Dev.to 뉴스
총 16,915건·최신 업데이트
- 4641
Spring AI + Langfuse: ObservationFilter를 활용한 스트리밍 추적
기존 Spring AI의 CallAdvisor 방식은 스트리밍 응답 추적에 한계가 있으며, 실행 흐름을 방해할 수 있는 StreamAdvisor 대신 ObservationFilter를 활용한 새로운 접근법을 제안합니다. 이 방법은 모델 호출 로직을 건드리지 않고도 프롬프트와 응답 데이터를 Langfuse와 같은 관측 도구에 효율적으로 전달하여 정교한 트레이싱을 가능하게 합니다.
Spring AI + Langfuse: Tracing Streaming with ObservationFilter↗dev.to
- 4649
한 업체 업데이트가 다른 업체의 캐시를 최신 것처럼 보이게 하지 마세요
이 글은 멀티 소스 데이터를 다루는 시스템에서 한쪽의 성공적인 업데이트가 다른 쪽의 오래된 데이터까지 최신인 것처럼 오도하는 '타임스탬프 세탁' 문제를 지적합니다. 해결책으로 각 공급자별로 독립적인 타임스탬프를 관리하고, 에러나 빈 응답을 신선한 데이터로 오인하지 않도록 설계할 것을 제안하며 시스템의 정직성을 강조합니다.
Do Not Let One Provider Refresh Make Another Provider's Cache Look Fresh↗dev.to
- 4650
Claude Code 및 Codex 세션의 긴급도를 기준으로 순위를 매기는 방법
이 글은 Claude Code나 Codex와 같이 다중 AI 세션이 활성화된 환경에서 단일 UI 모니터에 어떤 상태를 우선적으로 표시할 것인가에 대한 엔지니어링 전략을 다룹니다. 단순한 시간순 정렬 대신 작업의 실행 가능성(Action성을 기준으로 우선순위를 매기고, 최신성은 동점자 처리용으로만 사용하는 'Classify first, aggregate second' 원칙을 강조합니다.
How to Rank Multiple Claude Code and Codex Sessions by Urgency↗dev.to
- 4653
AWS 비용 85% 절감하며 수백만 사용자 규모로 확장 – 시스템 설계 사례 연구
단일 리전 S3 버킷 사용 시 발생하는 글로벌 레이턴시와 오리진 부하 문제를 CloudFront CDN 도입을 통해 해결한 사례입니다. 특히 기존 종량제(Pay-as-you-go) 대신 고정 요금제(Pro plan)를 선택함으로써 아키텍처 변경 없이도 월 비용을 약 85% 절감할 수 있음을 보여줍니다.
We Cut AWS Costs 85% While Scaling to Millions of Users - A System Design Case Study.↗dev.to
- 4655
35k+ RPS 환경에서 API 속도 제한기 성능 비교: Nginx, Python, Rust
본 기사는 Nginx, Python(aiohttp), Rust(Axum/Tokio) 세 가지 엔진을 활용해 API Rate Limiter의 성능을 벤치마크한 결과를 다룹니다. 실험 결과, 트래픽 차단이 활성화된 상황에서 Rust는 초당 약 36,000건 이상의 요청을 처리하며 타 엔진 대비 압도적인 효율성을 보여주었습니다.
Benchmarking API Rate Limiters at 35k+ RPS: Nginx vs. Python vs. Rust↗dev.to
- 4659
🤔 `kubectl apply` 실행 시 정말 무슨 일이 벌어질까? 에피소드 3
이 글은 kubectl apply 명령이 단순한 실행을 넘어, API 서버의 검증부터 ETCD 저장, 컨트롤러 매니저의 상태 조정, 스케줄러의 노드 할당, 그리고 Kubelet과 컨테이너 런타임의 실행에 이르는 일련의 과정을 추적합니다. 쿠버네티스의 각 컴포넌트가 어떻게 협력하여 '원하는 상태(Desired State)'를 구현하는지 보여줍니다.
🤔 What Really Happens When You Run kubectl apply? Episode 3↗dev.to












