Dev.to DevOps
원문 사이트 ↗Dev.to DevOps 섹션은 인프라·CI/CD·컨테이너·모니터링 등 DevOps 실무 콘텐츠가 모이는 카테고리로, Kubernetes, Terraform, Docker, 옵저버빌리티 도구 사용기와 사례 연구가 풍부합니다. 한국 SRE·DevOps 엔지니어에게 글로벌 도구 트렌드 학습 자료로 추천합니다.
Dev.to DevOps 주요 토픽
Dev.to DevOps 관련 글 — 52 페이지
- 8
실시간 IoT 플랫폼, 강제 앱 업데이트 없이 자체 호스팅 Kubernetes에서 이전하기
문서화되지 않은 레거시 시스템을 백업본만으로 재구성하여 AWS에서 GCP로 인프라를 이전한 사례를 다룹니다. 앱 업데이트 없이 WebSocket 프록시와 듀얼 라이트(Dual-write) 전략을 활용해 사용자 중단과 데이터 손실 없이 클라우드 네이티브 환경으로의 전환을 달성했습니다.
Migrating a live IoT platform off self-hosted Kubernetes - without a single forced app update↗dev.to
- 9
AI 에이전트가 죽는 7가지 방법을 기록했습니다. 이 모든 것을 막는 해결책은 이것입니다.
AI 에이전트는 기존 소프트웨어와 달리 오류 발생 시 에러 로그를 남기지 않고도 문법적으로 완벽한 오답을 내놓는 특성이 있어, 전통적인 APM으로는 감지가 불가능합니다. 이를 해결하기 위해 에이전트의 추론 경로를 기록하는 'Trace'와 결과의 정당성을 검증하는 'Assertion' 중심의 새로운 모니터링 체계가 필요합니다.
I Documented All 7 Ways an AI Agent Can Die. Here is the One Fix That Stops Them All↗dev.to
- 11
Grok 구독이 에이전트 운영의 저렴한 방법이라고 생각했지만, 제한 사항이 이상해질 때까지
Grok 구독(OAuth) 방식은 설정이 간편하지만 사용량 제한과 계정 자격에 따른 불확실성이 커서 24/7 운영되는 에이전트에게는 위험할 수 있습니다. 반면 API 방식은 비용은 더 높을 수 있어도 예측 가능한 운영이 가능하며, 효율적인 에이전트 구축을 위해서는 단일 거대 모델 대신 작업을 분산하는 전문화된 워커 구조를 채택해야 합니다.
I thought Grok subscriptions were the cheap way to run agents until the limits got weird↗dev.to
- 13
리디렉션 도메인은 인프라다: t.me 중단 사고에서 배우는 점
텔레그램의 t.me 도메인이 규제 이슈로 인해 일시적으로 접속 불능 상태가 된 사건을 분석하며, 리디렉션 도메인을 단순한 URL이 아닌 관리해야 할 인프라로 정의합니다. 도메인, DNS, TLS, 규칙, 목적지 등 연결된 모든 계층의 가용성을 점검하고, 장애 발생 시 피해 범위를 최소한으로 줄이기 위한 전략적 관리가 필요함을 강조합니다.
Your Redirect Domain Is Infrastructure: What the t.me Outage Teaches Us↗dev.to
- 16
Kubernetes 1.35, containerd 1.x 지원 종료 버전: 2026년 업그레이드 가이드
Kubernetes 1.35는 containerd 1.x 버전을 지원하는 마지막 릴리스이며, 이후 버전부터는 containerd 2.0이 필수 요구사항이 됩니다. 이번 업데이트는 CRI 플러그인 경로와 레지스트리 설정 방식의 변경을 포함하므로, 단순한 버전 업그레이드를 넘어 노드 구성의 전면적인 재검토가 필요합니다.
Kubernetes 1.35 is the last release supporting containerd 1.x: a 2026 upgrade guide↗dev.to
- 18
내 쿠버네티스 클러스터를 감시하는 AI 에이전트 구축하기 (망가뜨리지 않고)
Kentinel은 쿠버네티스 클러스터의 상태를 주기적으로 스냅샷하여 분석하고, 장애 발생 시 슬랙 등으로 알림을 보내며 챗봇을 통해 로그와 메트릭 조회를 지원하는 AI 에이전트입니다. 특히 AI에게 읽기 전용 권한만 부여하고 수정 사항은 인간의 승인을 거치게 설계되어, LLM 도입 시 우려되는 클러스터 파괴 리스크를 원천 차단했습니다.
I built an AI agent that watches my Kubernetes cluster (and can’t break it)↗dev.to
이 출처 페이지는 글 누적 후 검색엔진에 노출됩니다.














