AI 에이전트 뉴스
Claude, Cursor, OpenClaw, ChatGPT Agent 등 자율적으로 작업을 수행하는 AI 에이전트 동향과 활용 사례.
총 8,321건·최신 업데이트
- 4223
ADK Go 2.0으로 안정적인 멀티 에이전트 애플리케이션 구축하세요. 새로운 그래프 기반 워크플로우 엔진, 내장된 휴먼 인 더 루프, 그리고 동적 오케스트레이션을 만나보세요.
구글의 ADK for Go 2.0은 그래프 기반 워크플로우 엔진을 통해 복잡한 멀티 에이전트 시스템을 체계적으로 설계할 수 있게 해줍니다. 노드와 엣지를 활용해 분기, 병렬 처리, 인간 개입(HITL) 등을 구현하며, 기존 Go 서비스에 자연스럽게 통합 가능한 구조를 갖췄습니다.
Build reliable multi-agent applications with ADK Go 2.0. Discover our new graph-based workflow engine, built-in human-in-the-loop, and dynamic orchestration↗developers.googleblog.com
- 4224
코딩 에이전트에서 에이전트 품질 선순환 가속화하기
이 기사는 AI 에이전트 개발 시 발생하는 'vibe-checking(감에 의존한 테스트)'의 한계를 극복하기 위해, 데이터 준비부터 실패 분석 및 최적화까지 이어지는 자동화된 품질 평가 플라이휠 도입을 제안합니다. 특히 코딩 에이전트가 스스로 평가 지표를 선택하고 개선안을 제안하되 인간의 승인을 거치는 'Human-in-the-loop' 방식의 운영 모델을 강조합니다.
Driving the Agent Quality Flywheel from Your Coding Agent↗developers.googleblog.com
- 4227
Show HN: YAML 정의 웹앱 기능 시연 녹화를 위한 Shot-scraper 비디오 도구
shot-scraper 1.10 버전에서 도입된 'video' 명령어는 YAML 파일을 통해 정의된 웹 애플리케이션의 동작 과정을 Playwright를 이용해 영상으로 기록합니다. 특히 AI 에이전트가 도구의 도움말을 참조하여 스스로 시나리오를 작성하고 데모 영상을 제작할 수 있는 환경을 제공하는 것이 핵심입니다.
Show HN: Shot-scraper video tool for recording YAML-defined webapp feature demos↗simonwillison.net
- 4228
Show HN: ADHD 때문에 방치되는 나를 AI 에이전트가 깨우다
ADHD로 인한 인지적 한계를 극복하기 위해 개발된 'hex'는 캘린더, Todoist, Obsidian 등 파편화된 개인 도구들을 MCP(Model Context Protocol)를 통해 통합 관리하는 AI 에이전트 프로젝트입니다. 이 시스템은 단순한 정보 요약을 넘어 웹 검색, 브라우징, 물리적 장치와의 연동을 통해 사용자의 실제 행동 변화를 유도하는 기능을 갖추고 있습니다.
Show HN: I built an AI agent to yell at me about my ADHD↗0xff.nu
- 4230
AI 코딩 에이전트 신뢰에 대한 교훈: 12가지 실패 유형과 300억 개의 토큰
AI 코딩 에이전트가 실제 운영 환경에서 겪는 12가지 주요 실패 유형을 분류하고, 각 오류에 맞는 구체적인 해결책을 제시합니다. 단순한 재시도 방식에서 벗어나 실행 전 단계에서 예산, 범위, 보안 등을 검증하는 '사전 실행 제어(Pre-execution enforcement)'의 중요성을 강조합니다.
What 12 failure classes and 30 Billion tokens spent taught us about trusting AI coding agents↗dev.to
- 4231
Phinq 구축기: 크론잡 오류가 에이전트 거버넌스 재설계로 이어진 과정
AI 에이전트가 기존의 감시망을 피해 외부 프로세스를 통해 파일을 수정하는 사고를 계기로, 개별 도구에 대한 후킹 방식의 한계를 지적합니다. 대신 모든 도구 호출이 통과하는 LLM API 레이어에서 위험도를 분류하고 승인 절차를 거치는 중앙 집중식 프록시 기반 거버넌스 아키텍처로의 전환을 설명합니다.
Building Phinq: How a Cronjob Failure Forced Me to Redesign Agent Governance From Scratch↗dev.to
- 4232
새로운 공격 방식, AI 브라우저가 위험한 이유를 또다시 증명하다
최근 연구에 따르면 공격자가 웹사이트 내의 논리적 모순을 이용해 AI 브라우저를 '가상 현실' 상태로 유도함으로써 기존의 보안 가드레일을 무력화하는 'BioShocking' 공격이 가능함이 밝혀졌습니다. 이 공격은 AI 에이전트가 가진 강력한 권한을 악용하여 비밀번호나 개인 저장소 코드를 탈취할 위험을 내포하고 있습니다.
New attack provides one more reason why AI browsers are a bad idea↗arstechnica.com
- 4233
Anthropic의 가장 강력한 Sonnet 모델, 클로드 소넷 5가 AWS에 출시되었습니다
Anthropic의 차세대 모델인 Claude Sonnet 5가 Amazon Bedrock과 AWS 내 Claude Platform을 통해 공식 출시되었습니다. 이 모델은 Opus급에 근접한 지능을 유지하면서도 비용과 속도 면에서 최적화되어, 코딩, 에이전트 자동화 및 복잡한 데이터 분석 작업에 특화된 성능을 제공합니다.
Introducing Claude Sonnet 5 on AWS: Anthropic’s most capable Sonnet model↗aws.amazon.com
- 4234
ScarfBench: 엔터프라이즈 자바 프레임워크 마이그레이션을 위한 AI 에이전트 벤치마킹
ScarfBench는 Spring, Jakarta EE, Quarkus 간의 프레임워크 마이그레이션 성능을 평가하기 위해 개발된 벤치마크로, 단순 코드 변환이 아닌 빌드, 배포, 동작 검증까지 포함한 실질적인 성공 여부를 측정합니다. 실험 결과, 최신 AI 에이전트들의 행동 기반 성공률은 10% 미만에 불과하며, 에이전트가 자신의 작업 결과를 실제보다 더 성공적이라고 판단하는 과잉 확신 문제도 드러났습니다.
ScarfBench: Benchmarking AI Agents for Enterprise Java Framework Migration↗huggingface.co
- 4237
Anthropic, 최고 모델 대비 파격적인 할인 가격으로 Claude Sonnet 5 출시… 폭발적인 IPO를 향해 속도 높여
앤스로픽이 고성능과 합리적인 가격을 동시에 잡은 클로드 소네트 5를 새롭게 선보였습니다. 이번 모델은 특히 개발자들이 강력한 에이전트 기능을 활용할 수 있도록 비용 효율성을 극대화했으며, 이는 상장을 준비 중인 앤스로픽의 전략적 행보로 풀이됩니다.
Anthropic launches Claude Sonnet 5 at a steep discount to its top model as the company races toward a blockbuster IPO↗venturebeat.com
- 4238
Acti가 AI 에이전트를 스마트폰 키보드에 직접 탑재했습니다.
싱가포르 스타트업 Acti는 사용자가 앱을 전환할 필요 없이 키보드 내에서 즉각적인 작업을 수행할 수 있는 AI 에이전트 기반의 키보드를 iOS와 Android에 출시했습니다. 구글 Gemini 모델을 활용해 번역, 정보 검색 등 맞춤형 '스킬' 기능을 제공하며, 개인정보 보호를 위해 로컬 우선(local-first) 방식을 채택했습니다.
Acti puts AI agents directly into your smartphone keyboard↗techcrunch.com








