AI 에이전트 뉴스
Claude, Cursor, OpenClaw, ChatGPT Agent 등 자율적으로 작업을 수행하는 AI 에이전트 동향과 활용 사례.
총 7,832건·최신 업데이트
- 481
Google의 에이전트 개발 키트로 제로 트러스트 AI 에이전트 구축하기
AI 에이전트가 데이터베이스를 수정하거나 코드를 실행할 수 있게 되면서 프롬프트 인기젝션을 통한 보안 사고 위험이 커지고 있습니다. 이를 해결하기 위해 시스템 프롬프트에 의존하는 대신, 암호화 서명, 코드 격리(gVisor), 결정론적 게이트웨이라는 3단계의 하드웨어 기반 보안 계층을 구축해야 한다고 제안합니다.
Build zero-trust AI agents with Google's Agent Development Kit↗developers.googleblog.com
- 482
Show HN: 내 플러그인을 잡아낸 AI 에이전트 가드레일 벤치마크
'holdline'은 AI 에이전트가 실행하는 작업(write-actions)을 감시하는 가드레일 플러그인의 성능을 측정하는 중립적인 벤치마크 도구입니다. 이 도구는 인젝션 공격에 대한 방어력, 캐치율, 오탐률 등을 정밀하게 평가하며, 개발자가 자신의 가드레일 성능을 객관적 데이터로 입증할 수 있는 환경을 제공합니다.
Show HN: A benchmark for AI agent guardrails that caught my own plugin↗github.com
- 485
181,874회의 미팅, 누락된 하나의 보안 규칙: tl;dv 유출은 아키텍처 레슨이다
AI 미팅 기록 서비스 tl;dv에서 Firestore 보안 규칙 누락으로 인해 약 18만 건의 회의 기록이 인증된 모든 사용자에게 노출되었습니다. 이번 사고는 AI 에이전트가 가진 광범위한 접근 권한과 기본적인 보안 관리 부실이 결합되었을 때 발생하는 막대한 데이터 유출 위험을 시사합니다.
181,874 meetings, one missing security rule: the tl;dv leak is an architecture lesson↗dev.to
- 491
seblight: 자율 에이전트 명령 실행을 위한 인증 권한
seblight는 자율 에이전트의 명령 실행 시 기존 IAM(신원 중심)의 한계를 넘어, 인증서 기반의 정밀한 권한 부여와 불변의 감사 로그를 제공하는 Python 솔루션입니다. 에이전트의 제안을 정책 엔진이 검토하여 승인된 명령에 대해서만 일회성 인증서를 발급하고 실행 과정을 기록함으로써 보안성을 극대화합니다.
seblight: autoridad certificada para la ejecución de comandos de agentes autónomos↗dev.to
- 493
contagion-networks: 평가자 편향 확산 측정 방법, 멀티 에이전트 시스템에서
LLM 에이전트들이 서로를 평가하는 멀티 에이전트 환경에서, 특정 모델의 편향이 네트워크를 통해 전염되어 전략적 다양성을 파괴하는 문제를 다룹니다. 수학적 지표인 방사 반지름(Spectral Radius)을 활용해 편향의 확산 단계를 억제, 지속, 폭주 세 가지 레짐으로 구분하고 이를 완도할 수 있는 구체적인 측정 및 완화 방법을 제시합니다.
contagion-networks: medir la propagación de sesgos de evaluador en sistemas multi-agente↗dev.to














