프롬프트 엔지니어링 뉴스
LLM 프롬프트 설계, 시스템 프롬프트, 컨텍스트 엔지니어링, 프롬프트 인젝션 방어 등에 관한 글.
총 2,076건·최신 업데이트
- 865
앤스로픽, 자체 칩 개발 중, 팔란티어는 토큰 모델을 “잘못된 것”이라고 지적하고, AI 브라우저는 현실 점검을 받다
Anthropic이 엔비디아 의존도를 낮추기 위해 자체 AI 칩 개발에 착수했으며, Palantir는 데이터 주권을 위협하는 토큰 기반 과금 모델의 부당함을 지적했습니다. 또한, AI 브라우저가 컨텍스트 조작을 통해 보안 가드레일을 우회할 수 있는 새로운 공격 방식이 발견되어 AI 에이전트 시대의 보안 경고등이 켜졌습니다.
Anthropic Is Building Its Own Chip, Palantir Calls the Token Model "Wrong," and AI Browsers Got a Reality Check↗dev.to
- 870
Show HN: Context.md - AI 프로젝트 컨텍스트를 위한 제안 표준
AI 에이전트가 코드의 결과뿐만 아니라 결정 배경과 실패한 대안까지 이해할 수 있도록, 버전 관리 시스템(Git) 내에 지속적으로 업데이트되는 'Repository Context Layer'를 구축해야 한다는 제안입니다. 이는 단순한 문서화를 넘어 에이전트가 실행 후 스스로 맥락을 갱신하고 인간이 이를 리뷰하는 양방향 구조를 지향합니다.
Show HN: Context.md – A proposed standard for AI project context↗github.com
- 872
DSpy를 활용하여 Datasette Agent의 SQL 시스템 프롬프트 평가 및 개선하기
이 글은 DSPy 프레임워크를 사용하여 Datasette Agent의 SQL 쿼리 생성 성능을 평가하고 최적화하는 과정을 다룹니다. Claude Code와 같은 AI 에이전트를 활용해 시스템 프롬프트의 취약점을 찾아내고, 스키마 정보 제공 방식을 개선함으로써 LLM의 실행 오류를 줄이는 구체적인 사례를 보여줍니다.
Using DSPy to evaluate and improve Datasette Agent's SQL system prompts↗simonwillison.net
- 877
AI 페어 세션 녹화기" 구축을 고려 중입니다 — 팀에 도움이 될까요?
AI 코딩 에이전트의 작업 과정(프롬프트, 편집 내역, 터미널 출력 등)을 공유 가능한 타임라인 형태로 기록하는 도구 개발에 대한 아이디어 검증 글입니다. 이 도구는 단순한 코드 차이(diff)를 넘어 에이전트의 의사결정 과정을 시각화하여 팀원 간 지식 공유와 신규 개발자 온보딩을 개선하는 것을 목표로 합니다.
I'm considering building an "AI pair-session replay recorder" — would this help your team?↗dev.to
- 880
AI 에이전트가 스스로 프롬프트를 재작성하게 했습니다. 더 악화되지 않게 하는 게 어려웠습니다.
이 기사는 AI 에이전트가 스스로 프롬프트를 재작성하며 진화할 때 발생하는 성능 저하 및 안전성 결여 문제를 다룹니다. 저자는 단순한 루프 구현보다, 회귀 방지, 데이터 품질 감시, 정렬 체크 및 통계적 A/B 테스트를 통해 에이전트의 진화를 제어하는 '게이트' 시스템의 중요성을 강조합니다.
I let my AI agents rewrite their own prompts. The hard part was stopping them from getting worse.↗dev.to












