프롬프트 엔지니어링 뉴스
LLM 프롬프트 설계, 시스템 프롬프트, 컨텍스트 엔지니어링, 프롬프트 인젝션 방어 등에 관한 글.
총 2,088건·최신 업데이트
- 1301
화웨이, KV 캐시 양자화를 위한 네이티브 vLLM 백엔드 KVarN 공개
화웨이가 개발한 KVarN은 vLLM에 즉시 적용 가능한 KV 캐시 양자화 기술로, 기존 방식과 달리 정확도 저하 없이 캐시 용량을 3~5배 확장하고 처리량을 높입니다. 하다마르 회전과 분산 정기화를 통해 아웃라이어를 제어함으로써, 긴 컨텍스트와 높은 동시 접속이 필요한 대규모 언어 모델(LLM) 서빙의 효율성을 획기적으로 개선합니다.
KVarN: Native vLLM backend for KV-cache quantization by Huawei↗github.com
- 1303
이 LLM들은 러시아 선전선동에 가장 잘 저항한다
에스토니아 언어 연구소(ELI)는 LLM이 러시아의 전략적 서사에 얼마나 잘 대응하는지 측정하는 '선전선동 저항(Propaganda Resistance)' 벤치마크를 공개했습니다. 테스트 결과 Anthropic의 Claude 모델이 가장 우수한 성능을 보였으며, 반면 Google의 Gemini 모델은 악의적인 프롬프트와 러시아어 질문에 취약한 모습을 보였습니다.
These LLMs are the best at resisting Russian propaganda↗arstechnica.com
- 1305
AI는 개발자를 대체하지 않지만, 시니어 엔지니어의 업무는 변화시키고 있다
AI는 보일러플레이트 작성이나 테스트 코드 생성 등 반복적 작업을 가속화하여 개발 생산성을 높이지만, 비즈니스 요구사항을 기술로 변환하는 의사결정 능력은 여전히 인간의 영역으로 남습니다. 미래의 핵심 역량은 단순 코딩이 아닌, AI에게 정확한 맥락을 제공하는 '컨텍스트 엔지니어링'과 시스템 설계 및 보안 검증 능력이 될 것입니다.
AI Won't Replace Developers — But It Is Changing What Senior Engineers Do↗dev.to
- 1306
제가 구축한 thredly: AI 컨텍스트 윈도우를 절대 죽게 하지 않는 Chrome 확장 프로그램
thredly는 ChatGPT, Claude, Deep점 등의 AI 사용 시 발생하는 컨텍스트 윈도우 포화 문제를 해결하는 크롬 확장 프로그램입니다. 기존 대화의 핵심 의도와 결정을 요약하여 새로운 채팅 세션에 자동으로 주입함으로써, 사용자가 맥락을 잃지 않고 연속성 있는 작업을 이어갈 수 있도록 돕습니다.
How I built thredly: a Chrome extension that never lets your AI context window die↗dev.to
- 1307
알림 해킹을 통한 간접 프롬프트 주입, Android의 Google Gemini 공격
SafeBreach 연구원은 WhatsApp, Slack 등 다양한 앱의 알림을 통해 Google Gemini의 Android Utilities 기능을 공격하는 간접 프롬프트 주입 기법을 공개했습니다. 공격자는 다국어 난독화와 숨겨진 링크를 이용해 사용자가 인지하지 못한 상태에서 민감한 기기 동작을 실행하도록 유도할 수 있습니다.
Indirect Prompt Injection via Notifications Hijacks Google Gemini on Android↗dev.to
- 1317
- 1318
마이크로 SaaS 창업자를 위한 AI 자동화: 이탈 분석 및 맞춤형 재획득 캠페인 초안 자동화 방법
이 글은 마이크로 SaaS 운영자가 반복적인 업무를 줄이기 위해 AI를 활용하여 고객 이탈을 분석하고 맞춤형 재획락 캠페인을 자동화하는 방법을 다룹니다. 무료 도구부터 시작해 측정 가능한 워크플로우를 구축하고 프롬프트를 표준화하는 단계적 접근법을 제안합니다.
AI Automation for Ai For Micro Saas Founders How To Automate Churn Analysis And Personalized Win Back Campaign Drafts: Quick ...↗dev.to
- 1319
오늘의 오픈 소스 프로젝트 (#85): OpenAI의 초고속 BPE 토크나이저, tiktoken
OpenAI의 GPT 모델 시리즈에서 사용하는 공식 BPE 토크나이저인 tiktoken의 기능과 활용법을 소개합니다. Rust 기반의 고성능 아키텍처를 통해 텍스트를 토큰화하고, 이를 통해 API 비용 예측, RAG를 위한 문서 분할, 컨텍스트 창 관리 등 LLM 애플리케이션 개발의 핵심적인 최적화 작업을 수행할 수 있습니다.
Open Source Project of the Day (#85): tiktoken - OpenAI's Blazing-Fast BPE Tokenizer↗dev.to











