프롬프트 엔지니어링 뉴스
LLM 프롬프트 설계, 시스템 프롬프트, 컨텍스트 엔지니어링, 프롬프트 인젝션 방어 등에 관한 글.
총 2,058건·최신 업데이트
- 204
DeepSeek-V4 프로: 모두가 성능 테스트하고, 저는 실제 비즈니스 시나리오에서 사용 중입니다.
DeepSeek-V4 Pro는 1.6조 개의 파라미터와 100만 토큰의 컨텍스트 창을 제공하며, 기존 GPT급 모델 대비 약 1/10한 수준의 혁신적인 가격을 제시합니다. 이 글은 단순한 성능 지표를 넘어, 저렴한 비용을 활용해 복잡한 에이전트 워크플로우와 정교한 엔지니어링을 구축하는 것이 비즈니스의 핵심임을 강조합니다.
"DeepSeek-V4 Pro: Everyone Is Benchmarking It, I'm Running It in Real Business Scenarios"↗dev.to
- 206
대규모 MCP 도구 레지스트리를 컨텍스트에 전부 로드하지 않고도 사용 가능하게 유지하기
대규모 MCP 도구 레지스트리가 모델의 컨텍스트를 과도하게 점유하여 성능을 저하시키는 문제를 해결하기 위해, 모든 도구를 한 번에 로드하는 대신 검색 기반의 단계적 노출 방식을 제안합니다. 이를 통해 토큰 비용을 절감하면서도 에이전트가 필요한 시점에만 정확한 도구 정의를 참조하도록 설계함으로써 시스템의 효율성과 신뢰성을 확보할 수 있습니다.
Keeping a Large MCP Tool Registry Available Without Loading It All Into Context↗dev.to
- 212
Show HN: StarryKit – 편집 가능한 슬라이드, 포스터 및 모든 시각 디자인을 위한 MCP
StarryKit은 AI 에이전트가 시각적 디자인 작업을 수행할 수 있도록 돕는 MCP(Model Context Protocol) 기반의 플러그인입니다. 사용자는 텍스트 프롬프트나 기존 이미지를 활용해 편집 가능한 슬라이드, 포스터, 소셜 미디어 그래픽 등을 생성하고 다양한 형식으로 내보낼 수 있습니다.
Show HN: StarryKit – MCP for editable slides, posters and all visual designs↗github.com
- 215
엔비디아, 치솟는 기업용 AI 비용 해결책은… 라우터?
엔비디아가 프롬프트 요청을 적절한 모델로 자동 배분하여 비용과 성능을 최적화하는 소프트웨어 플랫폼 'NeMo Switchyard'를 공개했습니다. 이 기술은 단순 작업은 저렴한 소형 모델에, 복잡한 작업은 고성능 모델에 할당함으로써 대규모 언어 모델(LLM) 사용 시 발생하는 막대한 추론 비용을 최대 74%까지 절감할 수 있습니다.
Nvidia's latest solution to soaring enterprise AI costs is...a router?↗theregister.com
- 217
NVIDIA GB300 NVL72에서 조정 가능한 추론 기능을 갖춘 2.4T 파라미터 모델 Qwen3.8-2.4T-A95B 서비스
알리바바가 공개한 2규모의 오픈 웨이트 모델 Qwen3.8-2.4T-A95B가 엔비디아 블랙웰 기반 GB300 NVL72에서 압도적인 추론 성능을 구현했습니다. 이 모델은 MoE 구조와 하이브리드 어텐션 기술을 통해 최대 100만 토큰의 긴 컨텍스트를 효율적으로 처리하며, 사용자가 작업에 따라 추론 깊이를 조절할 수 있는 기능을 제공합니다.
Serve Qwen3.8-2.4T-A95B, a 2.4T-Parameter Model, with Configurable Reasoning on NVIDIA GB300 NVL72↗developer.nvidia.com













