VentureBeat AI
원문 사이트 ↗VentureBeat AI의 영문 기사를 한국어 제목·분석과 함께 큐레이션합니다.
VentureBeat AI 주요 토픽
VentureBeat AI 관련 글 — 8 페이지
- 1
모건 스탠리, AI, API, GPU 활용해 가장 위험했던 업무 절반으로 축소 – 에이전트의 자율성 감소로
모건스ernetes탠리는 금융 업무 중 정확도가 생명인 손익(P&L) 조정 프로세스에 AI 에이전트를 적용하여 업무 시간을 50% 절감했습니다. 특히 주목할 점은 완전 자율형 AI가 아닌, 인간의 판단을 반복 가능한 규칙으로 변환하는 '제한적 자율성' 모델을 통해 성공을 거두었다는 것입니다.
Morgan Stanley cut its riskiest reconciliation job in half — by making its agents less autonomous↗feeds.feedburner.com
- 2
Anthropic, 최고 모델 대비 파격적인 할인 가격으로 Claude Sonnet 5 출시… 폭발적인 IPO를 향해 속도 높여
앤스로픽이 고성능과 합리적인 가격을 동시에 잡은 클로드 소네트 5를 새롭게 선보였습니다. 이번 모델은 특히 개발자들이 강력한 에이전트 기능을 활용할 수 있도록 비용 효율성을 극대화했으며, 이는 상장을 준비 중인 앤스로픽의 전략적 행보로 풀이됩니다.
Anthropic launches Claude Sonnet 5 at a steep discount to its top model as the company races toward a blockbuster IPO↗feeds.feedburner.com
- 3
Google Gemini Omni Flash, API 출시로 기업 비디오 제작을 대화형으로 전환
구글의 Gemini Omni Flash API 출시로 인해 기존의 막대한 비용과 긴 시간이 소요되던 기업용 영상 제작 프로세스가 대화형 방식으로 변화할 전망입니다. 이는 기획부터 편집, 수정에 이르는 복잡한 단계를 단순화하여 텍스트 변경만으로도 즉각적인 영상 업데이트를 가능하게 합니다.
Google's Gemini Omni Flash hits the API, turning enterprise video production into a conversation↗feeds.feedburner.com
- 4
구글, 저렴한 비용으로 4초 만에 엔터프라이즈 이미지 생성 가능한 Nano Banana 2 Lite (Gemini 3.1 Flash-Lite) 공개
구글이 비용 효율성과 속도에 최적화된 이미지 생성 모델인 Nano Banana 2 Lite(Gemini 3.1 Flash-Lite Image)를 발표했습니다. 이 모델은 건당 $0.034의 저렴한 비용으로 매우 빠른 이미지 생성 성능을 제공하여 인프라 예산이 제한적인 환경에서도 효율적인 활용이 가능합니다.
Google unveils Nano Banana 2 Lite aka Gemini 3.1 Flash-Lite for low cost, 4-second fast enterprise image generations↗feeds.feedburner.com
- 5
AI 에이전트는 클라우드가 따라올 수 없는 곳까지도 모든 환경에서 컨텍스트를 필요로 한다
Couchbase는 AI 에이전트에게 필요한 메모리, 실시간 컨텍스트 검색, MCP 서버 관리를 단일 플랫폼으로 통합한 'AI 데이터 플레인'을 발표했습니다. 이는 캐싱 및 고성능 트랜잭션 아키텍처를 활용해 클라우드를 넘어 모든 환경에서 에이전트의 의사결정을 지원하는 것을 목표로 합니다.
AI agents need context everywhere they run, even where the cloud can't follow↗feeds.feedburner.com
- 6
美트완, 중국산 칩으로만 학습된 1.6T 규모의 에이전트 코딩 모델 LongCat-2.0 오픈소스 공개 — OpenRouter 선도
중국 배달 플랫폼 메이<0xED><0x87><0x98>(Meituan)이 그동안 'Owl Alpha'라는 익명으로 알려졌던 1.6조 파라미터 규모의 MoE 모델 LongCat-2.0을 오픈소스로 공개했습니다. 이 모델은 중국산 칩만을 활용해 학습되었으며, 강력한 코딩 에이전트 기능을 통해 기존 독점적 엔터프라이즈 AI 시스템을 대체하는 것을 목표로 합니다.
Meituan open sources LongCat-2.0, the 1.6T, near-frontier agentic coding model that's been leading OpenRouter — trained entirely on Chinese chips↗feeds.feedburner.com
- 8
Sentry를 통해 클로드 코드 해킹 공격 발생, Datadog, PagerDuty, Jira도 동일한 취약점 노출
Tenet Security는 Sentry의 가짜 오류 이벤트를 통해 Claude Code, Cursor 등 AI 에이전트에 공격 명령을 주입하는 '에이전트 재킹' 취약점을 공개했습니다. 이 공격은 별도의 인증 없이도 가능하며, Datadog이나 Jira 같은 주요 개발 도구들도 동일한 위험에 노출되어 있습니다.
The attack that hijacked Claude Code came through Sentry. Datadog, PagerDuty, and Jira have the same exposure.↗feeds.feedburner.com
- 9
프롬프트 인젝션이 에이전트, RAG 파이프라인 및 모델 라우터를 노려 기업 AI의 가장 큰 설계 결함을 악용
사이버 범죄자들이 LLM의 작동 특성과 실제 구현 방식 간의 차이를 이용해 프롬프트 인젝션 공격을 강화하고 있습니다. 특히 에이전트, RAG 파이프라인, 모델 라우터와 같은 기업용 AI 아키텍처의 구조적 취약점이 주요 타겟이 되고 있습니다.
Prompt injection is exploiting enterprise AI's biggest design flaws by targeting agents, RAG pipelines and model routers↗feeds.feedburner.com
- 10
Claude Code로 엔지니어 생산성이 세 배 증가, 이제 기업은 제품 전문가가 더 필요하다
앤스로픽은 클로드 코드를 도입한 이후 엔지니어링 조직의 결과물 산출 속도가 실제 인력의 약 3배에 달하게 되자, 개발자 대신 제품 관리자 채용을 확대하고 있습니다. 이는 기술적 구현 능력보다 '무엇을 만들 것인가'를 결정하는 기획 역량이 기업 경쟁력의 핵심으로 부상하고 있음을 보여줍니다.
Claude Code turned every engineer into three. Now companies need more product thinkers↗feeds.feedburner.com
- 11
새로운 에이전트 메모리 프레임워크, 쿼리당 118K 토큰 사용. LangMem은 326만 개 소모.
싱가포르 국립대학교 연구진이 AI 에이전트의 장기 추론 성능을 높이기 위한 MRAgent 프레임워크를 발표했습니다. 이 기술은 정적인 검색 방식에서 벗어나, 누적되는 증거에 따라 메모리를 동적으로 구축하고 재구성하여 컨텍스트 윈도우의 한계를 극복합니다.
New agentic memory framework uses 118K tokens per query. LangMem burns through 3.26M.↗feeds.feedburner.com
- 12
자율 보안 에이전트는 완전한 데이터를 필요로 합니다. 당신의 에이전트가 준비되었는지 확인하는 방법은 다음과 같습니다.
Axonius의 최신 보고서에 따르면, 엔드포인트 보안 에이전트가 설치되지 않은 기기가 전체의 약 12.7%에 달해 심각한 보안 공백이 발생하고 있습니다. 이러한 미설치 기기는 관리 콘솔에서 식별되지 않아 자율 보안 시스템의 운영을 방해하는 주요 원인이 됩니다.
Autonomous security agents need complete data. Here's how to check if yours is ready.↗feeds.feedburner.com
- 13
OpenAI, GPT-5.6 Sol, Terra 및 Luna 모델 공개…현재는 제한된 프리뷰 파트너만 접근 가능, 미국 정부 발표에 따르면
OpenAI가 복잡한 코딩용 Sol, 비즈니스 업무용 Terra, 일상 자동화용 Luna로 구성된 GPT-5.6 모델 패밀리의 제한적 프리뷰를 발표했습니다. 이번 업데이트는 특정 작업에 최적화된 모델 분화를 통해 성능과 효율성을 동시에 극대화하는 데 초점을 맞추고 있습니다.
OpenAI unveils GPT-5.6 Sol, Terra and Luna models — but only accessible to limited preview partners for now, per US Gov↗feeds.feedburner.com
- 14
대부분의 기업은 소프트웨어 공장을 건설한다고 생각하지만, 실제로는 버그를 더 빠르게 출시하고 있습니다.
LLM의 등장으로 소프트웨어 개발 방식이 산업화된 공장처럼 대량, 저비용, 고속 생산 체제로 변화하고 있습니다. 이는 기존의 표준 개발 라이프사이클과 CI/CD 프로세스가 감당하기 어려운 수준의 압력을 창출하며 새로운 개발 패러다임을 요구합니다.
Most companies think they're building a software factory. They're actually just shipping bugs faster.↗feeds.feedburner.com
- 15
Liquid AI의 최소 모델, LFM2.5-230M: 데이터 추출 성능은 크기보다 4배 큰 모델 압도, '어디든' 실행 가능
Liquid AI가 2억 3천만 개의 파라뮬터를 가진 초소형 언어 모델 LFM2.5-230M을 공개했습니다. 이 모델은 스마트폰, 노트북, 로봇 등 다양한 기기에서 로컬로 실행 가능하며 특히 데이터 추출 작업에서 탁월한 성능을 발휘하도록 설계되었습니다.
Liquid AI's smallest model yet LFM2.5-230M beats models 4X its size at data extraction, can run 'anywhere'↗feeds.feedburner.com
- 16
OpenAI의 업데이트된 GPT-5.5 Instant는 쇼핑, 복잡한 제약 조건, 사용자 의도 파악에 더 능숙하며 이미 API에 탑재 완료
OpenAI가 ChatGPT 무료 버전의 기반인 GPT-5.5 Instant 모델을 업데이트하여 사용자 의도 파악 및 응답 조정 능력을 향상시켰습니다. 이번 업데이트에는 쇼핑 결과와 지역 추천, 복잡한 작업 처리 능력 개선이 포함되어 더욱 개인화된 경험을 제공합니다.
OpenAI's updated GPT-5.5 Instant is better at shopping, complex constraints, and understanding user intent — and it's already in the API↗feeds.feedburner.com
- 17
기업용 AI 에이전트는 어떤 모델이 어떤 작업에 적합한지 자동으로 기억해야 합니다. 마인스톤은 리벨을 통해 해당 기능을 구축했습니다.
런던 기반 AI 스타트업 Mindstone가 에이전트 오케스트레이션 플랫폼인 'Rebel'을 공식 출시했습니다. 이 시스템은 작업에 가장 적합한 모델을 스스로 기억하는 기능을 갖춘 로컬 우선(local-first) AI 운영체제로, 소규모 팀을 위해 Fair Source 라이선스로 제공됩니다.
Your enterprise AI agents should automatically remember which model is right for which task. Mindstone built the capability with Rebel↗feeds.feedburner.com
이 출처 페이지는 글 누적 후 검색엔진에 노출됩니다.

