AI 모델 (LLM·GPT·Claude·Gemini)
GPT, Claude, Gemini, Llama 등 AI 모델(LLM) 출시·벤치마크·API 변경사항을 모읍니다.
최신 업데이트
AI 모델 관련 글 — 161 페이지
- 0
OpenAI, 2024년 50억 9천만 달러 순손실에서 2025년 385억 3천만 달러 순손실로 증가
OpenAI의 재무 제표 유출에 따르면, 2025년 예상 순손실은 전년 대비 대폭 증가한 385억 달러에 달할 것으로 전망됩니다. 이는 AI 인프라 구축과 R&D를 위한 막대한 비용 지출이 매출 성장을 압도하고 있음을 보여주며, AI 산업의 지속 가능성에 대한 회의론을 불러일으키고 있습니다.
OpenAI Went From $5.09 Billion Net Loss in 2024 to $38.53 Billion Net Loss in 2025↗cleantechnica.com
- 8
Show HN: fenic – 데이터프레임 연산자로서의 LLM, 의미 및 구조 질의
fenic은 LLM 기반의 추출, 분류, 요약 등의 기능을 SQL/PySpark 스타일의 연산자로 제공하는 시맨틱 데이터프레임 엔진입니다. 이를 통해 비정형 데이터를 타입이 지정된 구조적 데이터로 변환하며, 단순한 챗봇 응답을 넘어 검증 및 재사용이 가능한 지속 가능한 데이터 파이프라인 구축을 가능하게 합니다.
Show HN: fenic – LLMs as dataframe operators, query meaning and structure↗github.com
- 9
Show HN: 기기 최적화를 통해 로컬 LLM 속도 및 안정성 향상 방법
llm-autotune은 Ollama와 사용자 코드 사이에서 작동하는 투명 프록시로, KV 캐시 최적화 및 시스템 RAM 상태에 따른 동적 정기 조절을 통해 메모리 사용량을 줄이고 첫 토큰 생성 속도를 최대 53%까지 높여줍니다. 특히 시스템 프롬프트 캐싱과 모델 상주 기능을 통해 멀티턴 대화의 효율성을 극대화합니다.
Show HN: Makes local LLMs faster and more reliable by optimizing for your device↗autotunellm.com
- 15
인기 오픈소스 LLM 게이트웨이에 대한 MCP-게이트웨이 프로덕션-레디니스 감사를 실시했습니다. 결과는 다음과 같습니다.
오픈소스 LLM 게이트웨이인 LiteLLM을 대상으로 MCP(Model Context Protocol) 환경에서의 프로덕션 준비성을 심층 감사한 결과, 보안과 관측성 등 주요 지표에서 높은 점수를 받았습니다. 다만, 특정 권한 확인 로직에서 예외 발생 시 'fail-open'되는 리스크가 발견되어 실제 배포 시에는 추가적인 하드닝(Hardening)이 필요하다는 결론을 내렸습니다.
I ran an MCP-gateway production-readiness audit on a popular open-source LLM gateway. Here's what it found.↗dev.to
- 17
첫인상: 저스트뷰그, 순수 C/CUDA로 구축된 나노유러 GPT-2 스케일 LLM 출시
나노유러(NanoEuler)는 PyTorch와 같은 기존 프레임워크 없이 순수 C/CUDA로만 구축된 약 1억 1,600만 파라미터 규모의 오픈소스 언어 모델입니다. 백프로파게이션부터 FlashAttention까지 모든 과정을 직접 구현하여, 외부 라이브러리 종속성 없는 투명하고 이동성이 높은 학습 스택을 제공합니다.
First Look: JustVugg Releases NanoEuler GPT-2 Scale LLM Built in Pure C/CUDA↗dev.to
- 20
AI 연산 방식 변화로 하드웨어 부담을 줄일 수 있다는 연구 결과
기존 AI 모델 경량화 방식인 양자화는 정밀도를 낮춤에 따라 정확도가 급격히 떨어지는 한계가 있었으나, SEMQ 기술은 임베딩의 의미적 관계를 보존하면서 수치적 표현을 분리하는 새로운 접근법을 제시합니다. 실험 결과, SEMQ는 기존 FP32 모델과 거의 동일한 수준의 정확도를 유지하면서도 효율적인 데이터 저장이 가능함을 입증했습니다.
Changing AI math could reduce the hardware burden, researchers show↗theregister.com
- 22
새로운 공격 방식, AI 브라우저가 위험한 이유를 또다시 증명하다
최근 연구에 따르면 공격자가 웹사이트 내의 논리적 모순을 이용해 AI 브라우저를 '가상 현실' 상태로 유도함으로써 기존의 보안 가드레일을 무력화하는 'BioShocking' 공격이 가능함이 밝혀졌습니다. 이 공격은 AI 에이전트가 가진 강력한 권한을 악용하여 비밀번호나 개인 저장소 코드를 탈취할 위험을 내포하고 있습니다.
New attack provides one more reason why AI browsers are a bad idea↗arstechnica.com















