GPT 모델 뉴스
OpenAI GPT 시리즈 모델(GPT-4, GPT-5, GPT-o)의 기술 발전과 벤치마크 소식을 전합니다.
총 164건·최신 업데이트
- 61
페이블 5 vs. GPT-5.6 솔루션: NP-Hard 문제에서 /goal은 도움이 될까?
복잡한 네트워크 설계 문제를 통해 Claude Fable 5와 GPT-5.6 Sol의 추론 능력을 비교한 결과, Fable 5가 훨씬 강력한 원시 지능과 안정성을 증명했습니다. 특히 /goal 모드는 모델의 탐색 방식을 재설정하며, 승률은 높일 수 있으나 평균적인 최적화 성능을 오히려 떨어뜨릴 수 있는 양날의 검임이 밝혀졌습니다.
Fable 5 vs. GPT-5.6 Sol on an NP-Hard Problem: Does /goal help?↗charlesazam.com
- 67
GPT-5.6 솔 공개: OpenAI의 주력 모델, 정부 검토를 통과하며 역대 최고 91.9% 코딩 점수 기록
OpenAI가 강력한 보안 및 코딩 능력을 갖춘 GPT-5.6 모델군(Sol, Terra, Luna)을 공식 출시했습니다. 이번 모델은 미 정부의 보안 검토를 통과했으며, 용도와 비용에 따른 세분화된 가격 정책을 통해 기업용 AI 시장 공략을 가속화할 전망입니다.
GPT-5.6 Sol Goes Public: OpenAI's Flagship Breaks Government Review with Record 91.9% Coding Score↗dev.to
- 70
OpenAI GPT-5.6 Sol, Terra, 그리고 Luna가 아마존 Bedrock에서 일반 출시되었습니다.
OpenAI의 새로운 모델 라인업인 GPT-5.6 Sol, Terra, Luna가 Amazon Bedrock에서 일반 출시되었습니다. 이번 업데이트는 용도에 따른 세분화된 모델 티어와 프롬프트 캐싱을 통한 비용 절감, 그리고 강력한 보안 및 데이터 거버넌스 기능을 제공하여 기업용 AI 에이전트 개발의 효율성을 극대화합니다.
OpenAI GPT-5.6 Sol, Terra, and Luna are now generally available on Amazon Bedrock↗aws.amazon.com
- 72
gpt-5.6-sol이 PowerShell의 $HOME 변수 충돌로 사용자 홈 디렉터리를 날려버릴 뻔한 건에 대하여
최신 AI 모델 gpt-5.6-sol을 사용하는 과정에서 PowerShell의 $HOME 내장 변수와 에이전트가 생성한 $home 변수가 충돌하여 사용자 홈 디렉터리가 삭제될 뻔한 사고가 발생했습니다. 다행히 시스템 파일 잠금 덕분에 전면 삭제는 면했으나, 일부 설정 파일이 손실되는 피해를 입었습니다. 이는 AI 에이전트의 도구 실행 권한 부여 시 환경 격리의 중요성을 시사합니다.
GeekNews↗news.hada.io
- 74
프로덕션 AI 에이전트, GPT-5.6으로 마이그레이션: 2.2배 빠른 속도, 27% 저렴한 비용
AI 에이전트 서비스 Ploy는 성능과 비용 효율성을 극대화하기 위해 주력 모델을 Claude Opus에서 GPT-5.6 Sol로 마이그레이션했습니다. 이 과정에서 모델 교체가 단순한 프롬프트 수정을 넘어, 도구 호출 방식 및 평가 체계(Eval Harness)의 근본적인 재설계를 요구한다는 기술적 도전 과제를 보여줍니다.
Migrating a production AI agent to GPT-5.6: 2.2x faster, 27% cheaper↗ploy.ai













![[pdf] GPT-5.6 Sol Ultra가 제시한 사이클 이중 덮개 추측 증명](https://startupschool.cc/og/pdf-gpt-56-sol-ultra가-제시한-사이클-이중-덮개-추측-증명-12a076.jpg)
![[7월10일] GPT-5.6이 보여준 '파레토 프론티어' 경쟁...벤치마크 기준이 바뀌기 시작](https://startupschool.cc/og/7월10일-gpt-56이-보여준-파레토-프론티어-경쟁벤치마크-기준이-바뀌기-시작-8d9cc4.jpg)