AI 모델 (LLM·GPT·Claude·Gemini)
GPT, Claude, Gemini, Llama 등 AI 모델(LLM) 출시·벤치마크·API 변경사항을 모읍니다.
최신 업데이트
AI 모델 관련 글 — 190 페이지
- 0
업라이트, 기업의 지속가능성 영향, 위험 및 기회를 정량화하는 새로운 AI 모델 출시
업라이트는 기업의 자발적 공시에 의존하지 않고 과학적 증거를 기반으로 지속가능성 리스크와 기회를 정량화하는 새로운 LLM을 출시했습니다. 이 모델은 EU Taxonomy, SFDR 등 글로벌 규제 대응을 지원하며, 투자자와 기업이 실시간으로 임팩트를 시나리오 모델링할 수 있도록 돕습니다.
Upright Launches New AI Model to Quantify Companies’ Sustainability Impacts, Risks and Opportunities↗esgtoday.com
- 1
Probably, 더욱 안정적인 AI 구축을 위해 900만 달러 투자 유치할 가능성
a16z로부터 900만 달러 규모의 시드 투자를 유치한 'Probably'는 LLM의 환각 현상을 방지하기 위해 결정론적 검증 시스템을 활용한 기술을 개발 중입니다. 이들은 정교한 '하네스 엔지니어링'을 통해 작은 모델로도 높은 정확도를 구현하며, 데이터 과학을 시작으로 의료 및 회계 등 정밀도가 필수적인 분야로 확장을 목표로 합니다.
Probably raises $9M to build a more reliable kind of AI↗techcrunch.com
- 6
인증서 없는 공개 키 암호화(CL-PKC)를 활용한 작동하는 SSL 인증서 대체 구축 - 실시간 데모 포함
0Cert는 인증 기관(CA)의 침해가 웹 전체의 신뢰를 무너뜨리는 기존 SSL/TLS의 구조적 결함을 해결하려는 PoC 프로젝트입니다. 사용자가 로컬에서 생성한 비밀키와 KGC가 발급한 부분 키를 결합하는 방식을 통해, 중앙 서버인 KGC조차 사용자의 트래픽을 훔쳐볼 수 없는 보안 모델을 구축했습니다.
I built a working SSL certificate replacement using Certificateless Public Key Cryptography (CL-PKC) – live demo inside↗dev.to
- 8
기업을 위한 AI 음성 에이전트: 기능, 비용, 그리고 2026년 사용자 현황
LLM 기반의 AI 보이스 에이전트가 단순한 자동응답기를 넘어 실시간 예약 및 업무 처리가 가능한 수준으로 진화하며 비즈니스 운영의 핵심으로 부상하고 있습니다. 이 기술은 응답 시간 단축을 통한 매출 증대와 인건비 절감이라는 명확한 ROI를 제공하며 의료 및 서비스 산업을 중심으로 빠르게 확산 중입니다.
AI Voice Agents for Business: What They Do, What They Cost, and Who's Using Them in 2026↗dev.to
- 10
프롬프트에서 사용하지 않는 청크의 검색 지연 시간 비용을 중단하세요
RAG 시스템 구축 시 벡터 스토어에서 가져온 청크 중 상당수가 프롬프트 구성 단계에서 필연적으로 필터링되어 토큰 낭비와 레이턴시를 초래합니다. ragscope는 OpenTelemetry를 활용해 검색된 데이터와 실제 사용된 데이터 사이의 간극을 측정함으로써, 비용 효율적인 RAG 운영을 위한 구체적인 최적화 가이드를 제공합니다.
Stop Paying For Retrieval Latency On Chunks You Never Use In The Prompt↗dev.to
- 11
AI는 제품 성능을 저하시키지 않았지만, 오히려 방향 감각을 더 빠르게 흐트러뜨렸다. 그래서 나는 ‘인텐트 데이터독’을 구축했다.
여러 LLM과 에이전트를 활용해 다수의 프로젝트를 동시에 진행할 때, 세션 간 컨텍텍스트 단절로 인해 제품의 본질적인 설계 결정이 유실되는 '의도 드리프트' 문제가 발생합니다. 이를 해결하기 위해 코드에서 의도를 추출하는 대신, 개발자가 직접 설계 제약 조건을 선언하고 실시간으로 일치 여부를 감시하는 '제품 지도(Product Map)' 중심의 새로운 관리 패러다임을 제시합니다.
AI didn't slow my products down — it drifted them off-course faster. So I built an 'Intent Datadog'.↗dev.to
- 12
모델 파인튜닝에 3만 5천 달러를 투자했습니다. 2만 8천 달러짜리 RAG 시스템이 더 나은 결과를 냈을 겁니다.
많은 기업이 특정 지식을 학습시키기 위해 파인튜닝을 시도하지만, 이는 모델의 행동 양식만 바꿀 뿐 새로운 사실을 정확히 기억하게 하지는 못합니다. 반면 RAG는 최신 데이터를 즉각 반영하고 답변의 근거를 제시할 수 있어, 데이터 변화가 잦은 환경에서 훨씬 경제적이고 신뢰할 수 있는 대안입니다.
You Spent $35,000 Fine-Tuning a Model. A $28,000 RAG System Would Have Done It Better.↗dev.to
- 14
Claude와 ChatGPT가 서로 대화하도록 하는 도구를 만들었습니다 – 만드는 방법은 다음과 같습니다.
개발자 LifePilot이 개발 중인 'AI Bridge'는 ChatGPT, Claude, Gemini 등 서로 다른 AI 모델들을 하나의 컨텍스트 안에서 연결해 상호작용하게 하는 도구입니다. 사용자가 자신의 API 키를 사용하는 BYOK(Bring Your Own Key) 방식을 채택하고 있으며, 현재 베타 버전으로 운영 중입니다.
I built a tool that lets Claude and ChatGPT talk to each other — here's how↗indiehackers.com
- 15
ChatGPT에 고객 문서 붙여넣고 제발 잘 해내라, 하는 답답함에 지쳐버렸다
개인정보 유출 방지를 위해 브라우저 내에서 데이터를 익명화하여 AI 모델로 전달하는 ArcanAI의 개발 배경과 비즈니스 전략을 다룹니다. 특히 보안에 민감한 기업 고객(Enterprise)을 타겟팅할 때의 접근 방식과 데이터 프라이버시 보호의 기술적 한계 및 신뢰 구축 방안에 대한 전문가들의 논의를 담고 있습니다.
I got tired of pasting client documents into ChatGPT and hoping for the best↗indiehackers.com
- 16
Fable 5 수출 통제, 미국 사이버 방어에 악영향
최근 Fable 5 모델이 보안 취약점 수정 요청을 공격으로 간주하여 제한받는 수출 통제 대상에 포함되었는데, 이는 '코드 수정'이라는 AI의 핵심적 방어 기능을 무력화할 위험이 있습니다. 연구자들은 단순한 코드 리뷰 거부를 넘어 '코드 수정' 프롬프트를 통해 가드레일을 우회할 수 있음을 증명하며, 이러한 규제가 사이버 보안 방어 체계에 심각한 위협이 될 수 있다고 경고합니다.
The Fable 5 Export Controls Harm US Cyber Defense↗simonwillison.net
- 20
Show HN: HashMeterAI - 모든 모델의 개인 AI 토큰 실사용량 측정 도구
HashMeterAi는 로컬에 남은 AI 코딩 도구의 트랜스크립트를 읽어 토큰 사용량, 예상 비용, 집중 시간 등을 대시보드로 보여주는 오픈소스 프로젝트입니다. 개인정보 유출 걱정 없는 100% 오프라인 환경을 지향하며, 개발자의 AI 활용 패턴을 분석해 성과를 시각화하고 공유할 수 있는 기능을 제공합니다.
Show HN: HashMeterAi – Private AI Token Real Usage Meter for All Models↗github.com
- 21
JEPA 모델의 90년 전 아이디어: 정준 상관 분석 (Canonical Correlation Analysis)
이 글은 Yann LeCun의 JEPA 모델이 1936년 Hotelling이 제안한 정준 상관 분석(CCA)의 비선형적 확장임을 수학적으로 설명합니다. 또한, JEPA의 핵심 과제인 표현 붕괴(collapse) 문제를 해결하는 과정과 이를 둘러싼 학계의 우선권 논쟁을 다룹니다.
The 90-year-old idea behind JEPA models: Canonical Correlation Analysis↗shonczinner.github.io











