AI 모델 (LLM·GPT·Claude·Gemini)
GPT, Claude, Gemini, Llama 등 AI 모델(LLM) 출시·벤치마크·API 변경사항을 모읍니다.
최신 업데이트
AI 모델 관련 글 — 210 페이지
- 8
오늘의 오픈 소스 프로젝트 (#85): OpenAI의 초고속 BPE 토크나이저, tiktoken
OpenAI의 GPT 모델 시리즈에서 사용하는 공식 BPE 토크나이저인 tiktoken의 기능과 활용법을 소개합니다. Rust 기반의 고성능 아키텍처를 통해 텍스트를 토큰화하고, 이를 통해 API 비용 예측, RAG를 위한 문서 분할, 컨텍스트 창 관리 등 LLM 애플리케이션 개발의 핵심적인 최적화 작업을 수행할 수 있습니다.
Open Source Project of the Day (#85): tiktoken - OpenAI's Blazing-Fast BPE Tokenizer↗dev.to
- 14
Show HN: Mnemo – LLM을 위한 로컬 우선 AI 메모리 레이어 (Rust, SQLite, petgraph)
Mnemo는 LLM이 세션 간의 정보를 유지하지 못하는 한계를 극복하기 위해 설계된 로컬 우선 AI 메모리 레이어입니다. Rust 기반의 단일 바이너리로 작동하며, 지식 그래프를 통해 엔티티 간의 관계를 추출하고 검색하여 프롬프트에 최적화된 컨텍스트를 자동으로 주입합니다.
Show HN: Mnemo – local-first AI memory layer for any LLM (Rust, SQLite,petgraph)↗github.com
- 19
Google의 드림빈즈, 지금까지 가장 특이한 이름의 AI 툴이 당신의 삶을 만화로 바꿔줄 것입니다.
구글 랩스의 신규 앱 '드림빈즈'는 Gmail, 캘린더, 사진 등 사용자의 구글 서비스 데이터를 분석하여 맞춤형 일상 스토리와 라이프스타일 제안을 제공합니다. 무분별한 스크롤링을 방지하기 위해 하루에 제한된 수의 스토리만 제공하며, 사용자의 데이터를 기반으로 개인화된 영감을 전달하는 것이 핵심입니다.
Google’s Dreambeans, its weirdest-named AI tool to date, will turn your life into a cartoon↗techcrunch.com
- 20
다중 모드 패널티 회피: 음성 AI 비용 절감 및 생체 인식 개인 정보 보호 확보 방법
멀티모달 API에 직접 오디오를 전송하는 대신, 로컬에서 음성을 텍스트로 변환(STT)하고 클라우드에서는 텍스트만 처리한 뒤 다시 로컬에서 음성으로 합성(TTS)하는 파이프라인을 구축함으로써 비용과 레이턴시를 획기적으로 줄일 수 있습니다. 이 방식은 생체 데이터 유출 위험을 방지하고 클라우드 API의 엄격한 호출 제한 문제를 극복하는 데 효과적입니다.
Bypassing the "Multimodal Tax": How I Cut Voice AI Costs and Secured Biometric Privacy↗dev.to
- 21
트럼프의 AI 모델 테스트 계획, 문제점 발생…DOGE에 의해 미국 보안팀 축소
트럼프 행정부가 AI 기술 주도권 확보를 위해 기업의 자발적 참여를 기반으로 한 AI 모델 안전성 테스트 행정명별에 서명했습니다. 하지만 테스트 기간을 90일에서 30일로 단축하고 강제성을 배제하면서, 실질적인 보안 검증 능력과 정부의 인력·예산 부족 문제가 핵심 쟁점으로 떠오르고 있습니다.
Trump plan to test AI models has a problem—US security teams were gutted by DOGE↗arstechnica.com


















