AI 모델 (LLM·GPT·Claude·Gemini)
GPT, Claude, Gemini, Llama 등 AI 모델(LLM) 출시·벤치마크·API 변경사항을 모읍니다.
최신 업데이트
AI 모델 관련 글 — 8 페이지
- 0
Snowflake, Amazon SageMaker Canvas 및 Amazon Quick으로 노코드 ML 워크플로우 구축하기 - 2부: Amazon SageMaker Canvas를 활용한 데이터 준비 및 모델 구축
본 기사는 Amazon SageMaker Canvas와 Snowflake를 활용하여 데이터 준비부터 모델 구축까지 이어지는 노코드 ML 워크플로우의 두 번째 단계를 다룹니다. 사용자는 Data Wrangler를 통해 Snowflake 데이터를 직접 연결하고 변환하며, 이를 바탕으로 사기 탐지(Fraud Detection) 모델을 구축하는 과정을 상세히 설명합니다.
Build a no-code ML workflow with Snowflake, Amazon SageMaker Canvas and Amazon Quick – Part 2: Data preparation and model building with Amazon SageMaker Canvas↗aws.amazon.com
- 1
Snowflake, Amazon SageMaker Canvas 및 Amazon Quick을 활용한 노코드 ML 워크플로우 구축 - Part 3: Amazon Quick Sight로 인사이트 시각화하기
본 기사는 Amazon SageMaker Canvas에서 생성된 머신러닝 예측 데이터를 Amazon QuickSight로 통합하여 인터랙티브 대시보드를 구축하는 방법을 설명합니다. 특히 자연어 질의가 가능한 생성형 BI 기능을 활용해 복잡한 데이터 분석 과정을 자동화하고 비즈니스 의사결정에 필요한 인사이트를 시각화하는 워크플로우를 다룹니다.
Build a no-code ML workflow with Snowflake, Amazon SageMaker Canvas and Amazon Quick – Part 3: Visualizing insights with Amazon Quick Sight↗aws.amazon.com
- 7
저렴한 임베딩과 재순위화를 활용한 지원 검색: OpenAI, Cohere, 또는 Voyage?
시맨틱 검색 시스템 구축 시 임베딩은 넓은 범위의 검색(Recall)을 위해 저렴한 모델을 사용하고, 재순위화는 소수의 후보군에 대해서만 선택적으로 적용하여 비용 효율성을 높여야 합니다. 또한 벤더 선택 시 단순 토큰 단가뿐만 아니라 구조화된 출력 오류로 인한 재시도 비용 등 전체 운영 비용을 기준으로 평가하는 것이 핵심입니다.
Cheap Embeddings and Reranking for Support Search: OpenAI, Cohere, or Voyage?↗dev.to
- 8
OpenAI, 제로 데이터 보존 약속으로 Anthropic의 비즈니스 고객 추격
OpenAI는 고객의 프롬프트와 응답을 인력에게 노출하지 않으면서도 자동화된 방식으로 안전성을 검사하는 'Private Safety Processing' 기술을 도입했습니다. 이는 안전 점검을 위해 일정 기간 데이터를 보유하는 Anthropic의 정책과 차별화하여, 진정한 의미의 데이터 비보존(ZDR)을 구현함으로써 엔터프라이즈 시장에서의 우위를 점하려는 전략입니다.
OpenAI chases Anthropic's biz customers with zero data retention pledge↗theregister.com
- 9
신경망에 손을 빌려주세요: 왜 또 다른 MCP 서버를 만들었는지 (그리고 검색 제공업체가 당신을 털어가고 있는지)
고비용의 검색 API를 대체하기 위해 개발된 오픈소스 MCP 서버 'mcp-retrieval'이 공개되었습니다. 이 도구는 별도의 API 키 없이 브라우저 에뮬레이션 기술을 통해 텍스트, 이미지, 마크다운 페이지 추출 기능을 제공하며 LLM에 실시간 웹 검색 능력을 부여합니다.
Give the neural net some hands: why I wrote yet another MCP server (and how search providers are fleecing you)↗dev.to
- 11
저희는 현지 LLM에 대한 15건의 프롬프트 인젝션 공격을 수행했습니다. 3번 실패했습니다. 여러분의 모델을 확인할 수 있는 무료 도구를 제작했습니다.
Ventrova가 공개한 'Sentinel Scan CLI'는 OpenAI 호환 엔드포인트를 대상으로 15가지 프롬프트 인젝션 및 탈옥 기법을 실행하여 취약점을 찾아내는 무료 오픈소스 도구입니다. Llama 3.1 기본 설정 모델 테스트 결과, 15건 중 3건의 공격이 성공하며 보안 허점이 발견되었습니다.
We ran 15 prompt-injection attacks against a stock local LLM. It failed 3. Here's the free tool we built to check yours.↗dev.to
- 16
ChatGPT 출시 이후 발행된 웹 페이지 중 3분의 1이 AI 작성 흔적을 보인다는 연구
Pew Research의 최신 보고서에 따르면 ChatGPT 출시 이후 발행된 웹 페이지 중 약 35%가 AI에 의해 작성되었거나 대폭 수정된 것으로 나타났습니다. 특히 .com 도메인의 AI 활용률이 .edu나 .gov 도메인보다 10배나 높게 나타나며, 인터넷 트래픽의 상당 부분이 봇과 AI 콘텐츠로 채워지고 있습니다.
A third of web pages published since ChatGPT’s launch show signs of AI authorship, study finds↗techcrunch.com
- 18
Generative Recommenders가 대규모 RecSys를 재정의하는 방법
기존 임베딩 기반 추천 시스템은 데이터 규모 확대에 따른 메모리 병목과 긴 꼬리(Long-tail) 문제로 한계에 직면해 있으나, 생성형 추천 모델(GR)은 시퀀스 모델링을 통해 이를 해결하고자 합니다. NVIDIA는 HSTU와 같은 혁신적 아키텍처를 효율적으로 구현하고 대규모 임베딩 테이블을 관리할 수 있는 최적화된 솔루션을 제시하며 RecSys의 재정의를 주도하고 있습니다.
How Generative Recommenders Are Redefining RecSys at Scale↗developer.nvidia.com
- 19
Amazon Bedrock으로 의료 API용 지능형 보안 구축하기
Amazon Bedrock의 파운데이션 모델을 활용하여 FHIR 의료 API에 대해 정적 규칙이 놓치기 쉬운 이상 행동 탐지, 데이터 민감도 자동 분류, 자연어 기반 컴플라이언스 보고서 생성을 구현하는 기술적 방안을 다룹니다. 특히 보안 분석 프로세스를 비동기 방식으로 설계하여 API 응답 지연 없이 실시간 보안 모니터링이 가능하도록 구성했습니다.
Build intelligent security for healthcare APIs with Amazon Bedrock↗aws.amazon.com














