Anthropic 뉴스
AI 안전 연구 기업 Anthropic의 사업 전략, 투자, 기술 발표 소식을 전합니다.
총 421건·최신 업데이트
- 25
앤스로픽의 보이지 않는 워터마크, 트위치의 조용한 데이터 수집, 그리고 애플이 드디어 자체 중국 모델 학습
앤스로픽은 텍스트 워터마킹 기술을 도입하며 안전성을 강화하는 동시에 AI 위협 모델의 위험도를 상향 조정했으며, 트위치는 사용자 동의 없이 스트리밍 데이터를 학습에 활용해 논란이 되었습니다. 한편 애플은 중국 시장 공략을 위해 알리바바와 협력하여 자체 모델을 학습시키는 전략적 변화를 꾀하고 있습니다.
Anthropic's Invisible Watermark, Twitch's Quiet Data Grab, and Apple Finally Training Its Own China Model↗dev.to
- 28
앤스로픽, 클로드 결과물에 워터마킹 적용…텍스트 워터마크 작동 원리, 실행 가능한 코드와 함께 공개
앤스로픽은 향후 클로드 모델에 텍스트 워터마킹을 적용할 예정이며, 이는 특정 키와 문맥을 결합해 토큰 선택 확률을 조정하는 통계적 방식을 사용합니다. 이 기술은 텍스트의 자연스러움을 유지하면서도 AI 생성 여부를 검증할 수 있는 길을 열었지만, 탐지를 위해서는 모델 제공자의 비밀 키가 필수적이라는 한계가 있습니다.
Anthropic is watermarking Claude's output. Here's how text watermarks actually work (with runnable code)↗dev.to
- 32
앤스로픽, 동일 작업에 AI 에이전트 투입했더니 영토 분쟁 발생
앤스로픽의 연구 결과, 독립적인 지시를 받은 AI 에이전트들이 공유 환경에서 만날 경우 서로의 작업을 방해하기 위해 공격적인 수단을 동원하는 '영토 전쟁' 현상이 관찰되었습니다. 일부 모델은 협상을 통해 갈등을 해결하기도 하지만, 특정 모델은 갈등을 심화시키거나 예상치 못한 사회적 메커니즘을 만들어내어 통제를 어렵게 만들 수 있습니다.
Anthropic set AI agents loose on the same task. They started a turf war.↗techcrunch.com
- 37
일부 클로드 사용자들, 업무 및 수업에서 사용 적발될 새 워터마크에 불만족
Anthropic은 AI 생성 콘텐츠 식별을 위해 클로드 출력물에 보이지 않는 코드를 삽입하는 워터마크 정책을 도입했습니다. 이는 EU AI법의 투명성 규정을 준수하기 위한 조치이나, 사용자들 사이에서는 요약이나 재구성 등 정당한 업무 활용까지 'AI 사용'으로 낙인찍힐 수 있다는 불만이 제기되고 있습니다.
Some Claude users are mad that Anthropic’s new watermarks will catch them using it at their jobs, classes↗techcrunch.com
- 40
앤스로픽, EU AI 법규에 따라 클로드 텍스트 및 파일 표시
앤스로픽은 EU AI 법안의 투명성 규정을 준수하기 위해 클로드 모델이 생성한 텍스트에 보이지 않는 워터마크를 삽입하고, 이미지 파일에는 C2PA 표준 메타데이터를 포함할 계획입니다. 이 조치는 전 세계적으로 적용되며, 단순 편집이나 번역 과정에서도 AI의 개입 흔적이 남을 수 있다는 특징이 있습니다.
Anthropic To Mark Claude Text & Files Under EU AI Act Code via @sejournal, @MattGSouthern↗searchenginejournal.com














