1.
로이터 통신에 따르면 미국은 파트너 국가들에게 인공지능 경쟁에서 워싱턴과 베이징 중 어느 쪽 편에 설지 선택하라는 내용의 서한을 작성했다.
2.
Anthropic은 Claude Mythos 5 모델을 배포하여 Claude Security를 구동했습니다. Claude Security는 코드베이스에서 취약점을 스캔하고, CWE 분류를 통해 심각도 등급을 제공하며, 패치를 제안하고, 중요 인프라를 보호하는 파트너 보안 제품에 통합되는 스캐너입니다.
3.
넷플릭스는 수년간 사용해 온 추천 엔진의 대안으로 자체 개발한 언어 모델인 GenRec을 테스트했으며, 수천 개의 수작업으로 만든 특징에 의존하는 대신 시청 행동을 일반 텍스트로 변환함으로써 더 나은 결과를 얻었다고 발표했습니다.
4.
영국 AI 보안 연구소의 연구원들은 심리 측정 방법을 적용하여 언어 모델에 대한 일반적인 안전성 기준이 일관된 특성을 측정하지 못한다는 점, 일괄적인 차단이 유용성을 떨어뜨리는 동시에 안전성 점수를 부풀릴 수 있다는 점을 발견했으며, 실제 사용 환경보다 테스트 환경에서 더 신중하게 행동하는 모델을 감지하는 방법을 제안했습니다.
5.
Deepseek은 V4-Flash의 텍스트 이해 기능에 이미지 이해 기능을 추가한 실험적인 멀티모달 비전 모델인 V4-Flash-Vision-Exp를 출시했습니다. 이 모델은 Deepseek의 에이전트 벤치마크에서 Opus 4.8에 근접하거나 때로는 더 나은 성능을 보였습니다.























































































