소식
블로그
포트폴리오
구독하다

AI 뉴스 요약 - 2026년 7월 20일

범주
비어 있음
1.
알리바바는 2조 4천억 개의 매개변수를 가진 멀티모달 AI 모델인 Qwen 3.8을 공개하고, 공개된 미리보기 버전을 제공하면서, 이 모델이 선두 시스템들과 경쟁할 만하며 Fable 5에 이어 두 번째로 우수한 성능을 보인다고 밝혔습니다.
2.
Moonshot의 Kimi K3는 Code Arena: Frontend 순위에서 Claude Fable 5와 GPT-5.6 Sol을 제치고 1위를 차지했지만, FrontierMath Tier 4에서는 약 39%의 점수를 기록하여 OpenAI와 Anthropic의 모델들이 기록한 약 90%에 비해 낮은 점수를 받았습니다.
3.
구글 딥마인드는 젠셉션(GenCeption)에서 비디오 생성기를 재활용하여 깊이 추정 및 분할과 같은 고전적인 컴퓨터 비전 작업을 수행하도록 했습니다. 이를 통해 훨씬 적은 데이터로 학습하고 주로 합성 비디오를 사용하면서도 최첨단 시스템과 동등한 성능을 달성했습니다.
4.
RadLE 2.0 벤치마크 결과에 따르면 많은 방사선학 AI 모델이 높은 확신도를 가지고 잘못된 소견을 내놓았으며, 인간 방사선 전문의의 정확도가 훨씬 더 높았습니다.
5.
Epoch AI는 Pangram, GPTZero, Originality.ai 등 세 가지 주요 AI 텍스트 탐지기를 테스트한 결과, AI가 생성한 문단 중 최대 18%가 전체적으로 탐지되지 않았고, 과학 논문의 경우 최대 48%가 탐지되지 않은 것으로 나타났습니다.

참고 자료

👍