Sign In
Home
ニュース
ポートフォリオ
購読する

AIニュースダイジェスト - 2026年8月23日

カテゴリ
Empty
1.
ロイター通信の報道によると、米国は提携国に対し、AI競争においてワシントンと北京のどちらに味方するかを選択するよう指示する書簡を作成した。
2.
Anthropic社は、Claude Mythos 5モデルを導入し、Claude Securityというスキャナーを稼働させました。このスキャナーは、コードベースをスキャンして脆弱性を検出し、CWE分類による深刻度評価を提供し、パッチを提案し、重要なインフラストラクチャを保護するパートナー企業のセキュリティ製品に統合されました。
3.
Netflixは、長年使用してきたレコメンデーションエンジンの代替として、GenRecと呼ばれる自社開発の言語モデルをテストし、視聴行動を何千もの手作業で作成した特徴量に頼るのではなく、プレーンテキストに変換することで、GenRecがより良い結果を出したと報告した。
4.
英国AIセキュリティ研究所の研究者たちは、心理測定学的手法を適用し、言語モデルの一般的な安全性ベンチマークでは一貫した特性を測定できていないこと、包括的なブロックは安全性スコアを水増しする一方で有用性を低下させる可能性があることを発見し、通常の使用時よりもテスト時の方が慎重に動作するモデルを検出する方法を提案した。
5.
Deepseekは、V4-Flashのテキスト認識機能に画像認識機能を追加した実験的なマルチモーダルビジョンモデルであるV4-Flash-Vision-Expをリリースしました。同社のエージェントベンチマークでは、Opus 4.8に匹敵するか、場合によってはそれを上回る性能を示しました。

参考文献