OpenAI a lancé GPT-5.6 Sol comme son nouveau modèle phare, qui surpasserait Claude Mythos 5 d'Anthropic sur les benchmarks de codage, et l'a publié sous des règles d'accès restreint imposées par le gouvernement américain, avec des approbations requises « client par client ».
2.
Epoch AI a publié le benchmark MirrorCode pour tester la capacité des modèles à reconstruire des programmes complets, et Claude Opus 4.7 a pris la tête avec un taux de résolution de 56 %, reconstruisant une boîte à outils de 16 000 lignes en environ 14 heures tandis que les modèles continuaient d'échouer aux tâches les plus complexes.
3.
La Linux Foundation et une vingtaine d'entreprises technologiques, de laboratoires d'IA et de banques ont lancé Akrites pour identifier et corriger les vulnérabilités critiques des logiciels libres avant d'éventuelles attaques basées sur l'IA.
4.
Lindy, une start-up spécialisée dans l'IA, a abandonné Claude d'Anthropic au profit de Deepseek, indiquant que ce changement a permis à l'entreprise d'économiser des millions, les coûts de l'IA dépassant les dépenses de personnel.