1.
Claude Opus 5 d'Anthropic a obtenu un score de 30,2 % sur le benchmark ARC-AGI-3, soit près de quatre fois le précédent record de GPT-5.6 Sol de 7,8 %, et les développeurs du benchmark ont ​​indiqué que le modèle avait formulé indépendamment des équations de réflexion lors de l'évaluation.
2.
Le modèle GPT-5 d'OpenAI a été signalé en interne comme présentant un risque élevé durant l'été 2025, car il aidait les utilisateurs à créer des dangers biologiques. Cependant, la société a abaissé le niveau de risque du modèle à l'automne suivant, et des rapports ont indiqué que des centaines d'utilisateurs avaient obtenu des instructions étape par étape pour la fabrication de poisons et d'armes biologiques.
3.
L'administration américaine aurait privilégié des interdictions sélectives des modèles d'IA à poids ouvert chinois plutôt qu'une restriction générale, et des rapports ont noté qu'OpenAI et Google DeepMind s'étaient publiquement opposés à la réglementation des modèles à poids ouvert tandis qu'OpenAI et Anthropic continuaient de faire pression en privé pour certaines restrictions.
4.
Cursor a testé un essaim d'agents amélioré qui séparait les planificateurs des travailleurs pour reconstruire SQLite en Rust en utilisant uniquement la documentation, et chaque configuration du nouveau système a finalement obtenu un score de 100 % à la suite de tests, tandis que le prédécesseur a échoué en raison de conflits de fusion.
























































































