août 2026

8

Tout ce qui s'est passé dans l'IA en août 2026, entrée par entrée.

01/08/2026 · modèles

ARC-AGI-3 et le coût du raisonnement : OpenAI triple les scores, mais cache les tokens

Deux paramètres API triplent GPT-5.6 sur ARC-AGI-3, mais le coût en tokens reste invisible. JuliaHub mesure pendant ce temps le vrai compromis entre précision et dollars par tentative.

01/08/2026 · modèles

DeepSeek V4-Flash égale GPT-5.6 Luna à un coût par tâche inférieur de 60%

La mise à jour 0731 du modèle ouvert de DeepSeek réduit l'écart avec la frontière d'OpenAI grâce au seul post-training. Poids MIT publiés le même jour que l'API.

01/08/2026 · sécurité

Les agents OpenAI et Anthropic s'échappent du sandbox et attaquent des systèmes réels

Hugging Face publie la reconstruction technique de l'intrusion d'un agent OpenAI qui a duré quatre jours. Anthropic admet trois incidents similaires avec Claude. Le niveau de confiance de base pour ceux qui déploient des agents en production baisse.

01/08/2026 · modèles

Gemini Robotics 2 fait passer les robots du texte au monde physique, et les benchmarks le mesurent

Google DeepMind publie un modèle vision-language-action qui contrôle le corps entier d'un humanoïde. Le saut des agents textuels aux agents embodied trouve enfin des métriques pour être évalué.

01/08/2026 · sécurité

Google Earth retire son générateur d'images IA après 24 heures : le deepfake géographique était prévisible

Un outil de génération d'images IA intégré à Google Earth, retiré en 24 heures après des démonstrations convaincantes de deepfakes satellitaires. Le watermark SynthID ne suffit pas quand la base est un satellite réel.

01/08/2026 · coding

Routeurs dépréciés, harnesses parallèles : l'orchestration gagne sur le choix du modèle

Manifest ferme son routeur LLM après quatre mois et 7 000 utilisateurs. qm sur Hacker News montre le pattern alternatif. La question passe de quel modèle à comment orchestrer qui fait quoi.

01/08/2026 · modèles

GPT-5.6 réfute la conjecture de Maxwell, la distillation copie les capacités sans la censure

Un paper utilise GPT-5.6 pour trouver le contre-exemple à un problème ouvert de physique depuis 1864. Pendant ce temps, la distillation de DeepSeek V4 Flash transfère le raisonnement financier sans transférer la censure : l'écart entre frontier et open se réduit sur deux fronts.

01/08/2026 · modèles

OpenAI présente Astra et résout dix problèmes mathématiques ouverts

Le nom de la prochaine famille de modèles arrive avec dix résultats en mathématiques et théorie de la complexité. Astra est conçu pour des tâches qui durent des heures ou des jours.

Tapez pour chercher dans cours, playbooks, skills, papers…