TL;DR : la nouvelle du jour n’est pas un modèle plus intelligent, c’est une démonstration que l’emballage compte autant que le moteur. Et pendant ce temps, le prix d’un même niveau d’intelligence a été divisé par 56 en six mois.
1. NVIDIA met Claude Opus 5 dans une enveloppe, et le score passe de 30 à 100
Sur ARC-AGI-3, un banc de test où l’agent est lâché dans un jeu sans règles ni consigne, Claude Opus 5 seul plafonne autour de 30 pour cent. Enveloppé dans AVO, l’architecture d’agent de NVIDIA, il boucle les 183 niveaux des 25 environnements publics, en 6 624 actions (le billet technique de NVIDIA).
Le modèle n’a pas changé. Ce qui change, c’est la mémoire, la supervision et la boucle autour. NVIDIA prend d’ailleurs la peine de dire que le résultat ne vaut que pour l’ensemble public et ne doit pas être lu comme une mesure contrôlée : on aimerait que tout le monde s’impose cette phrase.
2. Le même niveau d’intelligence coûte 56 fois moins qu’en février
Benjamin Dichter suit les modèles frontière tous les deux mois et compare à intelligence égale, pas à modèle égal. Résultat : ce qui coûtait 1,22 dollar par tâche en février 2026 en coûte 0,022 en août (sa méthode et ses réserves).
Sa conclusion est plus intéressante que le chiffre : à ce prix, on cesse d’échantillonner. On lit tout.
3. Anna’s Archive demande qu’on scanne les livres rares avant qu’ils y passent
Le billet fait suite à ce qu’on racontait hier sur les livres découpés par Amazon. La bibliothèque pirate appelle des volontaires à numériser en priorité les ouvrages rares ou uniques, et cite le Project Panama d’Anthropic, révélé par un règlement à 1,5 milliard de dollars.
C’est la plus grande bibliothèque illégale du monde qui se pose en conservatrice du patrimoine. La situation est ce qu’elle est.
4. DeepSeek ouvre sa vision, en expérimental assumé
deepseek-v4-flash-vision-exp lit les captures d’écran, les graphiques et le texte dans les images, avec jusqu’à 600 images par requête (la documentation). Le suffixe exp est là pour une raison : ne construisez rien de sérieux dessus cette semaine.
5. FireRedTTS3 clone une voix en 24 langues, et le code est publié
Clonage zéro-shot sur 24 langues et 21 dialectes chinois, édition de la parole, conception de voix par consigne écrite. Code et poids sont sur GitHub. Un détail qui circule faux : son socle est un Qwen3 de 1,7 milliard de paramètres, pas un modèle de 9 milliards.
Ailleurs aujourd’hui, une histoire qui n’a rien à voir avec l’IA et tout à voir avec la dette technique : un domaine oublié racheté 5 euros.