
Tech • IA • Crypto
Anthropic a officiellement lancé Claude Opus 5, un modèle haute performance à moindre coût qui rivalise avec les systèmes de pointe tout en intensifiant la concurrence sur les prix, l’efficacité et l’adoption en entreprise.
Les premières observations d’un modèle nommé Honeycomb EAP, avec une fenêtre de contexte de 1 million de tokens et des modes de raisonnement améliorés, ont été confirmées avec la sortie de Opus 5 le 24 juillet. Le déploiement a suivi plusieurs jours de fuites, d’accès partiels et de traces backend sur différentes plateformes. Certains fournisseurs ont activé le modèle avant l’annonce officielle, signalant un déploiement coordonné mais progressif.
Les démonstrations ont montré un niveau de détail inhabituellement élevé dans les environnements générés, incluant des variations d’éclairage précises, des reflets et des comportements physiques réalistes. Des scènes comme des simulations de sièges, des cuisines aux matériaux crédibles ou des environnements de type jeu vidéo ont révélé des progrès en géométrie, fidélité des textures et ombres dynamiques, domaines où les modèles précédents échouaient souvent. Les comparaisons avec Fable 5 montrent un écart net en densité de détail et réalisme.
Opus 5 est proposé à 5 $ par million de tokens en entrée et 25 $ en sortie, au même niveau que Opus 4.8, mais nettement moins cher que Fable 5 à 10 $/50 $. Anthropic le positionne comme un modèle “de niveau frontière” à environ la moitié du coût, faisant du prix un levier concurrentiel clé. Il devient le modèle par défaut des offres premium, remplaçant l’accès haut de gamme précédent.
Un nouveau “curseur d’effort” permet d’ajuster le raisonnement de faible à très élevé, optimisant le rapport coût/performance. Un mode rapide fournit des réponses environ 2,5 fois plus vite à un coût supérieur. Les premiers retours indiquent 26 % de tokens en moins nécessaires pour des tâches de raisonnement comparables, renforçant l’efficacité comme argument majeur.
Anthropic annonce de fortes améliorations, notamment 43 % sur des benchmarks de code agentique contre 33 % pour Fable 5, et 30 % sur ARC-AGI-3, contre moins de 8 % pour GPT-5.6. Toutefois, beaucoup de résultats ne sont pas encore vérifiés indépendamment et certains concurrents sont absents de certains tests. Des évaluations tierces sont attendues.
Le modèle déclencherait 85 % d’interventions de sécurité en moins que Fable 5, visant des flux de travail plus fluides. Notamment, Opus 5 n’applique pas la rétention de données de 30 jours utilisée par certains autres modèles, levant un frein pour les benchmarks indépendants et l’adoption en entreprise.
Une fonctionnalité confirmée permet de rediriger automatiquement les requêtes signalées vers d’autres modèles au lieu de les bloquer, si activée par les développeurs. Cela clarifie les spéculations sur des mécanismes de secours cachés et souligne l’importance croissante de la configurabilité en production.
L’accès à Fable 5 a été retiré des offres payantes standards quelques jours avant le lancement, Opus 5 devenant le nouveau modèle haut de gamme par défaut. Cette transition maintient la structure des offres tout en améliorant les capacités de base.
Des responsables américains accusent le laboratoire chinois Moonshot de développer des modèles avancés via distillation de systèmes américains et l’usage de matériel restreint comme les puces Nvidia GB300. Aucune preuve publique n’a été fournie, et des chercheurs contestent la faisabilité d’une telle reproduction rapide par distillation seule.
Les experts estiment que si la distillation peut transférer style et sorties, les véritables gains reposent sur le reinforcement learning et une infrastructure à grande échelle. La frontière entre distillation et génération de données synthétiques reste floue, et l’apprentissage entre modèles est largement répandu.
Des rapports suggèrent que des puces restreintes atteignent encore la Chine via des intermédiaires ou des marchés parallèles. Des propositions incluent des règles mondiales de type “connaître son client” pour les centres de données, mais leur application reste inégale.
Google a simultanément lancé Gemini 3.6 Flash et 3.5 Flash Light, mettant l’accent sur une moindre consommation de tokens et une exécution plus rapide. Les gains incluent 17 % de tokens de sortie en moins et de meilleurs scores, soulignant une évolution vers l’efficacité des coûts et le déploiement d’agents à grande échelle plutôt que la seule puissance brute.
Le lancement de Opus 5 marque un basculement de la compétition en IA vers une intelligence déployable et rentable, tandis que les débats techniques et géopolitiques continuent d’influencer son développement et sa diffusion.