
Tech • IA • Robotique
Anthropic a lancé Fable 5.1 au même prix catalogue que son prédécesseur, mais avec des coûts d’exploitation de long terme nettement plus faibles et des performances bien supérieures sur les tâches longues utilisant des outils, ce qui signale une poussée vers des agents d’IA d’entreprise capables de travailler de façon autonome pendant des heures.
Fable 5.1 est facturé 10 $ par million de tokens en entrée et 50 $ par million de tokens en sortie, soit le même tarif que la version précédente, tout en restant plus cher que plusieurs concurrents. La fenêtre de contexte du modèle reste aussi proche de 1 million de tokens, donc les spécifications principales changent peu. Le changement clé est une baisse de 75 % du coût du contexte mis en cache, ramenant un coût de relecture répétée de 1 $ à 0,25 $ et rendant les tâches longues sensiblement moins chères.
Ces économies comptent surtout pour les tâches de plusieurs heures où le modèle revisite sans cesse consignes, fichiers et notes intermédiaires. D’après quatre semaines d’usage client en août, Anthropic a indiqué que le passage de charges de travail depuis l’ancien modèle vers Fable 5.1 avait réduit le coût total d’environ 25 % en moyenne, et jusqu’à 45 % pour les tâches plus lourdes et multi-étapes. Des développeurs ont noté que des sessions de programmation complexes peuvent encore coûter entre 20 $ et 50 $.
Dans un message produit inhabituel, Anthropic a conseillé à ses clients d’utiliser son modèle moins cher Opus 5 pour la plupart des usages, et de réserver Fable 5.1 aux missions difficiles où les modèles à moindre coût échouent. Ce positionnement suggère que l’entreprise voit cette sortie moins comme une mise à niveau générale de chatbot que comme un moteur premium pour des workflows d’entreprise exigeants.
Les améliorations les plus fortes ne concernent pas l’intelligence générale, mais l’exécution soutenue. Sur une tâche de recherche scientifique dans un environnement en ligne de commande, le score est passé d’environ 25 % à 53 %. Sur un test agentique pratique plus large, il est monté de 42 % à 56 %. Sur un benchmark de workflow métier, la performance a progressé de 17 % à 31 %. Les gains en raisonnement général, programmation et travail de connaissance ont été comparativement modestes.
Chez Ramp, le modèle a été laissé en fonctionnement pendant 38 heures et a détecté seul qu’une expérience précédente avait été compromise par un problème de données, a corrigé le problème, lancé six nouvelles expériences et renvoyé les résultats avec un plan pour la suite. Dans un autre test, Ramp lui a donné une instruction unique et vague pour trouver des problèmes négligés mais utiles à traiter; il a identifié une alerte ignorée sur des incidents de production, rassemblé les logs et rédigé un correctif sans être dirigé vers un système précis.
Browserbase a indiqué que Fable 5.1 a réussi 82 % de ses tâches les plus difficiles de contrôle de navigateur, contre 74 % pour le modèle moins cher d’Anthropic et 57 % pour la version précédente de la même famille. Canva a rapporté une meilleure qualité d’écriture dans des comparaisons à l’aveugle et a indiqué que le modèle avait créé un jeu de rythme de zéro, en générant niveaux, musique et gameplay synchronisé au tempo dans un seul workflow.
Anthropic a aussi lancé Mythos 5.1, présenté comme le même modèle sous-jacent mais proposé avec moins de restrictions uniquement à des partenaires validés en cybersécurité et en biologie. Anthropic a déclaré que Fable 5.1 est assez permissif pour la découverte de vulnérabilités, tandis que les capacités plus dangereuses orientées exploitation restent limitées à Mythos, qu’elle a décrit comme le système capable de piratage le plus puissant qu’elle ait commercialisé.
Une nouvelle option de déploiement permettra aux clients d’exécuter le modèle sur leur propre matériel, en gardant les données dans leurs propres installations. Anthropic a indiqué que cette option vise les organisations sensibles à la sécurité et arrivera à l’automne. L’entreprise a aussi réaffirmé qu’elle n’entraîne pas ses modèles sur les données clients sans autorisation. Dans les tests de sécurité, le modèle a été classé à faible risque pour une accélération matérielle de la recherche de pointe en IA, bien qu’il se soit montré un peu plus enclin que les modèles moins chers à accepter des demandes d’usage abusif.
Quelques jours avant le lancement, Anthropic a annoncé que les abonnés payants recevraient une hausse permanente de 25 % des limites hebdomadaires à partir du 14 septembre. Mais les utilisateurs bénéficiaient déjà d’une hausse temporaire de 50 % qui prend fin le même jour, ce qui signifie qu’en pratique l’accès passe de 150 unités à 125 si la base précédente était de 100. Cette arithmétique a alimenté les critiques selon lesquelles l’entreprise présentait une réduction comme une amélioration.
Anthropic aurait signé un accord cloud de 35 milliards de dollars avec Lambda, lié à un projet de centre de données au Texas. En utilisant les indications récentes de Nvidia sur le coût d’un déploiement IA à l’échelle du gigawatt, cela implique environ 400 mégawatts de capacité de calcul future. L’accord a suivi un autre engagement rapporté de 45 milliards de dollars pour une installation distincte en Virginie-Occidentale, ce qui signifie qu’Anthropic semble avoir sécurisé environ 80 milliards de dollars d’infrastructure IA en l’espace d’environ une semaine, en grande partie pour une capacité qui ne devrait pas entrer en service avant 2027 ou plus tard.
Fable 5.1 ne ressemble pas à une évolution classique de taille de modèle ou de prix. Son importance tient au fait qu’il rend le travail d’IA autonome de longue durée plus fiable et un peu moins coûteux, tandis qu’Anthropic se prépare en parallèle à une course très capitalistique pour sécuriser sa future puissance de calcul.
Explique-moi