En bref
- Anthropic lance Opus 5.5 avec un discours plus prudent sur les risques de l’IA.
- Le modèle vise de meilleures performances en codage et en travail de connaissance, tout en étant plus rapide et moins cher.
- Opus 5.5 conserve des garde-fous renforcés, avec des évaluations de sécurité menées avant son déploiement.
Deux mois après Opus 5, Anthropic remet ça avec Opus 5.5. Et le plus intéressant n’est pas seulement la fiche technique. C’est le moment choisi, juste après le virage plus prudent assumé par Dario Amodei. Quand un labo dit vouloir ralentir la course aux capacités, chaque nouveau modèle est observé de près.
Un lancement qui arrive avec le frein à main visible
C’est la première sortie de modèle chez Anthropic depuis que son patron a embrassé l’idée de pacer the frontier, autrement dit avancer moins vite pour laisser la sécurité suivre. Plus tôt ce mois-ci, Dario Amodei écrivait : « Je suis devenu convaincu que traiter pleinement les risques exige encore plus de prudence », puis ajoutait qu’il fallait aussi ralentir la progression des capacités pour que la prévention des risques ait le temps de suivre.
Anthropic explique aussi que, plus les systèmes d’IA gagnent en capacités, plus les pouvoirs publics devront peser pour garantir leur sûreté. L’infrastructure pour ça est en cours de mise en place, avec davantage de détails promis bientôt. Clairement, le message dépasse la simple annonce produit.
Côté perfs, Opus 5.5 vise le très haut du panier
Sur le fond, Anthropic affirme que Opus 5.5 établit un nouvel état de l’art pour le codage et le travail de connaissance. La boîte dit aussi que le modèle dépasse souvent Fable, pourtant plus gros, dans plusieurs benchmarks. Et sur des tâches plus informelles, Opus 5.5 aurait réussi là où Fable a bloqué. Pas anodin.
Il est aussi annoncé comme plus rapide à exécuter. Autre changement, moins flashy mais utile tous les jours, ses réponses doivent contenir moins de jargon et placer les infos importantes plus tôt dans le message. En gros, moins de blabla, plus de signal.
La baisse de prix change la donne
Là, ça devient très concret. Les tokens de sortie passent à environ 18 euros (20$) par million, contre environ 23 euros (25$) pour la version précédente. Anthropic parle aussi de baisses similaires sur d’autres métriques tarifaires.
Ce recul des prix va avec une baisse globale du calcul nécessaire pour servir le modèle. Donc un modèle plus rapide, moins coûteux et plus efficace côté infra. Franchement, pour les clients, c’est le genre d’update qui compte plus qu’un joli nom de version.
Même niveau de garde-fous que Fable
Anthropic estime que Opus 5.5 se situe au niveau de Mythos en biologie et en cybersécurité. Résultat, il hérite des mêmes garde-fous que Fable. Ces protections limitent notamment l’usage du modèle pour trouver des failles dans des programmes compilés ou pour développer des armes biologiques reconnaissables.
Côté préparation, l’entraînement sécurité reste globalement proche de celui des modèles précédents, avec des tests d’alignement et des évaluations avant sortie menées aussi par des organisations externes comme METR et Frontier Design. Mais Anthropic précise déjà préparer des systèmes plus avancés pour la suite, avec une meilleure sécurité et plus de monitoring. Et Sonnet 5.5 comme Haiku 5.5 doivent suivre dans les prochaines semaines, avec des gains du même genre.