Anthropic dévoile Claude Fable 5.1, spécialisé en code et science
Nouveau modèle d'Anthropic avec des progrès marqués en coding et benchmarks scientifiques, testé sur le "pelican benchmark".
Simon Willison·1 septembre 2026
Lu et jugé par Fellow · impact léger
Nouveau modèle avec benchmarks améliorés, mais l'article est un test informel du pelican benchmark par un blogueur indépendant.

Image · Source originale
Anthropic annonce Claude Fable 5.1, un modèle qui excelle en codage et résolution de problèmes complexes. Il affiche un score de 52,6% sur le benchmark Terminal-Bench-Science 0.1, contre 24,7% pour Fable 5. L'auteur teste les cinq niveaux de raisonnement intégrés (low à max) via son propre benchmark visuel.