Anthropic est-il en train de surpasser ses rivaux ? À en croire ses propres tableaux, la réponse serait oui... En avril, la firme a annoncé son modèle le plus dangereux jamais créé, Claude Mythos, capable notamment de trouver un nombre impressionnant de failles de sécurité dans les logiciels. En juin, Anthropic a lancé Claude Fable 5, une version de Mythos avec des protections en plus. Toutefois, l'entreprise a un peu trop vendu la dangerosité de ses deux modèles et le gouvernement américain a imposé un blocus, qui a depuis été levé.
Claude Mythos : le modèle d’IA le plus dangereux jamais créé ?
Anthropic pensait garder son modèle le plus avancé hors de portée du public. Pourtant, quelques passionnés ont déjà trouvé un moyen d’y accéder. Et cette intelligence artificielle a déjà montré à quel point elle pourrait être dangereuse entre les mauvaises mains, en découvrant des centaines de failles dans le navigateur Firefox.... Lire la suite
C'est dans ce contexte qu'Anthropic vient de dévoiler son nouveau modèle, Claude Opus 5. Il est « presque » au niveau de Claude Fable 5, mais pour un coût d'utilisation divisé par deux. Opus 5 dépasserait même Fable 5 sur de nombreux tests, comme le codage agentique (Frontier-Bench v0.1), la connaissance générale (GPDval-AA v2) ou encore l'utilisation d'ordinateurs (OSWorld 2.0).
Sur de nombreux tests standards, Claude Opus 5 obtient des scores plus élevés que les autres modèles d’Anthropic ou OpenAI. © Anthropic
Des performances qui distancent OpenAI et Google
Ce nouveau modèle battrait même GPT 5.6 Sol, la réponse d'OpenAI à Claude Fable 5, sur quasiment toute la ligne. La seule exception est le test de codage agentique DeepSWE v1.1. Et alors que Google s'appuie sur son écosystème pour imposer son IA Gemini partout, Anthropic ne le considère même pas assez puissant pour l'inclure dans la comparaison !
Avec AI Overviews, Google ne renvoie plus seulement vers le Web : il commence à le remplacer
C’est la fin d’une exception française. Les irréductibles Gaulois seront désormais logés à la même enseigne que le reste du monde. Pour certains, il s’agit d’une excellente nouvelle qui met fin à une discrimination qui a duré deux ans. Pour d’autres, la fin d’un répit et les portes ouvertes à une désinformation à grande échelle.... Lire la suite
Anthropic a décidé de ne pas jouer avec le feu cette fois et évite de caractériser son modèle comme étant dangereux. La firme souligne même ne pas avoir entraîné Opus 5 sur les tâches liées à la cybersécurité. Il se rapprocherait toutefois des capacités de Mythos pour la découverte de failles de sécurité, mais ne saurait pas vraiment les exploiter. Malgré des chiffres prometteurs, les premiers retours sont mitigés. Si certains saluent un modèle plus performant que Claude Opus 4.8, d'autres se plaignent d'un taux d'hallucinations bien plus élevé, d'une consommation excessive de tokens, et d'un modèle qui en fait plus qu'on lui demande.
.png)
12 hours ago
English (United States) ·
French (France) ·