Anthropic identifie le modèle sous le nom Claude Mythos Preview dans sa system card, le document technique qui accompagne l’évaluation d’un modèle. TechCrunch le décrit aussi comme la preview d’un nouveau modèle d’IA puissant développé par Anthropic.
La lecture la plus prudente est donc la suivante : Mythos est un modèle Claude en phase de preview. Les sources disponibles ne permettent pas de le présenter comme une entreprise séparée, une application autonome ou un niveau Claude classique que chacun pourrait sélectionner librement dans une interface publique.
La déclaration la plus nette vient d’Anthropic : Claude Mythos Preview serait significativement plus capable que Claude Opus 4.6. La même system card présente Opus 4.6 comme le modèle le plus capable évoqué dans le plus récent rapport de risque d’Anthropic, ce qui en fait le principal point de comparaison officiel.
Mais la nuance compte. Anthropic indique aussi que, pour son évaluation globale des risques, le profil de Mythos Preview reste effectivement similaire. Certains résultats d’évaluations multi-tours étaient même comparables à ceux de Claude Opus 4.6 et Claude Sonnet 4.6, dans la marge d’erreur.
| Question | Ce que disent les sources | Comment le lire |
|---|---|---|
| Mythos dépasse-t-il Opus 4.6 ? | Anthropic affirme que Claude Mythos Preview est significativement plus capable que Claude Opus 4.6. | Mythos est présenté comme une progression générale, pas comme une preuve qu’il domine tous les tests possibles. |
| Comment se situe-t-il face à Sonnet 4.6 ? | Des résultats multi-tours étaient comparables à Sonnet 4.6 et Opus 4.6 dans la marge d’erreur. | Sonnet reste un repère utile, mais ce n’est pas la comparaison centrale d’Anthropic. |
| Le risque change-t-il complètement ? | Anthropic dit que Mythos est plus capable, tout en jugeant son profil effectivement similaire pour l’évaluation globale des risques. | Plus de capacité ne signifie pas automatiquement que chaque catégorie de risque change de nature. |
Les détails techniques les plus précis publiés sur Mythos concernent des tests de vulnérabilités et d’exploitation. Dans son compte rendu de red team, Anthropic indique que Mythos Preview a pu écrire de manière entièrement autonome des exploits sophistiqués visant des failles déjà corrigées.
Anthropic affirme aussi que le modèle a identifié puis exploité de manière autonome une vulnérabilité d’exécution de code à distance vieille de 17 ans dans FreeBSD, susceptible de donner un accès « root » à une machine utilisant NFS, un protocole de partage de fichiers en réseau.
Ces éléments ne signifient pas que Mythos serait disponible publiquement comme outil offensif de cybersécurité. Ils montrent plutôt pourquoi le contrôle d’accès, la surveillance, les tests adversariaux et la prévention des abus occupent une place centrale dans son lancement. TechCrunch aborde Mythos sous cet angle de sécurité, et CrowdStrike formule le même constat général : plus les systèmes d’IA deviennent capables, plus ils exigent des pratiques de sécurité solides.
À ce stade, les sources citées ne présentent pas Claude Mythos Preview comme une option Claude ordinaire et largement disponible. TechCrunch parle d’une preview, tandis que Fortune a rapporté qu’Anthropic avait commencé à tester le modèle avec des clients en accès anticipé après une fuite de données ayant révélé son existence.
Pour les développeurs, les responsables sécurité ou les entreprises qui suivent l’écosystème Claude, la conclusion pratique est simple : il vaut mieux ne pas bâtir de plan de déploiement autour de Mythos tant qu’Anthropic n’a pas publié de consignes officielles d’accès et d’intégration. Les informations publiques sont plus solides sur son positionnement, ses comparaisons de capacité et ses tests de sécurité que sur une disponibilité large.
Fortune a rapporté qu’un brouillon disponible dans un espace de données non sécurisé et publiquement indexable avait révélé l’existence du modèle, le nom Claude Mythos, ainsi que l’idée qu’Anthropic le considérait comme porteur de risques de cybersécurité sans précédent.
Ce point est important, mais il doit être interprété avec prudence : il s’agissait, selon ce récit, de documents de travail et non d’une page produit finale. La system card publiée par Anthropic est plus mesurée : elle dit que Mythos Preview est plus capable que les modèles précédents, tout en affirmant que son profil reste effectivement similaire pour l’évaluation globale des risques.
La meilleure lecture n’est donc pas de chercher une contradiction simple. Mythos combine une revendication forte de progrès capacitaire avec des résultats de tests cyber particulièrement sensibles.
Anthropic compare directement Claude Mythos Preview à Claude Opus 4.6 et affirme que Mythos est significativement plus capable. L’idée d’un simple changement de nom ne correspond donc pas bien aux éléments disponibles.
La principale affirmation d’Anthropic porte sur une capacité globale supérieure à Opus 4.6. Mais la même system card indique que certains résultats multi-tours étaient comparables à Opus 4.6 et Sonnet 4.6 dans la marge d’erreur. Il serait donc excessif d’en déduire que Mythos surclasse tout, partout, dans toutes les tâches.
Les résultats de red team sont marquants parce qu’ils décrivent des comportements autonomes liés à l’écriture et à l’exploitation de vulnérabilités. Ils ne prouvent pas, à eux seuls, que le modèle ait été publié pour un usage offensif sans restriction ou pour un large public.
Non. Anthropic compare Claude Mythos Preview à Claude Opus 4.6 et affirme que Mythos Preview est significativement plus capable.
Les sources identifient Claude Mythos Preview comme une preview d’un modèle Claude, pas comme un produit de cybersécurité autonome. La cybersécurité domine toutefois la discussion publique parce qu’Anthropic décrit des tests où Mythos a écrit des exploits et exploité des vulnérabilités de manière autonome.
Les sources publiques citées ne montrent pas Mythos comme une version Claude ouverte à tous. TechCrunch parle d’une preview, et Fortune évoque des tests auprès de clients en accès anticipé après une fuite de données.
Claude Mythos Preview attire l’attention parce qu’il associe une promesse de saut de capacité au-delà de Claude Opus 4.6 à des résultats de red team montrant une exploitation autonome avancée de vulnérabilités. À ce stade, il faut surtout le lire comme une preview de modèle Claude très surveillée, apparemment pas comme un lancement public classique. Son enjeu principal n’est pas seulement le classement des modèles d’IA, mais la manière dont Anthropic gère les risques de sécurité liés à des systèmes plus puissants.