Anthropic : une faille critique et le spectre de claude mythos

anthropic est au bord du précipice. Une récente fuite massive de code source a révélé une vulnérabilité majeure concernant son modèle d’IA le plus ambitieux, Claude Mythos. Cette nouvelle attaque met en lumière les failles de sécurité persistantes qui menacent les géants de l’intelligence artificielle.

Un accès non autorisé, un précédent dangereux

Selon un rapport Bloomberg, un petit groupe d’utilisateurs de Discord a obtenu un accès précoce à une version préliminaire de Mythos. L’incident survient alors qu’anthropic annonçait déjà une distribution limitée du modèle à un cercle restreint d’entreprises, notamment Apple, Microsoft et Amazon. L’entreprise tempère l’affaire en affirmant ne pas avoir détecté d’accès non autorisé à Mythos lui-même, mais l’ombre d’une possible intrusion reste palpable.

Cette faille, confirmée par les experts en cybersécurité, ne se limite pas à une simple divulgation de code. Il s’agit d’un accès direct à un modèle d’IA potentiellement déstabilisant, capable, selon Anthropic, de s'infiltrer dans « tous les principaux systèmes d'exploitation et navigateurs web sur la demande de l’utilisateur ». C’est une capacité qui, entre de bonnes mains, pourrait être utilisée à des fins malveillantes. Une bombe à retardement.

Mythos, une promesse brisée ?

Mythos, une promesse brisée ?

Claude Mythos était présenté comme le successeur de Claude Code, et incarnait l'ambition d'Anthropic de proposer une IA dépassant les limites actuelles. Pourtant, cette fuite, la seconde en quelques semaines, érode la confiance et soulève des questions sur la maturité des processus de sécurité de l'entreprise. L'annonce de la restriction du modèle à quelques entreprises, loin d’être une victoire, témoigne d’une prudence excessive, peut-être justifiée, mais qui fragilise l'image d'Anthropic.

L’incident est d’autant plus préoccupant que Mythos a déjà révélé 271 vulnérabilités dans Firefox, comme l’a mis en lumière un test indépendant. Une semaine plus tôt, des utilisateurs avaient découvert que l’IA était capable d'exécuter 300 agents en parallèle et de programmer pendant des heures sans supervision, des capacités qui, dans de mauvaises mains, pourraient engendrer des conséquences imprévisibles. Un potentiel destructeur, trop peu maîtrisé.

Dario Amodei, le PDG d'Anthropic, se veut rassurant, évoquant les mesures prises pour renforcer la sécurité. Mais, soyons clairs : la confiance est un bien rare dans le domaine de l'IA. Et après cette nouvelle faille, elle risque d'être difficile à regagner. Le pari d'Anthropic est désormais de prouver que Mythos peut être déployé en toute sécurité, et que la technologie ne sera pas utilisée à des fins destructrices. La responsabilité est immense.