
Anthropic a annoncé qu'il restaurerait l'accès public à Claude Fable 5 et Mythos 5 après que les autorités américaines ont levé les restrictions à l'exportation qui avaient maintenu les deux modèles d'IA les plus avancés de la société hors ligne depuis le 12 juin.
Selon Anthropic, cette décision fait suite à « une série de conversations productives » avec le gouvernement américain, après quoi la société a commencé à redéployer les modèles avec de nouveaux classificateurs conçus pour identifier et bloquer davantage de tâches liées à la cybersécurité.
La société a déclaré que les dernières mesures de protection visent à répondre aux préoccupations du gouvernement concernant une éventuelle utilisation abusive si les systèmes sont contournés par des méthodes de jailbreak.
Les restrictions avaient contraint Anthropic à suspendre l'accès à Fable 5 et Mythos 5 pour tous les utilisateurs plus tôt ce mois-ci, après qu'une directive de contrôle des exportations du gouvernement américain a ordonné à la société de bloquer les deux modèles pour tous les ressortissants étrangers.
Dans sa déclaration du 13 juin, Anthropic a indiqué que l'ordre couvrait également les employés de nationalité étrangère travaillant au sein de l'entreprise, ce qui l'a incitée à désactiver entièrement les modèles pour assurer la conformité.
Le secrétaire américain au Commerce, Howard Lutnick, a déclaré mercredi sur X que les responsables avaient travaillé avec Anthropic au cours des deux dernières semaines pour examiner et approuver Fable 5 tout en maintenant le modèle conforme aux exigences du gouvernement américain.
La chef de cabinet de la Maison Blanche, Susie Wiles, a également déclaré sur X que la priorité du gouvernement était de déployer la meilleure technologie d'IA « aussi rapidement et en toute sécurité que possible ».
L'intervention est intervenue après que les responsables ont pris connaissance d'un rapport selon lequel des chercheurs d'Amazon avaient découvert une méthode pour contourner les protections de Fable 5 et faire en sorte que le modèle identifie des vulnérabilités logicielles.
Anthropic, cependant, a soutenu que le problème signalé n'était pas propre à Fable 5, affirmant que des modèles plus faibles pourraient également identifier les mêmes vulnérabilités et produire des résultats similaires liés aux exploits.
Dans sa réponse antérieure à l'ordre, la société a déclaré que les autorités n'avaient présenté que des preuves verbales de ce qu'elle décrivait comme un jailbreak étroit et non universel. Anthropic a affirmé qu'une telle méthode ne supprimait pas les protections de sécurité d'un modèle pour un large éventail de tâches, contrairement à un jailbreak universel.
« Nous ne sommes pas d'accord pour dire que la découverte d'un jailbreak potentiel étroit devrait justifier le rappel d'un modèle commercial déployé auprès de centaines de millions de personnes. Si cette norme était appliquée dans toute l'industrie, nous pensons qu'elle arrêterait essentiellement tous les nouveaux déploiements de modèles pour tous les fournisseurs de modèles de pointe. »
La société avait également averti que traiter un jailbreak étroit comme une raison de rappeler un modèle commercial de pointe pourrait affecter l'ensemble de l'industrie de l'IA si cela était appliqué comme une norme générale.
Les restrictions imposées à Anthropic ont également soulevé des préoccupations politiques en dehors des États-Unis. Le 29 juin, l'Autriche a exhorté l'Union européenne à envisager d'établir Anthropic au sein du bloc, le secrétaire d'État à la numérisation, Alexander Proell, arguant dans une lettre que l'Europe ne devrait pas risquer de perdre l'accès aux avancées majeures de l'IA en raison de décisions prises ailleurs.
Parallèlement au redéploiement du modèle, Anthropic a déclaré qu'elle intensifiait sa coopération avec le gouvernement américain en matière de tests de modèles, de mesures de protection et de suivi des abus. La société a indiqué que cela inclurait un accès avant la publication aux modèles et aux systèmes de sécurité pour évaluation, le partage d'informations sur les jailbreaks et les abus, et des ressources dédiées à la recherche conjointe.
Anthropic a également commencé à élaborer un cadre avec Amazon, Microsoft, Google et d'autres partenaires via le Projet Glasswing, une collaboration en cybersécurité annoncée en avril, pour évaluer la gravité des jailbreaks d'IA. La société a précisé que le cadre est en cours d'élaboration dans le cadre d'un effort consensuel pour classer les risques de jailbreak.
Le débat sur l'accès est intervenu alors qu'Anthropic a poursuivi ses efforts pour une surveillance plus stricte de l'IA de pointe. Dans sa proposition du 11 juin intitulée « Politique sur l'exponentielle de l'IA », la société a appelé à des exigences de test, des évaluations indépendantes, des normes de cybersécurité et des mesures d'application pour les systèmes d'IA avancés, citant des risques potentiels biologiques, de cybersécurité et opérationnels.