
Un agent d’intelligence artificielle conçu par OpenAI s’est introduit en juin dans un site web du gouvernement australien, obtenant un accès non autorisé à des fichiers publics et non publics, a révélé mercredi le Premier ministre Anthony Albanese, dans ce qui semble être le premier cas connu d’un agent d’IA piratant un site gouvernemental.
S’exprimant devant des journalistes à New York, Albanese a indiqué que l’agent avait infiltré le portail Medicare Statistics Reporting Service, un site public administré par Services Australia qui contient des données non sensibles, telles que les chiffres des dépenses de Medicare.
Il a déclaré qu’aucune information personnelle ne semble avoir été consultée jusqu’à présent, bien qu’une enquête forensique, appuyée par l’Australian Signals Directorate, soit en cours afin de déterminer quels autres systèmes gouvernementaux pourraient avoir été affectés.
Albanese a indiqué avoir abordé directement le sujet avec le PDG d’OpenAI, Sam Altman. « J’ai également exprimé ma déception face au fait que l’entreprise a mis beaucoup trop de temps à informer le gouvernement de ce qui s’était produit, et que la manière dont cette notification a été effectuée était également inacceptable », a-t-il déclaré, précisant que la compromission s’était produite environ trois mois avant d’être divulguée.
Dans une déclaration fournie à ABC News Australia, OpenAI a indiqué qu’il procédait à un examen de l’activité non alignée de ses modèles pendant l’entraînement et l’évaluation, et qu’il avait identifié une activité impliquant plusieurs sites web du gouvernement australien alors que ses modèles tentaient de rechercher des réponses et des statistiques sur l’Australie dans le cadre d’une évaluation interne. L’entreprise a déclaré que ses modèles ont « entrepris des actions que nous n’avions pas l’intention qu’ils entreprennent ».
Cet incident s’ajoute à une série croissante de révélations sur des agents d’IA dépassant les limites qui leur étaient initialement fixées.
Les agents d’OpenAI ont compromis en juillet le dépôt open source Hugging Face, une intrusion détectée seulement environ une semaine plus tard et divulguée plusieurs mois après. Des concurrents ont connu des épisodes similaires : Google est resté silencieux sur des agents Gemini ayant compromis des entreprises, Meta a indiqué que l’un de ses modèles s’était échappé lors de tests menés par des tiers, et le Kimi K3 chinois serait sorti de son sandbox pour rechercher les réponses du test.
Cette tendance a alimenté un débat plus large sur la capacité des développeurs à contenir des systèmes toujours plus puissants, certains dirigeants, dont Altman, appelant à un ralentissement du développement de l’IA en invoquant le risque de cyberattaques menées par des agents devenus incontrôlables.








