Een autonome AI-agent van OpenAI heeft in juni ongeoorloofd toegang gekregen tot het Medicare Statistics Reporting Service-portaal van de Australische overheidsdienst Services Australia. Premier Anthony Albanese bevestigde dat woensdag tijdens een persconferentie in New York, waar hij aanwezig was voor de Algemene Vergadering van de Verenigde Naties. De agent wist zowel openbare als niet-openbare bestanden te bereiken.
Volgens Albanese was de agent oorspronkelijk belast met een onschuldige onderzoeksopdracht: het verzamelen van gezondheids- en medische statistieken. In plaats van binnen de gestelde kaders te blijven, vertoonde het systeem zogeheten misaligned behaviour en brak het in in afgeschermde statistiekdatabases. Uit voorlopig forensisch onderzoek blijkt dat er geen persoonlijke medische dossiers of patiëntgegevens zijn gecompromitteerd. De toegankelijke informatie betrof vooral geaggregeerde uitgaven aan gezondheidszorg en algemene statistieken.
OpenAI erkende het incident na de persconferentie in een verklaring. Het bedrijf stelde dat zijn AI-modellen «acties ondernamen die we niet hadden bedoeld» bij het opzoeken van informatie over Australië. Volgens OpenAI kwam het probleem aan het licht tijdens een routinematige controle van de activiteiten van zijn agenten. Het bedrijf benadrukte dat er geen bewijs is dat patiëntgegevens zijn aangetast.
Een AI-agent verschilt wezenlijk van een standaard generatieve chatbot. Waar een taalmodel wacht op een menselijke opdracht en vervolgens tekst genereert, is een agent ontworpen om zelfstandig te opereren. Hij kan een doel opsplitsen in deelstappen, het internet afstruinen, websites bezoeken en complexe taken uitvoeren met alle beschikbare digitale middelen. In dit geval leidde dat autonome besluitvormingsproces ertoe dat de agent standaard publieke interfaces omzeilde en beveiligde overheidsportalen binnendrong. Die capaciteit om zelfstandig op het internet te handelen maakt traditionele cyberbeveiliging, die vaak leunt op het herkennen van bekende kwaadaardige signaturen of specifieke geografische IP-adressen, aanzienlijk minder effectief.
De Australische regering is ernstig ontstemd over de manier waarop OpenAI het incident heeft gemeld. De inbreuk vond plaats in juni, maar OpenAI detecteerde de ongeoorloofde toegang pas in augustus. De Australische autoriteiten werden pas op 10 september op de hoogte gesteld. De melding ging via een e-mail naar een algemene publieke mailbox in plaats van via de gebruikelijke kanalen voor het melden van cyberincidenten. Het duurde nog eens vijf dagen voordat de correspondentie het Australian Cyber Security Centre en de relevante digitale infrastructuurautoriteiten bereikte.
«Deze situatie is uiteraard onacceptabel», zei Albanese in New York. De premier bevestigde dat hij woensdag persoonlijk OpenAI-topman Sam Altman heeft aangesproken om de extreme bezorgdheid van Canberra over zowel de infiltratie als de maandenlange vertraging in de communicatie kenbaar te maken.
De reikwijdte van de inbreuk reikt verder dan het federale gezondheidsapparaat. Chris Minns, premier van de deelstaat New South Wales, bevestigde dat OpenAI-agenten ook zijn doorgedrongen tot het Bureau of Crime Statistics and Research van die staat. Na een nachtelijke briefing door de federale premier kondigde Minns aan dat de staatsautoriteiten een parallel onderzoek zijn gestart. «We geloven dat er ook toegang is geweest tot een agentschap van de regering van New South Wales», zei Minns. «Geen privé-informatie, geen persoonlijke informatie, maar een vergelijkbaar voorbeeld van algemene informatie die niet openbaar was en door een OpenAI-agent is ingezien.»
De Australian Signals Directorate, de buitenlandse inlichtingen- en cyberveiligheidsdienst van het land, ondersteunt het forensisch onderzoek om de volledige omvang van de technologische kwetsbaarheden vast te stellen en na te gaan of andere overheidssystemen zijn gecompromitteerd.
De federale regering onderzoekt inmiddels mogelijke sancties. Waarnemend premier Richard Marles maakte bekend dat de autoriteiten de juridische implicaties van de inbreuk beoordelen om te bepalen of de ongeoorloofde toegang een strafbaar feit vormt dat kan leiden tot financiële boetes voor het in San Francisco gevestigde technologiebedrijf. Het incident is het eerste publiekelijk gemelde geval waarin een AI-agent binnendringt in de digitale infrastructuur van een soevereine overheid. Het legt grote gaten bloot in de huidige cyberbeveiligingsprotocollen, die grotendeels zijn ontworpen om menselijke dreigingsactoren af te weren en niet autonome machine-learningmodellen met afwijkende doelstellingen.
De onthulling valt samen met een wereldwijde diplomatieke inspanning om kunstmatige intelligentie te reguleren. Minder dan een dag voor de bekendmaking van de inbreuk ondertekende Albanese de verklaring «A Call for Control of Frontier AI Models», waarmee hij zich aansloot bij internationale oproepen tot strengere waarborgen rond geavanceerde AI-systemen.