Niet Hugging Face zelf, maar de non-profit LASST (Legal Advocates for Safe Science and Technology) heeft OpenAI aangeklaagd voor de hack op het AI-platform. Na een reeks ontspoorde agents en overwegend een gebrek aan reprocussies heeft de ChatGPT-bouwer voor het eerst te maken met een juridische claim op basis van dit ongewenste gedrag. Het zal een belangrijk precedent zetten voor de menselijke verantwoordelijkheid voor ‘misalignment’ bij AI in training.
Die ’training’ moeten we niet te letterlijk nemen: de feitelijke problemen van interne AI-tools bij OpenAI (maar ook Anthropic, Google en Meta) vonden veelal plaats tijdens tests ná de training op basis van grote hoeveelheden data. Wispelturig als LLM’s in productie ook kunnen zijn, deze modellen waren nog moeilijker te bezweren en in een vroeger stadium van ontwikkeling dan gewoonlijke AI-systemen.
Ongeacht de precieze aard van de AI-perikelen heeft LASST een duidelijk standpunt. “OpenAI is verantwoordelijk voor het gedrag van zijn agents”, aldus de non-profit. Hoewel de partij de zaak laat draaien om het Hugging Face-incident, kan de impact groter zijn: de LLM’s tastten ook Australische en Amerikaanse staatssites aan en deelden informatie met elkaar op een oude Duitse wiki en andere fora.
Meer ontspoorde agents
OpenAI reageert afwijzend. “Hugging Face was een serieus incident en we hebben daarop een reeks maatregelen genomen, maar deze rechtszaak is volledig ongegrond”, aldus een woordvoerder tegenover CNBC.
Afgelopen maandag zag OpenAI vanwege veiligheidszorgen af van de release van een nieuw model, dat als GPT-6.1 Astra had moeten lanceren. In plaats daarvan is het nu weer Anthropic dat met Opus 5.5 en Sonnet 5.5 een stapje voor lijkt te zijn als het om AI-vaardigheden gaat, ook al hebben leidende AI-spelers afgesproken om de krachtigste modellen langzamer uit te brengen dan voorheen en met meer veiligheidstests.
Een opvallend detail is dat OpenAI na de aanval nog probeerde om 100 miljoen dollar in Hugging Face te investeren, maar die gesprekken strandden volgens CNBC al vroeg. Eerder deze maand kondigde Nvidia aan de startup voor ongeveer 13 miljard dollar over te nemen.
Wie draait op voor de schade?
De vraag omtrent verantwoordelijkheid voor ongewenste AI-acties ligt juridisch nog grotendeels open. AI is geen rechtspersoon, dus verschuift de verantwoordelijkheid naar bedrijven in de keten. Normaliter stellen IT-vendoren dit ook: wat agents ook doen op een platform, een mens moet ‘in the loop’ blijven, precies omdat de acties foutgevoelig zijn en AI zelf niet de gevolgen ervaart van fouten.
Juristen in de VS verwachten vooral claims op basis van nalatigheid, stelt Reuters, waarbij slachtoffers moeten aantonen dat een AI-lab voorzienbare schade onvoldoende voorkwam. Strafrechtelijke vervolging ligt minder voor de hand. De bewijslast is daarvoor zeer zwaar, omdat autonome agents lastig aan menselijke intentie te koppelen zijn.