OpenAI opplyser at selskapets KI-agenter har lekket 53 bilder fra ChatGPT-brukere. Selskapet arbeider fortsatt med å kartlegge omfanget av uønsket aktivitet knyttet til agentene.
Kortversjonen
- OpenAI bekrefter at kunstige intelligens-agenter har lekket 53 bilder generert eller lastet opp av ChatGPT-brukere.
- Selskapet forsøker fortsatt å kartlegge omfanget av uønsket aktivitet, noe som kan ta flere måneder.
- Bilder og data var tilgjengelige fordi OpenAI bruker anonymisert brukerinnhold i opplæringen av sine modeller.
OpenAI vil ikke opplyse om bildene var KI-genererte eller avbildet virkelige personer. Selskapet vil heller ikke si når de ble publisert, skriver The Guardian.
De fleste bildene er fjernet, ifølge OpenAI. Selskapet opplyser at det ber leverandører som lagrer innhold på nettet, om å fjerne resten.
Gjennomgang kan ta måneder
Opplysningene kommer to måneder etter at OpenAI opplyste at selskapets agenter hadde brutt seg inn hos KI-plattformen Hugging Face. To personer med kjennskap til saken sier til Reuters at ChatGPT-selskapet fortsatt forsøker å forstå det fulle omfanget av agentenes aktivitet.
OpenAI sier at gjennomgangen vil ta «måneder» på grunn av arbeidets omfang, og at selskapet har varslet «dusinvis» av tredjeparter om uregelmessig aktivitet. I midten av september anslo én person med kjennskap til saken at OpenAI hadde funnet rundt to dusin tilfeller der agentene hadde handlet på uønskede måter. Antallet har fortsatt å stige etter hvert som selskapets team går gjennom interne logger, ifølge to personer nær selskapet.
Les også: 30 minutter som endret spillereglene for amerikansk maktbruk
Siden OpenAI først opplyste at agentene hadde kommet ut av kontroll, er det offentliggjort mer enn 15 hendelser knyttet til selskapet, med ulik alvorlighetsgrad. Hendelsene er opplyst av OpenAI, eksterne forskere og andre. Onsdag sa Australias statsminister Anthony Albanese i FN at OpenAI-agenter hadde brutt seg inn i en portal med offentlige helsedata i juni.
Anonymiserte data
Agentene hadde tilgang til bildene fordi OpenAI bruker anonymiserte brukerdata i deler av opplæringen av modellene, ifølge selskapet, tidligere ansatte og eksterne forskere. Data fra bedriftskunder brukes ikke til opplæring, mens vanlige ChatGPT-brukere må reservere seg dersom de ikke vil at dataene skal brukes til dette.
Før brukerinnhold brukes til opplæring, blir metadata, navn og annen kontaktinformasjon fjernet, opplyser OpenAI. Selskapet sier prosessen skal gjøre det vanskelig å knytte materialet til enkeltbrukere. Tre personer med kjennskap til praksisen sier imidlertid at det kan være en risiko for at personopplysninger ikke fjernes fullstendig, og at data kan lekke gjennom modellenes aktivitet.
OpenAI har erkjent et generelt behov for større åpenhet om uønsket KI-atferd. 16. september publiserte selskapet et nytt rammeverk for å offentliggjøre slike hendelser og sa at det ville legge seg på en åpen linje, også når hendelsens betydning er usikker.












