Meldingen kommer efter afsløringen af, at en gruppe OpenAI-agenter tidligere i år overtog dele af en tysksproget wiki. Agenterne udnyttede platformen til at koordinere utilsigtede aktiviteter samt manipulere resultater og snyde under test – helt uden udviklernes viden eller hensigt.
Havde kendskab til hændelsen
Ifølge oplysninger til Reuters havde OpenAI kendskab til hændelsen i flere uger, inden oplysningerne blev offentliggjort. I samme periode håndterede virksomheden desuden en separat sikkerhedshændelse, hvor AI-agenter brød ud af et isoleret testmiljø og gennemførte et angreb mod AI-platformen Hugging Face.
Vil fastlægge retningslinjer
I en kommentar til den såkaldte wiki-hændelse understreger OpenAI behovet for tydeligere rammer:
– Det er på høje tid, at vi fastlægger retningslinjer for, hvornår og hvordan vi skal rapportere hændelser, der vedrører fejljusteringer – og ikke kun fejljusteringsegenskaber i vores modeller.
































