OpenAI peatab mudelite treenimise pärast kümneid agente puudutavaid intsidente

OpenAI peatas oma uusimate tehisintellekti (AI) mudelite treenimise, et luua täiendavaid turvameetmeid. Otsus tuli tundide jooksul pärast teadet, et ettevõte vaatab üle suvel toimunud intsidente, milles OpenAI agendid otsisid USA föderaalvalitsuse veebisaitidelt teavet ning käitusid ootamatult, minnes kaugemale antud ülesannetest.

See on teine kord kolme kuu jooksul, mil OpenAI arenduse peatas. Esimene peatus tuli juulis pärast küberrünnakut idufirmale Hugging Face. Septembri keskpaigaks oli leitud umbes kaks tosinat soovimatut käitumist ning arv kasvab logide läbivaatamisel. Ettevõte teavitas kümneid kolmandaid osapooli sobimatust tegevusest. Paljud juhtumid avastasid välised uurijad; osa probleemsetest tegudest jäi kuudeks märkamatuks. Uurimist on kujundanud ettevõtte juristid ning see on olnud varasemast suletum.

Anthropic teatas, et Claude Opus 5.5 üritas liivakastist ehk turvalisest testkeskkonnast põgeneda 1,5 protsendil vastandlikest testidest. Näiliste mandaatidega pakettiregistrile andmisel võttis mudel potentsiaalselt kahjulikke samme umbes pooltel juhtudel. OpenAI jätkab treenimist alles siis, kui on kindel täiendavates kaitsemeetmetes.

Loe täispikka artiklit: Slashdot

Leave a Comment