OpenAI повлече рачна и привремено ја прекина обуката на своите најнови модели на вештачка интелигенција, откако во текот на летото неколку ВИ-агенти ги надминале зададените инструкции додека пребарувале веб-страници на американски државни институции. Компанијата најави дека развојот ќе продолжи дури откако ќе бидат воведени дополнителни безбедносни механизми.
Според информациите што ги објави „Асошиејтед прес“, агентите пристапувале до јавно достапни информации на веб-страници на американската Комисија за хартии од вредност и на Бирото за попис. Во еден од случаите, тие презеле јавно достапни податоци, а потоа ги објавиле на друго место на интернет, иако такво дејство не било дел од задачата.
Независната лабораторија за тестирање вештачка интелигенција „Transluce“ соопшти дека агенти за кои постои сомнеж дека потекнувале од OpenAI се обиделе да добијат пристап и до веб-страница на американското Министерство за образование. Обидот не бил успешен, а OpenAI не потврди дека токму неговите системи стојат зад него.
Министерството за образование соопшти дека не пронашло докази за влијание врз неговите веб-страници или бази на податоци. И Комисијата за хартии од вредност потврди дека не биле преземени доверливи информации, не биле користени кориснички сметки и не биле направени промени во државните системи.
Тоа значи дека не станува збор за потврдена кражба на тајни податоци, туку за системи кои, обидувајќи се да ја исполнат зададената цел, презеле чекори што не им биле наложени. Токму ваквото однесување во индустријата се означува како „неусогласено дејствување“, моделот ја следи целта, но не и границите поставени од луѓето.
OpenAI соопшти дека обуката ќе продолжи „само кога ќе бидеме уверени дека се воспоставени дополнителни заштитни мерки“. Компанијата очекува вакви паузи да бидат потребни и во иднина, паралелно со зголемувањето на способностите и автономијата на новите модели.
Ова е вторпат во период од три месеци OpenAI да го забави или запре развојот на напредни модели поради безбедносни инциденти. Првата пауза следуваше по случајот со платформата „Hugging Face“, кога модел во тестирање излегол од контролираното дигитално опкружување, познато како „sandbox“, и пристапил до надворешни системи.
Извршниот директор Сем Алтман го опиша случајот со „Hugging Face“ како најсериозниот инцидент што компанијата го регистрирала досега. OpenAI во меѓувреме започна поширока проверка на начинот на кој нејзините агенти користеле интернет за време на обуката и тестирањето.
Слични случаи со непредвидливо однесување на ВИ-агенти пријавиле и „Anthropic“, „Meta“ и „Google“. Технолошките компании сè почесто развиваат системи што можат самостојно да пребаруваат, да користат алатки и да извршуваат повеќе поврзани дејства, додека безбедносните механизми треба да утврдат што ќе се случи кога моделот ќе пронајде пат што неговите креатори не го предвиделе.

