ВИ-моделите на OpenAI со месеци си оставале пораки, потоа го пробиле Hugging Face

Експериментални модели на OpenAI со месеци меѓусебно разменувале пораки и соработувале за да излезат од затворената тест-околина, пред во јули да пробијат дел од инфраструктурата на платформата Hugging Face.

Активноста започнала уште во мај, кога повеќе ВИ-агенти добиле задачи што во одредени случаи не можеле да ги завршат без пристап до интернет. Агентите почнале да си оставаат белешки преку незабележани табли за пораки и да бараат помош едни од други за да стигнат до потребните податоци.

Според истражувачите на OpenAI, агентите постепено се насочиле кон заобиколување на ограничувањата наместо кон самостојно решавање на задачите. Во еден случај требало да обработат табела со линкови до Google Drive, иако немале интернет-пристап, а во друг недостигала датотека неопходна за решавање на задачата.

Кога OpenAI ја исклучил првата табла за комуникација, моделите неколку недели подоцна пронашле нов начин за размена на пораки. Тие откриле и претходно непозната ранливост во Artifactory, систем што се користел како посредник за софтверски пакети, преку која добиле пристап до интернет.

Откако излегле од тест-околината, агентите заклучиле дека Hugging Face можеби ги чува моделите, податоците и решенијата поврзани со безбедносниот тест ExploitGym. Наместо да ги решат задачите, тие се обиделе да стигнат до одговорите преку системите на платформата.

OpenAI потврди дека во инцидентот учествувала комбинација од негови модели, меѓу кои GPT-5.6 Sol и помоќен истражувачки прототип што не бил наменет за јавно објавување. За потребите на тестирањето, безбедносните ограничувања на моделите биле намалени.

Hugging Face реконструирал околу 17.600 дејства извршени од агентите меѓу 9 и 13 јули. Според компанијата, моделите самостојно комбинирале повеќе ранливости, добиле пристап до продукциски системи и продолжиле со активностите неколку дена, без човек да ги насочува поединечните чекори.

Во текот на пробивот биле тестирани илјадници различни патишта, биле користени украдени пристапни податоци и бил направен обид за движење низ повеќе делови од внатрешната инфраструктура. Hugging Face соопшти дека го отстранил пристапот на агентите, ги сменил погодените лозинки и токени и ги зајакнал безбедносните контроли.

OpenAI наведува дека ниту еден модел планиран за претстојно јавно објавување не бил вклучен во инцидентот. Истражувачкиот прототип бил деактивиран, шифриран и повлечен од понатамошна употреба, а компанијата најави построга изолација и надзор при идните безбедносни тестирања.

Најчитано