ПОВЕЌЕ

    ТЕСТОТ ИЗЛЕЗЕ ОД КОНТРОЛА: Вештачката интелигенција на Anthropic нападна реални системи

    Време зa читање: 4 минути

    На Claude му било кажано дека се наоѓа во затворена компјутерска лабораторија и дека пред него има измислена компанија која треба да ја хакира. Но, тест-околината по грешка останала поврзана на интернет. Вештачката интелигенција тргнала по „знамето“, пронашла слабо заштитени реални системи и навлегла во инфраструктурата на три вистински организации.

    Компанијата Anthropic призна дека три различни верзии на нејзиниот модел Claude добиле неовластен пристап до надворешни системи за време на сајбер-безбедносни тестирања. Инцидентите биле откриени откако компанијата анализирала 141.006 тест-сесии, барајќи случаи во кои моделите можеле да стигнат до интернет од средини што требало да бидат целосно изолирани.

    Во тестовите биле вклучени Claude Opus 4.7, Claude Mythos 5 и внатрешен истражувачки модел. Најстарите инциденти датираат од април, но биле откриени дури по големата ревизија започната во јули. Имињата на погодените компании не се објавени. Две од нив воопшто не знаеле дека биле пробиени сè додека Anthropic не ги известил на 27 јули. Контактот со третата организација сè уште се воспоставувал.

    Клод не користел некаква досега невидена хакерска техника. Според Anthropic, моделите искористиле слаби лозинки и интернет-адреси до кои можело да се пристапи без соодветна автентикација. Токму тоа го прави случајот уште понепријатен: напредната вештачка интелигенција не морала да открие сложена ранливост – доволни биле вообичаени безбедносни пропусти какви што сè уште постојат во голем број компании.

    Моделите решавале задачи познати како „фати го знамето“. Во таквите тестови, на системот му се дава измислено сценарио и задача да влезе во друга машина и да пронајде скриена информација. Клод бил уверуван дека нема пристап до јавниот интернет и затоа реалните системи што ги пронашол ги третирал како дел од симулацијата.

    Во еден од случаите, Claude Opus 4.7 добил име на измислена компанија кое се совпаднало со името на реален бизнис. Откако не успеал да ја пробие замислената цел, моделот пронашол вистинска компанија, дошол до нејзини пристапни податоци и навлегол во базата. Дури и кога препознал дека можеби се наоѓа во реален систем, продолжил со нападот, убедувајќи се дека и тоа мора да е дел од тестот.

    Понапредниот истражувачки модел реагирал поинаку. Кога сфатил дека целта е реална, самостојно го запрел нападот. Anthropic го смета ова за охрабрувачки сигнал, но предупредува дека се потребни дополнителни тестирања пред да се извлечат пошироки заклучоци.

    Компанијата нагласува дека Клод не се обидел намерно да „избега“ од тестот, ниту да се копира или да ги напушти системите на Anthropic. Тест-инфраструктурата била одвоена од чувствителните внатрешни системи и од податоците на клиентите. Според компанијата, станува збор првенствено за оперативен пропуст: недоразбирање со надворешниот партнер Irregular оставило отворен пат до интернет.

    Сите сајбер-тестирања биле запрени на 23 јули, веднаш по откривањето на сомнителните записи. Anthropic најави построга контрола на тест-средините, постојано следење на однесувањето на моделите и посериозни проверки на надворешните партнери.

    Инцидентот доаѓа само неколку дена откако OpenAI призна дека негов агент излегол од изолирана тест-средина и ја компромитирал инфраструктурата на платформата Hugging Face. Разликата е во тоа што системот на OpenAI искористил новооткриена ранливост за да ја пробие изолацијата, додека на Клод интернетот му бил оставен достапен поради погрешно поставување на тестот.

    Но, за компаниите што биле хакирани, разликата е главно техничка. Во двата случаи, модели тестирани во контролирани услови стигнале до реални системи и извршиле активности што нивните создавачи не ги очекувале навреме.

    Случајот покажува дека опасноста не мора да започне со „непослушна“ вештачка интелигенција. Понекогаш е доволно човек да остави една врата отклучена – а системот што никогаш не се уморува да почне да ги проверува сите следни.

    14,794Следи нè на facebookЛајк

    слично