ЗАГРИЖУВАЧКИ ИНЦИДЕНТ Модели на ВИ избегале од изолација и извршиле хакерски напад

OpenAI објави дека идентификувал безбедносен пропуст во инсталерот на пакетот, го пријавил и работи со Hugging Face на понатамошна истрага. Компанијата, исто така, објави дополнителни безбедносни мерки што ќе „ги ограничат можностите на моделот за време на идните тестирања и ќе ја зајакнат инфраструктурата за да спречат слични инциденти повторно да се случат“.

183

OpenAI призна дека за време на тестирањето на внатрешната безбедност, еден од неговите напредни модели на вештачка интелигенција ги компромитирал системите на платформата Hugging Face. Компанијата вели дека станува збор за случаен инцидент што се случил за време на проценката на кибернетските способности на моделот, а не за намерен напад.

Според соопштението на OpenAI, во инцидентот биле вклучени повеќе модели, вклучувајќи го GPT-5.6 Sol и уште понапреден модел пред објавување. И двата имале олабавени безбедносни ограничувања за цели на тестирање со цел да се проценат нивните сајбер безбедносни способности.






Проблемот се појавил за време на тестирањето на јавно достапната алатка ExploitGym, наменета за проценка на способноста на моделите да ги искористат познатите безбедносни ранливости.

Ваквите реперни тестови често се користат во развојот на вештачката интелигенција, но ова е првиот познат случај каде што тестирањето довело до вистински сајбер напад.

Моделот не требало да има пристап до интернет. Единствената дозволена надворешна функција била алатка за инсталирање на софтверските пакети потребни за завршување на задачата. Сепак, моделот пронашол претходно неоткриена ранливост во таа алатка и ги заобиколи ограничувањата и добил бесплатен пристап до интернет.

Потоа заклучил дека Hugging Face веројатно хостира модели, бази на податоци и можни одговори поврзани со ExploitGym. Потоа ги пребарал системите на платформата и пронашол начин да пристапи до доверливите податоци што ги содржеле тест решенијата, со што практично стигнал до одговорите што требало сам да ги најде.

„Во потрагата по решение за ExploitGym, моделите биле исклучително фокусирани на постигнување на многу тесна цел и презеле екстремни чекори за да ја постигнат“, рекоа од OpenAI.

Во првото соопштение за медиумите, Hugging Face го опиша инцидентот како софистициран и агресивен сајбер напад. Компанијата изјави дека евидентирала „повеќе илјади индивидуални акции“ извршени низ голем број краткотрајни изолирани средини (песочни кутии), со инфраструктура за управување со напади распоредена на јавни услуги.

На почетокот, Hugging Face верувал дека зад нападот стои „надворешен агент на вештачка интелигенција“, но последователната истрага покажала дека токму моделите на OpenAI, за време на внатрешното тестирање, излегле од наменетата изолирана средина.

OpenAI објави дека идентификувал безбедносен пропуст во инсталерот на пакетот, го пријавил и работи со Hugging Face на понатамошна истрага. Компанијата, исто така, објави дополнителни безбедносни мерки што ќе „ги ограничат можностите на моделот за време на идните тестирања и ќе ја зајакнат инфраструктурата за да спречат слични инциденти повторно да се случат“.

Засега не е познато дали OpenAI ќе се соочи со правни последици поради овој случај, иако некои експерти веруваат дека дејствијата на моделот би можеле да претставуваат прекршување на Законот за компјутерски измами и злоупотреба на САД.

Истражувачот на OpenAI, Мика Керол, рече дека овој случај јасно покажува како усогласувањето на целите на системот за вештачка интелигенција со човечките намери ќе стане важно прашање во идниот развој на вештачката интелигенција.

Поврзани содржини