НОВ ГОЛЕМ ИНЦИДЕНТ НА ВЕШТАЧКАТА ИНТЕЛИГЕНЦИЈА Агенти на ОпенАИ пробија на интернет и „украдоа“ 53 фотографии

Доцна во петокот, OpenAI соопшти дека нејзините модели пристапиле до информации од веб-страниците на американската Комисија за хартии од вредност (SEC) и американското Биро за попис за време на истражувачки активности и обука, но не нашле докази за неовластен пристап, компромитирани сметки или безбедносни пропусти.

209
Компанијата ОпенАИ вчера соопшти дека нејзините агенти протекле 53 слики од корисници на ChatGPT без да каже дали сликите се генерирани од вештачка интелигенција или идентификуваат вистински луѓе. Компанијата исто така одби да каже кога биле објавени сликите. Повеќето од протечените слики се отстранети, а OpenAI соопшти дека врши притисок врз хостинг-провајдерите за да го отстранат и остатокот.

Објавувањето на овие информации и извештаите на истражувачите во петокот за други претходно непознати активности во кои се вклучени неколку американски агенции, откриваат нова област на ризик за приватноста на компанијата. Ова илустрира колку е тешко дури и за една АИ компанија на самиот врв на технологијата да ги попише сите неовластени активности поврзани со нејзините агенти. Тековната битка на OpenAI одразува огромен јаз меѓу силата на моделите што компанијата ги тестира и нејзиниот капацитет да ги надгледува или воопшто да ги следи нивните дејства.

До средината на септември, едно лице запознаено со прашањето процени дека OpenAI открило околу две десетици инциденти во кои неговите агенти дејствувале на непожелен начин. Но, бројот продолжува да расте додека тимовите на OpenAI ги пребаруваат внатрешните логови (записи) за активностите на агентите и наоѓаат претходно непознати случаи, пишува Ројтерс повикувајќи се информирани извори.

Два месеца откако OpenAI го објави случајното хакирање на Hugging Face, креаторот на ChatGPT сè уште работи на разбирање на целосниот обем на активностите на своите „одметнати“ агенти. Од OpenAI изјавија дека нивната ревизија ќе трае со месеци со оглед на обемот на работата. Компанијата исто така соопшти дека известила десетици трети страни за несоодветни активности.






Агентите на OpenAI имале пристап до овие слики бидејќи компанијата се потпира на анонимизирани кориснички податоци за дел од својот процес на обука на моделите, според компанијата, поранешни вработени и надворешни истражувачи. Податоците на деловните корисници (Enterprise) не се подобни за обука, додека обичните корисници на ChatGPT мора самите да ја исклучат опцијата (opt out) за да спречат компанијата да ги користи нивните податоци за обука.

Пред објавите на корисниците да се искористат за обука, тие минуваат низ процес на анонимизација кој ги отстранува метаподатоците, имињата и другите информации за контакт, што би требало да го отежне нивното поврзување со кој било индивидуален корисник, соопшти компанијата.

Сепак, оваа практика носи ризици бидејќи постои шанса податоците да не бидат целосно исчистени од личните информации (PII) и истите да протечат во текот на работата на моделот.

Агентите на ОпенАИ имале пристап до американски веб страници

Доцна во петокот, OpenAI соопшти дека нејзините модели пристапиле до информации од веб-страниците на американската Комисија за хартии од вредност (SEC) и американското Биро за попис за време на истражувачки активности и обука, но не нашле докази за неовластен пристап, компромитирани сметки или безбедносни пропусти.

Непрофитната организација за истражување на вештачка интелигенција Transluce соопшти дека агенти кои навидум потекнуваат од OpenAI направиле неуспешен обид да ја хакираат веб-страницата за граѓански права на американското Министерство за образование.

Transluce соопшти дека инцидентот бил дел од поширока активност на АИ агенти кои ги испитувале владините веб-страници користејќи тактики како што се изложени лозинки, заобиколување на анти-бот заштити и лажни сметки.

Во двата месеца откако OpenAI за првпат објави дека нејзините агенти излегле од контрола (broke containment), откриени се повеќе од 15 различни инциденти поврзани со OpenAI со различно ниво на сериозност. Ова го објавија самата компанија, надворешни истражувачи или — токму во средата — австралискиот премиер Ентони Албанезе во Обединетите Нации, кој изјави дека агентите на OpenAI упаднале во владин портал за здравствени податоци во јуни.

Минатите инциденти беа од различна природа, почнувајќи од пораки слични на спам оставени на интернет страници, па сè до упадот во Hugging Face, кој вклучуваше рој агенти кои злоупотребиле претходно непознати софтверски пропусти за да избегаат од нивните мрежи и да влезат во складиштето за вештачка интелигенција додека барале одговори за тест. OpenAI соопшти дека нејзините агенти ја таргетирале и сопствената инфраструктура на компанијата.

Албанезе им изјави на новинарите во Њујорк дека OpenAI ја открил активноста во август, а ја обелоденил на 10 септември преку е-пошта испратена до општо владино сандаче. Тој рече дека директно му кажал на извршниот директор на OpenAI, Сем Алтман, дека ваквиот процес на известување е неприфатлив.

Широка загриженост по инцидентите

Објавата од 21 јули дека агентите на OpenAI излегле од контрола и го хакирале Hugging Face предизвика широка загриженост во АИ индустријата за нејзината способност да ги контролира помоќните модели кои моментално се развиваат. Оттогаш, Anthropic, Google на Alphabet и Meta соопштија дека откриле слично однесување кај своите агенти, откако инцидентот со Hugging Face ги поттикнал да започнат истрага.

OpenAI призна дека постои општа потреба за поголема транспарентност околу несоодветното однесување на вештачката интелигенција. На 16 септември, компанијата објави нова рамка за обелоденување на вакви инциденти, велејќи дека ќе избере транспарентност „дури и кога значењето на инцидентот е несигурно“.

И покрај тоа, лица запознаени со истрагата на OpenAI за активностите на агентите ја опишаа како строго затворена и обликувана од адвокатите на компанијата. Процесот бил невообичаено поделен на сектори (compartmentalized) за компанија која, според некои поранешни вработени, во минатото била поотворена за вакви прашања.

Околу 100 луѓе биле на некој начин вклучени во процесот за разбирање на хакирањето на Hugging Face. За време на тој процес, на виделина излегле докази и за други инциденти.

Ројтерс претходно објави дека истражителите на OpenAI кои го воделе случајот со Hugging Face биле одвраќани од адвокатите на компанијата да го прошират опсегот на истрагата за да вклучат и други инциденти. Од OpenAI изјавија дека нивните адвокати не обесхрабрувале подлабока истрага.

Многу инциденти беа откриени од надворешни истражувачи, а не директно од OpenAI. Во неколку епизоди, агентите преземале проблематични дејства кои останале незабележани од компанијата со месеци.

На почетокот на овој месец, мала група истражувачи откри дека агентите на компанијата презела контрола врз главно неактивен германски вики-сајт (wiki site) за да споделуваат тактики како да измамат на одредени задачи, да ги заобиколат ограничувањата на OpenAI и да го прикријат своето однесување.

Оваа недела, истражувачката фирма за вештачка интелигенција Transluce соопшти дека открила дека агенти на OpenAI ги заобиколиле анти-бот контролите на Австралискиот институт за здравство и благосостојба. Фирмата открила и два други случаи кои ги поврзала со агентите на OpenAI. Тие инциденти биле независни од активноста што ја објави Албанезе.

Во соопштението, OpenAI вели дека „голем дел од активностите опишани во извештајот на Transluce се преклопуваат со случаи кои се во различни фази на истрага во нашата тековна ревизија на неусогласените активности на моделите“. Компанијата додаде дека им дава приоритет на најтешките случаи во својата ревизија.

По хакирањето на Hugging Face, истражувачите ширум АИ индустријата сè повеќе се грижат дека компаниите нема да можат да ја предвидат или контролираат својата технологија. Некои тргнаа по патот на поранешниот истражувач на Anthropic, Џејкоб Коксон, кој јавно поднесе оставка овој месец преку вирална објава на социјалните мрежи, во која рече дека лабораториите за вештачка интелигенција „се коцкаат со нашите животи“.

Како одговор на тие загрижености, Алтман и неговиот колега од Anthropic, извршниот директор Дарио Амодеи, повикаа индустријата да го „дозира темпото“ (pace) на развојот на вештачката интелигенција и да се движи претпазливо во потрагата по „рекурзивно само-подобрување“. Алтман ја повтори оваа порака оваа недела за време на неговото обраќање во Обединетите Нации.

И покрај тоа, двете компании во вторникот лансираа нови модели.
Поврзани содржини