„Опен АИ“, „Антропик“ и безбедносните експерти истражуваат десетици илјади инциденти во кои нивните напредни ВИ-модели презеле чекори што надворешните проценувачи ги сметаат за проблематични.
Според сознанијата на „Аксиос“, толкавиот број случаи, забележани во последните месеци за време на интерните тестирања и во реалната примена, покажува дека проблемот е значително посложен отколку што се мислеше. Наодите од интерните процени го отвораат и прашањето дали водечките компании во секторот воопшто можат да воспостават целосна контрола врз својата технологија.
Природа на инцидентите
Според изворите, инцидентите вклучуваат заобиколување на безбедносните протоколи, самостојно стартување на интернет-форуми за дискусија, излегување од изолираните тест-опкружувања, преземање контрола врз веб-страници и обиди за избегнување на надзорот. Случаите се случувале и во интерните тестови и во реалното опкружување, а многу од нив сѐ уште не се јавно објавени бидејќи безбедносните експерти и понатаму спроведуваат истраги.
Дел од тестирањата се спроведува како таканаречен „ред-тиминг“ (црвен тим), каде што компаниите намерно ги поттикнуваат моделите на несоодветно однесување за да ја проверат безбедноста на системот. Проблематичното однесување на автономните агенти станува сѐ почеста појава во развојот на напредната вештачка интелигенција.
Главните ВИ-лаборатории се соочуваат со сличен предизвик: луѓето се обидуваат да постават заштитни механизми, додека моќните системи се трудат да ги извршат задачите по секоја цена.
Реакција на „Опен АИ“
Инцидентите се разликуваат по сериозноста и се слични на оние што „Опен АИ“ ги откри во последните денови. Вклучуваат успешни и неуспешни обиди за заобиколување на правилата, а за мнозинството засега не е познато дека предизвикале штета во реалниот свет.
Изворите наведуваат дека вкупниот број би можел да биде и значително поголем од десетиците илјади. Неодамна „Опен АИ“ и надворешните истражувачи објавија низа вознемирувачки епизоди. Меѓу нив се случаи во кои агентите на „Опен АИ“ на интернет објавиле 53 слики од корисници на „Чет-ГПТ“, упаднале на веб-страница на австралиската влада и се обиделе да хакираат други страници, вклучувајќи ги и оние на американската влада.
„Опен АИ“ објави дека привремено го запира тренирањето на своите најспособни модели. Портпаролот за „Аксиос“ изјави дека со работата ќе продолжат дури кога ќе бидат сигурни дека вовеле дополнителни заштитни мерки и ја подобриле усогласеноста на системот. Извршниот директор Сем Алтман објави на платформата „Х“ дека интерната ревизија не оди онолку брзо колку што би сакале.
Алтман истакна дека инцидентот со платформата „Хагинг фејс“ е најсериозниот што досега го забележале. Во тој случај група од стотина агенти координирала активности преку форум и хакирала надворешна компанија за да ги подобри сопствените резултати на тестот за сајбер-безбедност.
-Луѓето сакаат да знаат дека ВИ се развива безбедно, а тоа започнува од она што ние самите го правиме. Ова не е првпат да ја паузираме работата поради вакви мерки, а не очекуваме ни дека ќе биде последен, бидејќи способностите на ВИ продолжуваат да напредуваат - рече портпаролот на „Опен АИ“.
Состојбата во „Антропик“
„Антропик“ ангажира надворешна безбедносна организација да го испита однесувањето на нивните модели. Во јавно објавените документи компанијата откри колку често се случуваат епизоди на „неусогласеност“. Извештајот за нивниот модел Опус 5.5, објавен оваа недела, покажа колку често моделот реагирал на начини кои компанијата ги смета за необични или проблематични.
На пример, моделот се обидел да побегне од безбедното тестно опкружување во 1,5 отсто од случаите. Компанијата напоменува дека се работело за експерименти во кои задачата не можела да се реши без тој чекор.
Бидејќи „Антропик“ и другите компании спроведуваат стотици илјади тестирања, дури и мал процент неочекувано однесување може да резултира со десетици илјади инциденти во кои моделите се однесувале неочекувано и понекогаш загрижувачки.
Инцидентот со платформата „Хагинг фејс“, како и низа други што следуваа, ги поттикнаа водечките луѓе во ВИ-индустријата да повикаат на забавување на развојот и да побараат постриктна национална и меѓународна регулатива.
Некои во „Опен АИ“ го сметаат случајот „Хагинг фејс“ за изолиран и веруваат дека идните инциденти веројатно ќе бидат помалку сериозни поради подобрите контроли и специфичната природа на тој тест, кој вклучувал модел што сѐ уште не бил во јавна употреба.
Експертите за безбедност на вештачката интелигенција се согласуваат дека постојат едноставни решенија што можат да им помогнат на компаниите да ги избегнат ситуациите поради кои случајот со „Хагинг фејс“ изгледаше толку опасно.
Сепак, други директори и истражувачи предупредуваат дека немаат многу доверба во способноста на ВИ-компаниите да спречат какво било проблематично однесување на моделите. Новата генерација ВИ-модели ги извршува задачите со исклучителна упорност, па обидот за ограничување на нивната снаодливост е често однапред изгубена битка. Невозможно е да се предвиди секој начин на кој системот би можел да излезе од контрола.
Челниците на ВИ-компаниите велат дека моделите често користат техники што на луѓето никогаш не би им паднале на памет за да ги заобиколат правилата.
-Обидот за составување совршена листа на она што се смее, а што не, веројатно е залудна работа - рече еден експерт за сајбер-безбедност.
Процени на експертите
Расте загриженоста бидејќи ако моделот повеќепати направи проблематичен потег при тестирањето, поголема е веројатноста дека неговото однесување ќе предизвика реален сајбер-инцидент.
Конор Лихи, истражувач и извршен директор на организацијата „Контрол АИ“, вели дека проблемот не е во тоа колкава штета предизвикал секој поединечен случај. „Неверојатно е“, изјави Лихи, „што овде се работи за автономни системи кои прават работи што им се забранети“, што потенцијално вклучува и кривични дела.
Одредена количина таканаречено „неусогласено однесување“ е очекувана додека компаниите ги тестираат новите модели, а експертите за „Аксиос“ изјавија дека целосното отстранување на тој ризик можеби и не е изводливо. Се очекува со понатамошниот развој на ВИ-способностите да продолжат да се појавуваат извештаи за непредвидено однесување на моделите.
Извор: index
Фото: magnific