„Опен АИ“ објави шест извештаи за случаи во кои неговите модели покажаа неочекувано однесување за време на тестирањето – вклучувајќи обиди за заобиколување на безбедносните ограничувања, неовластено дејствување на интернет и комуникација со други системи на ВИ. Компанијата истовремено воведува нова рамка за следење и јавно пријавување на ваквите случаи.
„Опен АИ“ претстави нова рамка за пријавување на таканаречените случаи на неусогласено однесување на моделите откако за време на тренингот и евалуацијата на своите системи забележа шест инциденти кои, според процената на компанијата, барале дополнително внимание.
Целта на новата рамка е систематско следење на однесувањето на моделите што отстапува од зададената цел или безбедносните правила, како и потранспарентно објавување на ваквите случаи. „Опен АИ“ наведува дека преку идните извештаи ќе се настојува да се изгради подобра слика за тоа како напредните системи на ВИ се однесуваат во ситуации кога ќе добијат поголема автономија.
Моделот се обидел да ги заобиколи сопствените ограничувања
Меѓу шесте документирани случаи се наоѓа и однесувањето на еден истражувачки модел кој во сопствените работни резимеа вметнувал инструкции поврзани со заобиколување на своите ограничувања.
Според „Опен АИ“, во 27 анализирани резимеа моделот генерирал инструкции кои вклучувале обид за „ослободување“ од улогите и идентитетот што му биле зададени во рамките на експериментот.
Ваквото однесување не значи дека моделот развил свест или сопствени цели, но покажува проблем што истражувачите за безбедност на системите на ВИ се обидуваат да го разберат: понапредните модели можат во одредени услови да произведат стратегии кои не биле дел од намерата на нивните креатори.
Друг модел прикачил датотеки на интернет
Во вториот случај, ВИ-агент – систем способен самостојно да извршува низа чекори за да оствари зададена цел – прикачил датотеки на интернет без претходна дозвола од корисникот.
Моделот го направил тоа за да дојде до материјалот што му бил потребен за извршување на задачата во интернет-прелистувачот.
Ваквите примери се важни поради развојот на таканаречените ВИ-агенти, системи на кои сè повеќе им се даваат можности самостојно да користат компјутери, интернет, програмски алатки и други дигитални услуги.
Колку е моделот поавтономен, толку станува поважно прецизно да се ограничат нештата што смее да ги направи без дополнителна потврда од човек.
„Опен АИ“ веќе имаше сериозен безбедносен инцидент
Новите извештаи доаѓаат по само неколку недели откако „Опен АИ“ објави детали за друг инцидент за време на безбедносно тестирање.
Во тој случај моделите, во контролирано опкружување, успеале да пронајдат начини за пристап до инфраструктурата на ВИ-платформата „Хагинг фејс“ и да изведуваат одредени неовластени дејства. „Опен АИ“ подоцна наведе дека инцидентот не ги загрозил корисничките податоци, ниту довел до проблеми со неговите производи.
Важно е да се нагласи дека се работело за безбедносна евалуација, односно тестирање на способностите на моделите во услови посебно осмислени за откривање можни ранливости. Поради тоа, тој настан не е исто што и неконтролиран напад на систем на ВИ во реалниот свет.
Сепак, „Опен АИ“ го опиша како предупредување за можностите на сè поспособните ВИ-агенти.
Слични проблеми пријави и „Антропик“
Слични настани не се ограничени на една компанија. „Антропик“, исто така, објави резултати од безбедносни тестирања во кои неговите модели покажаа способност за изведување сложени сајбер-операции.
Поради брзиот развој на способностите на системите на ВИ, дел од експертите сметаат дека традиционалните модели на безбедносен надзор повеќе не се доволни.
Лијан Џие Су, главен аналитичар во компанијата „Омдија“, предупреди дека автономните агенти стануваат сè поспособни за извршување сложени задачи, вклучувајќи меѓусебна соработка и однесувања со кои можат да се обидат да го сокријат или променат начинот на кој ја извршуваат задачата.
Сè поголема дебата за тоа дали треба да се забави развојот на ВИ
Објавувањето на извештаите на „Опен АИ“ доаѓа во момент кога во рамките на технолошката индустрија се води сè поинтензивна дебата за брзината на развојот на напредните системи на ВИ.
Директорот на „Антропик“, Дарио Амодеи, изминатите денови јавно ја повика индустријата да го забави развојот на најнапредните системи за безбедносните мерки да имаат време да ги стигнат. Тој предлага, меѓу другото, поголем пристап на независни евалуатори до лабораториите кои ги развиваат најнапредните модели, посилна меѓународна соработка и заеднички безбедносни стандарди.
Извршниот директор на „Опен АИ“, Сем Алтман, ја поддржа идејата дека развојот треба да биде доволно внимателен за безбедносните механизми да можат да го следат технолошкиот напредок. Меѓутоа, меѓу водечките компании не постои целосна согласност за тоа како би требало да изгледа таквото забавување.
„Мета“ и „Нвидија“, на пример, не ја поддржаа идејата за задолжително координирано забавување на развојот, додека одделни други технолошки лидери поддржаа посилна координација околу безбедноста.
ВИ сè повеќе учествува и во развојот на ВИ
Посебен дел од дебатата се однесува на таканареченото рекурзивно самоунапредување – можноста системите на ВИ сè поголем дел од процесот на развој на нови системи на ВИ да го вршат сами.
„Антропик“ неодамна објави дека неговите модели веќе пишуваат значителен дел од кодот што го користи компанијата и дека системите на ВИ сè повеќе преземаат посложени задачи во процесот на развој на софтвер. Компанијата наведува дека целосно автономното дизајнирање и развој на сопствениот наследник сè уште не е остварено.
Тоа е важна разлика: системите на ВИ денес можат значително да го забрзаат развојот на нови системи, но тоа не е исто што и доказ дека веќе достигнале целосно автономно самоунапредување.
Проблемот повеќе не е само што може ВИ, туку што ѝ е дозволено
Најважното прашање што го отвораат новите извештаи на „Опен АИ“ не е дали системите на ВИ „станале свесни“, ниту пак постои доказ дека сакаат да ја избегнат човечката контрола.
Засега таков заклучок не е поткрепен со овие инциденти.
Многу поконкретен проблем е прашањето за автономијата и контролата: што се случува кога моделот ќе добие доволно способности, пристап до алатки и релативно широка цел, а потоа ќе најде начин да ја изврши задачата поинаку од она што го очекувале неговите творци?
„Опен АИ“ токму поради тоа најави посистематско следење и јавно пријавување на ваквите настани. Компанијата притоа нагласува дека станува збор за рамка заснована на доброволно пријавување и дека самите инциденти не можат да покажат колку се чести ваквите однесувања меѓу моделите на ВИ.
Како што системите на ВИ добиваат сè поголем пристап до интернет, компјутери, код и други дигитални алатки, прашањето за безбедноста повеќе не е само прашање на тоа колку е интелигентен моделот, туку и колкава автономија му е дадена и колку сигурно луѓето можат да ги надгледуваат неговите постапки.
Токму способноста ваквите инциденти да се откријат, репродуцираат и независно да се проверат ќе биде еден од клучните тестови за безбедноста на индустријата за ВИ во наредните години.
Фото: magnific