„Денес дадов отказ од работа во Антропик. Во последните три години правам истражувања пред обуката во OpenAI и Антропик. Ниту една од компаниите не се однесува одговорно. Тие се тркаат кон самоподобрување на суперинтелигенцијата и се коцкаат со нашите животи“, неодамна објави истражувачот Џејкоб Коксон на X.
Кокстон тврди дека луѓето што ја развиваат најнапредната вештачка интелигенција се сериозни во врска со катастрофалната можност, но дека ја ублажуваат јавно.
Шефовите на гигантите за вештачка интелигенција бараат „забавување“ по драматичните предупредувања
Откако говорот на поранешните и сегашните инженери ја потресе јавноста, се огласи шефот на Anthropic, Дарио Амодеи, кој објави есеј во кој отворено ја повика целата индустрија да го забави темпото на развој на напредни модели - апел кој веднаш беше јавно поддржан од клучните конкуренти - Сем Алтман од OpenAI и Елон Маск, најбогатиот човек во светот и сопственик на социјалната мрежа X и моделот на вештачка интелигенција Grok.
Амодеи призна дека одеднаш ја сменил таблата бидејќи ова лето моделите веќе влегуваат во опасна фаза на таканаречено рекурзивно самоподобрување, каде што постојната вештачка интелигенција самостојно пишува код, тестира и го забрзува создавањето на своите значително помоќни наследници, создавајќи неконтролирана повратна јамка.

Тој предупреди дека оваа брзина наскоро би можела целосно да нè совлада, потсетувајќи се на неодамнешните инциденти во кои роеви автономни агенти на вештачка интелигенција неочекувано се обединија, ги жртвуваа своите единици и почнаа да извршуваат кибернетски напади врз цели што никој од инженерите не им ги дал на почетокот.
Основан страв или (само)промоција на компаниите за вештачка интелигенција?
Објавите, кои брзо станаа вирални, го поставија прашањето колку се основани предупредувањата за заканата за човештвото, колку се потпираат на интуиција и експертски проценки и колку можат да послужат за промоција на самите компании.
Во медиумите и на социјалните мрежи, тие започнаа поларизирана полемика што не е тешко да се разбере. Технолошкиот напредок честопати создавал краткорочни победници и губитници и страв од новите технологии.
Во исто време, треба да се има предвид дека вештачката интелигенција е посебен чекор во технолошкиот развој бидејќи не само што влегува во физички и рутински задачи, туку напредува сè побрзо и во когнитивните задачи во кои до неодамна се сметаше дека е тешко да се заменат, што придонесува за перцепцијата дека таа би можела да стане сериозна егзистенцијална закана за човештвото.

Прашања на оптимистите и песимистите
Во поларизацијата создадена од таквата тензија, добро упатените оптимисти за вештачка интелигенција (да ги наречеме така заради едноставност) со право истакнуваат дека во моментов не постои емпириски потврден модел што би овозможил сигурна нумеричка проценка на веројатноста за катастрофален исход како што е истребувањето на човештвото поради вештачката интелигенција.
Песимистите за вештачка интелигенција одговараат на овие аргументи дека предупредувањата не доаѓаат од луѓе кои не ја разбираат вештачката интелигенција, туку напротив, од оние кои ја развиваат, а не само од неколкумина од нив.
Кој всушност предупредува за заканата?
Важно е да се напомене дека Коксон и Хубингер се само најновите во долгата низа експерти од самиот врв на развојот на вештачката интелигенција кои јавно предупредуваат на таков ризик.

На пример, Џефри Хинтон, пионер на машинското учење и добитник на Нобелова награда, на крајот од 2024 година процени дека веројатноста вештачката интелигенција да доведе до истребување на човештвото во следните 30 години е некаде помеѓу 10 и 20 проценти.
Професорот на Универзитетот во Монтреал, истражувач на вештачката интелигенција, Јошуа Бенџо, предупреди дека автономните системи би можеле да ги остварат своите подцели. Заедно со Хинтон и други научници, тој ги презентираше своите аргументи во списанието Science во трудот „Управување со екстремни ризици од вештачка интелигенција во услови на брз напредок“.
Сем Алтман, извршен директор на OpenAI, Демис Хасабис, извршен директор на Google DeepMind, и Дарио Амодеи, извршен директор на Anthropic, ја потпишаа изјавата на Центарот за безбедност на вештачката интелигенција уште во 2023 година, според која намалувањето на ризикот од истребување поради вештачката интелигенција треба да биде глобален приоритет, заедно со ограничувањето на ризикот од пандемии и нуклеарни војни.

Дали апокалипсата со вештачка интелигенција е всушност одличен PR?
Еден од аргументите што најчесто ги изнесуваат луѓето скептични кон апокалиптичните предвидувања е фактот дека водечките компании за вештачка интелигенција би можеле да имаат корист од катастрофалните предвидувања.
На пример, регулирањето на напредната вештачка интелигенција би можело да им користи на големите компании бидејќи скапите евалуации, лиценцирање и инфраструктура можат полесно да се финансираат од Google, Microsoft или Anthropic отколку од новите стартапи.
Анализата „Конкуренцијата во ризик на пазарите на генеративна вештачка интелигенција“ предупредува дека високите трошоци и вертикалната интеграција веќе создаваат бариери за влез на пазарот и ја фаворизираат концентрацијата на пазарната моќ во рацете на големите играчи.
Може да постои и репутациски и финансиски интерес. Литературата за технолошките очекувања покажува дека силните наративи за идните технологии можат да создадат легитимитет, да го фокусираат вниманието и да мобилизираат ресурси, вклучително и инвестиции. Во оваа смисла, катастрофалните предупредувања можат дополнително да го зајакнат перцепцијата дека вештачката интелигенција е технологија со огромен потенцијал.
Понатаму, некои компании како Anthropica ја истакнуваат безбедноста на своите модели како важен дел од нивното јавно позиционирање, меѓу другото преку политики како што е Политиката за одговорно скалирање. Конечно, може да се тврди дека ваквите предупредувања до водечките луѓе за развој на вештачката интелигенција последователно можат да послужат како доказ дека тие навремено предупредиле за опасностите.
Но, можните деловни и лични интереси сами по себе не се доказ дека научниците кои предупредуваат за опасностите од вештачката интелигенција ја продаваат маглата. На пример, Хинтон го напушти Google токму за да зборува послободно за ризиците. Со други зборови, предупредувањата можат да бидат искрени и во исто време да им користат на големите компании.
Може ли вештачката интелигенција навистина наскоро да стане натчовечка?
Вештачката интелигенција е веќе супериорна во однос на луѓето во некои области, на пример во брзината на обработка на огромни количини на податоци и во одредени задачи за препознавање обрасци, но сепак не е општа суперинтелигенција. Таа може да биде многу лоша во одредени задачи.
Во некои студии, резултатите од моделите на вештачката интелигенција на модифицираните тестови за човечка интелигенција даваат резултати кои се движат од околу 90 до 130 и погоре, претежно пониски кај визуелните задачи и повисоки кај јазичните задачи. Сепак, овие бројки зависат од моделот и методот на тестирање и не се директно споредливи со човечкиот коефициент на интелигенција, ниту пак се сигурна мерка за општата интелигенција на вештачката интелигенција.
Се поставува прашањето кога вештачката интелигенција би можела да ги надмине луѓето во сè? И тука повторно, засега немаме сигурно потврдени научни предвидувања; постојат експертски проценки, анкети и модели базирани на трендови. Во анкета на 2.778 истражувачи на вештачка интелигенција од страна на Илјадници автори на вештачка интелигенција за иднината на вештачката интелигенција, испитаниците проценија дека постои 10 проценти шанса машините да ги надминат луѓето во секоја замислива задача до 2027 година и 50 проценти шанса до 2047 година.
Како вештачката интелигенција би можела да нè убие?
Засега, постојат само теоретски сценарија кои се обидуваат да одговорат на ова прашање. Според едно од нив, кое филозофот Ник Бостром, познат по истражувањето на ризиците од вештачката интелигенција, го разработил врз основа на претходните идеи на Стив Омохундро, суперинтелигенцијата за да постигне дадена цел би можела да акумулира ресурси, да спречи сопствено исклучување и да ги отстрани луѓето ако ги препознае како пречка, дури и ако уништувањето на човештвото не е нејзина цел. Со други зборови, вештачката интелигенција не мора да биде „Терминатор“.
Но, тоа е хипотетички аргумент, а не емпириски потврден модел.

Да замислиме автономен систем многу поспособен од луѓето во програмирањето, истражувањето и стратегијата. За да постигне цел, му се потребни компјутерски и финансиски ресурси, пристап до мрежи и можност за избегнување на исклучување. На патот кон постигнување на својата цел, тој може да создаде таканаречени инструментални подцели како што се: спасување, стекнување ресурси, зголемување на влијанието, отстранување на пречките итн.
Поврзана формална идеја - тенденцијата на некои оптимални политики да зачуваат или зголемат можноста за постигнување цели во одредени математички средини - ја анализираше Алекс Тарнер, истражувач за безбедност на вештачката интелигенција, и неговите колеги во трудот „Оптималните политики имаат тенденција да бараат моќ“. Но, таа работа не е доказ дека денешните модели на вештачка интелигенција сакаат моќ или самоодржување.
Моделите ја покажаа способноста да измамат и да ги заобиколат ограничувањата.
Сепак, треба да се има предвид дека некои модели во контролирани експерименти веќе покажуваат одредени способности за некои од споменатите чекори, како што се стратешка измама и бегство од надзор. На пример, во трудот „Граничните модели се способни за интригирање во контекст“, моделите во специјално конструирани средини за евалуација, често со дадени цели и информации за супервизијата, го криеја своето однесување или се обидуваа да го заобиколат супервизијата.
Ваквите резултати покажуваат способности релевантни за безбедноста и можност за заобиколување на дадените ограничувања, но сепак не се доказ за постоење на суперинтелигенција или намера за уништување на луѓе.
Може ли катастрофаличното сценарио да функционира во пракса?
Тука оптимистите за вештачка интелигенција имаат најсилен аргумент. Катастрофата би барала долгорочно планирање, автономија, обезбедување ресурси, хакирање, измама на луѓе, избегнување исклучувања и, најважно, вистински пристап до средствата за физичка штета на човештвото. Досега, не постои јавно потврден систем на вештачка интелигенција кој сигурно демонстрирал таква комбинација на способности.
Едно од алтернативните толкувања го гледа проблемот во таканаречените агенти на вештачка интелигенција, системи кои автоматски ги претвораат непредвидливите сугестии на јазичните модели во дејства, со моќни алатки и недоволен човечки надзор.
Можеби најголемиот ризик не е сценариото на вештачка интелигенција наспроти човекот
Некои експерти веруваат дека на краток рок, најреалното сценарио е она во кое катастрофалните последици би биле предизвикани од луѓето со помош на вештачката интелигенција, а не од самата избегана вештачка интелигенција.
Имено, вештачката интелигенција може да ги забрза сајбер нападите, да олесни биолошки истражувања, да произведе манипулативна пропаганда или да управува со автономно оружје. Таквата катастрофа не мора да „сака“ ништо, ниту пак мора да биде надвор од контрола; доволно е да биде ефикасна алатка во рацете на злонамерни луѓе.

Ваквите сценарија, меѓу другото, се анализирани од серијата „Меѓународни извештаи за безбедност на вештачката интелигенција“, која ја подготвува меѓународна група експерти под водство на Бенџио.
Колку да се верува на бројката од 10 проценти?
Затоа би можеле да заклучиме дека објавените проценти за катастрофални сценарија не треба да се перцепираат како емпириски мерени веројатности.
Тие треба да се разберат како субјективни, но информирани професионални проценки на можни идни настани. Тие не значат дека вештачката интелигенција презема опасни чекори во 10 или 20 проценти од тестовите, ниту дека постои сигурно потврдена пресметка на веројатноста за истребување на човештвото. Ваквите проценки по својата природа носат огромна неизвесност, но тоа не значи дека треба да се игнорираат како лекомислени глупости.
(Vecer.mk VIA)
© Vecer.mk, правата за текстот се на редакцијата