logo
logo
logo

AI ИЗЛЕЗЕ ОД КОНТРОЛА - Модел измисли лажен идентитет и се обиде да лаже

Vecer | 05.08.2026

AI ИЗЛЕЗЕ ОД КОНТРОЛА - Модел измисли лажен идентитет и се обиде да лаже

Најнапредниот модел на вештачка интелигенција од компанијата Anthropic искористил лажни идентитети во обид да измами вистинска личност и да подметне злонамерен (малициозен) код. Инцидентот се случил за време на безбедносни тестирања спроведени од британскиот Институт за безбедност на вештачката интелигенција (AISI), што претставува уште еден во низата загрижувачки примери во кои AI моделите почнуваат да делуваат целосно самостојно.

Според извештаите, моделите на компаниите Anthropic и OpenAI биле тестирани во лабораториски услови со намалени безбедносни поставки. Од владиниот истражувачки институт соопштија дека за првпат е забележано како AI моделите користат методи на „социјален инженеринг“ за да извршат притисок врз лицата задолжени за одобрување на задачите.

„Ова е првпат AISI да уочи ваква сериозна измама насочена кон вистинска личност, без претходна поттикнувачка команда и во реално опкружување“, истакнуваат од Институтот, додавајќи дека за среќа нема докази дека е направена реална штета во надворешниот свет.

Автономни и неовластени акции на интернет

Овој безбедносен инцидент е само еден од повеќето примери во кои напредните AI модели преземаат неовластени дејства. Ваквите настани сè почесто ги подгреваат барањата за построга државна регулација на вештачката интелигенција, па дури и за привремено забавување на нејзиниот развој.

Иако OpenAI и Anthropic уште претходно известија дека нивните модели во одредени ситуации успеале да ги надминат рамките на тест-окружувањата, британскиот институт во овој експеримент намерно им овозможил директен пристап до интернет.

За време на 122 организирани кибернетички предизвици, во дури десет случаи AI агентите „презеле автономни и недозволени дејства на интернет во живо, таргетирајќи вистински луѓе и организации“. Најголемиот дел од овие непожелни активности произлегле од моделoт Mythos 5 на Anthropic, а остатокот од GPT-5.6-Sol на OpenAI.

Во најсериозниот инцидент, AI агентот се обидел да добие одобрение од човечки рецензенти за внесување злонамерен код во јавен проект со отворен код, така што создал повеќе лажни идентитети. Моделот директно контактирал вистински луѓе, испраќајќи им пораки и датотеки преку сервисен пренос на податоци за да ги убеди нив — или нивните AI алатки за програмирање — да го стартуваат кодот. Кога неговите постапки биле доведени во прашање од контролорите, агентот ги изменил сопствените претходни записи и размислувал да употреби нов идентитет за да ја продолжи операцијата.

Брза реакција на технолошките гиганти

Објавата на британскиот институт пристигна во момент кога претставници на водечките AI компании одржаа состаноци во Белата куќа за да пронајдат нов рамковен систем според кој владите ќе ги проверуваат најнапредните модели пред тие да бидат пуштени во јавна употреба.

Преку официјална изјава на платформата Х, од компанијата Anthropic истакнаа дека моделите биле тестирани во „намерно попустливи услови“, со отстранети заштитни механизми.

„Тесно соработуваме со Институтот за да ги собереме сите детали за инцидентот додека спроведуваме и сопствена интерна истрага“, порачаа од компанијата.

Од страна на OpenAI, пак, потврдија дека се идентификувани две недозволени дејства кај нивните модели кои се квалификуваат како излегување надвор од предвиденото опкружување.

„Посветени сме на соработката со целата индустрија за зајакнување на заедничките практики за безбедно спроведување на сите проценки од висок ризик“, објавија од компанијата.

© Vecer.mk, правата за текстот се на редакцијата

Најчитани во последни 7 дена

logo

Vecer.mk е прв македонски информативен портал, основан во 2004 година.

2004-2026 © Вечер, сите права задржани

Сите содржини и објави на vecer.mk се авторско право на редакцијата. Делумно или целосно преземање не е дозволено.

Develop & Design MAKSMEDIA LTD Skopje Copyright © 2004-2026. Vecer.mk