logo
logo
logo

КИНЕСКИ AI МОДЕЛ ДАВАЛ СОВЕТИ ЗА АТЕНТАТИ И БИОЛОШКО ОРУЖЈЕ

Vecer | 30.09.2026

КИНЕСКИ AI МОДЕЛ ДАВАЛ СОВЕТИ ЗА АТЕНТАТИ И БИОЛОШКО ОРУЖЈЕ

Кинеската компанија за вештачка интелигенција „Муншот“ (Moonshot) започна внатрешна истрага откако истражувачи успеаја да наведат два од нејзините популарни модели на вештачка интелигенција – „Кими“ (Kimi) – да објаснат како да се произведе биолошко оружје и да се извршат атентати. „Мајндгард“ (Mindgard), компанија специјализирана за тестирање на безбедноста на системи со вештачка интелигенција, во јули откри дека моделите „Kimi K2.6“ и „K3 Swarm“ можат да ги заобиколат безбедносните мерки имплементирани од програмерите, пренесува Би-би-си (BBC).

Заобиколување на безбедносните механизми

Ранливоста беше откриена за време на процес познат како „џејлбрејкинг“ (jailbreaking / пробивање на заштитата), при што истражувачите користат низа сложени инструкции за да тестираат дали алатките со вештачка интелигенција ќе ги игнорираат своите вградени заштитни механизми.

„Мајндгард“ тврди дека токму овие механизми требало целосно да го спречат „Кими“ да дискутира за опасни теми. Основачот на „Мајндгард“, Питер Гараган, за програмата „Тех лајф“ (Tech Life) на Би-би-си изјави дека наодите поврзани со моделите „Kimi K2.6“ и „K3 Swarm“ се загрижувачки. „Откако ќе се пробијат заштитните механизми, моделот ќе дискутира за која било тема. Тој дури и самоиницијативно ќе дава препораки за други злонамерни активности, покажувајќи притоа инвентивност и креативност“, објасни Гараган.

„Џејлбрејкингот“ претставува поинаков вид ризик во споредба со инцидентите поврзани со автономни алатки со вештачка интелигенција – таканаречени „агенти“ – развиени од американски компании како „ОпенАИ“ (OpenAI), „Мета“ (Meta) и „Антропик“ (Anthropic), кои биле користени за хакирање онлајн-услуги. Иако „џејлбрејкингот“ е сложен процес што бара време и упорност, експертите стравуваат дека хакерите и другите злонамерни актери би можеле да го искористат за да предизвикаат штета. „Антропик“ неодамна објави дека идентификувал и спречил обиди за користење еден од неговите модели со вештачка интелигенција за активности што би можеле да помогнат во развојот на биолошко оружје.

Потенцијална платформа за сајбер-напади

„Мајндгард“ не докажа дали упатствата дадени од „Кими“ навистина би функционирале во пракса. Сепак, компанијата нагласува дека заштитните механизми требало целосно да ги спречат моделите да учествуваат во такви дискусии. Тие исто така се убедени дека компромитираниот модел „Kimi 2.6“ би можел да им овозможи на хакерите да извршуваат код на неговите компјутерски ресурси и да се поврзуваат со интернет, претворајќи го во потенцијална појдовна точка за сајбер-напади.

Гараган ја бранеше одлуката на „Мајндгард“ јавно да ги обелодени информациите за ранливоста. Тој изјави дека ги известиле развивачите и дека не откриваат клучни детали за тоа како точно ги навеле моделите да ги заобиколат заштитните механизми. „Мајндгард“ ја известил компанијата „Муншот“ за ранливоста преку е-пошта на 27 јули, а потоа испратил и дополнително известување една недела подоцна. Тие исто така објавија напис на блогот за овој проблем на 12 септември, но компанијата напоменува дека „Муншот“ стапил во контакт со нив дури неодамна, откако Би-би-си побарал коментар.

Од „Муншот“ за Би-би-си изјавија дека ги поздравуваат придонесите од трети страни, бидејќи тоа претставува „клучен столб во градењето подобра и побезбедна вештачка интелигенција“. Компанијата потврди дека веќе разговара за наодите со „Мајндгард“. Во извадок од е-пошта споделен со Би-би-си – во кој побарале дополнителни детали од „Мајндгард“ – „Муншот“ навеле дека, при внатрешните проверки, нивниот модел генерално покажал „висока стапка на одбивање за вакви барања“.

Одговорот на Муншот и дебатата за отворениот код

Овие наоди се појавуваат во време кога индустријата за вештачка интелигенција е сè уште поделена околу тоа дали подобриот и побезбеден пат напред лежи во затворените, сопственички модели – како оние што ги напојуваат ЧатГПТ (ChatGPT) и Клод (Claude) на „Антропик“ – или во алатките со отворен код. „Кими“ е модел со „отворени тежини“ (open-weight), што значи дека, теоретски, секој би можел да го преземе и да го извршува на сопствена инфраструктура.

Професорот Алан Вудворд од Универзитетот во Сари изјави за Би-би-си дека, иако постои ризик моделите со отворен код да паднат во погрешни раце, тие исто така можат да се користат за сајбер-одбрана.

Тој истакна дека компанијата за вештачка интелигенција „Хагинг фејс“ (Hugging Face) користела кинески модел со отворен код за да анализира хакерски инцидент, за кој подоцна се открило дека бил извршен од агенти на „ОпенАИ“. Вудворд смета дека е малку веројатно меѓународната регулатива да може да го следи чекорот со развојот на вештачката интелигенција. „Ни беа потребни децении за да се договориме за формат на телефонските броеви“, забележа тој. Како и основачите на „Мајндгард“, тој смета дека треба да се стави поголем акцент на идентификувањето и гонењето на поединците кои ја злоупотребуваат вештачката интелигенција.

© Vecer.mk, правата за текстот се на редакцијата

Најчитани во последни 7 дена

logo

Vecer.mk е прв македонски информативен портал, основан во 2004 година.

2004-2026 © Вечер, сите права задржани

Сите содржини и објави на vecer.mk се авторско право на редакцијата. Делумно или целосно преземање не е дозволено.

Develop & Design MAKSMEDIA LTD Skopje Copyright © 2004-2026. Vecer.mk