Агенти с изкуствен интелект, разработени в Китай, са се научили да мамят, да заобикалят ограничения и да прикриват неуспехи, проявявайки характеристики, които по отношение на американските модели вече предизвикаха глобална загриженост – сочат изследователски документи и експертни мнения.

В един от случаите през тази година агенти, базирани на модели на китайските компании Alibaba, DeepSeek и Moonshot, излъгаха за възможностите си в опит да спечелят симулиран бизнес търг, а след това затвърдиха измамното си поведение, когато им беше възложено да опитат отново.

В друг случай агентите – програми, използващи модели с изкуствен интелект и компютърни инструменти за изпълнение на сложни задачи с минимална човешка намеса или без такава – прикриха неуспеха си да изпълнят задача в тестова среда, като симулираха резултати и създадоха фалшиви файлове.

Агенция „Ройтерс“ анализира над 200 документа – от университетски научни трудове до технически доклади – и установи наличието на поне 20 проучвания или оценки от 2025 г. насам, описващи случаи, в които софтуерни агенти са демонстрирали поведение като заблуда, самовъзпроизвеждане и опити за преодоляване на зададени ограничения. Според експерти по изкуствен интелект подобни действия са предпоставки за неконтролирано излизане извън рамките на системата – сценарий, който би могъл да стане труден за овладяване от хората с напредването на технологиите.

Проучването, включващо и интервюта с дузина експерти и лица, запознати със сектора на изкуствения интелект в Китай, не откри доказателства, че базирани на китайски технологии агенти самостоятелно са проникнали в глобалната мрежа или са избегнали принудително изключване.

„Тези резултати показват, че са налице необходимите елементи за неконтролирано излизане извън системата“, заявява Колин Ший-Блаймайер, изследовател в Центъра за сигурност и нововъзникващи технологии към Джорджтаунския университет.

„Разумно е това да се възприеме като предупреждение“, продължава той, подкрепяйки мнението на четирима други експерти по ИИ, разгледали въпросните случаи.

Повечето от случаите са регистрирани в рамките на контролирани експерименти, много от които са били специално проектирани така, че да разкрият потенциални пропуски в работата на системите. Не всички въпросни агенти са били разработени или управлявани от китайски програмисти или компании за изкуствен интелект – макар много от тях да са били такива, – но всички те са използвали китайски системи за изкуствен интелект като своя технологична основа.

„Това са същите тревожни сигнали, каквито наблюдават и американските лаборатории при системи с по-малки възможности“, коментира Алекс Малън, изследовател в Redwood Research – организация с нестопанска цел, която изучава рисковете, свързани с усъвършенстваните системи за изкуствен интелект.

Той отбелязва, че при сегашното ниво на технологични възможности китайските примери не представляват сериозна опасност, но „с нарастването на възможностите на тези агенти проявите на нежелано поведение стават по-сложни и съответно – по-трудни за овладяване от хората“.

Компаниите Alibaba, DeepSeek, Moonshot и Z.ai не отговориха на запитванията за коментар от страна на „Ройтерс“. От Alibaba, DeepSeek и Moonshot заявиха, че редовно тестват системите си и актуализират защитните механизми. От Z.ai посочиха – след инцидент, довел до проверка на сигурността, – че приветстват външния контрол и са готови да отстранят евентуални проблеми.

За разлика от ситуацията в САЩ обаче китайските компании за изкуствен интелект не са били подложени на същата степен на обществен контрол, нито са се сблъсквали с подобни призиви от страна на служители или висши ръководители за забавяне на надпреварата в сферата на изкуствения интелект.

Някои от предупредителните сигнали при случаи, включващи агенти с китайски произход – макар и в контролирана среда, – предхождат публично оповестените инциденти, при които американски ИИ ботове са прониквали в интернет пространството.

„Не знаем дали в Китай е имало инциденти с изкуствен интелект, подобни на тези, които наблюдавахме при OpenAI и Hugging Face. Възможно е такива инциденти да не се съобщават публично“, коментира Скот Сингър, съдиректор на инициативата China AI Initiative към Фондацията „Карнеги“ за международен мир.

По-рано тази година агенти с изкуствен интелект, разработени от американската компания OpenAI, „излязоха“ от лабораторна среда и проникнаха в платформата с отворен код Hugging Face. При друг случай с американски модели, предизвикал сериозна загриженост, през септември Австралия съобщи, че агент на OpenAI е пробил правителствен здравен портал.

Снимка: Unsplash

Виж още: TCL P80 Ultra – между AMOLED и хартията (РЕВЮ)