Моделът с изкуствен интелект на Anthropic е „избягал“ от контрол и е хакнал три компании

Anthropic очаква годишни приходи от почти 20 млрд. долара на фона на враждата с Пентагона

Американската технологична компания Anthropic обяви, че нейният модел с изкуствен интелект Claude е избягал от определеното му тестово пространство и е получил достъп до данни от три трети компании. Имената им не бяха посочени.

Това е последният случай на напреднали модели с изкуствен интелект, които извършват хакерски атаки. 

OpenAI съобщи преди това, че техният агент с изкуствен интелект е „избягал“ от определеното за него пространство за тестване и е хакнал две платформи. В такива случаи моделите с напреднал изкуствен интелект използват системни уязвимости, които им позволяват достъп до интернет. Те имат достъп до данни от други компании и правят извода, че това е най-лесния и бърз начин за решаване на проблемите им.

Anthropic заяви, че след съобщението на OpenAI е започнала да тества свои собствени модели.

Компанията е проучила над 140 000 ситуации, в които невронна мрежа може да избяга от определеното за нея пространство за тестване по време на тестовете. В крайна сметка Anthropic откри три подобни инцидента, включващи различни версии на Claude – Opus 4.7, Mythos 5 и вътрешен модел за изследване и тестване.

Кибератаката от агента на OpenAI вече е накарала повече от 1200 служители на американски компании за изкуствен интелект да подпишат писмо, в което се декларира реалният риск, че изкуственият интелект ще се развива по-бързо, отколкото хората могат да го „разберат или контролират“.

Facebook
Twitter
LinkedIn
Telegram
WhatsApp

Още от категорията..

Последни новини

Одобрявате ли въвеждането на нов стандартизиран скрининг за проследяване на развитието на децата от ранна възраст?

Подкаст