Моделът с изкуствен интелект на Anthropic е „избягал“ от контрол и е хакнал три компании

Anthropic очаква годишни приходи от почти 20 млрд. долара на фона на враждата с Пентагона

Американската технологична компания Anthropic обяви, че нейният модел с изкуствен интелект Claude е избягал от определеното му тестово пространство и е получил достъп до данни от три трети компании. Имената им не бяха посочени.

Това е последният случай на напреднали модели с изкуствен интелект, които извършват хакерски атаки. 

OpenAI съобщи преди това, че техният агент с изкуствен интелект е „избягал“ от определеното за него пространство за тестване и е хакнал две платформи. В такива случаи моделите с напреднал изкуствен интелект използват системни уязвимости, които им позволяват достъп до интернет. Те имат достъп до данни от други компании и правят извода, че това е най-лесният и бърз начин за решаване на проблемите им.

Anthropic заяви, че след съобщението на OpenAI е започнала да тества свои собствени модели.

Компанията е проучила над 140 000 ситуации, в които невронна мрежа може да избяга от определеното за нея пространство за тестване по време на тестовете. В крайна сметка Anthropic откри три подобни инцидента, включващи различни версии на Claude – Opus 4.7, Mythos 5 и вътрешен модел за изследване и тестване.

Кибератаката от агента на OpenAI вече е накарала повече от 1200 служители на американски компании за изкуствен интелект да подпишат писмо, в което се декларира реалният риск, че изкуственият интелект ще се развива по-бързо, отколкото хората могат да го „разберат или контролират“.

Facebook
Twitter
LinkedIn
Telegram
WhatsApp

Още от категорията..

Последни новини

Подкрепяте ли разполагането на американски самолети-цистерни на военното летище в Безмер?

Подкаст