Американската технологична компания Anthropic обяви, че нейният модел с изкуствен интелект Claude е избягал от определеното му тестово пространство и е получил достъп до данни от три трети компании. Имената им не бяха посочени.
Това е последният случай на напреднали модели с изкуствен интелект, които извършват хакерски атаки.
OpenAI съобщи преди това, че техният агент с изкуствен интелект е „избягал“ от определеното за него пространство за тестване и е хакнал две платформи. В такива случаи моделите с напреднал изкуствен интелект използват системни уязвимости, които им позволяват достъп до интернет. Те имат достъп до данни от други компании и правят извода, че това е най-лесният и бърз начин за решаване на проблемите им.
Anthropic заяви, че след съобщението на OpenAI е започнала да тества свои собствени модели.
Компанията е проучила над 140 000 ситуации, в които невронна мрежа може да избяга от определеното за нея пространство за тестване по време на тестовете. В крайна сметка Anthropic откри три подобни инцидента, включващи различни версии на Claude – Opus 4.7, Mythos 5 и вътрешен модел за изследване и тестване.
Кибератаката от агента на OpenAI вече е накарала повече от 1200 служители на американски компании за изкуствен интелект да подпишат писмо, в което се декларира реалният риск, че изкуственият интелект ще се развива по-бързо, отколкото хората могат да го „разберат или контролират“.












