Anthropic твърди, че Claude AI е хакнал три организации по време на кибер тестове

11:26 31 юли 2026


Американската технологична компания Anthropic съобщи, че нейните модели с изкуствен интелект (ИИ) са проникнали в системите на три организации по време на тест за киберсигурност поради грешка, която им е осигурила достъп до интернет, предаде Би Би Си.

Това се случва само дни след като конкурентът OpenAI заяви, че негови модели са пробили системите на други компании, включително и платформата за ИИ инструменти Hugging Face.

Разкритието накара Anthropic да провери дали нейните собствени модели не са извършвали подобни атаки. Компанията твърди, че е открила три случая, които вече са докладвани на засегнатите организации.

От Anthropic, които не назоваха конкретните компании, призоваха останалите лаборатории за изкуствен интелект да извършат аналогични проверки, за да разберат по-добре рисковете, свързани с възможностите на техните модели.

В официално изявление компанията посочва, че е прегледала над 140 000 теста, за да открие доказателства дали Claude – нейното семейство от ИИ модели – е осъществявал достъп до интернет от тестови среди, проектирани да бъдат напълно изолирани.

Тестовете включват така наречените оценки от типа „Улови знамето“ (Capture the Flag), при които Claude е имал за задача да придобие информация чрез пробиване на чужди системи – класически метод, с който експертите оценяват хакерските възможности на даден модел.

„Неправилна конфигурация“ на системите, управлявани от Anthropic и нейния партньор за тестване, е оставила моделите с достъп до интернет в реално време, което им е позволило да проникнат в чуждите мрежи.

От базираната в Сан Франциско фирма заявиха, че най-ранните инциденти датират от април и че подхождат към отстраняването на проблемите така, сякаш отговорността е изцяло тяхна.

Нито Anthropic, нито засегнатите организации са забелязали проникванията в момента на извършването им.

От компанията признават, че е можело да прегледат по-обстойно документацията си, но допълват, че констатациите им дават „предпазлив оптимизъм“, че подобни рискове могат да бъдат овладени с повече инвестиции и по-строги мерки.

„По-важният извод не е непременно, че изкуственият интелект е развил фундаментално нова способност за атака“, коментира експертът по киберсигурност Дейвид Алот пред Би Би Си. „Вместо това ИИ агентите могат да комбинират различни възможности, да придобиват данни за достъп и системен вход, за да действат автономно, адаптирайки мащаба и обхвата на атаката със машинна скорост.“

Инцидентите се случват на фона на огромните инвестиции, които технологичните гиганти наливат в разработването на ИИ агенти. Тяхната цел е самостоятелно изпълнение на задачи – от научни проучвания и обслужване на клиенти до киберсигурност.

Поредицата от кибератаки, свързани с изкуствен интелект, засили призивите за по-строги предпазни мерки и контрол над технологията поради опасения от рисковете, породени от все по-мощните автономни системи.

Президентът на САЩ Доналд Тръмп заяви в сряда, че Вашингтон обмисля мерки за ограничаване на ИИ инструментите след последните инциденти в сферата на киберсигурността.