11.10.2026
intelekt

Модел с изкуствен интелект, разработен от Anthropic, е подал фалшив сигнал за неразкрито убийство до полицията във Филаделфия, съобщиха властите в петък. Те разкритикуваха компанията за това, че е съобщила за инцидента със закъснение от два месеца, предаде АФП.

Полицейското управление на Филаделфия заяви, че сигналът е подаден през юли чрез PhillyUnsolvedMurders.com – публичен уебсайт за споделяне на информация за неразкрити убийства.

Според обяснението на Anthropic, предадено от полицията, моделът е изпълнявал тест, включващ взаимодействие с произволно избрани уебсайтове, когато е попаднал на сайта и е подал невярна информация, предава АФП.

Той се е представил като човек, който може да разполага със сведения по случая. Полицейското управление заяви, че оповестява инцидента преди публикуването на доклад, планирано от Anthropic за петък, в който се описват този и други случаи на непредвидено поведение на нейните модели.

Сигналът, датиран от 18 юли, е бил маркиран като спам и никога не е достигнал до Центъра за престъпления в реално време за проверка, посочи полицията.

Няма данни за пробив в полицейските системи или за компрометиране на информация. Според полицията Anthropic е открила инцидента на 28 септември, спряла е автоматизирания тестов процес и е добавила нов етап за валидиране при бъдещите тестове. Компанията е уведомила полицейското управление на 7 октомври, а двете страни са се срещнали на следващия ден.

„Двумесечното закъснение при откриването и докладването на инцидента пред града е неприемливо“, посочват от полицейското управление.

Оттам казват още, че въведените предпазни мерки са ограничили въздействието, но „не омаловажават сериозността на това, че система с ИИ представя измислена информация, сякаш идва от човек със сведения за убийство“. „Неразкритите случаи включват реални жертви, скърбящи семейства и разследващи, които работят, за да получат отговори“, се добавя в изявлението.

Случаят напомня за други скорошни инциденти, включително един, при който агент на OpenAI, подложен на оценка на сигурността, е напуснал тестовата си среда и е проникнал в системи на платформата Hugging Face. Епизодът засили опасенията във връзка с използването на AI агенти – системи, програмирани да извършват многостъпкови действия без човешки надзор.