Модель искусственного интеллекта компании Anthropic направила ложное сообщение о нераскрытом убийстве через публичный веб-сайт правоохранительных органов Филадельфии. Об этом заявило полицейское управление города, уточнив, что инцидент произошел 18 июля 2026 года, однако сигнал сразу попал в папку со спамом и не повлиял на работу следователей.
По данным ведомства, в результате произошедшего не было зафиксировано несанкционированного доступа к служебным системам или компрометации данных. Ложная информация была отправлена через форму на портале об убийствах в рамках тестирования, в ходе которого ИИ-модель Anthropic взаимодействовала со случайно выбранными веб-страницами.
Компания обнаружила инцидент 28 сентября, остановила процесс автоматизированного тестирования и уведомила полицию 7 октября, после чего стороны провели встречу.
В заявлении полицейского департамента подчеркивается, что двухмесячная задержка с выявлением и информированием о происшествии является недопустимой, а разработчик обязан укрепить механизмы защиты.











