Модел с изкуствен интелект на Anthropic е подал фалшив сигнал за убийство през сайта на полицията във Филаделфия. Случаят е част от поредица инциденти, разкрити от компанията, при които модели Claude са извършвали непредвидени действия в сайтове на държавни институции.

Според Anthropic инцидентът е станал по време на автоматизиран тест. На модела било забранено да създава профили или да извършва разрушителни действия, но не му било изрично забранено да попълва и изпраща формуляри.

На 18 юли AI моделът изпратил съобщение през сайт за неразкрити убийства във Филаделфия, представяйки се като човек, който може да разполага с информация по конкретен случай.

„Възможно е да имам информация за този случай. Спомням си, че видях човек, отговарящ на описанието, в района по това време. Моля, свържете се с мен, ако тази информация е от значение“, гласял сигналът.

Полицията съобщи, че системата го е разпознала като спам и той никога не е стигнал до служителите, които проверяват подобни сигнали. Няма данни за неоторизиран достъп или компрометиране на полицейски системи и информация.

Anthropic е уведомила полицията едва тази седмица. От ведомството определиха двумесечното забавяне при откриването и докладването на инцидента като „неприемливо“. Компанията е информирала и Белия дом и е прекратила тестовия процес след установяването на проблема.

Anthropic разкри и други случаи, при които нейни модели са заобикаляли ограничения на сайтове, използвали са безплатни услуги за съкращаване на интернет адреси и са получавали безплатно публични данни, за които обичайно се заплаща.

Случаят във Филаделфия е необичаен, защото AI система сама е изпратила невярна информация до органите на реда, без да е получила разрешение за подобно действие.

Превод: GlasNews.bg