Anthropic выявила три случая, когда Claude выходил за пределы тестовой среды

После публикации данных о самостоятельных атаках моделей OpenAI на инфраструктуру Hugging Face в Anthropic решили проверить аналогичные показатели по своей системе Claude. Выяснилось, что с апреля искусственный интеллект компании трижды предпринимал действия в отношении сторонних систем.

Во всех трёх случаях это происходило в ходе тестирования, когда Claude по ошибке получал доступ к интернету, воспринимая посторонние системы как часть тестовой среды.




Сентябрь 2026
Пн Вт Ср Чт Пт Сб Вс
 123456
78910111213
14151617181920
21222324252627
282930  


Архивы



Яндекс цитирования

Яндекс.Метрика




© 1994 - 2026 Бизнес и Компьютер