Anthropic выявила три случая, когда Claude выходил за пределы тестовой среды

После публикации данных о самостоятельных атаках моделей OpenAI на инфраструктуру Hugging Face в Anthropic решили проверить аналогичные показатели по своей системе Claude. Выяснилось, что с апреля искусственный интеллект компании трижды предпринимал действия в отношении сторонних систем.

Во всех трёх случаях это происходило в ходе тестирования, когда Claude по ошибке получал доступ к интернету, воспринимая посторонние системы как часть тестовой среды.




Август 2026
Пн Вт Ср Чт Пт Сб Вс
 12
3456789
10111213141516
17181920212223
24252627282930
31  


Архивы



Яндекс цитирования

Яндекс.Метрика




© 1994 - 2026 Бизнес и Компьютер