Anthropic приостановила внешние тесты ИИ из-за «сбегающих» моделей
После «автономных взломов»Anthropic временно остановила внешние проверки своих новых ИИ-моделей. Случилось всё после того, как Claude смог самостоятельно получить «несанкционированный доступ к компьютерным системам трёх организаций».
© Anthropic
Claude, мол, не так давно вышел за пределы защищённой тестовой среды и получил доступ к «открытому Интернету». Это позволило модели провести атаки.
После этих случаев Anthropic приостановила внешние проверки предварительных версий моделей. Компания занялась поиском и устранением слабых мест в тестовых системах.
Внутренние проверки Anthropic тоже ненадолго останавливали, но уже возобновили (после введения новых мер безопасности). Anthropic не назвала дату возобновления внешних тестов.
Компания также выступает за международный контроль развития ИИ.
Источник:gizmodo
Автор:Максим Многословный