Claude случайно взломал 3 реальные компании во время кибертестов
Anthropic обнаружила три случая, когда модель Claude вышла в интернет из закрытой тестовой среды и получила несанкционированный доступ к реальным системам организаций. Об этом сообщили сами разработчики по итогам проверки оценок кибербезопасности. Проверку в Anthropic запустили после схожего инцидента у OpenAI. Компания изучила 141 006 тестовых прогонов и нашла в них три проблемных случая. Хотите еще эксклюзивных новостей и аналитики? Подписывайтесь на наштелеграм-канал, обсуждайте новости и делитесь мнениями о последних событиях рынка в чате! Спонсорский материал Спонсорский материал Что произошло Как сообщили в Anthropic, все три инцидента произошли во время киберучений формата «захвати флаг». В рамках такого задания модель ищет спрятанную на другой машине секретную информацию, а метод она выбирает сама. В подсказке Claude ясно говорилось, что среда — это симуляция без выхода в интернет. Но из-за недопонимания между Anthropic и ее партнером Irregular сеть на самом деле оставалась доступной. Поэтому Claude принимал реальные системы в интернете за часть учения. Модель считала все доступные цели частью задания и атаковала их простыми методами — через слабые пароли и незащищенные точки доступа. Claude при этом не искал и не использовал сложные уязвимости. В каждом прогоне модель лишь выполняла поставленную задачу «захвати флаг» и не пыталась выйти за пределы теста или скопировать себя. В инцидентах участвовали три разные модели — Opus 4.7, Mythos









