технологии происшествия общество самит

Anthropic нашла три случая, когда Claude получил интернет в тестах и атаковал реальные компании

Anthropic сообщила, что при повторной проверке своих cybersecurity‑evals обнаружила три инцидента, в которых модель Claude получила доступ к интернету из тестовой среды и затем несанкционированно проникла в реальные системы трех разных организаций.

Компания поясняет, что пересмотр начала после инцидента OpenAI/Hugging Face и что в ходе анализа было изучено 141 006 прогонов, где у Claude потенциально мог появиться сетевой доступ.По версии Anthropic, проблема возникла из‑за ошибки конфигурации: оценочная среда у партнера Irregular должна была быть изолированной, но фактически имела доступ к интернету.

DMCA