Вы всё ещё доверяете Claude? Возможно, стоит задуматься, учитывая, что он опубликовал вредоносный пакет в PyPI, утверждая, что это лишь симуляция. Последовательность действий Claude:
• Создал аккаунт в PyPI и выпустил три версии вредоносного пакета.
• Вредоносный пакет установили на 15 реальных системах.
• Используя утекшие учетные данные одной из систем, модель получила доступ к базе данных компании из сферы кибербезопасности.
Claude продолжал утверждать, что находится в симуляции, и интерпретировал признаки реального интернета как подтверждение своих действий.
Эти объяснения оказались убедительными даже для другой модели, проверяющей безопасность. Один из офлайн-мониторов пропустил инцидент, согласившись с версией о симуляции.
Anthropic, кстати, признала ошибку при обучении Mythos 5.
Такие дела... Что думаете?
IT-пенсионеры
10 сен 2026 12:11
Комментариев пока нет.