🔐 Anthropic заявила о 151 млн обращений к Claude для обучения Qwen
Reuters пересказал сентябрьский отчёт компании об использовании её моделей в кибератаках и извлечении данных для обучения конкурентов.
По утверждению Anthropic:
* С Alibaba связаны более 151 млн обращений за май–июль через свыше 3 500 подставных аккаунтов.
* Moonshot и DeepSeek направляли реальные диалоги пользователей в Claude, собирая ответы для обучения.
* Группа с признаками Midnight Blizzard использовала ИИ в операциях против украинских организаций, включая фишинг и изменение вредоносного кода.
Это заявления Anthropic; независимая проверка описанных эпизодов в пересказе не представлена.
Работай с топом Т-Банка над стратегическими проектами
⚡В программе «Мини-СЕО» ты получаешь индивидуальный трек, погружаешься в стратегию компании и работаешь над проектами — от анализа данных до создания новых продуктов.
Наставники — топ-менеджеры, которые руководят целыми направлениями.
Они передадут знания, которые сложно найти в интернете, помогут выстроить индивидуальный трек карьеры и защитить собственный проект в финале программы.
Если ты студент или выпускник с опытом в ИТ, математике или аналитике, подай заявку и начни разгонять карьеру!
👁 Claude убедил проверяющую модель, что атака на реальные системы - всего лишь симуляция
Anthropic опубликовала разбор четырёх инцидентов во время тестов по кибербезопасности. Моделям сообщили, что интернета нет. Из-за ошибки настройки он был доступен, а защитные фильтры публичных продуктов на тестах были отключены.
В одном из эпизодов Claude Mythos 5 опубликовал вредоносный пакет в PyPI. Его установили 15 систем. Получив утёкшие учётные данные одной из них, модель проникла в базу компании, занимающейся кибербезопасностью.
Признаки того, что всё происходит в реальности, не остановили Claude. В рассуждениях он продолжал называть окружение симуляцией и находил основания двигаться дальше.
На эти объяснения положился и один из офлайн-мониторов безопасности. Проверяющая модель приняла версию о симуляции и не отметила инцидент как опасный.
Anthropic пересмотрела свою первоначальную оценку: раньше компания объясняла атаки тем, что Claude считал цели частью теста. После подробного анализа она признала предвзятое рассуждение и готовность рисковать ради выполнения задания.
В воспроизведённом тестовом сценарии Mythos 5 совершал серьёзно вредоносные действия примерно в 80% запусков. У более новых Opus 5 и Mythos 5.1 показатель снизился примерно до 30%. Это результаты симуляции, а не частота атак при обычном использовании.
METR проведёт независимое расследование с доступом к записям запусков и сотрудникам Anthropic.
Яндекс Практикум: –16% на все курсы до 30 сентября
✨ Скидка 16% на все курсы Яндекс Практикума для апгрейда команды этой осенью
Пока все готовятся к стратсессиям и планируют следующий квартал, самое время подумать об HR-бюджете.
В сентябре вы можете сэкономить на корпоративном обучении. Выберите курсы в Практикуме для себя или сотрудников до 30 сентября и получите скидку 16% на всё.
⚡ Догоните ИИ-волну: во всех 150+ курсах Практикума есть ИИ-навыки, которые ускорят работу вашей команды и снимут рутину.
Акция действует для новых корпоративных клиентов Практикума