Anthropic создала модель мощнее Mythos, но боится её выпускать
Компания уже использует более мощную Model 2 внутри компании, но не готова выпускать ее публично: разработчик повысил оценку рисков своих ИИ-моделей и признал, что прежние тесты все хуже отражают рост их возможностей.
Компания уже использует более мощную Model 2 внутри компании, но не готова выпускать ее публично: разработчик повысил оценку рисков своих ИИ-моделей и признал, что прежние тесты все хуже отражают рост их возможностей.
Anthropic разработала новую ИИ-модель под внутренним названием Model 2, которая в целом превосходит флагманскую Mythos 5. Выпускать ее для внешних пользователей компания пока не планирует, следует из нового отчета компании о рисках, как сообщает Axios.
В отчете Model 2 называют «заметным улучшением» по сравнению с Mythos 5 для многих задач, с которыми сотрудники работают внутри компании. При этом скачок возможностей оказался меньше, чем при переходе от Claude Opus 4.6 к Mythos Preview.
Model 2 уже активно используют внутри компании вместе с Mythos 5 — в том числе для программирования, генерации данных и агентных задач. Обе модели также применяют в исследованиях и инженерной работе. В отдельных областях Model 2 превосходит Mythos 5, в других уступает ей, но в целом компания оценивает ее как немного более мощную.
При этом Anthropic не провела для Model 2 полный набор стандартных тестов, которые обычно выполняет перед публичным запуском. Поэтому компания отмечает, что ее уверенность в оценке возможностей новой модели ниже обычного. Планов выпускать новую модель для внешних пользователей сейчас нет.
Одновременно Anthropic повысила общую оценку риска рассогласования моделей в ситуациях с высокими ставками с «очень низкой» до «низкой». Компания объясняет изменение возросшей неопределенностью после недавних инцидентов, выявленных во время тестирования моделей в области кибербезопасности. При этом вероятность катастрофического вреда от известных форм проблемного поведения моделей Anthropic по-прежнему оценивает как низкую.
Еще одна причина для осторожности — ускорение возможностей ИИ в автоматизированных исследованиях и разработке. Anthropic видит первые признаки того, что модели начинают заметнее ускорять такую работу. Одновременно некоторые привычные тесты достигли своего предела и уже плохо фиксируют дальнейший рост возможностей новых систем. Из-за этого разработчик признает, что оценивать риски наиболее мощных моделей становится сложнее.
Релоцировались? Теперь вы можете комментировать без верификации аккаунта.