Support us

Anthropic создала модель мощнее Mythos, но боится её выпускать

Компания уже использует более мощную Model 2 внутри компании, но не готова выпускать ее публично: разработчик повысил оценку рисков своих ИИ-моделей и признал, что прежние тесты все хуже отражают рост их возможностей.

Оставить комментарий
Anthropic создала модель мощнее Mythos, но боится её выпускать

Компания уже использует более мощную Model 2 внутри компании, но не готова выпускать ее публично: разработчик повысил оценку рисков своих ИИ-моделей и признал, что прежние тесты все хуже отражают рост их возможностей.

Anthropic разработала новую ИИ-модель под внутренним названием Model 2, которая в целом превосходит флагманскую Mythos 5. Выпускать ее для внешних пользователей компания пока не планирует, следует из нового отчета компании о рисках, как сообщает Axios.

В отчете Model 2 называют «заметным улучшением» по сравнению с Mythos 5 для многих задач, с которыми сотрудники работают внутри компании. При этом скачок возможностей оказался меньше, чем при переходе от Claude Opus 4.6 к Mythos Preview.

Model 2 уже активно используют внутри компании вместе с Mythos 5 — в том числе для программирования, генерации данных и агентных задач. Обе модели также применяют в исследованиях и инженерной работе. В отдельных областях Model 2 превосходит Mythos 5, в других уступает ей, но в целом компания оценивает ее как немного более мощную.

При этом Anthropic не провела для Model 2 полный набор стандартных тестов, которые обычно выполняет перед публичным запуском. Поэтому компания отмечает, что ее уверенность в оценке возможностей новой модели ниже обычного. Планов выпускать новую модель для внешних пользователей сейчас нет.

Одновременно Anthropic повысила общую оценку риска рассогласования моделей в ситуациях с высокими ставками с «очень низкой» до «низкой». Компания объясняет изменение возросшей неопределенностью после недавних инцидентов, выявленных во время тестирования моделей в области кибербезопасности. При этом вероятность катастрофического вреда от известных форм проблемного поведения моделей Anthropic по-прежнему оценивает как низкую.

Еще одна причина для осторожности — ускорение возможностей ИИ в автоматизированных исследованиях и разработке. Anthropic видит первые признаки того, что модели начинают заметнее ускорять такую работу. Одновременно некоторые привычные тесты достигли своего предела и уже плохо фиксируют дальнейший рост возможностей новых систем. Из-за этого разработчик признает, что оценивать риски наиболее мощных моделей становится сложнее.

SpaceX купила Cursor за $60 млрд — стартап уже помогает обучать Grok
SpaceX купила Cursor за $60 млрд — стартап уже помогает обучать Grok
По теме
SpaceX купила Cursor за $60 млрд — стартап уже помогает обучать Grok
3 млрд загрузок за полгода: самые скачиваемые ИИ-модели в мире — не от OpenAI и Anthropic
3 млрд загрузок за полгода: самые скачиваемые ИИ-модели в мире — не от OpenAI и Anthropic
По теме
3 млрд загрузок за полгода: самые скачиваемые ИИ-модели в мире — не от OpenAI и Anthropic
Anthropic объяснила как будет прятать «водяной знак» в текстах Claude
Anthropic объяснила, как будет прятать «водяной знак» в текстах Claude
По теме
Anthropic объяснила, как будет прятать «водяной знак» в текстах Claude
Читайте также
Блогеров начали «отменять» за рекламу и использование ИИ
Блогеров начали «отменять» за рекламу и использование ИИ
Блогеров начали «отменять» за рекламу и использование ИИ
Anthropic изменит лимиты Claude Code: формально +25%, фактически -17%
Anthropic изменит лимиты Claude Code: формально +25%, фактически -17%
Anthropic изменит лимиты Claude Code: формально +25%, фактически -17%
ИИ всё чаще выходит из-под контроля: за месяц число инцидентов удвоилось
ИИ всё чаще выходит из-под контроля: за месяц число инцидентов удвоилось
ИИ всё чаще выходит из-под контроля: за месяц число инцидентов удвоилось
Anthropic рассылает «письма счастья»: у пользователей Claude взламывают аккаунты и съедают лимиты
Anthropic рассылает «письма счастья»: у пользователей Claude взламывают аккаунты и съедают лимиты
Anthropic рассылает «письма счастья»: у пользователей Claude взламывают аккаунты и съедают лимиты

Хотите сообщить важную новость? Пишите в Telegram-бот

Главные события и полезные ссылки в нашем Telegram-канале

Обсуждение
Комментируйте без ограничений

Релоцировались? Теперь вы можете комментировать без верификации аккаунта.

Комментариев пока нет.