Anthropic представила Claude Fable 5.1 и Mythos 5.1: кодинг, исследования и цена
Anthropic анонсировала Claude Fable 5.1 для кодинга и Mythos 5.1 для исследований. Заявлена экономия до 45% на агентных задачах, улучшенные бенчмарки и новые правила безопасности. Разбираем, что известно и что требует проверки.
Anthropic анонсировала две новые модели: Claude Fable 5.1 для работы с кодом и агентных сценариев и Mythos 5.1 для исследований и сложной аналитики. Компания заявляет о снижении стоимости длинных автономных задач до 45 процентов, для типичных нагрузок экономия около 25 процентов. Заявлены улучшения в кодинге, научных задачах, качестве текста и менее чувствительные фильтры безопасности. В релизе упомянуты встроенные водяные знаки и ограниченный доступ к Mythos 5.1 для специализированных программ в кибербезопасности и бионауках.
Подтвердить эти сведения по независимым источникам пока нельзя: в нашем распоряжении нет официального пресс-релиза Anthropic. Все цифры и характеристики в этой статье приведены как заявленные и требуют проверки по первоисточнику.
Claude Fable 5.1 и Mythos 5.1: что заявлено в релизе
Fable 5.1 позиционируется как модель для кодинга и агентных сценариев: она должна лучше работать с репозиториями, инструментами и последовательным выполнением задач. Mythos 5.1 ориентирована на исследования и сложные аналитические задачи: поиск и сопоставление сведений, формирование гипотез, работа с длинными материалами.
Anthropic заявляет о росте результатов на кодовых и научных бенчмарках. Фильтры безопасности стали менее чувствительными к безвредным запросам. В результатах моделей появились встроенные водяные знаки. Доступ к Mythos 5.1 ограничен: модель доступна только для специализированных программ в области кибербезопасности и бионаук.
Эти данные требуют проверки. На момент публикации нет официального первоисточника, поэтому все специфические цифры и характеристики могут отличаться от реальных.
Что подтверждено, а что пока требует первоисточника
Новость о выпуске Claude Fable 5.1 и Mythos 5.1 не подтверждена независимыми источниками. В доступных материалах нет упоминаний об этих моделях. Мы разделили информацию на две группы: рыночный контекст и заявления, требующие проверки.
Какие данные можно использовать только как рыночный контекст
Тенденция к снижению стоимости моделей для агентных задач существует. Например, Google в августе 2026 года представила Gemini 3.7 Flash как рабочую модель для кодинга и агентов. Компания заявила, что модель вышла через три недели после Gemini 3.6 Flash и стоит вдвое дешевле в расчете на миллион токенов. Это пример другого производителя, его нельзя напрямую сравнивать с Anthropic без одинаковых условий: тарификации, длины контекста, количества вызовов инструментов, лимитов и качества результата.
Какие заявления Claude Fable 5.1 и Mythos 5.1 нужно проверить
Для следующих фактов обязательна ссылка на официальный релиз, документацию или таблицу тестирования:
- Названия моделей Claude Fable 5.1 и Mythos 5.1.
- Дата релиза.
- Официальные тарифы.
- Доступность через API.
- Методика бенчмарков.
- Формулировки про безопасность.
- Формат водяных знаков.
- Перечень программ, которым доступен Mythos 5.1.
Claude Fable 5.1 для кодинга: где ожидается прирост
Агентный сценарий отличается от обычной генерации фрагмента кода. Модель сама читает файлы, вызывает инструменты, проверяет результат и продолжает задачу. Fable 5.1 заявлена как улучшенная для таких сценариев.
От генерации фрагмента кода к работе с задачей целиком
Модель может выполнять code review, исправлять ошибки в нескольких файлах, готовить pull request и искать места вызова функции. Качество зависит от доступа к инструментам, структуре репозитория и возможности проверять результат.
Почему длинный контекст влияет на стоимость агента
Даже более дешевая модель может обходиться дорого при большом числе итераций. Повторно прочитанные файлы остаются в диалоге и повторно тарифицируются на следующих шагах. Sonar, платформа для AI-агентов в разработке, приводит пример: одна pull request в их кодовой базе достигла 156 миллионов контекстных токенов с пиковым значением 459 тысяч токенов. Это пример другой системы, а не показатель Claude Fable 5.1, но он показывает масштаб проблемы.
Как оценивать кодовую модель на своей задаче
Сравнивайте процент успешно завершенных задач, число ручных исправлений, количество вызовов инструментов, время до результата, расход токенов и число повторных попыток. Инфраструктура вокруг модели тоже влияет на итог: Sonar утверждает, что их агентная навигация уменьшает объем контекста и число обращений к инструментам.
Mythos 5.1 для исследований: что меняется для пользователя
Mythos 5.1 заявлена как модель для исследовательских и научных сценариев. Она может помочь аналитикам, исследователям и специалистам по знаниям.
Какие исследовательские задачи можно делегировать
Модель может готовить обзор по теме, сравнивать несколько документов, выделять противоречия, строить план эксперимента и проводить предварительный анализ данных. Она ускоряет работу с информацией, но не заменяет экспертную проверку.
Почему высокий результат на бенчмарке не равен готовому исследованию
Смотрите на набор задач, дату тестирования, базовую модель для сравнения, доступные инструменты, стоимость попыток и частоту фактических ошибок. Без официальной таблицы Anthropic конкретные баллы Mythos 5.1 приводить нельзя.
Цена новых моделей Anthropic 5.1: откуда берется экономия 25 и 45 процентов
Anthropic заявляет о снижении стоимости: около 25 процентов на типичных нагрузках и до 45 процентов на длинных автономных задачах с большим числом вызовов инструментов. Это относительная экономия, а не опубликованный тариф. Без базовой цены, состава нагрузки и методики расчета ее нельзя проверить.
Около 25 процентов на типичных нагрузках
Типичные нагрузки: обычные чаты, короткие запросы к API, небольшие задачи генерации и редактирования. Итоговая сумма зависит от соотношения входных и выходных токенов, лимитов контекста и фактического объема использования.
До 45 процентов в длинных агентных задачах
Максимальная экономия относится не ко всем пользователям. Она связана с длительными цепочками действий, большим числом инструментальных вызовов и повторной передачей контекста. Показатель «до» описывает отдельные сценарии и не должен использоваться как средняя экономия.
Почему цену нельзя сравнивать только по стоимости токена
Учитывайте цену входных и выходных токенов, кэширование, число вызовов инструментов, повторные попытки, задержку, лимиты и ручную проверку результата. Google заявляла цену Gemini 3.7 Flash вдвое ниже Gemini 3.6 Flash, но это не прямое сравнение с Anthropic.
Безопасность и доступ: водяные знаки, фильтры и Mythos 5.1
Три изменения требуют внимания: встроенные водяные знаки, снижение чувствительности фильтров к безвредным запросам и ограничение доступа к Mythos 5.1.
Встроенные водяные знаки: что важно уточнить
Проверьте формат водяного знака, виден ли он пользователю, можно ли обнаружить его автоматически, относится ли он ко всем типам вывода и распространяется ли правило на API.
Что означает изменение safety-фильтров
Снижение числа ложных срабатываний должно оцениваться на безопасных сценариях. Не утверждайте, какие категории запросов изменились, без официального описания политик Anthropic.
Почему Mythos 5.1 доступна не для всех программ
Уточните, кто может претендовать на доступ, нужна ли предварительная проверка, какие задачи считаются специализированными и доступны ли альтернативные режимы через API. Ограничение доступа не является самостоятельным доказательством качества или риска модели.
Кому подойдут Claude Fable 5.1 и Mythos 5.1 и что проверить перед подключением
Решение о тестировании модели принимайте по тестовой нагрузке, а не по заявленным максимальным показателям.
Когда тестировать Claude Fable 5.1
Начните с повторяемого набора задач: исправление багов, рефакторинг, написание тестов, code review и работа с несколькими связанными файлами. Сравните качество, число итераций и полную стоимость выполнения.
Когда рассматривать Mythos 5.1
Модель может быть полезна для обзоров литературы, структурирования больших документов, сравнительного анализа и подготовки исследовательских черновиков. Финальные факты, ссылки и выводы должны проходить проверку специалистом.
Минимальный чек-лист перед использованием API
Проверьте документацию, тарифную сетку, лимиты, региональную доступность, политику хранения данных, правила для чувствительных доменов, формат водяных знаков и способ измерения результатов.
Есть вопрос или заметили неточность? Напишите нам, и мы обновим материал после проверки официального релиза Anthropic.