Запись архива

Claude Fable 5: обзор, рейтинг и ограничения

Claude Fable 5 заняла 8-е место в рейтинге COMRAD404, но стала лидером Text Arena. Разбираем сильное рассуждение и кодинг, высокую задержку, цену, ограничения безопасности и пригодность для агентных задач.

Claude Fable 5 от Anthropic — профиль модели с рейтингом COMRAD404, ценой API и показателями кодинга

Claude Fable 5 — модель для сложной работы, где важнее качество решения и автономность, чем быстрый первый ответ. В редакционном рейтинге COMRAD404 она заняла 8-е место с COMRAD Score 89,0. При этом профиль модели неоднороден: качество и предпочтение людей получили максимальные 100,0, кодинг — 96,1, а эффективность — только 13,4. Иными словами, Fable 5 выглядит убедительно там, где нужно долго разбираться, писать и проверять результат, но её нельзя считать универсально выгодным или быстрым API-вариантом.

По независимым замерам из паспорта модель стала первой в LMArena Text с рейтингом 1507,5 и 25 824 голосами. В Code Arena она заняла 7-е место с рейтингом 1628,0. Artificial Analysis Intelligence Index составил 62,1. Эти числа описывают разные измерения и не являются процентами правильных ответов или единым «процентом качества».

Официальный профиль Anthropic позиционирует Fable 5 как модель для наиболее сложных задач в программировании, профессиональной работе, анализе документов, работе с изображениями и длительных агентных процессов. Компания также предупреждает о защитных механизмах в кибербезопасности и биологии: часть запросов может быть передана менее мощной модели. ([anthropic.com](https://www.anthropic.com/news/claude-fable-5-mythos-5?type=company))

Коротко

  • Итоговая оценка COMRAD404: 89,0 из 100.
  • Позиция: 8-е место в выпуске 2026 H2.
  • Лучшее измерение: человеческое предпочтение и общий показатель качества — по 100,0.
  • Кодинг: 96,1; 7-е место в LMArena Code по паспорту.
  • Слабое место: эффективность 13,4, на которую влияют стоимость и задержка.
  • Цена из паспорта: 10 долларов за миллион входных токенов и 50 долларов за миллион выходных.
  • Скорость из паспорта: 69,0 выходных токенов в секунду, time to first token — 120,6 секунды.
  • Контекст: 1 000 000 токенов.
  • Доступ: закрытая проприетарная модель без open weights.

Выбирать Fable 5 разумно для длинных инженерных, аналитических и исследовательских процессов, где один удачный проход экономит часы ручной работы. Для коротких ответов, массовой генерации и чувствительных к задержке интерфейсов её профиль менее удобен.

Что это за модель

Claude Fable 5 разработана Anthropic. В паспорте указаны закрытая лицензия Proprietary, отсутствие открытых весов, поддержка reasoning и статус обычной, а не preview-модели. Это важные практические характеристики: Fable 5 нельзя скачать и развернуть на собственном сервере как модель с открытыми весами, а доступ зависит от продуктов Anthropic и подключённых API-провайдеров.

Anthropic представила Fable 5 9 июня 2026 года и описала её как модель Mythos-класса для общего использования. В официальных материалах акцент сделан на длительных задачах, агентном программировании, работе с большими документами, визуальном анализе и сложной профессиональной деятельности. Архитектура, число параметров и техническая схема обучения в использованном срезе официально не раскрыты в форме, которую можно было бы надёжно использовать для этого профиля, поэтому эти сведения здесь не восстанавливаются по косвенным признакам. ([anthropic.com](https://www.anthropic.com/news/claude-fable-5-mythos-5?type=company))

В официальной документации Anthropic также фигурирует идентификатор claude-fable-5. Для интеграции важно указывать именно канонический идентификатор, а не маркетинговое название модели. Статус и доступность такого идентификатора могут зависеть от конкретной поверхности: Claude API, Claude Code, Claude.ai, облачного маркетплейса или корпоративного плана.

Паспорт модели

Параметр Значение в срезе 31 августа 2026 года
Модель Claude Fable 5
Разработчик Anthropic
Канонический slug claude-fable-5
Лицензия Proprietary
Open weights Нет
Reasoning Да
Статус preview Нет
Место COMRAD404 8
COMRAD Score 89,0 из 100
Artificial Analysis Intelligence Index 62,1; оценка не помечена как estimated
LMArena Text 1507,5; 1-е место; 25 824 голоса
LMArena Code 1628,0; 7-е место
Цена входа 10 долларов за 1 млн токенов
Цена выхода 50 долларов за 1 млн токенов
Скорость генерации 69,0 выходных токенов/с
Time to first token 120,6 с
Контекст 1 000 000 токенов

Таблица объединяет показатели из паспорта, но не делает их взаимозаменяемыми. LMArena rating — статистический результат слепых попарных сравнений. Artificial Analysis Intelligence Index — отдельный индекс с собственной методикой. Цена указана за токены, скорость — в токенах в секунду, а контекст — в токенах доступного окна. Ни один из этих показателей не является процентом успешных ответов.

Место в рейтинге

Выпуске 2026 H2 Fable 5 находится на 8-й позиции общего рейтинга. Это не противоречит первому месту в Text Arena: общий COMRAD Score учитывает не только человеческое предпочтение, но и качество, кодинг, эффективность и доступ. Веса редакционной методики для этих пяти блоков составляют соответственно 0,4, 0,3, 0,15, 0,1 и 0,05.

Итоговая оценка 89,0 получается из сильных верхних блоков и заметного штрафа за эффективность. Редакционная оценка эффективности — 13,4 — особенно резко отличается от качества 100,0 и coding 96,1. Это означает не «плохую модель», а дорогой и медленный профиль: Fable 5 может хорошо решать задачу, но не обязательно делает это с лучшим соотношением стоимости, задержки и результата.

Статистический результат Text Arena показывает высокое предпочтение модели в открытых текстовых сравнениях. Однако он не отвечает на вопросы о времени ожидания, цене, поведении с инструментами, устойчивости к длинным цепочкам действий или допустимом уровне отказов. Поэтому первое место в текстовом рейтинге следует трактовать как сильный сигнал качества диалога, а не как универсальный сертификат для любой эксплуатации.

Полный контекст методики и соседних позиций стоит проверять в рейтинге COMRAD404. Значения в этой статье относятся именно к срезу на 31 августа 2026 года и могут измениться в следующих редакциях.

Разбор пяти суббаллов

Суббалл Оценка Что означает для выбора
Качество 100,0 Модель рассчитана на сложные ответы, многошаговое рассуждение и задачи, где важна глубина результата.
Человеческое предпочтение 100,0 Сильный результат в слепых текстовых сравнениях LMArena; это не процент точности.
Кодинг 96,1 Высокая пригодность для разработки, миграций, ревью и агентной работы с репозиториями.
Эффективность 13,4 Главный компромисс профиля: цена и задержка делают модель нерациональной для многих простых запросов.
Доступ 64,8 Доступность лучше, чем у закрытой preview-системы, но нет open weights и сохраняется зависимость от платформы.

Суббаллы COMRAD404 — это нормализованные редакционные оценки от 0 до 100, а не проценты качества. Значение 100,0 в качестве не означает, что модель правильно решает каждую задачу. Оно означает, что в данной редакционной шкале Fable 5 получила верхнюю оценку по этому измерению на момент среза.

Возможности и сценарии

Длинные агентные процессы

Главный практический сценарий Fable 5 — задача, которую нельзя качественно закрыть одним коротким ответом. Это может быть исследование с несколькими этапами, разбор большого набора документов, подготовка отчёта с проверкой источников или последовательная работа через инструменты. Anthropic описывает модель как пригодную для многоступенчатых проектов, делегирования подзадач и самостоятельной проверки результата. Это официальная интерпретация разработчика, а не независимый аудит всех возможных агентных сценариев. ([anthropic.com](https://www.anthropic.com/claude/fable))

Программирование и сопровождение кода

С coding-суббаллом 96,1 Fable 5 естественно рассматривать для крупных миграций, реализации требований по существующему проекту, генерации тестов, code review и поиска причин регрессий. Наиболее разумный режим — не «написать всё без проверки», а дать модели репозиторий, ограничения, тестовый контур и понятные критерии готовности. Высокий балл не отменяет необходимости запускать тесты, смотреть diff и проверять изменения в инфраструктуре.

Для локального программирования важен агентный контур: модель должна видеть файлы, получать результаты команд и иметь возможность исправлять ошибки. Без такого контура её преимущество над обычным чатом может быть заметно меньше. С другой стороны, агентный режим повышает стоимость и время выполнения, особенно если запрос запускает несколько циклов анализа и проверки.

Документы, таблицы и визуальные материалы

Официальная страница Fable 5 отдельно указывает на работу с диаграммами, графиками, таблицами в документах и PDF. Это делает модель интересной для финансового анализа, юридического разбора, аналитики и архитектурных материалов. На практике нужно проверять не только способность прочитать изображение, но и точность переноса чисел, единиц измерения, подписей осей и сносок. ([anthropic.com](https://www.anthropic.com/claude/fable))

Исследовательские задачи

Reasoning-флаг и максимальные оценки качества делают модель кандидатом для постановки гипотез, структурирования литературы, сопоставления аргументов и подготовки плана эксперимента. Но результат следует использовать как рабочий черновик: факты, расчёты и выводы нужно проверять по первичным материалам, а в медицине, биологии и финансовых решениях — дополнительно привлекать профильного специалиста.

Цена и скорость

В паспорте указаны 10 долларов за миллион входных токенов и 50 долларов за миллион выходных. Это цена токенов, а не фиксированная стоимость одного запроса. Реальный расход зависит от длины истории, системных инструкций, инструментов, повторно передаваемого контекста, кэширования, объёма рассуждения и того, какой API-провайдер или режим используется.

Официальная страница Anthropic также указывает базовую цену 10/50 долларов и отдельно упоминает скидку на prompt caching, а для US-only inference — коэффициент 1,1. Эти условия относятся к конкретным поверхностям и тарифным правилам Anthropic; их нельзя автоматически переносить на любой сторонний маркетплейс. Перед запуском следует проверить актуальный прайс именно выбранного канала. ([anthropic.com](https://www.anthropic.com/claude/fable))

Скорость 69,0 выходных токенов в секунду выглядит приемлемо после начала генерации, но time to first token в паспорте составляет 120,6 секунды. Для интерактивного чата это может ощущаться как длинная пауза, даже если последующий вывод печатается быстро. Поэтому для пользовательского интерфейса нужны потоковая выдача, индикатор работы и асинхронная архитектура. Измерения скорости зависят от нагрузки, региона, провайдера, размера запроса и режима рассуждения; приведённые числа не следует обещать как постоянные.

Приближённую стоимость собственного теста можно оценить так: входные токены умножаются на 10 долларов за миллион, выходные — на 50 долларов за миллион, после чего добавляются возможные расходы на инструменты, кэширование и специфические условия провайдера. В длинных агентных задачах выход и повторно отправляемая история могут стать более значимой статьёй расходов, чем первый пользовательский запрос.

Контекст в миллион токенов

Паспорт указывает контекст 1 000 000 токенов. Такой объём полезен для больших репозиториев, архивов документов, длинных журналов событий и многочасовых рабочих процессов. Однако размер окна не гарантирует одинаково внимательное использование каждой части контекста. При большом объёме входных данных всё равно нужны структура, индексы, краткие промежуточные сводки и явные ссылки на ключевые фрагменты.

Практическая проверка должна включать «иголку в стоге сена»: положите уникальный факт в начало, середину и конец большого набора материалов, а затем попросите модель найти и сопоставить их. Отдельно проверьте, не теряются ли условия задачи после нескольких циклов tool use. Контекст — ресурс, а не замена архитектуре поиска и памяти.

Ограничения

Стоимость и задержка

Главный недостаток по паспорту — низкая эффективность 13,4. Модель может быть оправдана, если один качественный запуск заменяет значительный объём работы инженера или аналитика. Но для классификации, коротких писем, простого перефразирования и массовых однотипных операций дорогой выходной токен и длительное ожидание первого токена могут перевесить выигрыш в качестве.

Защитные переключения

Fable 5 сопровождается защитными классификаторами для кибербезопасности и биологии. При срабатывании запрос может быть заблокирован или перенаправлен к менее мощной модели. Anthropic прямо отмечала, что на запуске классификаторы были настроены консервативно и могли срабатывать на безобидных формулировках. 7 августа 2026 года компания сообщила о снижении биологических fallback-срабатываний примерно на 85% в собственном тестировании. Это заявление разработчика, а не независимое измерение; кроме того, оно не означает полного исчезновения отказов. ([anthropic.com](https://www.anthropic.com/news/claude-fable-5-mythos-5?type=company))

Для задач по безопасности и биологии нужно заранее предусмотреть обработку fallback, повторную постановку разрешённого запроса и журналирование того, какая модель фактически сформировала ответ. Нельзя считать, что выбранный Fable 5 гарантированно отвечает на каждый запрос сам.

Приватность и управляемость

Официальная страница Anthropic указывает, что использование Fable 5 требует 30-дневного хранения данных для мониторинга безопасности. Для компаний это важное ограничение при работе с персональными данными, коммерческой тайной, исходным кодом и регулируемой информацией. Условия конкретного API-провайдера могут отличаться, поэтому перед передачей данных нужно изучить договор, настройки хранения и режимы корпоративного доступа. ([anthropic.com](https://www.anthropic.com/claude/fable))

Закрытая лицензия

Fable 5 не имеет open weights, а лицензия в паспорте обозначена как Proprietary. Следовательно, модель нельзя рассматривать как открытое программное обеспечение или свободно переносимый артефакт для самостоятельного развёртывания. Это не делает её непригодной для бизнеса, но усиливает зависимость от цен, лимитов, доступности и политики Anthropic или посредника.

История доступности

В июне 2026 года Anthropic временно приостанавливала доступ к Fable 5, а 1 июля сообщила о восстановлении доступности. Для долгоживущего сервиса это аргумент в пользу резервного провайдера, абстракции над API и сохранения тестового набора. История сама по себе не доказывает регулярные перебои, но показывает, что доступность frontier-модели нельзя считать неизменной. ([anthropic.com](https://www.anthropic.com/news/claude-fable-5-mythos-5?type=company))

Как проверить на своей задаче

  1. Соберите эталон. Возьмите 20–50 реальных задач, а не только демонстрационные промпты. Разделите их на код, документы, таблицы, изображения, поиск ошибок и длинные процессы.
  2. Зафиксируйте критерии. Для каждой задачи заранее определите, что считается правильным результатом: тесты проходят, числа совпадают, обязательные поля заполнены, ссылки проверены, формат соблюдён.
  3. Снимите базовую линию. Запишите результат текущей модели или ручного процесса. Без этого высокий субъективный рейтинг Fable 5 не превращается в измеримую выгоду.
  4. Проведите минимум три запуска. Один ответ может быть удачным случайно. Для каждой задачи сохраняйте промпт, входные данные, модель, режим, результат и причину ручной правки.
  5. Измерьте деньги и время. Разделяйте время до первого токена, полное время, число входных и выходных токенов, число вызовов инструментов и стоимость всей цепочки.
  6. Проверьте длинный контекст. Используйте документы размером от 100 тысяч токенов и выше, а затем постепенно увеличивайте объём. Ищите факты в разных частях входа и проверяйте устойчивость после нескольких итераций.
  7. Проверьте fallback. Добавьте безопасные, но тематически чувствительные запросы по биологии и кибербезопасности. Зафиксируйте отказ, перенаправление, фактическую модель ответа и стоимость.
  8. Оцените управляемость. Для агентных задач проверьте, умеет ли система останавливаться перед опасными действиями, объяснять прогресс, восстанавливаться после ошибки и не менять файлы без подтверждения.

Решение о покупке стоит принимать не по одному COMRAD Score, а по стоимости полезного результата. Если Fable 5 с первого или второго прохода закрывает сложную задачу, её дорогой тариф может окупаться. Если большая часть запросов короткая и предсказуемая, низкая эффективность из паспорта должна стать решающим предупреждением.

Кому подойдёт Claude Fable 5

  • Командам, которые ведут крупные миграции и сложные рефакторинги.
  • Разработчикам агентных систем с инструментами, тестами и контролем изменений.
  • Аналитикам, работающим с длинными отчётами, таблицами, графиками и PDF.
  • Исследовательским группам, которым нужен сильный первый проход по многошаговой задаче.
  • Компаниям, готовым платить за снижение числа итераций и ручных исправлений.

Модель хуже подходит для дешёвого массового inference, мгновенных чат-ответов, полностью автономных действий без журналирования и сценариев, где нельзя принять 30-дневное хранение данных. Для медицинских, юридических, финансовых и кибербезопасностных задач ответ Fable 5 должен оставаться материалом для проверки, а не единственным основанием решения.

Итоговая оценка

Claude Fable 5 занимает 8-е место не потому, что ей не хватает базовой способности рассуждать или писать код. Наоборот, её сильная сторона — верхний уровень качества: 100,0 за качество и человеческое предпочтение, 96,1 за кодинг, первое место в Text Arena. Позицию снижают практические издержки — эффективность 13,4, высокая задержка первого токена, дорогой вывод, закрытая лицензия и защитные fallback-механизмы.

Итоговый вердикт: это специализированный выбор для дорогих и длинных задач, а не автоматическая рекомендация для каждого API-запроса. Если проекту нужны автономность, глубокий анализ, работа с большим контекстом и сильный кодинг, Fable 5 заслуживает полноценного пилота. Если важнее скорость, предсказуемая себестоимость или локальный контроль, паспорт модели даёт достаточно оснований искать другой профиль.

FAQ

Какое место Claude Fable 5 занимает в рейтинге COMRAD404?

В выпуске COMRAD404 2026 H2 модель занимает 8-е место с COMRAD Score 89,0 из 100.

Действительно ли Claude Fable 5 лучшая модель в рейтинге?

В паспорте она занимает 1-е место в LMArena Text с рейтингом 1507,5, но в общем рейтинге COMRAD404 находится на 8-й позиции. Это разные системы измерения.

Сколько стоит Claude Fable 5?

В зафиксированном паспорте указаны 10 долларов за миллион входных токенов и 50 долларов за миллион выходных. Фактические условия зависят от API-провайдера, режима и возможных скидок.

Подходит ли модель для программирования?

Да, кодовый суббалл составляет 96,1, а в LMArena Code модель имеет рейтинг 1628,0 и занимает 7-е место по паспорту. Для production-кода всё равно нужны тесты, ревью и контроль изменений.

Есть ли у Claude Fable 5 открытые веса?

Нет. В паспорте указано open weights: false, а лицензия обозначена как Proprietary. Модель доступна через продукты и API-поверхности, но не как свободно загружаемый набор весов.

Почему модель может не ответить на запрос по биологии или кибербезопасности?

Anthropic использует защитные классификаторы. Срабатывание может привести к отказу или перенаправлению к менее мощной модели. В августе 2026 года компания сообщила о снижении биологических fallback-срабатываний, но не об их полном устранении.

Насколько быстро Claude Fable 5 отвечает?

В паспорте указаны 69,0 выходных токенов в секунду и 120,6 секунды до первого токена. Это параметры конкретного среза; на практике они меняются в зависимости от нагрузки, провайдера, региона и режима.

Источники

  • Artificial Analysis: LLM Leaderboard — benchmark; источник площадки для Intelligence Index, цен, скорости, контекста и API-функций в соответствующем срезе.
  • LMArena Text Leaderboard — benchmark; Text Arena rating, место и число пользовательских голосов.
  • LMArena Leaderboard — benchmark; результаты Code Arena, использованные в кодовом суббалле.
  • Claude Fable 5 and Claude Mythos 5 — official; дата запуска, разработчик, позиционирование, цена, доступность и описание защитных механизмов. ([anthropic.com](https://www.anthropic.com/news/claude-fable-5-mythos-5?type=company))
  • Claude Fable 5 — official; официальная страница модели, сценарии, цена, доступные поверхности, контур безопасности и требования к хранению данных. ([anthropic.com](https://www.anthropic.com/claude/fable))
  • Redeploying Claude Fable 5 — official; восстановление доступа и изменения доступности после июня 2026 года. ([anthropic.com](https://www.anthropic.com/news/redeploying-fable-5))
  • Improving Fable 5’s biology safeguards — official; обновление биологических защит и заявленное Anthropic снижение fallback-срабатываний. ([anthropic.com](https://www.anthropic.com/news/improving-fable-5-s-biology-safeguards))
  • More details on Fable 5’s cyber safeguards and our jailbreak framework — official; устройство и назначение защитных классификаторов в кибербезопасности. ([anthropic.com](https://www.anthropic.com/news/fable-safeguards-jailbreak-framework))
  • Claude Fable 5 and Claude Mythos 5 System Card — model-card; официальный системный документ Anthropic с оценками возможностей и безопасности.
  • Anthropic Claude API migration guide — repository; официальный репозиторий Anthropic с каноническим API-идентификатором и рекомендациями по миграции.

Срез данных: 31 августа 2026 года. Редакционные оценки COMRAD404 нормализованы по шкале 0–100. Цена, скорость, доступность и поведение API могут изменяться.