До выхода Claude Opus 5 на Habr появилась версия, что Fable 5 — это будущий Opus 5 под другим названием. После официального релиза стало видно: у моделей разные цены, задержка, режимы рассуждения и правила работы с данными, но одинаковый контекст в 1 миллион токенов и близкие результаты в ряде тестов. Поэтому оба быстрых вывода — «Fable больше не нужен» и «Opus заведомо слабее» — плохо подходят для продакшена.
Рабочая гипотеза: Opus 5 стоит проверять как модель по умолчанию для большинства сложных задач, а Fable 5 — как уровень эскалации для самых неоднозначных, длинных и дорогих в случае ошибки задач.
Это разбор открытых материалов, а не завершённый A/B‑тест двух моделей в одинаковом окружении. Ниже я отделяю подтверждённые факты от того, что команде ещё предстоит измерить самостоятельно.
Что релиз доказал — и чего он не доказал
Официальная таблица моделей Anthropic рекомендует начинать с Opus 5 для сложного агентного программирования и корпоративной работы, а Fable 5 использовать там, где нужен максимальный доступный уровень возможностей.
Это уже полезнее, чем названия линеек. Оно даёт две разные продуктовые роли:
Opus 5 — основной рабочий слой для сложных задач.
Fable 5 — верхний слой для задач, где предел качества важнее цены и скорости.
Официальные контракты действительно отличаются:
Параметр |
Claude Opus 5 |
Claude Fable 5 |
|---|---|---|
API model ID |
|
|
Позиционирование |
сложное агентное программирование и корпоративная работа |
максимальный общедоступный уровень возможностей, длительные агенты |
Контекст |
1 млн токенов |
1 млн токенов |
Максимальный вывод |
128 тыс. токенов |
128 тыс. токенов |
Относительная задержка |
moderate |
slower |
Рассуждение |
adaptive thinking, пять уровней effort |
adaptive thinking всегда включён |
Надёжная граница знаний |
май 2026 |
январь 2026 |
Базовая цена Anthropic, ввод / вывод |
$5 / $25 за 1 млн токенов |
$10 / $50 за 1 млн токенов |
Хранение данных для общего доступа |
специального требования на 30 дней нет |
требуется хранение в течение 30 дней |
Эта таблица доказывает, что перед нами два разных публичных продукта. Но она не раскрывает архитектуру, обучающие данные или веса моделей.
Поэтому корректный ответ на старый спор звучит так:
Мы можем доказать, что контракты Opus 5 и Fable 5 различаются. Но по публичным параметрам нельзя доказать ни идентичность, ни различие их внутренних весов.
Для выбора модели этого достаточно. В продакшене мы покупаем не абстрактные веса, а конкретный API‑контракт с ценой, задержкой, политикой данных и поведением маршрутизации.
Полцены за токен — не полцены за принятую задачу
Самая заметная разница находится в прайс‑листе.
У Anthropic Opus 5 стоит $5 / $25, а Fable 5 — $10 / $50 за 1 млн входных и выходных токенов. Здесь формулировка «в два раза дешевле» математически точна.
Но команда платит не за строку в прайс‑листе. Она платит за результат, который прошёл тесты, ревью и приёмку.
Artificial Analysis получил в своём наборе задач другую пропорцию:
Opus 5 на
maxeffort — в среднем $2,03 за задачу.Fable 5 с fallback — в среднем $2,75 за задачу.
В этом конкретном тестовом окружении преимущество Opus составило около 26%, а не 50%.
Противоречия здесь нет. Модели могут использовать разное количество токенов, выбирать разную глубину рассуждения, делать разное число вызовов инструментов и требовать разное количество повторных запусков.

Источник: Artificial Analysis, effort и token trade‑off.
Для реального сравнения я бы считал такую метрику:
стоимость принятой задачи = входные токены + выходные токены + cache write и cache read + вызовы инструментов + неудачные попытки + время инженера на исправления и ревью
Если дешёвая модель трижды не проходит тесты, её номинальная цена уже ничего не объясняет. Если дорогая модель решает задачу с первого раза, премия может окупиться. Обратная ситуация тоже возможна: Fable может дать чуть более сильный результат там, где Opus уже полностью проходит критерии приёмки.
Поэтому полезный вопрос звучит не «какая модель дешевле за токен», а «какая модель дешевле за принятый результат нужного качества?».
Почему публичные рейтинги дают разные ответы
В анонсе Opus 5 Anthropic сообщает, что на CursorBench 3.2 модель на максимальном effort отстаёт от пикового результата Fable менее чем на 0,5%, но стоит примерно вдвое дешевле за задачу. На OSWorld 2.0 Opus, по данным компании, превышает лучший результат Fable примерно за треть стоимости.
Artificial Analysis даёт Opus 5 индекс интеллекта 61, а Fable 5 — 60 при максимальном effort. Разница в один пункт здесь больше похожа на практическую ничью, чем на новое поколение между моделями.

Источник: Artificial Analysis, основной тред о Claude Opus 5.
В других задачах картина может переворачиваться. У Fable остаются убедительные результаты в сложной диагностике, архитектурном анализе, фактических знаниях и длинных автономных запусках.

Источник: Artificial Analysis, GDPval‑AA v2 и AA‑Briefcase.
Причина не только в шуме измерений. Сравниваются разные системы:
модель и уровень effort.
agent harness.
доступные инструменты.
лимиты времени и токенов.
число повторов.
критерии успешного результата.
поведение защитных классификаторов и fallback.
Даже в сноске к тестам Anthropic указано, что при отказах защитного классификатора для Opus 5 и Fable 5 использовался fallback на Opus 4.
В выборке Artificial Analysis стоимость Fable также указана с fallback.

Источник: Artificial Analysis, полная разбивка Intelligence Evaluations.
Если сохранять только поле requested_model, но не сохранять фактическую модель ответа, можно сравнить не те модели, которые, как кажется, были вызваны.
Отсюда практическое правило:
Benchmark нужен, чтобы выбрать задачи для собственного теста, а не чтобы отменить собственный тест.
Данные и fallback могут завершить выбор раньше benchmark
Для Fable 5 Anthropic требует 30-дневное хранение данных для мониторинга безопасности. Для общего доступа к Opus 5 такого специального требования нет.
Если политика компании запрещает передавать исходный код или клиентские данные в контур с таким сроком хранения, Fable может не пройти отбор независимо от его результатов.
Вторая граница — защитная маршрутизация. Anthropic пишет, что ограничения Opus 5 для киберзадач должны срабатывать заметно реже, чем у Fable, но бинарное сканирование, пентест и генерация эксплойтов по‑прежнему ограничиваются. В пользовательских продуктах заблокированные запросы могут переключаться на другую модель, а в API fallback можно включить отдельно.
Для обычной команды отсюда следуют три требования:
Сохранять запрошенную и фактическую модель ответа.
Логировать причину отказа или переключения, если провайдер её возвращает.
Не смешивать результаты с fallback и без fallback в одной строке сравнения.
Это особенно важно для security review. Иначе слабый результат легко ошибочно приписать Fable, хотя запрос уже обрабатывала другая модель.
Доступ из России: официальные ограничения и реальные цены
Россия отсутствует в официальном списке стран Anthropic как для Claude.ai, так и для коммерческого API. Для использования официальных сервисов потребуются зарубежное сетевое подключение или VPN, аккаунт в поддерживаемой стране и зарубежный способ оплаты.
Официальная подписка Claude стоит $20 в месяц для Pro или от $100 в месяц для Max. Она даёт доступ к интерфейсу Claude и Claude Code, но не является отдельным API‑балансом.
Если нужен именно API, сравнивать стоит маршрут подключения и итоговую цену за 1 млн токенов:
API‑маршрут |
Opus 5: ввод / вывод |
Fable 5: ввод / вывод |
Что входит в цену |
|---|---|---|---|
Anthropic API |
$5 / $25 |
$10 / $50 |
Официальный тариф |
OpenRouter |
$5,25–5,28 / $26,25–26,38 |
$10,50–10,55 / $52,50–52,75 |
Тариф Anthropic плюс 5–5,5% при покупке кредитов |
EvoLink |
$4,75 / $23,75 |
$9 / $45 |
Тариф API‑платформы |
EvoLink здесь не заменяет подписку Claude, а выступает ещё одним API‑маршрутом наряду с Anthropic API и OpenRouter, поэтому цены сравниваются в одной и той же единице.
Для OpenRouter нижняя граница рассчитана с комиссией 5% при оплате криптовалютой, верхняя — с комиссией 5,5% при оплате картой. При небольшой покупке картой действует минимальная комиссия $0,80.
Практическая схема: Opus по умолчанию, Fable при необходимости
Я бы начинал не с жёсткой миграции, а с проверяемой двухуровневой маршрутизации:
обычная сложная задача → Opus 5 → тесты и критерии приёмки пройдены? ├─ да → сохранить стоимость и принять результат └─ нет → определить причину ├─ нехватка контекста, инструментов или плохая постановка → исправить окружение └─ высокая неоднозначность, длинная автономная цепочка или дорогая повторная ошибка → эскалация в Fable 5
Fable стоит подключать не после любого неудачного ответа, а по заранее заданному условию:
задача требует пересмотреть исходные предположения.
агент должен долго работать без вмешательства.
две сопоставимые попытки Opus не прошли один и тот же критерий.
цена человеческой ошибки или повторной работы выше премии за модель.
нужен независимый финальный review самого сложного изменения.
Для каждой пары запусков нужно сохранять один и тот же prompt, контекст, инструменты, таймаут и критерии приёмки. Для Opus дополнительно фиксируется effort.
Минимальный журнал эксперимента:
Поле |
Зачем оно нужно |
|---|---|
requested model / response model |
увидеть fallback и ошибочную маршрутизацию |
input / output / cache tokens |
посчитать прямую стоимость |
effort |
сравнивать одинаковую глубину рассуждения |
latency |
отличить дешёвый ответ от приемлемого рабочего цикла |
вызовы инструментов и ошибки |
увидеть скрытые повторения |
число перезапусков |
не прятать неудачные попытки |
минуты ручной правки |
учитывать главный скрытый расход |
passed / failed |
связать расход с принятым результатом |
Через неделю такого журнала команда получит более полезный ответ, чем из ещё одного общего рейтинга.
Итог
Fable 5 не стал бесполезным после выхода Opus 5. Изменилось другое: стало сложнее оправдывать Fable как модель по умолчанию для каждой сложной задачи.
Opus 5 получил близкий к верхнему уровню профиль, более управляемый effort, умеренную заявленную задержку и вдвое меньшую официальную цену за токен. Fable сохраняет роль верхней эскалации для длинных, неоднозначных и дорогих в случае провала задач.
Но это пока только хорошая гипотеза маршрутизации.
Подтвердить её может не таблица параметров, а три числа из вашего рабочего процесса:
стоимость принятой задачи.
число повторных попыток.
минуты ручной правки.
Если воспроизводить только один тест, я бы выбрал не публичный benchmark, а самую дорогую реальную задачу, на которой текущая модель регулярно терпит неудачу.
Именно там станет видно, нужен ли Fable как эксперт по эскалации — или Opus уже изменил значение слова «по умолчанию».
Основные источники
Anthropic: релиз Opus 5 и таблица моделей.
Anthropic: цены API и тарифы Claude.
Anthropic: Fable 5 и поддерживаемые страны.