Анталья --:-- Обсудить проект
← Журнал Креативные технологии 06.10.2026 5 мин чтения

Три модели, один вопрос: Fable 5.1, Opus 5.5 или Sonnet 5.5 — что для чего?

В сентябре Anthropic выпустила три модели: Fable 5.1, Opus 5.5 и Sonnet 5.5. Возможности, цены, результаты тестов и какую модель разумно давать для какой задачи в продакшн-агентстве.

Логотип Claude компании Anthropic
Логотип Claude — товарный знак Anthropic

Anthropic уместила в сентябрь три модели. Fable 5.1 заняла вершину семейства. 22 сентября вышла Opus 5.5, а через шесть дней, 28 сентября, — Sonnet 5.5.

На бумаге знакомый порядок: самая сильная, средняя, быстрая. Но самое интересное в этой тройке — насколько сократился разрыв между ними.

Все цифры ниже взяты из официальных анонсов Anthropic. С появлением независимых измерений детали могут сдвинуться; направление, похоже, не изменится.

Fable 5.1: модель на вершине

Fable 5.1 — самая мощная из общедоступных моделей Anthropic. Любопытная деталь: это та же модель, что и Mythos 5.1, отличаются только защитные ограничения. Mythos 5.1 не общедоступна: её получают проверенные организации в сфере кибербезопасности и наук о жизни через программы доверенного доступа.

Главное:

  • Цена: 10 долларов за миллион входных токенов, 50 долларов за миллион выходных. Чтение из кэша подешевело до 0,25 доллара. По данным Anthropic, общая стоимость типичной работы снижается примерно на 25 процентов, а работы с агентами — до 45 процентов.
  • Рывок в агентной работе: в Terminal-Bench 4.0, который измеряет программирование в роли агента, результат вырос с 42,0 до 55,8 процента. В Terminal-Bench-Science, измеряющем научную работу в терминале, он почти удвоился: с 24,7 до 52,6 процента.
  • Кибербезопасность: защитные фильтры теперь на 60 процентов реже ошибочно блокируют легитимную работу. Fable 5.1 можно использовать для поиска уязвимостей в программах, но атакующий код для них она не разрабатывает.
  • Наука: в анонсе есть примеры от дизайна белков до карты высот Венеры. Далеко от моей работы, но показывает, куда движется модель.

Opus 5.5: уровень Fable, цена ниже

Opus 5.5 — первая модель нового семейства Claude 5.5. Заявление Anthropic однозначно: в большинстве задач на уровне Fable 5.1, работает на 40 процентов дешевле Opus 5 и выдаёт результат более чем на 30 процентов быстрее.

Токены стоят 4 доллара за миллион входных и 20 долларов за миллион выходных. Когда я писал об Opus 5, эти цифры были 5 и 25 долларов. Цена за токен снизилась на 20 процентов; по данным Anthropic, общая стоимость работы ниже на 40 процентов.

Есть и быстрый режим: до 2,5 раза быстрее за двойную цену (8 долларов за вход, 40 — за выход).

В таблице Anthropic Opus 5.5 обходит Fable 5.1 в нескольких тестах:

  • Terminal-Bench 4.0 (программирование в роли агента): Opus 5.5 — 66,4 процента, Fable 5.1 — 55,8 процента.
  • OSWorld 2.1 (работа с компьютером): 81,8 против 80,7 процента.
  • Humanity's Last Exam (сложные рассуждения): 67,7 против 65,6 процента.
  • AutomationBench (автоматизация бизнес-задач): 40,0 против 31,4 процента.

В вопросах безопасности тоже серьёзные заявки. Перед выпуском модель проверили внешние эксперты, в том числе METR, и она показала лучший на сегодня результат в автоматическом поведенческом аудите Anthropic. Склонность обходить ограничения на 85 процентов ниже, чем у Opus 5 и Mythos 5.1.

Sonnet 5.5: новая рабочая лошадка для повседневных задач

Sonnet 5.5 стоит столько же, сколько Sonnet 5: 2 доллара за миллион входных токенов, 10 — за миллион выходных. Но работает более чем на 30 процентов быстрее, а общая стоимость большинства задач, по данным Anthropic, снижается до 30 процентов.

По-настоящему удивляет, насколько близко она подошла к Opus 5.5:

  • Terminal-Bench 4.0: с результатом 70,6 процента Sonnet 5.5 в этом тесте обходит даже Opus 5.5 (66,4 процента).
  • OSWorld 2.1: 80,1 процента против 81,8 у Opus 5.5.
  • GDPval-AA (задачи интеллектуального труда): 1844 против 1846 баллов. Практически одинаково.
  • Humanity's Last Exam: 64,5 против 67,7 процента. В сложных рассуждениях Opus всё ещё впереди.

Anthropic говорит, что Sonnet 5.5 пишет яснее и сильна в повседневных задачах с понятными рамками (исправление ошибок, документы, презентации, таблицы). И забавная деталь: это первая Sonnet, прошедшая Pokémon Red только по скриншотам.

Как читать эти цифры

У меня три оговорки.

Цифры — от производителя. Все они из таблиц самой Anthropic. Независимые измерения могут оказаться осторожнее.

Версии тестов разные. Анонсы Fable 5.1 и Opus 5.5 используют разные версии некоторых тестов. Сопоставлять цифры из разных анонсов было бы некорректно; каждое сравнение я брал внутри одной таблицы.

Тест — это не работа. 70 процентов в тесте не означают 70 процентов точности в вашем проекте. Эти цифры показывают направление, а не дают гарантию.

Что для чего в продакшн-агентстве

В моей работе ИИ ускоряет то, что происходит до и после съёмки: коммерческие предложения и описания объёма работ, планы съёмок, пятиязычный контент сайта, мою собственную программную инфраструктуру. Площадки, решения и взгляда он не касается. Эта тройка не меняет картину; она меняет то, какую задачу я отдаю какой модели.

  • Sonnet 5.5: повседневные задачи с понятными рамками. Планы съёмок, call sheet, черновики предложений, каркас презентации. Быстро и дёшево — и уже не на уровне «сойдёт».
  • Opus 5.5: длинные и сложные задачи. Инфраструктура сайта, многошаговая работа с контентом, агентные задачи на несколько часов. Получить уровень Fable за такую цену год назад было немыслимо.
  • Fable 5.1: самые сложные проблемы. В моей работе — редкость. Верхняя полка на случай, когда что-то действительно застряло.

По умолчанию у меня была бы Opus 5.5; где важна скорость, я спускаюсь до Sonnet 5.5, а Fable 5.1 открываю, когда это действительно нужно.

Главная новость: кривая «цена — качество» сломалась

Главная история месяца — не отдельные модели. Пиковая производительность предыдущего поколения переходит к модели уровнем ниже и по более низкой цене. Opus 5.5 вышла на уровень Fable, Sonnet 5.5 — почти на уровень Opus. В том же месяце то же самое произошло и у GPT-6 Astra и GPT-6.1 Sol, о которых я писал днём раньше.

Для небольшого и загруженного агентства вроде моего это значит: работа, от которой год назад я отказывался из-за стоимости, теперь окупается. Многоязычный контент, разметка архива, долгие технические задачи. Сильная модель — больше не роскошь, а повседневный инструмент.

Но скажу ещё раз: чем сильнее модель, тем убедительнее выглядит её результат. Выглядеть убедительно — не то же самое, что быть правым. Проверять цифру, фразу, код — моя работа, и эта работа не передаётся.

Обыденное спрашивает о самой сильной модели. Бунтарское знает, какую задачу какой модели отдать.

ClaudeAnthropicFable 5.1Opus 5.5Sonnet 5.5Искусственный интеллектКреативные технологии
Çağlar Doğan

Çağlar DoğanКреативный директор, фэшн- и рекламный фотограф и режиссёр из Антальи. Не флиртует со светом, а выстраивает его.