Claude Sonnet или Opus: в чём разница и что выбрать

Если коротко: Anthropic сейчас сама советует начинать с Opus, и в Claude Code на платных тарифах он стоит по умолчанию. Sonnet в API ровно вдвое дешевле и быстрее, поэтому на него разумно переключаться, когда задача понятная и повторяющаяся или когда важны скорость и бюджет. На бесплатном тарифе Opus нет вовсе, там выбор идёт между Sonnet и Haiku.
В чате на Pro обе модели входят в подписку, и расплачиваешься ты не долларами, а лимитом. Anthropic пишет, что его расход зависит в том числе от выбранной модели. Письма, тексты и разбор таблицы спокойно отдавай Sonnet, а длинный документ, запутанную задачу или разбор многих картинок отдавай Opus.
Версии я сверил с обзором моделей Anthropic 25 сентября 2026 года. На эту дату актуальны Claude Opus 5.5, Claude Sonnet 5 и Claude Haiku 4.5, а выше Opus стоит отдельная модель Claude Fable 5.1. Дальше пишу просто Opus, Sonnet, Haiku и Fable. Если к моменту чтения вышли новые версии, логику выбора можно брать отсюда, а цифры сверь с обзором моделей (opens in new tab).
Если ты выбираешь не между моделями Claude, а между Claude и ChatGPT, это отдельный разговор: он есть в статье Claude или ChatGPT.
Что выбрать: короткий ответ
- Opus подходит для длинных и запутанных задач: многочасовая разработка в большом репозитории, крупный рефакторинг, архитектура, разбор документов и скриншотов.
- Sonnet закрывает повседневную работу: код по понятному заданию, тесты, анализ данных, тексты. Он вдвое дешевле Opus в API и отвечает быстрее.
- Haiku нужен там, где важны скорость и цена: чат-боты, массовая обработка, субагенты. В текущей линейке это самая быстрая и самая дешёвая модель.
- Fable остаётся для работы на много часов, с которой не справился Opus. Она самая дорогая и самая медленная из четырёх.
Чем Opus отличается от Sonnet: цифры из документации
Здесь только то, что Anthropic публикует сама. Бенчмарки и впечатления оставляю за скобками.
- Цена в API. Opus стоит $4 за миллион входных токенов и $20 за миллион выходных, Sonnet стоит $2 и $10. Разница ровно вдвое и на входе, и на выходе.
- Кэш промптов. Чтение из кэша у обеих моделей стоит одинаково: $0.20 за миллион токенов. В длинных агентских сессиях, где большая часть входа приходит из кэша, эта часть счёта у Opus не дороже, чем у Sonnet.
- Пакетная обработка. Batch API даёт скидку 50% на вход и выход для обеих моделей.
- Контекст и длина ответа. У обеих окно контекста 1 млн токенов и до 128 тыс. токенов на выходе в обычном запросе. Anthropic оценивает объём 1 млн токенов примерно в 555 тыс. слов.
- Скорость. В сравнительной таблице Anthropic у Sonnet задержка отмечена как «Fast», у Opus как «Moderate». Секунд там нет: реальная скорость зависит от длины запроса, длины ответа и уровня усилий. Для Opus есть быстрый режим (fast mode, пока в статусе research preview): до 2,5 раза быстрее, но по $8 за миллион входных и $40 за миллион выходных токенов. Он работает в Claude Code и в API Anthropic. На подписках Pro и Max быстрый режим оплачивается только из usage credits и в лимит подписки не входит, а в API доступ к нему дают по запросу через менеджера или лист ожидания.
- Свежесть знаний. Надёжные знания Opus доходят до июня 2026 года, у Sonnet до января 2026 года.
- Рассуждения. У Opus адаптивное мышление включено всегда и не отключается, уровень усилий по умолчанию
medium. У Sonnet мышление тоже адаптивное, а уровень усилий по умолчаниюhigh.
Opus Anthropic описывает как модель для долгой агентской разработки и интеллектуальной работы, Sonnet как лучшее сочетание скорости и интеллекта. Про текущий Opus компания пишет, что на большинстве задач он работает на уровне Fable, а при оплате по токенам обходится примерно на 40% дешевле Opus 5. Сама цена за токен ниже только на 20%: $4 и $20 против $5 и $25 у Opus 5. Остальную экономию Anthropic объясняет тем, что на задачу уходит меньше токенов. Это заявление вендора, своих замеров у меня нет, и к лимитам подписки оно напрямую не относится.
Haiku и Fable: края линейки
Haiku стоит $1 за миллион входных токенов и $5 за миллион выходных, в таблице Anthropic это самая быстрая модель. Окно контекста у неё меньше, чем у старших: 200 тыс. токенов, а ответ ограничен 64 тыс. токенов. Надёжные знания Haiku заканчиваются февралём 2025 года. Anthropic предлагает Haiku для чат-ботов и службы поддержки, где важна скорость ответа, для массовой обработки и для субагентов. Если строишь продукт на Haiku через API, следи за датой вывода из эксплуатации: Anthropic обязуется не отключать текущую Haiku раньше 15 октября 2026 года, и это самая близкая дата среди актуальных моделей.
Fable стоит $10 за миллион входных токенов и $50 за миллион выходных, задержка в таблице отмечена как «Slower». Anthropic советует переходить на неё, когда Opus даже на уровнях усилий xhigh и max не вытягивает сложные рассуждения или долгую агентскую работу. На Pro Fable доступна только через дополнительные кредиты (usage credits), на Max она входит в тариф в пределах 50% недельного лимита. В Claude Code Fable ни на одном тарифе не стоит по умолчанию, её включают командой /model fable.
Что доступно на твоём тарифе
- Free: Sonnet и Haiku. Opus и Fable недоступны, Claude Code тоже.
- Pro: добавляются Opus и Claude Code, Fable подключается через usage credits.
- Max 5x и Max 20x: всё, что есть в Pro, плюс Fable в пределах половины недельного лимита.
Лимиты подписки не считаются в сообщениях. Anthropic пишет, что объём работы зависит от длины и сложности диалогов, выбранной модели и используемых функций, а чат и Claude Code расходуют один общий пул. Сколько стоят сами тарифы и какой из них брать под Claude Code, я разбирал в статье про цену Claude Code.
Claude Max за $100 я оплатил из России картой Altyn Wallet, платёж прошёл с первого раза. Ссылка партнёрская, комиссию платит сервис, на цену для тебя это не влияет. Другие способы оплаты разобраны в гайде по картам для зарубежных подписок.
Opus и Sonnet в Claude Code
По документации Claude Code, на тарифах Pro, Max, Team и Enterprise и при работе через API модель по умолчанию сейчас Opus. Так стало с версии Claude Code 2.1.280. До неё на Pro и на местах Team Standard по умолчанию стоял Sonnet 5, а на Max, Team Premium, Enterprise и в API уже был Opus, только предыдущий, Opus 5. Если в стартовой строке у тебя старая модель, обнови Claude Code командой claude update. Установки через Homebrew и WinGet сами не обновляются: для них есть brew upgrade claude-code и winget upgrade Anthropic.ClaudeCode.
Переключаться можно прямо в сессии:
/model sonnetили/model opusменяют модель сразу, а/modelбез аргумента открывает список. Клавишаsв списке переключает модель только для текущей сессии и не трогает сохранённый выбор.claude --model sonnetзапускает сессию сразу на нужной модели./model opusplanвключает связку: в режиме планирования работает Opus, а на выполнении Claude Code переключается на Sonnet./effortменяет уровень усилий. У Opus и Sonnet доступныlow,medium,high,xhighиmax.
Псевдонимы opus и sonnet указывают на рекомендованные версии и со временем обновляются сами, так что после выхода новой модели конфиг менять не придётся. Если нужна конкретная версия, укажи полное имя модели.
Субагентов можно держать на более дешёвой модели: для этого в описании субагента задаётся поле model. Если переключить основную сессию на Opus, субагенты без своего поля model тоже пойдут на Opus. Как устроены субагенты, я описывал в статье про агентов Claude Code, а готовый процесс разбивки плана на подзадачи есть в скилле Разработка через субагентов.
Какие задачи отдавать Opus, а какие Sonnet
Ниже рекомендации, а не замеры. Я опираюсь на таблицу выбора модели в документации Anthropic и на гайд Anthropic о выборе модели и уровня усилий в Claude Code (opens in new tab).
Sonnet подходит, когда задачу можно описать точно. В таблице выбора Anthropic перечисляет для него генерацию кода, анализ данных, создание контента, работу с изображениями и вызов инструментов. Гайд советует давать младшим моделям конкретные инструкции и отмечает, что старшие лучше справляются с неопределённостью.
Opus в той же таблице рекомендован для многочасовых автономных агентов, крупного рефакторинга, сложной системной инженерии, задач с большим количеством изображений и управления компьютером. Гайд советует брать старшую модель под тонкие баги, незнакомую предметную область и архитектурные решения. Сюда же я отношу всё, где сама постановка размыта.
Дорогая модель не всегда выходит дороже по итогу. На задачах, которые упираются в предел младшей модели, гайд допускает, что общая стоимость задачи у старшей окажется ниже: она доходит до результата за меньшее число шагов. На рутине картина обратная: обе модели справляются, и переход на младшую экономит деньги без потери качества.
Как понять, что пора менять модель, в том же гайде объясняют через простой тест:
- у Claude был весь нужный контекст, он честно пытался и всё равно ошибся: бери модель мощнее;
- ошибка вышла из-за того, что Claude пропустил файл, не запустил тесты или бросил рефакторинг на полпути: подними уровень усилий, модель менять не обязательно.
Но первым шагом там советуют проверить не настройки, а сам запрос: хватает ли контекста и понятно ли поставлена задача. Для этого пригодится скилл Инженер промптов.
Если работаешь через API: что сломается при переходе
У Sonnet 5 по сравнению с Sonnet 4.6 три изменения поведения:
- адаптивное мышление включено по умолчанию;
- ручное расширенное мышление (
thinking.typeenabledсbudget_tokens) теперь возвращает ошибку 400, на Sonnet 4.6 оно было только объявлено устаревшим; temperature,top_pилиtop_kсо значениями не по умолчанию тоже дают ошибку 400.
У Opus 5.5 по сравнению с Opus 5 четыре несовместимых изменения:
- мышление нельзя отключить;
- принудительный вызов инструмента (
tool_choiceс типомanyилиtool) возвращает ошибку; - блоки мышления привязаны к модели и к разговору, в котором появились;
- в Claude API и Google Cloud не принимается старый инструмент управления компьютером
computer_20251124.
Ещё одно изменение у Opus 5.5 ничего не ломает, но меняет форму ответа: текст между вызовами инструментов приходит в блоках thinking и при настройке display по умолчанию пустой. Если твоё приложение показывает этот текст пользователю как прогресс, между вызовами инструментов оно замолчит, пока ты не выставишь display.
Алиасы моделей в Claude API: claude-opus-5-5, claude-sonnet-5 и claude-haiku-4-5.
Частые вопросы
Можно ли пользоваться Opus бесплатно?
На тарифе Free Opus недоступен: в таблице тарифов Anthropic у Free в строке Opus стоит «No». Бесплатно работают Sonnet и Haiku. Opus открывается с тарифа Pro, а в API за него платишь по токенам.
Какая модель умнее, Opus или Sonnet?
Anthropic ставит Opus выше Sonnet и советует начинать с него большинство задач. В гайде Claude Code это сравнение уточняют: Opus на низком уровне усилий похож на эксперта, у которого на тебя пять минут, а Sonnet на высоком уровне похож на сильного универсала, которому дали полдня. Второй прочитает твой код внимательнее, первый принесёт опыт похожих задач. Поэтому ответ зависит от задачи и настроек.
Где скачать Claude Sonnet?
Скачать можно приложение Claude, а модель выбирается уже в нём. На странице claude.com/download (opens in new tab) есть десктопные версии для macOS и Windows, приложения для iOS и Android, а для Linux есть бета-версия под Ubuntu 22.04 и новее или Debian 12 и новее. Sonnet доступен и на бесплатном тарифе, а Free включает чат в браузере, на компьютере и в телефоне. Разработчикам Sonnet 5 доступен через API на Claude Platform, в AWS, Google Cloud и Microsoft Foundry.
Чем Sonnet 5 отличается от Sonnet 4.6?
В документации Sonnet 5 описан как прямая замена Sonnet 4.6 с тремя изменениями поведения, включая ошибку на нестандартные temperature, top_p и top_k. Он дешевле: $2 и $10 за миллион токенов против $3 и $15 у Sonnet 4.6. Но у Sonnet 5 новый токенизатор: Anthropic пишет, что на тот же текст он выдаёт примерно на 30% больше токенов, чем токенизатор Sonnet 4.6. Поэтому реальная экономия на задаче меньше, чем разница в цене за токен. Цену $2 и $10 сначала объявляли вводной, но Anthropic сделала её постоянной, и запланированного на 1 сентября 2026 года повышения до $3 и $15 не будет. Sonnet 4.6 перешла в список legacy-моделей, но в API пока доступна.




