Коротко
Для большинства задач через API разумный выбор по умолчанию — Claude Sonnet 5.5: на 2026-10-10 он стоит в APIVAI $0.77 / $3.82 за миллион входных / выходных токенов против $2.00 / $10.00 по официальному прайсу Anthropic. Для долгой агентной разработки и сложных рассуждений берите Claude Opus 5.5 ($1.54 / $7.65), а для массовой классификации, извлечения данных и маршрутизации — Claude Haiku 4.5 ($0.38 / $1.92); Claude Fable 5.1 — самый мощный и самый дорогой уровень Claude, он оправдан, только когда Opus не справляется. Из моделей OpenAI GPT-6.1 Sol ($0.30 / $1.52) — вариант средней цены, а GPT-6 Luna ($0.0144 / $0.0768) — самая дешёвая модель в списке. Один ключ APIVAI работает со всеми ними, поэтому модель можно выбирать под задачу, а не привязываться к одной.
Чем отличаются Haiku, Sonnet, Opus и Fable?
Anthropic продаёт Claude в четырёх уровнях. Описания ниже взяты из обзора моделей Anthropic и её руководства по выбору модели:
- Haiku: для массовых задач, чувствительных к задержке, — классификации, извлечения данных, маршрутизации. Самый быстрый и дешёвый уровень; хорошо работает и как субагент, выполняющий рутинные шаги за более крупную модель.
- Sonnet: по словам Anthropic, лучшее сочетание скорости и интеллекта. Подходит для повседневной генерации кода, анализа данных, создания текстов и агентной работы с инструментами.
- Opus: для долгой агентной разработки и интеллектуальной работы — многочасовых агентов-программистов и крупных рефакторингов. Медленнее Sonnet. Если вы не уверены, документация Anthropic советует начинать с Claude Opus 5.5.
- Fable: для сложных рассуждений и агентной работы на длинной дистанции — сессий агента на несколько часов и многошаговых исследований. Самый медленный и самый дорогой уровень.
У Claude Sonnet 5.5, Claude Opus 5.5 и Claude Fable 5.1 контекстное окно 1M токенов и до 128K выходных токенов; у Claude Haiku 4.5 контекстное окно 200K. В APIVAI режим размышлений включён по умолчанию, а токены размышлений оплачиваются как выходные, поэтому даже короткий видимый ответ может расходовать заметное количество выходных токенов. Если ответы приходят пустыми или обрезанными, увеличьте max_tokens до 4096 или больше.
Как с ними соотносятся модели GPT?
На актуальной странице моделей OpenAI три уровня: Astra («наша самая мощная модель для самых требовательных задач»), Sol (GPT-6.1 Sol, «производительность почти как у Astra для сложной работы по более низкой цене») и Luna (GPT-6 Luna, «наша самая эффективная модель для узких массовых задач»). По официальной цене Astra стоит рядом с Fable, Sol — рядом с Sonnet, а Luna — ниже Haiku.
В APIVAI доступны и более ранние релизы GPT: GPT-6 Sol, GPT-5.6 Sol, GPT-5.6 Terra, GPT-5.6 Luna и GPT-5.5. На актуальной странице моделей OpenAI они не описаны, поэтому здесь они сравниваются только по цене и контексту. Одно практическое отличие: модели Claude в APIVAI работают и в формате Anthropic, и в формате OpenAI, а модели GPT — в формате OpenAI (/v1/chat/completions или /v1/responses).
Сколько стоит каждая модель за миллион токенов?
Цены за миллион токенов на 2026-10-10. На странице цен есть все модели, а в списке моделей у каждой своя страница.
| Модель | APIVAI вход / выход | Официально вход / выход | APIVAI чтение кэша | Контекст |
|---|---|---|---|---|
| Claude Fable 5.1 | $4.42 / $22.08 | $10.00 / $50.00 | $0.11 | 1M |
| Claude Opus 5.5 | $1.54 / $7.65 | $4.00 / $20.00 | $0.0768 | 1M |
| Claude Sonnet 5.5 | $0.77 / $3.82 | $2.00 / $10.00 | $0.0384 | 1M |
| Claude Sonnet 4.6 | $1.15 / $5.74 | $3.00 / $15.00 | $0.12 | 1M |
| Claude Haiku 4.5 | $0.38 / $1.92 | $1.00 / $5.00 | $0.0384 | 200K |
| GPT-6 Astra | $1.52 / $7.60 | $10.00 / $50.00 | $0.15 | 1M |
| GPT-6.1 Sol | $0.30 / $1.52 | $2.00 / $10.00 | $0.0144 | 1M |
| GPT-6 Sol | $0.30 / $1.52 | $2.00 / $10.00 | $0.0304 | 1M |
| GPT-5.5 | $0.77 / $4.56 | $5.00 / $30.00 | $0.0768 | 1M |
| GPT-6 Luna | $0.0144 / $0.0768 | $0.10 / $0.50 | $0.0016 | 1M |
У каждой модели выходные токены в несколько раз дороже входных, поэтому счёт сильнее растёт от длинных ответов и долгих размышлений, чем от длинных промптов. Чтение из кэша стоит малую долю обычного входа — поэтому кэширование так важно для агентов (пример 1 ниже). В сравнении цен Claude API перечислены все версии Claude, включая цены записи в кэш.
Почему несколько моделей Opus стоят одинаково?
Claude Opus 5, Claude Opus 4.8, Claude Opus 4.7 и Claude Opus 4.6 имеют одну цену: $1.92 / $9.57 в APIVAI ($5.00 / $25.00 официально). Самая новая, Claude Opus 5.5, даже дешевле — $1.54 / $7.65. С Sonnet то же самое: Claude Sonnet 5.5 стоит меньше, чем Claude Sonnet 4.6, а у Claude Sonnet 5 та же цена входа и выхода, что у Sonnet 5.5, но чтение кэша дороже. Claude Fable 5 и Claude Fable 5.1 стоят одинаково за вход и выход, но у 5.1 чтение кэша дешевле.
При равной или более низкой цене новая модель обычно лучший выбор. Оставайтесь на старой версии, только если ваши промпты настроены под неё и ваши собственные тесты показывают, что она работает лучше, или если инструмент жёстко задаёт конкретный ID. Anthropic указывает несколько несовместимых изменений в Opus 5.5 (например, принудительный вызов инструментов и отключение размышлений), так что перед переводом рабочей интеграции проведите тесты. У каждой старой модели есть своя страница: Opus 5, Opus 4.8, Opus 4.7, Opus 4.6, Sonnet 5, Fable 5.
Сколько стоит сессия агента-программиста с кэшированием?
Допущения: двухчасовая сессия в агенте вроде Claude Code или Cline делает 40 запросов. Каждый запрос повторно отправляет около 25 000 токенов контекста (системный промпт, описания инструментов, открытые файлы, предыдущие шаги), которые читаются из кэша, — всего 1 000 000 кэшированных токенов за сессию. Сверх этого отправляется 60 000 новых входных токенов (новые файлы, результаты инструментов) и приходит 30 000 выходных токенов с учётом размышлений.
| Модель | Чтение кэша (1M токенов) | Новый вход + выход | Та же сессия без кэша (APIVAI) | Без кэша (официально) |
|---|---|---|---|---|
| Claude Sonnet 5.5 | $0.0384 | $0.161 | $0.931 | $2.42 |
| Claude Sonnet 4.6 | $0.12 | $0.241 | $1.39 | $3.63 |
| Claude Opus 5.5 | $0.0768 | $0.322 | $1.86 | $4.84 |
| Claude Fable 5.1 | $0.11 | $0.928 | $5.35 | $12.10 |
| GPT-6.1 Sol | $0.0144 | $0.0636 | $0.364 | $2.42 |
С кэшированием сессия стоит сумму первых двух столбцов с ценами. Третий и четвёртый показывают, сколько стоили бы те же токены совсем без кэша. Запись в кэш у Claude немного дороже обычного входа ($0.96 против $0.77 за миллион у Sonnet 5.5), поэтому реальный итог чуть выше суммы. Кэш срабатывает, только если инструмент повторно отправляет одинаковый префикс; большинство агентов-программистов так и делают. Как перевести цену сессии в месячный бюджет и сравнить её с редакторами по подписке, смотрите в статье Claude Code и Cursor: сравнение расходов.
Сколько стоит чат-бот на 1 000 диалогов в день?
Допущения: бот поддержки ведёт 1 000 диалогов в день, 30 дней в месяц. Диалог в среднем — 2 500 входных токенов (инструкции, несколько фрагментов базы знаний, история) и 350 выходных токенов с учётом размышлений.
| Модель | В день (APIVAI) | В месяц (APIVAI) | В месяц (официально) |
|---|---|---|---|
| GPT-6 Luna | $0.0629 | $1.89 | $12.75 |
| Claude Haiku 4.5 | $1.62 | $48.66 | $128 |
| GPT-6.1 Sol | $1.28 | $38.46 | $255 |
| Claude Sonnet 5.5 | $3.26 | $97.86 | $255 |
Для типовых вопросов обычно хватает модели класса Haiku или Luna, и многие команды отправляют в Sonnet только сложные обращения. Кэширование постоянных инструкций снижает эти суммы ещё сильнее.
Сколько стоит реферирование 2 000 документов?
Допущения: разовая задача превращает 2 000 отчётов примерно по 15 000 токенов в рефераты по 800 токенов. Здесь преобладает вход, поэтому важнее всего цена входных токенов.
| Модель | Итого (APIVAI) | Итого (официально) |
|---|---|---|
| GPT-6 Luna | $0.555 | $3.80 |
| Claude Haiku 4.5 | $14.47 | $38.00 |
| GPT-6.1 Sol | $11.43 | $76.00 |
| Claude Sonnet 5.5 | $29.21 | $76.00 |
| Claude Opus 5.5 | $58.44 | $152 |
Прежде чем запускать весь пакет, прогоните выборку из 20 документов на двух-трёх моделях и сравните рефераты: правильная модель — самая дешёвая из тех, что проходят вашу проверку. APIVAI выполняет такие задания обычными запросами и не предоставляет Batch API. Собственный Batch API Anthropic тарифицируется ниже стандартных ставок для задач, которые могут подождать, поэтому для очень больших офлайн-задач сравните и эту цену.
Какую модель выбрать для каждой задачи?
| Задача | С чего начать | Повысить или понизить |
|---|---|---|
| Повседневная разработка в агенте или IDE | Claude Sonnet 5.5 | Claude Opus 5.5 для крупных рефакторингов и долгих автономных запусков |
| Самые сложные рассуждения, многочасовая работа агента | Claude Opus 5.5 | Claude Fable 5.1 или GPT-6 Astra, если Opus не справляется |
| Тексты и контент | Claude Sonnet 5.5 или GPT-6.1 Sol | Claude Opus 5.5 для длинных структурированных материалов |
Полезная привычка — проверять свои промпты на двух соседних уровнях. Если дешёвая модель справляется, оставьте её; если ей нужно много повторных попыток, более сильная модель часто выходит дешевле в итоге. Берите ID моделей из GET /v1/models или со страницы цен, а не копируйте старые названия: список со временем меняется.
Частые вопросы
Opus лучше Sonnet для программирования?
Для долгих автономных запусков, крупных рефакторингов и сложной отладки Opus — более сильный уровень. Для повседневных правок и коротких задач агента обычно хватает Sonnet: $0.77 / $3.82 против $1.54 / $7.65 у Opus, поэтому многие разработчики по умолчанию используют Sonnet и переключаются на Opus под конкретную задачу.
Когда вместо Sonnet достаточно Haiku?
Haiku рассчитана на массовые простые задачи: классификацию, извлечение данных, маршрутизацию, короткие ответы поддержки и шаги субагентов. Если нужны многошаговые рассуждения или аккуратный код, протестируйте Sonnet.
Что дешевле через API — Claude или GPT?
Зависит от уровня. На 2026-10-10 в APIVAI GPT-6 Luna стоит $0.0144 / $0.0768 против $0.38 / $1.92 у Claude Haiku 4.5, а GPT-6.1 Sol — $0.30 / $1.52 против $0.77 / $3.82 у Claude Sonnet 5.5. Сравнивайте качество на своих промптах, а не только цену.
Токены размышлений стоят дополнительно?
Они оплачиваются как выходные токены по обычной цене выхода модели. В APIVAI размышления включены по умолчанию, поэтому закладывайте в бюджет выходные токены сверх видимого ответа.
Можно ли пользоваться несколькими моделями с одним ключом?
Да. Один ключ APIVAI работает со всеми моделями Claude и GPT; в каждом запросе меняется только ID модели.
Создайте аккаунт, пополните баланс от $10 и попробуйте каждую модель с одним ключом.