.pt{width:100%;border-collapse:collapse;font-size:15px;margin:10px 0}
.pt th,.pt td{border-bottom:1px solid #e2e8f0;padding:7px 9px;text-align:left}
.pt th{background:#f1f5f9;font-weight:600}
.pt .num{text-align:right;white-space:nowrap}
.pt tr.best td{background:#ecfdf5;font-weight:600}
.calc{border:1px solid #e2e8f0;border-radius:10px;padding:14px;margin:14px 0}
.calc .fields{display:flex;flex-wrap:wrap;gap:12px}
.calc label{display:flex;flex-direction:column;font-size:13px;color:#475569;gap:4px}
.calc input,.calc select{padding:7px 9px;border:1px solid #cbd5e1;border-radius:8px;font-size:15px;min-width:130px}
.embed{background:#0f172a;color:#e2e8f0;padding:12px;border-radius:8px;overflow:auto;font-size:13px}
Сколько на самом деле стоит работа с языковыми моделями — вопрос не про цену модели,
а про объём токенов. Мы собрали базовые тарифы OpenAI, Anthropic и Google в одну таблицу
и добавили калькулятор: подставьте свой месячный объём и увидите реальный счёт в долларах
и рублях. Данные сверены с официальными страницами вендоров 31 июля 2026.
Калькулятор месячной стоимости
Укажите, сколько миллионов токенов в месяц вы отправляете модели (вход) и сколько она
генерирует в ответ (выход). Строка с самой выгодной ценой подсвечивается.
Полная таблица тарифов
Цены указаны в долларах за миллион токенов. Это базовые тарифы: кеширование промпта,
пакетная обработка и длинный контекст тарифицируются отдельно.
| Вендор | Модель | Вход, $/1M | Выход, $/1M | Примечание |
|---|---|---|---|---|
| Anthropic | Claude Haiku 4.5 | 1.00 | 5.00 | быстрая |
| Anthropic | Claude Sonnet 5 | 2.00 | 10.00 | вводная цена до 31.08.2026, далее 3 и 15 |
| Anthropic | Claude Sonnet 4.6 | 3.00 | 15.00 | |
| Anthropic | Claude Opus 5 | 5.00 | 25.00 | |
| Anthropic | Claude Fable 5 | 10.00 | 50.00 | флагман |
| Gemini 2.5 Flash-Lite | 0.10 | 0.40 | самая дешёвая в подборке | |
| Gemini 3.1 Flash-Lite | 0.25 | 1.50 | ||
| Gemini 3.5 Flash-Lite | 0.30 | 2.50 | ||
| Gemini 2.5 Flash | 0.30 | 2.50 | ||
| Gemini 3.6 Flash | 1.50 | 7.50 | ||
| Gemini 3.5 Flash | 1.50 | 9.00 | ||
| OpenAI | gpt-5-nano | 0.05 | 0.40 | самая дешёвая у OpenAI |
| OpenAI | gpt-4o-mini | 0.15 | 0.60 | рабочая лошадка |
| OpenAI | gpt-5.6-luna | 0.20 | 1.20 | дешёвая |
| OpenAI | gpt-5.4-nano | 0.20 | 1.25 | |
| OpenAI | gpt-5-mini | 0.25 | 2.00 | |
| OpenAI | gpt-4.1-mini | 0.40 | 1.60 | |
| OpenAI | gpt-5.4-mini | 0.75 | 4.50 | |
| OpenAI | o4-mini | 1.10 | 4.40 | рассуждающая |
| OpenAI | gpt-5 | 1.25 | 10.00 | |
| OpenAI | gpt-5.6-terra | 2.00 | 12.00 | |
| OpenAI | gpt-4.1 | 2.00 | 8.00 | |
| OpenAI | o3 | 2.00 | 8.00 | рассуждающая |
| OpenAI | gpt-5.4 | 2.50 | 15.00 | |
| OpenAI | gpt-4o | 2.50 | 10.00 | |
| OpenAI | gpt-5.6-sol | 5.00 | 30.00 | флагман |
Источники: OpenAI · Anthropic · Google. Сверка: 31 июля 2026.
Как читать эти цифры
Разброс между самой дешёвой и самой дорогой моделью в таблице — более чем стократный.
На практике это означает, что выбор модели под задачу экономит больше, чем любые
оптимизации промпта. Массовые однотипные операции (классификация, извлечение полей,
короткие ответы) закрываются моделями уровня nano, mini и flash. Дорогие флагманы
оправданы там, где нужна длинная цепочка рассуждений или работа с большим контекстом.
Второй ориентир — соотношение входа и выхода. Если вы отправляете большие документы,
но просите короткое резюме, основной счёт формирует вход, и выгодны модели с дешёвым
входным токеном. Если наоборот, генерируете длинные тексты, смотрите прежде всего на
цену выходных токенов.
Встроить калькулятор на свой сайт
Виджет бесплатный, работает автономно и не требует подключения библиотек.
Скопируйте код и вставьте в любое место страницы:
<iframe src="https://ai.chatgptinbusiness.ru/widget/ai-prices.html" width="100%" height="520" style="border:1px solid #e2e8f0;border-radius:10px" loading="lazy" title="Калькулятор стоимости API нейросетей"></iframe>
Мы обновляем таблицу при изменении официальных тарифов, встроенный виджет
подхватывает актуальные цифры автоматически.
Частые вопросы
Что такое цена за 1 миллион токенов?
Токен — это кусочек текста, примерно 0,75 слова для английского и меньше для русского. Вендоры берут плату отдельно за входные токены (то, что вы отправляете модели) и за выходные (то, что она генерирует). Выходные почти всегда дороже входных в 4–5 раз.
Почему выходные токены дороже входных?
Генерация ответа требует последовательного прохода по модели на каждый новый токен, тогда как входной запрос обрабатывается параллельно. Поэтому при планировании бюджета важнее оценивать не объём запросов, а длину ответов.
Как сократить расходы на API?
Три рабочих приёма: брать модель по задаче (для простых операций хватает mini/nano/flash), включать кеширование одинаковых частей промпта, отправлять некритичные задачи пакетно — у ряда вендоров пакетная обработка дешевле примерно вдвое.
Цены в таблице окончательные?
Это базовые тарифы на 31 июля 2026 по официальным страницам вендоров. Отдельно могут тарифицироваться кеширование, пакетная обработка, длинный контекст, поиск и работа с изображениями. Перед запуском проекта сверяйтесь с официальным прайсом.