Чат и LLM
Цены на API GPT, Claude, Gemini и DeepSeek — сравнение LLM
Сколько стоит API GPT, Claude, Gemini, DeepSeek, Grok и Kimi: цены за 1 млн токенов, расчёт месячных затрат на примерах и способы снизить счёт.
На вопрос «сколько стоит Claude API» нет одного ответа, потому что платите вы не за запрос. API языковых моделей тарифицирует токены, причём по двум-трём разным ставкам в зависимости от того, в какую сторону они идут. Один и тот же чат-бот может обходиться в $2 в месяц на одной модели и в $60 на другой, а расклад между двумя моделями способен поменяться, как только вы включите кэширование промпта.
В этом гайде собраны текущие цены на все текстовые модели каталога API Hubs — GPT, Claude, Gemini, DeepSeek, Grok, Kimi и ещё несколько — и разобраны три типичные нагрузки, чтобы было видно, во что цена за токен превращается в месячном счёте. Он для разработчиков, которые выбирают модель под продукт, и для всех, кто искал «Gemini API цена» и находил таблицу без единого расчёта.
За что вы на самом деле платите
Все цены ниже указаны за 1 млн токенов в долларах США. Токен — это фрагмент слова; страница текста занимает несколько сотен токенов. Важны три ставки:
- Входные токены — всё, что вы отправляете: системный промпт, историю диалога, найденные документы и сообщение пользователя. Поскольку история пересылается целиком на каждом шаге, в чат-сценариях обычно доминирует именно вход.
- Выходные токены — всё, что пишет модель. Это всегда более дорогое направление: в нашем каталоге выход стоит в 2–6 раз дороже входа той же модели.
- Кэшированные входные токены — часть промпта, которую провайдер уже видел и сохранил. Если у модели есть кэш-тариф, такой токен стоит небольшую долю обычной цены входа, как правило десятую. У некоторых моделей есть и отдельная ставка записи в кэш — она списывается один раз, когда префикс сохраняется впервые.
Итоговый счёт за месяц считается просто:
вход × цена входа + выход × цена выхода + кэш × цена кэша + запись в кэш × цена записи, делённое на
миллион. Весь остальной гайд — эта формула с реальными цифрами.
Цены на LLM API: сводная таблица
Цены каталога на 24 сентября 2026 года, доллары за 1 млн токенов, отсортированы по цене входа. Значения, которые в каталоге указаны с большей точностью, округлены до цента. Актуальная таблица есть на странице каждой модели, а все модели сразу — на странице цен.
| Модель | Семейство | Вход | Выход | Кэш (чтение) |
|---|---|---|---|---|
| DeepSeek V4 Flash | DeepSeek | $0.168 | $0.336 | — |
| GPT 5.6 Luna | GPT | $0.18 | $1.08 | $0.018 |
| Claude Sonnet 5 | Claude | $0.30 | $1.50 | $0.03 |
| Qwen3.7 Plus | Qwen | $0.34 | $1.37 | $0.034 |
| MiniMax M3 | MiniMax | $0.36 | $1.44 | $0.036 |
| DeepSeek V4 Pro | DeepSeek | $0.522 | $1.044 | — |
| GPT 5.6 Terra | GPT | $0.80 | $4.80 | $0.08 |
| Gemini 3.6 Flash | Gemini | $0.90 | $4.50 | $0.09 |
| Gemini 3.7 Flash | Gemini | $0.90 | $4.50 | $0.09 |
| Gemini 3.5 Flash | Gemini | $0.90 | $5.40 | $0.09 |
| GLM 5.2 | GLM | $0.98 | $3.43 | $0.098 |
| Kimi K2.7 Code | Kimi | $1.11 | $4.62 | $0.111 |
| GPT 5.5 | GPT | $1.50 | $9.00 | $0.15 |
| Claude Fable 5 | Claude | $1.50 | $7.50 | $0.15 |
| Gemini 3.5 Flash (High) | Gemini | $1.62 | $9.72 | $0.162 |
| GLM 5.3 | GLM | $1.68 | $5.28 | $0.312 |
| Grok 4.5 | Grok | $2.10 | $6.30 | $0.525 |
| Grok 4.6 | Grok | $2.10 | $6.30 | $0.525 |
| GPT 5.6 Sol | GPT | $3.00 | $18.00 | $0.30 |
| Claude Opus 5 | Claude | $3.00 | $15.00 | $0.30 |
| Kimi K3 | Kimi | $3.15 | $15.75 | $0.315 |
| GPT 6 Astra | GPT | $8.00 | $40.00 | $0.80 |
Прочерк означает, что в каталоге у модели нет тарифа на кэшированный вход, и все входные токены оплачиваются по полной цене. Это цены API Hubs, они не совпадают с прямыми тарифами самих разработчиков моделей.
Какую линейку выбрать
Таблица цен ранжирует модели по стоимости, а не по пригодности для задачи. Ниже — только то, что следует из самих цифр; какая модель лучше справится именно с вашими промптами, стоит проверить на них же.
GPT — самый широкий ценовой диапазон в каталоге: вход у GPT 6 Astra дороже, чем у GPT 5.6 Luna, более чем в сорок раз. Luna за $0,18 на входе и $1,08 на выходе описана в каталоге как модель для больших объёмов — чатов, классификации и простых агентных шагов. Terra дешевле GPT 5.5 и на входе, и на выходе, так что для новой интеграции это более выгодный вариант среднего уровня. Выход у моделей 5.5 и 5.6 стоит в 6 раз дороже входа, у Astra — в 5, поэтому короткие ответы на GPT экономят особенно много. Кэшированный вход во всей линейке — десятая часть цены входа.
Claude — три модели, и Claude Sonnet 5 среди них заметно дешевле остальных: $0,30 за вход и $1,50 за выход. Claude Opus 5 ровно в десять раз дороже по обеим ставкам, поэтому маршрутизацию — Sonnet по умолчанию, Opus для сложных случаев — имеет смысл закладывать сразу. Claude Fable 5, настроенная на длинные тексты, стоит посередине: $1,50 / $7,50. У всех трёх выход в 5 раз дороже входа, чтение из кэша стоит десятую часть входа, а запись в кэш — 1,25 цены входа. Sonnet и Opus доступны и через OpenAI-совместимый, и через Anthropic-совместимый эндпоинт; Fable работает через Anthropic-совместимый Messages API.
Gemini держит цену входа одинаковой: у всех моделей Flash это $0,90 за миллион входных токенов. Разница — в выходе: 3.6 Flash и 3.7 Flash берут $4,50, 3.5 Flash — $5,40. Вариант High закрепляет за 3.5 Flash большой бюджет на рассуждения и по всем ставкам стоит в 1,8 раза дороже обычной 3.5 Flash. Если выбирать между версиями Gemini только по цене, 3.6 и 3.7 Flash одинаковы. Кэшированный вход — десятая часть цены входа.
DeepSeek — самые дешёвые токены в каталоге. DeepSeek V4 Flash стоит $0,168 за вход и $0,336 за выход, и выход у неё дороже входа всего в 2 раза — это минимальный разрыв среди всех моделей, поэтому она остаётся дешёвой даже при длинных ответах. V4 Pro примерно втрое дороже, но её выход за $1,044 всё равно дешевле, чем у GPT 5.6 Luna. Подвох — в кэшировании: в каталоге нет кэш-тарифа ни для одной модели DeepSeek, и для сценариев с большим повторяющимся промптом это важно (см. второй пример ниже).
Grok: Grok 4.5 и Grok 4.6 стоят одинаково — $2,10 / $6,30, так что оставаться на 4.5 ради экономии смысла нет. Выход всего втрое дороже входа, зато скидка на кэш меньше, чем у других: кэшированный токен стоит четверть цены входа ($0,525), а не десятую часть. Для обеих моделей указан контекст 500K токенов.
Kimi — флагман и модель для кода. Kimi K3 по цене близка к Claude Opus 5 ($3,15 / $15,75). Kimi K2.7 Code, рассчитанная на правки в масштабе целого репозитория, стоит примерно втрое меньше, а запись в кэш у неё тарифицируется так же дёшево, как чтение ($0,111), — сохранять в кэше большой контекст репозитория не накладно.
Остальные модели каталога закрывают промежуток между DeepSeek и средним сегментом: Qwen3.7 Plus и MiniMax M3 стоят около $0,35 за вход и $1,40 за выход, а GLM 5.2 и GLM 5.3 — $0,98–1,68 за вход и $3,43–5,28 за выход.
Расчёт стоимости на примерах
Три нагрузки по ценам каталога из таблицы выше. В итогах учтена только оплата токенов.
1. Бот поддержки
5000 диалогов в месяц, в каждом около 2000 входных токенов (системный промпт, история, сообщение клиента) и около 400 токенов ответа. Итого 10 млн входных + 2 млн выходных токенов.
Для Claude Sonnet 5 расчёт такой: 10 × $0.30 + 2 × $1.50 = $3.00 + $3.00.
| Модель | Вход | Выход | В месяц |
|---|---|---|---|
| DeepSeek V4 Flash | $1.68 | $0.67 | $2.35 |
| GPT 5.6 Luna | $1.80 | $2.16 | $3.96 |
| Claude Sonnet 5 | $3.00 | $3.00 | $6.00 |
| DeepSeek V4 Pro | $5.22 | $2.09 | $7.31 |
| GPT 5.6 Terra | $8.00 | $9.60 | $17.60 |
| Gemini 3.7 Flash | $9.00 | $9.00 | $18.00 |
| Grok 4.6 | $21.00 | $12.60 | $33.60 |
| Claude Opus 5 | $30.00 | $30.00 | $60.00 |
Даже при пяти входных токенах на один выходной у GPT, Claude и Gemini на выход приходится половина счёта или больше. У DeepSeek V4 Flash самые низкие ставки в обе стороны, поэтому она уверенно впереди.
2. Ассистент с большим постоянным промптом
Ассистент по продукту отвечает на 10 000 вопросов в месяц. Каждый запрос начинается с одного и того же блока на 1600 токенов — инструкции и справочные материалы, — за ним идут около 400 токенов вопроса и истории, а ответ занимает 100 токенов. С включённым кэшированием промпта это 16 млн кэшированных + 4 млн обычных входных + 1 млн выходных токенов.
Для Claude Sonnet 5: 16 × $0.03 + 4 × $0.30 + 1 × $1.50 = $0.48 + $1.20 + $1.50.
| Модель | Кэш | Обычный вход | Выход | С кэшем | Без кэша |
|---|---|---|---|---|---|
| GPT 5.6 Luna | $0.29 | $0.72 | $1.08 | $2.09 | $4.68 |
| Claude Sonnet 5 | $0.48 | $1.20 | $1.50 | $3.18 | $7.50 |
| DeepSeek V4 Flash | — | $3.36 | $0.34 | $3.70 | $3.70 |
| GPT 5.6 Terra | $1.28 | $3.20 | $4.80 | $9.28 | $20.80 |
| Gemini 3.7 Flash | $1.44 | $3.60 | $4.50 | $9.54 | $22.50 |
| Grok 4.6 | $8.40 | $8.40 | $6.30 | $23.10 | $48.30 |
| Claude Opus 5 | $4.80 | $12.00 | $15.00 | $31.80 | $75.00 |
Здесь расклад меняется. Без кэша самой дешёвой была бы DeepSeek V4 Flash, но с кэшем её обходят и GPT 5.6 Luna, и Claude Sonnet 5: DeepSeek оплачивает все 20 млн входных токенов по полной ставке. У моделей GPT, Claude и Gemini кэширование сокращает счёт на 55–58%, у Grok — примерно на 52%, потому что кэшированный токен там стоит четверть цены, а не десятую часть. Разовая плата за запись в кэш у моделей, где она есть, в таблицу не включена: для префикса, который переиспользуется тысячи раз, это погрешность округления.
3. Пакетная суммаризация
Нужно сжать 5000 документов примерно по 8000 токенов каждый до резюме на 400 токенов. Документы разные, кэшировать нечего: 40 млн входных + 2 млн выходных токенов.
| Модель | Вход | Выход | Вся задача |
|---|---|---|---|
| DeepSeek V4 Flash | $6.72 | $0.67 | $7.39 |
| GPT 5.6 Luna | $7.20 | $2.16 | $9.36 |
| Claude Sonnet 5 | $12.00 | $3.00 | $15.00 |
| Qwen3.7 Plus | $13.72 | $2.74 | $16.46 |
| MiniMax M3 | $14.40 | $2.88 | $17.28 |
| DeepSeek V4 Pro | $20.88 | $2.09 | $22.97 |
| GPT 5.6 Terra | $32.00 | $9.60 | $41.60 |
| Gemini 3.7 Flash | $36.00 | $9.00 | $45.00 |
Входа здесь в 20 раз больше, чем выхода, так что почти всё решает цена входных токенов. Прогоните сотню документов через двух-трёх кандидатов, сравните резюме и пересчитайте на полный объём, прежде чем запускать всю партию.
Как снизить счёт
- Включайте кэширование промпта для всего, что повторяется. Ставьте неизменную часть — инструкции, описания инструментов, справочные данные — в начало, а меняющуюся в конец, чтобы префикс совпадал от запроса к запросу. Кэшированные токены оплачиваются по кэш-тарифу модели, если он у неё есть. Больше всех выигрывают агенты для кода и многоходовые диалоги, которые на каждом шаге заново отправляют растущий контекст.
- Ограничивайте выход. Выходные токены дороже, поэтому задавайте
max_tokensи просите нужный формат: метку, JSON-объект, три пункта списка. Модель, которую попросили «ответить коротко», сама решает, что значит коротко. - Черновик — на дешёвой модели, финал — на дорогой. Отдавайте классификацию, извлечение данных, первые черновики и маршрутизацию недорогим моделям — DeepSeek V4 Flash, GPT 5.6 Luna, Claude Sonnet 5, — а в Opus, Sol или Astra отправляйте только то, что действительно этого требует. При десятикратной разнице в цене маршрутизатор, который поднимает наверх каждый десятый запрос, стоит меньше половины того, во что обошлась бы отправка всех запросов в топовую модель.
- Сокращайте то, что пересылаете. Сжимайте старые реплики в краткое резюме вместо полной истории и подтягивайте меньше фрагментов, но точнее. Токен, который вы не отправили, не нужно оплачивать — ни по полной цене, ни по кэш-тарифу.
- Сравнивайте на своём трафике. Примеры выше показывают, что самая
дешёвая модель зависит от соотношения входа и выхода и от кэширования.
Сохраните
usageза день реальных запросов и посчитайте стоимость на двух-трёх моделях.
Один API-ключ для всех моделей
Все модели из таблицы работают с одним API-ключом API Hubs и одним предоплаченным балансом — тем же, с которого оплачивается генерация видео, изображений и музыки. Подписки нет, отдельные аккаунты у каждого вендора не нужны: вы пополняете баланс, и каждый запрос списывает стоимость использованных токенов. Если провайдер недоступен, запрос повторяется через резервного, а если ошибкой завершились все попытки, списанная сумма возвращается.
OpenAI-совместимый эндпоинт — POST /api/v1/chat/completions. В официальном
OpenAI SDK достаточно указать базовый URL API Hubs и ваш ключ; чтобы сменить
модель, поменяйте строку model.
import OpenAI from "openai";const client = new OpenAI({apiKey: process.env.API_STOCK_KEY,baseURL: "https://api.apihubs.ru/api/v1",});const completion = await client.chat.completions.create({model: "deepseek-v4-flash", // или "gpt-5.6-luna", "claude-sonnet-5", "gemini-3.7-flash"…max_tokens: 300,messages: [{ role: "system", content: "Ты — лаконичный ассистент поддержки." },{ role: "user", content: "Как сбросить пароль?" },],});console.log(completion.choices[0].message.content);console.log(completion.usage); // токены, по которым тарифицируется запрос
Anthropic-совместимый эндпоинт — POST /api/v1/messages. Он принимает
запрос в формате Anthropic, где поле max_tokens обязательно:
curl -X POST https://api.apihubs.ru/api/v1/messages \-H "Authorization: Bearer $API_STOCK_KEY" \-H "Content-Type: application/json" \-d '{"model": "claude-sonnet-5","max_tokens": 300,"messages": [{ "role": "user", "content": "Как сбросить пароль?" }]}'
Параметры, стриминг и обработка ошибок описаны в справочнике Chat Completions и справочнике Messages. Перед запуском в продакшен загляните в чек-лист — там про хранение ключей и контроль баланса.
Частые вопросы
Сколько стоит Gemini API?
По ценам каталога у всех моделей Gemini Flash вход стоит $0,90 за миллион токенов. Выход — $4,50 за миллион у Gemini 3.6 и 3.7 Flash, $5,40 у 3.5 Flash и $9,72 у 3.5 Flash (High). Кэшированный вход — $0,09 за миллион ($0,162 у High). Актуальные цены — на странице семейства Gemini.
Сколько стоит Claude API?
Claude Sonnet 5 стоит $0,30 за миллион входных токенов и $1,50 за миллион выходных, Claude Fable 5 — $1,50 / $7,50, Claude Opus 5 — $3 / $15. Кэшированный вход у всех трёх — десятая часть цены входа. Текущая таблица — на странице семейства Claude.
DeepSeek — самый дешёвый LLM API?
Если считать за токен, да: DeepSeek V4 Flash за $0,168 на входе и $0,336 на выходе — самая недорогая модель каталога. Но когда большая часть промпта кэшируется, GPT 5.6 Luna и Claude Sonnet 5 могут оказаться дешевле, потому что у DeepSeek нет кэш-тарифа, — насколько именно, показывает второй пример выше.
Как получить API-ключ Claude, Gemini или DeepSeek?
Отдельный ключ под каждого вендора не нужен. Зарегистрируйтесь в API Hubs, пополните баланс на любую сумму и создайте API-ключ в личном кабинете. Этот же ключ работает с GPT, Claude, Gemini, DeepSeek, Grok, Kimi и всеми остальными моделями каталога.
Какой LLM API дешевле всего для моей задачи?
Умножьте месячный объём входных, выходных и кэшированных токенов на ставки каждого кандидата, как в примерах выше. Короткие промпты с длинными ответами выгоднее на модели с дешёвым выходом, длинные повторяющиеся промпты — на модели с дешёвым кэшем, разовые длинные документы — на модели с дешёвым входом. Начните со страницы цен и страниц семейств GPT, Claude, Gemini, DeepSeek, Grok и Kimi.
Запустите это со своим ключом
Все модели из этого руководства доступны в каталоге API Hubs — один API-ключ, один предоплаченный баланс, без отдельной регистрации у каждого провайдера.