Цены
DeepSeek API: цена V4 Flash и Pro, расчёт в рублях
Сколько стоит DeepSeek V4 Flash и Pro за миллион токенов, как посчитать бюджет чат-бота и оплатить API из России без фиксированного курса.

Через API Hubs DeepSeek V4 Flash стоит 0,168 coin за 1 млн входных и 0,336 coin за 1 млн выходных токенов. V4 Pro — 0,522 и 1,044 coin соответственно. При нагрузке в 10 000 диалогов по 2 000 входных и 500 выходных токенов расчёт даёт 5,04 coin на Flash или 15,66 coin на Pro. Один coin равен одному доллару в каталоге; рублёвая сумма зависит от курса в момент пополнения. Цены сверены с каталогом 28 сентября 2026 года.
Сколько стоит миллион токенов DeepSeek API?
Промпт, системные инструкции и история переписки — это входные токены. Ответ модели — выходные. Выход у обеих версий стоит вдвое дороже входа, поэтому ограничение длины ответа порой даёт больший эффект, чем сокращение системного промпта.
| Модель | Вход, coin / 1 млн | Выход, coin / 1 млн | Кому подходит |
|---|---|---|---|
| DeepSeek V4 Flash | 0,168 | 0,336 | Классификация, извлечение данных, массовые диалоги |
| DeepSeek V4 Pro | 0,522 | 1,044 | Задачи, где нужен более сильный разбор и код |
Цены API Hubs на 28.09.2026; 1 coin = 1 $. Pro стоит примерно в 3,11 раза дороже Flash при одинаковом числе токенов. Это разница в тарифе, а не измерение качества: на ваших задачах Pro может отвечать короче или потребовать меньше повторных попыток. Сравнение других LLM по единой методике есть в руководстве по ценам LLM API.
Как посчитать цену одного запроса и 10 000 диалогов?
Формула проста: (входные токены / 1 000 000 × цена входа) + (выходные токены / 1 000 000 × цена выхода). Для одного диалога с 2 000 входных и 500 выходных токенов Flash даёт 0,000336 + 0,000168 = 0,000504 coin. Pro — 0,001044 + 0,000522 = 0,001566 coin. Здесь нет фиксированной платы за сам запрос; счёт растёт вместе с обработанными токенами.
| Сценарий: 10 000 диалогов | Вход: 20 млн токенов | Выход: 5 млн токенов | Итого |
|---|---|---|---|
| V4 Flash | 3,36 coin | 1,68 coin | 5,04 coin |
| V4 Pro | 10,44 coin | 5,22 coin | 15,66 coin |
Это модель бюджета, а не прогноз реального счёта. Длинная история чата, большой системный промпт, повторные запросы и объёмные ответы изменят оба множителя. Токены внутреннего рассуждения, если модель их возвращает и учитывает как выходные, также входят в оплачиваемый объём. Попросите API вернуть usage и сверяйте расчёт с фактическим потреблением.

Сколько это в рублях и как пополнить баланс из России?
В каталоге цены выражены в coins, где 1 coin = 1 $. Чтобы получить рублёвый бюджет, умножьте нужное число coins на рублёвый курс пополнения, который показан при оплате. Например, для 10 000 диалогов из расчёта выше это 5,04 × курс рублей на Flash или 15,66 × курс на Pro. Подставлять «сегодняшний курс» из старой статьи нельзя: итоговая сумма и условия платёжного метода меняются.
API Hubs работает с предоплаченным балансом: сначала пополняете его, затем создаёте ключ и оплачиваете фактические запросы. Доступные способы и применимый курс смотрите в кабинете перед платежом. Это удобнее для прототипа, чем заводить отдельный биллинг для каждой модели: тот же ключ можно использовать для Gemini и других LLM. Сведения о текущей цене всегда есть на странице тарифов.
Для финансового планирования заложите три величины отдельно: курс пополнения, объём токенов и запас на повторные запросы. Так будет ясно, что именно изменило бюджет. Если приложение работает с персональными или коммерчески чувствительными данными, до отправки запросов проверьте свои требования к обработке данных и используйте обезличенные тестовые примеры.
Что выгоднее: V4 Flash или V4 Pro?
Начните с Flash на задачах с чётким критерием правильности: отнести обращение к категории, извлечь поля из документа, составить черновик ответа. Возьмите 30–50 своих примеров, сохраните ожидаемые результаты и сравните обе модели по точности, длине ответов и доле ручных исправлений. У Pro выше тариф, но меньшая доля ошибок может окупить разницу там, где неверный ответ дорог.
Допустим, в вашей выборке Flash требует ручной правки у каждого пятого ответа, а Pro — у каждого двадцатого. Только после замера времени на правку можно понять, какой вариант дешевле целиком. Эти доли — пример расчёта, не результаты тестирования DeepSeek. Не переносите выводы из чужого бенчмарка на свои документы, язык и промпты.
Разумная схема для смешанной нагрузки: Flash обрабатывает простые случаи, а сложные или неуверенные уходят на Pro после проверки правилами приложения. Оба ID доступны через один OpenAI-совместимый протокол; переключение модели не требует второго API-ключа. Следите за тем, чтобы повторный запрос на Pro не отправлял без необходимости всю историю: это удваивает входной объём.
Как отправить первый запрос к DeepSeek V4 Flash?
Создайте ключ в кабинете и выполните запрос ниже. Если приложение уже использует SDK OpenAI, обычно достаточно сменить базовый URL и model — формат messages остаётся знакомым.
curl -X POST https://api.apihubs.ru/api/v1/chat/completions \-H "Authorization: Bearer $API_KEY" \-H "Content-Type: application/json" \-d '{"model": "deepseek-v4-flash","messages": [{"role": "system", "content": "Отвечай кратко и по существу."},{"role": "user", "content": "Объясни, что такое идемпотентность API, на одном примере."}],"max_tokens": 200}'
Ответ придёт в формате Chat Completions. Сохраните поля usage вместе с типом задачи, чтобы видеть стоимость в разрезе сценариев, а не только общий остаток баланса. Для длинных ответов включайте потоковый режим: его описание и пример есть в документации. Не записывайте ключ в исходный код или логи.
Как снизить расходы, не ухудшая ответы?
Сократите повторяемый контекст. Вместо всей истории диалога передавайте краткое состояние беседы и только нужные фрагменты базы знаний. На 10 000 запросов дополнительные 1 000 входных токенов в каждом случае — это ещё 10 млн входных токенов и 1,68 coin на Flash по текущей цене.
Ограничьте ответ по задаче. Для классификации достаточно кода категории и одной фразы объяснения; тысячословный ответ лишь поднимет выходную стоимость. max_tokens задаёт верхнюю границу, а формат ответа фиксируйте в инструкции и проверяйте в приложении.
Измеряйте полную стоимость результата. Если короткий ответ требует повторного обращения или ручной правки, экономия на токенах мнимая. Сравнивайте стоимость всех попыток / число принятых ответов; для важных задач учитывайте и время человека.
Частые вопросы
Сколько стоит DeepSeek API за миллион токенов?
На 28 сентября 2026 года через API Hubs DeepSeek V4 Flash стоит 0,168 coin за миллион входных и 0,336 coin за миллион выходных токенов. Для V4 Pro ставки — 0,522 и 1,044 coin. Один coin равен одному доллару в каталоге.
Сколько стоит DeepSeek API в рублях?
Умножьте стоимость в coins на курс пополнения в рублях, показанный при оплате. Фиксированную рублёвую цену нельзя честно указать без курса и способа платежа; пример 10 000 диалогов выше стоит 5,04 coin на Flash до перевода в рубли.
Какая версия DeepSeek дешевле для чат-бота?
При одинаковом количестве входных и выходных токенов V4 Flash дешевле Pro примерно в 3,11 раза. Если Pro заметно уменьшает число повторов или ручных исправлений на вашей задаче, сравните стоимость принятого ответа, а не только одного запроса.
Можно ли использовать DeepSeek через SDK OpenAI?
Да. Для русской витрины задайте базовый URL https://api.apihubs.ru/api/v1, модель deepseek-v4-flash или deepseek-v4-pro и свой ключ. Формат сообщений соответствует Chat Completions.
Нужна ли подписка на DeepSeek API?
Через API Hubs используется предоплаченный баланс, а списание зависит от фактически обработанных токенов. Проверяйте текущие ставки в каталоге перед запуском большой нагрузки.
- deepseek
- llm
- pricing
- россия
Попробуйте со своим ключом
Все модели из статьи доступны в каталоге API Hubs — один API-ключ, единый предоплаченный баланс, автоматическое переключение между провайдерами.
Читать дальше
ЦеныGemini API: цены в 2026 году и как платить из РоссииСколько стоит Gemini API за 1 млн токенов, во что обойдётся чат-бот на 10 000 диалогов в месяц и как подключить Gemini из России с оплатой по СБП.·6 мин чтения
РуководствоSuno API: 31 режим, цены и примеры запросовКак выбрать действие Suno API для песни, минуса, вокала и монтажа: полный список 31 режима, цена каждого, цепочки задач и примеры запросов.·6 мин чтения