DeepSeek API: цены, ключ и подключение в 2026
Практический разбор DeepSeek API: актуальные модели и цены, как создать ключ и сделать первый запрос, как включить рассуждения, чем платить и как подключить API к агентам.

Содержание
DeepSeek API – это платный доступ к моделям DeepSeek по HTTP: вы создаёте ключ на платформе, пополняете баланс и отправляете запросы на адрес https://api.deepseek.com в формате, совместимом с OpenAI и Anthropic. По документации на октябрь 2026 года доступны две модели: deepseek-flash (DeepSeek-V4.1-Flash) и deepseek-v4-pro (DeepSeek-V4-Pro-0813). Цены указаны в долларах за 1 млн токенов и зависят от времени суток: у Flash входные токены без попадания в кэш стоят $0,15 в непиковые часы и $0,30 в пиковые, выходные – $0,60 и $1,20. Ниже – полная таблица цен, как получить ключ, пример запроса, режим рассуждений, лимиты и типичные ошибки. Что подтверждено про оплату и доступ из России, разобрано отдельно.
Коротко. Базовый адрес – https://api.deepseek.com (формат OpenAI) и https://api.deepseek.com/anthropic (формат Anthropic). Модели: deepseek-flash и deepseek-v4-pro, контекст 1 млн токенов, максимум ответа 384 тысячи токенов. Пиковые часы – с 01:00 до 04:00 и с 06:00 до 10:00 UTC с понедельника по пятницу, кроме китайских праздников; в остальное время цены в два раза ниже. Режим рассуждений включён по умолчанию. Лимит параллельных запросов на аккаунт: 2500 у Flash и 500 у Pro, при превышении приходит ошибка 429, при нулевом балансе – 402. Официальных способов оплаты для России в документации не указано: условия смотрите на платформе. Данные – по api-docs.deepseek.com на октябрь 2026 года.
Какие модели есть в API
Страница «Models & Pricing» документации описывает две модели с общими параметрами и разным набором функций:
| Параметр | deepseek-flash | deepseek-v4-pro |
|---|---|---|
| Версия | DeepSeek-V4.1-Flash | DeepSeek-V4-Pro-0813 |
| Режимы | Обычный и рассуждение (по умолчанию включено рассуждение) | |
| Контекст | 1 млн токенов | 1 млн токенов |
| Максимум ответа | 384 тысячи токенов | 384 тысячи токенов |
| JSON-вывод, вызов функций, Responses API, Anthropic API | да | да |
| Зрение (картинки на входе) | да | не поддерживается |
| Параллельных запросов на аккаунт | 2500 | 500 |
Для Flash вызывайте модель по имени deepseek-flash. Прежние имена deepseek-v4-flash и deepseek-v4-flash-vision-exp временно принимаются, но соответствующие модели выведены из эксплуатации: запросы обслуживает V4.1 Flash по цене Flash. Из журнала изменений: 21 августа 2026 вышла экспериментальная мультимодальная модель, затем появилась V4.1 Flash с нативной мультимодальностью, а цены на API были снижены; для V4 Pro компания решила продолжать обслуживание и после 14 сентября 2026 года без изменения тарифов. Если у вас в коде старые названия моделей, замените их на актуальные.
Если вам нужно общее знакомство с чатом DeepSeek, режимами и локальным запуском, начните со статьи «DeepSeek: что это и как пользоваться». Здесь – только API.
Цены за 1 млн токенов
Цены указаны в долларах США за 1 млн токенов. Пиковые часы – с 01:00 до 04:00 и с 06:00 до 10:00 UTC с понедельника по пятницу, за исключением государственных праздников Китая; все остальные часы, включая выходные и праздники, – непиковые, и тариф в них вдвое ниже.
| Что считается | Время | deepseek-flash | deepseek-v4-pro |
|---|---|---|---|
| Вход, попадание в кэш | непиковое | $0,003 | $0,022 |
| пиковое | $0,006 | $0,044 | |
| Вход, промах кэша | непиковое | $0,15 | $0,66 |
| пиковое | $0,30 | $1,32 | |
| Выход | непиковое | $0,60 | $1,98 |
| пиковое | $1,20 | $3,96 |
Стоимость запроса считается как число токенов, умноженное на цену. Деньги списываются с пополненного или выданного баланса, причём сначала расходуется выданный (granted) баланс. DeepSeek оставляет за собой право менять цены, поэтому перед пополнением проверьте страницу.
Пример расчёта (наш, по таблице выше; реальный расход считайте по полю usage в ответе API). Допустим, вы отправили 1 млн входных токенов без попадания в кэш и получили 200 тысяч выходных на модели Flash в пиковые часы: 1 × $0,30 + 0,2 × $1,20 = $0,54. В непиковые часы тот же объём стоит $0,27.
Кэширование. Кэш на диске включён для всех по умолчанию, менять код не нужно. Если префикс нового запроса полностью совпадает с ранее сохранённым фрагментом, эта часть считается попаданием в кэш и стоит в десятки раз дешевле. Практический вывод: держите неизменяемые части промпта – инструкции, описание инструментов – в начале запроса, а меняющиеся данные добавляйте в конец. Правила сохранения префиксов описаны на странице «Context Caching» документации и устроены сложнее, чем «совпало начало», – прочитайте её, если у вас длинные диалоги.
Как получить ключ
- Откройте платформу DeepSeek (ссылка «DeepSeek Platform» в шапке документации, platform.deepseek.com). При открытии сайт показал проверку «подтвердите, что вы не бот» – это обычная защита.
- Зарегистрируйтесь и перейдите в раздел API keys (адрес platform.deepseek.com/api_keys указан в документации), создайте ключ и сразу сохраните его в менеджере паролей или переменной окружения.
- Пополните баланс на странице Top up. Без пополненного баланса запросы вернут ошибку 402.
- Не вставляйте ключ в код, который попадёт в репозиторий или на сайт. Если ключ утёк, удалите его и создайте новый.
Баланс можно проверять через API: в справке есть метод получения баланса пользователя, где различаются общий, выданный и пополненный баланс. Про способы оплаты и доступность в вашей стране: в документации они не описаны, а страница оплаты видна только внутри аккаунта. Поэтому мы не утверждаем, что оплата из России возможна – проверьте это на платформе до того, как закладывать DeepSeek в проект. Общую картину по оплате зарубежных сервисов даёт статья «Как оплатить Claude и ChatGPT из России без зарубежной карты»; она не про DeepSeek, но объясняет, с какими ограничениями сталкиваются российские карты.
Первый запрос
В документации используется формат OpenAI. Минимальный запрос через curl:
curl https://api.deepseek.com/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer ${DEEPSEEK_API_KEY}" \
-d '{
"model": "deepseek-flash",
"messages": [
{"role": "system", "content": "You are a helpful assistant."},
{"role": "user", "content": "Hello!"}
],
"thinking": {"type": "enabled"},
"reasoning_effort": "high",
"stream": false
}'
Переменная DEEPSEEK_API_KEY хранит ваш ключ. Для потокового ответа поставьте "stream": true. Если вы работаете через Python-библиотеку OpenAI, укажите base_url="https://api.deepseek.com" и ваш ключ, а параметр thinking передайте через extra_body. Для сайта-прототипа или бота можно взять любой из примеров на curl, Python и Node.js со страницы «Your First API Call».
Полезные возможности из документации: JSON-вывод (response_format со значением json_object; в промпте должно быть слово «json» и пример нужного формата, а max_tokens стоит задавать с запасом, чтобы ответ не обрезался), вызов функций, префиксное дополнение и FIM-дополнение (обе в бета-версии; FIM только в обычном режиме), загрузка файлов и возможность передавать параметр user_id для разделения пользователей вашего сервиса.
Режим рассуждений
Режим рассуждений включён по умолчанию, уровень усилия по умолчанию – high. Переключатель и параметры в формате OpenAI: {"thinking": {"type": "enabled"}} или disabled и reasoning_effort со значениями low, high или max. Просьбы вроде minimal и low сводятся к low, medium, high и xhigh – к high, а max и ultra – к max.
- В режиме рассуждений параметры
temperature,presence_penaltyиfrequency_penaltyне действуют: ошибки не будет, но эффекта тоже. - Параметр
top_pработает только в этом режиме, допустимый диапазон 0,95–1,0; значения ниже 0,95 считаются как 0,95. - Ход рассуждений приходит в поле
reasoning_contentрядом сcontent. Если в запросе естьtools,reasoning_contentпредыдущих ходов нужно передавать обратно; если инструментов нет – не нужно, API его проигнорирует.
Рассуждения расходуют выходные токены и увеличивают счёт. Для простых задач вроде классификации и извлечения полей отключайте режим и экономьте. Для сложных – оставляйте. Как выбирать модель по задаче, мы разбирали в статье «Лучшая нейросеть для программирования».
Подключение к агентам и кодинг-инструментам
Поскольку API совместим с форматами OpenAI и Anthropic, DeepSeek можно подключить к инструментам, которые поддерживают смену адреса. В документации есть отдельные страницы интеграций: Claude Code, Codex, OpenCode, OpenClaw, Hermes и другие, а также анонсирован «DeepSeek Harness» в режиме предварительного доступа для разработчиков агентных оболочек.
Пример для Claude Code из документации (Linux и macOS): нужно задать переменные окружения ANTHROPIC_BASE_URL=https://api.deepseek.com/anthropic, ANTHROPIC_AUTH_TOKEN со своим ключом DeepSeek и имя модели (в примере документации – deepseek-flash[1m]), после чего запустить claude в папке проекта. Полный список переменных и версия для Windows – на странице интеграции. Читайте её целиком: набор переменных в документации включает и настройки уровня усилия, и размер окна сжатия контекста.
Для Codex и других агентов принцип тот же: меняется адрес и ключ. Как работает Codex, мы объясняли в статье «Codex от OpenAI». Если вы запускаете модели локально, а не по API, посмотрите установку Ollama: так данные остаются на вашем компьютере.
Лимиты и ошибки
Лимит на аккаунт – число одновременных запросов: 2500 для deepseek-flash и 500 для deepseek-v4-pro. Запрос считается занятым от отправки до конца ответа, учёт идёт на уровне аккаунта независимо от ключа. При превышении приходит HTTP 429. Увеличить квоту можно заявкой, дополнительной платы за расширение, по документации, нет. Параметр user_id (латиница, цифры, дефис и подчёркивание, до 512 символов) позволяет разделять пользователей вашего сервиса по безопасности, кэшу и планированию; личные данные в него передавать нельзя.
Если запрос ещё не начал обрабатываться в течение 10 минут, сервер закрывает соединение. Пока вы ждёте ответа, соединение остаётся открытым: для обычных запросов приходят пустые строки, для потоковых – служебные комментарии : keep-alive. Если вы сами разбираете HTTP-ответы, учтите это.
| Код | Причина | Что делать |
|---|---|---|
| 400 | Неверный формат тела запроса | Исправьте тело по подсказке в сообщении об ошибке |
| 401 | Неверный ключ | Проверьте ключ или создайте новый |
| 402 | Закончился баланс | Пополните счёт на странице Top up |
| 422 | Недопустимые параметры | Исправьте параметры по подсказке |
| 429 | Слишком быстрый поток запросов | Снизьте частоту; в документации советуют временно переключаться на другого провайдера |
| 500 | Сбой на стороне сервера | Повторите запрос через паузу, при повторе напишите в поддержку |
| 503 | Сервер перегружен | Повторите через паузу |
Практический совет: в клиентском коде для 429, 500 и 503 делайте повтор с растущей паузой и ограничением числа попыток, а для 402 и 401 – предупреждение администратору, а не бесконечный повтор. Ограничьте ключ по расходам на стороне своего сервиса: пока баланс не нулевой, зациклившийся агент будет тратить деньги.
Что сказано про доступ из России
На открытых страницах документации списка стран и правил оплаты мы не нашли. Страница ошибок отдельно упоминает способ пополнить баланс – раздел Top up, но способы оплаты и региональные ограничения видны только внутри аккаунта. Поэтому не стоит полагаться на чужие рассказы: зарегистрируйтесь, откройте раздел оплаты и проверьте, доступен ли вам платёж. Не передавайте данные карты и пароль посредникам, которые предлагают «пополнить за вас».
Если важна предсказуемость, рассмотрите российские сервисы с OpenAI-совместимым API; один из примеров – AI Gateway у Timeweb Cloud, о котором мы писали в обзоре Timeweb Cloud, или запуск открытых моделей на своём сервере. Условия любого сервиса проверяйте сами.
Частые вопросы
Сколько стоит DeepSeek API?
Цены в долларах за 1 млн токенов. Для deepseek-flash вход без кэша – $0,15 в непиковые и $0,30 в пиковые часы, выход – $0,60 и $1,20. Для deepseek-v4-pro вход без кэша – $0,66 и $1,32, выход – $1,98 и $3,96. Попадание в кэш намного дешевле.
Что такое пиковые часы?
С 01:00 до 04:00 и с 06:00 до 10:00 UTC с понедельника по пятницу, кроме государственных праздников Китая. В остальное время, включая выходные, тарифы вдвое ниже.
Как получить ключ DeepSeek API?
Зарегистрируйтесь на платформе DeepSeek, откройте раздел API keys и создайте ключ. Для работы нужно пополнить баланс: при нулевом балансе API возвращает ошибку 402.
Совместим ли DeepSeek API с OpenAI?
Да. Базовый адрес https://api.deepseek.com работает в формате OpenAI, а https://api.deepseek.com/anthropic – в формате Anthropic. Поэтому его можно подключить к инструментам, которые позволяют менять адрес API.
Как отключить рассуждения?
Передайте "thinking": {"type": "disabled"}. В OpenAI SDK этот параметр нужно положить в extra_body. Рассуждения по умолчанию включены, и их токены оплачиваются как выходные.
Почему я получаю ошибку 429?
Вы превысили лимит одновременных запросов: 2500 для deepseek-flash и 500 для deepseek-v4-pro на аккаунт. Снизьте параллельность, добавьте повторы с паузой или отправьте заявку на расширение квоты.
Можно ли оплатить DeepSeek API из России?
В открытой документации способы оплаты и список стран не указаны, поэтому утверждать это нельзя. Откройте страницу пополнения в своём аккаунте и проверьте; не пользуйтесь сомнительными посредниками.
Есть ли у DeepSeek поддержка картинок?
По таблице документации, зрение поддерживает deepseek-flash, а deepseek-v4-pro – нет.

Строю AI-агентов для своего бизнеса и клиентов, на сайте пишу о том, что запускал сам. Вопросы задавайте в Telegram.
@aaakalsin →

