Что такое DeepSeek API
В обычном чате вы задаёте вопросы вручную. Через API DeepSeek программа передаёт сообщения модели и обрабатывает результат. Такой способ подходит для повторяющихся задач: разобрать обращение, подготовить черновик ответа, найти сведения в переданном тексте.
Для сайта сначала определите источник знаний помощника. Например, передавайте актуальные условия доставки вместе с вопросом посетителя. Если ответа в этих условиях нет, направляйте обращение сотруднику. Не поручайте модели придумывать цену товара или статус заказа.
DeepSeek API price: стоимость входных и выходных токенов
Цена API DeepSeek складывается из входа, выхода и попадания входного текста в кэш. Ниже тарифы на сентябрь 2026 года. Все суммы указаны в долларах за миллион токенов.
Пиковые часы: с 01:00 до 04:00 и с 06:00 до 10:00 UTC по будням, кроме китайских государственных праздников. В остальное время действует непиковый тариф. Перед оплатой сверяйте таблицу Models & Pricing в официальной документации.
| Модель | Вход из кэша | Вход без кэша | Выход |
|---|---|---|---|
| deepseek-flash, вне пика | 0,003 $ | 0,15 $ | 0,60 $ |
| deepseek-flash, пик | 0,006 $ | 0,30 $ | 1,20 $ |
| deepseek-v4-pro, вне пика | 0,022 $ | 0,66 $ | 1,98 $ |
| deepseek-v4-pro, пик | 0,044 $ | 1,32 $ | 3,96 $ |
Как посчитать бюджет чат-бота
Учебный пример: за месяц приложение передало миллион входных токенов без кэша и получило миллион выходных. Для Flash вне пика расчёт составит 0,15 + 0,60 = 0,75 доллара. Это пример арифметики по тарифу, а не обещанный бюджет вашего проекта.
Соберите пробные диалоги и измерьте расход. Длинная инструкция, история переписки и повторные попытки увеличивают объём обработки. Задайте предел расходов в приложении. Стоимость разработки и поддержки считайте отдельно от платежей поставщику модели.
Context Caching: как уменьшить стоимость входа
Кэширование включено автоматически. Совпадение начала запроса с уже сохранённым фрагментом позволяет повторно использовать обработанный контекст. Совпадения текста в середине недостаточно; попадание в кэш не гарантировано.
Ставьте постоянную инструкцию и общий документ перед меняющимся вопросом. Проверяйте в usage значения prompt_cache_hit_tokens и prompt_cache_miss_tokens. Кэш снижает стоимость входа, но не делает запрос бесплатным.
DeepSeek free API: есть ли бесплатный доступ
Официальный API DeepSeek тарифицируется по использованию. В правилах списания предусмотрен бонусный баланс, но постоянный бесплатный лимит для каждого аккаунта не обещан. Не закладывайте рекламный бонус в постоянный бюджет.
У стороннего поставщика уточняйте, кто оплачивает запросы, где хранятся данные и когда заканчивается бесплатный доступ. Бесплатный веб-чат не означает бесплатный API.
Как получить DeepSeek API key и сохранить ключ
Ключ авторизует обращения к платному сервису. Ограничьте доступ к настройкам сервера и исключите секреты из репозитория. При утечке отзовите ключ и обновите настройки приложения.
Для диагностики передавайте время вызова, модель и код ошибки. Удаляйте секреты и клиентские данные из снимков экрана и сообщений сервера.
- Перейдите на platform.deepseek.com по ссылке из официальной документации и войдите в свой аккаунт.
- Откройте раздел API keys и создайте ключ для подключения приложения.
- Сохраните секрет в переменной окружения DEEPSEEK_API_KEY на сервере. Не вставляйте его в код страницы.
- Проверьте баланс аккаунта и выполните короткий тестовый запрос из серверного окружения.
Подключение к API DeepSeek: адрес и SDK
Базовый адрес, или base URL: https://api.deepseek.com. Запрос Chat Completions отправляется методом POST на /chat/completions. Не подставляйте адрес веб-чата вместо адреса API DeepSeek.
Для совместимого клиента задайте api_key, base_url и model. Формат Anthropic использует адрес https://api.deepseek.com/anthropic. При переносе приложения отдельно проверьте поддержку каждого параметра.
Заголовок Content-Type задаёт application/json, Authorization передаёт Bearer и секрет. Тело запроса содержит JSON. Пример для Bash читает ключ из окружения; не включайте вывод HTTP-заголовков при диагностике.
| Поле запроса | Что передать |
|---|---|
| model | Имя модели, например deepseek-flash |
| messages | Список сообщений диалога |
| role | Роль автора: system для инструкции, user для вопроса |
| content | Текст инструкции или обращения |
| stream | false для получения готового ответа целиком |
curl https://api.deepseek.com/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer ${DEEPSEEK_API_KEY}" \
-d '{"model":"deepseek-flash","messages":[{"role":"user","content":"Что такое API?"}],"thinking":{"type":"disabled"},"stream":false}'
Запрос к API DeepSeek на Python
Установите OpenAI SDK командой python -m pip install openai. Задайте DEEPSEEK_API_KEY в окружении сервера, сохраните пример в deepseek_test.py и запустите python deepseek_test.py.
Импорт from openai import OpenAI подключает клиент. Вызов client.chat.completions.create отправляет запрос; response.choices[0].message.content содержит ответ. Без переменной окружения программа остановится до обращения к сервису.
Для первого теста размышление отключено. Замените учебный вопрос своей задачей после проверки соединения. Не передавайте результат в CRM без проверки.
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ['DEEPSEEK_API_KEY'],
base_url='https://api.deepseek.com',
)
response = client.chat.completions.create(
model='deepseek-flash',
messages=[
{'role': 'system', 'content': 'Отвечайте кратко по-русски.'},
{'role': 'user', 'content': 'Что такое API?'},
],
stream=False,
extra_body={'thinking': {'type': 'disabled'}},
)
print(response.choices[0].message.content)
Подключение из Node.js
На сервере установите пакет командой npm install openai. Сохраните пример в deepseek_test.mjs и выполните node deepseek_test.mjs. Переменная DEEPSEEK_API_KEY должна быть задана в окружении процесса.
Этот JavaScript предназначен для сервера. Браузер обращается к вашему обработчику, а тот вызывает модель. Иначе посетитель сможет извлечь секрет из кода страницы.
import OpenAI from 'openai';
if (!process.env.DEEPSEEK_API_KEY) {
throw new Error('Задайте переменную DEEPSEEK_API_KEY');
}
const client = new OpenAI({
apiKey: process.env.DEEPSEEK_API_KEY,
baseURL: 'https://api.deepseek.com',
});
const response = await client.chat.completions.create({
model: 'deepseek-flash',
messages: [{role: 'user', content: 'Что такое API?'}],
thinking: {type: 'disabled'},
stream: false,
});
console.log(response.choices[0].message.content);
Модели DeepSeek: что доступно через API
На сентябрь 2026 года документация API DeepSeek указывает deepseek-flash и deepseek-v4-pro. Первая соответствует DeepSeek-V4.1-Flash, вторая DeepSeek-V4-Pro-0813. Flash принимает изображения, Pro указан как текстовая модель.
Имена deepseek-v4-flash и deepseek-v4-flash-vision-exp временно перенаправлены на новую Flash с её тарифами. Pro продолжает работать после 14 сентября 2026 года: журнал изменений уточняет ранний анонс отключения.
Для обеих моделей заявлены контекст 1M и максимальный выход 384K токенов. Вход и генерируемый ответ вместе должны помещаться в контекст. Параметр max_tokens ограничивает длину ответа.
Старые имена deepseek-chat и deepseek-reasoner объявлены к отключению с 24 июля 2026 года. Не копируйте их из инструкций для V3 и R1. Выбирайте актуальную модель по результатам собственных тестов.
Responses API и история диалога
На сентябрь 2026 года API DeepSeek поддерживает также POST /responses. Этот формат использует input вместо messages. При переносе приложения сверяйте поля запроса с отдельной документацией.
Responses API не сохраняет состояние диалога для следующего вызова: передавайте историю в input заново. Для Chat Completions собирайте историю в messages. Ключ доступа сам по себе не связывает вопросы в беседу.
Как читать ответ: choices, message, usage и id
В ответе choices содержит варианты результата, message содержит сообщение, content содержит текст. Поле id помогает найти конкретный вызов при диагностике.
Проверьте finish_reason: значение length означает обрезанный ответ. Не сохраняйте такой текст в карточку товара без проверки.
Блок usage показывает расход токенов. В журнал приложения, или log, записывайте длительность, статус и расход, исключая ключи и клиентские сообщения.
Режим размышления и потоковая генерация
В объекте thinking значение type: enabled включает размышление, disabled выключает. Параметр reasoning_effort управляет усилием рассуждения. Сравните режимы на одной подборке вопросов, прежде чем выбрать настройку.
В API DeepSeek параметр stream: true включает потоковый ответ. Текст Chat Completions приходит фрагментами в delta.content. Отдельное поле delta.reasoning_content содержит рассуждение, а не итоговый ответ.
При разрыве соединения покажите ошибку и предложите повторить запрос. Запускайте действие в CRM только после завершения ответа и проверки результата.
JSON Output и вызов внешних функций
В Chat Completions задайте response_format с type: json_object и явно попросите JSON. Это не проверка вашей схемы: проверяйте поля и типы данных самостоятельно.
Для обращения к вашим данным предусмотрены Tool Calls. Модель предлагает функцию и аргументы, а выполняет её ваше приложение. Например, обработчик получает артикул, ищет товар в базе и возвращает результат модели.
Сохраните сообщение модели с tool_calls. В режиме без размышления добавьте результат функции с role: tool и соответствующим tool_call_id. Затем повторно обратитесь к модели за итоговым ответом.
Ограничьте список доступных действий. Поиск по каталогу можно отделить от изменения заказа. Для операций с последствиями предусмотрите подтверждение пользователя и проверку прав на сервере.
Лимиты API DeepSeek и ошибки
На сентябрь 2026 года лимит параллельных запросов равен 2500 для Flash и 500 для Pro. Это число одновременно открытых запросов аккаунта, а не запросов в минуту. Другой ключ того же аккаунта не увеличивает лимит.
При ошибке 429 уменьшите число одновременных обращений. Для временных сбоев задайте очередь и повторы с растущей паузой. Ошибки ключа, баланса и параметров сначала исправьте.
Если HTTP-ответа нет, проверьте сеть, DNS, TLS и разрешение исходящих соединений из рабочего окружения. Если код работает локально, повторите тест внутри контейнера приложения: его сеть и переменные могут отличаться.
| HTTP code | Причина | Что проверить |
|---|---|---|
| 400 | Неверный формат | Структуру тела запроса и сообщение об ошибке |
| 401 | Ошибка авторизации | Ключ и передачу заголовка Authorization |
| 402 | Недостаточно средств | Баланс аккаунта |
| 422 | Неверные параметры | Названия и значения полей |
| 429 | Достигнут лимит нагрузки, в том числе параллельных запросов | Число незавершённых запросов аккаунта и очередь |
| 500 / 503 | Ошибка сервера или перегрузка | Повтор после паузы с ограничением попыток |
Доступ из России и защита данных
Проверяйте доступ к API DeepSeek из того окружения, где будет работать приложение. Успешный вход в веб-чат не проверяет серверную интеграцию. Разделите диагностику: сеть, авторизация, баланс, модель и параметры вызова.
Не отправляйте реальные клиентские обращения во время первичной настройки. Используйте вымышленные примеры, удаляйте контакты и договорные сведения. Перед запуском согласуйте состав передаваемых данных и условия обработки с ответственным за их защиту.
Продумайте работу сайта при недоступности модели. Можно сохранить обращение для сотрудника или показать обычную форму связи. Посетитель должен понимать, принят ли его вопрос и какое действие доступно дальше.
Что проверить перед запуском помощника на сайте
Нужна интеграция с бизнес-процессом? Посмотрите разработку ИИ-агентов: /uslugi/ii-agenty/. Подготовьте задачу, примеры данных и ожидаемый результат. Цена и сроки после брифа.
- Соберите примеры обычных, неоднозначных и неполных вопросов. Заранее определите приемлемый ответ для каждого.
- Проверьте отказ при отсутствии данных. Помощник не должен придумывать остатки товаров, контакты или условия возврата.
- Проверьте права пользователя перед выполнением функции. Ответ модели не заменяет серверную проверку доступа.
- Назначьте ответственного за обновление инструкций. Повторяйте проверку после смены модели и условий работы сервиса.
Источники
- DeepSeek: первый вызов, curl, Python и Node.js
- DeepSeek: модели, цены и ограничения
- DeepSeek: журнал изменений и сохранение Pro
- DeepSeek: Chat Completions, параметры и ответ
- DeepSeek: Responses API и состояние диалога
- DeepSeek: кэширование контекста
- DeepSeek: параллельные запросы и изоляция
- DeepSeek: коды ошибок