Что такое Anthropic Claude API и для чего он нужен
Anthropic предоставляет программный интерфейс: приложение отправляет инструкции и данные, получает результат и показывает его пользователю.
Claude AI API подходит для повторяемых операций. Вы задаёте правила ответа и решаете, когда передать диалог сотруднику.
Официально сервис недоступен в России; для российского проекта рассмотрите GigaChat или YandexGPT. Инструкция ниже относится к работе в поддерживаемых Anthropic странах.
- Поддержка: ответы по справке с передачей спорных вопросов сотруднику.
- Интернет-магазин: черновики описаний на основе характеристик товара.
- Внутренний поиск: краткое изложение найденных документов с проверкой исходного текста.
- Обработка обращений: предложение категории, темы и следующего действия оператору.
Claude API pricing: модели и цены
На сентябрь 2026 года базовые цены прямого доступа указаны в долларах за миллион токенов. Вход включает отправленные инструкции и материалы, выход состоит из сгенерированного содержимого.
Токен представляет фрагмент текста. Для предварительной оценки входа используйте Token Counting API: число букв не даёт точного расхода.
| Модель | Когда проверить на своей задаче | Контекст | Вход / выход, $ |
|---|---|---|---|
| Claude Haiku 4.5 | Быстрые типовые ответы и сортировка обращений | 200 тысяч | 1 / 5 |
| Claude Sonnet 5 | Работа с текстом и кодом при ограниченном бюджете | 1 миллион | 2 / 10 |
| Claude Opus 5.5 | Сложные задачи с кодом и многошаговая работа | 1 миллион | 4 / 20 |
| Claude Fable 5.1 | Трудные рассуждения и длительные задания агентам | 1 миллион | 10 / 50 |
Как выбрать модель и оценить бюджет
Anthropic рекомендует Opus 5.5 для большинства задач. Для своего сайта сравните модели по точности, задержке и стоимости принятого ответа.
В поле model передают идентификатор версии: например, claude-sonnet-5. Доступные модели можно проверить через GET /v1/models.
Учебный расчёт: тысяча запросов по 3000 входных и 500 выходных токенов. Для Sonnet 5: 3 × 2 + 0,5 × 10 = 11 долларов.
Это оценка без кеширования, платных инструментов и повторов. Историю диалога считайте при каждом запросе; расход берите из usage.
- Сравнивайте модели на одинаковых вопросах, включая неоднозначные.
- Заранее задайте критерии: верные факты, нужный формат, допустимые отказы.
- После смены версии повторите проверку на сохранённых примерах.
Как получить Claude API key
Ключ выпускают в Claude Console на platform.claude.com. Для личной разработки подходит персональный ключ, для общего сервиса предназначен ключ сервисного аккаунта. Персональный доступ прекращается, если владелец покидает организацию.
- Проверьте доступность сервиса для вашей страны и организации.
- Войдите в консоль и откройте Settings, затем API keys.
- Выберите Create key, задайте имя, связанный аккаунт, срок действия и рабочее пространство.
- Сохраните секрет в защищённом хранилище: полностью он отображается только при создании.
- Передайте значение серверному приложению через переменную окружения ANTHROPIC_API_KEY.
Первый запрос на Python через SDK
Установите официальный SDK: pip install anthropic. В отдельном виртуальном окружении зависимости проекта не конфликтуют с другими приложениями.
Задайте ANTHROPIC_API_KEY в окружении сервера. Пример рассчитан на ключ одного рабочего пространства. Для ключа нескольких пространств нужен дополнительный заголовок.
import anthropic подключает библиотеку, client.messages.create отправляет сообщение. response хранит результат; цикл for и print выводят текстовые блоки.
- model: идентификатор модели, которую вы вызываете.
- messages: список сообщений; role задаёт автора, user обозначает пользователя.
- content: содержимое сообщения, например вопрос посетителя.
- max_tokens: верхняя граница объёма генерации, а не заданное количество слов.
- type: тип блока ответа; print выводит текст только у блоков text.
import anthropic
client = anthropic.Anthropic()
try:
response = client.messages.create(
model="claude-sonnet-5",
max_tokens=1000,
messages=[{"role": "user", "content": "Кратко объясните API"}],
)
for block in response.content:
if block.type == "text":
print(block.text)
except anthropic.APIConnectionError:
print("Нет соединения с сервисом")
except anthropic.APIStatusError as error:
print("HTTP:", error.status_code)
Прямой HTTP-запрос и заголовки
Без SDK отправляйте POST на https://api.anthropic.com/v1/messages. Тело в JSON содержит model, max_tokens и messages. Это вызов генерации, а не произвольного ресурса.
Заголовки: content-type со значением application/json и anthropic-version со значением 2023-06-01. В cURL параметр --data обозначает тело запроса.
Для авторизации поддерживаются Authorization: Bearer и x-api-key. Для ключа нескольких пространств обязателен anthropic-workspace-id, в том числе через SDK.
- Проверьте метод POST и путь /v1/messages при ошибке адреса.
- Не выводите заголовки авторизации в журнал при отладке.
- У стороннего шлюза свои адрес, ключ, тарифы и условия обработки данных.
Как читать ответ и сохранять контекст
Ответ содержит массив content. Проверяйте type каждого блока: первый элемент может оказаться не текстом.
В usage поля input_tokens и output_tokens показывают расход входа и выхода. При кешировании отдельно учитываются чтение и запись.
Messages API не хранит историю беседы за приложение. При следующем запросе снова передайте сообщения user и assistant. Общие инструкции задавайте параметром system.
Проверяйте stop_reason: max_tokens означает достижение предела генерации. Такой ответ может быть незавершённым; не передавайте его дальше как готовый результат.
Документы и инструкции для модели
Передавайте найденные фрагменты справки, а не весь архив. Сохраните ссылки на исходные документы для проверки ответа.
Пример инструкции: «Ответьте по приложенным условиям возврата. Если ответа нет, предложите обратиться к оператору». Проверьте пустой документ и противоречивые сведения.
Возможности: изображения, файлы и ответы по схеме
Модели принимают текст и изображения, а отвечают текстом. Например, можно разобрать изображение товара или сопоставить документ с описанием.
Files API позволяет повторно использовать загруженные документы. Загрузка файла не означает обучение модели на вашей базе.
Для передачи данных в CRM используйте Structured outputs: они задают формат ответа по JSON Schema. Проверяйте смысл значений отдельно.
Citations связывают ответ с исходными документами. Для большой базы сначала найдите подходящие фрагменты, затем передайте их модели.
Инструменты Claude API и Managed Agents
Tool use позволяет модели запросить вызов вашей функции, например проверку наличия товара. Приложение проверяет аргументы и права пользователя.
Затем сервер выполняет разрешённый вызов и возвращает результат модели. Для оплаты или удаления данных предусмотрите отдельное подтверждение.
Серверные инструменты включают поиск в интернете и выполнение кода. Их доступность и стоимость проверяйте отдельно от базовой ставки модели.
Messages API даёт контроль над отдельными обращениями. Managed Agents предоставляет инфраструктуру длительных сессий; интерфейсы агентов и окружений имеют статус beta.
Для агента заранее определите критерий завершения, разрешённые инструменты и предел расходов. Хранение состояния сессии не заменяет проверку результата.
MCP связывает агента с инструментами и данными. Memory tool помогает сохранять сведения, а compaction сокращает старый контекст. Эти возможности подключают под конкретный сценарий.
Потоковый ответ и работа сайта
Для длинных ответов используйте client.messages.stream: посетитель увидит текст по мере поступления. События передаются через SSE.
HTTP-статус 200 не гарантирует успешное завершение: ошибка возможна внутри потока. При обрыве сохраните вопрос и обозначьте ответ как незаконченный.
Перед запуском действия дождитесь полного ответа и проверьте его. Частичный результат нельзя использовать для изменения заказа.
Лимиты Claude API и ошибки подключения
Лимиты зависят от уровня использования и класса модели. Проверяйте requests per minute, входные и выходные токены за минуту в консоли.
Ограничение частоты и предел денежных расходов требуют разных действий. При превышении частоты ориентируйтесь на retry-after. Если исчерпан месячный предел уровня, повторные запросы сами по себе доступ не восстановят.
SDK автоматически повторяет некоторые временные сбои. Настройка max_retries управляет повторами; учитывайте её, если добавляете собственную очередь.
| HTTP-код | Что проверить | Действие |
|---|---|---|
| 400 | Формат запроса или установленный вами предел расходов | Прочитайте сообщение ошибки и исправьте указанную причину |
| 401 | Недействующий, отозванный или просроченный ключ | Проверьте серверную настройку авторизации |
| 402 | Проблема платёжных данных | Проверьте раздел оплаты в консоли |
| 403 | Недостаточные разрешения | Проверьте права организации и рабочего пространства |
| 413 | Слишком большой запрос в байтах | Уменьшите объём передаваемых данных |
| 429 | Частота запросов либо месячный предел уровня | Проверьте детали ошибки и наличие retry-after |
| 529 | Временная перегрузка сервиса | Повторите позже с ограниченным числом попыток |
| 500 / 504 | Сбой сервиса или превышение времени ожидания | Повторите с паузой; для долгого ответа рассмотрите потоковую передачу |
Как снизить стоимость и защитить данные
Сократите лишний контекст и задайте предел расходов. После каждого изменения проверяйте точность на тех же вопросах.
Prompt caching уменьшает расходы при повторении длинных инструкций. Запись и чтение оплачиваются отдельно; выгода зависит от модели и повторных обращений. Для Sonnet 5 на сентябрь 2026 года запись на 5 минут стоит $2,50, чтение $0,20 за миллион токенов.
Batch API даёт скидку 50% на вход и выход для несрочной обработки. Он подходит для подготовки описаний, но не для живого диалога.
Определите, какие данные действительно нужны модели. Удаляйте лишние сведения до отправки, разграничивайте доступ к истории и проверяйте условия выбранного сервиса. Для действий с заказом предусмотрите проверку прав пользователя.
- Задайте предел ответа под задачу.
- Ограничьте число повторов при сбое.
- Разделяйте расходы по сценариям: консультация, карточка товара, разбор документа.
- Не выполняйте команды из документов без проверки разрешённых действий.
Что подготовить перед интеграцией
Опишите задачу, источники данных, ожидаемый результат и случаи передачи оператору. Приложите примеры вопросов и укажите, какие действия программа может выполнять самостоятельно. Это позволит оценить объём разработки после брифа.
Если нужна помощь с проектом, смотрите услугу «Разработка ИИ-агентов»: /uslugi/ii-agenty/. В seosite1 итоговую цену и сроки называем после брифа. Оплата идёт по этапам, каждый этап оплачивается вперёд.
Источники
- Anthropic: Модели, идентификаторы и контекст
- Anthropic: Цены, кеширование и пакетная обработка
- Anthropic: сообщения, Python и история диалога
- Anthropic: Создание и хранение ключа
- Anthropic: HTTP API, заголовки и методы
- Anthropic: Ошибки и потоковые ответы
- Anthropic: возможности, файлы и структурированные ответы
- Anthropic: поддерживаемые страны