Сразу дисклеймер: мы делаем Polza AI — агрегатор доступа к моделям. Заинтересованность очевидная, поэтому официальный путь через Anthropic описываем так же подробно, как обходной, и честно пишем, где он выгоднее нашего.

Повод для статьи возник, когда мы переносили собственные сервисы на новую линейку. За два месяца Anthropic обновила почти весь модельный ряд: в июне вышли Fable 5 и Sonnet 5, 24 июля 2026 года — Opus 5. Одновременно у Sonnet 5 сменился токенизатор, у Opus 5 появился параметр effort, а старые связки начали возвращать ошибки там, где раньше работали. Русскоязычные гайды при этом в большинстве своём написаны в 2024–2025 годах и рассказывают про Claude 3, которого в актуальной линейке уже нет.

Подписка и API — это два разных продукта

Claude Pro и Max дают доступ к чату на claude.ai и приложениям за фиксированную сумму в месяц. Claude API — программный доступ к моделям по HTTP: запрос на /v1/messages, ответ в JSON, оплата по токенам. Подписка не выдаёт API-ключ, ключ не открывает чат.

Подписка Pro / Max

API

Что покупаете

доступ к чату и приложениям

доступ к моделям для своего кода

Оплата

фиксированная сумма в месяц

по факту, за токены

Интерфейс

claude.ai, десктоп, мобильные

ваш код, SDK, HTTP

Кому

пишете промпты руками

промпты отправляет программа

Пограничный случай один. Claude Code работает и от подписки Max, и от API-ключа, и что выгоднее — считаем ниже отдельно.

Что поменялось в линейке за два месяца

Если в гайде фигурируют Claude 3 Opus или Claude 3.5 Sonnet — гайд можно закрывать: первые поколения Anthropic постепенно отключает, и закладывать их в новый проект нельзя.

Модель

Цена за 1M токенов, ввод / вывод

Когда брать

Sonnet 5

2 $ / 10 $ до 31 августа 2026, дальше 3 $ / 15 $

модель по умолчанию для большинства задач

Opus 5

(подставьте актуальные цифры из каталога)

сложный код, длинные агентные цепочки

Fable 5

(подставьте актуальные цифры из каталога)

когда качество важнее счёта

Haiku 4.5

1 $ / 5 $

массовые дешёвые запросы, классификация, разметка

Предыдущее поколение — Opus 4.8 и Sonnet 4.6 — пока доступно по прежним ценам, 5 $ / 25 $ и 3 $ / 15 $. Это пригодится, если продукт завязан на поведение конкретной версии: смена модели меняет формулировки, длину ответов и иногда формат JSON, который вы парсите.

Из-за трёх изменений мы переписывали код, а не просто меняли строку с названием модели.

У Opus 5 появился параметр effort — низкий, средний, высокий уровень «усилий». Им регулируют баланс между качеством ответа и расходом токенов прямо в запросе. На типовых задачах низкий уровень экономит заметно и без видимой просадки, на длинных цепочках рассуждений разница уже чувствуется.

У Sonnet 5 другой токенизатор. Тот же текст режется на большее число токенов — примерно в 1,0–1,35 раза в зависимости от контента. Промо-цена 2 $ / 10 $ до 31 августа как раз компенсирует эту разницу. Если считаете бюджет по старым логам, умножайте объём на коэффициент, а не переносите цифры один в один.

Claude Mythos 5 существует, но купить его нельзя. Это версия Fable 5 без части ограничений, доступ Anthropic выдаёт только одобренным организациям. Продавцы «ключей Mythos» — скам, других вариантов там нет.

Цена одного запроса

Токен — примерно 3–4 символа, страница A4 — около 500–700 токенов. Платите отдельно за ввод (промпт плюс контекст) и вывод (ответ), вывод дороже в пять раз.

Отправляем Sonnet 5 запрос на 2 000 токенов — промпт с куском кода — и получаем ответ на 1 000 токенов:

  • ввод: 2 000 × 2 $ / 1 000 000 = 0,004 $

  • вывод: 1 000 × 10 $ / 1 000 000 = 0,01 $

  • итого 0,014 $

Тот же запрос к Fable 5 стоит 0,07 $, к Haiku 4.5 — 0,007 $. Между крайними моделями десятикратный разрыв, поэтому топ-модель не стоит гонять там, где справится Haiku.

Счёт уменьшают ещё два механизма, и они складываются друг с другом.

Кэширование промптов. Если в каждом запросе повторяется системный промпт или большой документ, его закэшируйте: чтение из кэша стоит 10% от цены ввода. На сценарии «один длинный контекст, много коротких вопросов» это экономит до 90% на повторяющейся части.

Batch API. Запросы, которым не нужен мгновенный ответ — ночная обработка, массовая генерация — отправляются пачкой со скидкой 50%. Ответ приходит обычно в течение часа, максимум за сутки.

Чего не хватает для регистрации из России

Ключи выдаются в консоли разработчика на platform.claude.com. Регистрируетесь по почте с подтверждением по номеру телефона, открываете раздел API Keys, нажимаете Create Key и даёте ключу понятное имя по названию проекта. Ключ показывается целиком один раз, поэтому копируйте сразу; формат — строка, начинающаяся с sk-ant-. Без положительного баланса в разделе Billing запросы вернут ошибку.

Ключ храните как пароль: в переменных окружения или менеджере секретов. Ключ, закоммиченный в публичный репозиторий, боты находят за минуты, и вы оплачиваете чужие запросы, пока Anthropic не заблокирует его.

Из России зарегистрироваться в консоли не получится. Россия не входит в список поддерживаемых регионов: консоль не принимает российские номера при регистрации и российские карты при оплате, а запросы с российских IP возвращают 403. Для официального пути нужен зарубежный номер при регистрации, карта иностранного банка для оплаты и доступ из поддерживаемого региона — не хватает одного, остальные два бесполезны.

Если у вас есть зарубежное юрлицо или карта иностранного банка, официальный путь оптимален: цены без наценки, весь функционал платформы, новые модели в день релиза. Если нет, сбор этого набора занимает больше времени, чем сама интеграция, а аккаунт работает, пока Anthropic не заметит несоответствие региона.

Тот же код через посредника

Агрегатор — посредник с собственным доступом к моделям. Он выдаёт свой ключ и эндпоинт, совместимый с API Anthropic или OpenAI, и проксирует запросы. По этой схеме работаем мы.

SDK при этом остаётся привычным, меняется базовый адрес, а к названию модели добавляется префикс провайдера.

python

from openai import OpenAI

client = OpenAI(
    base_url="https://polza.ai/api/v1",
    api_key="<POLZA_AI_API_KEY>",
)
completion = client.chat.completions.create(
    model="anthropic/claude-sonnet-5",
    messages=[{"role": "user", "content": "Привет"}],
)

Тот же префикс переключает запрос на GPT или Gemini, остальной код не трогается. Ради этого схему обычно и берут даже там, где с картой проблем нет: один ключ и один счёт вместо четырёх кабинетов, когда нужно сравнить модели или настроить фолбэк между провайдерами.

Посредник зарабатывает на марже к токенам, поэтому его тарифы имеет смысл сравнить с каталогом Anthropic до интеграции. Новые модели он подключает с задержкой от нескольких часов до нескольких дней после релиза. А часть функционала платформы — Files API, Admin API, тонкие настройки батчей — у посредников либо урезана, либо сделана по-своему, и это проверяют заранее, а не когда половина пайплайна уже написана.

Проверить связку за две минуты

Примеры ниже написаны для официального эндпоинта. У агрегаторов чаще другой стандарт, OpenAI Chat Completions: там меняется и базовый URL, и SDK, как в коде выше.

Python:

bash

pip install anthropic

python

import anthropic

client = anthropic.Anthropic()  # ключ берётся из ANTHROPIC_API_KEY
message = client.messages.create(
    model="claude-sonnet-5",
    max_tokens=1024,
    system="Отвечай кратко, на русском языке.",
    messages=[
        {"role": "user", "content": "Объясни, чем HTTP/2 отличается от HTTP/1.1"}
    ]
)
print(message.content[0].text)
print(f"Токенов: {message.usage.input_tokens} на ввод, {message.usage.output_tokens} на вывод")

Ключ в код не вписывайте:

bash

export ANTHROPIC_API_KEY="sk-ant-..."

JavaScript / TypeScript:

bash

npm install @anthropic-ai/sdk

javascript

import Anthropic from "@anthropic-ai/sdk";

const client = new Anthropic(); // ключ из ANTHROPIC_API_KEY
const message = await client.messages.create({
  model: "claude-sonnet-5",
  max_tokens: 1024,
  messages: [{ role: "user", content: "Напиши функцию дебаунса на JavaScript" }],
});
console.log(message.content[0].text);

cURL, если надо убедиться, что ключ рабочий:

bash

curl https://api.anthropic.com/v1/messages \
  -H "x-api-key: $ANTHROPIC_API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -H "content-type: application/json" \
  -d '{
    "model": "claude-sonnet-5",
    "max_tokens": 256,
    "messages": [{"role": "user", "content": "Ответь одним словом: работает?"}]
  }'

max_tokens — обязательный потолок длины ответа, он же страхует от случайного ответа на 20 000 токенов за ваши деньги. В system задают роль, тон и формат, и кэшировать выгодно именно его. temperature от 0 до 1: ноль для извлечения данных, ближе к единице для творческих задач.

Claude Code: пустая переменная, которая стоила часа

Claude Code — агент для программирования: работает в терминале, VS Code и JetBrains, читает кодовую базу, правит файлы, гоняет тесты. Запитывается от подписки Max или от API-ключа.

Официальный ключ подставляется одной переменной окружения:

bash

npm install -g @anthropic-ai/claude-code
export ANTHROPIC_API_KEY="sk-ant-..."
claude

При первом запуске агент спросит способ авторизации, дальше каждая сессия списывает токены с баланса консоли.

А вот с ключом от посредника мы потеряли час. Claude Code шлёт обычные запросы Messages API, поэтому агрегатору достаточно переадресовать их у себя, и настройка выглядит так:

bash

export ANTHROPIC_BASE_URL="https://polza.ai/api"
export ANTHROPIC_AUTH_TOKEN="ключ-от-сервиса"
export ANTHROPIC_API_KEY=""

ANTHROPIC_API_KEY и ANTHROPIC_AUTH_TOKEN — две разные переменные с разной семантикой. Первая уходит заголовком x-api-key и означает «я иду к Anthropic напрямую», вторая уходит заголовком Authorization: Bearer и предназначена для шлюзов и корпоративных прокси. Claude Code разрешает маршрут по приоритету, и прямой ключ в этой лестнице стоит выше. Оставите в ANTHROPIC_API_KEY старое значение — агент пойдёт на официальный эндпоинт и вернёт 403, хотя оба ключа рабочие. Логи при этом выглядят так, будто виноват посредник.

Забытая переменная может лежать где угодно: в ~/.zshrc, в .env проекта, в настройках devcontainer или в секретах CI. Поэтому маршрут проверяют не по памяти, а командой /status внутри сессии — она показывает, куда реально ходит агент.

Чтобы не держать всё в терминале, тот же блок кладётся в ~/.claude/settings.json (на Windows — %USERPROFILE%\.claude\settings.json) в секцию env:

json

{
  "env": {
    "ANTHROPIC_BASE_URL": "https://polza.ai/api",
    "ANTHROPIC_AUTH_TOKEN": "ключ-от-сервиса",
    "ANTHROPIC_MODEL": "anthropic/claude-sonnet-5"
  }
}

Через посредника название модели идёт с префиксом провайдера, поэтому задавать его переменной ANTHROPIC_MODEL надёжнее, чем командой /model в сессии.

Подписка или API для Claude Code

Через API агент списывает токены за каждое действие, и на активной разработке набегает заметно: по данным Anthropic, средний разработчик тратит около 13 $ в активный день, то есть 150–250 $ в месяц. Подписка Max стоит фиксированных денег и включает большой лимит Claude Code.

Если вы кодите каждый день, подписка почти наверняка дешевле. Запускаете агента пару раз в неделю или встраиваете в CI — платите за API по факту. И если остаётесь на API, держите Sonnet 5 моделью по умолчанию, а Opus 5 включайте точечно на сложных задачах: на этом экономится больше, чем на всех остальных настройках вместе.

Коды ошибок и что с ними делать

Код

Что означает

Что делать

400

некорректный запрос

проверить обязательные поля, чаще всего забыт max_tokens

401

проблема с ключом

ключ не тот, отозван или не подхватился из окружения

403

регион или права

тот самый случай с непустым ANTHROPIC_API_KEY или запрос с неподдерживаемого IP

429

упёрлись в лимиты

ретраи с задержкой, кэширование, батчи

500

сбой на стороне Anthropic

ретрай, затем статусная страница

529

перегрузка

фолбэк на другую модель

Оберните вызовы в ретраи с экспоненциальной задержкой: официальные SDK умеют это через параметр max_retries. И настройте фолбэк, чтобы при 529 от Opus 5 запрос уходил в Sonnet 5. С июля 2026 года на платформе Anthropic есть и серверный фолбэк с автоматическим перенаправлением на доступную модель.

При массовых 500 и 529 сначала откройте статусную страницу Anthropic, а потом дебажьте свой код.

Потолки по запросам и как поднимается тир

Кроме баланса у аккаунта есть rate limits — потолки по запросам в минуту (RPM) и токенам в минуту (ITPM/OTPM). С апреля 2026 года на платформе три тира: Start, Build и Scale. Тир поднимается автоматически по мере трат и времени жизни аккаунта.

На старте лимиты скромные, и для разработки это нормально. Упираетесь в 429 на проде — сначала посмотрите текущий тир в консоли, потом оптимизируйте расход: кэширование срезает входящие токены, батчи выводят массовые задачи из real-time-квоты. У агрегаторов лимиты свои, их смотрят в тарифах сервиса.

Про ключи с форумов

Постоянного бесплатного тарифа у Claude API нет, в отличие от того же Gemini с его free tier. Новым аккаунтам консоль периодически начисляет небольшой пробный баланс, но его хватает на знакомство, а не на продакшен. У агрегаторов порог входа ниже: у нас, например, минимальное пополнение 100 ₽, чего достаточно, чтобы собрать интеграцию и посмотреть реальный расход в поле usage, прежде чем считать бюджет проекта.

Не покупайте «безлимитный Claude API» за 200 рублей на маркетплейсах. Это либо ворованные ключи, которые заблокируют вместе с вашими запросами, либо чистый скам. Через чужой ключ вдобавок проходят ваши промпты и данные.

А если задача — просто попробовать Claude, не пишите код вообще: чат на claude.ai бесплатен и работает на Sonnet 5.

Что чаще всего спрашивают про Claude API

Эти вопросы приносят в наш чат поддержки, и почти все они возникают уже после подключения: первый запрос прошёл, а счёт или ответы модели не сходятся с ожиданиями.

В чате и по API один и тот же промпт даёт разные ответы. В чате на claude.ai и в чатах агрегаторов к вашему сообщению добавляется системный промпт площадки, а по API модель получает ваше сообщение и больше ничего. Отсюда и ощущение, что по API модель отвечает хуже, хотя она работает без инструкций, которые в чате подставляются автоматически. Свой системный промпт задают параметром system или первым сообщением с ролью system в OpenAI-совместимом формате.

Почему на агентских задачах счёт растёт быстрее, чем длина ответов? Ввод оплачивается целиком в каждом запросе, и входят в него ваш промпт, весь предыдущий контекст диалога и системный промпт, если он есть. В вывод попадает всё, что сгенерировала модель, включая токены рассуждений, которых вы в ответе не видите. Поэтому в агентских расширениях, где контекст растёт с каждым шагом, миллионы токенов уходят за два-три десятка запросов. Кэширование срезает повторяющуюся часть ввода, но работает не в каждом клиенте: Cline кэширует сам, в других расширениях кэш приходится проверять и настраивать руками.

В ответе всегда cached_tokens: 0, хотя кэширование включено. Кэш у Claude не включается сам по себе. Промпт должен быть не короче минимального порога, а порог зависит от модели, и живёт такой кэш минутами, а не часами. Через посредника решение кэшировать принимает провайдер, которому ушёл запрос, а при смене провайдера кэш сбрасывается, и повторный запрос оплачивается заново целиком. В n8n кэширование не работает через ноду «Message a model», для него нужен HTTP Request.

Чьи лимиты меня ограничивают — Anthropic или посредника? С ключом Anthropic вы упираетесь в потолки своего аккаунта: RPM и токены в минуту по текущему тиру, сам тир виден в консоли. С ключом посредника запросы идут не с вашего аккаунта, его лимиты к вам не применяются, а работают потолки сервиса — у нас это 30 запросов в секунду в одну модель, и на отдельный ключ лимит можно выставить самому. Отдельно приходит 429 от вышестоящего провайдера с пометкой, что модель временно ограничена. Это не ваш потолок и не потолок сервиса, помогает повтор запроса.

Откуда берётся 400 с сообщением, что модель не найдена? Такую ошибку возвращает не модель, а проверка идентификатора: до Anthropic запрос не доходит. Чаще всего в коде остаётся имя модели из старого гайда, которого в актуальной линейке уже нет. Вторая частая причина — точка вместо дефиса: anthropic/claude-3-5-sonnet вернёт ошибку там, где anthropic/claude-3.5-sonnet отработает. Актуальные идентификаторы отдаёт эндпоинт со списком моделей, сверяйтесь с ним, а не с примером из чужого гайда.

Если бы начинали сегодня

Взяли бы Sonnet 5 моделью по умолчанию и не трогали Opus 5, пока задача не покажет, что он нужен, а связку проверили бы одним curl вместо полноценной интеграции. Кэширование, ретраи и фолбэк включили бы до продакшена: по нашему опыту, это три вещи, которые дописываются задним числом после первого инцидента.

И решили бы вопрос с доступом честно: есть зарубежная карта и номер — идти напрямую к Anthropic, там дешевле и функциональнее. Нет — брать посредника и заложить наценку в расчёт. Мы делаем Polza AI как раз для второго случая: один ключ на Claude, GPT, Gemini и открытые модели, оплата картой, СБП или счётом для юрлиц. Цены по каждой модели лежат в каталоге до регистрации — сравнить с таблицей выше можно, ничего не создавая.

Если будете подключать и споткнётесь — приходите в наш чат, разбираем упавшие связки, в том числе с n8n. Свои грабли мы описали выше, интересно посмотреть на чужие.