API Stock

Чат и LLM

Цены на API GPT, Claude, Gemini и DeepSeek — сравнение LLM

Сколько стоит API GPT, Claude, Gemini, DeepSeek, Grok и Kimi: цены за 1 млн токенов, расчёт месячных затрат на примерах и способы снизить счёт.

9 мин чтенияразделов: 7

На вопрос «сколько стоит Claude API» нет одного ответа, потому что платите вы не за запрос. API языковых моделей тарифицирует токены, причём по двум-трём разным ставкам в зависимости от того, в какую сторону они идут. Один и тот же чат-бот может обходиться в $2 в месяц на одной модели и в $60 на другой, а расклад между двумя моделями способен поменяться, как только вы включите кэширование промпта.

В этом гайде собраны текущие цены на все текстовые модели каталога API Stock — GPT, Claude, Gemini, DeepSeek, Grok, Kimi и ещё несколько — и разобраны три типичные нагрузки, чтобы было видно, во что цена за токен превращается в месячном счёте. Он для разработчиков, которые выбирают модель под продукт, и для всех, кто искал «Gemini API цена» и находил таблицу без единого расчёта.

За что вы на самом деле платите

Все цены ниже указаны за 1 млн токенов в долларах США. Токен — это фрагмент слова; страница текста занимает несколько сотен токенов. Важны три ставки:

  • Входные токены — всё, что вы отправляете: системный промпт, историю диалога, найденные документы и сообщение пользователя. Поскольку история пересылается целиком на каждом шаге, в чат-сценариях обычно доминирует именно вход.
  • Выходные токены — всё, что пишет модель. Это всегда более дорогое направление: в нашем каталоге выход стоит в 2–6 раз дороже входа той же модели.
  • Кэшированные входные токены — часть промпта, которую провайдер уже видел и сохранил. Если у модели есть кэш-тариф, такой токен стоит небольшую долю обычной цены входа, как правило десятую. У некоторых моделей есть и отдельная ставка записи в кэш — она списывается один раз, когда префикс сохраняется впервые.

Итоговый счёт за месяц считается просто: вход × цена входа + выход × цена выхода + кэш × цена кэша + запись в кэш × цена записи, делённое на миллион. Весь остальной гайд — эта формула с реальными цифрами.

Цены на LLM API: сводная таблица

Цены каталога на 24 сентября 2026 года, доллары за 1 млн токенов, отсортированы по цене входа. Значения, которые в каталоге указаны с большей точностью, округлены до цента. Актуальная таблица есть на странице каждой модели, а все модели сразу — на странице цен.

МодельСемействоВходВыходКэш (чтение)
DeepSeek V4 FlashDeepSeek$0.168$0.336$0.0168
GPT 5.6 LunaGPT$0.18$1.08$0.018
Claude Sonnet 5Claude$0.30$1.50$0.03
Qwen3.7 PlusQwen$0.34$1.37$0.034
MiniMax M3MiniMax$0.36$1.44$0.036
DeepSeek V4 ProDeepSeek$0.522$1.044$0.0522
GPT 5.6 TerraGPT$1.20$7.20$0.12
Gemini 3.6 FlashGemini$0.90$4.50$0.09
Gemini 3.7 FlashGemini$0.90$4.50$0.09
Gemini 3.5 FlashGemini$0.90$5.40$0.09
GLM 5.2GLM$0.98$3.43$0.098
Kimi K2.7 CodeKimi$1.11$4.62$0.111
GPT 5.5GPT$1.50$9.00$0.15
Claude Fable 5Claude$1.50$7.50$0.15
GLM 5.3GLM$1.68$5.28$0.312
Grok 4.5Grok$2.10$6.30$0.525
Grok 4.6Grok$2.10$6.30$0.525
GPT 5.6 SolGPT$3.00$18.00$0.30
Claude Opus 5Claude$3.00$15.00$0.30
Kimi K3Kimi$3.15$15.75$0.315
GPT 6 AstraGPT$8.00$40.00$0.80

Прочерк означает, что в каталоге у модели нет тарифа на кэшированный вход, и все входные токены оплачиваются по полной цене. Это цены API Stock, они не совпадают с прямыми тарифами самих разработчиков моделей.

Какую линейку выбрать

Таблица цен ранжирует модели по стоимости, а не по пригодности для задачи. Ниже — только то, что следует из самих цифр; какая модель лучше справится именно с вашими промптами, стоит проверить на них же.

GPT — самый широкий ценовой диапазон в каталоге: вход у GPT 6 Astra дороже, чем у GPT 5.6 Luna, более чем в сорок раз. Luna за $0,18 на входе и $1,08 на выходе описана в каталоге как модель для больших объёмов — чатов, классификации и простых агентных шагов. Terra дешевле GPT 5.5 и на входе, и на выходе, так что для новой интеграции это более выгодный вариант среднего уровня. Выход у моделей 5.5 и 5.6 стоит в 6 раз дороже входа, у Astra — в 5, поэтому короткие ответы на GPT экономят особенно много. Кэшированный вход во всей линейке — десятая часть цены входа.

Claude — три модели, и Claude Sonnet 5 среди них заметно дешевле остальных: $0,30 за вход и $1,50 за выход. Claude Opus 5 ровно в десять раз дороже по обеим ставкам, поэтому маршрутизацию — Sonnet по умолчанию, Opus для сложных случаев — имеет смысл закладывать сразу. Claude Fable 5, настроенная на длинные тексты, стоит посередине: $1,50 / $7,50. У всех трёх выход в 5 раз дороже входа, чтение из кэша стоит десятую часть входа, а запись в кэш — 1,25 цены входа. Sonnet и Opus доступны и через OpenAI-совместимый, и через Anthropic-совместимый эндпоинт; Fable работает через Anthropic-совместимый Messages API.

Gemini держит цену входа одинаковой: у всех моделей Flash это $0,90 за миллион входных токенов. Разница — в выходе: 3.6 Flash и 3.7 Flash берут $4,50, 3.5 Flash — $5,40. Если выбирать между версиями Gemini только по цене, 3.6 и 3.7 Flash одинаковы. Кэшированный вход — десятая часть цены входа.

DeepSeek — самые дешёвые токены в каталоге. DeepSeek V4 Flash стоит $0,168 за вход и $0,336 за выход, и выход у неё дороже входа всего в 2 раза — это минимальный разрыв среди всех моделей, поэтому она остаётся дешёвой даже при длинных ответах. V4 Pro примерно втрое дороже, но её выход за $1,044 всё равно дешевле, чем у GPT 5.6 Luna. Кэшированный вход на обеих — десятая часть цены входа.

Grok: Grok 4.5 и Grok 4.6 стоят одинаково — $2,10 / $6,30, так что оставаться на 4.5 ради экономии смысла нет. Выход всего втрое дороже входа, зато скидка на кэш меньше, чем у других: кэшированный токен стоит четверть цены входа ($0,525), а не десятую часть. Для обеих моделей указан контекст 500K токенов.

Kimi — флагман и модель для кода. Kimi K3 по цене близка к Claude Opus 5 ($3,15 / $15,75). Kimi K2.7 Code, рассчитанная на правки в масштабе целого репозитория, стоит примерно втрое меньше, а запись в кэш у неё тарифицируется так же дёшево, как чтение ($0,111), — сохранять в кэше большой контекст репозитория не накладно.

Остальные модели каталога закрывают промежуток между DeepSeek и средним сегментом: Qwen3.7 Plus и MiniMax M3 стоят около $0,35 за вход и $1,40 за выход, а GLM 5.2 и GLM 5.3 — $0,98–1,68 за вход и $3,43–5,28 за выход.

Расчёт стоимости на примерах

Три нагрузки по ценам каталога из таблицы выше. В итогах учтена только оплата токенов.

1. Бот поддержки

5000 диалогов в месяц, в каждом около 2000 входных токенов (системный промпт, история, сообщение клиента) и около 400 токенов ответа. Итого 10 млн входных + 2 млн выходных токенов.

Для Claude Sonnet 5 расчёт такой: 10 × $0.30 + 2 × $1.50 = $3.00 + $3.00.

МодельВходВыходВ месяц
DeepSeek V4 Flash$1.68$0.67$2.35
GPT 5.6 Luna$1.80$2.16$3.96
Claude Sonnet 5$3.00$3.00$6.00
DeepSeek V4 Pro$5.22$2.09$7.31
GPT 5.6 Terra$8.00$9.60$17.60
Gemini 3.7 Flash$9.00$9.00$18.00
Grok 4.6$21.00$12.60$33.60
Claude Opus 5$30.00$30.00$60.00

Даже при пяти входных токенах на один выходной у GPT, Claude и Gemini на выход приходится половина счёта или больше. У DeepSeek V4 Flash самые низкие ставки в обе стороны, поэтому она уверенно впереди.

2. Ассистент с большим постоянным промптом

Ассистент по продукту отвечает на 10 000 вопросов в месяц. Каждый запрос начинается с одного и того же блока на 1600 токенов — инструкции и справочные материалы, — за ним идут около 400 токенов вопроса и истории, а ответ занимает 100 токенов. С включённым кэшированием промпта это 16 млн кэшированных + 4 млн обычных входных + 1 млн выходных токенов.

Для Claude Sonnet 5: 16 × $0.03 + 4 × $0.30 + 1 × $1.50 = $0.48 + $1.20 + $1.50.

МодельКэшОбычный входВыходС кэшемБез кэша
DeepSeek V4 Flash$0.27$0.67$0.34$1.28$3.70
GPT 5.6 Luna$0.29$0.72$1.08$2.09$4.68
Claude Sonnet 5$0.48$1.20$1.50$3.18$7.50
Gemini 3.7 Flash$1.44$3.60$4.50$9.54$22.50
GPT 5.6 Terra$1.92$4.80$7.20$13.92$31.20
Grok 4.6$8.40$8.40$6.30$23.10$48.30
Claude Opus 5$4.80$12.00$15.00$31.80$75.00

DeepSeek V4 Flash остаётся самой дешёвой в обоих случаях: с кэшем её счёт снижается примерно на 65% — до $1,28 против $2,09 у GPT 5.6 Luna. У моделей GPT, Claude и Gemini кэширование сокращает счёт на 55–58%, у Grok — примерно на 52%, потому что кэшированный токен там стоит четверть цены, а не десятую часть. Разовая плата за запись в кэш у моделей, где она есть, в таблицу не включена: для префикса, который переиспользуется тысячи раз, это погрешность округления.

3. Пакетная суммаризация

Нужно сжать 5000 документов примерно по 8000 токенов каждый до резюме на 400 токенов. Документы разные, кэшировать нечего: 40 млн входных + 2 млн выходных токенов.

МодельВходВыходВся задача
DeepSeek V4 Flash$6.72$0.67$7.39
GPT 5.6 Luna$7.20$2.16$9.36
Claude Sonnet 5$12.00$3.00$15.00
Qwen3.7 Plus$13.72$2.74$16.46
MiniMax M3$14.40$2.88$17.28
DeepSeek V4 Pro$20.88$2.09$22.97
GPT 5.6 Terra$32.00$9.60$41.60
Gemini 3.7 Flash$36.00$9.00$45.00

Входа здесь в 20 раз больше, чем выхода, так что почти всё решает цена входных токенов. Прогоните сотню документов через двух-трёх кандидатов, сравните резюме и пересчитайте на полный объём, прежде чем запускать всю партию.

Как снизить счёт

  • Включайте кэширование промпта для всего, что повторяется. Ставьте неизменную часть — инструкции, описания инструментов, справочные данные — в начало, а меняющуюся в конец, чтобы префикс совпадал от запроса к запросу. Кэшированные токены оплачиваются по кэш-тарифу модели, если он у неё есть. Больше всех выигрывают агенты для кода и многоходовые диалоги, которые на каждом шаге заново отправляют растущий контекст.
  • Ограничивайте выход. Выходные токены дороже, поэтому задавайте max_tokens и просите нужный формат: метку, JSON-объект, три пункта списка. Модель, которую попросили «ответить коротко», сама решает, что значит коротко.
  • Черновик — на дешёвой модели, финал — на дорогой. Отдавайте классификацию, извлечение данных, первые черновики и маршрутизацию недорогим моделям — DeepSeek V4 Flash, GPT 5.6 Luna, Claude Sonnet 5, — а в Opus, Sol или Astra отправляйте только то, что действительно этого требует. При десятикратной разнице в цене маршрутизатор, который поднимает наверх каждый десятый запрос, стоит меньше половины того, во что обошлась бы отправка всех запросов в топовую модель.
  • Сокращайте то, что пересылаете. Сжимайте старые реплики в краткое резюме вместо полной истории и подтягивайте меньше фрагментов, но точнее. Токен, который вы не отправили, не нужно оплачивать — ни по полной цене, ни по кэш-тарифу.
  • Сравнивайте на своём трафике. Примеры выше показывают, что самая дешёвая модель зависит от соотношения входа и выхода и от кэширования. Сохраните usage за день реальных запросов и посчитайте стоимость на двух-трёх моделях.

Один API-ключ для всех моделей

Все модели из таблицы работают с одним API-ключом API Stock и одним предоплаченным балансом — тем же, с которого оплачивается генерация видео, изображений и музыки. Подписки нет, отдельные аккаунты у каждого вендора не нужны: вы пополняете баланс, и каждый запрос списывает стоимость использованных токенов. Если провайдер недоступен, запрос повторяется через резервного, а если ошибкой завершились все попытки, списанная сумма возвращается.

OpenAI-совместимый эндпоинт — POST /api/v1/chat/completions. В официальном OpenAI SDK достаточно указать базовый URL API Stock и ваш ключ; чтобы сменить модель, поменяйте строку model.

ts
import OpenAI from "openai";
const client = new OpenAI({
apiKey: process.env.API_STOCK_KEY,
baseURL: "https://api.api-stock.com/api/v1",
});
const completion = await client.chat.completions.create({
model: "deepseek-v4-flash", // или "gpt-5.6-luna", "claude-sonnet-5", "gemini-3.7-flash"…
max_tokens: 300,
messages: [
{ role: "system", content: "Ты — лаконичный ассистент поддержки." },
{ role: "user", content: "Как сбросить пароль?" },
],
});
console.log(completion.choices[0].message.content);
console.log(completion.usage); // токены, по которым тарифицируется запрос

Anthropic-совместимый эндпоинт — POST /api/v1/messages. Он принимает запрос в формате Anthropic, где поле max_tokens обязательно:

sh
curl -X POST https://api.api-stock.com/api/v1/messages \
-H "Authorization: Bearer $API_STOCK_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "claude-sonnet-5",
"max_tokens": 300,
"messages": [
{ "role": "user", "content": "Как сбросить пароль?" }
]
}'

Параметры, стриминг и обработка ошибок описаны в справочнике Chat Completions и справочнике Messages. Перед запуском в продакшен загляните в чек-лист — там про хранение ключей и контроль баланса.

Частые вопросы

Сколько стоит Gemini API?

По ценам каталога у всех моделей Gemini Flash вход стоит $0,90 за миллион токенов. Выход — $4,50 за миллион у Gemini 3.6 и 3.7 Flash и $5,40 у 3.5 Flash. Кэшированный вход — $0,09 за миллион. Актуальные цены — на странице семейства Gemini.

Сколько стоит Claude API?

Claude Sonnet 5 стоит $0,30 за миллион входных токенов и $1,50 за миллион выходных, Claude Fable 5 — $1,50 / $7,50, Claude Opus 5 — $3 / $15. Кэшированный вход у всех трёх — десятая часть цены входа. Текущая таблица — на странице семейства Claude.

DeepSeek — самый дешёвый LLM API?

Если считать за токен, да: DeepSeek V4 Flash за $0,168 на входе и $0,336 на выходе — самая недорогая модель каталога. И это верно с кэшем: во втором примере выше она остаётся самой дешёвой, даже когда большая часть промпта кэшируется.

Как получить API-ключ Claude, Gemini или DeepSeek?

Отдельный ключ под каждого вендора не нужен. Зарегистрируйтесь в API Stock, пополните баланс в пределах лимитов выбранного способа оплаты и создайте API-ключ в личном кабинете. Этот же ключ работает с GPT, Claude, Gemini, DeepSeek, Grok, Kimi и всеми остальными моделями каталога.

Какой LLM API дешевле всего для моей задачи?

Умножьте месячный объём входных, выходных и кэшированных токенов на ставки каждого кандидата, как в примерах выше. Короткие промпты с длинными ответами выгоднее на модели с дешёвым выходом, длинные повторяющиеся промпты — на модели с дешёвым кэшем, разовые длинные документы — на модели с дешёвым входом. Начните со страницы цен и страниц семейств GPT, Claude, Gemini, DeepSeek, Grok и Kimi.

Запустите это со своим ключом

Все модели из этого руководства доступны в каталоге API Stock — один API-ключ, один предоплаченный баланс, без отдельной регистрации у каждого провайдера.

Читать дальше