Независимая проверка цен · официальные ставки проверены 2026-10-01

Сравнивайте стоимость по своему token mix.

Практическое сравнение prepaid blended pricing, официальных тарифов и подписочного доступа. Начинайте с реальной нагрузки, а не с одной цифры в заголовке.

Рассчитать workload

Публичные цены Model.sale

Цена указана за 1M charged tokens. Initial reservation временный и возвращается после terminal usage; это не отдельное списание за запрос. Цена остаётся видимой при временной недоступности модели.

МодельBlended / 1MНачальный резервСтатус
gpt-5.5$0.45$0.01 (возвращается)LIVE
gpt-5.6-luna$0.09$0.01 (возвращается)LIVE
gpt-5.6-sol$0.45$0.01 (возвращается)LIVE
gpt-5.6-terra$0.15$0.01 (возвращается)LIVE
gpt-6-astra$1.125$0.01 (возвращается)LIVE
gpt-6-luna$0.08$0.01 (возвращается)LIVE
gpt-6-sol$0.38$0.01 (возвращается)LIVE
gpt-6.1-sol$0.40$0.01 (возвращается)LIVE
claude-fable-5-1$1.00$0.01 (возвращается)LIVE
claude-haiku-4-5-20251001$0.20$0.01 (возвращается)LIVE
claude-opus-4-6$0.50$0.01 (возвращается)LIVE
claude-opus-4-7$0.50$0.01 (возвращается)LIVE
claude-opus-4-8$0.60$0.01 (возвращается)LIVE
claude-opus-5$0.60$0.01 (возвращается)LIVE
claude-opus-5-5$1.00$0.01 (возвращается)LIVE
claude-sonnet-5-5$0.55$0.01 (возвращается)LIVE
glm-5.2$0.15$0.01 (возвращается)LIVE
glm-5.3$0.15$0.01 (возвращается)LIVE
glm-5.3-flash$0.10$0.01 (возвращается)LIVE
gpt-5.4$0.10$0.01 (возвращается)ВРЕМЕННО НЕДОСТУПНА
gpt-5.4-20$0.10$0.01 (возвращается)ВРЕМЕННО НЕДОСТУПНА
gpt-5.4-mini$0.09$0.01 (возвращается)ВРЕМЕННО НЕДОСТУПНА
claude-haiku-4-5$0.075$0.01 (возвращается)ВРЕМЕННО НЕДОСТУПНА
claude-opus-4-5$0.30$0.01 (возвращается)ВРЕМЕННО НЕДОСТУПНА
claude-sonnet-4-5$0.15$0.01 (возвращается)ВРЕМЕННО НЕДОСТУПНА
claude-sonnet-4-6$0.25$0.01 (возвращается)ВРЕМЕННО НЕДОСТУПНА
deepseek-flash$0.03$0.01 (возвращается)ВРЕМЕННО НЕДОСТУПНА
deepseek-v4-flash$0.20$0.01 (возвращается)ВРЕМЕННО НЕДОСТУПНА
deepseek-v4-pro$0.02$0.01 (возвращается)ВРЕМЕННО НЕДОСТУПНА
glm-5$0.12$0.01 (возвращается)ВРЕМЕННО НЕДОСТУПНА
glm-5.1$0.16$0.01 (возвращается)ВРЕМЕННО НЕДОСТУПНА
qwen-3.8$0.25$0.01 (возвращается)ВРЕМЕННО НЕДОСТУПНА
qwen3.5-plus$0.05$0.01 (возвращается)ВРЕМЕННО НЕДОСТУПНА
qwen3.6-plus$0.04$0.01 (возвращается)ВРЕМЕННО НЕДОСТУПНА
qwen3.7-max$0.11$0.01 (возвращается)ВРЕМЕННО НЕДОСТУПНА
qwen3.7-plus$0.03$0.01 (возвращается)ВРЕМЕННО НЕДОСТУПНА
kimi-k2.5$0.07$0.01 (возвращается)ВРЕМЕННО НЕДОСТУПНА
kimi-k2.6$0.11$0.01 (возвращается)ВРЕМЕННО НЕДОСТУПНА
kimi-k3$0.24$0.01 (возвращается)ВРЕМЕННО НЕДОСТУПНА
mimo-v2-omni$0.05$0.01 (возвращается)ВРЕМЕННО НЕДОСТУПНА
mimo-v2-pro$0.05$0.01 (возвращается)ВРЕМЕННО НЕДОСТУПНА
mimo-v2.5$0.01$0.01 (возвращается)ВРЕМЕННО НЕДОСТУПНА
mimo-v2.5-pro$0.03$0.01 (возвращается)ВРЕМЕННО НЕДОСТУПНА
minimax-m2.5$0.02$0.01 (возвращается)ВРЕМЕННО НЕДОСТУПНА
minimax-m2.7$0.04$0.01 (возвращается)ВРЕМЕННО НЕДОСТУПНА
minimax-m3$0.04$0.01 (возвращается)ВРЕМЕННО НЕДОСТУПНА
gpt-4o-transcribe$0.10$0.01 (возвращается)ВРЕМЕННО НЕДОСТУПНА
gpt-image-1.5$20.00$0.01 (возвращается)ВРЕМЕННО НЕДОСТУПНА
gpt-image-2$0.10$0.01 (возвращается)ВРЕМЕННО НЕДОСТУПНА
gpt-image-2.5$20.00$0.01 (возвращается)ВРЕМЕННО НЕДОСТУПНА
gpt-image-2.5-flare$20.00$0.01 (возвращается)ВРЕМЕННО НЕДОСТУПНА
gpt-image-2.5-sunburst$20.00$0.01 (возвращается)ВРЕМЕННО НЕДОСТУПНА
Prepaid
Платите по факту

Пополните баланс и платите за использование. Средства резервируются до отправки запроса.

Официальные API
Раздельные ставки

Input, cached input и output могут иметь разные цены и уровни контекста.

Exact usage
Списание по usage

Временный резерв защищает wallet, а итоговый charge считает только terminal tokens из API.

Примеры одинаковой нагрузки

Ниже одна и та же нагрузка: 80K input + 20K output (100K токенов), по стандартным тарифам short context. Это сравнение формы биллинга, а не утверждение об одинаковом качестве моделей.

СемействоBlended Model.saleПример Model.saleОфициальный split-пример
GPT-5.6 Terra$0.15/M$0.015$0.40 · $0.16 input + $0.24 output
GPT-5.6 Sol$0.45/M$0.045$0.72 · $0.32 input + $0.40 output
GPT-6 Astra$1.125/M$0.1125$1.80 · $0.80 input + $1.00 output

Model.sale применяет одну blended-ставку к 100K charged tokens (одна десятая тарифа за 1M). Официальный пример использует стандартные short-context ставки input/output к тем же объёмам; cached input, reasoning surcharges и long-context tiers исключены. При другой mix результат изменится.

Prepaid API и подписка

ВопросPrepaid APIПодписочный продукт
ОплатаБаланс, затем фактическое использованиеРегулярная плата за план или место
Кому подходитПеременная нагрузка, скрипты, coding agentsФиксированные места и функции продукта
ПрозрачностьЗапросы, токены и ledgerКвоты или лимиты плана
Контроль бюджетаЛимиты ключа и дневной capОтмена регулярного платежа

Популярные альтернативы API

Model.sale — prepaid-сервис с единым публичным каталогом. Ниже собраны распространённые альтернативы, но это разные типы продукта: агрегаторы, прямые платформы open-моделей и low-latency API. Таблица сравнивает документированные условия, а не качество моделей и не обещает универсальную «самую низкую цену».

СервисБиллингКаталог / маршрутизацияКому подходитПроверено
OpenRouter
Multi-provider aggregator
Standard pay-as-you-go lists a 5.5% platform fee; Business lists 8%. The current pricing page also documents a BYOK allowance and a fee after the allowance.The current Standard plan lists 500+ models and 80+ providers; its Free plan lists 25+ models and 4 providers. Standard includes auto-routing, preferred-provider selection, budgets and spend controls.Teams that want breadth and provider choice in one account.
Компромисс: A broad catalog and routing controls add choices; the platform fee and exact model billing still belong in the workload estimate.
2026-10-01 · источник
Together AI
Open-model inference platform
Serverless rates are listed per 1M input and output tokens, with separate batch pricing on eligible models; dedicated and provisioned capacity have different billing units.The live pricing page lists model-specific rates across open-model families, including DeepSeek, Qwen, Kimi, GLM and others. Choose a model from its catalog; provisioned throughput and dedicated inference are separate capacity options.Developers who want a direct API and a broad open-model catalog.
Компромисс: Compare input, cached input, output and batch rates separately; dedicated capacity is not comparable to serverless token billing.
2026-10-01 · источник
Fireworks AI
Inference platform
Self-serve accounts moved to prepaid credits on July 1, 2026; contracted accounts are excluded from that migration. Serverless inference is per token, and on-demand deployments are priced per GPU-second.Serverless open-model inference plus separate training and dedicated deployment products. Choose a serverless model and tier, or provision a deployment; these are distinct products rather than one cross-provider router.Teams that want token-billed serverless inference and a path to dedicated GPU deployment.
Компромисс: Self-serve prepaid credits are closer to a prepaid wallet, but credit rules and GPU-second deployment pricing still differ; compare the same workload and capacity assumptions.
2026-10-01 · источник
Groq
Low-latency inference platform
Developer-tier usage is invoiced monthly or at progressive usage thresholds; a payment method is required to upgrade from Free.A focused list of production and preview models, with model-specific prices, limits and lifecycle notes. Select a Groq-hosted model; the product is an inference platform, not a broad multi-provider router.Latency-sensitive workloads that fit the currently hosted models and account limits.
Компромисс: Postpaid billing, model-specific limits and preview lifecycle differ from a prepaid multi-family catalog.
2026-10-01 · источник

Тарифы, комиссии, модели и лимиты меняются. Перед production запуском откройте источник и проверьте условия ещё раз. Model.sale не аффилирован с перечисленными сервисами.

Какой API подходит вашей нагрузке?

Начните с нужной модели работы. Каталоги, комиссии, правила оплаты и возможности меняются; для каждой альтернативы ориентируйтесь на датированный официальный источник выше.

Если вам нужно…СравнитеЧем может подойтиЧто проверить
Один prepaid-баланс и небольшой проверенный каталогModel.saleОдин аккаунт, API-ключ и usage-записи по каждому запросу.Модель доступна сейчас, нужный endpoint работает, тариф подходит token mix.
Много моделей, поставщиков и настроек маршрутизацииOpenRouterШирокий каталог, выбор поставщика и задокументированные параметры маршрутизации.Комиссии, выбор маршрута, лимиты поставщиков и поведение fallback.
Прямой доступ к inference open-моделейTogether AIТарифы serverless по моделям и отдельные варианты выделенной мощности.Цены input/output/cache и сравнивается ли serverless с резервируемой мощностью.
Prepaid-кредиты на inference или выделенные GPUFireworks AIServerless-токены и отдельный путь к выделенным deployments.Правила кредитов и автопополнения; GPU-time не является ценой за токены.
Узкий каталог для inference с низкой задержкойGroqProduction- и preview-модели с опубликованными лимитами.Актуальный lifecycle модели, лимиты аккаунта и условия postpaid-биллинга.

Подробные сравнения

Платформы open-моделей

Together, Fireworks и Groq

Сравните способы запуска, оплату, мощность и операционные компромиссы.

Открыть руководство →

Как посчитать эффективную стоимость

  1. Возьмите репрезентативный час или день запросов.
  2. Разделите input, cached и output tokens, retries и disconnect.
  3. Примените правила каждой официальной модели.
  4. Примените blended rate Model.sale к фактическому charged-token total; initial reservation возвращается после settlement.
  5. Сравните итог вместе с latency, availability и возможностями модели.

Reference rows ниже датированы и ведут на официальные источники. Они не означают, что соответствующая модель подключена в Model.sale, и не являются benchmark или обещанием parity.

Официальные опубликованные ставки

USD за миллион токенов по стандартному тарифу short context. Cached input означает OpenAI cached input или Anthropic cache-read, где применимо. Cache writes, long context, batch и другие надбавки не включены. Reference-цена не означает доступность модели через Model.sale; доступность отдельно указана выше.

МодельInputCached input / cache readOutputИсточник
OpenAI GPT-6 Astra$10.00$1.00$50.00Официальный тариф
OpenAI GPT-6.1 Sol$2.00$0.10$10.00Официальный тариф
OpenAI GPT-6 Luna$0.10$0.01$0.50Официальный тариф
OpenAI GPT-5.6 Sol$4.00$0.40$20.00Официальный тариф
OpenAI GPT-5.6 Terra$2.00$0.20$12.00Официальный тариф
Anthropic Claude Opus 5.5$4.00$0.20$20.00Официальный тариф
Anthropic Claude Sonnet 5.5$2.00$0.20$10.00Официальный тариф
Anthropic Claude Haiku 4.5$1.00$0.10$5.00Официальный тариф
Anthropic Claude Opus 4.8$5.00$0.50$25.00Официальный тариф
Anthropic Claude Sonnet 4.6$3.00$0.30$15.00Официальный тариф

Не утверждение эквивалентности

Официальная ставка не доказывает доступность такой же модели в каталоге Model.sale. Названия, context limits и качество могут различаться; таблица сравнивает только форму биллинга.

Цены меняются

Проверяйте дату и официальный источник перед расчётом бюджета.

Нужна формула?

Откройте методику цен для measured usage, reservation и settlement.