Калькулятор сравнения AI-моделей
Укажите ожидаемый месячный объём токенов и посмотрите расчётную стоимость по актуальным моделям Claude, GPT и Gemini бок о бок — плюс контекстное окно и максимальный output каждой модели, чтобы сравнивать не только цену, но и возможности.
Сравнение всех моделей
Сравнение всех моделей
| Модель | Поставщик | Контекстное окно | Макс. output | $/1M in | $/1M out | Расч. стоимость/мес |
|---|---|---|---|---|---|---|
| GPT-5.6 Luna | OpenAI | 1.05M | 128K | $0.20 | $1.20 | $4.40 |
| Gemini 3.5 Flash-Lite | 1.05M | 66K | $0.30 | $2.50 | $8.00 | |
| Gemini 3.6 Flash | 1.05M | 66K | $0.75 | $3.75 | $15.00 | |
| Claude Haiku 4.5 | Anthropic | 200K | 64K | $1.00 | $5.00 | $20.00 |
| Claude Sonnet 5 | Anthropic | 1M | 128K | $2.00 | $10.00 | $40.00 |
| GPT-5.6 Terra | OpenAI | 1.05M | 128K | $2.00 | $12.00 | $44.00 |
| Gemini 3.1 Pro Preview | 1.05M | 66K | $2.00 | $12.00 | $44.00 | |
| GPT-5.6 Sol | OpenAI | 1.05M | 128K | $4.00 | $20.00 | $80.00 |
| Claude Opus 5 | Anthropic | 1M | 128K | $5.00 | $25.00 | $100.00 |
Реальная цена Gemini 3.1 Pro Preview примерно удваивается для части ОДНОГО запроса свыше 200K токенов контекста — это тариф на конкретный запрос, а не на месячный объём. У калькулятора нет данных о том, как ваш месячный объём распределён по отдельным запросам, поэтому расчёт всегда идёт по базовому (≤200K) тарифу. Если вы регулярно отправляете запросы с контекстом свыше 200K токенов, реальная стоимость Gemini 3.1 Pro Preview будет выше показанной.
Цены и лимиты сверены с актуальными страницами тарифов каждого поставщика 25.08.2026 — цены на подписки/API меняются; перед планированием нагрузки проверьте актуальную страницу поставщика. Текущая цена Gemini 3.6 Flash явно помечена Google как действующая "до 31.12.2026" (промо-тариф) — после этой даты цену нужно проверить заново.
Как это считается
Месячная стоимость по каждой модели — это введённый объём input-токенов × цена модели за миллион input-токенов, плюс объём output-токенов × цена за миллион output-токенов — везде стандартный тариф API, без batch и без скидок на кеширование, чтобы сравнение было честным между поставщиками. Расчёт НЕ учитывает тарификацию по длине конкретного запроса (см. предупреждение у Gemini 3.1 Pro Preview), скидки batch API или prompt caching, а также стоимость мультимодальных токенов (изображения/аудио) — считается только обычный текстовый input/output по стандартному тарифу.
Частые вопросы
Почему у Gemini 3.1 Pro Preview есть предупреждение про 200K токенов?
Google тарифицирует эту модель по ОДНОМУ запросу: запросы с контекстом больше 200K токенов стоят примерно вдвое дороже за токен. Калькулятор знает только суммарный месячный объём, а не то, как он распределён по отдельным запросам, поэтому всегда считает по более дешёвому (≤200K) тарифу — реальная стоимость будет выше, если вы регулярно отправляете запросы с большим контекстом.
Учитываются ли скидки batch API или prompt caching?
Нет — каждая модель считается по стандартному тарифу API, без batch и без кеширования. Batch-обработка и prompt caching могут заметно снижать реальную стоимость для некоторых нагрузок; калькулятор намеренно их не учитывает, чтобы сравнение оставалось честным между всеми тремя поставщиками.
Откуда цены и как часто они обновляются?
Цены сверяются вручную с публичными страницами тарифов каждого поставщика и хранятся вместе с датой проверки (показана под таблицей) — калькулятор не опрашивает API поставщиков в реальном времени, поэтому перед планированием нагрузки всегда сверяйтесь с актуальной страницей поставщика.
Почему в каталоге только модели Claude, GPT и Gemini?
Первая версия покрывает трёх наиболее часто сравниваемых поставщиков. Другие поставщики могут появиться позже, но сегодня в каталоге их нет.
Часть категории Калькуляторы для разработки и AI-инструментов