Каталог AI моделей
Единый API к моделям разных провайдеров. Оплата в рублях, без VPN.
71 моделей
Alice AI
Яндекс
Модель Алисы от Яндекса, разговорная. Данные обрабатываются в России.
Ввод
834 ₽ / 1M
Вывод
2 000 ₽ / 1M
Alice AI Flash
Яндекс
Быстрая и недорогая модель Алисы для потока коротких задач.
Ввод
167 ₽ / 1M
Вывод
334 ₽ / 1M
Claude Fable 5
1MAnthropic
Флагман Anthropic: сложный код, агентные задачи, длинные диалоги.
Ввод
2 070 ₽ / 1M
Вывод
9 900 ₽ / 1M
Claude Haiku 4.5
1MAnthropic
Быстрая и недорогая, для простых задач и большого потока.
Ввод
207 ₽ / 1M
Вывод
1 035 ₽ / 1M
Claude Opus 5
1MAnthropic
Тяжёлые рассуждения и код, окно контекста 1 млн токенов.
Ввод
900 ₽ / 1M
Вывод
4 500 ₽ / 1M
Claude Sonnet 5
1MAnthropic
Рабочая модель на каждый день: код, тексты, агенты.
Ввод
414 ₽ / 1M
Вывод
2 070 ₽ / 1M
Codestral
256KMistral AI
Модель Mistral для программирования: дополнение и правка кода, разбор файлов.
Ввод
62,1 ₽ / 1M
Вывод
187 ₽ / 1M
DeepSeek Chat
164KDeepSeek
Классическая модель DeepSeek для общих задач, отвечает сразу, без рассуждений.
Ввод
47,37 ₽ / 1M
Вывод
190 ₽ / 1M
DeepSeek V4 Flash
1.0MDeepSeek
Быстрая и очень дешёвая модель для потока задач; умеет рассуждать.
Ввод
20,35 ₽ / 1M
Вывод
40,7 ₽ / 1M
DeepSeek V4 Pro
1.0MDeepSeek
Флагман DeepSeek: рассуждает перед ответом, сильна в коде и математике.
Ввод
90,05 ₽ / 1M
Вывод
181 ₽ / 1M
Gemini 2.5 Flash
1.0MНедорогая рабочая модель с длинным контекстом и изображениями на входе.
Ввод
62,1 ₽ / 1M
Вывод
518 ₽ / 1M
Gemini 2.5 Flash Image
Генерация изображений по описанию. Зовётся как обычный чат и отвечает текстом, если о картинке не просить. Картинка приходит байтами в data-URI, одна за вызов. Поток не поддерживается: в нём поставщик изображение не присылает вовсе.
Ввод
62,1 ₽ / 1M
Вывод
517,5 ₽ / 1M
output_image_tokens
6 210 ₽ / 1M / 1M
Gemini 3 Pro Image
Старшая модель генерации изображений. Перед рисованием рассуждает, и токены рассуждения тарифицируются как текстовый выход. За один вызов возвращает несколько изображений байтами в data-URI — в замерах стабильно два. Поток не поддерживается.
Ввод
414 ₽ / 1M
Вывод
2 484 ₽ / 1M
output_image_tokens
24 840 ₽ / 1M / 1M
Gemini 3.1 Flash Image
Генерация изображений по описанию, поколение 3.1. Зовётся как обычный чат. Картинка приходит байтами в data-URI, одна за вызов; размер и цена вызова заметно плавают от запроса к запросу. Поток не поддерживается.
Ввод
103,5 ₽ / 1M
Вывод
621 ₽ / 1M
output_image_tokens
12 420 ₽ / 1M / 1M
Gemini 3.1 Flash Lite
1.0MСамая дешёвая из Gemini: отвечает сразу, без рассуждений — для потока задач.
Ввод
51,75 ₽ / 1M
Вывод
311 ₽ / 1M
Gemini 3.1 Pro
1.0MФлагман Google: длинный контекст, изображения на входе, рассуждает перед ответом.
Ввод
360 ₽ / 1M
Вывод
2 160 ₽ / 1M
Gemini 3.5 Flash
1.0MБыстрая модель текущего поколения, принимает изображения.
Ввод
310,5 ₽ / 1M
Вывод
1 863 ₽ / 1M
Gemma 3 12B
131KОткрытая модель Google, дешёвая, для простых задач и большого потока.
Ввод
8,28 ₽ / 1M
Вывод
26,91 ₽ / 1M
Gemma 4 31B
262KОткрытая модель Google покрупнее: заметно умнее младшей при невысокой цене.
Ввод
24,84 ₽ / 1M
Вывод
76,59 ₽ / 1M
GigaChat 2 Lite
Сбер
Младшая модель Сбера: недорогая, для простых задач и большого потока.
Ввод
109 ₽ / 1M
Вывод
109 ₽ / 1M
GigaChat 2 Max
Сбер
Старшая модель Сбера. Данные обрабатываются в России.
Ввод
1 084 ₽ / 1M
Вывод
1 084 ₽ / 1M
GigaChat 2 Pro
Сбер
Средняя модель Сбера для повседневных задач. Данные обрабатываются в России.
Ввод
834 ₽ / 1M
Вывод
834 ₽ / 1M
GLM 4.6V
131KZ.ai
Зрячая модель GLM: разбирает изображения и видео.
Ввод
62,1 ₽ / 1M
Вывод
187 ₽ / 1M
GLM 4.7
205KZ.ai
Рабочая модель GLM: близка к старшим по качеству, заметно дешевле.
Ввод
82,8 ₽ / 1M
Вывод
363 ₽ / 1M
GLM 4.7 Flash
203KZ.ai
Самая дешёвая в линейке GLM, с рассуждением; для потока задач.
Ввод
12,42 ₽ / 1M
Вывод
82,8 ₽ / 1M
GLM 5.2
1.0MZ.ai
Флагман китайской лаборатории Zhipu: контекст миллион токенов, рассуждает перед ответом.
Ввод
249 ₽ / 1M
Вывод
849 ₽ / 1M
GLM 5.3
1.3MZ.ai
Старший GLM: контекст 1,3 млн токенов, рассуждает перед ответом.
Ввод
290 ₽ / 1M
Вывод
910 ₽ / 1M
cached_input_tokens
53,333333 ₽ / 1M / 1M
GLM 5.3 Flash
1.3MZ.ai
Дешёвый GLM 5.3: тот же контекст, рассуждение и картинки на входе; для потока задач.
Ввод
16 ₽ / 1M
Вывод
52 ₽ / 1M
cached_input_tokens
3,1 ₽ / 1M / 1M
GPT Audio
OpenAI
Голосовая модель OpenAI: принимает текст и отвечает речью. Подходит для озвучки ответов ассистента и голосовых сценариев, где нужен живой голос, а не механический синтез. Звук в ответе тарифицируется отдельными аудио-токенами.
Ввод
518 ₽ / 1M
Вывод
2 070 ₽ / 1M
Звук на входе
6 624 ₽ / 1M / 1M
Звук в ответе
13 248 ₽ / 1M / 1M
GPT Audio Mini
OpenAI
Младшая голосовая модель OpenAI: та же озвучка ответов, вчетверо дешевле старшей. Разумный выбор, когда голос нужен постоянно и в объёме, а не в единичных ответах.
Ввод
125 ₽ / 1M
Вывод
497 ₽ / 1M
Звук на входе
2 070 ₽ / 1M / 1M
Звук в ответе
4 140 ₽ / 1M / 1M
GPT-4.1
1.0MOpenAI
Рабочая модель OpenAI: контекст миллион токенов, точно следует инструкции, принимает изображения и файлы.
Ввод
414 ₽ / 1M
Вывод
1 656 ₽ / 1M
GPT-4.1 Mini
1.0MOpenAI
Младшая 4.1 при том же миллионном контексте: заметно дешевле старшей.
Ввод
82,8 ₽ / 1M
Вывод
332 ₽ / 1M
GPT-4.1 Nano
1.0MOpenAI
Самая дешёвая в семействе 4.1: миллионный контекст за небольшие деньги, для ботов и потока задач.
Ввод
20,7 ₽ / 1M
Вывод
82,8 ₽ / 1M
GPT-4o
128KOpenAI
Классическая мультимодальная модель OpenAI, по-прежнему поддерживается.
Ввод
518 ₽ / 1M
Вывод
2 070 ₽ / 1M
GPT-4o mini
128KOpenAI
Самое узнаваемое имя дешёвого яруса OpenAI: боты, разметка, простые ответы.
Ввод
31,05 ₽ / 1M
Вывод
125 ₽ / 1M
GPT-5 Nano
400KOpenAI
Дешёвая модель для ботов и потока простых задач.
Ввод
10,35 ₽ / 1M
Вывод
82,8 ₽ / 1M
GPT-5.6 Luna
1.1MOpenAI
Младшая модель поколения 5.6: текущее качество по цене дешёвого яруса.
Ввод
36 ₽ / 1M
Вывод
216 ₽ / 1M
GPT-5.6 Sol
1.1MOpenAI
Флагман OpenAI текущего поколения: сложные задачи, код, агенты; рассуждает перед ответом.
Ввод
900 ₽ / 1M
Вывод
5 400 ₽ / 1M
GPT-5.6 Terra
1.1MOpenAI
Средняя модель поколения 5.6: баланс цены и качества для повседневных задач.
Ввод
360 ₽ / 1M
Вывод
2 160 ₽ / 1M
GPT-OSS 120B
131KOpenAI
Открытая модель OpenAI: очень дёшево при разумном качестве, для агентов и ботов.
Ввод
8,08 ₽ / 1M
Вывод
37,26 ₽ / 1M
GPT-OSS 20B
131KOpenAI
Младшая открытая модель OpenAI: самая дешёвая у этого создателя.
Ввод
6,01 ₽ / 1M
Вывод
28,98 ₽ / 1M
Grok 4.20
2MxAI (Grok)
Модель xAI с очень длинным контекстом — до двух миллионов токенов; принимает изображения и файлы.
Ввод
259 ₽ / 1M
Вывод
518 ₽ / 1M
Grok 4.5
500KxAI (Grok)
Флагман xAI: рассуждает перед ответом, принимает изображения и файлы.
Ввод
414 ₽ / 1M
Вывод
1 242 ₽ / 1M
Kimi K2.5
262KMoonshot AI (Kimi)
Самая выгодная в линейке Kimi: длинный контекст, изображения на входе, отвечает без долгих рассуждений.
Ввод
82,8 ₽ / 1M
Вывод
394 ₽ / 1M
Kimi K2.7 Code
262KMoonshot AI (Kimi)
Модель Moonshot под программирование и агентные задачи в репозитории; рассуждает перед ответом.
Ввод
156 ₽ / 1M
Вывод
725 ₽ / 1M
Kimi K3
1.0MMoonshot AI (Kimi)
Флагман Moonshot: контекст до миллиона токенов, принимает изображения и видео, рассуждает перед ответом.
Ввод
621 ₽ / 1M
Вывод
3 105 ₽ / 1M
Llama 3.1 8B
131KMeta (Llama)
Самая дешёвая модель каталога: простые задачи, классификация, большой поток.
Ввод
4,14 ₽ / 1M
Вывод
10,35 ₽ / 1M
Llama 4 Maverick
1.0MMeta (Llama)
Старшая модель Llama 4 с открытыми весами: текст и изображения на входе, контекст до миллиона токенов.
Ввод
31,05 ₽ / 1M
Вывод
125 ₽ / 1M
Llama 4 Scout
1.3MMeta (Llama)
Младшая Llama 4: дешевле старшей, принимает изображения, очень длинный контекст.
Ввод
16,56 ₽ / 1M
Вывод
62,1 ₽ / 1M
MiniMax M2.5
205KMiniMax
Недорогая китайская модель с длинным контекстом; рассуждает перед ответом.
Ввод
31,05 ₽ / 1M
Вывод
239 ₽ / 1M
MiniMax M2.7
205KMiniMax
Следующая версия линейки M2: рассуждает, отвечает короче предшественницы.
Ввод
53,82 ₽ / 1M
Вывод
249 ₽ / 1M
MiniMax M3
1.0MMiniMax
Старшая модель MiniMax: контекст до миллиона токенов, рассуждает.
Ввод
62,1 ₽ / 1M
Вывод
249 ₽ / 1M
Mistral Large
262KMistral AI
Флагман французской лаборатории Mistral: текст, изображения и файлы на входе.
Ввод
104 ₽ / 1M
Вывод
311 ₽ / 1M
Mistral Nemo
131KMistral AI
Компактная и очень дешёвая модель для простых задач и большого потока.
Ввод
4,14 ₽ / 1M
Вывод
6,21 ₽ / 1M
Mistral Small
256KMistral AI
Недорогая рабочая модель Mistral, принимает изображения.
Ввод
15,53 ₽ / 1M
Вывод
41,4 ₽ / 1M
Qwen Plus
1MAlibaba (Qwen)
Известное имя линейки Qwen: миллионный контекст, ровное качество на общих задачах.
Ввод
53,82 ₽ / 1M
Вывод
162 ₽ / 1M
Qwen3 235B
262KAlibaba (Qwen)
Большая модель по цене младших: отвечает сразу, лучшее соотношение цены и класса в каталоге.
Ввод
14,7 ₽ / 1M
Вывод
20,7 ₽ / 1M
Qwen3 235B Thinking
262KAlibaba (Qwen)
Та же большая модель, но рассуждает перед ответом; цена входа и выхода одинаковая.
Ввод
20,7 ₽ / 1M
Вывод
20,7 ₽ / 1M
Qwen3 30B Instruct
262KAlibaba (Qwen)
Дешёвая и быстрая: отвечает сразу, хорошо держит русский. Для ботов и потока задач.
Ввод
9,97 ₽ / 1M
Вывод
39,97 ₽ / 1M
Qwen3 8B
131KAlibaba (Qwen)
Компактная модель с рассуждением по невысокой цене.
Ввод
10,35 ₽ / 1M
Вывод
82,8 ₽ / 1M
Qwen3 Coder Next
262KAlibaba (Qwen)
Модель Alibaba под программирование: отвечает коротко и по делу.
Ввод
24,84 ₽ / 1M
Вывод
166 ₽ / 1M
Qwen3 VL 235B
262KAlibaba (Qwen)
Зрячая модель Alibaba: разбирает изображения, отвечает без долгих рассуждений.
Ввод
41,4 ₽ / 1M
Вывод
183 ₽ / 1M
Qwen3.6 Flash
1MAlibaba (Qwen)
Быстрая модель текущего поколения: принимает изображения и видео, контекст миллион.
Ввод
38,82 ₽ / 1M
Вывод
233 ₽ / 1M
Qwen3.7 Max
1MAlibaba (Qwen)
Флагман Alibaba: контекст миллион токенов, рассуждает перед ответом.
Ввод
259 ₽ / 1M
Вывод
777 ₽ / 1M
Text Embedding 3 Large
OpenAI
Векторные представления текста, размерность 3072. Точнее младшей, дороже вшестеро.
Ввод
26,91 ₽ / 1M
Text Embedding 3 Small
OpenAI
Векторные представления текста, размерность 1536. Дёшево, для поиска по документам.
Ввод
4,14 ₽ / 1M
Whisper 1
OpenAI
Распознавание речи: звук на вход, текст на выход. Понимает русский и десятки других языков, годится для голосовых сообщений, диктовки и расшифровки записей. Тарифицируется длительностью звука, а не токенами; неполная секунда считается как целая.
Звук
0,0207 ₽ / 1M / секунда
Yandex SpeechKit
Яндекс
Синтез речи Яндекса: текст на входе, звук на выходе. Тарифицируется символами исходного текста, а не длительностью звука — за одну фразу, сказанную медленно и быстро, цена одна. Предел одного запроса — 4900 символов. Форматы: mp3, opus, wav, pcm. Обработка в РФ.
Текст
0,002237 ₽ / 1M / символ
Yandex SpeechKit — распознавание
Яндекс
Распознавание речи Яндекса: звук на входе, текст на выходе. Принимает ТОЛЬКО .ogg (Opus) и .wav (16 бит, моно, 8000/16000/48000 Гц) — mp3 апстрим не берёт. Запись до 30 секунд и до 1 МБ. Тарифицируется блоками по 15 секунд с округлением вверх, как у поставщика: ролик в 3 секунды стоит как 15. response_format — json или text; srt, vtt и verbose_json не поддерживаются, таймингов апстрим не отдаёт. Обработка в РФ.
Звук
0,018067 ₽ / 1M / секунда
YandexGPT
Яндекс
Старшая модель Яндекса. Данные обрабатываются в России.
Ввод
1 334 ₽ / 1M
Вывод
1 334 ₽ / 1M
YandexGPT Lite
Яндекс
Младшая модель Яндекса: дешевле старшей вчетверо.
Ввод
334 ₽ / 1M
Вывод
334 ₽ / 1M