LLM API
OpenAI-совместимый API нейросетей: Claude, GPT, Gemini и российские модели по одному ключу
73 модели от 13 провайдеров, включая Яндекс и Сбер. Работает из России без VPN. Меняете адрес и ключ в коде на OpenAI SDK, остальное работает как раньше. Оплата в рублях картой, по СБП или по счёту с документами.
- Один ключ и один баланс для всех моделей
- 9 моделей с обработкой в России
- Договор, акты и ЭДО для компаний
from openai import OpenAI client = OpenAI( base_url="https://get.llmlink.ru/v1", api_key="llm-...",) client.chat.completions.create( model="anthropic/claude-fable-5", messages=[...],)- 1 адрес LLMLink
- 2 ваш ключ
Что мешает подключить нейросети напрямую
Оплата
Зарубежные сервисы просят иностранную карту и телефон. Посредники с переводом в валюте добавляют риск и время.
Десяток кабинетов
Для каждой модели свой аккаунт, ключ, баланс и формат запроса. Сменить модель значит переписать интеграцию.
Документы
Бухгалтерии нужны договор, счёт и акты. С зарубежным сервисом их взять негде.
Расходы команды
Ключ один на всех, кто сколько потратил и на что, видно только в конце месяца.
Один адрес, один ключ, любые модели каталога
Запросы идут в формате OpenAI: /v1/chat/completions, /v1/embeddings, /v1/audio/transcriptions, /v1/audio/speech, /v1/images/generations, /v1/models. Модель выбираете полем model, переключение между моделями занимает одну строку.
- Ваше приложение
- Cursor
- n8n
Claude, GPT, Gemini и др.
- OpenAI
- Alibaba (Qwen)
- Z.ai
- Anthropic
- и ещё 6
Обработка в России
- Яндекс
- Сбер
- 65 моделей для чата, из них с рассуждением 31, с пониманием картинок 35
- Контекст до 2 млн токенов
- Кроме чата: эмбеддинги, распознавание речи, синтез речи и генерация изображений
73 модели от 13 провайдеров
Каталог обновляется: новые модели появляются в нём и в API одновременно. Цены за миллион токенов в рублях на странице «Модели и цены».
- Яндекс 6
- Anthropic 4
- Mistral AI 4
- DeepSeek 3
- Google 10
- Сбер 3
- Z.ai 6
- OpenAI 16
- xAI (Grok) 2
- Moonshot AI (Kimi) 3
- Meta (Llama) 3
- MiniMax 3
- Alibaba (Qwen) 10
Claude Fable 5
1MAnthropic
Флагман Anthropic: сложный код, агентные задачи, длинные диалоги.
DeepSeek Chat
164KDeepSeek
Классическая модель DeepSeek для общих задач, отвечает сразу, без рассуждений.
Gemini 2.5 Flash
1MНедорогая рабочая модель с длинным контекстом и изображениями на входе.
Llama 3.1 8B
131KMeta (Llama)
Самая дешёвая модель каталога: простые задачи, классификация, большой поток.
MiniMax M2.5
205KMiniMax
Недорогая китайская модель с длинным контекстом; рассуждает перед ответом.
Alice AI
Яндекс
Модель Алисы от Яндекса, разговорная. Данные обрабатываются в России.
Модели с обработкой в России
9 моделей каталога работают на серверах в России: Alice AI, Alice AI Flash, Yandex SpeechKit, YandexGPT, YandexGPT Lite; GigaChat 2 Lite/Max/Pro. Подходит для задач, где данные клиентов и сотрудников должны оставаться в стране. Выбираете такую модель полем model, ключ и баланс те же.
Alice AI
Яндекс
Модель Алисы от Яндекса, разговорная. Данные обрабатываются в России.
Alice AI Flash
Яндекс
Быстрая и недорогая модель Алисы для потока коротких задач.
GigaChat 2 Lite
Сбер
Младшая модель Сбера: недорогая, для простых задач и большого потока.
GigaChat 2 Max
Сбер
Старшая модель Сбера. Данные обрабатываются в России.
GigaChat 2 Pro
Сбер
Средняя модель Сбера для повседневных задач. Данные обрабатываются в России.
Yandex SpeechKit
Яндекс
Синтез речи Яндекса: текст на входе, звук на выходе. Тарифицируется символами исходного текста, а не длительностью звука — за одну фразу, сказанную медленно и быстро, цена одна. Предел одного запроса — 4900 символов. Форматы: mp3, opus, wav, pcm. Обработка в РФ.
Yandex SpeechKit — распознавание
Яндекс
Распознавание речи Яндекса: звук на входе, текст на выходе. Принимает ТОЛЬКО .ogg (Opus) и .wav (16 бит, моно, 8000/16000/48000 Гц) — mp3 апстрим не берёт. Запись до 30 секунд и до 1 МБ. Тарифицируется блоками по 15 секунд с округлением вверх, как у поставщика: ролик в 3 секунды стоит как 15. response_format — json или text; srt, vtt и verbose_json не поддерживаются, таймингов апстрим не отдаёт. Обработка в РФ.
YandexGPT
Яндекс
Старшая модель Яндекса. Данные обрабатываются в России.
YandexGPT Lite
Яндекс
Младшая модель Яндекса: дешевле старшей вчетверо.
Нужно, чтобы данные оставались в офисе? Локальный ИИ
Подключите ключ в Cursor, n8n и других инструментах
Ключ работает везде, где можно указать адрес OpenAI-совместимого API и ключ.
Cursor
Редактор кодаРедактор кода с ИИ-агентом: пишет, правит и объясняет код в проекте.
Cline
Редактор кодаИИ-агент в VS Code: правит файлы и запускает команды, каждый шаг под вашим контролем.
OpenCode
Агент для кодаОткрытый агент для программирования в терминале и редакторе.
OpenClaw
ИИ-агентЛичный ИИ-агент: ведёт задачи, почту и календарь, общается с вами в мессенджере.
Hermes Agent
ИИ-агентОткрытый ИИ-агент от Nous Research: запоминает контекст, учится навыкам и работает с вашими инструментами.
n8n
АвтоматизацияКонструктор автоматизаций: ИИ-агенты связывают почту, CRM, таблицы и мессенджеры.
LangChain
ФреймворкБиблиотека для своих ИИ-приложений: агенты, поиск по документам и цепочки запросов.
Verity
ИгрыИИ-компаньон в Minecraft: говорит голосом и помогает в игре.
Гайд по настройке
API для команды и компании
Договор и ЭДО
Работаем по договору, счёт, акты и документы через ЭДО.
Ключи сотрудникам
У каждого свой ключ, отозвать или заменить можно в один клик.
Группы и лимиты
Отделы и проекты деревом, лимит на группу и на сотрудника, общий баланс компании.
Расходы по людям и моделям
Кто, на какую модель и сколько потратил, видно в кабинете в любой день.
Модели на сервере в вашем офисе: Локальный ИИ
Как получить API ключ
- 1ЗарегистрируйтесьПочта и пароль, для компании реквизиты.
- 2Пополните балансКартой, по СБП или по счёту для юрлица.
- 3Создайте ключ и отправьте первый запросСкопируйте ключ в кабинете и подставьте адрес https://get.llmlink.ru/v1.
Частые вопросы
Подключите нейросети по API за пять минут
Регистрация, пополнение и первый запрос в одном кабинете.
