Описание модели
Распознавание речи Яндекса: звук на входе, текст на выходе. Принимает ТОЛЬКО .ogg (Opus) и .wav (16 бит, моно, 8000/16000/48000 Гц) — mp3 апстрим не берёт. Запись до 30 секунд и до 1 МБ. Тарифицируется блоками по 15 секунд с округлением вверх, как у поставщика: ролик в 3 секунды стоит как 15. response_format — json или text; srt, vtt и verbose_json не поддерживаются, таймингов апстрим не отдаёт. Обработка в РФ.
Модальности
Типы данных на входе и выходе модели.
Цены
Стоимость за 1 миллион токенов. Оплата в рублях.
Звук
0,018067 ₽ / 1M / секунда
Как подключить эту модельOpenAI SDK
import OpenAI from 'openai'
const client = new OpenAI({
apiKey: 'sk-llmlink-xxx', // ключ из кабинета LLMLink
baseURL: 'https://get.llmlink.ru/v1',
})
const result = await client.chat.completions.create({
model: 'yandex/speechkit-stt',
messages: [{ role: 'user', content: 'Привет!' }],
})
console.log(result.choices[0]?.message)Используйте эту модель через LLMLink
Один ключ для всех моделей каталога. Создайте API-ключ в кабинете.