← К тестируемым моделям
Apache 2.0Базовая

OpenAI

Whisper — речь в текст

Превращает речь в текст

Оригинальная модель OpenAI под задачу «речь → текст» — основной релиз large-v3.

1,5 млрд параметровРечь и аудио~3 ГБ на диске

Как внедрить Whisper — речь в текст

Поставим модель на ваш сервер или в облако.

Установка у вас

На ваш сервер

Развернём модель на вашей инфраструктуре и передадим готовый запуск.

Срок5–7 раб. дн.

В работе

  • Развёртывание и настройка на вашем сервере
  • Готовый образ для запуска и инструкция
  • Примеры запросов и проверка работы
  • Рекомендуем: Сервер с 8 ГБ RAM или видеокарта от 4 ГБ, ~3 ГБ на диске

Дообучение и интеграция

Под ваш проект

Дообучим на ваших данных и встроим в продукт или процессы команды.

Срок6–10 нед.

В работе

  • Дообучение на ваших данных
  • Встраивание в продукт и процессы команды
  • Гарантии и выделенный инженер

Лицензия на веса модели — по условиям автора. Мы берём установку, настройку и сопровождение. Сроки — ориентир после согласования. Зависят от очереди, доступности видеокарт и объёма работ.

Демо

Подключаемся к серверу…

Транскрипт

Нажмите «Записать и отправить» и говорите в микрофон

Whisper — речь в текст — OpenAI · VELT