VibeLab

Модели/Whisper

Расшифруйте в Whisper — разберём мы.

Whisper — открытая модель распознавания речи: понимает почти сотню языков, запускается прямо на ноутбуке, платить за неё не нужно. Для пары записей этого достаточно. У нас Whisper не подключён; наша работа начинается там, где записи идут потоком и после каждой кто-то должен ответить, занести и поручить.

Распознавание речи в платформе

Whisperне подключён
SaluteSpeech (Сбер) — по умолчаниювашим ключом
Yandex SpeechKit — вторымвашим ключом
Голосовые, записи звонков и встречработает

Разовая расшифровка и поток записей

Задачи разные, и решаются они разными инструментами.

Whisper на своём компьютере

  • Надо разово расшифровать несколько файлов
  • Аудио не должно покидать ваш компьютер вообще
  • Языков много и они редкие
  • Бюджета нет, а руки есть

Сотрудник в платформе

  • Записей десятки в день и они идут сами
  • После каждой нужно ответить, занести, поручить
  • Расшифровку должен читать не человек, а тот, кто сразу сделает следующий шаг
  • Нужна история: кто, когда и о чём договаривался раньше

Как это использовать у нас

Первый месяц бесплатно и без карты.

  1. 1

    Нанимаете сотрудника

    Того, к кому звук приходит по работе: поддержку, продажи, ассистента.

  2. 2

    Подключаете распознавание

    Карточкой в маркете коннекторов: SaluteSpeech по ключу Сбера или Yandex SpeechKit по IAM-ключу. Оба обрабатывают звук в России.

  3. 3

    Заводите источники звука

    Мессенджеры, телефония, встречи. Дальше записи приходят сами, приносить файлы руками не нужно.

  4. 4

    Проверяете по результату

    Смотрите не на текст расшифровки, а на то, что после неё изменилось: ответ клиенту, карточка сделки, протокол.

Расшифровка — самая заметная часть работы и самая простая. Дорого обходится то, что должно происходить после неё.

Отдайте ему неделю записей

Месяц бесплатно, карта не нужна. Ключ распознавания — ваш.