Модели/Whisper
Расшифруйте в Whisper — разберём мы.
Whisper — открытая модель распознавания речи: понимает почти сотню языков, запускается прямо на ноутбуке, платить за неё не нужно. Для пары записей этого достаточно. У нас Whisper не подключён; наша работа начинается там, где записи идут потоком и после каждой кто-то должен ответить, занести и поручить.
Распознавание речи в платформе
Разовая расшифровка и поток записей
Задачи разные, и решаются они разными инструментами.
Whisper на своём компьютере
- Надо разово расшифровать несколько файлов
- Аудио не должно покидать ваш компьютер вообще
- Языков много и они редкие
- Бюджета нет, а руки есть
Сотрудник в платформе
- Записей десятки в день и они идут сами
- После каждой нужно ответить, занести, поручить
- Расшифровку должен читать не человек, а тот, кто сразу сделает следующий шаг
- Нужна история: кто, когда и о чём договаривался раньше
Как это использовать у нас
Первый месяц бесплатно и без карты.
- 1
Нанимаете сотрудника
Того, к кому звук приходит по работе: поддержку, продажи, ассистента.
- 2
Подключаете распознавание
Карточкой в маркете коннекторов: SaluteSpeech по ключу Сбера или Yandex SpeechKit по IAM-ключу. Оба обрабатывают звук в России.
- 3
Заводите источники звука
Мессенджеры, телефония, встречи. Дальше записи приходят сами, приносить файлы руками не нужно.
- 4
Проверяете по результату
Смотрите не на текст расшифровки, а на то, что после неё изменилось: ответ клиенту, карточка сделки, протокол.
Расшифровка — самая заметная часть работы и самая простая. Дорого обходится то, что должно происходить после неё.
Отдайте ему неделю записей
Месяц бесплатно, карта не нужна. Ключ распознавания — ваш.