Wiki / Core Features / AudioToText

AudioToText

Обновлено Maxime_48 · 3 часа назад · Просмотры: 104

Языки: English Français Deutsch Español Português (Brasil) Italiano Nederlands Polski Türkçe Русский 日本語 한국어 中文

AudioToText преобразует аудио в текст с помощью транскрипции.

Это отдельная функция от полной записи голосового канала, и её можно использовать, когда вашему серверу нужно превращать голосовые сообщения или файлы в читаемый текст.

Страница настроек AudioToText: каналы транскрипции, ключ API, два переключателя автотранскрипции и модель транскрипции


🎙️ Что делает AudioToText

AudioToText принимает поддерживаемое аудио и создаёт транскрипцию.

Это помогает в:

  • Доступности
  • Проверке модерации
  • Заметках о встречах
  • Сводках голосовых сообщений
  • Записях, по которым можно искать

⚙️ Настройка

В зависимости от конфигурации вашего сервера для AudioToText могут понадобиться:

  • Канал, в котором обрабатывается аудио
  • Ключ API
  • Модель транскрипции
  • Собственный эндпоинт транскрипции (по желанию)
  • Ограничения по ролям или каналам

🔌 Собственный эндпоинт транскрипции

AudioToText может использовать собственный эндпоинт транскрипции, совместимый с Whisper.

Это удобно, если вы хотите использовать своего провайдера или собственную службу транскрипции.

Подробнее см. Custom AI Model Endpoints.


🧠 Выбор модели транскрипции

Поле «Модель транскрипции» перечисляет модели, которые ваш эндпоинт действительно публикует (панель спрашивает его об этом, а не показывает список, написанный по памяти), и оставляет только те, что умеют транскрибировать.

Если оставить его пустым, используется whisper-1 - то, что предоставляет OpenAI. Если вы направляете AudioToText на собственный сервер, именно это поле имеет значение: экземпляр faster-whisper или distil-whisper редко отзывается на имя whisper-1, а запрос несуществующей модели - обычная причина, по которой собственный эндпоинт ничего не возвращает.


↔️ Отличие от Audio Recording

AudioToText сосредоточен на транскрипции.

Audio Recording сосредоточен на записи разговоров в голосовых каналах и при желании может добавлять транскрипцию и сводки.

Используйте AudioToText, когда вам в основном нужно преобразовать аудио в текст. Используйте Audio Recording, когда нужно записать всю сессию голосового канала.


💡 Рекомендации

  • Сначала проверьте на коротком аудио.
  • Убедитесь, что формат файла поддерживается.
  • Используйте чистый звук для лучших результатов.
  • Не применяйте транскрипцию к конфиденциальному личному аудио, если на вашем сервере нет чёткой политики.
  • Проверяйте транскрипции, прежде чем полагаться на них при модерации или в официальных заметках.