AudioToText преобразует аудио в текст с помощью транскрипции.
Это отдельная функция от полной записи голосового канала, и её можно использовать, когда вашему серверу нужно превращать голосовые сообщения или файлы в читаемый текст.

🎙️ Что делает AudioToText
AudioToText принимает поддерживаемое аудио и создаёт транскрипцию.
Это помогает в:
- Доступности
- Проверке модерации
- Заметках о встречах
- Сводках голосовых сообщений
- Записях, по которым можно искать
⚙️ Настройка
В зависимости от конфигурации вашего сервера для AudioToText могут понадобиться:
- Канал, в котором обрабатывается аудио
- Ключ API
- Модель транскрипции
- Собственный эндпоинт транскрипции (по желанию)
- Ограничения по ролям или каналам
🔌 Собственный эндпоинт транскрипции
AudioToText может использовать собственный эндпоинт транскрипции, совместимый с Whisper.
Это удобно, если вы хотите использовать своего провайдера или собственную службу транскрипции.
Подробнее см. Custom AI Model Endpoints.
🧠 Выбор модели транскрипции
Поле «Модель транскрипции» перечисляет модели, которые ваш эндпоинт действительно публикует (панель спрашивает его об этом, а не показывает список, написанный по памяти), и оставляет только те, что умеют транскрибировать.
Если оставить его пустым, используется whisper-1 - то, что предоставляет OpenAI. Если вы направляете AudioToText на собственный сервер, именно это поле имеет значение: экземпляр faster-whisper или distil-whisper редко отзывается на имя whisper-1, а запрос несуществующей модели - обычная причина, по которой собственный эндпоинт ничего не возвращает.
↔️ Отличие от Audio Recording
AudioToText сосредоточен на транскрипции.
Audio Recording сосредоточен на записи разговоров в голосовых каналах и при желании может добавлять транскрипцию и сводки.
Используйте AudioToText, когда вам в основном нужно преобразовать аудио в текст. Используйте Audio Recording, когда нужно записать всю сессию голосового канала.
💡 Рекомендации
- Сначала проверьте на коротком аудио.
- Убедитесь, что формат файла поддерживается.
- Используйте чистый звук для лучших результатов.
- Не применяйте транскрипцию к конфиденциальному личному аудио, если на вашем сервере нет чёткой политики.
- Проверяйте транскрипции, прежде чем полагаться на них при модерации или в официальных заметках.