Wiki / Core Features / AudioToText

AudioToText

Bijgewerkt door Maxime_48 · 3 uur geleden · Weergaven: 110

Talen: English Français Deutsch Español Português (Brasil) Italiano Nederlands Polski Türkçe Русский 日本語 한국어 中文

AudioToText zet audio om in tekst via transcriptie.

Het staat los van het volledig opnemen van spraakkanalen en is bedoeld voor wanneer je server audioberichten of -bestanden in leesbare tekst wil omzetten.

De instellingenpagina van AudioToText: transcriptiekanalen, API-sleutel, de twee schakelaars voor automatisch transcriberen en het transcriptiemodel


🎙️ Wat AudioToText doet

AudioToText neemt ondersteunde audio-invoer en maakt er een transcriptie van.

Dat kan helpen bij:

  • Toegankelijkheid
  • Controle voor moderatie
  • Vergadernotities
  • Samenvattingen van spraakberichten
  • Doorzoekbare archieven

⚙️ Configuratie

Afhankelijk van hoe je server is ingesteld, kan AudioToText het volgende vereisen:

  • Een kanaal waarin audio wordt verwerkt
  • Een API-sleutel
  • Een transcriptiemodel
  • Optioneel een eigen transcriptie-endpoint
  • Beperkingen op rollen of kanalen

🔌 Eigen transcriptie-endpoint

AudioToText kan een eigen, met Whisper compatibel transcriptie-endpoint gebruiken.

Dat is handig als je je eigen provider of een zelf gehoste transcriptieservice wilt gebruiken.

Zie Custom AI Model Endpoints voor meer details.


🧠 Het transcriptiemodel kiezen

Het veld Transcriptiemodel toont de modellen die je endpoint echt aanbiedt - het panel vraagt het eraan, in plaats van een lijst te tonen die uit het hoofd is geschreven - en houdt alleen de modellen over die kunnen transcriberen.

Laat je het leeg, dan wordt whisper-1 gebruikt, wat OpenAI aanbiedt. Als je AudioToText naar je eigen server laat wijzen, is dit het veld waar het om draait: een faster-whisper- of distil-whisper-instantie luistert zelden naar de naam whisper-1, en het vragen om een model dat die niet heeft is meestal de reden dat een zelf gehost endpoint niets teruggeeft.


↔️ Verschil met Audio-opname

AudioToText richt zich op transcriptie.

Audio-opname richt zich op het opnemen van gesprekken in spraakkanalen en kan er optioneel transcriptie en samenvattingen aan toevoegen.

Gebruik AudioToText als je vooral audio in tekst wilt omzetten. Gebruik Audio-opname als je een volledige sessie in een spraakkanaal wilt vastleggen.


💡 Tips

  • Test eerst met korte audio.
  • Controleer of het bestandsformaat wordt ondersteund.
  • Gebruik heldere audio voor betere resultaten.
  • Gebruik transcriptie niet voor gevoelige privéaudio, tenzij je server een duidelijk beleid heeft.
  • Bekijk transcripties na voordat je erop vertrouwt voor moderatie of officiële notities.