Zum Hauptinhalt springen
Für Entwickler, die Audio-Unterstützung benötigen, bietet Infercom das Whisper large-v3 Modell von OpenAI, das Echtzeit-Transkriptionen und Übersetzungen ermöglicht.

Whisper-Large-v3

  • Modell: Whisper-Large-v3
  • Beschreibung: Hochmodernes automatisches Spracherkennungs- (ASR) und Übersetzungsmodell. Entwickelt von OpenAI und trainiert auf über 5 Millionen Stunden gelabeltem Audio. Hervorragend geeignet für mehrsprachige und Zero-Shot-Sprachaufgaben in verschiedenen Bereichen.
  • Modell-ID: Whisper-Large-v3
  • Unterstützte Sprachen: Mehrsprachig

Kernfähigkeiten

  • Transkribiert und übersetzt erweiterte Audio-Eingaben (bis zu 25 MB).
  • Zeigt hohe Genauigkeit bei Spracherkennungs- und Übersetzungsaufgaben.
  • Bietet OpenAI-kompatible Endpunkte für Transkriptionen und Übersetzungen.

Anfrageparameter

Beispielverwendung