Zurück zur Übersicht
OpenAI hat drei neue Modelle für Echtzeit-Sprache, Übersetzung und Transkription in seine API aufgenommen. Der Ausbau richtet sich an Entwickler von Sprachassistenten, Voice-Interfaces und Live-Übersetzung.
OpenAI hat seine API um drei neue Audio-Modelle erweitert: GPT-Realtime-2, GPT-Realtime-Translate und GPT-Realtime-Whisper.
GPT-Realtime-2 ist für Echtzeit-Sprachanwendungen mit stärkerem Reasoning ausgelegt. GPT-Realtime-Translate dient der Live-Übersetzung, GPT-Realtime-Whisper der Streaming-Transkription. OpenAI positioniert das Update damit klar für Anwendungen, die Sprache in Echtzeit verstehen, übersetzen und beantworten müssen.
Der Kommentarbereich wird geladen, sobald du ihn erreichst.
Weiterlesen