Zurück zur Übersicht
OpenAI hat drei neue Modelle für Echtzeit-Sprache, Übersetzung und Transkription in seine API aufgenommen. Der Ausbau richtet sich an Entwickler von Sprachassistenten, Voice-Interfaces und Live-Übersetzung.
OpenAI hat seine API um drei neue Audio-Modelle erweitert: GPT-Realtime-2, GPT-Realtime-Translate und GPT-Realtime-Whisper.
GPT-Realtime-2 ist für Echtzeit-Sprachanwendungen mit stärkerem Reasoning ausgelegt. GPT-Realtime-Translate dient der Live-Übersetzung, GPT-Realtime-Whisper der Streaming-Transkription. OpenAI positioniert das Update damit klar für Anwendungen, die Sprache in Echtzeit verstehen, übersetzen und beantworten müssen.
Der Kommentarbereich wird geladen, sobald du ihn erreichst.
Weiterlesen
Microsoft bringt die Modelle von xAI zunächst als Vorschau in seine Copilot Anwendungen. Der Zugang bleibt in der Europäischen Union, der EFTA und im Vereinigten Königreich vorerst ausgeschlossen.
US-Präsident Donald Trump setzt im Wettbewerb mit China auf eine schnelle Entwicklung künstlicher Intelligenz. Zugleich hält er begrenzte Leitplanken für möglich, nennt Warnungen vor künftigen Risiken aber übertrieben.
OpenAI-Chef Sam Altman schließt einen Börsengang des Unternehmens im Jahr 2026 aus. Als Grund nennt er unter anderem offene Fragen zur Sicherheit und Ausrichtung leistungsfähiger KI-Systeme.
Die öffentliche Beta macht den von Codex genutzten Agenten-Harness für Entwickler zugänglich. Die Schnittstelle verwaltet Kontext, Werkzeuge und parallel arbeitende Teilagenten über längere Arbeitsabläufe hinweg.