Zurück zur Übersicht
OpenAI will den Erfolg von KI-Systemen stärker an erledigter Arbeit und deren Kosten messen. Die Kennzahl „Useful Intelligence per Dollar“ soll den wirtschaftlichen Nutzen im Arbeitsablauf sichtbar machen.
OpenAI plädiert dafür, den wirtschaftlichen Wert von KI künftig nicht vor allem an Lizenzen, aktiven Nutzern oder Tokenkosten zu messen. Entscheidend sei, wie viel verwertbare Arbeit ein System zu welchem Preis erledigt.
In einem am 17. Juli 2026 veröffentlichten Beitrag nennt das Unternehmen dafür die Kennzahl „Useful Intelligence per Dollar“. Sie soll zeigen, ob relevante Arbeit erledigt wird, was eine erfolgreiche Aufgabe kostet, wie zuverlässig das Ergebnis ist und ob der Wert pro KI-Dollar mit zunehmender Nutzung steigt.
Als Beispiele nennt OpenAI gelöste Kundenanfragen, ausgelieferte Codeänderungen, geprüfte Verträge und vorbereitete Finanzprognosen. Damit verschiebt sich die Messlatte für KI-Projekte von der Nutzung zur nachweisbaren Wirkung im Arbeitsablauf. Das ist sinnvoller als Nutzerzahlen zu zählen, aber erst belastbar, wenn Unternehmen die Ergebnisse unabhängig prüfen.
Weiterlesen
ChatGPT soll anhand von Nutzersignalen erkennen, ob ein Konto einer minderjährigen Person gehört. In der EU soll die Funktion in den kommenden Wochen starten.
Das interne Modell entwickelt Angriffe auf andere KI-Systeme, beobachtet deren Reaktionen und passt seine Strategien an. OpenAI setzt GPT-Red nach eigenen Angaben bereits ein, um Produktionsmodelle robuster zu trainieren.
OpenAI bündelt seine Forschungs und Sicherheitsteams. Johannes Heidecke soll das Unternehmen verlassen, während Saachi Jain seine Aufgaben vorerst übernimmt.
Apple wirft OpenAI, io Products und zwei ehemaligen Mitarbeitern vor, vertrauliche Informationen für den Aufbau eines eigenen Hardwaregeschäfts genutzt zu haben. Die Klage verschärft den Konflikt um die geplante Consumer-Hardware von OpenAI.
Ein internes Audit von OpenAI stuft rund 30 Prozent der öffentlichen Aufgaben als fehlerhaft ein. Damit verliert der Benchmark seine Aussagekraft als Messlatte für die Leistungsfähigkeit von KI-Coding-Modellen.