💸 Anthropic und OpenAI liefern neue KI-Modelle

PLUS: 3 weitere Stories, Tipps & Tricks sowie KI-Ranking

Eine Woche ist vergangen und KI WEEKLY hält Dich auf dem neuesten Stand der KI-Welt.

IN DIESER AUSGABE

  • Google schickt KI-Chips zum Test ins All

  • Anthropic und OpenAI liefern neue KI-Modelle

  • EU-Bericht: Mit KI erledigte Hausaufgaben sind noch kein Lernerfolg

  • Claude übernimmt ein Viertel von Anthropics KI-Entwicklung

  • Unser wöchentliches Ranking, Tipps & Events

KI-TOOLS DER WOCHE

  1. 🎥 P-Video-2-Pro — Prunas Video-KI

  2. 📺️ Studio 4.0 — Der KI-Editor von ElevenLabs zum Erstellen und Bearbeiten von Videos, Musik und Soundeffekten

  3. 📽️ Dramagic — die Plattform von ByteDance für Kurzserien und Videoproduktion

  4. ⚙️ Jev — Das KI-Modell von TypeSafe ist nun allgemein verfügbar

  5. 📺️ Tesseract — Mirages Video-, Bewegungs- und Tonbearbeitungsprogramm für KI-Agenten

# Bonus: 📒 Notion - Jetzt mit der zweiten Generation von Notion AI: Dein smarter Partner für alles. 30 Tage kostenlos testen mit KI Weekly*

01

Bildquelle: Google

Google schickt KI-Chips zum Test ins All

Google will kommende Woche erstmals eigene KI-Chips ins All schicken. Ein Prototyp-Satellit soll erproben, ob die Hardware auch dort zuverlässig arbeitet. Der Flug gehört zum Forschungsprojekt Suncatcher.

  • Die mit dem Satellitenunternehmen Planet entwickelte Mission soll mit SpaceX starten. Sie untersucht, wie die Chips den Raketenstart überstehen und mit Strahlung im Orbit zurechtkommen.

  • Langfristig denkt Google an vernetzte Satelliten als Rechenzentren. In einer geeigneten Umlaufbahn könnten deren Solarmodule fast ununterbrochen Strom erzeugen. Die Grundidee hatte Google bereits 2025 vorgestellt.

  • Die Kühlung ist eine zentrale Hürde: Im Vakuum fehlt Luft, die Wärme abtransportiert. Google testet deshalb Wärmerohre und Flächen, die die Abwärme ins All abstrahlen.

  • 2027 sollen zwei weitere Satelliten unter anderem schnelle Datenverbindungen per Laser erproben. Damit könnten später mehrere Satelliten gemeinsam an großen KI-Aufgaben rechnen.

Warum das wichtig ist: Google verlegt eine klassische Standortfrage in den Orbit: Der Rechner soll dorthin, wo Energie reichlich verfügbar ist. Doch mehr Sonnenstrom bringt wenig, wenn Abwärme und Datenverkehr nur mit hohem Zusatzaufwand beherrschbar sind. Deshalb sind die unspektakulären Messungen dieses Testflugs wichtiger als spektakuläre Bilder von Rechenzentren im All.

02

KI-generierte Illustration: KI Weekly

Anthropic und OpenAI liefern neue KI günstiger

Anthropic und OpenAI haben am selben Tag neue Modelle mit niedrigeren Preisen vorgestellt: Claude Opus 5.5 soll nahe an Anthropics bisherige Spitzenklasse herankommen. GPT-6 Sol und Luna bringen Fortschritte des größeren Astra-Modells in günstigere Varianten.

  • Opus 5.5 erreicht laut Anthropic bei vielen Aufgaben das Niveau von Fable 5.1 und erzeugt Antworten über 30 Prozent schneller als Opus 5. Es soll außerdem besser schreiben und stilistische Vorgaben besser umsetzen.

  • Die regulären API-Preise von Opus 5.5 sinken um 20 Prozent auf 4 Dollar pro Million Eingabe- und 20 Dollar pro Million Ausgabe-Tokens, also verarbeitete Textbausteine. Durch weitere Effizienzgewinne beziffert Anthropic die Ersparnis bei typischen Aufgaben auf rund 40 Prozent.

  • OpenAI halbiert die API-Preise von Sol auf 2 beziehungsweise 10 Dollar je Million Eingabe- und Ausgabe-Tokens. Luna kostet 0,10 beziehungsweise 0,50 Dollar. In OpenAIs eigenen Tests machten beide weniger sachliche Fehler als ihre Vorgänger.

  • Opus 5.5 ist bereits verfügbar; Anthropic erhöht zudem die Nutzungslimits bezahlter Tarife. Sol und Luna starten in ChatGPT Work und Codex, noch nicht im normalen Chat. Luna steht auch kostenlosen Konten offen.

Warum das wichtig ist: Der Wettbewerb erreicht die laufende Rechnung. Wenn KI-Agenten stundenlang arbeiten, summieren sich ihre vielen Zwischenschritte, auch wenn am Ende nur eine kurze Antwort erscheint. Günstigere Modelle machen deshalb mehr Versuche und ausführlichere Prüfungen wirtschaftlich.

03

Bildquelle: Europäische Union, Eurostat (Bildausschnitt, CC BY 4.0)

EU-Bericht: Mit KI erledigte Hausaufgaben sind noch kein Lernerfolg

Die EU-Kommission hat einen Bericht über KI beim Lernen veröffentlicht. Seine zentrale Unterscheidung: Mit KI lassen sich Aufgaben erfolgreich erledigen, ohne dass dabei das entsprechende Wissen hängen bleibt.

  • 2025 nutzten vier von zehn 16- bis 24-Jährigen in der EU generative KI für Schule, Studium oder Ausbildung. Wie häufig und auf welche Weise sie damit lernten, ist deutlich schlechter erforscht.

  • Ein ausgewertetes Experiment mit Studierenden zeigt das Problem: Mit KI-Hilfe verfassten sie Kommentare zu fremden Texten. Als die Unterstützung entfiel, konnten sie die Qualität dieser Kommentare nicht halten.

  • KI-Werkzeuge, die gezielt für das Lernen entwickelt wurden, schneiden in der zusammengefassten Forschung meist besser ab als allgemeine Chatbots. Hilfreich ist etwa, wenn Lernende eigene Lösungswege erklären und sich Begriffe erläutern lassen.

  • Auch Lehrkräfte brauchen Unterstützung. Laut einer Befragung von 2024 hatten erst 29,7 Prozent der befragten EU-Lehrkräfte an KI-bezogener Weiterbildung teilgenommen. Welche langfristigen Folgen KI für die Fähigkeiten von Lernenden hat, bleibt offen.

Warum das wichtig ist: Eine fertige Hausaufgabe verrät immer weniger darüber, was jemand verstanden hat. Schulen brauchen deshalb Aufgaben, bei denen der eigene Lösungsweg sichtbar wird, und Gelegenheiten, das Gelernte ohne Hilfsmittel anzuwenden. Eine KI, die sofort die perfekte Antwort liefert, kann dabei pädagogisch weniger wert sein als eine, die zum Weiterdenken zwingt.

04

Bildquelle: Anthropic

Claude übernimmt ein Viertel von Anthropics KI-Entwicklung

Anthropic lässt Claude zunehmend an seinen Nachfolgern arbeiten. Laut einem neuen Bericht erledigt die KI bei 26 Prozent der erfassten Modellforschung und -entwicklung Aufgaben nach einem groben Auftrag weitgehend selbst. Menschen behalten dabei die Aufsicht.

  • Im Februar lag dieser Anteil noch unter einem Prozent. Bei mehr als 90 Prozent der erfassten Arbeit wirkt Claude inzwischen mindestens als Mitarbeiter mit. Vollständig autonome Arbeit wurde in keinem untersuchten Bereich festgestellt.

  • Die Schätzung basiert auf einem festen Aufgabenkatalog aus Juli, gewichtet nach geschätztem Personaleinsatz. Claude wertete interne Arbeitsunterlagen aus und bewertete den Automatisierungsgrad. Die Zahl misst weder eingesparte Stellen noch sämtliche heutige Forschungsarbeit.

  • Auf Anthropics meistgenutzter interner Agentenplattform arbeiteten im August ungefähr 30.000 Agenten parallel. Eine automatische Kontrolle blockierte etwa eine von 47.000 geprüften Entscheidungen.

  • In einer untersuchten Juliwoche flossen sechs Prozent der Rechenleistung für KI-Forschung und -Entwicklung in Sicherheitsarbeit.

Warum das wichtig ist: Wer KI entwickelt, kann mit leistungsfähigeren Modellen auch die eigene Entwicklungsarbeit stärker automatisieren. Das eröffnet einen Beschleunigungskreislauf, dessen Tempo bisher vor allem die Labore selbst kennen. Regelmäßige, extern überprüfte Messungen wären deshalb ein sinnvoller Maßstab für die Debatte über Entwicklungspausen.

RANKING

IN ALLER KÜRZE

  • Zwanzig Staaten und die EU, darunter Deutschland, fordern in einer gemeinsamen Erklärung am Rande der UN-Generalversammlung, dass KI unter menschlicher Kontrolle bleiben muss.

  • Ein KI-Agent von OpenAI ist im Juni in ein Statistikportal der australischen Krankenversicherung Medicare eingedrungen, hat Sperren umgangen, nicht öffentliche Dateien abgerufen und sogar Dateien auf einem internen Server abgelegt.

  • Chinas Internetbehörde ermittelt gegen DeepSeek und Moonshot AI, weil die beiden Unternehmen laut Anthropic Millionen Nutzeranfragen ohne Wissen ihrer Kunden an Claude weitergeleitet haben sollen, um dessen Antworten zum Training eigener Modelle zu nutzen.

  • OpenAI startet „Astra for Law", eine auf Rechtsarbeit zugeschnittene Fassung von GPT-6 Astra mit eigenem Suchindex für Gerichtsentscheidungen und Gesetze sowie 26 Partner-Plugins, unter anderem von Thomson Reuters, Harvey und dem schwedischen Legal-Tech-Anbieter Legora.

  • YouTube bringt einen Gemini-gestützten Schnittassistenten in Shorts und die YouTube-Create-App, der Clips per Anweisung kürzt, umordnet und mit Musik synchronisiert. Außerdem testet die Plattform eine optionale KI-Kommentarmoderation, die den Stil des jeweiligen Kanals lernt.

TIPPS & TRICKS

Lass Codex mit Computer use deinen Bildschirm bedienen

Der Agent sieht deinen Bildschirm, klickt und tippt selbst und erledigt so Aufgaben in Programmen, die sich mit keiner Automatisierung verbinden lassen. Seit Juni ist die Funktion auch in der EU verfügbar. Du brauchst die ChatGPT-Desktop-App mit einem Plus-Tarif oder höher, auf dem Mac oder unter Windows.

Schritt für Schritt

  1. Computer Use einrichten

    Öffne Codex in der Desktop-App und aktiviere Computer Use in den Einstellungen; unter Windows installierst du dafür das Computer-Use-Plugin. Beim ersten Auftrag fragt das System nach Berechtigungen. Gib sie nur für die Programme frei, die Codex tatsächlich bedienen soll.

  2. Den richtigen Auftrag wählen

    Nutze es für Aufgaben, die klar strukturiert und wiederkehrend sind, bei denen es aber keinen anderen Weg gibt: Werte aus einer alten Warenwirtschaft übertragen, Formulare in einem Behördenportal vorbereiten, Berichte aus einem Programm ohne Exportfunktion abschreiben.

  3. Beim ersten Durchlauf zusehen

    Lass den ersten Auftrag nicht unbeaufsichtigt laufen. Schau Codex zu, prüf danach Stichproben in der Tabelle und schärfe den Prompt nach.

🚀 Profi-Tipp: Auf dem Mac arbeitet Codex mit einem eigenen Mauszeiger im Hintergrund, du kannst also parallel weiterarbeiten. Unter Windows übernimmt Codex dagegen den Vordergrund, plan die Aufgabe dort für eine Pause oder über Nacht ein.

Eine Vielzahl von Tipps und Tricks ist auf unserer Website

Entdecke über 250+ Tipps & Tricks auf unserer Website.

KI-EVENTS

Nur bei mit einem Sternchen (*) gekennzeichneten Links handelt es sich um Affiliate-Links. Dies hat keinen Einfluss darauf, wie wir ein Tool oder einen Anbieter bewerten.