OpenAI holt GPT-6 mit Sol und Luna aus der High-End-Nische

OpenAI stellt mit GPT-6 Sol und GPT-6 Luna zwei günstigere Modelle für professionelle Aufgaben, Softwareentwicklung und KI-Agenten vor. Nach Angaben des Unternehmens basieren beide Modelle auf ähnlichen Trainingsmethoden wie das Spitzenmodell GPT-6 Astra. Gleichzeitig sinken die API-Preise gegenüber den Aktionspreisen der Vorgängermodelle GPT-5.6 um rund 50 Prozent.

GPT-6 Sol kostet für Entwickler 2 US-Dollar pro einer Million Eingabe-Token und 10 US-Dollar pro einer Million Ausgabe-Token. Bei GPT-6 Luna liegen die Preise bei 0,10 US-Dollar für Eingaben und 0,50 US-Dollar für Ausgaben. Token sind Textbausteine, die ein KI-Modell verarbeitet oder erzeugt.

Die Preissenkung ist besonders für Unternehmen relevant, die KI-Agenten einsetzen oder große Mengen an Texten verarbeiten. Dort entstehen hohe Kosten, weil die Modelle wiederholt Anweisungen, Dokumente und den Verlauf einer Unterhaltung berücksichtigen müssen.

Stärkere Modelle für den breiten Einsatz

OpenAI ordnet Sol als leistungsstärkeres Modell für allgemeine Arbeitsaufgaben ein, während Luna vor allem auf niedrige Kosten zielt. Astra bleibe laut OpenAI das beste Modell für besonders anspruchsvolle Aufgaben. Sol und Luna sollen dessen Fähigkeiten jedoch für mehr Anwendungen wirtschaftlich nutzbar machen.

OpenAI erklärt, GPT-6 Sol mache in einer internen Prüfung etwa halb so viele sachliche Fehler wie GPT-5.6 Sol. Die Prüfung basiert auf anonymisierten Unterhaltungen, in denen Nutzer zuvor Fehler gemeldet hatten. GPT-6 Luna erreiche bei höheren Reasoning-Einstellungen in dieser Auswertung die Leistung von GPT-5.6 Sol, verursache dabei aber nur etwa ein Hundertstel der Kosten.

Diese Angaben stammen aus unternehmenseigenen Tests und lassen sich nicht unmittelbar auf jede Nutzung übertragen. OpenAI weist selbst darauf hin, dass die Faktentreue-Prüfung absichtlich Gespräche auswählt, die Fehler begünstigen. Auch die Ergebnisse in ChatGPT können abweichen, wenn dort andere Systemanweisungen oder Werkzeuge eingesetzt werden.

Bei Benchmark-Tests für KI-Agenten meldet OpenAI ebenfalls Fortschritte. Auf AutomationBench, einer Prüfung für Arbeitsabläufe über mehrere Geschäftsanwendungen hinweg, erreichte GPT-6 Sol laut Unternehmen mit der höchsten Reasoning-Stufe 33,2 Prozent bei geschätzten Kosten von 0,27 US-Dollar pro Aufgabe. Claude Opus 5 von Anthropic habe im Vergleich 26,9 Prozent erreicht und pro Aufgabe 11,1-mal so viel gekostet. Der Test umfasst unter anderem Aufgaben aus Vertrieb, Marketing, Finanzen, Support und Personalwesen.

Bei komplexen Softwareaufgaben in realen Codebasen erreichte Sol laut OpenAI auf DeepSWE v1.1 68,8 Prozent. Luna kam auf 66,6 Prozent. Sol habe damit 1,1 Prozentpunkte unter dem besten gemeldeten Ergebnis von Claude Fable 5 gelegen, aber rund 80 Prozent weniger pro Aufgabe gekostet. Die Vergleiche mit Konkurrenzmodellen beruhen teilweise auf öffentlich verfügbaren Angaben der jeweiligen Anbieter.

Günstigerer Kontext für lange Gespräche

Zusätzlich verbessert OpenAI das Prompt Caching. Dabei werden bereits verarbeitete Teile von Anweisungen oder Gesprächen wiederverwendet. Das spart Rechenleistung, etwa bei langen Agentenabläufen. Für zwischengespeicherte Eingabe-Token nennt das Unternehmen einen Preisnachlass von 90 Prozent.

Entwickler erhalten außerdem Werkzeuge, die nicht genutzte Caching-Möglichkeiten sichtbar machen sollen. Änderungen an der Reasoning-Stufe oder an verfügbaren Tools sollen den zuvor gespeicherten Gesprächskontext nicht mehr unterbrechen.

Sol und Luna übernehmen laut OpenAI auch den Kommunikationsstil von Astra. Die Antworten sollen klarer, kürzer und weniger jargonlastig ausfallen. Zudem berichtet das Unternehmen von besseren Ergebnissen in Alignment-Tests. Diese Tests untersuchen unter anderem irreführende Aussagen über Programmierarbeit, das Umgehen von Warnhinweisen und nicht erlaubte Aktionen.

In der OpenAI-API sind die neuen Modelle als gpt-6-sol und gpt-6-luna verfügbar. Sie werden außerdem für zahlende Nutzer sowie Organisationen in ChatGPT Work und Codex freigeschaltet. Nutzer der kostenlosen und Go-Tarife erhalten Luna in der Desktop-App. Im regulären Chat-Bereich stehen die Modelle laut OpenAI noch nicht zur Verfügung.

Quellen

Bleib auf dem Laufenden

KI für Contentprofis: die neuesten Tools, Tipps und Trends. Alle 14 Tage in deine Inbox:

 

Weitere Infos …

Über den Autor

Mehr zum Thema:

×