Skip to main content

GPT 5.4 vs Luna Pro

Ich habe mich informiert – die Info ist inzwischen echt: Es gibt tatsächlich eine "Luna"-Variante als Teil der neuen GPT‑5.6-Familie (Sol, Terra, Luna), erschienen ab 26. Juni 2026 mit "Luna Pro" als Reasoning-Variante Anfang Juli aufgetaucht. Hier der Vergleich zu GPT‑5.4:

Kontext: Was ist was?

Modell Rolle
GPT‑5.4 Vorheriges Flaggschiff-Modell (Release: März 2026)
GPT‑5.6 Luna / Luna Pro Das schnellste, günstigste Modell der neuen 5.6-Familie (neben Sol = Top-Tier, Terra = Mid-Tier). "Pro" ist die Variante mit reasoning.mode = pro für höhere Qualität bei gleichem Modell

Direkter Vergleich: GPT‑5.4 vs. GPT‑5.6 Luna

Preis 💰

  • GPT‑5.4: $2,50 / $15,00 (Input/Output pro 1M Tokens)
  • GPT‑5.6 Luna: $1,00 / $6,00 → ~2,5× günstiger

Kontextfenster

  • GPT‑5.4: 1,0 Mio. Tokens Input
  • GPT‑5.6 Luna: 1,05 Mio. Tokens Input (marginal größer)

Benchmarks – gemischtes Bild:

Bereich Gewinner
GPQA, MMMU-Pro, Toolathlon GPT‑5.4 (leicht besser)
BrowseComp, FrontierMath, GDPval-AA, SWE-Bench Pro Luna (deutlich besser)
Graphwalks BFS >128k Luna klar vorn (51,2 % vs. 21,4 %)
Agent's Last Exam Luna übertrifft leicht GPT-5.4-Niveau

Geschwindigkeit

  • GPT‑5.4 hat niedrigere Latenz (schnellere erste Antwort)
  • Luna hat höheren Durchsatz (schnellere Generierung, mehr Zeichen/Sek.)

Wichtige Einordnung von OpenAI selbst

Laut OpenAIs eigener Positionierung liegt Luna auf dem Niveau von GPT‑5.5 bei mehreren Tests – trotz des Preises des günstigsten Modells der Familie. Es ist explizit nicht als "besser als alles bisherige" gedacht, sondern für schnelle, alltägliche Aufgaben (Zusammenfassungen, Entwürfe, Routineautomatisierung), während Sol und Terra die anspruchsvolleren/komplexeren Use Cases abdecken.

Fazit

  • Rohleistung (Benchmarks): Luna schneidet in der Mehrheit der vergleichbaren Benchmarks besser ab als GPT‑5.4, besonders bei Agentic-/Tool-Use-/Coding-Aufgaben (SWE-Bench Pro, FrontierMath).
  • Kosten-Nutzen: Luna ist deutlich günstiger und damit für produktionsnahe Skalierung attraktiver.
  • Reine Wissens-/Reasoning-Benchmarks (GPQA): GPT‑5.4 hält knapp die Nase vorn, aber der Unterschied ist minimal.
  • "Luna Pro" (mit High-Reasoning-Modus) dürfte diese Werte durch mehr Reasoning-Zeit nochmal steigern, ist aber teurer/langsamer als Standard-Luna.

Kurz gesagt: GPT‑5.6 Luna ist trotz Positionierung als "günstiges Einsteigermodell" in vielen Benchmarks besser als das ältere Flaggschiff GPT‑5.4 – bei gleichzeitig geringeren Kosten. Wer aber die absolute Referenzleistung sucht, sollte GPT‑5.6 Sol oder Terra statt Luna vergleichen.