GPT-56, AWS

GPT-5.6 auf AWS Bedrock: Luna kostet 80% weniger

Veröffentlicht am: 30.07.2026 um 22:43 Uhr | Redaktion boerse-global.de

OpenAI integriert GPT-5.6-Modelle in AWS Bedrock mit massiven Preisnachlässen für Luna und Terra sowie neuem Prompt-Caching.

OpenAI GPT-5.6: Luna und Terra nun günstiger auf AWS Bedrock
Abstrakte Darstellung neuronaler Netze und Cloud-Computing-Architektur zur Integration von KI-Modellen. Illustration mit AI erstellt übermittelt durch boerse-global.de

OpenAI stellt seine neueste Modellfamilie ab sofort auch über die AWS-Cloud zur Verfügung. Die Integration umfasst die drei Leistungsstufen Sol, Terra und Luna – und bringt deutliche Preissenkungen mit sich.

Massive Rabatte für Mittelklasse und Sparmodelle

Zum Start auf Amazon Bedrock senkte OpenAI die Preise für zwei der drei GPT-5.6-Varianten drastisch. Das Einstiegsmodell Luna kostet jetzt 80 Prozent weniger: 0,18 Euro pro Million Eingabe-Tokens und 1,08 Euro pro Million Ausgabe-Tokens. Der Allrounder Terra verbilligte sich um 20 Prozent auf 1,80 Euro (Eingabe) beziehungsweise 10,80 Euro (Ausgabe) pro Million Tokens.

Das Spitzenmodell Sol bleibt mit 4,50 Euro für Eingabe- und 27 Euro für Ausgabe-Tokens preislich unverändert. Dafür führt OpenAI einen „Fast-Modus“ ein: Er liefert die 2,5-fache Verarbeitungsgeschwindigkeit – zum doppelten Preis. Möglich wurden die Preissenkungen laut technischen Berichten durch Effizienzgewinne: OpenAI nutzte Sol selbst, um die eigene Inferenz-Infrastruktur und GPU-Kernel zu optimieren. Die Betriebskosten sanken dadurch um 20 Prozent.

Explizites Prompt-Caching für komplexe Workflows

Die Bedrock-Integration bringt eine neue Funktion mit: explizites Prompt-Caching. Entwickler können gezielt bestimmte Abschnitte ihrer Eingabeaufforderungen zwischenspeichern. Das senkt Kosten und beschleunigt komplexe, agentische Arbeitsabläufe. Für gecachte Eingaben gewährt OpenAI einen Rabatt von 90 Prozent.

Anzeige

Während technologische Fortschritte wie das Prompt-Caching die Effizienz steigern, bringt der Einsatz von KI-Systemen in Unternehmen auch neue rechtliche Pflichten mit sich. Dieser kostenlose Umsetzungsleitfaden zum EU AI Act hilft Ihnen, alle Fristen und Dokumentationspflichten für Ihre KI-Projekte sicher im Blick zu behalten. EU AI Act in 5 Schritten verstehen

Die technischen Details: Die minimale Cache-Lebensdauer beträgt 30 Minuten. Entwickler setzen explizite Cache-Breakpoints, um die Speicherung zu steuern. Für autonome Agenten optimierte OpenAI zudem die Reihenfolge der Tool-Aufrufe und begrenzte die Tool-Ausgabe auf 10.000 Tokens. Diese Anpassungen verbesserten die Token-Generierungseffizienz durch verstärktes spekulatives Decoding um 15 Prozent.

Leistungsdaten und Ausrollgeschichte

Die GPT-5.6-Modelle verarbeiten Kontexte von bis zu 1,05 Millionen Tokens und geben maximal 128.000 Tokens aus. Im „Agents‘ Last Exam“ erreichte das Flaggschiff Sol 53,6 Punkte, im SWE-Bench Pro 64,6 Prozent. Mit der Responses API – inklusive beibehaltener Reasoning-Schritte und Kompaktierung – steigerte Sol seinen ARC-AGI-3-Wert von 13,3 auf 38,3 Prozent.

Anzeige

Der Einsatz leistungsstarker Sprachmodelle erfordert nicht nur technisches Know-how, sondern auch eine klare Strategie zur Einhaltung der neuen EU-Gesetzgebung. Erfahren Sie in diesem Experten-Report, welche KI-Systeme als Hochrisiko eingestuft werden und was Ihr Unternehmen jetzt konkret tun muss. Kostenlosen Leitfaden zur KI-Verordnung sichern

Die öffentliche Freigabe auf Bedrock folgt einem gestaffelten Rollout: Seit dem 9. Juli 2026 sind die Modelle allgemein verfügbar. Zuvor hatte die US-Regierung vom 26. Juni bis 8. Juli exklusiven Zugriff.

Aktuell laufen die Modelle auf Bedrock in den US-Regionen Nord-Virginia, Ohio und Oregon. Zeitgleich integrierte AWS auch Googles Gemma 4-Modelle in den Bedrock-Dienst – zunächst in der AWS GovCloud (US-West).

Disclaimer zu unseren Artikeln: Keine Anlageberatung, keine Kauf- oder Verkaufsempfehlung. Angaben zu Kursen, Unternehmen und Märkten ohne Gewähr; Änderungen jederzeit möglich. Börsengeschäfte können zu hohen Verlusten führen. Unsere Beiträge werden ganz oder teilweise automatisiert mit Unterstützung von AI erstellt und geprüft.

de | wissenschaft | 69902576 |