Firmenkunden von OpenAI können die chinesischen KI-Modelle Kimi K3 und GLM-5.3 Flash direkt im Coding-Agenten Codex nutzen und über ihr bestehendes OpenAI-Budget abrechnen. Den Zugang liefert der US-Inferenzanbieter Baseten, der seit dem 29. September im Firmenmarktplatz von OpenAI gelistet ist. Billiger als OpenAIs eigenes Mittelklassemodell GPT-6.1 Sol ist Kimi K3 dort allerdings nicht.

drweb.de als bevorzugte Quelle auf Google hinzufügenQualitätsgeprüfte Inhalte direkt in Google News & DiscoverJetzt hinzufügen

Den Start von Kimi K3 in Codex kommentierte Thibault Sottiaux, bei OpenAI für Codex und ChatGPT zuständig, auf X mit einem knappen Satz: „Darauf bin ich stolz. Offenheit ist der richtige Weg.“[4] Sottiaux teilte damit einen Beitrag des Baseten-Entwicklers Philip Kiely, der Kimi K3 von Moonshot AI und GLM-5.3 Flash von Zhipu als Beispiele nennt.[2] Das Finanzportal Sina Finance sprach vom ersten chinesischen Modell im Abrechnungssystem für OpenAIs Firmenkunden.[3]

Das Wichtigste in Kürze

  • Seit dem 29. September laufen offene Modelle von Baseten, darunter Kimi K3 und GLM-5.3 Flash, direkt in OpenAI Codex und über die Responses-API.
  • OpenAI verrechnet die Kosten mit bestehenden Budgetzusagen der Firmenkunden, ein zusätzlicher Lieferantenvertrag entfällt.
  • Kimi K3 kostet bei Baseten 2,61 € je Million Eingabetoken und 13,05 € je Million Ausgabetoken, 50 Prozent mehr als GPT-6.1 Sol.
  • Baseten betreibt die Modelle auf US-Servern, für personenbezogene Daten aus der EU brauchen Unternehmen eine eigene Rechtsgrundlage.

Warum rechnet OpenAI fremde Modelle über das eigene Budget ab?

Steckdose mit Stecker, Sparschwein und „Passt ins Budget“-Schild auf weißem Grund
OpenAI bindet Großkunden durch Budgetzusagen: Diese können ihr vertraglich zugesichertes Ausgabevolumen nun auch für konkurrierende offene Modelle nutzen, während das Geld über OpenAIs Konto fließt

Budgetzusagen binden Großkunden an OpenAI: Die Firmen verpflichten sich vorab auf ein Ausgabevolumen, meist für ein Jahr. Laut Baseten dürfen diese Kunden das zugesagte Volumen nun auch für offene Modelle einsetzen, die Baseten betreibt, in Codex wie über die Responses-API.[1] Das Geld fließt damit weiter über OpenAIs Konto, auch wenn ein Entwickler zu einem Konkurrenzmodell greift. Amazon und Microsoft rechnen Einkäufe über ihre Cloud-Marktplätze seit Jahren auf dieselbe Weise gegen Rahmenverträge an.

Das Einkaufsverfahren fällt weg. In Konzernen durchläuft jeder neue KI-Lieferant Sicherheitsprüfung und Vertragsverhandlung, oft über Monate. Über den Marktplatz landet Baseten ohne dieses Verfahren im Werkzeugkasten der Entwickler. Baseten betreibt nach eigener Aussage mehr als 90 Rechencluster in über 20 Clouds und speichert keine Prompts.[1]

Was gewinnt Moonshot mit dem Zugang zu OpenAIs Firmenkunden?

Westliche Vertriebswege öffnen sich für Kimi in schneller Folge. Seit dem 18. September bietet Amazon das Modell auf Amazon Bedrock als verwalteten Dienst an. Laut Reuters verlangt Moonshot von den US-Clouds bis zu 30 Prozent der Umsätze mit Kimi K3. Schon im Juli kam der Vorgänger Kimi K2.7 Code in GitHub Copilot, gehostet auf Microsoft Azure. Das Muster wiederholt sich: Die offenen Gewichte stammen aus China, die Rechenzentren stehen bei westlichen Anbietern. Allein ist Moonshot dabei nicht: Baseten nennt GLM-5.3 Flash von Zhipu gleichrangig neben Kimi K3, die Lesart von Sina Finance greift also zu kurz.

Politischer Gegenwind bleibt dabei bestehen. Anthropic wirft Moonshot und DeepSeek vor, Kundenanfragen heimlich an Claude durchgereicht zu haben, und Chinas Internetaufsicht prüft die Fälle. Am selben Tag wie die Baseten-Meldung wurde zudem bekannt, dass Sicherheitsforscher Kimi per Jailbreak zu Anleitungen für Biowaffen gebracht hatten.

OpenAI behält das Budget seiner Firmenkunden, auch wenn deren Entwickler zu Kimi greifen. Für Einkäufer in Europa bleibt die Frage nach dem Serverstandort trotzdem offen, denn der Marktplatz regelt die Rechnung und nicht den Datenschutz.

— Michael Dobler, Herausgeber Dr. Web
Kimi K3 in OpenAI Codex: Preise und Weg nach Westen
Was das chinesische Modell über Baseten kostet und über welche Plattformen Kimi seit Juli zu westlichen Firmenkunden kommt
2,61 €
je Million Eingabetoken für Kimi K3 bei Baseten
13,05 €
je Million Ausgabetoken für Kimi K3 bei Baseten
8,70 €
je Million Ausgabetoken verlangt OpenAI zum Vergleich für GPT-6.1 Sol
90+ Cluster
betreibt Baseten nach eigener Aussage in über 20 Clouds
Kimi auf westlichen Plattformen 2026
Anfang JuliKimi K2.7 Code kommt in GitHub Copilot, gehostet auf Azure
27. JuliMoonshot stellt die Gewichte von Kimi K3 zum Download bereit
Ende AugustMoonshot verhandelt laut Reuters mit Microsoft, Amazon und Google
18. SeptemberAmazon nimmt Kimi K3 in Bedrock auf
29. SeptemberBaseten bringt Kimi K3 in OpenAI Codex, abgerechnet über das OpenAI-Budget

Worauf sollten Unternehmen in Europa achten?

Der Preis spricht nicht automatisch für Kimi. Baseten verlangt für Kimi K3 umgerechnet 2,61 € je Million Eingabetoken und 13,05 € je Million Ausgabetoken, zum Kurs von 0,87 € je Dollar.[5] OpenAIs GPT-6.1 Sol kostet 1,74 € und 8,70 €. Deutlich günstiger fällt Kimi K3 nur gegenüber dem Spitzenmodell GPT-6 Astra aus, das den fünffachen Sol-Preis kostet. Ein Kostentest pro erledigter Programmieraufgabe sagt deshalb mehr als der Listenpreis.

Der Serverstandort verdient die zweite Prüfung. Baseten betreibt seine Modelle laut eigener Ankündigung auf Servern in den USA und lässt Kunden die Region festlegen.[1] Eine EU-Datenresidenz, wie OpenAI sie für eigene Modelle gegen 10 Prozent Aufschlag anbietet, nennt Baseten nicht. Enthält der Quellcode personenbezogene Daten, etwa Testdatensätze mit Kundendaten, braucht die Übermittlung in die USA eine Rechtsgrundlage nach der DSGVO. Die Datenschutzabteilung sollte außerdem klären, ob der Vertrag mit OpenAI Baseten als Unterauftragsverarbeiter abdeckt.

Eine Freigabe in Stufen senkt das Risiko. Unternehmen sollten Kimi K3 in Codex zunächst für Repositories ohne Personenbezug erlauben und die Modellwahl zentral steuern. Parallel lohnt ein Vergleich, wie viele Token Kimi K3 und GPT-6.1 Sol für dieselben Aufgaben verbrauchen. Weitere Hintergründe zu Chinas Modellen bündelt die KI-Rubrik von Dr. Web.

Kann ich Kimi K3 in OpenAI Codex nutzen?

Ja, als Firmenkunde von OpenAI. Seit dem 29. September 2026 stellt der Inferenzanbieter Baseten Kimi K3 und weitere offene Modelle direkt in Codex und über die Responses-API bereit. OpenAI verrechnet die Kosten mit der bestehenden Budgetzusage.

Was kostet Kimi K3 über Baseten?

Baseten verlangt für Kimi K3 umgerechnet 2,61 € je Million Eingabetoken und 13,05 € je Million Ausgabetoken. OpenAIs GPT-6.1 Sol kostet mit 1,74 € und 8,70 € weniger, das Spitzenmodell GPT-6 Astra dagegen deutlich mehr.

Laufen meine Daten bei Kimi K3 in Codex nach China?

Nein. Baseten betreibt Kimi K3 auf eigener Infrastruktur in den USA und speichert laut eigener Angabe keine Prompts. Für personenbezogene Daten aus der EU braucht der Transfer in die USA dennoch eine Rechtsgrundlage nach der DSGVO.

Quellen

[1] Baseten: „Announcing our partnership with OpenAI“

[2] Philip Kiely (Baseten) auf X: „Enterprise teams can now use open models like GLM-5.3 Flash and Kimi K3 natively in Codex“

[3] Sina Finance: „Kimi K3接入OpenAI Codex企业通道“

[4] Thibault Sottiaux (OpenAI) auf X: „Proud of this. Open is the way.“

[5] Baseten: „Kimi K3“ (Modellseite mit Preisen)

Mehr Newshunger?

4,5 16 Bewertungen

Wie hat Ihnen dieser Artikel gefallen?