Artikel teilen

Adobe, Amazon, Atlassian und Citi drosseln den KI-Verbrauch ihrer Belegschaft, weil die Rechnung für Claude, GPT und Copilot außer Kontrolle gerät. Atlassian meldet einen Sprung von 5 auf über 13 Millionen Euro monatlich, Citi sperrt zeitweise die teuersten Modelle komplett. Für Entscheider zeigt der Fall, wie schnell aus einem Produktivitätsversprechen eine Kostenfalle wird.

drweb.de als bevorzugte Quelle auf Google hinzufügenQualitätsgeprüfte Inhalte direkt in Google News & DiscoverJetzt hinzufügen

Die KI-Kosten in großen Unternehmen sprengen offenbar reihenweise die Budgetplanung. Nach Recherchen des US-Mediums 404 Media haben Adobe, Amazon, Atlassian und die Großbank Citi ihren Mitarbeitern in den vergangenen Wochen den Zugriff auf teure Sprachmodelle eingeschränkt oder ganz gesperrt. Ausgelöst hat den Rückzug ausgerechnet der Wechsel weg von Flatrate-Modellen, hin zur nutzungsbasierten Abrechnung.

Das Wichtigste in Kürze

  • Atlassian: KI-Ausgaben von 4,4 Millionen Euro (August 2025) auf über 13 Millionen Euro monatlich (Mai 2026), Jahresprognose rund 104 Millionen Euro.
  • Citi hat Claude Opus 4.6/4.7 und GPT-5.5 vom 24. Juni bis 1. Juli komplett gesperrt und bittet Mitarbeiter, günstigere Modelle wie Sonnet oder GPT-5.3-Codex zu nutzen.
  • Adobe beendet den unlimitierten Claude-Zugang zum 30. Juni, Amazon hat sein internes KI-Leaderboard abgeschafft und Nutzungsobergrenzen eingeführt.
  • Auslöser ist unter anderem GitHubs Wechsel zur nutzungsbasierten Copilot-Abrechnung im Juni 2026, der unternehmensweite Token-Pools statt Flatrates etabliert.

Welche Unternehmen kappen jetzt ihre KI-Kosten?

Hand öffnet goldenen Hahn mit Schild „KI-Guthaben“, aus dem drei Goldmünzen fallen
Atlassian erhöht Cloud- und KI-Ausgaben von 4,4 auf über 13 Millionen Euro monatlich. Für 2026 werden 104 Millionen Euro budgetiert

Das Unternehmen hinter Jira hat im August 2025 noch rund 4,4 Millionen Euro monatlich für Cloud- und KI-Dienste wie AWS, Google Cloud und OpenAI ausgegeben. Bis Mai 2026 ist der Betrag auf über 13 Millionen Euro gestiegen, für das laufende Geschäftsjahr rechnet Atlassian mit gut 104 Millionen Euro. Ein Mitarbeiter beschreibt gegenüber 404 Media, wie Kollegen ihr gewohntes Arbeitstempo plötzlich drosseln müssen, weil das monatliche KI-Kontingent schon nach zwei bis drei Tagen aufgebraucht ist.

Bei der Großbank Citi greift die Bremse noch härter. Ein internes Schreiben, das 404 Media vorliegt, hat den Zugriff auf Claude Opus 4.6 und 4.7 sowie GPT-5.5 vom 24. Juni bis zum 1. Juli komplett gesperrt, mittlerweile ist der Zugang wieder freigegeben. Zuvor hat Citi seine Entwickler gebeten, für einfache Aufgaben auf GPT-5.3-Codex oder Claude Sonnet 4.6 umzusteigen und die teureren Modelle nur für komplexe Architekturfragen zu reservieren. Zur Begründung verweist die Bank direkt auf den Wechsel von GitHub zur nutzungsbasierten Copilot-Abrechnung. Auf Nachfrage bestreitet Citi jede Drosselung, die internen Unterlagen zeichnen jedoch ein anderes Bild.

Ein Jahr unbegrenzten Modellzugriff zu versprechen und dann über Nacht Kreditkontingente einzuführen, verdrängt die eigentliche Rechnung nur, statt sie zu lösen. Die Token-Kosten sind kein Kollateralschaden der KI-Euphorie, sondern deren Kern.

Michael Dobler, Herausgeber Dr. Web
Zitat teilen

Warum steigen die KI-Kosten in Unternehmen so schnell?

Glas mit Strohhalmen, Faultierfigur, Aufschrift „Team-Guthaben“ und Etikett „Agent“
Geteiltes KI-Guthaben: Wer viel verbraucht, zieht mehr aus dem gemeinsamen Kontingent.

Der Grund liegt tiefer als einzelne Preiserhöhungen. GitHub hat im Juni 2026 sämtliche Copilot-Tarife von Flatrates auf nutzungsbasierte Abrechnung umgestellt und poolt das Guthaben seither unternehmensweit, statt jedem Nutzer ein festes Kontingent zuzuteilen. Teams mit intensiver Agentennutzung ziehen mehr aus dem gemeinsamen Kontingent, während sparsame Kolleginnen und Kollegen ungenutzte Anteile freigeben sollen. Reasoning-Modelle wie Opus oder GPT-5.5 verbrauchen laut Citi-Schreiben pro Anfrage ein Vielfaches an Kredits gegenüber Standardmodellen.

Der Fall reiht sich in ein bekanntes Muster ein. Uber hat sein komplettes Jahresbudget bereits im April aufgebraucht und daraufhin Nutzungsobergrenzen pro Werkzeug eingeführt. Andere Firmen zwingen ihre Teams inzwischen zu knapper formulierten Prompts, um den Token-Verbrauch gezielt zu senken. Was 2025 als vereinzelte Sparmaßnahme begonnen hat, ist Mitte 2026 zur Regel geworden, wie auch die jüngsten Kostendesaster anderer Tech-Konzerne zeigen.

Was bedeutet die KI-Kosten-Krise für deutsche Mittelständler?

Kaffeekanne mit
Ein Drittel der KI-nutzenden deutschen Unternehmen verzeichnet höhere Kosten als geplant. Besonders im Mittelstand führt intensiver Agenteneinsatz schnell zu Budgetüberschreitungen

Die Entwicklung betrifft längst nicht nur US-Konzerne. Laut Bitkom-KI-Studie 2026 berichten 33 Prozent der KI-nutzenden deutschen Unternehmen, dass der Einsatz teurer geworden ist als ursprünglich kalkuliert. Gerade im Mittelstand mit intensiver Agentennutzung reichen wenige Monate, bis Budgets aus dem Ruder laufen, wie eine frühere Analyse von Dr. Web zeigt.

Für Geschäftsführer und IT-Verantwortliche zahlt sich deshalb aus, Modelle gezielt nach Aufgabe statt aus Gewohnheit zu wählen und den Token-Verbrauch pro Team sichtbar zu machen, bevor das Kontingent zur Notbremse wird. Diese Weichenstellung frühzeitig zu treffen, erspart den Schock, den Citi- und Atlassian-Mitarbeiter gerade erleben.

Mehr Newshunger?

Server-Schrank vor weißem Hintergrund, umwickelt mit Kette, Vorhängeschloss und Anhänger
Unternehmen reduzieren KI-Kosten durch vereinfachte Sprache und senken damit Token-Verbrauch und Ausgaben erheblich
4,2 18 Bewertungen

Wie hat Ihnen dieser Artikel gefallen?