Ein KI-Rechenzentrum galt bisher als effizient, wenn möglichst wenig Strom für Kühlung und Verteilung verloren ging. SenseTime dreht diese Sicht um und misst seine Anlagen daran, wie viele Token am Ende auf jedes eingesetzte Watt entfallen. Der chinesische Anbieter nennt die Kennzahl TPW und stellt damit den Stromertrag über den reinen Kühl-Overhead.

drweb.de als bevorzugte Quelle auf Google hinzufügenQualitätsgeprüfte Inhalte direkt in Google News & DiscoverJetzt hinzufügen

Zugleich meldet der Konzern die Marktführung: Seine Plattform SenseCore hält laut Frost & Sullivan knapp die Hälfte des chinesischen Neocloud-Markts. Beides zusammen zeigt, wohin der Wettbewerb um KI-Rechenleistung kippt, weg vom bloßen Ausbau, hin zur Frage, wie viel nutzbare KI aus jeder Kilowattstunde kommt.

Das Wichtigste in Kürze

  • SenseTime führt mit TPW, kurz für Token pro Watt, eine Kennzahl ein, die den Ertrag eines KI-Rechenzentrums am Stromeinsatz misst, statt nur den Kühl-Overhead wie PUE.
  • Die Plattform SenseCore hält laut Frost & Sullivan rund die Hälfte des chinesischen Neocloud-Markts und liegt dort auf Platz eins.
  • Am eigenen Rechenzentrum in Lingang steigerte SenseCore den Token-Ertrag je Stromkosten nach eigenen Angaben um 80 Prozent.
  • SenseTime steht auf US-Sanktionslisten und hat sich von der Gesichtserkennung zum Betreiber von KI-Infrastruktur umgebaut.

Was misst SenseTime mit Token pro Watt?

Graues Messgerät mit Zählwerk, Textfeld
PUE misst Stromverluste in Rechenzentren, nicht die tatsächliche Rechenleistung pro Kilowatt

Reiner Overhead. PUE, kurz für Power Usage Effectiveness, vergleicht den gesamten Stromverbrauch eines Rechenzentrums mit dem Anteil, der bei den Servern ankommt. Moderne Anlagen liegen nahe am theoretischen Optimum, viel Kühl- und Verteilungsverlust bleibt kaum noch zu holen. Über die eigentliche Frage sagt der Wert nichts: wie viel Rechenergebnis aus dem Strom entsteht.

Ertrag statt Aufwand. TPW erweitert PUE um genau diese Achse und setzt die erzeugten Token ins Verhältnis zur eingesetzten Leistung.[1] Damit rückt der Engpass in den Blick, der den KI-Ausbau inzwischen bremst, nämlich der verfügbare Strom, nicht die Zahl der Chips. Auch dass sich Chinas KI-Nachfrage vom Training zur laufenden Inferenz verschiebt, macht den Verbrauch je Antwort zur entscheidenden Größe.

Wie wurde SenseTime zu Chinas größtem Neocloud-Anbieter?

Halber Markt. Nach einer Erhebung von Frost & Sullivan hält SenseCore knapp die Hälfte des chinesischen Neocloud-Markts. Gemeint sind Anbieter, die von Beginn an allein auf KI-Rechenleistung setzen, anders als die großen Cloud-Konzerne mit breitem Angebot. Im Westen zählen CoreWeave und Nebius zu dieser jungen Klasse.

Vom Sehen zum Rechnen. SenseTime begann als Spezialist für Gesichtserkennung und geriet darüber auf die US-Sanktionslisten, die dem Konzern westliche Investoren und Spitzenchips verwehren. Heute vermietet das Unternehmen Rechenleistung und verkauft generative KI, ähnlich wie es die Medizinsparte mit ihrem eigenen Weltmodell vormacht. SenseCore verarbeitet nach eigenen Angaben im Schnitt rund 4,5 Billionen Token am Tag.[2]

Nicht die Zahl der Grafikkarten entscheidet den nächsten KI-Zyklus, sondern der Ertrag je Kilowattstunde. Ein nur am Kühlverbrauch optimiertes Rechenzentrum dreht an der falschen Stellschraube.

— Markus Seyfferth, Chefredakteur Dr. Web
Token pro Watt: SenseCore in Zahlen
Kennzahlen zu SenseTimes KI-Infrastruktur (Stand: September 2026)

PUE gegen TPW

PUE

Misst, wie viel Strom im Rechenzentrum bei den Servern ankommt. Sagt nichts über die erzeugte KI-Leistung.

TPW

Setzt die erzeugten Token ins Verhältnis zur eingesetzten Leistung. Misst den Nutzen je Watt.

SenseCore in Zahlen

rund 50 %
Anteil am chinesischen Neocloud-Markt, Platz eins laut Frost & Sullivan
+80 %
mehr Token je Stromkosten am Rechenzentrum in Lingang (eigene Angabe)
1,25-fach
Kosteneffizienz der gemischten Inferenz gegenüber Nvidias H-Serie (eigene Angabe)

Was bedeutet der Effizienz-Umbruch für DACH-Entscheider?

Gleicher Engpass. Der Stromhunger der KI trifft Europa genauso. Netzanschlüsse für neue Rechenzentren sind knapp, und Betreiber sichern sich eigene Notstromversorgung oder ganze Kraftwerksscheiben. Eine Kennzahl, die Rechenergebnis und Strom verknüpft, taugt deshalb auch hier, unabhängig davon, wer sie zuerst propagiert.

Prüfen, nicht kaufen. SenseTimes Vorsprung beruht auf eigenen Angaben, wonach die gemischte Inferenz das 1,25-Fache der Kosteneffizienz von Nvidias H-Serie erreicht. Solche Herstellerzahlen gehören unabhängig belegt. Für europäische Einkäufer kommt hinzu, dass ein sanktionierter chinesischer Anbieter für regulierte Daten kaum in Betracht kommt.

Eigene Messgröße. Nehmen Sie die Idee hinter TPW mit, nicht den Anbieter, und vergleichen Sie KI-Cloud-Angebote am Preis je Million Token und am Verbrauch, nicht an der bloßen Rechenleistung. Mit bekannten Token-Kosten je Anwendung verhandeln Sie besser und erkennen früh, wann sich eigene Hardware lohnt.

Quellen

[1] 京报网 (Beijing Daily): „SenseCore stellt den Rechen-Strom-Agenten vor und definiert mit TPW den Effizienzmaßstab für Rechenzentren neu“

[2] SenseCore (商汤大装置): „SenseCore, die KI-Infrastruktur-Plattform von SenseTime“

Mehr Newshunger?

4,6 12 Bewertungen

Wie hat Ihnen dieser Artikel gefallen?