Anthropic sichert sich rund eine Million TPU-Chips
Wirtschaft

Anthropic sichert sich rund eine Million TPU-Chips

Anthropic weitet seine Nutzung von Googles KI-Chips deutlich aus: Laut beiden Unternehmen sichert sich die Firma rund eine Million TPU-Chips sowie mehr als ein Gigawatt Rechenkapazität für 2026. Nvidia reagierte darauf mit einem Verweis auf die eigene Technologieführerschaft; Monate später stellte Google zudem seine neue Chipgeneration TPU 8t und TPU 8i vor.

Quellen (5)
  1. Anthropic auf X: „Today, we announced that we plan to expand our use of Google TPUs, securing approximately one million TPUs and more than a gigawatt of capacity in 2026.“ / Xx.com
  2. Anthropic to Expand Use of Google Cloud TPUs and Services - Oct 23, 2025googlecloudpresscorner.com
  3. Ironwood: The first Google TPU for the age of inferenceblog.google
  4. Two chips for the agentic erablog.google
  5. NVIDIA Newsroom auf X: „We’re delighted by Google’s success — they’ve made great advances in AI and we continue to supply to Google. NVIDIA is a generation ahead of the industry — it’s the only platfox.com
2. Oktober 2026, 3:43 Uhr917 Wörter · 5 Min. Lesezeit

Anthropic kündigte am 23. Oktober 2025 an, seine Nutzung von Googles Tensor Processing Units auszubauen und sich dafür rund eine Million Chips sowie mehr als ein Gigawatt Rechenkapazität für das Jahr 2026 zu sichern. Das ist nach Angaben von Google Cloud und Anthropic die bisher größte Erweiterung der TPU-Nutzung von Anthropic. Die zusätzliche Kapazität soll den Forschungs- und Entwicklungsteams des Unternehmens laut Anthropic für Jahre zur Verfügung stehen.

Um die Größenordnung des Deals einzuordnen, lohnt ein Blick auf die Technik dahinter.

Was sind TPUs und was kann Ironwood?

Google stellte am 9. April 2025 mit Ironwood die siebte Generation seiner Tensor Processing Unit vor, eines speziell für KI-Berechnungen entwickelten Chips. Nach Angaben des Unternehmens ist Ironwood die erste TPU, die gezielt für Inferenz entwickelt wurde, also für die Anwendung bereits trainierter KI-Modelle; sie soll besonders leistungsfähig sowie energieeffizient sein. Ironwood skaliert laut Google auf bis zu 9.216 flüssigkeitsgekühlte Chips, die über eine Inter-Chip-Interconnect-Vernetzung verbunden sind und zusammen fast 10 Megawatt Leistung umfassen; für Google-Cloud-Kunden ist er in zwei Konfigurationsgrößen buchbar, mit 256 oder mit 9.216 Chips. Bei voller Skalierung auf 9.216 Chips pro Pod erreicht Ironwood nach Unternehmensangaben 42,5 Exaflops Rechenleistung, mehr als 24-mal so viel wie der nach Google-Angaben weltweit größte Supercomputer El Capitan mit 1,7 Exaflops pro Pod, während ein einzelner Chip auf eine Spitzenleistung von 4.614 TFLOPs kommt. Die Leistung pro Watt soll laut Google doppelt so hoch liegen wie bei der sechsten TPU-Generation Trillium und knapp 30-mal so hoch wie bei der ersten Cloud-TPU von 2018. Auch bei Speicher und Datenübertragung verspricht Google Fortschritte: 192 Gigabyte Hochgeschwindigkeitsspeicher pro Chip, das Sechsfache von Trillium, eine Speicherbandbreite von 7,37 Terabyte pro Sekunde und eine Chip-zu-Chip-Bandbreite von 1,2 Terabyte pro Sekunde. Ironwood verfügt zudem über einen verbesserten SparseCore, einen Spezialbeschleuniger für große Embeddings, mit dem laut Google auch Finanz- und Wissenschaftsanwendungen jenseits klassischer KI-Aufgaben möglich werden. Laut Google laufen führende Modelle wie Gemini 2.5 und das mit dem Nobelpreis ausgezeichnete AlphaFold bereits auf TPUs, Ironwood sollte im späteren Verlauf des Jahres 2025 verfügbar werden.

Die achte Generation: TPU 8t und TPU 8i

Etwas mehr als ein Jahr später, am 22. April 2026, kündigte Google bei der Entwicklerkonferenz Google Cloud Next die achte TPU-Generation an, aufgeteilt in zwei spezialisierte Chips: den TPU 8t und TPU 8i. Der TPU 8t ist laut Google auf massive, rechenintensive Trainings-Workloads ausgelegt, während der TPU 8i mit mehr Speicherbandbreite für latenzsensible Inferenz gebaut wurde, was nach Unternehmensangaben wichtig ist, weil sich bei Interaktionen zwischen KI-Agenten im großen Maßstab schon kleine Ineffizienzen verstärken. Ein einzelner TPU-8t-Superpod skaliert laut Google auf 9.600 Chips und zwei Petabyte gemeinsamen Speicher, mit doppelter Chip-zu-Chip-Bandbreite gegenüber der Vorgängergeneration und liefert dabei 121 Exaflops Rechenleistung. Der TPU 8t soll laut Google mehr als 97 Prozent sogenannten Goodput erreichen, also den Anteil der Rechenzeit, der tatsächlich produktiv genutzt wird, ermöglicht durch umfassende Zuverlässigkeits- und Wartungsfunktionen. Der TPU 8i verbindet nach Unternehmensangaben 288 Gigabyte Hochgeschwindigkeitsspeicher mit 384 Megabyte Speicher direkt auf dem Chip, dreimal mehr als in der Vorgängergeneration, damit das aktive Arbeitsset eines Modells vollständig auf dem Chip bleibt. Beide neuen Chips liefern laut Google bis zu doppelt so viel Leistung pro Watt wie Ironwood, die vorherige Generation. Entwickelt wurden die Chips laut Google in Partnerschaft mit Google DeepMind, um sich an sich entwickelnde Modellarchitekturen im großen Maßstab anzupassen. Als Kundenbeispiel nennt Google die Organisation Citadel Securities, die TPUs für ihre KI-Workloads nutzt.

Der Anthropic-Deal: eine Million Chips, ein Gigawatt

Anthropic und Google Cloud hatten ihre strategische Partnerschaft bereits 2023 bekanntgegeben: Anthropic trainierte seine Modelle auf der KI-Infrastruktur von Google Cloud und bot sie Unternehmen über die Plattform Vertex AI sowie den Google Cloud Marketplace an. Laut Google Cloud nutzten bereits Tausende Unternehmen die Claude-Modelle von Anthropic über Google Cloud, darunter Figma, Palo Alto Networks und Cursor. Mit der am selben Tag angekündigten Erweiterung erhält Anthropic laut eigenen Angaben Zugriff auf bis zu einer Million TPU-Chips sowie zusätzliche Google-Cloud-Dienste, die insgesamt deutlich mehr als ein Gigawatt Kapazität im Jahr 2026 umfassen; als Gründe nannte das Unternehmen das Preis-Leistungs-Verhältnis und die Effizienz der TPUs sowie die eigene Erfahrung im Training und Betrieb seiner Modelle auf dieser Hardware. Anthropic-Finanzchef Krishna Rao erklärte, Kunden von Fortune-500-Unternehmen bis zu KI-Startups seien für ihre wichtigste Arbeit auf Claude angewiesen; die erweiterte Kapazität stelle sicher, dass das Unternehmen die exponentiell wachsende Nachfrage decken und seine Modelle an der Spitze der Branche halten könne. Google-Cloud-Chef Thomas Kurian sagte, die deutliche Ausweitung der TPU-Nutzung durch Anthropic spiegele das starke Preis-Leistungs-Verhältnis und die Effizienz wider, die dessen Teams seit mehreren Jahren mit TPUs erlebt hätten; zudem kündigte er an, das bereits ausgereifte KI-Beschleuniger-Portfolio einschließlich Ironwood weiter auszubauen.

Nvidia betont eigene Technologieführerschaft

Etwa einen Monat nach der Anthropic-Ankündigung äußerte sich Nvidia am 25. November 2025 über den Kurznachrichtendienst X: Man sei „erfreut über Googles Erfolg“, Google habe „große Fortschritte“ in der KI gemacht; Nvidia beliefere das Unternehmen weiterhin. Zugleich betonte Nvidia, der Branche „eine Generation voraus“ zu sein und die einzige Plattform zu bieten, die jedes KI-Modell ausführe, „überall, wo Computing stattfindet“. Gegenüber anwendungsspezifischen Chips, sogenannten ASICs, die für bestimmte KI-Frameworks oder Funktionen entwickelt seien, biete Nvidia nach eigenen Angaben größere Leistung, Vielseitigkeit und Austauschbarkeit. Eine Reaktion Googles auf diese Einschätzung findet sich in den ausgewerteten Quellen nicht.

Chips für die Interaktion vieler KI-Agenten

Nvidia hält mit dem Verweis auf die eigene Technologieführerschaft dagegen, auch wenn das Unternehmen nach eigenen Angaben weiterhin Chips an Google liefert. Für Anthropic bedeutet der Deal vor allem gesicherte Rechenkapazität für ein Geschäft, dessen Nachfrage das Unternehmen selbst als exponentiell wachsend beschreibt.

Kommentare