· Zuletzt aktualisiert:
Claude auf Google Cloud: Woher die „90 % Ersparnis" wirklich kommen
- KI
- Claude
- Cloud
90 Prozent
kolportierte Kostenersparnis
„90 % Kostenersparnis"
Für alle Claude-Freundinnen und -Freunde macht gerade eine Meldung die Runde: Anthropics Claude-Modelle seien auf Google Cloud mit „90 % Kostenersparnis“ integriert. Klingt großartig — und verdient genau deshalb einen zweiten Blick, denn hinter der runden Zahl steckt etwas Konkreteres als ein Preissturz.
Was stimmt
Claude läuft auf Google Clouds KI-Plattform Vertex AI — das ist real und für Unternehmen praktisch: Wer seine Infrastruktur ohnehin bei Google hat, kann Claude dort betreiben, ohne die Google-Welt zu verlassen. So weit, so unspektakulär.
Woher die 90 % kommen
Die eigentliche Ersparnis ist keine Google-Sonderaktion, sondern eine allgemeine Claude-Funktion namens Prompt Caching — und die lohnt sich, verstanden zu werden. Vereinfacht: Wenn man einem KI-Modell immer wieder denselben langen Kontext mitschickt — etwa ein umfangreiches Dokument, eine Wissensbasis, feste Anweisungen —, muss das Modell diesen Teil normalerweise jedes Mal neu einlesen und bezahlen. Prompt Caching legt diesen wiederkehrenden Teil in einen Zwischenspeicher. Ab dem zweiten Mal kostet der zwischengespeicherte Teil nur noch rund ein Zehntel — also bis zu 90 Prozent weniger.
Das ist die Zahl. Sie bezieht sich nicht auf Claude insgesamt, sondern auf den zwischengespeicherten Anteil wiederkehrender Anfragen. Für eine Anwendung, die tausendfach dieselbe große Dokumentbasis abfragt, ist das ein gewaltiger Hebel. Für eine einzelne, jedes Mal völlig neue Frage bringt es nichts — da gibt es nichts zu cachen.
Warum diese Unterscheidung wichtig ist
Weil „90 % günstiger“ und „bis zu 90 % günstiger auf dem wiederholten Teil bei geschickter Nutzung“ zwei sehr verschiedene Versprechen sind. Das erste ist eine Schlagzeile, das zweite ist die Wahrheit — und nur die zweite hilft einem bei der Entscheidung. Wer eine KI-Anwendung baut, sollte Prompt Caching kennen und einsetzen; es ist einer der wirksamsten Kostenhebel überhaupt. Wer nur gelegentlich mit Claude chattet, merkt davon nichts.
Ehrlichkeit an dieser Stelle: Die ursprüngliche Meldung stammt aus einem Nachrichten-Aggregator, dessen genauen Wortlaut ich nicht gegenprüfen konnte. Deshalb steht hier bewusst der Mechanismus im Vordergrund und nicht die Schlagzeile — die Technik dahinter ist belegt und nachvollziehbar, die Rundung „90 %“ ist es ohne Quelle nur bedingt.
Unterm Strich eine gute Nachricht für alle, die Claude produktiv einsetzen — nur eben keine Rabattaktion, sondern ein Stück Handwerk, das sich zu lernen lohnt.
Hintergrund zum Mechanismus: Anthropic — Prompt Caching · Claude auf Google Vertex AI
Häufige Fragen.
Was ist Prompt Caching genau?
Wiederkehrende Kontextteile, etwa ein umfangreiches Dokument oder feste Anweisungen, werden in einen Zwischenspeicher gelegt. Ab dem zweiten Mal kostet der zwischengespeicherte Teil nur noch rund ein Zehntel, also bis zu 90 Prozent weniger.
Für wen lohnt sich Prompt Caching?
Für Anwendungen, die wiederholt dieselbe große Dokumentbasis abfragen, ist es ein gewaltiger Hebel. Bei einer einzelnen, jedes Mal völlig neuen Frage bringt es dagegen nichts, weil es nichts zu cachen gibt.
Läuft Claude tatsächlich auf Google Cloud?
Ja, Claude läuft auf Google Clouds KI-Plattform Vertex AI, sodass Unternehmen mit Google-Infrastruktur Claude betreiben können, ohne die Google-Welt zu verlassen.
Kommentare.
Lade Kommentare …