Anthropic hat vor zwei Tagen vorgerechnet, was eine Aufgabe auf Opus 5.5 kostet. Der Beitrag von Addy Osmani ist kurz und nüchtern. Die wichtigste Aussage steht nicht in der Preistabelle. Sie steckt in der Frage, wie oft dein Agent denselben Verlauf noch einmal liest.
Ich arbeite jeden Tag mit Claude Code und habe den Beitrag gegen mein eigenes Setup gelesen. Hier die Kurzfassung mit den Stellen, an denen du selbst drehen kannst.
die quelle
Anthropic, Claude-Blog, Addy Osmani, 22.09.2026
What a task costs on Opus 5.5
der kern in vier sätzen
- Billiger pro Token: Input und Output 20 Prozent, Cache-Lesen 60 Prozent günstiger als bei Opus 5.
- Cache schlägt Modellwahl: Ein Token aus dem Cache kostet 5 Prozent eines frischen Input-Tokens.
- Effort vor Modellwechsel: Erst höher denken lassen, dann erst zu Fable 5.1 greifen.
- Selbst messen: Die Zahlen im Beitrag sind Beispiele, deine Rechnung zeigt
/usage.
die neuen preise
Opus 5.5 kostet über die API 4 Dollar je Million Input-Token und 20 Dollar je Million Output-Token. Ein Lesezugriff auf den Cache kostet 0,20 Dollar je Million.
| Kategorie | opus 5 | opus 5.5 |
|---|---|---|
| input | 100 % | 80 % |
| output | 100 % | 80 % |
| cache lesen | 100 % | 40 % |
- opus 5
- opus 5.5
Gegenüber Opus 5 sind Input und Output 20 Prozent billiger, der Cache 60 Prozent. In einer Beispielsitzung mit gleichem Tokenverbrauch spart das laut Anthropic rund 31 Prozent. Wer nichts ändert, zahlt also schon weniger.
vier dinge bestimmen die rechnung
Der Beitrag zerlegt die Kosten einer Aufgabe in vier Größen. Jede davon kannst du beeinflussen.
Runden. Bei jeder Runde schickt Claude den bisherigen Verlauf erneut mit. Eine Aufgabe, die in acht Runden fertig ist, liest ihren Anfang achtmal. Weniger Rückfragen und klarere Aufträge sparen hier am meisten. Wie eine Runde im Detail abläuft, zeigt der Beitrag Die Agent-Schleife.
Cache-Treffer. Liegt der Verlauf im Cache, kostet er nur einen Bruchteil. Der Cache hält im Abo eine Stunde, mit API-Key oder über Cloud-Anbieter fünf Minuten. Lange Pausen mitten in der Arbeit sind deshalb teurer, als sie aussehen.
| Kategorie | Wert |
|---|---|
| output | 20 $ |
| input | 4 $ |
| cache | 0,20 $ |
- output20 $
- input4 $
- cache0,20 $
Output. Ein Output-Token kostet das Fünffache eines Input-Tokens. Dazu zählen auch die Denk-Token, selbst wenn du nur eine Zusammenfassung davon siehst.
Modell. Die Modellwahl setzt den Preis für jedes einzelne Token der Sitzung. Ein Wechsel wirkt deshalb auf alles, was danach kommt.
effort vor modellwechsel
Opus 5.5 kennt mehrere Effort-Stufen. Anthropic empfiehlt low für mechanische Arbeit wie Umbenennungen und medium als Standard für klar umrissene Tagesarbeit. High nimmst du, wenn medium hängen bleibt. Das kostet rund 20.000 zusätzliche Denk-Token, bei 20 Dollar je Million also etwa 40 Cent pro Aufgabe. Eine gesparte Schleife aus drei Fehlversuchen ist meist teurer.
low
Mechanische Arbeit wie Umbenennungen.
medium
Standard für klar umrissene Tagesarbeit.
aktuellhigh
Wenn medium hängen bleibt. Rund 20.000 Denk-Token mehr.
fable 5.1
Erst wenn high zweimal stecken bleibt. Input und Output 2,5-fach teurer.
zurück zu opus
Nach dem gelösten Problem wieder auf Opus 5.5.
Anthropic fasst das in eine Regel. Effort erhöhen, bevor du das Modell wechselst. Bleibt Opus 5.5 auf high zweimal stecken, holst du Fable 5.1 für genau dieses Problem und gehst danach zurück. Sonnet und Haiku gehören in Subagenten für Suchen, Logs und Nachschlagen. In meinem Setup erledigt ein Haiku-Subagent genau diesen Kleinkram, das Hauptmodell plant und prüft.
| modell | wofür | input / output je mio. |
|---|---|---|
| opus 5.5 | beaufsichtigte arbeit: features, debugging, code-review | 4 $ / 20 $ |
| fable 5.1 | lange läufe ohne aufsicht, neue probleme | 10 $ / 50 $ |
| sonnet, haiku | subagenten für suche, logs, nachschlagen | im beitrag nicht genannt |
Ein Detail aus dem Beitrag verdient Aufmerksamkeit. Wer mitten in der Sitzung mit /effort umstellt, leert den Cache. Die nächste Runde schreibt ihn neu und kostet entsprechend.
was du heute umstellen kannst
- Gib dem Modell Tests oder einen Build, mit dem es seine Arbeit selbst prüft. Fehler fallen früher auf und kosten weniger Runden.
- Arbeite in einem Zug, solange der Cache warm ist. Lange Unterbrechungen machen den nächsten Schritt teuer.
- Nutze
/compactan natürlichen Pausen. Der Verlauf wird zusammengefasst und muss nicht mehr vollständig mitlaufen. - Halte die CLAUDE.md unter 200 Zeilen und schalte MCP-Server ab, die du nicht brauchst. Beides reist bei jeder Runde mit.
Den letzten Punkt habe ich im September selbst durchgezogen. Nach dem Aufräumen von Plugins und Skills lag der feste Sockel meiner Sitzungen bei rund 17.000 statt 73.000 Token. Wie eine schlanke Regeldatei und ein Modell-Routing aussehen, steht im Beitrag Claude Code einrichten. Wer viele PDFs verarbeitet, spart zusätzlich mit einem Hook, der PDFs vor dem Lesen in Markdown umwandelt.
| Kategorie | Wert |
|---|---|
| vorher | 73 |
| nachher | 17 |
- vorher73
- nachher17
selbst messen statt glauben
Anthropic sagt das offen. Die Zahlen im Beitrag sind Beispiele, maßgeblich ist, was deine eigenen Aufgaben kosten. Nach einer Sitzung zeigt /usage drei Werte, auf die es ankommt.
cache-trefferquote
Sollte bei langen Sitzungen hoch sein.
output zu input
Zeigt, wie viel das Modell denkt und schreibt.
input zur gesprächslänge
Verrät, wie oft der Verlauf neu gelesen wurde.
Als Orientierung nennt Anthropic Werte aus Unternehmen. Im Schnitt kostet ein Entwickler rund 13 Dollar pro aktivem Tag, 90 Prozent bleiben unter 30 Dollar.
quelle und stand
- Anthropic, Addy Osmani: What a task costs on Opus 5.5, 22.09.2026.
Stand 24.09.2026. Preise sind API-Listenpreise in US-Dollar.


