direkt zum inhalt

24. September 2026kiunternehmen

Was eine Aufgabe auf Opus 5.5 kostet und wo du den Preis selbst bestimmstWhat a task costs on Opus 5.5 and where you set the price yourself

Opus 5.5 ist pro Token billiger als Opus 5. Was eine Aufgabe am Ende kostet, entscheiden aber vier Dinge, die du in der Hand hast. Eine kurze Einordnung des Anthropic-Beitrags.Opus 5.5 is cheaper per token than Opus 5. What a task really costs depends on four things you control. A short take on Anthropic's post.

this article is currently available in german only.

Aufgeräumter Holzschreibtisch im Morgenlicht mit aufgeklapptem Laptop, einer Messingwaage mit drei gestapelten Münzen, einem Kassenzettel und einer grauen Kaffeetasse.
Titelbild KI-generiert, als solches gekennzeichnet.

Anthropic hat vor zwei Tagen vorgerechnet, was eine Aufgabe auf Opus 5.5 kostet. Der Beitrag von Addy Osmani ist kurz und nüchtern. Die wichtigste Aussage steht nicht in der Preistabelle. Sie steckt in der Frage, wie oft dein Agent denselben Verlauf noch einmal liest.

Ich arbeite jeden Tag mit Claude Code und habe den Beitrag gegen mein eigenes Setup gelesen. Hier die Kurzfassung mit den Stellen, an denen du selbst drehen kannst.

die quelle

Anthropic, Claude-Blog, Addy Osmani, 22.09.2026
What a task costs on Opus 5.5

der kern in vier sätzen

  • Billiger pro Token: Input und Output 20 Prozent, Cache-Lesen 60 Prozent günstiger als bei Opus 5.
  • Cache schlägt Modellwahl: Ein Token aus dem Cache kostet 5 Prozent eines frischen Input-Tokens.
  • Effort vor Modellwechsel: Erst höher denken lassen, dann erst zu Fable 5.1 greifen.
  • Selbst messen: Die Zahlen im Beitrag sind Beispiele, deine Rechnung zeigt /usage.

die neuen preise

Opus 5.5 kostet über die API 4 Dollar je Million Input-Token und 20 Dollar je Million Output-Token. Ein Lesezugriff auf den Cache kostet 0,20 Dollar je Million.

preis je token, opus 5 = 100 %
Kategorieopus 5opus 5.5
input100 %80 %
output100 %80 %
cache lesen100 %40 %
  • opus 5
  • opus 5.5

Gegenüber Opus 5 sind Input und Output 20 Prozent billiger, der Cache 60 Prozent. In einer Beispielsitzung mit gleichem Tokenverbrauch spart das laut Anthropic rund 31 Prozent. Wer nichts ändert, zahlt also schon weniger.

input und output−20 %günstiger als bei Opus 5
cache lesen−60 %günstiger als bei Opus 5
beispielsitzung−31 %bei gleichem Tokenverbrauch, laut Anthropic

vier dinge bestimmen die rechnung

Der Beitrag zerlegt die Kosten einer Aufgabe in vier Größen. Jede davon kannst du beeinflussen.

Runden. Bei jeder Runde schickt Claude den bisherigen Verlauf erneut mit. Eine Aufgabe, die in acht Runden fertig ist, liest ihren Anfang achtmal. Weniger Rückfragen und klarere Aufträge sparen hier am meisten. Wie eine Runde im Detail abläuft, zeigt der Beitrag Die Agent-Schleife.

Cache-Treffer. Liegt der Verlauf im Cache, kostet er nur einen Bruchteil. Der Cache hält im Abo eine Stunde, mit API-Key oder über Cloud-Anbieter fünf Minuten. Lange Pausen mitten in der Arbeit sind deshalb teurer, als sie aussehen.

opus 5.5: eine million token in us-dollar, input aus dem cache kostet 5 % von frischem input
KategorieWert
output20 $
input4 $
cache0,20 $
  • output20 $
  • input4 $
  • cache0,20 $

Output. Ein Output-Token kostet das Fünffache eines Input-Tokens. Dazu zählen auch die Denk-Token, selbst wenn du nur eine Zusammenfassung davon siehst.

Modell. Die Modellwahl setzt den Preis für jedes einzelne Token der Sitzung. Ein Wechsel wirkt deshalb auf alles, was danach kommt.

effort vor modellwechsel

Opus 5.5 kennt mehrere Effort-Stufen. Anthropic empfiehlt low für mechanische Arbeit wie Umbenennungen und medium als Standard für klar umrissene Tagesarbeit. High nimmst du, wenn medium hängen bleibt. Das kostet rund 20.000 zusätzliche Denk-Token, bei 20 Dollar je Million also etwa 40 Cent pro Aufgabe. Eine gesparte Schleife aus drei Fehlversuchen ist meist teurer.

  1. low

    Mechanische Arbeit wie Umbenennungen.

  2. medium

    Standard für klar umrissene Tagesarbeit.

    aktuell
  3. high

    Wenn medium hängen bleibt. Rund 20.000 Denk-Token mehr.

  4. fable 5.1

    Erst wenn high zweimal stecken bleibt. Input und Output 2,5-fach teurer.

  5. zurück zu opus

    Nach dem gelösten Problem wieder auf Opus 5.5.

Anthropic fasst das in eine Regel. Effort erhöhen, bevor du das Modell wechselst. Bleibt Opus 5.5 auf high zweimal stecken, holst du Fable 5.1 für genau dieses Problem und gehst danach zurück. Sonnet und Haiku gehören in Subagenten für Suchen, Logs und Nachschlagen. In meinem Setup erledigt ein Haiku-Subagent genau diesen Kleinkram, das Hauptmodell plant und prüft.

Modellwahl nach Anthropic: das Modell setzt den Preis für jedes Token der Sitzung
modellwofürinput / output je mio.
opus 5.5beaufsichtigte arbeit: features, debugging, code-review4 $ / 20 $
fable 5.1lange läufe ohne aufsicht, neue probleme10 $ / 50 $
sonnet, haikusubagenten für suche, logs, nachschlagenim beitrag nicht genannt

Ein Detail aus dem Beitrag verdient Aufmerksamkeit. Wer mitten in der Sitzung mit /effort umstellt, leert den Cache. Die nächste Runde schreibt ihn neu und kostet entsprechend.

was du heute umstellen kannst

  • Gib dem Modell Tests oder einen Build, mit dem es seine Arbeit selbst prüft. Fehler fallen früher auf und kosten weniger Runden.
  • Arbeite in einem Zug, solange der Cache warm ist. Lange Unterbrechungen machen den nächsten Schritt teuer.
  • Nutze /compact an natürlichen Pausen. Der Verlauf wird zusammengefasst und muss nicht mehr vollständig mitlaufen.
  • Halte die CLAUDE.md unter 200 Zeilen und schalte MCP-Server ab, die du nicht brauchst. Beides reist bei jeder Runde mit.

Den letzten Punkt habe ich im September selbst durchgezogen. Nach dem Aufräumen von Plugins und Skills lag der feste Sockel meiner Sitzungen bei rund 17.000 statt 73.000 Token. Wie eine schlanke Regeldatei und ein Modell-Routing aussehen, steht im Beitrag Claude Code einrichten. Wer viele PDFs verarbeitet, spart zusätzlich mit einem Hook, der PDFs vor dem Lesen in Markdown umwandelt.

fester sockel jeder sitzung in tausend token, rund (eigene messung 10.09.2026)
KategorieWert
vorher73
nachher17
  • vorher73
  • nachher17

selbst messen statt glauben

Anthropic sagt das offen. Die Zahlen im Beitrag sind Beispiele, maßgeblich ist, was deine eigenen Aufgaben kosten. Nach einer Sitzung zeigt /usage drei Werte, auf die es ankommt.

  1. cache-trefferquote

    Sollte bei langen Sitzungen hoch sein.

  2. output zu input

    Zeigt, wie viel das Modell denkt und schreibt.

  3. input zur gesprächslänge

    Verrät, wie oft der Verlauf neu gelesen wurde.

Als Orientierung nennt Anthropic Werte aus Unternehmen. Im Schnitt kostet ein Entwickler rund 13 Dollar pro aktivem Tag, 90 Prozent bleiben unter 30 Dollar.

quelle und stand

Stand 24.09.2026. Preise sind API-Listenpreise in US-Dollar.

geschrieben vonwritten by · business transformation, ki und führung im mittelstand. methode: core+.business transformation, ai and leadership for mid-sized companies. method: core+.

weiterlesenkeep reading

← zurück zum herrlichblog← back to the herrlichblog