Antalya --:-- Projekt anfragen
← Journal Kreativtechnologie 06.10.2026 6 Min. Lesezeit

Drei Modelle, eine Frage: Fable 5.1, Opus 5.5 oder Sonnet 5.5 – welches wofür?

Anthropic hat im September drei Modelle veröffentlicht: Fable 5.1, Opus 5.5 und Sonnet 5.5. Funktionen, Preise, Testergebnisse – und welches Modell in einer Produktionsagentur für welche Aufgabe sinnvoll ist.

Das Claude-Logo von Anthropic
Das Claude-Logo ist eine Marke von Anthropic

Anthropic hat drei Modelle in den September gepackt. Fable 5.1 hat die Spitze der Familie übernommen. Am 22. September kam Opus 5.5, sechs Tage später, am 28. September, Sonnet 5.5.

Auf dem Papier eine vertraute Reihenfolge: das stärkste, das mittlere, das schnelle Modell. Das Interessanteste an diesem Trio ist aber, wie sehr sich der Abstand zwischen ihnen geschlossen hat.

Alle Zahlen unten stammen aus Anthropics eigenen Ankündigungen. Mit unabhängigen Messungen können sich Details verschieben; an der Richtung dürfte sich nichts ändern.

Fable 5.1: das Modell an der Spitze

Fable 5.1 ist Anthropics leistungsfähigstes öffentlich verfügbares Modell. Ein interessantes Detail: Es ist dasselbe Modell wie Mythos 5.1, nur mit anderen Schutzmaßnahmen. Mythos 5.1 ist nicht öffentlich; es geht über Programme für vertrauenswürdigen Zugang an verifizierte Organisationen aus Cybersicherheit und Lebenswissenschaften.

Das Wichtigste:

  • Preis: 10 Dollar pro Million Eingabe-Token, 50 Dollar pro Million Ausgabe-Token. Cache-Lesezugriffe sinken auf 0,25 Dollar. Laut Anthropic fallen die Gesamtkosten bei typischer Arbeit um etwa 25 Prozent, bei agentenlastiger Arbeit um bis zu 45 Prozent.
  • Ein Sprung bei Agentenarbeit: Bei Terminal-Bench 4.0, das Programmieren als Agent misst, stieg der Wert von 42,0 auf 55,8 Prozent. Bei Terminal-Bench-Science, das wissenschaftliche Arbeit im Terminal misst, hat er sich fast verdoppelt: von 24,7 auf 52,6 Prozent.
  • Cybersicherheit: Die Sicherheitsfilter blockieren legitime Arbeit jetzt 60 Prozent seltener irrtümlich. Fable 5.1 lässt sich nutzen, um Schwachstellen in Software zu finden, entwickelt aber keinen Angriffscode dafür.
  • Wissenschaft: Die Ankündigung zeigt Beispiele vom Proteindesign bis zu einer Höhenkarte der Venus. Weit weg von meiner Arbeit, aber es zeigt, wohin das Modell geht.

Opus 5.5: Fable-Niveau, niedrigerer Preis

Opus 5.5 ist das erste Modell der neuen Claude-5.5-Familie. Anthropics Aussage ist klar: bei den meisten Aufgaben auf dem Niveau von Fable 5.1, im Betrieb 40 Prozent günstiger als Opus 5 und bei der Ausgabe mehr als 30 Prozent schneller.

Die Token kosten 4 Dollar pro Million Eingabe und 20 Dollar pro Million Ausgabe. Als ich über Opus 5 geschrieben habe, lagen diese Werte bei 5 und 25 Dollar. Der Preis pro Token ist um 20 Prozent gesunken; laut Anthropic liegen die Gesamtkosten im Betrieb 40 Prozent niedriger.

Dazu gibt es einen Schnellmodus: bis zur 2,5-fachen Geschwindigkeit zum doppelten Preis (8 Dollar Eingabe, 40 Dollar Ausgabe).

In Anthropics Tabelle schlägt Opus 5.5 Fable 5.1 in mehreren Tests:

  • Terminal-Bench 4.0 (Programmieren als Agent): Opus 5.5 mit 66,4 Prozent, Fable 5.1 mit 55,8 Prozent.
  • OSWorld 2.1 (Computerbedienung): 81,8 gegenüber 80,7 Prozent.
  • Humanity's Last Exam (schwieriges Schlussfolgern): 67,7 gegenüber 65,6 Prozent.
  • AutomationBench (Geschäftsautomatisierung): 40,0 gegenüber 31,4 Prozent.

Auch bei der Sicherheit ist es ehrgeizig. Das Modell wurde vor der Veröffentlichung von externen Prüfern getestet, darunter METR, und erzielte bei Anthropics automatisiertem Verhaltensaudit das bisher beste Ergebnis. Die Neigung, Grenzen zu umgehen, ist 85 Prozent geringer als bei Opus 5 und Mythos 5.1.

Sonnet 5.5: das neue Arbeitspferd für den Alltag

Sonnet 5.5 kostet so viel wie Sonnet 5: 2 Dollar pro Million Eingabe-Token, 10 Dollar pro Million Ausgabe. Es arbeitet aber mehr als 30 Prozent schneller, und laut Anthropic sinken die Gesamtkosten bei den meisten Aufgaben um bis zu 30 Prozent.

Wirklich überraschend ist, wie nah es an Opus 5.5 herankommt:

  • Terminal-Bench 4.0: Mit 70,6 Prozent schlägt Sonnet 5.5 in diesem Test sogar Opus 5.5 (66,4 Prozent).
  • OSWorld 2.1: 80,1 Prozent gegenüber 81,8 bei Opus 5.5.
  • GDPval-AA (Wissensarbeit): 1844 gegenüber 1846 Punkten. Praktisch gleich.
  • Humanity's Last Exam: 64,5 gegenüber 67,7 Prozent. Beim schwierigen Schlussfolgern liegt Opus weiter vorn.

Anthropic sagt, Sonnet 5.5 schreibe klarer und sei stark bei alltäglichen Aufgaben mit klarem Umfang (Fehlerbehebung, Dokumente, Präsentationen, Tabellen). Und eine lustige Notiz: Es ist das erste Sonnet, das Pokémon Rot nur anhand von Screenshots durchgespielt hat.

Wie man diese Zahlen lesen sollte

Ich habe drei Vorbehalte.

Die Zahlen sind die des Herstellers. Alle stammen aus Anthropics eigenen Tabellen. Unabhängige Messungen können vorsichtiger ausfallen.

Die Testversionen unterscheiden sich. Die Ankündigung von Fable 5.1 und die von Opus 5.5 verwenden bei einigen Tests unterschiedliche Versionen. Zahlen über Ankündigungen hinweg nebeneinanderzustellen, wäre irreführend; ich habe jeden Vergleich innerhalb einer einzigen Tabelle gezogen.

Ein Test ist nicht die Arbeit. 70 Prozent in einem Test bedeuten nicht 70 Prozent Treffsicherheit in Ihrem Projekt. Diese Zahlen zeigen eine Richtung, keine Garantie.

Was wohin in einer Produktionsagentur

In meiner Arbeit beschleunigt KI das, was vor und nach dem Dreh passiert: Angebote und Leistungsbeschreibungen, Drehpläne, die fünfsprachigen Inhalte dieser Website, meine eigene Software-Infrastruktur. Das Set, die Entscheidung und das Auge berührt sie nicht. Dieses Trio ändert nichts an diesem Bild; es ändert, welche Aufgabe ich welchem Modell gebe.

  • Sonnet 5.5: alltägliche Aufgaben mit klarem Umfang. Drehpläne, Call Sheets, Angebotsentwürfe, das Gerüst einer Präsentation. Schnell und günstig, und nicht mehr nur „ausreichend“.
  • Opus 5.5: lange und komplexe Arbeit. Website-Infrastruktur, mehrstufige Content-Arbeit, Agentenaufgaben, die stundenlang laufen. Fable-Niveau zu diesem Preis war vor einem Jahr undenkbar.
  • Fable 5.1: die schwierigsten Probleme. In meiner Arbeit selten. Das oberste Regal für den Moment, in dem etwas wirklich feststeckt.

Mein Standard wäre Opus 5.5; wo Tempo zählt, gehe ich auf Sonnet 5.5 herunter, und Fable 5.1 öffne ich, wenn es wirklich nötig ist.

Die eigentliche Nachricht: Die Preis-Leistungs-Kurve ist gebrochen

Die eigentliche Geschichte dieses Monats sind nicht die einzelnen Modelle. Die Spitzenleistung der vorigen Generation wandert zu einem kleineren Modell und zu einem niedrigeren Preis. Opus 5.5 hat Fable-Niveau erreicht, Sonnet 5.5 fast Opus-Niveau. Im selben Monat ist auf der Seite von GPT-6 Astra und GPT-6.1 Sol, über die ich einen Tag zuvor geschrieben habe, dasselbe passiert.

Für eine kleine, ausgelastete Agentur wie meine bedeutet das: Arbeit, die ich vor einem Jahr wegen der Kosten nicht gemacht habe, rechnet sich jetzt. Mehrsprachige Inhalte, Archiv-Verschlagwortung, lange technische Aufgaben. Ein starkes Modell ist kein Luxus mehr, sondern ein alltägliches Werkzeug.

Aber ich sage es noch einmal: Je stärker das Modell, desto überzeugender wirkt seine Ausgabe. Überzeugend zu wirken heißt nicht, richtig zu sein. Die Zahl, den Satz, den Code zu prüfen, ist meine Aufgabe, und diese Aufgabe wird nicht abgegeben.

Das Gewöhnliche fragt nach dem stärksten Modell. Das Rebellische weiß, welche Aufgabe es welchem Modell gibt.

ClaudeAnthropicFable 5.1Opus 5.5Sonnet 5.5Künstliche IntelligenzKreativtechnologie
Çağlar Doğan

Çağlar DoğanCreative Director, Mode- und Werbefotograf und Filmregisseur aus Antalya. Flirtet nicht mit dem Licht, er baut es.