Claude Opus 5 ist da — und übernimmt die Spitze
Anthropic hat Claude Opus 5 veröffentlicht. Die nüchterne Einordnung: Es ist aktuell das stärkste allgemein verfügbare Modell — und der Abstand ist diesmal messbar, nicht nur behauptet.
Was die Zahlen sagen
Im Intelligence Index von Artificial Analysis liegt Opus 5 bei 61 Punkten und damit an der Spitze. Im Agentic Index, der misst, wie gut ein Modell mehrstufige Aufgaben selbstständig durchzieht, kommt es auf 55,3. Bei den Programmier-Ranglisten von Arena, wo Menschen zwei Antworten vergleichen und abstimmen, steht es auf beiden Bestenlisten auf Platz eins.
Das ist deshalb bemerkenswert, weil Ranglisten sonst gern auseinanderfallen: Ein Modell gewinnt beim Rechnen, ein anderes beim Schreiben. Hier fällt beides zusammen.
Warum „agentisch" das eigentliche Thema ist
Der Sprung liegt weniger im Beantworten einzelner Fragen als im Durchhalten über mehrere Schritte. Ein Chatbot beantwortet eine Frage. Ein agentisches Modell nimmt eine Aufgabe an, zerlegt sie, benutzt Werkzeuge, prüft sein eigenes Ergebnis und kommt zurück, wenn es fertig ist.
Genau daran sind bisherige Modelle gescheitert: Nach dem dritten oder vierten Schritt verloren sie den Faden. Der Agentic Index misst nichts anderes als das.
Was heißt das für dich?
Wenn du nicht programmierst: Der Nutzen liegt in längeren Aufgaben. „Lies diese vier Dokumente, vergleiche sie und schreib mir eine Entscheidungsvorlage" ist die Art Auftrag, die vorher in der Mitte auseinanderfiel. Solche Ketten laufen jetzt zuverlässiger durch.
Wenn du programmierst: Es lohnt sich, das stärkste Modell für die schwierigen Stellen zu nehmen und die Routine bei einem günstigeren zu lassen. Die Preisunterschiede zwischen den Stufen sind größer als die Qualitätsunterschiede bei einfachen Aufgaben.
Und die ehrliche Einschränkung: Ranglisten messen Aufgaben, nicht deinen Alltag. Ein Modell, das im Index vorn liegt, ist nicht automatisch das, mit dem du am besten arbeitest — Tonfall, Geschwindigkeit und Preis entscheiden im echten Einsatz oft mehr. Probier es an einer Aufgabe aus, die du gut kennst, und vergleiche selbst.
Ein guter Einstieg dafür: unsere Guides zu ChatGPT oder Claude und dem Claude-Einstieg.