Stand: So 27.09. · 06:30
Programmierung

Samstag, 26. September 2026 · 15:00 Uhr

Claude Opus 5.5 günstiger und schneller, aber nicht klüger

Anthropics neues Modell Opus 5.5 spart laut Hersteller 40 Prozent Kosten, zeigt im Reasoning-Test aber keine bessere Leistung als der Vorgänger.

An­thro­pic hat Clau­de Opus 5.5 ver­öf­fent­licht und wirbt mit 40 Pro­zent ge­rin­ge­ren Kos­ten sowie 30 Pro­zent schnel­le­rer Aus­ga­be im Ver­gleich zu Opus 51. Ein Test des New Stack, der beide Mo­del­le bei rei­nen Re­a­so­ning-Auf­ga­ben ver­glich, zeigt je­doch, dass Opus 5.5 in der Qua­li­tät der Er­geb­nis­se nicht über dem Vor­gän­ger liegt1.

An­thro­pic senk­te die API-Prei­se von 5 auf 4 US-Dol­lar je Mil­li­on Ein­ga­be-Token und von 25 auf 20 US-Dol­lar je Mil­li­on Aus­ga­be-Token, was laut Ana­ly­se rund 20 Pro­zent­punk­te der ver­spro­che­nen Ein­spa­rung er­klärt; der Rest müss­te aus einer ge­rin­ge­ren Token-Nut­zung stam­men1. Ge­tes­tet wur­den drei an­spruchs­vol­le Auf­ga­ben – ein Lo­gi­krät­sel, eine kom­bi­na­to­ri­sche Um­ord­nungs­auf­ga­be und ein Stei­ne-Spiel mit Ge­dächt­nis­kom­po­nen­te – wobei beide Mo­del­le bei einem Lo­gi­krät­sel mit 28 Fel­dern iden­ti­sche, voll­stän­dig kor­rek­te Er­geb­nis­se lie­fer­ten1.

Da beide Mo­del­le bei iden­ti­schen Prompts und ak­ti­vier­tem ad­ap­ti­vem Den­ken ge­tes­tet wur­den und keine ab­wei­chen­den Er­geb­nis­se zwi­schen Wie­der­ho­lun­gen auf­tra­ten, deu­tet der Test dar­auf hin, dass Opus 5.5 zwar ef­fi­zi­en­ter, aber nicht leis­tungs­fä­hi­ger als Opus 5 ist1. Dies wi­der­spricht der Mar­ke­tin­g­aus­sa­ge von An­thro­pic, wo­nach Opus 5.5 auf dem Ni­veau eines stär­ke­ren Mo­dells na­mens Fable 5.1 ar­bei­ten und damit Opus 5 über­tref­fen solle1.