Mittwoch, 30. September 2026 · 00:36 Uhr
Community-Projekt prüft, ob Anthropics Opus 5.5 heimlich abgeschwächt wurde
Ein neues Open-Source-Tool namens Livenerf soll messen, ob das KI-Modell Opus 5.5 nach seiner Veröffentlichung leistungsmäßig verschlechtert wurde.
Auf der Plattform Hacker News sorgt ein Projekt namens Livenerf für Aufsehen, das der Frage nachgeht, ob Anthropics Modell Opus 5.5 seit seinem Launch an Leistung eingebüßt hat1. Der Beitrag erreichte innerhalb kurzer Zeit über 360 Punkte und mehr als 150 Kommentare, was auf reges Interesse in der Entwicklergemeinschaft hindeutet1. Hintergrund ist der wiederkehrende Verdacht in der KI-Community, dass Anbieter ihre Modelle nach der Veröffentlichung stillschweigend drosseln oder verändern, um Rechenkosten zu senken1.
Das Projekt soll offenbar fortlaufend Benchmarks oder Testfälle gegen das Modell laufen lassen, um Veränderungen in Antwortqualität oder Konsistenz über die Zeit sichtbar zu machen1. Damit reiht es sich in eine Reihe ähnlicher Initiativen ein, die als Reaktion auf Nutzerbeschwerden über schwankende Modellqualität bei großen Sprachmodellen entstanden sind1. Genaue technische Details zur Methodik oder zu bisherigen Ergebnissen des Tools werden in der vorliegenden Quelle jedoch nicht genannt1.
Der Zeitpunkt der Diskussion fällt in eine Phase intensiven Wettbewerbs zwischen Anthropic und OpenAI, dessen neue Modelle GPT-6.1 Sol und Dots kürzlich vorgestellt wurden. Ob ein Zusammenhang zwischen diesem Wettbewerbsdruck und möglichen Leistungsänderungen bei Opus 5.5 besteht, lässt sich aus der Quelle nicht ableiten1.