Donnerstag, 17. September 2026 · 14:32 Uhr
Google DeepMind erforscht Unsicherheits-Erkennung bei KI-Modellen
Neue Forschung zeigt, wie Sprachmodelle ihre eigene Unsicherheit bewerten und dadurch entscheiden können, ob sie eine Antwort besser verweigern.
Forschende von Google DeepMind haben untersucht, wie KI-Modelle ihre eigene Unsicherheit einschätzen und mögliche Fehler erkennen können12. Ziel ist es, Chatbots dazu zu bringen, bei geringer Sicherheit lieber keine Antwort zu geben12.
Eine begleitende Studie zeigt, dass ein internes Konfidenzniveau eine zentrale Rolle bei dieser Entscheidung spielt: Je höher die interne Sicherheit, desto seltener verweigert das Modell eine Antwort3. Umgekehrt führt niedrige Konfidenz eher zu einem Antwortverzicht3.
Diese Erkenntnisse gelten als besonders relevant für autonome KI-Agenten, die eigenständig Entscheidungen treffen und Fehler frühzeitig vermeiden müssen3. Die Fähigkeit zur Selbsteinschätzung könnte damit ein wichtiger Baustein für zuverlässigere KI-Systeme werden123.