RESEARCH27
Diagnosing Multi-step Reasoning Failures in Black-box LLMs via Stepwise Confidence Attribution
arXiv CS.CL·20. Mai 2026
Dieses Papier stellt Stepwise Confidence Attribution (SCA) vor, ein Framework für Black-Box-LLMs, das mehrstufige Schlussfolgerungsfehler durch schrittweise Konfidenzzuordnung diagnostiziert. SCA wendet das Information Bottleneck-Prinzip an, kennzeichnet Abweichungen von Konsensstrukturen als potenzielle Fehler und schlägt zwei komplementäre Methoden vor: NIBS und GIBS.
Original lesen ↗