← 返回信息流
论文 arXiv 论文 · Qiyao Yan, Chenpeng Wang, Liangming Pan 2026-08-31 16:43 🔥 热度 3

预测错误,答案正确:从坍缩的LLM序列分数中恢复证据

从失败预测中恢复LLM隐藏的正确推理证据

原文:Wrong Prediction, Right Answer: Recovering Evidence from Collapsed LLM Sequence Scores

当大语言模型在推理任务中失败时,人们往往认为它缺乏相应的底层能力。然而,这混淆了真正的推理能力缺失与后期的输出瓶颈。我们在多个推理基准上观察到一致的读出差距:即使原生序列打分因结构性偏差而完全坍缩,隐状态探针仍能成功解码出正确答案。为了检验特定实例的逻辑是否能在这种坍缩中幸存,我们引入了一种诊断协议,使用一种最小化的、无需目标标签的加性修正。仅在25个无标注样本上拟合两个参数,即可为Qwen3.5模型恢复9至34个准确率百分点,并能成功迁移到OLMo-2-1B和Llama-3.1-8B。至关重要的是,这些恢复出的决策在简单词汇重叠无法解决的困难实例上依然有效,并显著超越了保持计数的置换基线。我们的结果表明,许多表面上的零样本推理缺陷其实是掩盖了完整内部逻辑的表达失败,这提醒人们应以更狭义的方式解读基准评估结果。

查看原文 ↗ 技术论文

📌 相关阅读

EvoUndo:面向 LLM Agent 运行框架的可恢复性约束自进化方法 热度 22 手撸刑法 大模型 实录|零基础用Qwen+LoRA微调,百万卷宗RAG落地(附凌晨报错截图) 热度 9 LLM量化损伤的结构:为何应将额外比特全局分配 热度 9 揭开人类丝滑变道的秘密,计算神经科学新成果绘出三大脑区连续决策地图 热度 8 BenchMIRT:LLM 基准测试到底在测什么? 热度 8