论文
Alireza Bayat Makou, Emirhan Böge, Phu Gia Hoang, Federico Tiblias, Jingcheng Niu
08-31 12:02
MURANO:将机制可解释性实验设计为可组合流水线进行设计、运行与复现
Murano开源框架:可组合管道做机制可解释性实验
Murano开源框架:可组合管道做机制可解释性实验
SwarmBench评估大模型作为Agent集群编排器能力
InfraOcc:含静态到动态推理的路侧占用基准
APT:面向全重生成图像的锚点对齐扰动篡改定位
季节感知混合模型预测南极海冰密集度
多图场景下细粒度多模态大模型幻觉基准
PyKEEN-NSX:知识图谱负采样模块化扩展框架
追踪隐藏状态轨迹提升多轮推理自适应能力
多模态大模型中无需保留数据的身份遗忘定位方法
二部图方法估计LLM与VLM的不确定性与可靠性
对比强化学习从动作序列学习表征的新方法
量子-格拉斯曼混合token用于灾后建筑损毁评估
梯度幅值token选择提升RLVR训练大模型推理
逆向推理结合困惑度引导的预训练数据增强方法
主动学习降低指代图像分割与定位标注成本
合成数据可注入隐蔽目标偏差威胁LLM安全
自适应查询Transformer用于3D实例分割
真实图像到CAD重建的新数据集与方法
OCR提取考古陶器元数据的CENTURIA数据集
大规模自动化分类体系构建与评估框架
持续预训练使LLM适配瑞典新闻领域
电商生成式检索的嵌入与码本联合学习
扩散引导采样提升鲁棒估计效率
混合神经网络结合贝叶斯优化估计电池健康度
分析角色扮演越狱中大模型安全机制与拒绝行为
用合成课程学习提升时空视频定位的组合泛化
通过自然阅读眼动评估语言能力水平