论文
Outongyi Lv, Yuanwei Zhang, Xiaoqun Zhang
08-31 11:41
GMTS:基于梯度幅值的令牌选择改进LLM推理的RLVR训练
梯度幅值token选择提升RLVR训练大模型推理
梯度幅值token选择提升RLVR训练大模型推理
逆向推理结合困惑度引导的预训练数据增强方法
主动学习降低指代图像分割与定位标注成本
合成数据可注入隐蔽目标偏差威胁LLM安全
自适应查询Transformer用于3D实例分割
真实图像到CAD重建的新数据集与方法
OCR提取考古陶器元数据的CENTURIA数据集
大规模自动化分类体系构建与评估框架
持续预训练使LLM适配瑞典新闻领域
电商生成式检索的嵌入与码本联合学习
开源WordPress聊天插件,支持角色权限与群组消息
扩散引导采样提升鲁棒估计效率
混合神经网络结合贝叶斯优化估计电池健康度
分析角色扮演越狱中大模型安全机制与拒绝行为
用合成课程学习提升时空视频定位的组合泛化
通过自然阅读眼动评估语言能力水平