← 返回信息流
论文 arXiv 论文 · Millen Kanabar, Michael Gastpar 2026-08-31 17:00 🔥 热度 3

水印与掩码递归离散分布估计的极小极大界

水印与掩码递归离散分布估计的极小极大界研究

原文:Minimax bounds for watermarked and masked recursive discrete distribution estimation

水印(watermarking)被提出用于在估计场景中识别合成样本,即在没有任何元数据可将其与真实样本区分开的情况下,但其确切影响尚未被探索。在没有区分机制的情况下,已有研究表明,加入合成样本会显著降低新增真实样本的边际效力。在本工作中,我们研究了存在水印时此类递归离散分布估计的极小极大损失,并与无辅助损失和oracle辅助损失进行对比。当真实样本比例渐近趋近于零时,我们给出一个下界,表明除非检测的假阴性率也趋近于零,否则不可能通过添加水印来提升性能。此外,我们证明在大多数情形下,一组简单的确定性估计器的最坏情况损失在常数因子内匹配相应的下界。最后,我们提出掩码(masking),一种随机化过程,能将其余情形下的差距缩小到一个Jensen差距。我们推测通过更紧的下界论证可以消除这一差距。

查看原文 ↗ 技术论文

📌 相关阅读

EvoUndo:面向 LLM Agent 运行框架的可恢复性约束自进化方法 热度 20 还在为大模型洗数据熬夜?蚂蚁拿下VLDB工业最佳论文,一套宽表搞定35PB语料,效率狂飙5.6倍 热度 10 世界模型与大模型安全风险到底哪里不同 热度 8 手撸刑法 大模型 实录|零基础用Qwen+LoRA微调,百万卷宗RAG落地(附凌晨报错截图) 热度 8 LLM量化损伤的结构:为何应将额外比特全局分配 热度 8