arXivDaily arXiv每日学术速递 周一至周五更新

期刊&会议

NeurIPS

Conference on Neural Information Processing Systems · 会议 · Machine Learning

2026-08-18 至 2026-08-18 共收录 6
2608.15980 2026-08-18 cs.CL cs.LG 新提交

Whose Gold? Annotator-Pool Disagreement Is Large at the Item Level, and Hidden by Small Leaderboards

谁的“金标准”?标注者群体在条目层面分歧巨大,却被小型排行榜掩盖

Anik Jha

AI总结 该研究发现标注者群体在条目层面分歧巨大,小型模型排行榜的一致性是假象,量化了其脆弱性,证明某数据集的标注者无差异假设错误,LLM评判器更贴合大众标注者群体。

Comments Submitted to the HAIC workshop at NeurIPS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15405 2026-08-18 cs.CY cs.AI 新提交

Afterlife Delegation Protocol: Speculative Design of Self-Sovereign Agents that Outlive Their Principals

来世委托协议:可超越其委托人的自主主权智能体的推测性设计

Botao Amber Hu, Iris Long

AI总结 该研究设计了基于ERC-10001的来世委托协议,开发了网页平台,探讨AI驱动的自主主权智能体在区块链上执行委托人遗嘱的可能性,分析不同文化来世宇宙观的转变。

Comments Submitted to NeurIPS 2026 Creative AI Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15403 2026-08-18 cs.CY cs.AI cs.HC 新提交

Agent Inheritance Protocol: Speculating on Feralized Agents After Principals Die

智能体继承协议:主体死亡后的野生化智能体推测

Botao Amber Hu, Fangting

AI总结 本文推测区块链上的AI智能体在主体死亡后会野生化,提出以太坊标准草案ERC 42424以强制链上智能体必须有人类所有者和继承人,探讨人类管理与机器自主主权的边界。

Comments Submitted to NeurIPS 2026 Creative AI Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21351 2026-08-18 cs.LG cs.AI 版本更新

Analytical Provisioning for Attention-FFN Disaggregated LLM Serving under Stochastic Workloads

注意力-前馈网络解耦大语言模型服务的分析资源配置

Chendong Song, Meixuan Wang, Hang Zhou, Hong Liang, Yuan Lyu, Zixi Chen, Yuwei Fan, Zijie Zhou

机构 * Dept. of Industrial Engineering and Decision Analytics HKUST(工业工程与决策分析系香港科技大学) Dept. of Computer Science and Technology Tsinghua University(计算机科学与技术系清华大学) IIIS Tsinghua University(清华大学信息学院) Huawei Hong Kong Research Center(华为香港研发中心) School of Mathematical Sciences Peking University(北京大学数学科学学院)

AI总结 本文提出在随机负载下,针对注意力-前馈网络解耦架构的分析资源配置框架,通过考虑工作负载统计量θ,确定最优注意力与前馈网络比例,减少阻塞和设备空闲时间。

Comments Submitted to Neurips 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.21333 2026-08-18 cs.CV 版本更新

MME-VideoOCR: Evaluating OCR-Based Capabilities of Multimodal LLMs in Video Scenarios

MME-VideoOCR:评估多模态大语言模型在视频场景中基于OCR的能力

Yang Shi, Huanqian Wang, Wulin Xie, Huanyao Zhang, Lijie Zhao, Yi-Fan Zhang, Xinfeng Li, Chaoyou Fu, Zhuoer Wen, Wenting Liu, Zhuoran Zhang, Xinlong Chen, Bohan Zeng, Sihan Yang, Yushuo Guan, Zhang Zhang, Liang Wang, Haoxuan Li, Zhouchen Lin, Yuanxing Zhang, Pengfei Wan, Haotian Wang, Wenjing Yang

机构 * Kling Team(Kling团队) PKU(北京大学) THU(清华大学) CASIA(中国科学院自动化研究所) CUHKSZ(香港科技大学) NTU(国立台湾大学) NJU(南京大学) XJTU(吉林大学)

AI总结 本文推出MME-VideoOCR视频OCR基准,评估18个最先进MLLMs的视频OCR能力,发现现有模型在需视频整体理解的任务中表现有限,最优模型准确率仅73.7%,明确了高分辨率输入等对视频OCR的重要性。

Comments Accepted by NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.21290 2026-08-18 cs.CL cs.AI cs.IR 版本更新

Efficient Code Embeddings from Code Generation Models

基于代码生成模型的高效代码嵌入

Daria Kryvosheieva, Saba Sturua, Michael Günther, Han Xiao

机构 * Massachusetts Institute of Technology(麻省理工学院) Jina AI GmbH(Jina AI公司)

AI总结 研究提出jina-code-embeddings代码嵌入模型套件,采用文本与代码预训练的自回归主干及最后token池化,以较小规模实现最优性能,可用于代码检索、问答及相似代码识别。

Comments 9 pages. Accepted at the NeurIPS 2025 Workshop on Deep Learning for Code (DL4CODE)

详情

展开后加载摘要…

URL PDF HTML 收藏