Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints
每个样本都很重要:基于逐点约束的语言模型监督微调
专题命中 工具调用 :function calling(abstract)
AI总结 研究语言模型微调中逐点约束问题,提出新对齐框架,通过逐样本约束最小化平均损失,引入学习松弛方法并开发增广拉格朗日方法,在多任务和约束下实例化,减少约束违反且保留模型性能。
AI 大模型
智能体、工具调用、规划、工作流、多智能体和自主任务执行。
每个样本都很重要:基于逐点约束的语言模型监督微调
专题命中 工具调用 :function calling(abstract)
AI总结 研究语言模型微调中逐点约束问题,提出新对齐框架,通过逐样本约束最小化平均损失,引入学习松弛方法并开发增广拉格朗日方法,在多任务和约束下实例化,减少约束违反且保留模型性能。
Weightflow:R 中声明式、可感知配方的调查加权
专题命中 工具调用 :workflow(abstract)
AI总结 研究为复杂调查生成权重的方法,提出 Weightflow 包,通过声明式 API 构建权重,将定义与应用分离,可重现可审计,能传播各阶段不确定性,实现多种校准及调整,经验证在实际数据中能恢复已知贫困率。
Comments 13 pages, 7 figures. Software on CRAN: https://CRAN.R-project.org/package=weightflow ; docs: https://jpferreira33.github.io/weightflow/
小程序、大问题:通过动态分析揭示小程序中基于 OAuth 的认证滥用情况
专题命中 工具调用 :workflow(abstract)
AI总结 研究通过动态分析揭示小程序中基于 OAuth 的认证滥用问题,设计 MINIAUTH 框架,对大量微信和百度小程序进行分析,发现多种滥用案例及百度 API 加密缺陷,强调加强开发者指导与平台保护的必要性。
Comments Accepted by ACM CCS 2026
寻找一阶优化的简单证明
专题命中 工具调用 :workflow(abstract)
AI总结 该研究针对一阶优化,将寻找简单证明结构设为第二阶段优化问题,从对偶证书出发,运用稀疏优化等工具开发后处理程序,通过特定特征衡量复杂度并引入多种方法,能简化证明结构,降低后续人工处理复杂度。
盲线搜索系统:BLiSS
专题命中 工具调用 :workflow(abstract)
AI总结 针对X射线天文台揭示更多微弱和混合发射线,现有分析方法难对大型数据集均匀分析的问题,提出开源Python包BLiSS,可快速盲检测和表征发射线候选者,无需先验模型,经实例验证性能良好,提供了相关工作流程。
花瓶博物馆:古希腊陶器数字智能博物馆
机构 * School of Computer Science and Technology, Beijing Jiaotong University(北京交通大学计算机科学与技术学院) ; School of Computer Science, Peking University(北京大学计算机科学学院) ; Huazhong University of Science and Technology(华中科技大学) ; Department of Computer Science and Information Technology, La Trobe University(拉筹伯大学计算机科学与信息技术系) ; UCAS-Terminus AI Lab, University of Chinese Academy of Sciences(中国科学院大学UCAS-Terminus人工智能实验室)
专题命中 工具调用 :agent(abstract)
AI总结 针对古希腊陶器文化遗产领域中视觉语言模型面临的挑战,提出轻量级模块化多模态智能体框架花瓶博物馆,结合虚拟博物馆与花瓶智能体,经多模态感知等操作,提高引用有效性,减少幻觉并产生更中立答案。
Comments Code: https://github.com/AIGeeksGroup/VaseMuseum. Website: https://aigeeksgroup.github.io/VaseMuseum
Probe-EM:通过无训练语义验证进行靶向神经元追踪
机构 * State Key Laboratory of Brain Cognition and Brain-inspired Intelligence Technology, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化所脑认知与脑机智能技术重点实验室) ; School of Future Technology, University of Chinese Academy of Sciences(中国科学院大学未来技术学院) ; School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) ; School of Advanced Interdisciplinary Sciences, University of Chinese Academy of Sciences(中国科学院大学高等研究院)
专题命中 工具调用 :workflow(abstract)
AI总结 为解决自动重建算法过分割瓶颈及传统追踪方法问题,提出无训练靶向神经元追踪框架,利用几何先验和新策略迭代重建神经元形态,集成到平台减少人工校对时间。
Comments Accepted at MICCAI 2026
用于内点最优潮流的嵌套循环轨迹引导变分量子求解器
专题命中 工具调用 :workflow(abstract)
AI总结 针对内点法求解最优潮流时,变分量子线性求解器嵌套循环致收敛慢的问题,提出双层可训练量子内点法框架,利用早期轨迹优化,减少变分更新次数,保持目标值接近经典方法。
Comments 10 pages
关于人工智能的弦论前讲座
专题命中 工具调用 :agentic(abstract)
AI总结 该讲座围绕神经网络要素、神经网络场论方法及弦论应用AI展开,通过场论视角阐述神经网络,介绍相关成果,如通用定理、弦振幅等,还涉及弦论应用AI的多种技术。
Comments 42 pages. Content from 2408.00082 was utilized for some lecture material
底物无关的3x:生物印记、技术印记、生态学
专题命中 工具调用 :agent(abstract)
AI总结 本文提出底物无关生态学概念,整合生物印记与技术印记研究,基于生态位构建理论建立统一视角。
Comments 5 pages
AMBUSH:复杂环境下的协作捕获与神经加速
机构 * School of Advanced Manufacturing and Robotics, Peking University(北京大学先进制造与机器人学院) ; Distributed Autonomous Systems and Control Lab, University of Michigan(密歇根大学分布式自主系统与控制实验室)
专题命中 工具调用 :planning(abstract)
AI总结 提出基于“伏击”策略的参数化方法,结合混合蒙特卡洛树搜索与神经加速,实现多个慢速追捕者在复杂环境中高效捕获快速逃逸者。
NanoVer: 一个用于在消费级硬件上进行扩展现实交互式分子动力学(iMD-XR)的开源框架
专题命中 工具调用 :AI agent(abstract)
AI总结 本文介绍NanoVer,一个开源框架,允许多人共处同一虚拟空间,以原子级精度实时操控柔性3D分子结构的分子动力学模拟,支持消费级独立XR硬件,并实现多客户端通信与多种任务。
基础模型的自适应微调用于晶体结构预测:CaFeNi体系中高压相的发现
专题命中 工具调用 :workflow(abstract)
AI总结 提出一种结合进化搜索与自适应数据选择及微调的自洽基础模型辅助晶体结构预测工作流,通过迭代选择代表性结构进行DFT标记,高效探索Ca-Fe-Ni三元体系,预测了高压下稳定的新化合物Ca6FeNi。
Comments 10 pages, 13 figures
TabClean: 用于表格数据清洗的可复用LLM合成程序
专题命中 工具调用 :workflow(abstract)
AI总结 提出TabClean系统,通过将LLM推理编译为可复用的带守卫修复程序,实现无模型训练的表格数据清洗,在五个基准数据集上F1优于基线,并大幅降低重复运行成本。
Comments 13 pages
基于支配性的可行推断用于带装箱约束的取送货问题
专题命中 工具调用 :planning(abstract)
AI总结 针对带二维装箱约束的取送货问题,提出一种基于支配性的可行推断框架,通过保序映射和搜索规则减少精确装箱验证调用,将可行性检查时间降低高达42%。
Comments 34 pages, 11 figures
与艺术家合作寻找生命
专题命中 工具调用 :planning(abstract)
AI总结 本文探讨艺术与科学协作在天体生物学中的价值,通过案例展示艺术家在问题解决、情境化和设计思维方面的独特贡献,并提出资助艺术家咨询、恢复驻留项目等建议。
Comments NASA-DARES 2025 white paper, 5 pages, 3 figures. Originally submitted in 2025 under topic 8 (Prepare for the Discovery of Life Beyond Earth and Subsequent Post-Discovery Activities), which now falls under focus area 9 (Astrobiology in Society)
CONDUCTOR: 一种用于不确定性感知配电网运行的LLM编排数字孪生
专题命中 工具调用 :tool use(abstract)
AI总结 提出CONDUCTOR,一种基于大语言模型编排的数字孪生系统,用于配电网运行,支持不确定性感知分析(概率安全评估、鲁棒校正调度等),在真实丹麦博恩霍尔姆60 kV配电网测试中,首次任务正确率达98.5%。
基于s(CASP)的复杂自主无人机任务执行与决策
专题命中 工具调用 :agent(abstract)
AI总结 提出使用s(CASP)回答集编程系统构建符号状态中心的无人机代理,在虚幻引擎5环境中实现基于约束的常识推理,支持多步骤自主行为并动态调整计划,确保决策正确可解释。
“局部发生,全局泄露”:检测MCP服务器中的隐私泄露风险
专题命中 工具调用 :agent(abstract)
AI总结 提出MCPPrivacyDetector,一种上下文感知的跨语言静态分析框架,用于检测MCP服务器中由协议引发的隐私泄露,在10,655个真实服务器中发现超过10%的泄露率。
从惩罚到保护:通过主题建模和LLM辅助分析描绘美国少年司法的六十年变迁
专题命中 工具调用 :tool use(abstract)
AI总结 本文通过主题建模和LLM辅助分析60470份美国上诉意见(1970-2025),发现儿童福利案件激增、性犯罪登记案件翻倍,而传统惩罚机制(移交成人法庭、少年死刑)大幅下降,并揭示了法律词汇的十年演变和司法管辖区碎片化风险。
Comments 7 figures, 4 tables, includes appendices
PACMS: 作为LLM代理可插拔引擎的子模上下文选择
专题命中 工具调用 :agent(abstract)
AI总结 提出PACMS,一种基于子模函数最大化的上下文选择方法,在提示组装时按相关性从会话、记忆和工具输出中挑选内容,替代截断机制,提升长对话中的信息保持能力。
LLM介导的人机交互在搜索与救援中的应用:专业知识对注意力分配的影响
专题命中 工具调用 :planning(abstract)
AI总结 本研究通过模拟搜索救援任务,比较有无大语言模型(LLM)指导的条件,结合眼动追踪和行为分析,发现LLM提升任务效率但未增加总救援人数,并揭示了注意力-指导权衡,其中专业知识调节了用户对AI的依赖模式。
HEACalculator:用于高熵合金热力学性质计算和固溶体预测的开源Python工具
专题命中 工具调用 :workflow(abstract)
AI总结 本文介绍HEACalculator,一个开源Python包,可计算16种常用热力学和结构描述符,并评估8种固溶体形成规则,支持CLI、GUI和API三种使用模式。
Comments 7 pages, 1 figure
Tangram: 隐藏GPU异构性以实现高效的大语言模型并行化
专题命中 工具调用 :planning(abstract)
AI总结 提出Tangram系统,通过将并行化规划与GPU异构性解耦,利用同构GPU岛和模型切片组合成工作平衡流水线,实现现有异构不可知并行化器在异构集群中的高效使用,训练吞吐量提升高达2.3倍。
CacheWise:理解工作负载并优化KVCache管理以高效服务LLM编码代理
专题命中 工具调用 :agent(abstract)
AI总结 针对编码代理会话中大量前缀复用导致KVCache压力的问题,提出CacheWise管理层,结合前缀感知调度和基于工具调用元数据的轻量级预测驱逐策略,减少KVCache驱逐并提升会话完成时间。
一种基于模型与无模型混合框架的主动多视角声纳目标识别视点优化
机构 * University of California, Berkeley(加州大学伯克利分校)
专题命中 工具调用 :agent(abstract)
AI总结 提出混合模型与无模型框架,结合CNN观测似然与Radon方向估计,通过信息增益奖励训练PPO智能体离线学习视点选择策略,部署时仅用CNN信念更新实现实时视点选择,在声纳数据集上以更少感知步数和运动成本达到竞争性识别精度。
面向搜索与推荐系统的可验证用户模拟
专题命中 工具调用 :agent(abstract)
AI总结 提出一个七组件可审计框架,将用户模拟器视为可验证工程制品,通过动手实验检查模拟器行为、诊断差异并检测人口偏差。
Comments Presented as a half-day tutorial at SIGIR 2026, 4 pages
Journal ref In Proceedings of the 49th International ACM SIGIR Conference on Research and Development in Information Retrieval (SIGIR 2026)
基普问题:分布式认知下的制度可读性
专题命中 工具调用 :agent(abstract)
AI总结 针对分布式AI系统认知分散导致制度可读性丧失的问题,提出“基普问题”概念,强调需要维护解释连续性而非仅保留痕迹,并建议构建治理工作空间和承载收据的治理界面作为解释基础设施。
Comments 17 pages, 2 figures, 1 table. Conceptual governance paper on institutional legibility, distributed cognition, and interpretive continuity in AI systems
消失的行为:生成式搜索与影子封禁
专题命中 工具调用 :agentic(abstract)
AI总结 本文研究生成式搜索和影子封禁对互联网开放生态的破坏,分析其法律与监管问题,并提出增强透明度与公平性的解决方案。
Journal ref 27 German Law Journal 1211 - 1234 (2025)
OpenPCC:在商用TEE上提供开放且保密的LLM服务
专题命中 工具调用 :AI agent(abstract)
AI总结 针对云推理服务中用户请求包含敏感信息的问题,提出OpenPCC框架,利用商用TEE实现开放、保密的LLM服务,并通过原型验证其可行性与安全性。