arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 6674 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 1921 篇

2607.13551 2026-07-16 cs.CL 新提交 57%

Cost-Pragmatic Quality Gating and Selection-Fusion Multi-Model Combiners for BioASQ Phases A+ and B

用于BioASQ A+和B阶段的成本实用质量门控和选择融合多模型组合器

Dima Galat, Marian-Andrei Rizoiu

机构 * University of Technology Sydney(悉尼科技大学)

专题命中 规划决策 :agent(abstract);分类 cs.CL

AI总结 该研究针对BioASQ任务14B 2026系统,围绕检索弱时的重新检索及多模型答案组合展开。采用混合与代理驱动管道结合质量门控,成本实用策略提升效果。还分解多模型集成,解析器在召回方面表现出色,团队在初步排行榜上成绩优异。

Comments CLEF2026, BioASQ2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13451 2026-07-16 cs.RO cs.AI cs.CV 新提交 57%

Learning Physics-Guided Residual Dynamics for Deformable Object Simulation

学习用于可变形物体模拟的物理引导残差动力学

Shivansh Patel, Kaifeng Zhang, Sanjay Pokkali, Svetlana Lazebnik, Yunzhu Li

机构 * UIUC(伊利诺伊大学厄巴纳 - 香槟分校) Columbia University(哥伦比亚大学)

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 研究针对可变形物体模拟中动力学预测难的问题,提出物理引导残差动力学(PGRD)框架,结合物理与学习方法优势,采用特定架构和公式,在多物体模拟上结果更准,还展示了其在操作规划和交互式模拟中的应用效用。

Comments Website: https://pgrd-robot.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13331 2026-07-16 cs.LG 新提交 57%

Accuracy-Preserving Stability Regularization for Large-Scale Retail Demand Forecasting

大规模零售需求预测中保持准确性的稳定性正则化

Jize Li, Jiani He, Dishu Yang, Dingyan Shang, Jingjing Liu, Shiqi Huang

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 研究大规模零售需求预测,提出在训练时对连续序列内变化施加惩罚的方法,结合多种特征评估稳定性。实验表明稳定性感知混合模型能提高预测稳定性得分,且RMSE变化小,拓展了零售预测从点误差最小化到准确性-稳定性权衡的评估视角。

Comments 9 pages, 5 figures, accepted for presentation at ICEME 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13072 2026-07-16 cs.RO cs.AI eess.SP 新提交 57%

HRO: Hierarchical Room-to-Object Framework for Zero-Shot Object Goal Navigation with Large Language Models

HRO:用于基于大语言模型的零样本目标导航的分层房间到物体框架

Luyuan Jia, Yinfeng Yu

机构 * School of Computer Science and Technology, Xinjiang University(新疆大学计算机科学与技术学院) Joint Research Laboratory for Embodied Intelligence, Xinjiang University(新疆大学具身智能联合研究实验室) Joint International Research Laboratory of Silk Road Multilingual Cognitive Computing, Xinjiang University(新疆大学丝绸之路多语言认知计算国际联合研究实验室)

专题命中 规划决策 :agent(abstract);分类 cs.AI

AI总结 针对零样本目标导航问题,提出LLM驱动的分层房间到物体(HRO)框架,引导智能体粗到细探索导航至目标物体,实验表明该框架在Gibson和HM3D数据集上优于现有基于LLM的方法。

Comments Main paper (6 pages). Accepted for publication by IEEE International Conference on Systems, Man, and Cybernetics 2026 (IEEE SMC 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11949 2026-07-15 eess.IV cs.AI 新提交 57%

BAT-RM: A Boundary-Aware Transformer with Region-Aware Multi-Directional Mamba for Clinically Deployed Cervical Cancer Radiotherapy Auto-Contouring

BAT-RM:一种用于临床部署的宫颈癌放疗自动轮廓勾画的具有区域感知多向曼巴的边界感知变换器

Istiak Ahmed, Kazi Shahriar Sanjid, Galib Ahmed, Md. Tanzim Hossain, Md. Anwarul Islam, Shahrukh Khan, Md. Ashrif Rahman Arian, Md. Nishan Khan, Md. Misbah Khan, S M Hasibul Hoque, Rahnuma Shahrin Rista, Md. Jobairul Islam, Sheikh Anisul Haque, Md Arifur Rahman, Syed Md. Akram Hussain, Syeda Nashra, Sayeed Shafayet Chowdhury, Md. Mostafa Kamal Sarker, M. Monir Uddin

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 研究针对宫颈癌放疗自动轮廓勾画问题,提出BAT-RM混合架构,集成多种技术。该架构在多机构数据实验中性能卓越,提升了初级肿瘤学家的交并比并减少轮廓勾画时间,临床部署后缩短患者等待时间,体现了严格研究流程对患者的益处。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12856 2026-07-15 cs.LG 新提交 57%

Verifier-Based Reinforcement Fine-Tuning of Reasoning Models for Thermal Energy Storage Control

基于验证器的热能存储控制推理模型强化微调

Takumi Shioda, Kohei Terashima, Tatsuo Nagai

机构 * The University of Tokyo(东京大学) Tokyo University of Science(东京理科大学)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 研究针对建筑物热能存储控制中模型难以扩展的问题,采用基于可验证奖励的强化学习,通过强化微调训练开放权重推理模型,在简单办公楼TES基准测试中取得较好效果,明确了规划模式转移情况,推动了相关测试与验证器发展。

Comments 29 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12590 2026-07-15 eess.SY cs.LG cs.SY 新提交 57%

Environment Parameter Gradient Theorem for Policy-Environment Co-Design in Reinforcement Learning

强化学习中用于策略-环境协同设计的环境参数梯度定理

Amber Srivastava

机构 * Faculty of Mechanical Engineering, Indian Institute of Technology Delhi(机械工程系,印度理工学院德里)

专题命中 规划决策 :agent(abstract);分类 cs.LG

AI总结 研究在环境可变的强化学习中联合优化策略与环境设计参数的问题,通过建立环境参数梯度定理及广义动作值函数,开发无模型算法,在无人机网络设计中证明可联合学习最优放置与路由以降低通信成本。

Comments 6 pages, 1 figure, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12775 2026-07-15 math.OC cs.LG cs.SY eess.SY 新提交 57%

Learning-enabled Acceleration of Scenario-based Model Predictive Control

基于学习的场景模型预测控制加速

Trinh Tran, Binh Nguyen, Truong X. Nghiem

机构 * Department of Electrical and Computer Engineering, University of Central Florida(电气与计算机工程系,中央佛罗里达大学)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 针对场景模型预测控制计算复杂的问题,提出学习加速的交替方向乘子法,通过重新表述问题、利用并行计算和莫罗包络学习加速求解,在微电网能量管理问题上评估,相比其他求解器有显著计算加速且保持控制性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11653 2026-07-14 cs.LG stat.ML 新提交 57%

Bet on Features: Anytime-Valid and Feature-Aware Auditing of Conditional Quantile Forecasters

押注于特征:条件分位数预测器的随时有效且特征感知审计

Ivane Antonov, Sohom Mukherjee, Richard Pibernik, Yo Joong Choe

机构 * Julius-Maximilians-Universität Würzburg(维尔茨堡大学朱利叶斯 - 马克西米利安斯大学) Zaragoza Logistics Center(萨拉戈萨物流中心) INSEAD(欧洲工商管理学院)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 研究针对黑箱条件分位数预测器,开发无分布且基于博弈论的测试框架,通过形式化校准概念、识别可实现功效的替代方案集,得出有限时间检测保证,能在特征层面解释证据过程,实证发现流行预测器存在校准错误。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11442 2026-07-14 cs.LG 新提交 57%

Velocity Scheduled Flow Matching

速度调度流匹配

Vitalii Bondar

机构 * Cherkasy State Technological University(切尔卡瑟国立技术大学)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 研究提出速度调度流匹配(VSFM)方法,放宽流匹配中样本恒速移动的隐含选择。通过特定多项式轮廓,预训练模型推理时无需重新训练和额外计算,FID降低,从零开始训练也有进一步提升,增益源于欧拉积分器局部截断误差。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11412 2026-07-14 cs.CV cs.AI 新提交 57%

Uncertainty Quantification for EO Regression Tasks: Building Height, Tree Canopy Height and Above-ground Biomass Estimation

地球观测回归任务的不确定性量化:建筑物高度、树冠高度和地上生物量估计

Ritu Yadav, Andrea Nascetti, Yifang Ban

机构 * Division of Geoinformatics, KTH Royal Institute of Technology(地理信息学部,瑞典皇家理工学院)

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 针对地球观测回归任务中多数深度学习模型缺乏可靠性指示的问题,利用哨兵 -1 SAR和哨兵 -2 MSI时间序列建模偶然不确定性,提出高斯和分位数两种互补方法,在三个任务上评估,结果优于基准和现有产品,树冠高度估计表现更优。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11377 2026-07-14 cs.RO cs.AI 新提交 57%

A Glimpse into Long-term Physical Coexistence with Intelligent Robots

深入了解与智能机器人的长期物理共存

Weiqi Jin, Peijun Tang, Kuncheng Luo, Baifu Huang, Binyan Sun, Haotian Yang, Shangjin Xie, Jianan Wang

机构 * Astribot Team(Astribot团队)

专题命中 规划决策 :agent(abstract);分类 cs.AI

AI总结 研究与智能机器人长期物理共存问题,提出基于机器人网关抽象的多机器人代理PHILIA,解耦代理推理与机器人执行,实现即插即用集成,在Astribot S1机器人上验证架构,展示用例,强调人机交互流程对有效协助的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11012 2026-07-14 cs.CL 新提交 57%

EasyOPD: An Easy-to-use On-Policy Distillation Framework for Large Language Models

EasyOPD:一种易于使用的大语言模型在线策略蒸馏框架

Jie Sun, Mao Zheng, Mingyang Song, Qiyong Zhong, Gengsheng Li, Zhepei Hong, Chang Wu, Pengfei Liu, Junfeng Fang, Xiang Wang

机构 * University of Science and Technology of China(中国科学技术大学) Tencent(腾讯) Shanghai Innovation Institute(上海创新研究院) National University of Singapore(新加坡国立大学)

专题命中 规划决策 :tool-use(abstract);分类 cs.CL

AI总结 研究针对传统语言模型蒸馏问题,提出基于verl构建的EasyOPD框架,分离用户配置等,为三种OPD设置实例化方法,经多基准测试,其实现可通过同一后端执行,还发布了相关配置、文档及演示包。

Comments 10 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10802 2026-07-14 cs.CY cs.LG 新提交 57%

Q-Learning Lab: Teaching Reinforcement Learning Through Learner-Generated Trace Analysis

Q学习实验室:通过学习者生成的轨迹分析教授强化学习

Ekkachai Jueng

机构 * Computer Science Program Faculty of Sciences and Liberal Arts Rajamangala University of Technology Isan(计算机科学系 法学院及文科院 瑞亚玛芒拉大学技术学院伊桑)

专题命中 规划决策 :agent(abstract);分类 cs.LG

AI总结 该研究提出Q学习实验室工具,通过学习者生成的轨迹分析教授表格Q学习。工具具可视化及记录功能,核心是学习-导出-分析循环。通过三项评估验证工具,还与现有工具比较、阐述教学法基础并提供教案,工具和代码公开。

Comments 12 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10787 2026-07-14 cs.CV cs.CL 新提交 57%

Detecting AI-Generated Video: A Vision-Language Dual-View Survey

检测人工智能生成的视频:视觉-语言双视角综述

Dylan Xinming Hou, Juntian Zhang, Xu Gu, Yichen Wu, Nils Lukas, Gus Xia, Xiuying Chen, Yuhan Liu

机构 * Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学中关村人工智能学院) Harvard University(哈佛大学)

专题命中 规划决策 :agentic(abstract);分类 cs.CL

AI总结 综述人工智能生成视频检测,将任务重定义为事实保真度验证,提出视觉-语言双视角分类法,基于对221篇论文回顾,综合生成范式、审视检测方法、回顾评估指标,讨论挑战并指出未来方向。

Comments 51 pages, accepted by ACL 2026

Journal ref Association for Computational Linguistics 2026 pages 32221 to 32255

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10511 2026-07-14 cs.CL 新提交 57%

Articulate Intuition or Genuine Analysis? Benchmarking Epistemic Reliability in LLM-as-a-Judge Peer Reviews

清晰的直觉还是真正的分析?评估大语言模型作为评审员的同行评审中的认知可靠性基准

Nuo Chen, Qian Wang, Qingyun Zou, Bingsheng He

机构 * National University of Singapore(新加坡国立大学)

专题命中 规划决策 :agentic(abstract);分类 cs.CL

AI总结 研究大语言模型评审员与人类评审员对同行评审评估的差异,将卡尼曼双过程理论转化为评分标准并发布Kahneman4Review基准,通过多方面发现揭示问题,强调可靠基准应区分分析形式与认知功能并给出设计选择。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09971 2026-07-14 cs.AI 新提交 57%

TopoExplore: Topological Discrimination for Archive-Based Exploration

TopoExplore:基于存档探索的拓扑判别

Jason Carlson

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 研究针对基于存档探索方法未考虑边界后区域能否进入的问题,提出TopoExplore,通过周期性拓扑遍历增强单元格选择,在MiniGrid套件等实验中取得加速效果,证明拓扑感知选择在区分封闭结构及开放覆盖区域均有优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09886 2026-07-14 cs.LG 新提交 57%

Nonparametric Bayesian Inverse Reinforcement Learning with Data-Parallel Gibbs Sampling

基于数据并行吉布斯采样的非参数贝叶斯逆强化学习

Sai Anirudh Katupilla, Shreeya Dasa Lakshminath

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 研究针对多专家示范下逆强化学习问题,采用狄利克雷过程先验的非参数贝叶斯方法,通过数据并行吉布斯采样联合推断潜在奖励类型及奖励,在ObjectWorld评估效果良好,还实现并行加速并刻画权衡。

Comments 6 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09787 2026-07-14 cs.CV cs.LG 新提交 57%

Adversarially Guided Diffusion for LiDAR Range Image Synthesis

用于激光雷达距离图像合成的对抗引导扩散

Stavros Bouras, Antonios Makris, Alexandros Gkillas, Aris S. Lalos, Konstantinos Tserpes

机构 * School of Electrical and Computer Engineering, National Technical University of Athens(雅典国立技术大学电气与计算机工程学院) Industrial Systems Institute, Athena Research Center(雅典娜研究中心工业系统研究所)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 研究针对二维距离图像分割的无限制对抗攻击,提出基于扩散并利用分割损失对抗引导的方法,在SemanticKITTI数据集实验,能跨架构转移,相比基线在有效性与现实性间有独特权衡,实现可控退化。

Comments Accepted at the 1st Workshop on Secure and Trustworthy AI (STAI 2026), co-located with the European Conference on Machine Learning and Principles and Practice of Knowledge Discovery in Databases (ECML PKDD 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09741 2026-07-14 cs.RO cs.AI cs.MA 新提交 57%

SWIFT: A Small-World Interaction Framework for Flow-Aware Trajectory Prediction in Autonomous Driving

SWIFT:用于自动驾驶中流量感知轨迹预测的小世界交互框架

Chengyue Wang, Bin Rao, Haicheng Liao, Bonan Wang, Chengzhong Xu, Zhenning Li

机构 * University of Macau(澳门大学) State Key Laboratory of Internet of Things for Smart City, University of Macau(澳门大学智慧城市物联网国家重点实验室) Department of Civil and Environmental Engineering, University of Macau(澳门大学土木与环境工程系)

专题命中 规划决策 :agent(abstract);分类 cs.AI

AI总结 研究自动驾驶中轨迹预测问题,提出SWIFT框架,结合小世界网络与交通流理论,通过特定网络和模块引入结构偏差与增强推理,实验证明其在多方面优于基线,展现出结构感知设计的有效性。

Comments Accepted by IEEE Transactions on Pattern Analysis and Machine Intelligence

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09712 2026-07-14 cs.LG 新提交 57%

ERP Data Provisioning Financial Control Testing

ERP数据供应财务控制测试

Anitha Samudrala

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 研究针对财务控制测试依赖ERP数据但直接复制有风险的问题,提出SEQ-FCT框架,结合多种技术,用合成数据集评估,与多种基线对比,在对账、欺诈触发召回率、控制失败等方面取得较好结果,表明综合评估更可靠。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10201 2026-07-14 eess.SY cs.AI cs.SY math.OC 新提交 57%

Comparing Socially-Equitable Renewable Energy Budget Allocation MDP Policies in Mature and Emerging Economies

比较成熟和新兴经济体中社会公平的可再生能源预算分配马尔可夫决策过程政策

Riya Kinnarkar, Mansur M. Arief, Yan Pratama Akhra, Dino Arla

机构 * Management \& Technology University of Pennsylvania Philadelphia, PA, USA Systems Engineering Institute Technology of Sepuluh Nopember (ITS) Surabaya, Indonesia Systems Engineering King Fahd University of Petroleum

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 研究成熟与新兴经济体中社会公平的可再生能源预算分配问题,将其建模为马尔可夫决策过程,用单一求解器接口比较政策,结果显示滚动时域值迭代政策占优,还揭示简单启发式方法在不同经济体效果不同。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11349 2026-07-14 math.OC cs.LG 新提交 57%

Inter-Stop Energy Prediction and Causal Driver Quantification for Dual-Source Trolleybuses via a Time-Aware Tabular Deep Learning Architecture

基于时间感知表格深度学习架构的双源无轨电车站点间能量预测及因果驱动因素量化

Wentao Zeng, Zijian Huang, Yiming Bie, Jiabin Wu, Jun Gong

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 研究双源无轨电车站点间能量预测及因果驱动因素量化问题,提出时间感知表格深度学习框架,集成周期性时间编码并结合贝叶斯优化调参,通过三层因果解释管道分析,实验表现优异,确定了关键因素并提供规划阈值。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09402 2026-07-13 cs.LG 新提交 57%

Data-Efficient Deep Learning: Empirical Guidelines for Training Set Size Estimation in Inertial Sensor Classification

数据高效深度学习:惯性传感器分类中训练集大小估计的实证指南

Ofir Kruzel, Itzik Klien

机构 * The Autonomous Navigation and Sensor Fusion Lab, the Hatter Department of Marine Technologies, University of Haifa(海法大学自主导航与传感器融合实验室,海洋技术哈特学院)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 研究针对深度学习在惯性传感器分类任务中依赖大规模数据集的瓶颈,通过系统实证评估学习曲线收敛率,提出统一框架和经验公式,引入定量稳定点指标,提供可推广框架,优化数据效率,为惯性传感应用记录活动规划提供指南。

Comments 1 pages, 17 figures, 15 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08925 2026-07-13 cs.LG 新提交 57%

SafeExplorer: An Unbiased Policy Gradient for Reinforcement Learning with Recovery Interventions

SafeExplorer:一种用于带有恢复干预的强化学习的无偏策略梯度算法

Elham Daneshmand, Majid Khadiv, Glen Berseth, Hsiu-Chin Lin

机构 * McGill University(麦吉尔大学) Mila(米拉) Technical University of Munich(慕尼黑工业大学) Université de Montréal(蒙特利尔大学)

专题命中 规划决策 :agent(abstract);分类 cs.LG

AI总结 研究在物理机器人上训练强化学习智能体减少跌倒问题,提出对PPO改进的SafeExplorer算法,核心是无偏策略梯度估计器,还添加加速学习组件,实验表明该算法大幅减少训练时间跌倒且奖励表现良好。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08971 2026-07-13 cs.LG math.ST stat.ML stat.TH 新提交 57%

Stochastic Linear Bandits with Partially Observed Actions

具有部分观测动作的随机线性博弈

Gautam Dasarathy, Vineet Gattani, Lalit Jain

机构 * Arizona State University(亚利桑那州立大学) GE Vernova(通用电气 Vernova) Google(谷歌)

专题命中 规划决策 :agent(abstract);分类 cs.LG

AI总结 研究具有部分观测动作的随机线性博弈问题,提出TOFU-POV算法,通过估计潜在动作子空间等操作,使遗憾为$\sqrt{T}$且与内在维度相关,还设计了秩自适应算法,实验证明该算法能改进自然基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03198 2026-07-13 cs.LG math-ph math.MP 新提交 57%

Reduced-Order Models: The Mother of World Models

降阶模型:世界模型之母

Rajat Ghosh

机构 * Independent Researcher(独立研究员)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 探讨世界模型的功能结构早于现代自监督学习,在模型降阶和控制文献中就已独立发展。追溯其在三个领域的发展,对比传统降阶模型与学习型世界模型的优缺点,指出在关键系统中部署世界模型的障碍及统一两者的研究议程。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08703 2026-07-10 cs.LG 新提交 57%

MPFlow: Learning Budgeted Max-Flow Optimization on the Lightning Network with Deep Graph Reinforcement Learning

MPFlow:基于深度图强化学习的比特币闪电网络预算最大流优化学习

Harrison Rush, Vincent Davis, Simone Antonelli, Vikash Singh, Jesse Shrader, Emanuele Rossi

机构 * Amboss Technologies(Amboss技术公司) CISPA Helmholtz Center for Information Security(CISPA海德堡信息安全中心) Stillmark(Stillmark公司) Sapienza University of Rome(罗马萨皮恩扎大学)

专题命中 规划决策 :agent(abstract);分类 cs.LG

AI总结 研究比特币闪电网络中给定预算下节点如何打开通道最大化路由容量的问题,采用图强化学习方法,结合消息传递策略网络、PPO和动作掩码,在真实网络快照实验中表现优于启发式基线,还用于生产中的对等推荐。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08602 2026-07-10 cs.AI 新提交 57%

Towards Precision Therapy in Hepatocellular Carcinoma: A Clinical-Reasoning LLM for Risk Stratification and Treatment Guidance

迈向肝细胞癌的精准治疗:用于风险分层和治疗指导的临床推理大语言模型

Peng Cui, Jitao Wang, Siyan Xue, Yao Huang, Haoming Xia, Dong Li, Dengxiang Liu, Weilin Wang, Liping Liu, Leida Zhang, Yunfu Cui, Tao Peng, Daolin Ji, Haitao Zhao, Wei Zhang, Xiaojuan Wang, Weijie Ma, Zongren Ding, Jinlong Li, Yuan Ding, Jiajing Zhao, Zhiyu Chen, Chengkun Yang, Ziyue Huang, Jiaqi Liu, Fusheng Liu, Yang Zhou, Xiaojuan Wang, Zhongquan Sun, Shiyun Bao, Xiaojun Wang, Ming Yang, Guangxin Li, Bin Shu, Yong Liao, Hongxuan Li, Yao Tang, Shizhong Yang, Yongyi Zeng, Yufeng Yuan, Yinpeng Dong, Jihui Hao, Jun Zhu, Jiahong Dong

专题命中 规划决策 :workflow(abstract);分类 cs.AI

AI总结 研究针对肝细胞癌治疗问题,提出HCC-STAR临床推理大语言模型。通过处理电子病历叙述输出风险分层、治疗方案等。经多中心队列验证,性能领先,能助医生决策,是可靠的肝细胞癌风险分层和精准治疗决策支持系统。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08554 2026-07-10 cs.AI 新提交 57%

CommuniWave:A Machine Learning Model for Quantifying the Degree of Temporary Informal Behavior in Urban Communities

CommuniWave:一种用于量化城市社区临时非正式行为程度的机器学习模型

Hongye Yang, Shien Liu, Zhihao Xie

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 研究针对城市社区规划缺乏量化居民非正式行为指标的问题,引入CommuniWave模型,它整合BCN、YLX和BEM,通过生成DIB波动图实现动态监测,助力城市管理者提升社区整体韧性。

Comments 17 pages, 4 figures. Presented at ASCAAD 2024

详情

展开后加载摘要…

URL PDF HTML 收藏