arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Xi'an Jiaotong University(西安交通大学)

共收录 765
2601.20894 2026-01-30 cs.LG

Is Parameter Isolation Better for Prompt-Based Continual Learning?

参数隔离是否更适合基于提示的持续学习?

Jiangyang Li, Chenhao Ding, Songlin Dong, Qiang Wang, Jianchao Zhao, Yuhang He, Yihong Gong

机构 * Xi’an Jiaotong University(西安交通大学) Shenzhen University of Advanced Technology(深圳大学)

AI总结 本文提出了一种基于提示共享的持续学习框架,通过动态解耦和协作优化提升参数利用效率,有效缓解知识遗忘问题。

Comments 17 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19365 2026-01-30 cs.CV

Efficient Spike-driven Transformer for High-performance Drone-View Geo-Localization

高效脉冲驱动变压器用于高性能无人机视角地理定位

Zhongwei Chen, Hai-Jun Rong, Zhao-Xu Yang, Guoqi Li

机构 * State Key Laboratory for Strength and Vibration of Mechanical Structures, Shaanxi Key Laboratory of Environment and Control for Flight Vehicle, School of Aerospace Engineering, Xi’an Jiaotong University(强度与振动机械结构国家重点实验室、飞行器环境与控制陕西省重点实验室、航空航天工程学院)

AI总结 SpikeViMFormer通过脉冲驱动变压器和混合状态空间模块,实现了高效低能耗的无人机视角地理定位。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.13993 2026-01-30 eess.IV cs.AI cs.CV

OrthoInsight: Rib Fracture Diagnosis and Report Generation Based on Multi-Modal Large Models

OrthoInsight:基于多模态大模型的肋骨骨折诊断与报告生成

Ningyong Wu, Jiangbo Zhang, Wenhong Zhao, Jinzhi Wang, Chenzhan Yu, Zhigang Xiu, Duwei Dai, Ziyu Xu, Yongli Yang

机构 * Organizational Management Department, School of Management, Xi’an Jiaotong University(管理学院组织管理部,西安交通大学) West China Longquan Hospital, Sichuan University(四川大学西部临床医学院) School of Electronic Science and Engineering, Xi’an Jiaotong University(西安交通大学电子科学与工程学院) Systems Engineering Institute, Xi’an Jiaotong University(西安交通大学系统工程研究院) Institute of Medical Artificial Intelligence, the Second Affiliated Hospital of Xi’an Jiaotong University(西安交通大学第二附属医院医学人工智能研究所) School of Human Settlements and Civil Engineering, Xi’an Jiaotong University(西安交通大学人居环境与土木工程学院) School of Life Science and Technology, Xi’an Jiaotong University(西安交通大学生命科学与技术学院)

AI总结 OrthoInsight通过多模态大模型实现肋骨骨折的自动诊断与报告生成,结合CT图像分析与医学知识图谱,提升诊断效率和临床实用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20689 2026-01-29 cs.CV cs.AI

Decoupling Perception and Calibration: Label-Efficient Image Quality Assessment Framework

解耦感知与校准:一种标签高效的图像质量评估框架

Xinyue Li, Zhichao Zhang, Zhiming Xu, Shubo Xu, Xiongkuo Min, Yitong Chen, Guangtao Zhai

机构 * Shanghai Jiao Tong University(上海交通大学) Xi’an Jiaotong University(西安交通大学) Baidu(百度)

AI总结 LEAF通过蒸馏多模态大语言模型的感知先验,实现轻量级图像质量评估,减少对人类标注的依赖,同时保持与人类注释的一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20526 2026-01-29 cs.CV

IOTA: Corrective Knowledge-Guided Prompt Learning via Black-White Box Framework

IOTA: 通过黑盒白盒框架实现纠正知识引导的提示学习

Shaokun Wang, Yifan Yu, Yuhang He, Weili Guan, Yihong Gong

机构 * Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳)) Xi’an Jiaotong University(西安交通大学)

AI总结 IOTA通过结合黑盒和白盒模块,利用纠正知识引导提示学习,提升下游任务适应效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.16324 2026-01-29 cs.CV

From Prediction to Perfection: Introducing Refinement to Autoregressive Image Generation

从预测到完美:引入精修到自回归图像生成

Cheng Cheng, Lin Song, Di An, Yicheng Xiao, Xuchong Zhang, Hongbin Sun, Ying Shan

机构 * Xi’an Jiaotong University(西安交通大学) Johns Hopkins University(约翰霍普金斯大学) Tsinghua University(清华大学) ARC Lab, Tencent PCG(腾讯PCG ARC实验室)

AI总结 TensorAR通过引入张量预测机制,改进自回归图像生成的质量和性能。

Comments Published as a conference paper at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.19430 2026-01-28 cs.CV

Unveiling Perceptual Artifacts: A Fine-Grained Benchmark for Interpretable AI-Generated Image Detection

揭示感知伪影:一个可解释AI生成图像检测的细粒度基准

Yao Xiao, Weiyan Chen, Jiahao Chen, Zijie Cao, Weijian Deng, Binbin Yang, Ziyi Dong, Xiangyang Ji, Wei Ke, Pengxu Wei, Liang Lin

机构 * Sun Yat-sen University(中山大学) Peng Cheng Laboratory(鹏城实验室) Xi’an Jiaotong University(西安交通大学) Australian National University(澳大利亚国立大学) Tsinghua University(清华大学)

AI总结 本文提出X-AIGD基准,通过细粒度注释感知伪影,揭示现有AIGI检测器对伪影的依赖低,且需提升可解释性与泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17405 2026-01-27 cs.CV

HAAF: Hierarchical Adaptation and Alignment of Foundation Models for Few-Shot Pathology Anomaly Detection

HAAF: 用于少样本病理异常检测的层次适应与对齐框架

Chunze Yang, Wenjie Zhao, Yue Tang, Junbo Lu, Jiusong Ge, Qidong Liu, Zeyu Gao, Chen Li

机构 * Sch Comp Sci \& Technol, Xi'an Jiaotong University Xi'an China University of Cambridge Cambridge United Kingdom Sch Comp Sci \& Technol, Xi'an Jiaotong University University of Cambridge

AI总结 HAAF通过层次适应与对齐框架,解决少样本病理异常检测中的粒度不匹配问题,提升模型在低资源场景下的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.05293 2026-01-27 cs.CV

Cross-domain EEG-based Emotion Recognition with Contrastive Learning

跨领域EEG情感识别与对比学习

Rui Yan, Yibo Li, Han Ding, Fei Wang

机构 * School of Software Engineering, Xi'an Jiaotong University, China(西安交通大学软件工程学院) School of Computer Science and Technology, Xi'an Jiaotong University, China(西安交通大学计算机科学与技术学院)

AI总结 EmotionCLIP通过多模态对比学习提升EEG情感识别的跨领域泛化能力,实现跨受试者和跨时间的高准确率

Comments Accepted by IEEE ICASSP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14620 2026-01-22 eess.AS cs.AI cs.LG cs.SD

Scaling Ambiguity: Augmenting Human Annotation in Speech Emotion Recognition with Audio-Language Models

缩放歧义:通过音频-语言模型增强语音情感识别中的人工标注

Wenda Zhang, Hongyu Jin, Siyi Wang, Zhiqiang Wei, Ting Dang

机构 * University of Melbourne(墨尔本大学) Xi'an Jiaotong University(西安交通大学)

AI总结 本文通过音频-语言模型生成合成标注,提升语音情感识别中模糊情感的真实分布可靠性,实验表明合成标注在低歧义区域效果显著,但高歧义情况需进一步优化。

Comments Accepted by ICASSP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.07062 2026-01-22 cs.CV cs.AI

$\mathrm{D}^\mathrm{3}$-Predictor: Noise-Free Deterministic Diffusion for Dense Prediction

D³-预测器:无噪声确定性扩散用于密集预测

Changliang Xia, Chengyou Jia, Minnan Luo, Zhuohang Dang, Xin Shen, Bowen Ping

机构 * School of Computer Science and Technology, Xi’an Jiaotong University(西安交通大学计算机科学与技术学院)

AI总结 D³-预测器通过无噪声确定性扩散模型解决密集预测中随机噪声导致的几何结构破坏问题,实现高效且高质量的密集预测性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.00681 2026-01-22 cs.LG cs.AI cs.CL

A Survey of Quantized Graph Representation Learning: Connecting Graph Structures with Large Language Models

图表示学习的综述:连接图结构与大语言模型

Qika Lin, Zhen Peng, Kaize Shi, Kai He, Yiming Xu, Jian Zhang, Erik Cambria, Mengling Feng

机构 * National University of Singapore(新加坡国立大学) Xi’an Jiaotong University(西安交通大学) University of Southern Queensland(南方昆士兰大学) Nanyang Technological University(南洋理工大学)

AI总结 本文综述了量化图表示学习,探讨了其与大语言模型的整合方法及未来研究方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13734 2026-01-21 cs.CL cs.AI

Towards robust long-context understanding of large language model via active recap learning

通过主动回顾学习实现大语言模型长上下文理解的鲁棒性

Chenyu Hui

机构 * School of Microelectronics(微电子学院) Xi'an Jiaotong University(西安交通大学)

AI总结 本文提出主动回顾学习方法,通过生成和利用回顾性总结提升大语言模型对长上下文的理解能力,在RULER和LongBench上分别取得26.8%和9.44%的提升。

Comments 5 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13481 2026-01-21 cs.AI

Towards Efficient and Robust Linguistic Emotion Diagnosis for Mental Health via Multi-Agent Instruction Refinement

通过多智能体指令细化实现高效的稳健语言情绪诊断以促进心理健康

Jian Zhang, Zhangqi Wang, Zhiyuan Wang, Weiping Fu, Yu He, Haiping Zhu, Qika Lin, Jun Liu

机构 * School of Computer Science and Technology, Xi’an Jiaotong University(计算机科学与技术学院,西安交通大学) Saw Swee Hock School of Public Health, National University of Singapore(Saw Swee Hock 公共卫生学院,新加坡国立大学)

AI总结 APOLO通过多智能体协作优化提示空间,提升语言情绪诊断的效率与鲁棒性,适用于心理健康领域的可信LLM应用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.07478 2026-01-21 cs.CL

Enhancing Agentic RL with Progressive Reward Shaping and Value-based Sampling Policy Optimization

通过渐进奖励塑造与基于价值的采样策略优化增强代理强化学习

Jianghao Su, Xia Zeng, Luhui Liu, Chao Luo, Ye Chen, Zhuoran Zhuang

机构 * Xi’an Jiaotong University(西安交通大学) Fliggy Alibaba(阿里飞猪)

AI总结 本文提出PRS和VSPO技术,通过渐进奖励塑造和基于价值的采样策略优化,提升代理强化学习在复杂推理任务中的性能与稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07593 2026-01-21 cs.AI

AgentAsk: Multi-Agent Systems Need to Ask

AgentAsk: 多智能体系统需要提问

Bohan Lin, Kuo Yang, Zelin Tan, Yingchuan Lai, Chen Zhang, Guibin Zhang, Xinlei Yu, Miao Yu, Xu Wang, Yudong Zhang, Yang Wang

机构 * University of Science and Technology of China(科学技术大学) Shanghai AI Laboratory(上海人工智能实验室) Xi’an Jiaotong University(西安交通大学) National University of Singapore(新加坡国立大学)

AI总结 AgentAsk通过边缘级澄清模块提升多智能体系统准确性,减少误差传播,提高任务效率与性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12714 2026-01-21 cs.CV cs.LG

P2L-CA: An Effective Parameter Tuning Framework for Rehearsal-Free Multi-Label Class-Incremental Learning

P2L-CA:一种适用于无回放多标签类增量学习的有效参数调节框架

Songlin Dong, Jiangyang Li, Chenhao Ding, Zhiheng Ma, Haoyu Luo, Yuhang He, Yihong Gong

机构 * Faculty of Computility Microelectronics, Shenzhen University of Advanced Technology(深圳先进技术大学计算微电子学院) College of Artificial Intelligence, Xi’an Jiaotong University(西安交通大学人工智能学院) College of Software Engineering, Xi’an Jiaotong University(西安交通大学软件工程学院)

AI总结 P2L-CA通过结合Prompt-to-Label模块和连续适配器模块,提出了一种参数高效的多标签类增量学习框架,有效解决特征混淆和领域差异问题,实现高性能与低开销的平衡。

Comments 12 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10406 2026-01-16 cs.AI

ErrEval: Error-Aware Evaluation for Question Generation through Explicit Diagnostics

ErrEval: 通过显式诊断实现的问题生成的误差感知评估

Weiping Fu, Bifan Wei, Jingyi Hao, Yushun Zhang, Jian Zhang, Jiaxin Wang, Bo Li, Yu He, Lingling Zhang, Jun Liu

机构 * School of Computer Science and Technology, Xi’an Jiaotong University(计算机科学与技术学院,西安交通大学) School of Continuing Education, Xi’an Jiaotong University(继续教育学院,西安交通大学) Shaanxi Province Key Laboratory of Big Data Knowledge Engineering, Xi’an(陕西省大数据知识工程重点实验室,西安) Test center, National University of Defense Technology(测试中心,国防科技大学)

AI总结 ErrEval通过显式诊断机制改进问题生成评估,有效识别并纠正事实性幻觉和答案不匹配等缺陷,提升评估与人类判断的一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10312 2026-01-16 cs.LG

We Need a More Robust Classifier: Dual Causal Learning Empowers Domain-Incremental Time Series Classification

我们需要一个更稳健的分类器:双因果学习赋能领域增量时间序列分类

Zhipeng Liu, Peibo Duan, Xuan Tang, Haodong Jing, Mingyang Geng, Yongsheng Huang, Jialu Xu, Bin Zhang, Binwu Wang

机构 * School of Software, Northeastern University(东北大学软件学院) Institute of Artificial Intelligence and Robotics, Xi'an Jiaotong University(西安交通大学人工智能与机器人研究所) College of Computer Science and Technology, National University of Defense Technology(国防科技大学计算机科学与技术学院) School of Software, University of Science and Technology of China(中国科学技术大学软件学院)

AI总结 本文提出双因果学习框架DualCD,通过解耦因果特征与虚假特征,提升领域增量时间序列分类的鲁棒性。

Comments This paper has been accepted for publication at ACM WWW 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.02064 2026-01-16 cs.CV

RTV-Bench: Benchmarking MLLM Continuous Perception, Understanding and Reasoning through Real-Time Video

RTV-Bench: 通过实时视频对多模态大语言模型的连续感知、理解和推理进行基准测试

Shuhang Xun, Sicheng Tao, Jungang Li, Yibo Shi, Zhixin Lin, Zhanhui Zhu, Yibo Yan, Hanqian Li, Linghao Zhang, Shikang Wang, Yixin Liu, Hanbo Zhang, Ying Ma, Xuming Hu

机构 * HIT(哈尔滨工业大学) HKUST (GZ)(香港科技大学(广州)) HKUST(香港科技大学) XJTU(西安交通大学) SDU(山东大学) CityU(城市大学) HUST(华中科技大学)

AI总结 RTV-Bench通过实时视频对多模态大语言模型的连续感知、理解和推理能力进行细粒度基准测试,揭示了实时模型在长时段视频处理中的性能优势与局限。

Comments Accepted by NeurIPS 2025 Datasets and Benchmarks Track;

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09274 2026-01-15 cs.AI

$A^3$-Bench: Benchmarking Memory-Driven Scientific Reasoning via Anchor and Attractor Activation

$A^3$-Bench:通过锚点和吸引子激活进行记忆驱动科学推理的基准测试

Jian Zhang, Yu He, Zhiyuan Wang, Zhangqi Wang, Kai He, Fangzhi Xu, Qika Lin, Jun Liu

机构 * Xi’an Jiaotong University(西安交通大学) National University of Singapore(新加坡国立大学)

AI总结 $A^3$-Bench通过双尺度记忆驱动激活机制,评估科学推理中的记忆利用效果,揭示记忆激活对推理性能的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09259 2026-01-15 cs.AI

MAXS: Meta-Adaptive Exploration with LLM Agents

MAXS: 基于LLM代理的元适应性探索

Jian Zhang, Zhiyuan Wang, Zhangqi Wang, Yu He, Haoran Luo, li yuan, Lingling Zhang, Rui Mao, Qika Lin, Jun Liu

机构 * Xi’an Jiaotong University(西安交通大学) Nanyang Technological University(南洋理工大学) National University of Singapore(国立新加坡大学) South China University of Technology(华南理工大学)

AI总结 MAXS通过元适应性探索框架提升LLM代理在多工具推理中的全局有效性和计算效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08204 2026-01-14 cs.CV

MobiDiary: Autoregressive Action Captioning with Wearable Devices and Wireless Signals

MobiDiary: 带可穿戴设备和无线信号的自回归动作描述

Fei Deng, Yinghui He, Chuntong Chu, Ge Wang, Han Ding, Jinsong Han, Fei Wang

机构 * School of Software Engineering, Xi’an Jiaotong University(西安交通大学软件工程学院) College of Computing and Data Science, Nanyang Technological University(南洋理工大学计算与数据科学学院) School of Computer Science and Technology, Xi’an Jiaotong University(西安交通大学计算机科学与技术学院) College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院)

AI总结 MobiDiary通过自回归机制从可穿戴设备和无线信号生成自然语言动作描述,实现跨模态的高效活动识别。

Comments Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.07779 2026-01-13 cs.MA cs.AI cs.CL cs.CV cs.HC

OS-Symphony: A Holistic Framework for Robust and Generalist Computer-Using Agent

OS-Symphony: 一个用于鲁棒且通用计算机使用代理的综合框架

Bowen Yang, Kaiming Jin, Zhenyu Wu, Zhaoyang Liu, Qiushi Sun, Zehao Li, JingJing Xie, Zhoumianze Liu, Fangzhi Xu, Kanzhi Cheng, Qingyun Li, Yian Wang, Yu Qiao, Zun Wang, Zichen Ding

机构 * University of Science and Technology of China(中国科学技术大学) Shanghai AI Laboratory(上海人工智能实验室) National University of Singapore(新加坡国立大学) The Hong Kong University of Science and Technology(香港科学与技术大学) The University of Hong Kong(香港大学) CUHK MMLab(香港中文大学MMLab) Xi’an Jiaotong University(西安交通大学) Nanjing University(南京大学) Harbin Institute of Technology(哈尔滨工业大学)

AI总结 OS-Symphony通过反思记忆代理和多功能工具代理,提升计算机使用代理在长周期任务和新领域中的鲁棒性和泛化能力。

Comments 31 pages, 11 figures, 12 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.13772 2026-01-13 cs.SD cs.AI cs.LG cs.MM eess.AS

Jailbreak-AudioBench: In-Depth Evaluation and Analysis of Jailbreak Threats for Large Audio Language Models

Jailbreak-AudioBench: 对大型音频语言模型中 jailbreak 威胁的深入评估与分析

Hao Cheng, Erjia Xiao, Jing Shao, Yichi Wang, Le Yang, Chao Shen, Philip Torr, Jindong Gu, Renjing Xu

机构 * Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) University of Oxford(牛津大学) Xi’an Jiaotong University(西安交通大学) Hong Kong University of Science and Technology(香港科技大学) Northeastern University(东北大学) Beijing University of Technology(北京理工大学)

AI总结 Jailbreak-AudioBench 通过构建工具箱、数据集和基准,深入评估大型音频语言模型中 jailbreak 威胁,并促进安全防护机制的发展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06636 2026-01-13 cs.CL cs.AI

MedEinst: Benchmarking the Einstellung Effect in Medical LLMs through Counterfactual Differential Diagnosis

MedEinst:通过反事实差异诊断基准测试医疗大语言模型中的Einstellung效应

Wenting Chen, Zhongrui Zhu, Guolin Huang, Wenxuan Wang

机构 * Stanford University(斯坦福大学) Xi’an Jiaotong University(西安交通大学) Shenzhen University(深圳大学) Renmin University of China(中国人民大学)

AI总结 MedEinst通过反事实差异诊断基准测试,揭示医疗大语言模型中的Einstellung效应,并提出ECR-Agent提升循证医学标准。

Comments 19 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06413 2026-01-13 cs.CV

GlobalPaint: Spatiotemporal Coherent Video Outpainting with Global Feature Guidance

GlobalPaint: 基于全局特征引导的时空一致视频外推

Yueming Pan, Ruoyu Feng, Jianmin Bao, Chong Luo, Nanning Zheng

机构 * State Key Laboratory of Human-Machine Hybrid Augmented Intelligence, Institute of Artificial Intelligence and Robotics, Xi’an Jiaotong University(人机混合增强智能国家重点实验室,人工智能与机器人研究院,西安交通大学) Microsoft Research Asia(微软亚洲研究院) University of Science and Technology of China(中国科学技术大学)

AI总结 GlobalPaint提出一种基于扩散的视频外推框架,通过增强的空间-时间模块和全局特征引导,提升视频外推的时空一致性与重建质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05688 2026-01-12 cs.CV

SketchVL: Policy Optimization via Fine-Grained Credit Assignment for Chart Understanding and More

SketchVL:通过细粒度信用分配进行政策优化以实现图表理解和更多

Muye Huang, Lingling Zhang, Yifei Li, Yaqiang Wu, Jun Liu

机构 * School of Computer Science and Technology, Xi’an Jiaotong University, China(计算机科学与技术学院,西安交通大学) MOE KLINNS Lab, Xi’an Jiaotong University, China(教育部KLINNS实验室,西安交通大学) Zhongguancun Academy, Beijing, China(中关村学院,北京)

AI总结 SketchVL通过细粒度信用分配优化,提升多模态大语言模型在图表理解和多领域推理中的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05478 2026-01-12 cs.CL

The Facade of Truth: Uncovering and Mitigating LLM Susceptibility to Deceptive Evidence

真相的 facade:揭示并缓解 LLM 对欺骗性证据的易感性

Herun Wan, Jiaying Wu, Minnan Luo, Fanxiao Li, Zhi Zeng, Min-Yen Kan

机构 * Xi’an Jiaotong University(西安交通大学) National University of Singapore(新加坡国立大学) Yunnan University(云南大学)

AI总结 本文提出 MisBelief 框架揭示 LLM 对复杂欺骗性证据的脆弱性,并提出 DIS 机制缓解这一问题,提升模型对误导性证据的抵御能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.19361 2026-01-09 cs.CL cs.AI

AgenticMath: Enhancing LLM Reasoning via Agentic-based Math Data Generation

AgenticMath: 通过基于代理的数学数据生成增强LLM推理

Xianyang Liu, Yilin Liu, Shuai Wang, Hao Cheng, Andrew Estornell, Yuzhi Zhao, Jun Shu, Jiaheng Wei

机构 * King’s College London(伦敦国王学院) Hong Kong Baptist University(香港 Baptist 大学) The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) ByteDance Seed(字节跳动种子) City University of Hong Kong(香港城市大学) Xi’an Jiaotong University(西安交通大学)

AI总结 AgenticMath通过基于代理的数学数据生成方法,提升LLM在数学推理任务上的性能。

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏