arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-08-07 至 2026-08-07 共收录 218 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 软件智能体 14 篇

2604.01518 2026-08-07 cs.SE 版本更新 57%

Probe to Generate: Program Variant-Guided Test Augmentation for Repository-Level Repair Benchmarks

基准测试足够强大吗?基于突变的诊断和回归套件的增强

Chenglin Li, Yisen Xu, Zehao Wang, Shin Hwei Tan, Tse-Hsun, Chen

专题命中 软件智能体 :agent(abstract);分类 cs.SE

AI总结 本文提出STING框架,通过语义改变的程序变体增强回归测试,提高基准测试的可靠性。实验显示,77%的实例存在至少一个存活变体,测试覆盖率提升,修复率下降,揭示了基准测试的不足。

Comments Accepted at the 41st IEEE/ACM International Conference on Automated Software Engineering (ASE 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08652 2026-08-07 cs.AI 版本更新 57%

CoCo: Code as CoT for Text-to-Image Preview and Rare Concept Generation

CoCo:用于文本到图像预览和稀有概念生成的代码作为CoT

Haodong Li, Chunmei Qing, Huanyu Zhang, Dongzhi Jiang, Yihang Zou, Hongbo Peng, Dingming Li, Yuhong Dai, ZePeng Lin, Juanxi Tian, Yi Zhou, Siqi Dai, Jingwei Wu, Pheng-Ann Heng

机构 * South China University of Technology(南方科技大学) StepFun Institute of Automation Chinese Academy of Sciences(中国科学院自动化研究所) Nanyang Technological University(南洋理工大学) The Chinese University of Hong Kong(香港中文大学)

专题命中 软件智能体 :planning(abstract);分类 cs.AI

AI总结 CoCo通过代码驱动的推理框架,提升文本到图像生成的精度和可控性,实现结构化图像生成和稀有概念生成。

Comments 21 pages, 7 figures, and 3 tables. Accepted to ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏

2. GUI与网页智能体 7 篇

2608.05784 2026-08-07 cs.AI 新提交 79%

Activity Frames: Deterministic Screen-Activity Compilation for Agent Memory and Replay

活动帧:面向智能体记忆与回放的确定性屏幕活动编译

Nossa Iyamu

专题命中 GUI与网页智能体 :agent(title,abstract);分类 cs.AI

AI总结 该研究提出确定性零模型流水线将屏幕活动编译为智能体记忆,可缩小上下文体积、提升问答准确率,还能获取智能体成本模型所需的例程开销比率与重复率等参数,相关资源开源。

Comments 14 pages, 5 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03327 2026-08-07 cs.AI 版本更新 79%

Screenshots or Tools? Eliciting Tool Use and Managing Multimodal Context in Hybrid GUI-MCP Computer-Use Agents

截图还是工具?在混合GUI-MCP计算机使用智能体中引出工具使用并管理多模态上下文

Siqi Fan, Minghao Li, Xiaoqian Ma, Wenhui Tan, Xiusheng Huang, Juntong Wu, Liujie Zhang, Shuo Shang, Weihang Chen

专题命中 GUI与网页智能体 :tool use(title);agent(abstract);分类 cs.AI

AI总结 该研究针对混合GUI-MCP计算机使用智能体,发现工具使用存在采用缺口,通过调整工具奖励与上下文压缩优化,提升了智能体性能并降低输入成本。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05587 2026-08-07 cs.AI 新提交 70%

StepReflect: Structured UI Transition Reflection for Mobile GUI Agents

StepReflect:面向移动GUI智能体的结构化UI过渡反射

Linqiang Guo, Wei Liu, Li Gu, Yang Wang, Tse-Hsun, Chen

专题命中 GUI与网页智能体 :agent(abstract,abstract_cn);分类 cs.AI

AI总结 针对移动GUI智能体长时序执行的动作反射需求,提出StepReflect模型,在离线和在线实验中均优于GPT-5.2相关方案,成本更低且可本地部署。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06171 2026-08-07 cs.CL 新提交 61%

Routing Is Least Learnable Where It Is Most Valuable: Bounds on Representation Routing for Web Agents

路由在最具价值处最不可学习:Web智能体的表示路由边界

Jiaming Wei, Zekun Wu, Adriano Koshiyama, Maria Perez-Ortiz

机构 * University College London(伦敦大学学院) Holistic AI

专题命中 GUI与网页智能体 :agent(abstract,comments);分类 cs.CL

AI总结 该研究针对Web智能体的观察模式路由问题,发现路由在智能体最需处因标签不足而不可学,固定合适模式的效果优于多数路由策略,仅稀疏单元有例外。

Comments Preprint. Under review at the Second Workshop for Research on Agent Language Models (REALM), EMNLP 2026 (non-archival track)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06065 2026-08-07 cs.CV 新提交 50%

The Next Screenshot Knows: Gated Hindsight Distillation for Mobile GUI Agents

下一张截图知晓:面向移动GUI智能体的门控事后蒸馏(Gated Hindsight Distillation)

Weiwei Li, Junzhuo Liu, Tong Chu, Hengfu Yu, Wen Li

专题命中 GUI与网页智能体 :agent(abstract)

AI总结 本文针对移动GUI智能体训练中丢失动作依据的问题,提出门控事后蒸馏方法,利用下一张截图作为特权信息,在AndroidWorld等基准上相比GRPO提升了任务成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.05506 2026-08-07 cs.CV 版本更新 50%

Robust Scene Transfer for PointGoal Navigation via Privileged Sensor Guided Contrastive Learning

基于特权传感器引导对比学习的点目标导航鲁棒场景迁移

Amirhossein Zhalehmehrabi, Tiziano Tezze, Alberto Castelini, Alessandro Farinelli

机构 * University of Padua(帕多瓦大学) ETH Zurich(苏黎世联邦理工学院)

专题命中 GUI与网页智能体 :agent(abstract)

AI总结 提出一种传感器引导的自适应对比学习框架,利用特权LiDAR传感器在训练时引导视觉编码器学习导航相关结构,并通过解耦表征学习与策略优化以及跨阶段域不匹配来提升策略级场景迁移能力。

Comments 8 pages, Accepted to IEEE Robotics and Automation Letters (RA-L)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08199 2026-08-07 cs.NI 版本更新 50%

Beyond Static Forecasting: Unleashing the Power of World Models for Mobile Traffic Extrapolation

超越静态预测:利用世界模型进行移动交通外推

Xiaoqian Qi, Haoye Chai, Yue Wang, Yong Li

专题命中 GUI与网页智能体 :planning(abstract)

AI总结 本文提出MobiWM世界模型,用于移动网络中的移动交通外推,通过融合多模态环境上下文和编码动作,提升空间理解,实验表明其在所有评估场景中均取得最佳分布保真度。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 记忆与上下文管理 13 篇

2409.20302 2026-08-07 cs.AI cs.CL cs.IR 82%

OM4OV: Leveraging Ontology Matching for Ontology Versioning

OM4OV:利用本体匹配进行本体版本控制

Zhangcheng Qiang, Kerry Taylor, Weiqing Wang

机构 * Australian National University(澳大利亚国立大学) Monash University(墨尔本大学)

专题命中 记忆与上下文管理 :agent(summary_cn,abstract);分类 cs.AI、cs.CL

AI总结 本文系统分析了本体匹配与本体版本控制的异同,提出OM4OV框架以提升版本控制支持。通过Agent-OM系统实现并评估,发现现有本体匹配系统在版本控制任务中需优化以避免偏差和性能问题。

Comments 19 pages, 10 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06294 2026-08-07 cs.AI cs.ET 新提交 79%

QuanTiMedAI: Quantum-Enhanced Time-Series Model guided by Agentic AI for Cardiac Arrest Mortality Prediction

QuanTiMedAI:由智能体人工智能引导的量子增强时间序列模型用于心脏骤停死亡率预测

Mutasim Fuad Sarker, Adiba Rahman Namira, Wafa Binte Alam, Md Adnan Arefeen, Mahzabeen Emu, Sumaiya Tabassum Nimi

机构 * North South University(北南大学) Memorial University(纪念大学)

专题命中 记忆与上下文管理 :agentic(title,abstract);分类 cs.AI

AI总结 该研究针对心脏骤停死亡率预测的静态数据局限,提出QuanTiMedAI量子-智能体框架,结合智能体LLM与量子循环网络,在MIMIC-IV数据集上仅用605个参数实现0.852的AUROC,优于现有最先进基线。

Comments Submitted for review

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05906 2026-08-07 cs.CL 新提交 79%

Causal Episodic Memory for Feedback-Driven Agent Repair

用于反馈驱动智能体修复的因果情景记忆

Khang Nhat Hoang Vo, Tam Minh Chu, Anh Trac Duc Dinh, Thuyen Vinh Ha Bui, Tho Quan

机构 * Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学) Faculty of Computer Science and Engineering, Ho Chi Minh City University of Technology (HCMUT), VNU-HCM(胡志明市理工大学计算机科学与工程学院(HCMUT,VNU-HCM))

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.CL

AI总结 本文提出无需训练的MERIT智能体,通过维护双极性记忆辅助LLM智能体修复,在Spider、BIRD数据集上提升了Text-to-SQL任务的执行准确率,同时明确了因果跨查询记忆的适用场景。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01707 2026-08-07 cs.CL cs.DB 版本更新 70%

Memory in the LLM Era: Modular Architectures and Strategies in a Unified Framework

在大语言模型时代:在统一框架下的模块化架构与策略

Yanchen Wu, Tenghui Lin, Yingli Zhou, Fangyuan Zhang, Qintian Guo, Xun Zhou, Sibo Wang, Xilin Liu, Yuchi Ma, Yixiang Fang

机构 * Huawei Cloud(华为云)

专题命中 记忆与上下文管理 :agent(abstract);agentic(abstract);分类 cs.CL

AI总结 本文在统一框架下系统比较了多种记忆方法,设计出优于现有方法的新方法,并探讨了未来研究方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05714 2026-08-07 cs.AI 新提交 57%

RA-CAD: Learning Post-Execution Critique for State-Aware Text-to-CAD Generation

RA-CAD:学习执行后批判的状态感知文本到CAD生成模型

Shuhao Yan, Changhao He, Xi Peng, Peng Hu

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

AI总结 该研究针对文本到CAD生成的反馈利用不足问题,提出RA-CAD智能体,通过生成-执行-批判-重写循环结合CCB、FAO优化,在CADFusion和Text2CAD上实现最优性能。

Comments 17 pages, 7 figures, 5tables, 8 listings

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.04949 2026-08-07 cs.CV cs.AI 版本更新 57%

DeepForgeSeal: Latent Space-Driven Semi-Fragile Watermarking for Deepfake Detection Using Adversarial Reinforcement Learning

DeepForgeSeal:基于对抗强化学习的隐空间驱动半脆弱深度伪造检测水印技术

Tharindu Fernando, Clinton Fookes, Sridha Sridharan

机构 * The Signal Processing, Artificial Intelligence and Vision Technologies (SAIVT), Queensland University of Technology, Australia(信号处理、人工智能与视觉技术研究所(SAIVT),昆士兰理工大学)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

AI总结 该研究针对深度伪造检测中现有水印方法鲁棒性与脆弱性难以平衡的问题,提出基于对抗强化学习的隐空间驱动半脆弱水印框架,在CelebA和CelebA-HQ数据集上性能优于现有最优方法

Comments Accepted for Publication in IEEE Transactions on Pattern Analysis and Machine Intelligence (TPAMI)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05444 2026-08-07 econ.TH 新提交 50%

A Costly-information Foundation for Psychometric Curves

心理测量曲线的信息成本基础

Jake Zhang

专题命中 记忆与上下文管理 :agent(abstract)

AI总结 该研究以Hebert等提出的Fisher信息成本为基础,用变分方法分析二元选择问题,得出智能体最优响应为状态S型函数的结论,契合心理测量曲线特征。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06290 2026-08-07 stat.CO stat.ME stat.ML 新提交 50%

Learning Latent Memory States from Longitudinal Athlete Monitoring Data

从纵向运动员监测数据中学习潜在记忆状态

Dae-Jin Lee

专题命中 记忆与上下文管理 :workflow(abstract)

AI总结 该研究提出潜在记忆表作为纵向数据分析单元,通过记忆算子生成,经含复合质量指数Q的六属性验证,在SoccerMon案例中表现优于经典基线,可复用且能区分真实记忆与对照。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05483 2026-08-07 cs.AR cs.DC 新提交 50%

PLoRA: An NDP-Enhanced Pooled-Memory System for Cost-Efficient Multi-LoRA Serving

PLoRA:一种用于高性价比多LoRA服务的NDP增强型池化内存系统

Zhongkai Yu, Ohm Rishabh Venkatachalam, Zheng Wang, Yikai Li, Yichen Lin, Zihao Yu, Yuke Wang, Liu Liu, Xulong Tang, Shuyi Pei, Yangwook Kang, Yufei Ding

专题命中 记忆与上下文管理 :agent(abstract)

AI总结 PLoRA是一种NDP增强型池化内存系统,通过优化适配器与KV缓存的存储和访问方式,在H100上服务1000个适配器时,解码延迟较S-LoRA平均低6.6倍,实现了高性价比的多LoRA服务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05763 2026-08-07 physics.geo-ph 新提交 50%

Foundation Model-Assisted Full Waveform Inversion

基础模型辅助的全波形反演

Mustafa Alfarhan, Matteo Ravasi, Fuqiang Chen, George Turkiyyah, David Keyes

专题命中 记忆与上下文管理 :workflow(abstract)

AI总结 该研究提出用预训练地震基础模型SeisLM的特征构建全波形反演早期目标函数,通过实验验证其可避免周期跳变,提升反演效果,优于传统及混合损失工作流。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05496 2026-08-07 cond-mat.stat-mech 新提交 50%

Morphology of frozen labyrinths from irreversible threshold dynamics

不可逆阈值动力学产生的冻结迷宫的形态

Daniel Richard Levy

专题命中 记忆与上下文管理 :agent(abstract)

AI总结 该研究探究不可逆多数阈值动力学的行为,发现其会冻结平衡非一致迷宫,确定粗域布局的确定性机制,揭示冻结壁的挫败特征,丰富了阈值动力学的形态调控认知。

Comments 13 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28443 2026-08-07 cs.RO 版本更新 50%

One Future, Every Robot: Label-Efficient Collective-State Prediction with Decentralized JEPA

单未来,每机器人:采用去中心化JEPA的标签高效集体状态预测

Alan-Barsag Gazzaev, Alexey Gavrilov, Sergey Muravyov

机构 * ITMO University(ITMO大学)

专题命中 记忆与上下文管理 :planning(abstract)

AI总结 该研究提出CS-JEPA架构,解决群体机器人去中心化共享状态预测问题,在多类场景下提升预测误差、一致性及相关指标,为去中心化群体预测提供标签高效基元。

Comments Submitted to IEEE ICRA 2027

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18141 2026-08-07 cs.DC 版本更新 50%

A CXL Memory Rack for Multi-Turn LLM Serving

HyMCache:一种用于多轮大语言模型服务的基于CXL混合内存的键值缓存框架

Hakbeom Jang, Inho Song, Hoshik Kim, Sam H. Noh, Jongryool Kim

专题命中 记忆与上下文管理 :agentic(abstract)

AI总结 研究针对多轮大语言模型服务中键值缓存重用问题,提出HyMCache框架集成CXL混合内存。利用多轮缓存访问特性优化DRAM管理,通过请求级前缀预取等技术,在真实原型上评估,相比其他方案有性能优势且节省DRAM。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. Agent评测 43 篇

2608.05668 2026-08-07 cs.MA cs.AI cs.MM 新提交 92%

F$^2$Agent: Financial Fusion of Agentic Intelligence for Multimodal Trading

F²Agent:面向多模态交易的智能体智能金融融合框架

Changshuo Liu, Yanzheng Jin, Shangfeng Cai, Peng Fang, Xiaokui Xiao, Beng Chin Ooi

专题命中 Agent评测 :agent(title,title_cn);agentic(title,abstract);分类 cs.AI

AI总结 该研究针对现有多模态金融交易模型的跨模态依赖捕捉不足、抗噪性差的问题,提出F²Agent框架,通过专业化智能体提取模态信号、模态感知自适应融合机制及抗噪正则化,在6种资产上较16个基线实现超20%年化回报率提升,表现出优异性能。

Comments 32 pages, 12 figures, 19 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21800 2026-08-07 cs.AI 版本更新 88%

BioAgent Bench: An AI Agent Evaluation Suite for Bioinformatics

BioAgent Bench: 一个用于生物信息学的AI代理评估套件

Dionizije Fa, Marko Culjak, Bruno Pandza, Mateo Cupic

机构 * Entropic

专题命中 Agent评测 :agent(title,abstract);AI agent(title,abstract);分类 cs.AI

AI总结 本文提出BioAgent Bench,用于评估AI代理在常见生物信息学任务中的性能和鲁棒性。通过定制端到端任务和压力测试,发现前沿代理可完成多步骤流程,但鲁棒性测试揭示了在受控扰动下的失败模式,表明高阶流程构建不保证可靠步骤推理。

Comments ICML 2026 camera ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06020 2026-08-07 cs.AI cs.LG 新提交 86%

From Economic Agents to Agentic Economies: A Systems Blueprint for Economic World Models

从经济智能体到智能体经济:经济世界模型的系统蓝图

Jiale Han, Xiang Li, Jing Qian, Wenyuan Gu, Pin Gao, Ye Luo, Hongyuan Zha, Dacheng Tao, Benyou Wang, Lin William Cong

机构 * Shenzhen Loop Area Institute(深圳河套学院) School of Data Science, The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)数据科学学院) University of Hong Kong(香港大学) Nanyang Technological University(南洋理工大学)

专题命中 Agent评测 :agentic(title);agent(abstract);AI agent(abstract);planning(abstract)

AI总结 本文提出经济世界模型(EWM)的六级能力阶梯实施蓝图,旨在加速可作为人类决策沙箱与AI智能体基础的下一代高保真经济模拟环境开发。

Comments Project page: https://github.com/FreedomIntelligence/Awesome-Economic-World-Models

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05573 2026-08-07 cs.AI 新提交 85%

SkillTV-Bench: Benchmarking How Well Judges Perform on Skill-Augmented Agentic Execution

SkillTV-Bench:评估评判者在技能增强型智能体执行任务中的表现

Zhi Han, Chenxi Zeng, Liuhaichen Yang, Zihan Guo, Ming Zhou, Yang Li

专题命中 Agent评测 :agentic(title);agent(abstract,abstract_cn);tool use(abstract);分类 cs.AI

AI总结 SkillTV-Bench是含681个案例的智能体轨迹基准,用于评估技能感知轨迹验证;提出SkillTV-Evolve优化JudgeSkill,使智能体评判者准确率提升14.8个百分点,选定轨迹成功率大幅提高。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05391 2026-08-07 cs.AI cs.MA 新提交 84%

Adaptive Arena-based Contestable Argumentative Network-of-Experts for Open-Ended Care Plan Coordination

面向开放式护理计划协调的自适应竞技场式可争议专家论证网络

Truong Thanh Hung Nguyen, Hoang-Loc Cao, Phuc Ho, Phuc Truong Loc Nguyen, René Richard, Hung Cao

机构 * University of New Brunswick(新不伦瑞克大学) National Research Council Canada(加拿大国家研究委员会)

专题命中 Agent评测 :agent(summary_cn,abstract);multi-agent(abstract);分类 cs.AI

AI总结 针对开放式护理计划协调中单一LLM流程的不足,提出多Agent神经符号框架CANOE,经医学微调模型在相关数据集上表现出强临床正确性,且CANOE具备可解释性与人类可争议性。

Comments Accepted at the 4th International Conference on Frontiers of Artificial Intelligence, Ethics, and Multidisciplinary Applications

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05201 2026-08-07 cs.CR cs.AI 新提交 84%

ASTELD: A Six-Axis Classification Framework for Autonomous AI Agents - Design, Evaluation, and an OpenClaw Case Study

ASTELD:自主AI智能体的六轴分类框架——设计、评估与OpenClaw案例研究

Siyuan Li, Peng Shu, Churan Yu, Peilong Wang, Ruidong Zhang, Bowen Guo, Xinliang Li, Ruiyu Yan, Arif Hassan Zidan, Yi Pan, Wei Ruan, Lifeng Chen, Junhao Chen, Zhaojun Ding, Yiwei Li, Zhengliang Liu, Haixing Dai, Lin Zhao, Yu Bao, Xiang Li, Wei Zhang, Tianming Liu

专题命中 Agent评测 :AI agent(title,abstract);agent(abstract,comments);分类 cs.AI

AI总结 该研究提出ASTELD六轴分类框架,用于比较自主AI智能体平台,通过案例研究验证其效用,揭示跨平台模式与创新方向,发现本地优先部署与企业级安全结合的空白区域。

Comments 40 pages, 4 figures, 6 tables. Introduces and empirically evaluates the ASTELD six-axis classification framework across eight autonomous AI agent platforms, with OpenClaw as an in-depth case study

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05266 2026-08-07 cs.AI cond-mat.mtrl-sci cs.LG 新提交 84%

Agentic self-driving microscopy benchmarks support qualification but do not necessarily generalize to unseen tasks

智能体自动驾驶显微镜基准测试支持性能验证,但不一定能泛化到未见任务

Nathan S Johnson, Ian Abshire

机构 * Carl Zeiss Research Microscopy Solutions(卡尔蔡司研究显微镜解决方案)

专题命中 Agent评测 :agentic(title,abstract);agent(abstract);分类 cs.AI、cs.LG

AI总结 本研究开发基准框架评估显微镜智能体架构等因素的性能,发现其虽可用于验证比较,但现有基准无法预测智能体在未见显微镜任务上的表现。

Comments 20 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04761 2026-08-07 cs.CL cs.AI 版本更新 84%

InsightEmb: Learning Action-Intent Embeddings for Agentic Insight Retrieval

InsightEmb:面向智能体洞察检索的动作-意图嵌入学习

Tsz Ting Chung, Jiangnan Li, Jie Zhou, Mo Yu

机构 * The Hong Kong University of Science and Technology(香港科技大学) WeChat AI, Tencent(腾讯微信人工智能)

专题命中 Agent评测 :agentic(title,abstract);agent(abstract);分类 cs.AI、cs.CL

AI总结 该研究针对智能体洞察检索任务,提出对比嵌入框架InsightEmb,利用数学推理数据学习可迁移的检索几何结构,在无特定环境训练时优于现有模型,验证了匹配几何结构的跨域迁移性。

详情

展开后加载摘要…

URL PDF HTML 收藏