arXivDaily arXiv每日学术速递 周一至周五更新

大厂专区

Xiaohongshu(小红书)

共收录 161
2603.12155 2026-03-13 cs.CV cs.AI

GlyphBanana: Advancing Precise Text Rendering Through Agentic Workflows

GlyphBanana: 通过代理工作流推进精确文本渲染

Zexuan Yan, Jiarui Jin, Yue Ma, Shijian Wang, Jiahui Hu, Wenxiang Jiao, Yuan Lu, Linfeng Zhang

机构 * Shanghai Jiao Tong University(上海交通大学) Xiaohongshu Inc.(小红书公司) Hong Kong University of Science and Technology(香港科技大学) Southeast University(东南大学) South China University of Technology(华南理工大学)

AI总结 GlyphBanana通过代理工作流整合辅助工具,提升复杂文本和公式渲染的精度,适用于多种文本到图像模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10473 2026-03-12 cs.CL cs.AI

Aligning Large Language Models with Searcher Preferences

将大型语言模型对齐于搜索者偏好

Wei Wu, Peilun Zhou, Liyi Chen, Qimeng Wang, Chengqiang Lu, Yan Gao, Yi Wu, Yao Hu, Hui Xiong

机构 * School of Artificial Intelligence and Data Science, University of Science and Technology of China(中国科学技术大学人工智能与数据科学学院) Xiaohongshu Inc.(小红书公司) Thrust of Artificial Intelligence, The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)人工智能研究所) Department of Computer Science and Engineering, The Hong Kong University of Science and Technology(香港科技大学计算机科学与工程系)

AI总结 SearchLLM通过分层多维奖励系统提升开放式生成搜索的鲁棒性和用户需求对齐能力,实测有效消费率提升1.03%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07700 2026-03-10 cs.CV cs.AI

TDM-R1: Reinforcing Few-Step Diffusion Models with Non-Differentiable Reward

TDM-R1: 通过非可微奖励强化少步扩散模型

Yihong Luo, Tianyang Hu, Weijian Luo, Jing Tang

机构 * Hong Kong University of Science and Technology(香港科技大学) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) hi-Lab, Xiaohongshu Inc(小红书实验室) Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))

AI总结 TDM-R1通过非可微奖励强化少步扩散模型,提升文本到图像生成性能

Comments https://luo-yihong.github.io/TDM-R1-Page/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05578 2026-03-09 cs.SE cs.AI

Tool-Genesis: A Task-Driven Tool Creation Benchmark for Self-Evolving Language Agent

Tool-Genesis: 一种以任务为导向的工具创建基准,用于自进化语言代理

Bowei Xia, Mengkang Hu, Shijian Wang, Jiarui Jin, Wenxiang Jiao, Yuan Lu, Kexin Li, Ping Luo

机构 * The University of Hong Kong(香港大学) Xiaohongshu Inc.(小红书公司)

AI总结 Tool-Genesis提出一种任务驱动的工具创建基准,用于评估自进化语言代理在无预定义规范下构建任务相关工具的能力及下游性能。

Comments 25 pages, 10 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05240 2026-03-06 cs.AI

GCAgent: Enhancing Group Chat Communication through Dialogue Agents System

GCAgent:通过对话代理系统增强群聊交流

Zijie Meng, Zheyong Xie, Zheyu Ye, Chonggang Lu, Zuozhu Liu, Zihan Niu, Yao Hu, Shaosheng Cao

机构 * Zhejiang University(浙江大学) Xiaohongshu Inc.(小红书公司) University of Science and Technology of China(中国科学技术大学)

AI总结 GCAgent通过集成娱乐和实用导向的对话代理系统,提升群聊交流效果,实现多参与者对话的高效管理与增强。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01840 2026-03-03 cs.CV eess.IV

FireRed-OCR Technical Report

FireRed-OCR 技术报告

Hao Wu, Haoran Lou, Xinyue Li, Zuodong Zhong, Zhaojun Sun, Phellon Chen, Xuanhe Zhou, Kai Zuo, Yibo Chen, Xu Tang, Yao Hu, Boxiang Zhou, Jian Wu, Yongji Wu, Wenxin Yu, Yingmiao Liu, Yuhao Huang, Manjie Xu, Gang Liu, Yidong Ma, Zhichao Sun, Changhao Qiao

机构 * Super Intelligence Team(超级智能团队) Xiaohongshu Inc(小红书公司)

AI总结 FireRed-OCR 通过三阶段渐进训练策略,将通用 VLM 转化为高精度结构文档解析专家,实现 OCR 领域的突破性性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01590 2026-03-03 cs.IR cs.LG

IDProxy: Cold-Start CTR Prediction for Ads and Recommendation at Xiaohongshu with Multimodal LLMs

IDProxy:小红书广告与推荐中基于多模态大语言模型的冷启动CTR预测

Yubin Zhang, Haiming Xu, Guillaume Salha-Galvan, Ruiyan Han, Feiyang Xiao, Yanhua Huang, Li Lin, Yang Luo, Yao Hu

机构 * Xiaohongshu Inc.(小红书公司) Shanghai Jiao Tong University(上海交通大学) Fudan University(复旦大学)

AI总结 IDProxy通过多模态大语言模型生成代理嵌入,解决广告和推荐系统中物品冷启动的CTR预测问题,实现与现有嵌入空间的对齐和端到端优化,已在小红书大规模应用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08630 2026-03-03 cs.CL

ExPO-HM: Learning to Explain-then-Detect for Hateful Meme Detection

ExPO-HM:为仇恨表情包检测学习解释-然后检测

Jingbiao Mei, Mingsheng Sun, Jinghong Chen, Pengda Qin, Yuhong Li, Da Chen, Bill Byrne

机构 * Department of Engineering, University of Cambridge(剑桥大学工程系) Xiaohongshu Inc.(小红书公司) University of Bath(巴斯大学) Tencent Company, China(腾讯公司) Alibaba Group(阿里巴巴集团)

AI总结 ExPO-HM通过结合SFT预热、GRPO与课程学习及CDE,提升仇恨表情包检测的解释性和准确性。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.14362 2026-03-03 cs.CV

DeepEyes: Incentivizing "Thinking with Images" via Reinforcement Learning

DeepEyes: 通过强化学习激励'图像思考'

Ziwei Zheng, Michael Yang, Jack Hong, Chenxiao Zhao, Guohai Xu, Le Yang, Chao Shen, Xing Yu

机构 * Xiaohongshu Inc.(小红书公司) Xi’an Jiaotong University(西安交通大学)

AI总结 DeepEyes通过强化学习实现图像引导的推理,无需预训练数据,提升多模态任务性能。

Comments Accepted by ICLR2026. Ziwei, Michael, Jack, and Chenxiao are equal-contribution. The list order is random

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.06749 2026-03-03 cs.CV cs.AI cs.CL cs.LG

Vision-R1: Incentivizing Reasoning Capability in Multimodal Large Language Models

Vision-R1: 促进多模态大语言模型推理能力的激励方法

Wenxuan Huang, Bohan Jia, Zijie Zhai, Shaosheng Cao, Zheyu Ye, Fei Zhao, Zhe Xu, Xu Tang, Yao Hu, Shaohui Lin

机构 * East China Normal University(华东师范大学) The Chinese University of Hong Kong(香港中文大学) Xiaohongshu Inc.(小红书公司)

AI总结 Vision-R1通过构建高质量多模态CoT数据集和渐进性思维抑制训练策略,提升多模态推理能力,在数学推理基准中取得显著成绩。

Comments Accepted to ICLR 2026. Code is available at https://github.com/Osilly/Vision-R1

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.04326 2026-03-03 cs.CV cs.AI

WorldSense: Evaluating Real-world Omnimodal Understanding for Multimodal LLMs

WorldSense: 评估多模态大语言模型的现实世界多模态理解

Jack Hong, Shilin Yan, Jiayin Cai, Xiaolong Jiang, Yao Hu, Weidi Xie

机构 * Xiaohongshu Inc.(小红书公司) Shanghai Jiao Tong University(上海交通大学)

AI总结 WorldSense是首个评估多模态大语言模型现实世界多模态理解能力的基准,通过多模态协作、多样化视频任务和高质量标注,全面评估模型在复杂场景中的表现。

Comments Accepted by ICLR2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19862 2026-03-02 cs.CL cs.LG

REA-RL: Reflection-Aware Online Reinforcement Learning for Efficient Reasoning

REA-RL:面向高效推理的反思意识在线强化学习

Hexuan Deng, Wenxiang Jiao, Xuebo Liu, Jun Rao, Min Zhang

机构 * Institute of Computing and Intelligence, Harbin Institute of Technology, Shenzhen, China(计算与智能学院,哈尔滨工业大学深圳学院) Zhongguancun Academy, Beijing, China(中关村学院,北京) Xiaohongshu Inc.(小红书公司)

AI总结 REA-RL通过引入反思模型和反思奖励,提升在线强化学习中推理效率和性能平衡。

Comments Accepted by ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12401 2026-02-16 cs.CV

ZeroDiff++: Substantial Unseen Visual-semantic Correlation in Zero-shot Learning

ZeroDiff++: 零样本学习中显著的未见视觉-语义相关性

Zihan Ye, Shreyank N Gowda, Kaile Du, Weijian Luo, Ling Shao

机构 * UCAS-Terminus AI Lab, University of Chinese Academy of Sciences(中国科学院大学Terminus AI实验室,中国科学院大学) School of Computer Science, the University of Nottingham(诺丁汉大学计算机学院) Southeast University(东南大学) hi-lab of Xiaohongshu Inc(小红书公司hi实验室)

AI总结 ZeroDiff++通过扩散生成框架提升零样本学习中视觉-语义相关性,解决虚假相关性和数据稀缺问题。

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21452 2026-02-16 cs.LG cs.AI

SAGE: Sequence-level Adaptive Gradient Evolution for Generative Recommendation

SAGE:用于生成推荐的序列级自适应梯度进化

Yu Xie, Xing Kai Ren, Ying Qi, Hu Yao

机构 * Xiaohongshu(小红书)

AI总结 SAGE通过序列级自适应梯度进化方法,解决生成推荐中的优化失败问题,提升推荐系统的准确性、冷启动召回率和多样性。

Comments arXiv admin note: text overlap with arXiv:2506.19235

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09901 2026-02-11 cs.IR cs.CL

QP-OneModel: A Unified Generative LLM for Multi-Task Query Understanding in Xiaohongshu Search

QP-OneModel: 一个用于小红书搜索多任务查询理解的统一生成式大语言模型

Jianzhao Huang, Xiaorui Huang, Fei Zhao, Yunpeng Liu, Hui Zhang, Fangcheng Shi, Congfeng Li, Zechen Sun, Yi Wu, Yao Hu, Yunhan Bai, Shaosheng Cao

机构 * Xiaohongshu Inc.(小红书公司)

AI总结 QP-OneModel通过统一生成式大语言模型提升小红书搜索多任务查询理解的效率与准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05909 2026-02-06 cs.CV

CLIP-Map: Structured Matrix Mapping for Parameter-Efficient CLIP Compression

CLIP-Map: 结构化矩阵映射用于参数高效的CLIP压缩

Kangjie Zhang, Wenxuan Huang, Xin Zhou, Boxiang Zhou, Dejia Song, Yuan Xie, Baochang Zhang, Lizhuang Ma, Nemo Chen, Xu Tang, Yao Hu, Shaohui Lin

机构 * East China Normal University(东华师范大学) Xiaohongshu Inc.(小红书公司) Beihang University(北航大学)

AI总结 CLIP-Map通过结构化矩阵映射和克罗内克因子分解实现参数高效的CLIP压缩,有效保留原始权重信息并在高压缩比下表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21618 2026-02-06 cs.AI cs.CL cs.IR cs.LG

DeepAgent: A General Reasoning Agent with Scalable Toolsets

DeepAgent: 一种具有可扩展工具集的通用推理代理

Xiaoxi Li, Wenxiang Jiao, Jiarui Jin, Guanting Dong, Jiajie Jin, Yinuo Wang, Hao Wang, Yutao Zhu, Ji-Rong Wen, Yuan Lu, Zhicheng Dou

机构 * Renmin University of China(中国人民大学) Xiaohongshu Inc.(小红书公司) Tsinghua University(清华大学)

AI总结 DeepAgent通过自主记忆折叠机制和ToolPO强化学习策略,实现高效通用工具使用和长周期交互,优于现有基线方法。

Comments Accepted by WWW 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.20322 2026-02-05 cs.CV

Dynamic Pyramid Network for Efficient Multimodal Large Language Model

动态金字塔网络用于高效多模态大语言模型

Hao Ai, Kunyi Wang, Zezhou Wang, Hao Lu, Jin Tian, Yaxin Luo, Peng Xing, Jen-Yuan Huang, Huaxia Li, Gen luo

机构 * Beihang University(北航大学) Shanghai AI Laboratory(上海人工智能实验室) KAUST(卡塔尔大学) Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Technical University Of Denmark(丹麦技术大学) Nanjing University of Science and Technology(南京理工大学) Peking University(北京大学) Xiaohongshu Inc(小红书公司)

AI总结 动态金字塔网络通过分层结构和动态池化专家提升多模态大语言模型的效率与性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03627 2026-02-04 cs.LG

Ultra Fast PDE Solving via Physics Guided Few-step Diffusion

通过物理引导的少步扩散实现超快PDE求解

Cindy Xiangrui Kong, Yueqi Wang, Haoyang Zheng, Weijian Luo, Guang Lin

机构 * Purdue University(普渡大学) hi-Lab, Xiaohongshu Inc(小红书实验室,小红书公司)

AI总结 Phys-Instruct通过物理引导的蒸馏框架,实现PDE求解的高效与高物理一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03060 2026-02-04 cs.CV

IVC-Prune: Revealing the Implicit Visual Coordinates in LVLMs for Vision Token Pruning

IVC-Prune: 在大型视觉-语言模型中揭示隐式的视觉坐标以进行视觉标记剪枝

Zhichao Sun, Yidong Ma, Gang Liu, Yibo Chen, Xu Tang, Yao Hu, Yongchao Xu

机构 * School of Computer Science, Wuhan University(武汉大学计算机学院) Xiaohongshu Inc(小红书公司)

AI总结 IVC-Prune通过揭示LVLMs中隐式的视觉坐标,提出一种无训练、提示感知的视觉标记剪枝方法,有效减少标记数量并保持高性能。

Comments Accepted to ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01675 2026-02-03 cs.AI cs.LG

TRIP-Bench: A Benchmark for Long-Horizon Interactive Agents in Real-World Scenarios

TRIP-Bench:面向现实场景的长周期交互智能体基准

Yuanzhe Shen, Zisu Huang, Zhengyuan Wang, Muzhao Tian, Zhengkang Guo, Chenyang Zhang, Shuaiyu Zhou, Zengjie Hu, Dailin Li, Jingwen Xu, Kaimin Wang, Wenhao Liu, Tianlong Li, Fengpeng Yue, Feng Hong, Cao Liu, Ke Zeng

机构 * Xiaohongshu Inc.(小红书公司) School of Computer Science, Fudan University(复旦大学计算机学院) Dalian University of Technology(大连理工大学) Peking University(北京大学) Wuhan University(武汉大学)

AI总结 TRIP-Bench是一个面向现实场景的长周期交互智能体基准,通过真实旅行规划场景测试多工具推理与约束满足,提出GTPO方法提升智能体鲁棒性与性能。

Comments 40 pages, 6figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01362 2026-02-03 cs.CL

Balancing Understanding and Generation in Discrete Diffusion Models

在离散扩散模型中实现理解和生成的平衡

Yue Liu, Yuzhong Zhao, Zheyong Xie, Qixiang Ye, Jianbin Jiao, Yao Hu, Shaosheng Cao, Yunfan Liu

机构 * Xiaohongshu Inc.(小红书公司)

AI总结 XDLM通过平稳噪声核平衡理解和生成能力,实现MDLM和UDLM的理论统一并提升生成质量与理解能力。

Comments 32 pages, Code is available at https://github.com/MzeroMiko/XDLM

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00800 2026-02-03 cs.LG cs.AI

JTok: On Token Embedding as another Axis of Scaling Law via Joint Token Self-modulation

JTok: 关于通过联合令牌自调制实现另一种扩展法则的令牌嵌入

Yebin Yang, Huaijin Wu, Fu Guo, Lin Yao, Xiaohan Qin, Jingzhi Wang, Debing Zhang, Junchi Yan

机构 * School of AI, Shanghai Jiao Tong University(人工智能学院,上海交通大学) Hi Lab, Xiaohongshu Inc(小红书研究院)

AI总结 JTok通过引入令牌索引参数,实现模型容量与计算资源的解耦,显著提升下游任务性能并减少计算开销。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00717 2026-02-03 cs.LG cs.AI

Deep Time-series Forecasting Needs Kernelized Moment Balancing

深度时间序列预测需要核化矩平衡

Licheng Pan, Hao Wang, Haocheng Yang, Yuqi Li, Qingsong Wen, Xiaoxi Li, Zhichao Chen, Haoxuan Li, Zhixuan Chu, Yuan Lu

机构 * Xiaohongshu Inc.(小红书公司) National University of Singapore(新加坡国立大学) The City University of New York, CUNY(纽约市立大学,CUNY) State Key Lab of General AI, School of Intelligence Science and Technology, Peking University(人工智能国家重点实验室,北京大学) Center for Data Science, Peking University(北京大学数据科学中心) College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院)

AI总结 本文提出KMB-DF方法,通过核化矩平衡提升深度时间序列预测的准确性,实现更全面的分布平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22931 2026-02-02 cs.CL

Benchmarking Machine Translation on Chinese Social Media Texts

在中文社交媒体文本上评估机器翻译

Kaiyan Zhao, Zheyong Xie, Zhongtao Miao, Xinze Lyu, Yao Hu, Shaosheng Cao

机构 * The University of Tokyo(东京大学) Xiaohongshu Inc.(小红书公司)

AI总结 本文提出CSM-MTBench,用于评估机器翻译在中文社交媒体文本上的表现,涵盖五个语言方向,并针对不同内容类型设计了定制化评估方法。

Comments Work in Progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21919 2026-01-30 cs.AI cs.CL

Self-Compression of Chain-of-Thought via Multi-Agent Reinforcement Learning

通过多智能体强化学习实现链式思维的自我压缩

Yiqun Chen, Jinyuan Feng, Wei Yang, Meizhi Zhong, Zhengliang Shi, Rui Li, Xiaochi Wei, Yan Gao, Yi Wu, Yao Hu, Zhiqiang Pu, Jiaxin Mao

机构 * Renmin University of China(中国人民大学) Xiaohongshu Inc.(小红书公司) Institute of Automation,Chinese Academy of Sciences(中国科学院自动化研究所) University of Southern California(南加州大学) Shandong University(山东大学)

AI总结 通过多智能体强化学习实现链式思维的自我压缩,有效减少响应长度并提升准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21916 2026-01-30 cs.AI cs.CL cs.IR

JADE: Bridging the Strategic-Operational Gap in Dynamic Agentic RAG

JADE:动态代理RAG中战略-操作鸿沟的弥合

Yiqun Chen, Erhan Zhang, Tianyi Hu, Shijie Wang, Zixuan Yang, Meizhi Zhong, Xiaochi Wei, Yan Gao, Yi Wu, Yao Hu, Jiaxin Mao

机构 * Renmin University of China(中国人民大学) Xiaohongshu Inc.(小红书公司) Institute of Automation,Chinese Academy of Sciences(中国科学院自动化研究所) Shanghai AI Laboratory(上海人工智能实验室)

AI总结 JADE通过联合优化规划与执行,解决动态代理RAG中战略与操作不匹配的问题,提升多轮工作流的性能与灵活性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17058 2026-01-27 cs.DB cs.AI cs.CL cs.LG

Can LLMs Clean Up Your Mess? A Survey of Application-Ready Data Preparation with LLMs

大模型能帮你清理数据吗?基于大模型的应用级数据准备综述

Wei Zhou, Jun Zhou, Haoyu Wang, Zhenghao Li, Qikang He, Shaokun Han, Guoliang Li, Xuanhe Zhou, Yeye He, Chunwei Liu, Zirui Tang, Bin Wang, Shen Tang, Kai Zuo, Yuyu Luo, Zhenzhe Zheng, Conghui He, Jingren Zhou, Fan Wu

机构 * Shanghai Jiao Tong University(上海交通大学) Tsinghua University(清华大学) Microsoft Research(微软研究院) MIT CSAIL(麻省理工学院计算机科学与人工智能实验室) Shanghai AI Laboratory(上海人工智能实验室) Xiaohongshu Inc.(小红书公司) Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Alibaba Group(阿里巴巴集团)

AI总结 本文综述了基于大语言模型的应用级数据准备方法,探讨了数据清洗、整合与丰富三大任务的技术、优势与局限,并提出了可扩展的大语言模型-数据系统和稳健评估协议的未来研究方向。

Comments Please refer to our repository for more details: https://github.com/weAIDB/awesome-data-llm

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.01652 2026-01-21 cs.CL

MIRAGE: Exploring How Large Language Models Perform in Complex Social Interactive Environments

MIRAGE:探索大型语言模型在复杂社会互动环境中的表现

Yin Cai, Zhouhong Gu, Zhaohan Du, Zheyu Ye, Shaosheng Cao, Yiqian Xu, Hongwei Feng, Ping Chen

机构 * Institute of Big Data, Fudan University(复旦大学大数据研究院) Shanghai Key Laboratory of Data Science, School of Computer Science, Fudan University(复旦大学计算机学院) School of Computer Science, Fudan University(复旦大学计算机学院) Xiaohongshu Inc.(小红书公司)

AI总结 MIRAGE通过谋杀谜案游戏评估LLMs在复杂社会互动环境中的表现,揭示其在信任、线索调查、互动和指令遵循方面的挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04698 2026-01-09 cs.AI cs.CL cs.LG

TourPlanner: A Competitive Consensus Framework with Constraint-Gated Reinforcement Learning for Travel Planning

TourPlanner: 一种基于约束门控强化学习的竞争共识框架用于旅行规划

Yinuo Wang, Mining Tan, Wenxiang Jiao, Xiaoxi Li, Hao Wang, Xuanyu Zhang, Yuan Lu, Weiming Dong

机构 * Xiaohongshu Inc.(小红书公司) Renmin University of China(中国人民大学) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) MAIS, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所MAIS)

AI总结 TourPlanner通过多路径推理和约束门控强化学习,解决旅行规划中候选点修剪、探索能力限制和约束优化难题,实现更高效的行程生成。

详情

展开后加载摘要…

URL PDF HTML 收藏