arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of Science and Technology of China(中国科学技术大学)

共收录 2228
2511.00396 2025-11-27 cs.CV

Saliency-R1: Incentivizing Unified Saliency Reasoning Capability in MLLM with Confidence-Guided Reinforcement Learning

Saliency-R1: 通过置信度引导的强化学习激励多模态大语言模型统一的显著性推理能力

Long Li, Shuichen Ji, Ziyang Luo, Zhihui Li, Dingwen Zhang, Junwei Han, Nian Liu

机构 * Northwestern Polytechnical University(西北工业大学) University of Science and Technology of China(中国科学技术大学)

AI总结 Saliency-R1通过置信度引导的强化学习,提升多模态大语言模型在显著性推理任务中的统一能力,实现显著物体检测、显著实例分割和共显著物体检测的高效处理。

Comments Main text (excluding references): 8 pages, 4 figures; Supplementary Materials (excluding references): 9 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.16687 2025-11-27 cs.CV eess.IV

One-Step Diffusion-Based Image Compression with Semantic Distillation

一步扩散式图像压缩与语义蒸馏

Naifu Xue, Zhaoyang Jia, Jiahao Li, Bin Li, Yuan Zhang, Yan Lu

机构 * Communication University of China(中国通信大学) University of Science and Technology of China(中国科学技术大学) Microsoft Research Asia(微软亚洲研究院)

AI总结 OneDC通过一步扩散生成和语义蒸馏机制实现高效图像压缩,达到SOTA感知质量,比特率降低39%且解码速度提升20倍。

Comments Accepted by NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.14914 2025-11-27 cs.CV cs.CL cs.LG

CAPability: A Comprehensive Visual Caption Benchmark for Evaluating Both Correctness and Thoroughness

CAPability: 一个全面的视觉描述基准,用于评估正确性和全面性

Zhihang Liu, Chen-Wei Xie, Bin Wen, Feiwu Yu, Jixuan Chen, Pandeng Li, Boqiang Zhang, Nianzu Yang, Yinglu Li, Zuan Gao, Yun Zheng, Hongtao Xie

机构 * University of Science and Technology of China(中国科学技术大学) Tongyi Lab, Alibaba Group(阿里云实验室)

AI总结 CAPability是一个全面的视觉描述基准,通过12个维度评估描述的正确性和全面性,利用人类标注数据和启发式指标提升多模态模型的描述能力分析。

Comments Accepted to NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20200 2025-11-26 cs.AI

Interactive AI NPCs Powered by LLMs: Technical Report for the CPDC Challenge 2025

基于大语言模型的交互式AI NPC:CPDC挑战2025的技术报告

Yitian Huang, Yuxuan Lei, Jianxun Lian, Hao Liao

机构 * CSSE, Shenzhen University(软件学院,深圳大学) University of Science and Technology of China(中国科学技术大学) Microsoft Research Asia(微软亚洲研究院)

AI总结 本报告提出基于大语言模型的交互式AI NPC框架,通过上下文工程与GRPO训练提升对话性能,在CPDC 2025挑战中取得优异成绩

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19914 2025-11-26 cs.RO

CoC-VLA: Delving into Adversarial Domain Transfer for Explainable Autonomous Driving via Chain-of-Causality Visual-Language-Action Model

CoC-VLA: 深入研究对抗域转移以实现可解释的自动驾驶 via 链式因果视觉语言动作模型

Dapeng Zhang, Fei Shen, Rui Zhao, Yinda Chen, Peng Zhi, Chenyang Li, Rui Zhou, Qingguo Zhou

机构 * Lanzhou University(兰州大学) National University of Singapore(新加坡国立大学) University of Science and Technology of China(中国科学技术大学)

AI总结 CoC-VLA通过链式因果视觉语言动作模型实现对抗域转移,提升自动驾驶的可解释性和长尾场景处理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19912 2025-11-26 cs.CV cs.RO

Reasoning-VLA: A Fast and General Vision-Language-Action Reasoning Model for Autonomous Driving

Reasoning-VLA: 一种用于自动驾驶的快速且通用的视觉-语言-动作推理模型

Dapeng Zhang, Zhenlong Yuan, Zhangquan Chen, Chih-Ting Liao, Yinda Chen, Fei Shen, Qingguo Zhou, Tat-Seng Chua

机构 * Lanzhou University(兰州大学) National University of Singapore(新加坡国立大学) University of Science and Technology of China(中国科学技术大学) Tsinghua University(清华大学) University of New South Wales(新南威尔士大学)

AI总结 Reasoning-VLA通过引入可学习的动作查询和链式思维推理的数据格式,实现了在自动驾驶中快速且通用的视觉-语言-动作推理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19836 2025-11-26 cs.CV

4DWorldBench: A Comprehensive Evaluation Framework for 3D/4D World Generation Models

4DWorldBench: 一种用于3D/4D世界生成模型的综合评估框架

Yiting Lu, Wei Luo, Peiyan Tu, Haoran Li, Hanxin Zhu, Zihao Yu, Xingrui Wang, Xinyi Chen, Xinge Peng, Xin Li, Zhibo Chen

机构 * University of Science and Technology of China(中国科学技术大学) Zhejiang University(浙江大学) Beijing Zhongguancun Academy(北京中关村学院)

AI总结 4DWorldBench提出了一种用于评估3D/4D世界生成模型的综合框架,通过四个维度评估模型的感知质量、条件对齐、物理真实性和一致性,支持多模态输入并整合多种评估方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19834 2025-11-26 cs.CV

Large Language Model Aided Birt-Hogg-Dube Syndrome Diagnosis with Multimodal Retrieval-Augmented Generation

基于多模态检索增强生成的大型语言模型辅助Birt-Hogg-Dube综合征诊断

Haoqing Li, Jun Shi, Xianmeng Chen, Qiwei Jia, Rui Wang, Wei Wei, Hong An, Xiaowen Hu

机构 * School of Computer Science and Technology(计算机科学与技术学院) Department of Pulmonary and Critical Care Medicine(呼吸与危重症医学科) Center for Diagnosis and Management of Rare Diseases(罕见病诊断与管理中心) the First Affiliated Hospital of USTC(USTC第一附属医院) Division of Life Sciences and Medicine(生命科学与医学系) USTC WanNan Medical College(皖南医学院)

AI总结 本研究提出BHD-RAG框架,通过整合多模态检索增强生成与领域专业知识,提升Birt-Hogg-Dube综合征的CT影像诊断准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17811 2025-11-26 cs.GR cs.AI cs.CV cs.LG

MeshSplat: Generalizable Sparse-View Surface Reconstruction via Gaussian Splatting

MeshSplat: 通过高斯散射实现通用稀疏视图表面重建

Hanzhi Chang, Ruijie Zhu, Wenjie Chang, Mulin Yu, Yanzhe Liang, Jiahao Lu, Zhuoyuan Li, Tianzhu Zhang

机构 * University of Science and Technology of China(中国科学技术大学) Shanghai AI Laboratory(上海人工智能实验室)

AI总结 MeshSplat通过高斯散射实现稀疏视图下的通用表面重建,利用2DGS连接新视图合成与几何先验,提升重建精度。

Comments Accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19425 2025-11-25 cs.CV

SAM3-Adapter: Efficient Adaptation of Segment Anything 3 for Camouflage Object Segmentation, Shadow Detection, and Medical Image Segmentation

SAM3-Adapter: 高效适应Segment Anything 3用于伪装物分割、阴影检测和医学图像分割

Tianrun Chen, Runlong Cao, Xinda Yu, Lanyun Zhu, Chaotao Ding, Deyi Ji, Cheng Chen, Qi Zhu, Chunyan Xu, Papa Mao, Ying Zang

机构 * KOKONI, Moxin (Huzhou) Tech. Co., LTD(摩西(湖州)科技有限公司) College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院) School of Computer Science and Engineering, Nanjing University of Science and Technology(南京理工大学计算机科学与工程学院) School of Information Engineering, Huzhou University(湖州大学信息工程学院) School of Electrical and Electronic Engineering, Nanyang Technological University(新加坡南洋理工大学电子与电气工程学院) College of Computing and Data Science, Nanyang Technological University(新加坡南洋理工大学计算与数据科学学院) School of Information Science and Technology, University of Science and Technology of China(中国科学技术大学信息科学与技术学院)

AI总结 SAM3-Adapter通过高效适配框架提升SAM3在伪装物分割、阴影检测和医学影像分割等任务中的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18920 2025-11-25 cs.CV

EventSTU: Event-Guided Efficient Spatio-Temporal Understanding for Video Large Language Models

EventSTU: 基于事件的高效空间-时间理解用于视频大语言模型

Wenhao Xu, Xin Dong, Yue Li, Haoyuan Shi, Zhiwei Xiong

机构 * University of Science and Technology of China(中国科学技术大学)

AI总结 EventSTU通过事件引导的方法,高效处理视频大语言模型的空间-时间理解,实现显著的计算效率提升和性能优化。

Comments 8 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.01421 2025-11-25 cs.CV

InfoScale: Unleashing Training-free Variable-scaled Image Generation via Effective Utilization of Information

InfoScale: 通过有效利用信息实现免训练可变尺度图像生成

Guohui Zhang, Jiangtong Tan, Linjiang Huang, Zhonghang Yuan, Mingde Yao, Jie Huang, Feng Zhao

机构 * USTC(中国科学技术大学) Beihang University(北京航空航天大学) CUHK MMLab(香港中文大学多媒体实验室) Kuaishou Technology(快手科技)

AI总结 InfoScale通过有效利用信息解决扩散模型在可变尺度图像生成中的信息丢失、聚合不灵活和分布不匹配问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.20840 2025-11-25 cs.RO cs.AI cs.MM

Learning Primitive Embodied World Models: Towards Scalable Robotic Learning

学习原始具身世界模型:迈向可扩展的机器人学习

Qiao Sun, Liujia Yang, Wei Tang, Wei Huang, Kaixin Xu, Yongchao Chen, Mingyu Liu, Jiange Yang, Haoyi Zhu, Yating Wang, Tong He, Yilun Chen, Xili Dai, Nanyang Ye, Qinying Gu

机构 * Shanghai AI Lab(上海人工智能实验室) Fudan(复旦大学) SJTU(上海交通大学) NJUST(南京理工大学) THU(清华大学) Harvard(哈佛大学) ZJU(浙江大学) NJU(南京大学) USTC(中国科学技术大学) Tongji(同济大学) HKUST (GZ)(香港科技大学(广州))

AI总结 提出原始具身世界模型(PEWM)以解决具身数据稀疏和高维问题,通过短视界视频生成实现细粒度对齐、降低学习复杂度并提高数据效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.11443 2025-11-25 cs.CV cs.AI

COLI: A Hierarchical Efficient Compressor for Large Images

COLI:一种用于大图像的分层高效压缩器

Haoran Wang, Hanyu Pei, Yang Lyu, Kai Zhang, Li Li, Feng-Lei Fan

机构 * Frontier of Artificial Networks (FAN) Lab, Department of Data Science, City University of Hong Kong(前沿人工智能网络实验室,数据科学系,香港城市大学) Molecular Imaging Business Unit, Shanghai United Imaging Healthcare Co., Ltd(分子影像业务部,上海联合影像医疗科技股份有限公司) MoE Key Laboratory of Brain-Inspired Intelligent Perception and Cognition, University of Science and Technology of China(脑启发智能感知与认知关键实验室,中国科学技术大学)

AI总结 COLI通过改进的神经表示方法,实现大图像高效压缩,提升压缩比并加快训练速度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18088 2025-11-25 cs.RO

A Unified Multi-Dynamics Framework for Perception-Oriented Modeling in Tendon-Driven Continuum Robots

为腱驱动连续机器人感知导向建模设计的统一多动态框架

Ibrahim Alsarraj, Yuhao Wang, Abdalla Swikir, Cesare Stefanini, Dezhen Song, Zhanchi Wang, Ke Wu

机构 * Robotics Department, Mohamed bin Zayed University of Artificial Intelligence (MBZUAI)(Mohamed bin Zayed大学人工智能研究院机器人部门) Hefei National Research Center for Physical Sciences at the Microscale, University of Science and Technology of China (USTC)(中国科学技术大学微尺度物理科学国家级研究中心)

AI总结 本文提出了一种统一的多动态框架,用于腱驱动连续机器人中基于内在动态的感知建模与交互解释。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18006 2025-11-25 cs.LG

Understanding Private Learning From Feature Perspective

从特征角度理解隐私学习

Meng Ding, Mingxi Lei, Shaopeng Fu, Shaowei Wang, Di Wang, Jinhui Xu

机构 * Department of Computer Science and Engineering, State University of New York at Buffalo(纽约州立大学布法罗分校计算机科学与工程系) Division of CEMSE, King Abdullah University of Science and Technology(卡普兰大学科学与技术大学CEMSE分校) Institute of Artificial Intelligence and Blockchain, Guangzhou University(广州大学人工智能与区块链研究院) School of Information Science and Technology, University of Science and Technology of China(中国科学技术大学信息科学与技术学院)

AI总结 本文从特征学习角度提出首个隐私训练理论框架,揭示隐私学习中特征信号学习需更高信噪比,且数据噪声记忆会影响泛化能力。

Comments 39pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01982 2025-11-25 cs.LG cs.CV

Fine-Grained GRPO for Precise Preference Alignment in Flow Models

细粒度GRPO用于流模型中的精确偏好对齐

Yujie Zhou, Pengyang Ling, Jiazi Bu, Yibin Wang, Yuhang Zang, Jiaqi Wang, Li Niu, Guangtao Zhai

机构 * Shanghai Jiao Tong University(上海交通大学) University of Science and Technology of China(中国科学技术大学) Fudan University(复旦大学) Shanghai AI Laboratory(上海人工智能实验室) Shanghai Innovation Institute(上海创新研究院)

AI总结 本文提出细粒度GRPO框架,通过细粒度评估和多粒度整合模块提升流模型中偏好对齐的精度与鲁棒性。

Comments Project Page: https://bujiazi.github.io/g2rpo.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.03833 2025-11-25 cs.LG stat.ML

Understanding Fine-tuning in Approximate Unlearning: A Theoretical Perspective

理解近似反向学习中的微调:一种理论视角

Meng Ding, Rohan Sharma, Changyou Chen, Jinhui Xu, Kaiyi Ji

机构 * Department of Computer Science and Engineering(计算机科学与工程系) State University of New York at Buffalo(纽约州立大学布法罗分校) School of Information Science and Technology(信息科学与技术学院) University of Science and Technology of China(中国科学技术大学)

AI总结 本文提出基于保留的遮蔽策略,通过理论分析揭示微调方法在反向学习中的局限性,并改进反向学习和保留准确性。

Comments 23 pages,5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.15503 2025-11-25 cs.CL

Llama2Vec: Unsupervised Adaptation of Large Language Models for Dense Retrieval

Llama2Vec: 无监督适应大型语言模型用于密集检索

Zheng Liu, Chaofan Li, Shitao Xiao, Yingxia Shao, Defu Lian

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) Beijing Academy of Artificial Intelligence(北京人工智能研究院) University of Science and Technology of China(中国科学技术大学) The Hong Kong Polytechnic University(香港理工大学)

AI总结 Llama2Vec通过无监督适应LLM提升密集检索性能,实现新的最先进结果。

Comments ACL 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17322 2025-11-24 cs.CV

NoPe-NeRF++: Local-to-Global Optimization of NeRF with No Pose Prior

NoPe-NeRF++: 无姿态先验的NeRF局部到全局优化

Dongbo Shi, Shen Cao, Bojian Wu, Jinhui Guo, Lubin Fan, Renjie Chen, Ligang Liu, Jieping Ye

机构 * University of Science and Technology of China(中国科学技术大学) Independent Researcher(独立研究者)

AI总结 NoPe-NeRF++通过局部到全局优化提升NeRF姿态估计与新视角合成性能,无需姿态先验且在复杂场景中表现优异。

Journal ref Eurographics 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.06677 2025-11-24 cs.CV cs.MM

REArtGS: Reconstructing and Generating Articulated Objects via 3D Gaussian Splatting with Geometric and Motion Constraints

REArtGS: 通过3D高斯散点与几何和运动约束进行姿态物体的重建与生成

Di Wu, Liu Liu, Zhou Linli, Anran Huang, Liangtu Song, Qiaojun Yu, Qi Wu, Cewu Lu

机构 * Hefei Institutes of Physical Science Chinese Academy of Sciences(合肥物理研究所中国科学院) University of Science and Technology of China(中国科学技术大学) Hefei University of Technology(合肥工业大学) Shanghai Jiao Tong University(上海交通大学) ByteDance(字节跳动)

AI总结 REArtGS通过引入几何和运动约束的3D高斯散点方法,实现姿态物体的高保真表面重建与生成。

Comments 11pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16573 2025-11-21 cs.OH cs.LG

An Exterior-Embedding Neural Operator Framework for Preserving Conservation Laws

一种用于保持守恒定律的外部嵌入神经算子框架

Huanshuo Dong, Hong Wang, Hao Wu, Zhiwei Zhuang, Xuanze Yang, Ruiqi Shu, Yuan Gao, Xiaomeng Huang

机构 * University of Science and Technology of China(科学技术大学) Tsinghua University(清华大学)

AI总结 本文提出了一种通用的守恒框架,通过外部嵌入技术强制神经算子在预测中严格遵守守恒定律,提升了模型性能和泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.05281 2025-11-21 cs.LG cs.AI

Fast-DataShapley: Neural Modeling for Training Data Valuation

Fast-DataShapley: 用于训练数据估值的神经建模

Haifeng Sun, Yu Xiong, Runze Wu, Xinyu Cai, Changjie Fan, Lan Zhang, Xiang-Yang Li

机构 * University of Science and Technology of China(中国科学技术大学) Netease, Fuxi AI Lab(网易智谱实验室) Nanyang Technological University(南洋理工大学)

AI总结 Fast-DataShapley通过神经建模实现训练数据估值,提升效率和性能

Journal ref ACM WSDM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.27237 2025-11-21 cs.CV

Fusion of Multi-scale Heterogeneous Pathology Foundation Models for Whole Slide Image Analysis

多尺度异构病理基础模型融合用于全切片图像分析

Zhidong Yang, Xiuhui Shi, Wei Ba, Zhigang Song, Haijing Luan, Taiyuan Hu, Senlin Lin, Jiguang Wang, Shaohua Kevin Zhou, Rui Yan

机构 * School of Biomedical Engineering, Division of Life Sciences and Medicine, University of Science and Technology of China(中国科学技术大学生物医学工程学院) Division of Life Science, Department of Chemical and Biological Engineering, State Key Laboratory of Nervous System Disorders, The Hong Kong University of Science and Technology(香港科技大学生命科学系) SIAT-HKUST Joint Laboratory of Cell Evolution and Digital Health, HKUST Shenzhen-Hong Kong Collaborative Innovation Research Institute(深圳-香港联合创新研究院细胞进化与数字健康联合实验室) Department of Hepatobiliary Surgery, The First Affiliated Hospital of USTC, Division of Life Sciences and Medicine, University of Science and Technology of China(中国科学技术大学附属第一医院肝胆外科) Center for Medical Imaging, Robotics, Analytic Computing & Learning (MIRACLE), Suzhou Institute for Advanced Research, USTC, Suzhou, Jiangsu, China(中国科学技术大学苏州先进研究所) Computer Network Information Center, Chinese Academy of Sciences(中国科学院计算机网络信息中心) Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) Jiangsu Provincial Key Laboratory of Multimodal Digital Twin Technology, Suzhou, Jiangsu, China(江苏省多模态数字孪生技术重点实验室) Key Laboratory of Precision and Intelligent Chemistry, USTC, Hefei, Anhui, China(中国科学技术大学精准与智能化学重点实验室) Department of Pathology, Chinese PLA General Hospital, Beijing, China(中国人民解放军总医院病理科)

AI总结 本文提出FuseCPath框架,通过多尺度异构病理基础模型融合提升全切片图像分析性能。

Comments 22 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23584 2025-11-21 cs.CV

VividFace: High-Quality and Efficient One-Step Diffusion For Video Face Enhancement

VividFace: 高质量和高效的一步扩散用于视频面部增强

Shulian Zhang, Yong Guo, Long Peng, Ziyang Wang, Ye Chen, Wenbo Li, Xiao Zhang, Yulun Zhang, Jian Chen

机构 * South China University of Technology(华南理工大学) Max Planck Institute for Informatics(马克斯·普朗克研究所(信息学)) University of Science and Technology of China(中国科学技术大学) The Chinese University of Hong Kong(香港中文大学) Nanjing University of Science and Technology(南京理工大学) Shanghai Jiao Tong University(上海交通大学)

AI总结 VividFace通过单步扩散框架和联合训练策略,高效提升视频面部增强的高质量与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.07503 2025-11-21 cs.CV

Event Stream Filtering via Probability Flux Estimation

基于概率流估计的事件流过滤

Jinze Chen, Wei Zhai, Yang Cao, Bin Li, Zheng-Jun Zha

机构 * University of Science and Technology of China(中国科学技术大学)

AI总结 EDFilter通过概率流估计实现事件流过滤,提升事件数据的实时处理与连续辐照度动态重建能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.18671 2025-11-21 cs.CV

Structure-Aware Correspondence Learning for Relative Pose Estimation

结构感知的对应学习用于相对姿态估计

Yihan Chen, Wenfei Yang, Huan Ren, Shifeng Zhang, Tianzhu Zhang, Feng Wu

机构 * University of Science and Technology of China(中国科学技术大学) National Key Laboratory of Deep Space Exploration, Deep Space Exploration Laboratory(国家空间科学探测重点实验室,深空探测实验室) Sangfor Technologies

AI总结 本文提出一种结构感知的对应学习方法,通过关键点提取和对应估计模块,提升未见物体的3D-3D对应估计精度。

Comments CVPR2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.12851 2025-11-21 cs.CL

ACEBench: Who Wins the Match Point in Tool Usage?

ACEBench: 工具使用场景中谁胜出?

Chen Chen, Xinlong Hao, Weiwen Liu, Xu Huang, Xingshan Zeng, Shuai Yu, Dexun Li, Shuai Wang, Weinan Gan, Yuefeng Huang, Wulong Liu, Xinzhi Wang, Defu Lian, Baoqun Yin, Yasheng Wang, Wu Liu

机构 * University of Science and Technology of China(中国科学技术大学) Huawei Noah’s Ark Lab(华为诺亚实验室) Shanghai Jiao Tong University(上海交通大学)

AI总结 ACEBench是一个用于评估大型语言模型工具使用能力的综合基准测试,通过三种类型的数据评估场景,深入分析LLMs在不同情境下的工具使用表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.15308 2025-11-20 cs.CV

Text2Loc++: Generalizing 3D Point Cloud Localization from Natural Language

Yan Xia, Letian Shi, Yilin Di, Joao F. Henriques, Daniel Cremers

机构 * School of Artificial Intelligence and Data Science, University of Science and Technology of China(人工智能与数据科学学院,中国科学技术大学) Technical University of Munich(慕尼黑技术大学) Visual Geometry Group, University of Oxford(牛津大学视觉几何组)

Comments This paper builds upon and extends our earlier conference paper Text2Loc presented at CVPR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.07968 2025-11-20 cs.AI

TimeFlow: Towards Stochastic-Aware and Efficient Time Series Generation via Flow Matching Modeling

He Panjing, Cheng Mingyue, Li Li, Zhang XiaoHan

机构 * State Key Laboratory of Cognitive Intelligence, University of Science and Technology of China(认知智能国家重点实验室,中国科学技术大学)

详情

展开后加载摘要…

URL PDF HTML 收藏