arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Fudan University(复旦大学)

共收录 1936
2512.21302 2025-12-25 cs.CV

AndroidLens: Long-latency Evaluation with Nested Sub-targets for Android GUI Agents

AndroidLens: 长延迟评估与嵌套子目标用于Android GUI代理

Yue Cao, Yingyao Wang, Pi Bu, Jingxuan Xing, Wei Jiang, Zekun Zhu, Junpeng Ma, Sashuai Zhou, Tong Lu, Jun Song, Yu Cheng, Yuning Jiang, Bo Zheng

机构 * Nanjing University(南京大学) Alibaba Group(阿里巴巴集团) Fudan University(复旦大学) Zhejiang University(浙江大学)

AI总结 AndroidLens通过引入571个长延迟任务和嵌套子目标,评估Android GUI代理的性能,揭示了现实环境中任务完成的挑战。

Comments 23 pages, 13 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20967 2025-12-25 cs.DC cs.LG

Deadline-Aware Online Scheduling for LLM Fine-Tuning with Spot Market Predictions

面向截止期限的在线调度用于大语言模型微调与预留市场预测

Linggao Kong, Yuedong Xu, Lei Jiao, Chuan Xu

机构 * Fudan University(复旦大学) University of Oregon(俄勒冈大学) Inria(法国国家信息与自动化研究所)

AI总结 本文提出了一种面向截止期限的在线调度方法,结合预留和按需实例,通过预测和策略选择算法实现大语言模型微调的低成本高效调度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20954 2025-12-25 cs.CL cs.AI

Reflection Pretraining Enables Token-Level Self-Correction in Biological Sequence Models

反射预训练使生物序列模型实现token级自我修正

Xiang Zhang, Jiaqi Wei, Yuejin Yang, Zijie Qiu, Yuhan Chen, Zhiqiang Gao, Muhammad Abdul-Mageed, Laks V. S. Lakshmanan, Wanli Ouyang, Chenyu You, Siqi Sun

机构 * Fudan University(复旦大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) University of British Columbia(不列颠哥伦比亚大学) Zhejiang University(浙江大学) The Chinese University of Hong Kong(香港中文大学) Stony Brook University(石溪大学)

AI总结 本文提出反射预训练方法,通过生成辅助标记提升生物序列模型的token表达能力,实现token级自我修正和推理能力提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20670 2025-12-25 cs.LG cs.AI

Disentangling Fact from Sentiment: A Dynamic Conflict-Consensus Framework for Multimodal Fake News Detection

区分事实与情感:一种动态冲突-共识框架用于多模态虚假新闻检测

Weilin Zhou, Zonghao Ying, Junjie Mu, Shengwei Tian, Quanchen Zou, Deyue Zhang, Dongdong Yang, Xiangzheng Zhang

机构 * Xinjiang University(新疆大学) AI Security Lab(360AI安全实验室) Beihang University(北航) South China University of Technology(华南理工大学) Fudan University(复旦大学) Shenzhen University(深圳大学)

AI总结 本文提出动态冲突-共识框架,通过区分事实与情感空间,利用物理启发式特征动态和冲突-共识机制,提升多模态虚假新闻检测的准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08674 2025-12-24 cs.AI cs.MA

Multi-Agent Intelligence for Multidisciplinary Decision-Making in Gastrointestinal Oncology

多智能体智能在胃肠肿瘤多学科决策中的应用

Rongzhao Zhang, Junqiao Wang, Shuyun Yang, Mouxiao Bian, Chihao Zhang, Dongyang Wang, Qiujuan Yan, Yun Zhong, Yuwei Bai, Guanxu Zhu, Kangkun Mao, Miao Wang, Chao Ding, Renjie Lu, Lei Wang, Lei Zheng, Tao Zheng, Xi Wang, Zhuo Fan, Bing Han, Meiling Liu, Luyi Jiang, Dongming Shan, Wenzhong Jin, Jiwei Yu, Zheng Wang, Jie Xu, Meng Luo

机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Shanghai Ninth People’s Hospital, Shanghai Jiao Tong University School of Medicine(上海第九人民医院,上海交通大学医学院) Renji Hospital, Shanghai Jiao Tong University School of Medicine(仁济医院,上海交通大学医学院) Shanghai Institute of Infectious Disease and Biosecurity, Fudan University(上海市传染病防治研究所暨生物安全研究所,复旦大学) Shanghai Health Development Research Center (Shanghai Medical Information Center)(上海市卫生健康发展研究中心(上海市医疗信息中心)) Shanghai Kupas Technology Co., Ltd.(上海库帕斯科技有限公司)

AI总结 本文提出基于多智能体的框架,用于提升胃肠肿瘤多学科决策的自动化支持,通过模拟多学科团队协作,提高推理逻辑和医疗准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19043 2025-12-23 cs.RO

EGM: Efficiently Learning General Motion Tracking Policy for High Dynamic Humanoid Whole-Body Control

EGM: 为高动态人形全身体控高效学习通用运动跟踪策略

Chao Yang, Yingkai Sun, Peng Ye, Xin Chen, Chong Yu, Tao Chen

机构 * Shanghai Innovation Institute(上海创新研究院) College of Future Information Technology, Fudan University(复旦大学未来信息科技学院) College of Intelligent Robotics and Advanced Manufacturing, Fudan University(复旦大学智能机器人与先进制造学院) The Chinese University of Hong Kong(香港中文大学) ByteDance(字节跳动)

AI总结 EGM通过高效学习通用运动跟踪策略,提升高动态人形全身体控的鲁棒性和泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18766 2025-12-23 cs.CV

MaskFocus: Focusing Policy Optimization on Critical Steps for Masked Image Generation

MaskFocus: 为掩码图像生成聚焦策略优化

Guohui Zhang, Hu Yu, Xiaoxiao Ma, Yaning Pan, Hang Xu, Feng Zhao

机构 * University of Science and Technology of China(中国科学技术大学) Fudan University(复旦大学)

AI总结 MaskFocus通过聚焦关键步骤优化策略,提升掩码图像生成模型的性能。

Comments Code is available at https://github.com/zghhui/MaskFocus

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18706 2025-12-23 cs.SD

X-Talk: On the Underestimated Potential of Modular Speech-to-Speech Dialogue System

X-Talk:模块化语音到语音对话系统的被低估潜力

Zhanxun Liu, Yifan Duan, Mengmeng Wang, Pengchao Feng, Haotian Zhang, Xiaoyu Xing, Yijia Shan, Haina Zhu, Yuhang Dai, Chaochao Lu, Xipeng Qiu, Lei Xie, Lan Wang, Nan Yan, Zilong Zheng, Ziyang Ma, Kai Yu, Xie Chen

机构 * MoE Key Lab of Artificial Intelligence, X-LANCE Lab, Shanghai Jiao Tong University(人工智能基础理论重点实验室,X-LANCE实验室,上海交通大学) Shanghai Innovation Institute(上海创新研究院) Shanghai AI Laboratory(上海人工智能实验室) State Key Laboratory of General Artificial Intelligence, BIGAI(通用人工智能国家重点实验室,BIGAI) Audio, Speech and Language Processing Group, Northwestern Polytechnical University(语音与语言处理组,西北工业大学) Fudan University(复旦大学) Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences(深圳先进技术研究院,中国科学院)

AI总结 X-Talk通过模块化设计和流水线优化,提升语音到语音对话系统的性能与灵活性,展示其在复杂语音任务中的潜力。

Comments 14 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18635 2025-12-23 cs.CV

Uni-Neur2Img: Unified Neural Signal-Guided Image Generation, Editing, and Stylization via Diffusion Transformers

Uni-Neur2Img:通过扩散变换器实现神经信号引导的图像生成、编辑和风格化

Xiyue Bai, Ronghao Yu, Jia Xiu, Pengfei Zhou, Jie Xia, Peng Ji

机构 * Fudan University(复旦大学) Zhejiang University(浙江大学) National University of Singapore(新加坡国立大学)

AI总结 Uni-Neur2Img通过扩散变换器实现神经信号引导的图像生成、编辑和风格化,提供统一且高效的解决方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.07651 2025-12-23 cs.CV

Liver Fibrosis Quantification and Analysis: The LiQA Dataset and Baseline Method

肝脏纤维化量化与分析:LiQA数据集及基线方法

Yuanye Liu, Hanxiao Zhang, Jiyao Liu, Nannan Shi, Yuxin Shi, Arif Mahmood, Murtaza Taj, Xiahai Zhuang

机构 * School of Data Science, Fudan University(复旦大学数据科学学院) Institute of Medical Robotics, Shanghai Jiao Tong University(上海交通大学医疗机器人研究院) Institute of Science and Technology for Brain-Inspired Intelligence, Fudan University(复旦大学脑启发智能科学技术研究院) Department of Radiology, Shanghai Public Health Clinical Center(上海公共卫生临床中心放射科) Department of Computer Science, Information Technology University(信息技术大学计算机科学系) Department of Computer Science, Lahore University of Management Sciences(拉合尔管理科学大学计算机科学系)

AI总结 本文提出LiQA数据集及基线方法,用于肝脏纤维化量化与分析,通过半监督学习和多视图共识方法提升分割与分期的鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.03198 2025-12-23 q-bio.NC cs.LG

SimSort: A Data-Driven Framework for Spike Sorting by Large-Scale Electrophysiology Simulation

SimSort:一种基于大规模电生理模拟的尖峰分拣数据驱动框架

Yimu Zhang, Dongqi Han, Yansen Wang, Zhenning Lv, Yu Gu, Dongsheng Li

机构 * Fudan University(复旦大学) Microsoft Research Asia(微软亚洲研究院)

AI总结 SimSort通过大规模电生理模拟数据预训练,实现了在真实尖峰分拣任务中的零样本泛化,提升了尖峰分拣的鲁棒性和可扩展性。

Journal ref 39th Conference on Neural Information Processing Systems (NeurIPS 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16900 2025-12-19 cs.CV

FlashPortrait: 6x Faster Infinite Portrait Animation with Adaptive Latent Prediction

FlashPortrait: 6倍更快的无限人物动画生成

Shuyuan Tu, Yueming Pan, Yinming Huang, Xintong Han, Zhen Xing, Qi Dai, Kai Qiu, Chong Luo, Zuxuan Wu

机构 * Fudan University(复旦大学) Microsoft Research Asia(微软亚洲研究院) Xi’an Jiaotong University(西安交通大学) Tencent Inc.(腾讯公司) Tongyi Lab, Alibaba Group(阿里云通义实验室)

AI总结 FlashPortrait通过归一化面部表情块和动态滑动窗口方案,实现6倍加速的无限长人物动画生成,保持身份一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16650 2025-12-19 cs.AI cs.CR

Prefix Probing: Lightweight Harmful Content Detection for Large Language Models

前缀探查:用于大型语言模型的轻量有害内容检测

Jirui Yang, Hengqi Guo, Zhihui Lu, Yi Zhao, Yuansen Zhang, Shijing Hu, Qiang Duan, Yinggui Wang, Tao Wei

机构 * Fudan University(复旦大学) Ant Group(蚂蚁集团) Pennsylvania State University(宾夕法尼亚州立大学)

AI总结 Prefix Probing通过高效前缀探查实现轻量有害内容检测,在保持检测效果的同时大幅降低计算成本和部署需求。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.15705 2025-12-19 cs.CV

GeoVista: Web-Augmented Agentic Visual Reasoning for Geolocalization

GeoVista: 基于网络增强的代理视觉推理用于地理定位

Yikun Wang, Zuyan Liu, Ziyi Wang, Han Hu, Pengfei Liu, Yongming Rao

机构 * Fudan University(复旦大学) Tencent Hunyuan(腾讯文元) Tsinghua University(清华大学) Shanghai Innovation Institute(上海创新研究院)

AI总结 GeoVista通过整合图像缩放和网络搜索工具,提升地理定位任务的代理模型性能,实现优于开源模型的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16409 2025-12-19 cs.LG

Geometric Laplace Neural Operator

几何拉普拉斯神经算子

Hao Tang, Jiongyu Zhu, Zimeng Feng, Hao Li, Chao Li

机构 * University of Dundee(邓迪大学) Fudan University(复旦大学) University of Cambridge(剑桥大学)

AI总结 本文提出几何拉普拉斯神经算子,通过引入拉普拉斯谱表示和网格不变网络架构,实现了在任意黎曼流形上高效求解偏微分方程和常微分方程的能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14711 2025-12-18 cs.SI cs.AI

Promoting Fairness in Information Access within Social Networks

在社交网络中促进信息访问的公平性

Changan Liu, Xiaotian Zhou, Ahad N. Zehmakan, Zhongzhi Zhang

机构 * College of Computer Science and Artificial Intelligence(计算机科学与人工智能学院) Fudan University(复旦大学) Australian National University(澳大利亚国立大学)

AI总结 本文提出了一种线性时间算法,用于在社交网络中通过添加连接来提升不同群体间信息访问的公平性。

Comments Accepted by ICDE 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.09677 2025-12-18 cs.CV cs.AI

Benchmarking Gaslighting Negation Attacks Against Reasoning Models

对抗性否定攻击下推理模型的基准测试

Bin Zhu, Hailong Yin, Jingjing Chen, Yu-Gang Jiang

机构 * Singapore Management University, Singapore College of Computer Science(新加坡国立管理学院计算机科学学院) Artificial Intelligence, Fudan University, China(人工智能,复旦大学)

AI总结 本文评估了三种顶级推理模型在对抗性否定攻击下的表现,发现其准确率显著下降,并提出了GaslightingBench-R基准以进一步研究模型对这类攻击的防御能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06112 2025-12-17 cs.RO cs.AI cs.CV

WAM-Flow: Parallel Coarse-to-Fine Motion Planning via Discrete Flow Matching for Autonomous Driving

WAM-Flow:通过离散流匹配实现自动驾驶的并行粗到细路径规划

Yifang Xu, Jiahao Cui, Feipeng Cai, Zhihao Zhu, Hanlin Shang, Shan Luan, Mingwang Xu, Neng Zhang, Yaoyi Li, Jia Cai, Siyu Zhu

机构 * Fudan University(复旦大学) Yinwang Intelligent Technology Co., Ltd(英伟达智能科技有限公司)

AI总结 WAM-Flow通过离散流匹配实现自动驾驶的并行粗到细路径规划,结合几何感知目标和并行生成,提升闭环性能。

Comments 18 pages, 11 figures. Code & Model: https://github.com/fudan-generative-vision/WAM-Flow

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13735 2025-12-17 cs.LG cs.AI

DARTs: A Dual-Path Robust Framework for Anomaly Detection in High-Dimensional Multivariate Time Series

DARTs:一种用于高维多变量时间序列异常检测的双路径稳健框架

Xuechun Liu, Heli Sun, Xuecheng Wu, Ruichen Cao, Yunyun Shi, Dingkang Yang, Haoran Li

机构 * Xi’an Jiaotong University, School of Computer Science and Technology(西安交通大学计算机科学与技术学院) Fudan University, College of Intelligent Robotics and Advanced Manufacturing(复旦大学智能机器人与先进制造学院)

AI总结 DARTs通过双路径框架和窗口感知机制,提升高维多变量时间序列异常检测的鲁棒性和准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13708 2025-12-17 cs.LG

Variational Physics-Informed Ansatz for Reconstructing Hidden Interaction Networks from Steady States

变分物理信息假设法用于从稳态重构隐藏相互作用网络

Kaiming Luo

机构 * School of Information Science and Technology, Fudan University(信息科学与技术学院,复旦大学)

AI总结 本文提出变分物理信息假设法,通过稳态数据重构复杂相互作用网络,无需时间轨迹或监督,适用于仅能获取快照观测的场景。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11872 2025-12-17 cs.RO cs.AI cs.CV

WAM-Diff: A Masked Diffusion VLA Framework with MoE and Online Reinforcement Learning for Autonomous Driving

WAM-Diff: 一种结合MoE和在线强化学习的掩码扩散VLA框架用于自动驾驶

Mingwang Xu, Jiahao Cui, Feipeng Cai, Hanlin Shang, Zhihao Zhu, Shan Luan, Yifang Xu, Neng Zhang, Yaoyi Li, Jia Cai, Siyu Zhu

机构 * Fudan University(复旦大学) Yinwang Intelligent Technology Co., Ltd(云网智能科技有限公司)

AI总结 WAM-Diff通过结合MoE和在线强化学习的掩码扩散框架,提升自动驾驶轨迹生成的性能与灵活性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.17116 2025-12-17 cs.AI

MCTS-EP: Empowering Embodied Planning with Online Preference Optimization

MCTS-EP:通过在线偏好优化增强具身规划

Hang Xu, Zang Yu, Yehui Tang, Pengbo Hu, Yuhao Tang, Hao Dong

机构 * School of Management, Fudan University, Shanghai, China(复旦大学管理学院) Independent Researcher(独立研究者) CFCS, School of Computer Science, Peking University, Beijing, China(计算机科学系,北京大学) PKU-AgiBot Lab, Peking University, Beijing, China(北京大学)

AI总结 MCTS-EP通过结合大语言模型与蒙特卡洛树搜索,实现具身智能体的在线偏好优化,提升多模态任务的性能表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13290 2025-12-16 cs.CV cs.AI cs.LG

LINA: Learning INterventions Adaptively for Physical Alignment and Generalization in Diffusion Models

LINA: 为扩散模型中的物理对齐和泛化学习适应性干预

Shu Yu, Chaochao Lu

机构 * Shanghai AI Laboratory(上海人工智能实验室) Shanghai Innovation Institute(上海创新研究院) Fudan University(复旦大学)

AI总结 LINA通过学习适应性干预,提升扩散模型在物理对齐和超出分布指令跟随方面的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13072 2025-12-16 cs.CV

Forging a Dynamic Memory: Retrieval-Guided Continual Learning for Generalist Medical Foundation Models

锻造动态记忆:基于检索的持续学习用于通用医学基础模型

Zizhi Chen, Yizhen Gao, Minghao Han, Yizhou Liu, Zhaoyu Chen, Dingkang Yang, Lihua Zhang

机构 * College of Intelligent Robotics and Advanced Manufacturing(智能机器人与先进制造学院) Fudan University(复旦大学) Fysics Intelligence Technologies Co., Ltd. (Fysics AI)(Fysics智能技术有限公司(Fysics AI)) School of Computer Science and Engineering(计算机科学与工程学院) Central South University(中南大学)

AI总结 本文提出基于检索的持续学习方法,通过动态知识蒸馏和RAG技术,解决多模态医学模型在领域迁移和细粒度特征保留中的核心难题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.12756 2025-12-16 cs.CV

FysicsWorld: A Unified Full-Modality Benchmark for Any-to-Any Understanding, Generation, and Reasoning

FysicsWorld: 一个统一的全模态基准用于任意到任意的理解、生成和推理

Yue Jiang, Dingkang Yang, Minghao Han, Jinghang Han, Zizhi Chen, Yizhou Liu, Mingcheng Li, Peng Zhai, Lihua Zhang

机构 * College of Intelligent Robotics and Advanced Manufacturing(智能机器人与先进制造学院) Fudan University(复旦大学) Fysics Intelligence Technologies Co., Ltd.(菲茨智能技术有限公司)

AI总结 FysicsWorld是一个统一的全模态基准,支持图像、视频、音频和文本之间的双向交互,通过16个主要任务和3,268个样本全面评估理解、生成和推理能力,揭示模型在多模态任务中的性能差异。

Comments The omni-modal benchmark report from Fysics AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.12272 2025-12-16 q-bio.QM cs.AI

Accurate de novo sequencing of the modified proteome with OmniNovo

利用OmniNovo实现修饰蛋白质组的准确从头测序

Yuhan Chen, Shang Qu, Zhiqiang Gao, Yuejin Yang, Xiang Zhang, Sheng Xu, Xinjie Mao, Liujia Qian, Jiaqi Wei, Zijie Qiu, Chenyu You, Lei Bai, Ning Ding, Tiannan Guo, Bowen Zhou, Siqi Sun

机构 * Shanghai Research Institute for Intelligent Autonomous Systems(上海智能自主系统研究所) Tongji University(同济大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Department of Electronic Engineering(电子工程系) Tsinghua University(清华大学) Research Institute of lntelligent Complex Systems(智能复杂系统研究所) Fudan University(复旦大学) University of British Columbia(不列颠哥伦比亚大学) School of Medicine(医学院) Westlake University(西湖大学) Shanghai Innovation Institute(上海创新研究院) Zhejiang University(浙江大学) Stony Brook University(石溪大学)

AI总结 OmniNovo通过统一深度学习框架实现对修饰蛋白质组的高精度从头测序,识别更多肽并提高假发现率控制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11047 2025-12-16 cs.RO cs.AI cs.CV

WholeBodyVLA: Towards Unified Latent VLA for Whole-Body Loco-Manipulation Control

WholeBodyVLA: 向统一的潜变量VLA迈进以实现全身体姿操控控制

Haoran Jiang, Jin Chen, Qingwen Bu, Li Chen, Modi Shi, Yanjie Zhang, Delong Li, Chuanzhe Suo, Chuang Wang, Zhihui Peng, Hongyang Li

机构 * Fudan University(复旦大学) OpenDriveLab & MMLab at The University of Hong Kong(香港大学开放驾驶实验室及多模态实验室) AgiBot(AgiBot公司) SII(SII研究所)

AI总结 WholeBodyVLA通过统一的潜变量学习框架和专门设计的强化学习策略,实现了大空间人形运动-操控的精准控制与高效泛化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08648 2025-12-16 cs.CV

Repulsor: Accelerating Generative Modeling with a Contrastive Memory Bank

Repulsor:利用对比记忆库加速生成建模

Shaofeng Zhang, Xuanqi Chen, Ning Liao, Haoxiang Zhao, Xiaoxing Wang, Haoru Tan, Sitong Wu, Xiaosong Jia, Qi Fan, Junchi Yan

机构 * School of Artificial Intelligence and Data Science, University of Science and Technology of China(人工智能与数据科学学院,中国科学技术大学) Shanghai Jiao Tong University(上海交通大学) HKU(香港大学) CUHK(香港大学) Fudan University(复旦大学) Nanjing University(南京大学)

AI总结 Repulsor通过对比记忆库机制,无需外部编码器,实现高效的生成建模,显著提升收敛速度和生成质量。

Comments 19 pages, 19 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12793 2025-12-16 cs.CV

ViCO: A Training Strategy towards Semantic Aware Dynamic High-Resolution

ViCO: 一种面向语义感知动态高分辨率的训练策略

Long Cui, Weiyun Wang, Jie Shao, Zichen Wen, Gen Luo, Linfeng Zhang, Yanting Zhang, Yu Qiao, Wenhai Wang

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Fudan University(复旦大学) Nanjing University(南京大学) Donghua University(东华大学) The Chinese University of Hong Kong(香港中文大学)

AI总结 ViCO通过动态调整视觉标记数量以适应图像语义复杂度,有效降低推理成本的同时保持模型性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.03761 2025-12-16 cs.CL

Pet-Bench: Benchmarking the Abilities of Large Language Models as E-Pets in Social Network Services

Pet-Bench: 评估大型语言模型作为社交网络服务中电子宠物的能力基准

Hongcheng Guo, Zheyong Xie, Shaosheng Cao, Boyang Wang, Weiting Liu, Zheyu Ye, Zhoujun Li, Zuozhu Liu, Wei Lu

机构 * Fudan University(复旦大学) Xiaohongshu Inc.(小红书公司) Beihang University(北航) Zhejiang University(浙江大学) Singapore University of Technology and Design(新加坡科技设计大学)

AI总结 Pet-Bench是一个评估大型语言模型作为电子宠物在社交网络服务中能力的基准测试,通过多样化的任务和7500多个互动实例,评估模型在自我进化和人际互动方面的表现,揭示模型大小和能力对性能的影响,推动情感沉浸式人-宠物互动的发展。

详情

展开后加载摘要…

URL PDF HTML 收藏