arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Zhejiang University(浙江大学)

共收录 2925
2208.14649 2026-04-23 cs.CV

DetailCLIP: Injecting Image Details into CLIP's Feature Space

DetailCLIP: 将图像细节注入CLIP的特征空间

Zilun Zhang, Cuifeng Shen, Yuan Shen, Xinyu Zhou, Huixin Xiong, Tiancheng Zhao, Jianwei Yin

机构 * Zhejiang University(浙江大学) Peking University(北京大学) Megvii(科大讯飞) Om AI Research(Om人工智能研究院) Binjiang Research Institute of Zhejiang University(浙江大学滨江研究院)

AI总结 本文提出DetailCLIP框架,通过生成高分辨率图像的单一特征表示,保留多尺度细节并共享CLIP的语义空间,提升遥感文本-图像检索性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20570 2026-04-23 cs.CV

Exploring Spatial Intelligence from a Generative Perspective

从生成视角探索空间智能

Muzhi Zhu, Shunyao Jiang, Huanyi Zheng, Zekai Luo, Hao Zhong, Anzhou Li, Kaijun Wang, Jintao Rong, Yang Liu, Hao Chen, Tao Lin, Chunhua Shen

机构 * Zhejiang University(浙江大学) State Key Laboratory of CAD & CG(计算机辅助设计与图形学国家重点实验室) Ant Group(蚂蚁集团) Westlake University(西湖大学) Zhejiang University of Technology(浙江工业大学)

AI总结 本文提出GSI-Bench,首个评估生成空间智能的基准,通过空间 grounded 图像编辑量化空间合规性与编辑保真度,实验表明生成训练可提升空间推理能力。

Comments Accepted by CVPR 2026. Project page: https://aim-uofa.github.io/GSI-Bench/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.19656 2026-04-22 cs.CL

Pause or Fabricate? Training Language Models for Grounded Reasoning

暂停或虚构?为基于事实的推理训练语言模型

Yiwen Qiu, Linjuan Wu, Yizhou Liu, Yuchen Yan, Jin Ma, Xu Tan, Yao Hu, Daoxin Zhang, Wenqi Zhang, Weiming Lu, Jun Xiao, Yongliang Shen

机构 * Zhejiang University(浙江大学) Tencent(腾讯) Xiaohongshu Inc.(小红书公司)

AI总结 本文提出GRIL框架,通过交互强化学习提升语言模型在不完整信息下的推理能力,显著提高前提检测并提升任务成功率。

Comments Code:https://github.com/ZJU-REAL/GRIL

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.19473 2026-04-22 cs.CV

TS-Attn: Temporal-wise Separable Attention for Multi-Event Video Generation

TS-Attn:多事件视频生成的时序可分离注意力

Hongyu Zhang, Yufan Deng, Zilin Pan, Peng-Tao Jiang, Bo Li, Qibin Hou, Zhiyang Dou, Zhen Dong, Daquan Zhou

机构 * Peking University(北京大学) Shenzhen Graduate School(深圳研究生院) Zhejiang University(浙江大学) Nankai University(南开大学) Massachusetts Institute of Technology(麻省理工学院) Nanjing University(南京大学) University of California, Santa Barbara(加州大学圣巴巴拉分校)

AI总结 本文提出TS-Attn机制,解决多事件视频生成中时序不一致与注意力冲突问题,提升生成质量,实验表明在两个数据集上效果显著。

Comments ICLR 2026, code available at: https://github.com/Hong-yu-Zhang/TS-Attn

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24803 2026-04-22 cs.LG cs.AI

TimeOmni-1: Incentivizing Complex Reasoning with Time Series in Large Language Models

TimeOmni-1:通过时间序列激励大型语言模型的复杂推理

Tong Guan, Zijie Meng, Dianqi Li, Shiyu Wang, Chao-Han Huck Yang, Qingsong Wen, Zuozhu Liu, Sabato Marco Siniscalchi, Ming Jin, Shirui Pan

机构 * Griffith University(格里菲斯大学) Zhejiang University(浙江大学) NVIDIA(英伟达) Squirrel Ai Learning University of Palermo(帕尔米奥大学) Norwegian University of Science and Technology(挪威科学技术大学)

AI总结 本文提出TimeOmni-1,首个统一推理模型,通过时间序列推理解决多样化现实问题,提升因果发现和有效响应率。

Comments Accepted by the 14th International Conference on Learning Representations (ICLR 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01959 2026-04-22 cs.CL

SitEmb-v1.5: Improved Context-Aware Dense Retrieval for Semantic Association and Long Story Comprehension

SitEmb-v1.5:改进的上下文感知密集检索用于语义关联和长故事理解

Junjie Wu, Jiangnan Li, Yuqing Li, Lemao Liu, Liyan Xu, Jiwei Li, Dit-Yan Yeung, Jie Zhou, Mo Yu

机构 * HKUST(香港科技大学) WeChat AI, Tencent(腾讯微信AI) IIE-CAS(国际 Institute 中国科学院) Zhejiang University(浙江大学)

AI总结 本文提出SitEmb模型,通过将短片段与更广的上下文窗口结合,提升长文档检索性能,实验表明其在书本情节检索任务中优于现有模型,且在多语言和下游任务中表现优异。

Comments ACL 2025 Main Conference. Our trained models can be downloaded from: https://huggingface.co/SituatedEmbedding

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.18871 2026-04-22 cs.CV cs.AI cs.CL

OmniGen2: Towards Instruction-Aligned Multimodal Generation

OmniGen2:面向指令对齐的多模态生成

Chenyuan Wu, Pengfei Zheng, Ruiran Yan, Shitao Xiao, Xin Luo, Yueze Wang, Wanli Li, Xiyan Jiang, Yexin Liu, Junjie Zhou, Ze Liu, Ziyi Xia, Chaofan Li, Haoge Deng, Jiahao Wang, Kun Luo, Bo Zhang, Defu Lian, Xinlong Wang, Zhongyuan Wang, Tiejun Huang, Zheng Liu

机构 * Beijing Academy of Artificial Intelligence(北京人工智能研究院) University of Science and Technology of China(中国科学技术大学) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) Zhejiang University(浙江大学)

AI总结 OmniGen2通过双解码路径和解耦图像分词器,实现文本和图像生成的统一解决方案,提升多模态生成任务的性能与一致性,同时提供开源模型和数据集支持。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.19009 2026-04-22 cs.LG cs.CV

Guiding Distribution Matching Distillation with Gradient-Based Reinforcement Learning

通过基于梯度的强化学习引导分布匹配蒸馏

Linwei Dong, Ruoyu Guo, Ge Bai, Zehuan Yuan, Yawei Luo, Changqing Zou

机构 * Zhejiang University(浙江大学) Bytedance Inc.(字节跳动公司) Zhejiang Lab(浙江实验室)

AI总结 本文提出GDMD框架,通过优先考虑蒸馏梯度而非原始像素输出来优化奖励机制,提升了少步生成的质量与稳定性,实验证明其在生成质量与人类偏好指标上均优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14726 2026-04-22 cs.LG cs.AI

Catching Every Ripple: Enhanced Anomaly Awareness via Dynamic Concept Adaptation

捕捉每一个涟漪:通过动态概念适应提升异常意识

Jiaqi Zhu, Shaofeng Cai, Jie Chen, Fang Deng, Beng Chin Ooi, Wenqiao Zhang

机构 * School of Automation and the National Key Laboratory of Autonomous Intelligent Unmanned Systems, Beijing Institute of Technology(自动化学院和自主智能无人系统国家重点实验室,北京理工大学) School of Computing, National University of Singapore(computing 学院,新加坡国立大学) Harbin Institute of Technology(哈尔滨工业大学) Digital Media Computing & Design Lab, Zhejiang University(数字媒体计算与设计实验室,浙江大学)

AI总结 本文提出DyMETER框架,通过动态概念适应机制提升在线异常检测的适应性与效率,采用超网络生成实例感知参数位移,并引入轻量级进化控制器和动态阈值优化模块以实现鲁棒和可解释的适应。

Comments Accepted by IEEE TPAMI

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03037 2026-04-22 cs.RO cs.AI cs.CV

ARM: Advantage Reward Modeling for Long-Horizon Manipulation

ARM:用于长 horizon 操控的优势奖励建模

Yiming Mao, Zixi Yu, Weixin Mao, Yinhao Li, Qirui Hu, Zihan Lan, Minzhao Zhu, Hua Chen

机构 * LimX Dynamics(LimX动力学) Beijing University of Posts and Telecommunications(北京邮电大学) Zhejiang University(浙江大学)

AI总结 本文提出ARM框架,通过三态标签策略提升长 horizon 操控任务的奖励建模,实现高效稳定的数据利用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18296 2026-04-22 cs.CL cs.AI cs.LG

Temp-R1: A Unified Autonomous Agent for Complex Temporal KGQA via Reverse Curriculum Reinforcement Learning

Temp-R1:通过反向课程强化学习实现复杂时间知识图谱问答的统一自主代理

Zhaoyan Gong, Zhiqiang Liu, Songze Li, Xiaoke Guo, Yuanxiang Liu, Xinle Deng, Zhizhen Liu, Lei Liang, Huajun Chen, Wen Zhang

机构 * Zhejiang University(浙江大学) Ant Group(蚂蚁集团) ZJU-Ant Group Joint Lab of Knowledge Graph(浙江大学-蚂蚁集团知识图谱联合实验室)

AI总结 本文提出Temp-R1,首个通过强化学习训练的时间知识图谱问答自主代理,通过扩展动作空间和反向课程学习提升复杂问题的推理能力,在MultiTQ和TimelineKGQA上取得最佳性能。

Comments ACL 2026 main

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.14324 2026-04-21 cs.CV cs.CL

DualToken: Towards Unifying Visual Understanding and Generation with Dual Visual Vocabularies

DualToken: 向通过双视觉词汇统一视觉理解和生成迈进

Wei Song, Yuran Wang, Zijia Song, Yadong Li, Zenan Zhou, Long Chen, Jianhua Xu, Jiaqi Wang, Kaicheng Yu

机构 * Zhejiang University(浙江大学) Shanghai Innovation Institute(上海创新研究院) Westlake University(西湖大学) Baichuan Inc.(北川科技) Peking University(北京大学) Xiaomi EV(小米电动车)

AI总结 DualToken通过双视觉词汇统一视觉理解和生成,解决了视觉理解和生成所需不同表示空间的挑战,提升了ImageNet上的重建质量和零样本准确率,并在下游任务中表现出色。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.18313 2026-04-21 cs.CV

Denoise and Align: Diffusion-Driven Foreground Knowledge Prompting for Open-Vocabulary Temporal Action Detection

去噪与对齐:基于扩散的前景知识提示用于开放词汇时序动作检测

Sa Zhu, Wanqian Zhang, Lin Wang, Jinchao Zhang, Cong Wang, Bo Li

机构 * Institute of Information Engineering, Chinese Academy of Sciences School of Cyber Security, University of Chinese Academy of Sciences State Key Laboratory of Cyberspace Security Defense Beijing China Institute of Information Engineering, Chinese Academy of Sciences Beijing China Hangzhou Dianzi University Hangzhou China Institute of Information Engineering, Chinese Academy of Sciences\ Key Laboratory of Cyberspace Security Defense Beijing China Engineering, Zhejiang University Hangzhou China Institute of Information Engineering, Chinese Academy of Sciences State Key Laboratory of Cyberspace Security Defense Beijing China Institute of Information Engineering, Chinese Academy of Sciences School of Cyber Security, University of Chinese Academy of Sciences State Key Laboratory of Cyberspace Security Defense Institute of Information Engineering, Chinese Academy of Sciences Hangzhou Dianzi University Institute of Information Engineering, Chinese Academy of Sciences\ Key Laboratory of Cyberspace Security Defense Engineering, Zhejiang University Institute of Information Engineering, Chinese Academy of Sciences State Key Laboratory of Cyberspace Security Defense

AI总结 本文提出DFAlign框架,通过扩散去噪生成前景知识,解决开放词汇时序动作检测中语义不平衡问题,提升动作相关片段的判别性。

Comments Accepted by SIGIR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11789 2026-04-21 cs.CV

LMMs Meet Object-Centric Vision: Understanding, Segmentation, Editing and Generation

LMMs 与以物体为中心的视觉:理解、分割、编辑和生成

Yuqian Yuan, Wenqiao Zhang, Juekai Lin, Yu Zhong, Mingjian Gao, Binhe Yu, Yunqi Cao, Wentong Li, Yueting Zhuang, Beng Chin Ooi

机构 * Zhejiang University(浙江大学) Nanjing University of Aeronautics and Astronautics(南京航空航天大学)

AI总结 本文探讨了LMMs与以物体为中心的视觉结合,总结了在理解、分割、编辑和生成方面的新进展,提出了开放挑战和未来方向。

Comments 38 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11698 2026-04-21 cs.LG

SpiralFormer: Looped Transformers Can Learn Hierarchical Dependencies via Multi-Resolution Recursion

SpiralFormer:通过多分辨率递归学习层次依赖的循环Transformer

Chengting Yu, Xiaobo Shu, Yadao Wang, Yizhen Zhang, Haoyi Wu, You Wu, Rujiao Long, Ziheng Chen, Yuchi Xu, Wenbo Su, Bo Zheng

机构 * Alibaba Group(阿里巴巴集团) Zhejiang University(浙江大学) ShanghaiTech University(上海科技大学)

AI总结 SpiralFormer通过多分辨率递归机制提升循环Transformer的参数和计算效率,实验证明其在不同模型规模下均优于传统递归和非递归基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04740 2026-04-21 cs.CL cs.AI

StealthGraph: Exposing Domain-Specific Risks in LLMs through Knowledge-Graph-Guided Harmful Prompt Generation

StealthGraph:通过知识图谱引导的有害提示生成暴露领域特定风险

Huawei Zheng, Xinqi Jiang, Sen Yang, Shouling Ji, Yingcai Wu, Dazhen Deng

机构 * School of Software Technology, Zhejiang University(浙江大学软件学院) College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院) State Key Lab of CAD&CG, Zhejiang University(浙江大学CAD&CG国家重点实验室)

AI总结 本文提出StealthGraph框架,通过知识图谱生成领域相关的隐式有害提示,解决领域知识转化为约束和提升提示隐式的挑战,推动LLM安全研究。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14582 2026-04-21 cs.CV

OmniZip: Audio-Guided Dynamic Token Compression for Fast Omnimodal Large Language Models

OmniZip:面向快速多模态大语言模型的音频引导动态令牌压缩

Keda Tao, Kele Shao, Bohan Yu, Weiqiang Wang, Jian liu, Huan Wang

机构 * Zhejiang University(浙江大学) Westlake University(西湖大学) Ant Group(蚂蚁集团) Shanghai Innovation Institute(上海创新研究院)

AI总结 本文提出OmniZip,一种无需训练的音频引导多模态令牌压缩框架,通过动态压缩音频视频令牌提升推理速度和内存效率,保持模型性能。

Comments [CVPR 2026] Code Link: https://github.com/KD-TAO/OmniZip

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07739 2026-04-21 cs.LG cs.AI

MeSH: Memory-as-State-Highways for Recursive Transformers

MeSH: 递归变换器的记忆作为状态高速公路

Chengting Yu, Xiaobo Shu, Yadao Wang, Yizhen Zhang, Haoyi Wu, Jiaang Li, Rujiao Long, Ziheng Chen, Yuchi Xu, Wenbo Su, Bo Zheng

机构 * Alibaba Group(阿里巴巴集团) Zhejiang University(浙江大学) ShanghaiTech University(上海科技大学)

AI总结 本文提出MeSH方案,通过外部化状态管理与轻量级路由解决递归变换器中的计算同质化和信息过载问题,提升模型性能。

Comments Accepted by ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.07160 2026-04-21 cs.CL

GeometryZero: Advancing Geometry Solving via Group Contrastive Policy Optimization

GeometryZero:通过群体对比策略优化推进几何求解

Yikun Wang, Yibin Wang, Dianyi Wang, Zimian Peng, Qipeng Guo, Dacheng Tao, Jiaqi Wang

机构 * Fudan University(复旦大学) Shanghai Innovation Institute(上海创新研究院) Zhejiang University(浙江大学) Shanghai AI Laboratory(上海人工智能实验室) Nanyang Technological University(南洋理工大学)

AI总结 本文提出GeometryZero,通过群体对比策略优化训练小型模型,实现高效的几何推理,实验表明其在Geometry3K和MathVista上优于RL基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17753 2026-04-21 cs.AI cs.CL cs.CV

Evolutionary Negative Module Pruning for Better LoRA Merging

进化式负模块剪枝以提升LoRA融合

Anda Cao, Zhuo Gou, Yi Wang, Kaixuan Chen, Yu Wang, Can Wang, Mingli Song, Jie Song

机构 * College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院) School of Software Technology, Zhejiang University(浙江大学软件学院) State Key Laboratory of Blockchain and Security, Zhejiang University(浙江大学区块链与安全国家重点实验室) Hangzhou High-Tech Zone (Binjiang) Institute of Blockchain and Data Security(杭州高新技术区(滨江)区块链与数据安全研究院)

AI总结 本文提出ENMP方法,通过进化搜索策略识别并排除LoRA融合中的负模块,提升多任务部署效率。

Comments Accepted to ACL 2026 (main conference)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17543 2026-04-21 cs.CL

PoliLegalLM: A Technical Report on a Large Language Model for Political and Legal Affairs

PoliLegalLM:政治与法律领域大型语言模型的技术报告

Yuting Huang, Yinghao Hu, Qian Xiao, Wenlin Zhong, Yiquan Wu, Taishi Zhou, Moke Chen, Changlong Sun, Kun Kuang, Fei Wu

机构 * Tongyi Lab, Alibaba Group(通义实验室,阿里巴巴集团) Zhejiang University(浙江大学) Zhejiang Zhengfa Xinxi Guanli Zhongxin(浙江正法信息警务中心)

AI总结 本文提出PoliLegalLM,通过统一训练框架提升法律知识和推理能力,针对法律领域挑战实现高性能表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17503 2026-04-21 cs.AI cs.MA

SkillGraph: Self-Evolving Multi-Agent Collaboration with Multimodal Graph Topology

SkillGraph: 基于多模态图拓扑的自进化多智能体协作

Zheng Nie, Ruolin Shen, Xinlei Yu, Bo Yin, Jiangning Zhang, Xiaobin Hu

机构 * National University of Singapore, Singapore(新加坡国立大学) Technical University of Munich, Munich, Germany(慕尼黑技术大学) Zhejiang University, China(浙江大学)

AI总结 SkillGraph通过联合进化智能体能力与通信拓扑,解决视觉多智能体系统中固定拓扑和静态推理能力的问题,提升协作效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17477 2026-04-21 cs.CV cs.LG

Unveiling Deepfakes: A Frequency-Aware Triple Branch Network for Deepfake Detection

揭开深度伪造:一种频率感知的三分支网络用于深度伪造检测

Qihao Shen, Jiaxing Xuan, Zhenguang Liu, Sifan Wu, Yutong Xie, Zhaoyan Ming, Yingying Jiao, kui Ren

机构 * State Key Laboratory of Blockchain and Data Security, Zhejiang University(区块链与数据安全国家重点实验室,浙江大学) College of Computer Science and Technology, Jilin University(吉林大学计算机科学与技术学院) State Grid Blockchain Technology (Beijing) Co., Ltd.(国家电网区块链技术(北京)有限公司) Hangzhou High-Tech Zone (Binjiang) Institute of Blockchain and Data Security(杭州高新技术区(滨江)区块链与数据安全研究院) Hangzhou City University(杭州城市学院) College of Computer Science and Technology, Zhejiang University of Technology(浙江工业大学计算机科学与技术学院)

AI总结 本文提出一种三分支网络,通过学习原始图像和不同频率通道重建图像的特征,结合频率特征分析,提升深度伪造检测的鲁棒性与泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04804 2026-04-21 cs.CL cs.AI cs.IR cs.LG cs.MA

SkillX: Automatically Constructing Skill Knowledge Bases for Agents

SkillX: 为智能体自动构建技能知识库

Chenxi Wang, Zhuoyun Yu, Xin Xie, Wuguannan Yao, Runnan Fang, Shuofei Qiao, Kexin Cao, Guozhou Zheng, Xiang Qi, Peng Zhang, Shumin Deng

机构 * Zhejiang University(浙江大学) Ant Digital Technologies, Ant Group(蚂蚁集团数字技术部)

AI总结 SkillX通过多级技能设计、迭代技能精炼和探索性技能扩展,构建可复用的技能知识库,提升智能体在长周期任务中的表现和泛化能力。

Comments Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15724 2026-04-21 cs.CV cs.AI

VideoThinker: Building Agentic VideoLLMs with LLM-Guided Tool Reasoning

VideoThinker:构建具有LLM引导工具推理的智能视频大语言模型

Chenglin Li, Qianglong Chen, Feng Han, Yikun Wang, Xingxi Yin, Yan Gong, Ruilin Li, Yin Zhang, Jiaqi Wang

机构 * Zhejiang University(浙江大学) Fudan University(复旦大学) Wuhan University(武汉大学) Shanghai AI Lab(上海人工智能实验室) Shanghai Innovation Institute(上海创新研究院)

AI总结 VideoThinker通过合成工具交互轨迹构建大规模视频与工具推理数据集,提升长视频理解能力,优于传统语言模型和视频模型基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08276 2026-04-21 cs.AI

ACE-Router: Generalizing History-Aware Routing from MCP Tools to the Agent Web

ACE-Router: 从MCP工具到智能体网络的历史感知路由泛化

Zhiyuan Yao, Zishan Xu, Yifu Guo, Zhiguang Han, Cheng Yang, Shuo Zhang, Weinan Zhang, Xingshan Zeng, Weiwen Liu

机构 * Zhejiang University(浙江大学) Shanghai Jiao Tong University(上海交通大学) Huawei Technologies Co. Ltd(华为技术有限公司) Sun Yat-sen University(中山大学) Nanyang Technological University(南洋理工大学) Hangzhou Dianzi University(杭州电子科技大学)

AI总结 本文提出ACE-Router,通过依赖丰富的候选图合成多轮轨迹,训练出动态上下文理解的路由器,实现在大规模生态系统中的精准导航,实验显示其在MCP-Universe和MCP-Mark基准上表现优异,具备泛化性和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03632 2026-04-21 eess.AS cs.AI cs.SD

ReStyle-TTS: Relative and Continuous Style Control for Zero-Shot Speech Synthesis

ReStyle-TTS:零样本语音合成中的相对和连续风格控制

Haitao Li, Chunxiang Jin, Chenglin Li, Wenhao Guan, Zhengxing Huang, Xie Chen

机构 * Zhejiang University(浙江大学) Shanghai Innovation Institute(上海创新研究院) Ant Group(蚂蚁集团) Xiamen University(厦门大学) Shanghai Jiao Tong University(上海交通大学)

AI总结 ReStyle-TTS通过Decoupled Classifier-Free Guidance和LoRAs实现连续且参考相关的风格控制,提升零样本语音合成的风格适应性与鲁棒性。

Comments ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.17795 2026-04-21 cs.CL cs.AI cs.LG cs.MA cs.SE

What Makes AI Research Replicable? Executable Knowledge Graphs as Scientific Knowledge Representations

什么使AI研究可重复?可执行知识图谱作为科学知识表示

Yujie Luo, Zhuoyun Yu, Xuehai Wang, Yuqi Zhu, Ningyu Zhang, Lanning Wei, Lun Du, Da Zheng, Huajun Chen

机构 * Zhejiang University(浙江大学) Ant Group(蚂蚁集团) Zhejiang University - Ant Group Joint Laboratory of Knowledge Graph(知识图谱联合实验室)

AI总结 本文提出可执行知识图谱(xKG),通过整合文献中的代码片段和技术洞察,提升AI研究的可重复性,实验显示其在PaperBench上性能提升显著。

Comments ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.11612 2026-04-21 cs.LG

Topology Structure Optimization of Reservoirs Using GLMY Homology

使用GLMY同调的 reservoirs 拓扑结构优化

Yu Chen, Shengwei Wang, Hongwei Lin

机构 * School of Mathematical Sciences, Zhejiang University(浙江大学数学科学学院) Polytechnic Institute of Zhejiang University(浙江大学 polytechnic 院)

AI总结 本文利用持久GLMY同调理论研究reservoirs拓扑结构,提出优化方法以提升性能,发现一维GLMY同调群与性能密切相关。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.11184 2026-04-21 cs.CL

Tailoring Diagnostic Modeling to Individual Learners: Personalized Distractor Generation via MCTS-Guided Reasoning Reconstruction

为个体学习者定制诊断建模:通过MCTS引导的推理重构实现个性化干扰项生成

Tao Wu, Jingyuan Chen, Wang Lin, Jian Zhan, Mengze Li, Fangzhou Jin, Min Zhang, Kun Kuang, Fei Wu

机构 * Zhejiang University(浙江大学) Hong Kong University of Science and Technology(香港科技大学) East China Normal University(华东师范大学)

AI总结 本文提出基于MCTS引导的推理重构方法,通过学生历史答题错误生成个性化干扰项,提升诊断效果,实验表明其在生成合理干扰项和适应群体设置方面表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏