arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

The Hong Kong University of Science and Technology(香港科技大学)

共收录 2796
2601.01955 2026-04-08 cs.CV

MotionAdapter: Video Motion Transfer via Content-Aware Attention Customization

MotionAdapter: 通过内容感知注意力定制实现视频动作迁移

Zhexin Zhang, Yangyang Xu, Yifeng Zhu, Long Chen, Yong Du, Shengfeng He, Jun Yu

机构 * Hangzhou Dianzi University(杭州电子科技大学) Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳)) The Hong Kong University of Science and Technology(香港科技大学) Ocean University of China(中国海洋大学) Singapore Management University(新加坡管理大学)

AI总结 本文提出MotionAdapter框架,通过解耦动作与外观并自适应定制动作,实现DiT视频扩散模型中的稳健动作迁移,实验表明其在质量和定量评估中优于现有方法,支持复杂动作迁移与编辑。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04642 2026-04-07 cs.RO

WaterSplat-SLAM: Photorealistic Monocular SLAM in Underwater Environment

WaterSplat-SLAM:水下环境中的光实单目SLAM

Kangxu Wang, Shaofeng Zou, Chenxing Jiang, Yixiang Dai, Siang Chen, Shaojie Shen, Guijin Wang

机构 * Department of Electronic Engineering, Tsinghua University(清华大学电子工程系) Key Laboratory of Marine Robotics, Shenyang(沈阳海洋机器人重点实验室) University of Chinese Academy of Sciences(中国科学院大学) Department of Electronic and Computer Engineering, The Hong Kong University of Science and Technology(香港科技大学电子及计算机工程学系)

AI总结 本文提出WaterSplat-SLAM,通过语义介质过滤和语义引导渲染实现水下高保真密集映射,提升水下单目SLAM的鲁棒性与可视化效果。

Comments 8 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04603 2026-04-07 cs.DB cs.AI

Cardinality Estimation for High Dimensional Similarity Queries with Adaptive Bucket Probing

高维相似性查询中卡数估计的自适应桶探针方法

Zhonghan Chen, Qintian Guo, Ruiyuan Zhang, Xiaofang Zhou

机构 * The Hong Kong University of Science and Technology(香港科技大学) Hong Kong Generative AI Research and Development Center (HKGAI)(香港生成式人工智能研发中心(HKGAI))

AI总结 本文提出一种轻量级框架,利用LSH分区和自适应桶探针技术,结合渐进采样和不对称距离计算,提升高维相似性查询的卡数估计精度和在线效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04573 2026-04-07 cs.ET cs.LG

SAIL: Scene-aware Adaptive Iterative Learning for Long-Tail Trajectory Prediction in Autonomous Vehicles

SAIL:面向场景的自适应迭代学习用于自动驾驶车辆的长尾轨迹预测

Bin Rao, Haicheng Liao, Chengyue Wang, Keqiang Li, Zhenning Li, Hai Yang

机构 * State Key Laboratory of Internet of Things for Smart City and Department of Civil and Environmental Engineering, University of Macau(澳门大学智慧城市物联网国家重点实验室及土木与环境工程系) State Key Laboratory of Internet of Things for Smart City and Department of Computer and Information Science, University of Macau(澳门大学智慧城市物联网国家重点实验室及计算机与信息科学系) Department of Automotive Engineering, Tsinghua University(清华大学汽车工程系) State Key Laboratory of Internet of Things for Smart City and Departments of Civil and Environmental Engineering and Computer and Information Science, University of Macau(澳门大学智慧城市物联网国家重点实验室及土木与环境工程系和计算机与信息科学系) Department of Civil and Environmental Engineering, The Hong Kong University of Science and Technology(香港科技大学土木与环境工程系)

AI总结 本文提出SAIL框架,通过定义和建模轨迹的三个关键属性维度,结合属性引导增强与自适应对比学习策略,提升自动驾驶车辆在长尾场景下的轨迹预测性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04475 2026-04-07 cs.LG cs.AI

Discrete Prototypical Memories for Federated Time Series Foundation Models

联邦时间序列基础模型的离散原型记忆

Liwei Deng, Qingxiang Liu, Xinhe Niu, Shengchao Chen, Sheng Sun, Yuankai Wu, Guodong Long, Yuxuan Liang

机构 * Australian Artificial Intelligence Institute, University of Technology Sydney(澳大利亚人工智能研究所,悉尼科技大学) The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Shenzhen University(深圳大学) Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) Sichuan University(四川大学)

AI总结 本文提出FeDPM框架,通过离散原型记忆解决联邦学习中时间序列数据与文本空间语义不匹配的问题,提升模型泛化能力与效率。

Comments 13 pages,5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04383 2026-04-07 cs.AI cs.MA math.OC

Optimizing Service Operations via LLM-Powered Multi-Agent Simulation

通过LLM赋能的多智能体仿真优化服务运营

Yanyuan Wang, Xiaowei Zhang

机构 * Department of Industrial Engineering and Decision Analytics, The Hong Kong University of Science and Technology(香港科技大学工业工程与决策分析系)

AI总结 本文提出基于LLM的多智能体仿真框架,通过建模决策依赖的不确定性,优化服务运营的稳态性能,实验证明其在可持续供应链中的优越性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.06800 2026-04-07 cs.CL cs.AI cs.HC cs.MA

FURINA: A Fully Customizable Role-Playing Benchmark via Scalable Multi-Agent Collaboration Pipeline

FURINA:通过可扩展的多智能体协作流水线实现完全可定制的角色扮演基准

Haotian Wu, Shufan Jiang, Chios Chen, Yiyang Feng, Hehai Lin, Heqing Zou, Yao Shu, Chengwei Qin

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) The University of Hong Kong(香港大学) Stony Brook University(石溪大学) Nanyang Technological University(南洋理工大学) Datawhale Org.(Datawhale 组织) Independent Researcher(独立研究者)

AI总结 本文提出FURINA-Builder,一种可扩展的多智能体协作流水线,用于构建完全可定制的角色扮演基准。该基准支持多样化的场景和提示格式,通过智能体协作评估任意角色,并发现推理能力提升的同时 hallucinations 增加的新型权衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04017 2026-04-07 cs.CL

GeoBrowse: A Geolocation Benchmark for Agentic Tool Use with Expert-Annotated Reasoning Traces

GeoBrowse:一种用于代理工具使用的地理定位基准测试

Xinyu Geng, Yanjing Xiao, Yuyang Zhang, Hanwen Wang, Xinyan Liu, Rui Min, Tianqing Fang, Yi R. Fung

机构 * Hong Kong University of Science and Technology(香港科技大学)

AI总结 GeoBrowse基准测试结合了视觉推理与知识密集型多跳查询,通过专家标注的逐步轨迹分析验证多步工具使用策略的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03738 2026-04-07 cs.CV

Rethinking Position Embedding as a Context Controller for Multi-Reference and Multi-Shot Video Generation

重新思考位置嵌入作为多参考和多镜头视频生成的上下文控制器

Binyuan Huang, Yuning Lu, Weinan Jia, Hualiang Wang, Mu Liu, Daiqing Yang

机构 * Wuhan University(武汉大学) University of Science and Technology of China(中国科学技术大学) Hong Kong University of Science and Technology(香港科技大学) Tsinghua University(清华大学)

AI总结 本文提出PoCo方法,通过引入位置嵌入作为额外的上下文控制,解决多参考和多镜头视频生成中参考混淆问题,提升跨镜头一致性和参考保真度。

Comments Accepted to CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03660 2026-04-07 cs.AI

TableVision: A Large-Scale Benchmark for Spatially Grounded Reasoning over Complex Hierarchical Tables

TableVision:一种大规模基准,用于复杂分层表格上的空间感知推理

Xiaoyu Chen, Lu Dai, Hanqing Wang, Zhuoyu Li, Wenbin Dai, Yanzong Zheng, Zhenggang Xia, Junyong Lin, Hui Xiong

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) The Hong Kong University of Science and Technology(香港科技大学) The Chinese University of Hong Kong(香港中文大学) Shanghai Jiao Tong University(上海交通大学)

AI总结 本文提出TableVision基准,通过量化分析发现复杂表格推理中的感知瓶颈,引入轨迹感知的分层任务分类,结合确定性接地流程生成6799条高保真推理轨迹,提升多模态大语言模型的空间推理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03592 2026-04-07 cs.CL cs.AI

Unveiling Language Routing Isolation in Multilingual MoE Models for Interpretable Subnetwork Adaptation

揭示多语言MoE模型中的语言路由隔离以实现可解释的子网络适应

Kening Zheng, Wei-Chieh Huang, Jiahao Huo, Zhonghao Li, Henry Peng Zou, Yibo Yan, Xin Zou, Jungang Li, Junzhuo Li, Hanrong Zhang, Xuming Hu, Philip S. Yu

机构 * University of Illinois Chicago(伊利诺伊大学芝加哥分校) HKUST (Guangzhou)(香港科技大学(广州)) University of Maryland(马里兰大学)

AI总结 本文研究了多语言MoE模型中语言路由隔离现象,提出RISE框架通过识别和适应语言特定的专家子网络,提升低资源语言性能并保持其他语言能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03590 2026-04-07 cs.CV

SBF: An Effective Representation to Augment Skeleton for Video-based Human Action Recognition

SBF:一种有效的表示方法用于增强基于视频的人体动作识别的骨架

Zhuoxuan Peng, Yiyi Ding, Yang Lin, S. -H. Gary Chan

机构 * The Hong Kong University of Science and Technology(香港科技大学) The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))

AI总结 本文提出SBF表示方法,通过引入尺度图、人体图和流图来增强骨架信息,提升动作识别精度。

Comments Accepted by ABAW2026 (CVPR Workshop)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03462 2026-04-07 cs.CV cs.GR cs.RO

SpectralSplat: Appearance-Disentangled Feed-Forward Gaussian Splatting for Driving Scenes

SpectralSplat:面向驾驶场景的外观-解耦前馈高斯点云法

Quentin Herau, Tianshuo Xu, Depu Meng, Jiezhi Yang, Chensheng Peng, Spencer Sherk, Yihan Hu, Wei Zhan

机构 * Applied Intuition The Hong Kong University of Science and Technology(香港科技大学) University of California, Berkeley(加州大学伯克利分校)

AI总结 SpectralSplat通过前馈高斯点云法解耦场景几何与外观属性,提升驾驶场景的重建质量和可控外观迁移能力。

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03393 2026-04-07 cs.AI

TABQAWORLD: Optimizing Multimodal Reasoning for Multi-Turn Table Question Answering

TABQAWORLD: 优化多模态推理以实现多轮表格问答

Tung Sum Thomas Kwok, Xinyu Wang, Xiaofeng Lin, Peng Lu, Chunhe Wang, Changlun Li, Hanwei Wu, Nan Tang, Elisa Kreiss, Guang Cheng

机构 * University of California, Los Angeles(加州大学洛杉矶分校) McGill University(麦吉尔大学) Université de Montréal(蒙特利尔大学) The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) SimpleWay

AI总结 TABQAWORLD通过联合优化表格表示与估计,提升多轮表格问答的可靠性与效率,实现4.87%的准确率提升和33.35%的推理延迟降低。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03299 2026-04-07 cs.CV cs.AI

MoViD: View-Invariant 3D Human Pose Estimation via Motion-View Disentanglement

MoViD:通过运动-视角解耦实现视角不变的3D人体姿态估计

Yejia Liu, Hengle Jiang, Haoxian Liu, Runxi Huang, Xiaomin Ouyang

机构 * Department of Computer Science and Engineering, Hong Kong University of Science and Technology(香港科技大学计算机科学与工程系)

AI总结 本文提出MoViD框架,通过解耦视角信息与运动特征,提升3D人体姿态估计的鲁棒性和效率,实验表明其在九个公开数据集和新收集的多视角无人机及步态分析数据集上,姿态估计误差降低24.2%,在严重遮挡下仅需60%训练数据即可保持性能,且在NVIDIA边缘设备上实现实时推理15FPS。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03232 2026-04-07 cs.AI

IC3-Evolve: Proof-/Witness-Gated Offline LLM-Driven Heuristic Evolution for IC3 Hardware Model Checking

IC3-Evolve: 用于IC3硬件模型检查的自动离线LLM驱动启发式进化

Mingkai Miao, Guangyu Hu, Ziyi Yang, Hongce Zhang

机构 * Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Hong Kong University of Science and Technology(香港科技大学)

AI总结 IC3-Evolve通过离线LLM提出小范围修正,实现IC3硬件模型检查的自动优化,确保正确性验证下的启发式改进。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14507 2026-04-07 cs.CV

Expanding mmWave Datasets for Human Pose Estimation with Unlabeled Data and LiDAR Datasets

通过未标记数据和LiDAR数据扩展毫米波数据集用于人体姿态估计

Zhuoxuan Peng, Boan Zhu, Xingjian Zhang, Wenying Li, S. -H. Gary Chan

机构 * The Hong Kong University of Science and Technology(香港科技大学)

AI总结 本文提出EMDUL方法,利用未标记毫米波数据和LiDAR数据扩展现有数据集,提升人体姿态估计模型的性能和泛化能力,减少15.1%和18.9%的误差。

Comments Accepted by CVPR2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08392 2026-04-07 cs.RO cs.AI cs.CV

ST-BiBench: Benchmarking Multi-Stream Multimodal Coordination in Bimanual Embodied Tasks for MLLMs

ST-BiBench:多流多模态协调在双臂具身任务中的基准测试

Xin Wu, Zhixuan Liang, Yue Ma, Mengkang Hu, Zhiyuan Qin, Xiu Li

机构 * Tsinghua University(清华大学) The University of Hong Kong(香港大学) HKUST(香港科技大学) Beijing Innovation Center of Humanoid Robotics(北京人形机器人创新中心)

AI总结 本文提出ST-BiBench框架,用于评估多流多模态协调,揭示MLLMs在高阶策略与精细物理执行间的协调悖论。

Comments 42 pages, 9 figures. Project page:https://stbibench.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.07469 2026-04-07 cs.CV

VideoCoF: Unified Video Editing with Temporal Reasoner

VideoCoF:基于时间推理的统一视频编辑

Xiangpeng Yang, Ji Xie, Yiyuan Yang, Yue Ma, Yan Huang, Min Xu, Qiang Wu

机构 * University of Technology Sydney(悉尼科技大学) Zhejiang University(浙江大学) HKUST(香港科技大学)

AI总结 VideoCoF通过引入时间推理机制,解决视频编辑中精度与统一性的矛盾,实现无需掩码的精确区域映射和细粒度编辑,验证了方法的高效性与有效性。

Comments Accepted by CVPR 2026, Project Page: https://videocof.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14336 2026-04-07 cs.CV

ArchMap: Arch-Flattening and Knowledge-Guided Vision Language Model for Tooth Counting and Structured Dental Understanding

ArchMap:用于牙齿计数和结构牙科理解的拱形扁平化和知识引导的视觉语言模型

Bohan Zhang, Yiyi Miao, Taoyu Wu, Tong Chen, Ji Jiang, Zhuoxiao Li, Zhe Tang, Limin Yu, Jionglong Su

机构 * Xi'an Jiaotong-Liverpool University(西交利物浦大学) University of Liverpool(利物浦大学) Zhejiang University of Technology(浙江工业大学) The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))

AI总结 本文提出ArchMap,一种无需训练的知识引导框架,通过几何归一化和本体引导的多模态推理,提升3D口腔扫描的结构化分析能力,实现牙齿计数、解剖分区、牙列阶段分类及临床状况识别。

Journal ref In Proceedings of the 2025 IEEE International Conference on Big Data (BigData), pp. 7529-7538, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03098 2026-04-06 cs.LG cs.AI cs.CL

Co-Evolution of Policy and Internal Reward for Language Agents

语言代理中策略与内部奖励的共演化

Xinyu Wang, Hanwei Wu, Jingwei Song, Shuyuan Zhang, Jiayi Zhang, Fanqi Kong, Tung Sum Thomas Kwok, Xiao-Wen Chang, Yuyu Luo, Chenglin Wu, Bang Liu

机构 * McGill University(麦吉尔大学) McMaster University(麦克马斯特大学) The University of Hong Kong(香港大学) The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Peking University(北京大学) University of California, Los Angeles(加利福尼亚大学洛杉矶分校) DeepWisdom(深度智慧) Université de Montréal(蒙特利尔大学) Mila(米拉研究所)

AI总结 本文提出Self-Guide方法,通过自动生成内部奖励实现推理和训练时的协同优化,提升语言代理性能。

Comments 20 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02627 2026-04-06 cs.CV cs.AI cs.MM

Smart Transfer: Leveraging Vision Foundation Model for Rapid Building Damage Mapping with Post-Earthquake VHR Imagery

智能迁移:利用视觉基础模型实现地震后高分辨率影像快速建筑损坏映射

Hao Li, Liwei Zou, Wenping Yin, Gulsen Taskin, Naoto Yokoya, Danfeng Hong, Wufan Zhao

机构 * Department of Geography, National University of Singapore(新加坡国立大学地理系) Urban Governance and Design Thrust, The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)城市治理与设计学域) School of Environment and Spatial Informatics, China University of Mining and Technology(中国矿业大学环境与空间信息学院) Disaster Management Institute, Istanbul Technical University(伊斯坦布尔技术大学灾害管理研究所) Department of Complexity Science and Engineering, University of Tokyo(东京大学复杂科学与工程系) School of Automation, Southeast University(东南大学自动化学院)

AI总结 本文提出Smart Transfer框架,利用先进视觉基础模型实现快速建筑损坏映射,通过像素聚类和距离惩罚三元组策略提升跨区域迁移性能,为灾害响应提供可扩展的自动化解决方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01479 2026-04-06 cs.CV

UniRecGen: Unifying Multi-View 3D Reconstruction and Generation

UniRecGen:统一多视图3D重建与生成

Zhisheng Huang, Jiahao Chen, Cheng Lin, Chenyu Hu, Hanzhuo Huang, Zhengming Yu, Mengfei Li, Yuheng Liu, Zekai Gu, Zibo Zhao, Yuan Liu, Xin Li, Wenping Wang

机构 * Macau University of Science and Technology(澳门科技大学) Xidian University(西安电子科技大学) ShanghaiTech University(上海科技大学) Hong Kong University of Science and Technology(香港科技大学) University of California, Irvine(加利福尼亚大学尔湾分校)

AI总结 UniRecGen融合了高效重建与生成模型,通过共享空间协作学习提升多视图3D模型的完整性和一致性,实验显示其在稀疏观测下生成更精确稳定的3D模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00290 2026-04-06 cs.AI cs.MA

ClinicalReTrial: Clinical Trial Redesign with Self-Evolving Agents

临床试验重设计:具有自进化代理的临床试验重设计

Sixue Xing, Kerui Wu, Xuanye Xia, Meng Jiang, Jintai Chen, Tianfan Fu

机构 * University of Notre Dame(圣母大学) University of Massachusetts Amherst(马萨诸塞大学阿默斯特分校) Georgia Institute of Technology(佐治亚理工学院) Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Nanjing University(南京大学)

AI总结 本文提出ClinicalReTrial系统,通过自进化代理对临床试验协议进行迭代重设计,提升成功率并降低成本。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20139 2026-04-06 cs.SE cs.AI cs.CL

StructEval: Benchmarking LLMs' Capabilities to Generate Structural Outputs

StructEval: 对LLMs生成结构化输出能力的基准测试

Jialin Yang, Dongfu Jiang, Lipeng He, Sherman Siu, Yuxuan Zhang, Disen Liao, Zhuofeng Li, Huaye Zeng, Yiming Jia, Haozhe Wang, Benjamin Schneider, Chi Ruan, Wentao Ma, Zhiheng Lyu, Yifei Wang, Yi Lu, Quy Duc Do, Ziyan Jiang, Ping Nie, Wenhu Chen

机构 * University of Waterloo(滑铁卢大学) University of Toronto(多伦多大学) HKUST(香港科技大学) Shanghai University(上海大学) Independent Contributor(独立贡献者) Vector Institute(向量研究所) University of British Columbia(不列颠哥伦比亚大学)

AI总结 StructEval通过生成和转换任务评估LLMs生成JSON、YAML等结构化格式的能力,揭示了先进模型在结构正确性上的显著差距。

Comments 24 pages, 8 figures, 14 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.13024 2026-04-03 cs.LG math.OC

Fragility-aware Classification for Understanding Risk and Improving Generalization

面向脆弱性的分类:理解风险与提升泛化能力

Chen Yang, Zheng Cui, Daniel Zhuoyu Long, Jin Qi, Ruohan Zhan

机构 * School of Management, Zhejiang University(浙江大学管理学院) Department of Systems Engineering and Engineering Management, The Chinese University of Hong Kong(香港中文大学系统工程与工程管理系) Department of Industrial Engineering and Decision Analytics, Hong Kong University of Science and Technology(香港科技大学工业工程与决策分析系) Department of Marketing and Analytics, University College London(伦敦大学学院市场营销与分析系)

AI总结 本文提出Fragility Index作为新型性能指标,从风险规避角度评估分类器,通过鲁棒满足框架确保在分布不确定性下的鲁棒性,并开发可训练框架以直接优化FI,实验证明其能揭示误差尾部风险并提升决策质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01913 2026-04-03 cs.LG

The Rank and Gradient Lost in Non-stationarity: Sample Weight Decay for Mitigating Plasticity Loss in Reinforcement Learning

在非平稳性中排名和梯度的丧失:用于缓解强化学习中塑性丧失的样本权重衰减

Zihao Wu, Hongyao Tang, Yi Ma, Jiashun Liu, Yan Zheng, Jianye Hao

机构 * School of Computer Software, Tianjin University(天津大学计算机软件学院) International Joint Institute of Tianjin University, Fuzhou(天津大学福州国际联合学院) The Hong Kong University of Science and Technology(香港科技大学)

AI总结 本文从网络优化的理论视角研究了非平稳性导致的塑性丧失问题,通过分析数据分布和目标非平稳性,提出样本权重衰减方法以缓解梯度衰减,提升强化学习性能。

Comments ICLR

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01777 2026-04-03 cs.CV

GardenDesigner: Encoding Aesthetic Principles into Jiangnan Garden Construction via a Chain of Agents

GardenDesigner: 通过一系列智能体编码美学原则以指导江南园林建设

Mengtian Li, Fan Yang, Ruixue Xiong, Yiyan Fan, Zhifeng Xie, Zeyu Wang

机构 * Shanghai University(上海大学) Shanghai Engineering Research Center of Motion Picture Special Effects(上海电影特效工程技术研究中心) The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))

AI总结 本文提出GardenDesigner框架,通过智能体链编码江南园林建设的美学原则,结合地形分布和道路生成代理,实现快速生成多样化且美观的江南园林。

Comments CVPR 2026, Project page: https://monad-cube.github.io/GardenDesigner

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01762 2026-04-03 cs.LG cs.AI cs.CL cs.DC

FourierMoE: Fourier Mixture-of-Experts Adaptation of Large Language Models

FourierMoE:大型语言模型的傅里叶混合专家适应

Juyong Jiang, Fan Wang, Hong Qi, Sunghun Kim, Jing Tang

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))

AI总结 本文提出傅里叶MoE,通过频域分析提升大语言模型在多任务适应中的性能,采用频域适应方法减少参数开销,实验证明其在单任务和多任务场景中均优于基线方法。

Comments The first two authors contributed equally to this work; listing order is random

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01715 2026-04-03 cs.CV

SteerFlow: Steering Rectified Flows for Faithful Inversion-Based Image Editing

SteerFlow:通过修正流实现忠实的基于反向的图像编辑

Thinh Dao, Zhen Wang, Kien T. Pham, Long Chen

机构 * The Hong Kong University of Science and Technology(香港科技大学) VinUniversity

AI总结 SteerFlow通过引入隐式直线化求解器和轨迹插值,提升图像编辑的源保真度,实验表明其在FLUX.1-dev和Stable Diffusion 3.5 Medium上表现更优。

详情

展开后加载摘要…

URL PDF HTML 收藏