arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Harbin Institute of Technology(哈尔滨工业大学)

共收录 1439
2602.16193 2026-02-19 cs.LG cs.AI

Rethinking Input Domains in Physics-Informed Neural Networks via Geometric Compactification Mappings

重新思考物理信息神经网络中的输入域 via 几何紧致化映射

Zhenzhen Huang, Haoyu Bian, Jiaquan Zhang, Yibei Liu, Kuien Liu, Caiyan Qin, Guoqing Wang, Yang Yang, Chaoning Zhang

机构 * School of Information and Software Engineering, University of Electronic Science and Technology of China(信息与软件工程学院,电子科学与技术大学) Computer Science and Engineering, University of Electronic Science and Technology of China(计算机科学与工程,电子科学与技术大学) Institute of Software Chinese Academy of Sciences, Beijing, China(软件研究所,中国科学院北京) School of Robotics and Advanced Manufacture, Harbin Institute of Technology, Shenzhen, China(机器人与先进制造学院,哈尔滨工业大学深圳)

AI总结 本文提出GC-PINN框架,通过几何紧致化映射策略解决物理信息神经网络中输入域几何错位导致的收敛问题,提升训练稳定性与解精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15776 2026-02-18 cs.AI

GlobeDiff: State Diffusion Process for Partial Observability in Multi-Agent Systems

GlobeDiff:多智能体系统中部分可观测性的状态扩散过程

Yiqin Yang, Xu Yang, Yuhua Jiang, Ni Mu, Hao Hu, Runpeng Xie, Ziyou Zhang, Siyuan Li, Yuan-Hua Ni, Qianchuan Zhao, Bo Xu

机构 * The Key Laboratory of Cognition and Decision Intelligence for Complex Systems, Institute of Automation, Chinese Academy of Sciences(认知与决策智能复杂系统重点实验室,自动化研究所,中国科学院) Tsinghua University(清华大学) Moonshot AI Nankai University(南开大学) Faculty of Computing, Harbin Institute of Technology(哈尔滨工业大学计算机学院)

AI总结 GlobeDiff通过多模态扩散过程解决多智能体系统中部分可观测性问题,实现高保真度的全局状态推断。

Journal ref ICLR-2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15669 2026-02-18 cs.AI

PERSONA: Dynamic and Compositional Inference-Time Personality Control via Activation Vector Algebra

PERSONA:通过激活向量代数实现动态和组合性的人格控制

Xiachong Feng, Liang Zhao, Weihong Zhong, Yichong Huang, Yuxuan Gu, Lingpeng Kong, Xiaocheng Feng, Bing Qin

机构 * Harbin Institute of Technology(哈尔滨工业大学) The University of Hong Kong(香港大学)

AI总结 PERSONA通过激活向量代数实现动态人格控制,无需训练即可达到微调水平性能,并在多个基准测试中表现出色。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23607 2026-02-18 cs.GR cs.CV

ZeroScene: A Zero-Shot Framework for 3D Scene Generation from a Single Image and Controllable Texture Editing

ZeroScene: 一种基于单张图像的3D场景生成零样本框架及可控纹理编辑

Xiang Tang, Ruotong Li, Xiaopeng Fan

机构 * Harbin Institute of Technology, Shenzhen, China(哈尔滨工业大学(深圳)) Pengcheng Laboratory, China(鹏城实验室) Harbin Institute of Technology, China(哈尔滨工业大学) Harbin Institute of Technology, Suzhou Research Institute, China(哈尔滨工业大学苏州市研究院)

AI总结 ZeroScene通过零样本方法实现单图像3D场景生成与可控纹理编辑,结合大视觉模型先验知识,提升场景连贯性和渲染真实感。

Comments 16 pages, 15 figures, Eurographics 2026, Project page: https://xdlbw.github.io/ZeroScene/

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.14841 2026-02-18 cs.GR cs.CV

Towards Geometric and Textural Consistency 3D Scene Generation via Single Image-guided Model Generation and Layout Optimization

面向几何与纹理一致性的单图像引导模型生成与布局优化的3D场景生成

Xiang Tang, Ruotong Li, Xiaopeng Fan

机构 * Harbin Institute of Technology, Shenzhen(哈尔滨工业大学深圳分校) Peng Cheng Laboratory(鹏城实验室) Harbin Institute of Technology(哈尔滨工业大学) Harbin Institute of Technology, Suzhou Research Institute(哈尔滨工业大学苏州研究院)

AI总结 本文提出一种三阶段框架,通过单图像引导的模型生成和空间布局优化,实现具有高几何准确性和纹理保真的3D场景生成。

Comments 14 pages, 9 figures, Project page: https://xdlbw.github.io/sing3d/

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.12254 2026-02-18 cs.CV cs.AI cs.LG

MMS-VPR: Multimodal Street-Level Visual Place Recognition Dataset and Benchmark

MMS-VPR:多模态街道级视觉地点识别数据集和基准

Yiwei Ou, Xiaobin Ren, Ronggui Sun, Guansong Gao, Kaiqi Zhao, Manfredo Manfredini

机构 * The University of Auckland(奥克兰大学) Harbin Institute of Technology, Shenzhen(哈尔滨工业大学深圳校区)

AI总结 MMS-VPR提出一个大规模多模态数据集和基准,用于行人环境中的街道级视觉地点识别,整合了多模态数据和统一评估平台。

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14386 2026-02-17 cs.CL

Beyond Token-Level Policy Gradients for Complex Reasoning with Large Language Models

超越令牌级策略梯度:用于大语言模型复杂推理的多令牌策略梯度优化

Mufan Xu, Kehai Chen, Xuefeng Bai, Zhengyu Niu, Muyun Yang, Tiejun Zhao, Min Zhang

机构 * School of Computer Science and Technology, Harbin Institute of Technology, China(哈尔滨工业大学计算机科学与技术学院) Baidu Inc.(百度公司)

AI总结 本文提出MPO框架,通过多令牌级优化提升大语言模型在复杂推理任务中的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14186 2026-02-17 cs.CV

UniRef-Image-Edit: Towards Scalable and Consistent Multi-Reference Image Editing

UniRef-Image-Edit: 向可扩展和一致的多参考图像编辑迈进

Hongyang Wei, Bin Wen, Yancheng Long, Yankai Yang, Yuhang Hu, Tianke Zhang, Wei Chen, Haonan Fan, Kaiyu Jiang, Jiankang Chen, Changyi Liu, Kaiyu Tang, Haojie Ding, Xiao Yang, Jia Sun, Huaiqing Wang, Zhenyu Yang, Xinyu Wei, Xianglong He, Yangguang Li, Fan Yang, Tingting Gao, Lei Zhang, Guorui Zhou, Han Li

机构 * Tsinghua University(清华大学) Kuaishou Technology(快手科技) Hong Kong Polytechnic University(香港理工大学) Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) CUHK MMLab(香港中文大学MMLab)

AI总结 UniRef-Image-Edit通过统一的输入表示和两阶段训练框架,提升多参考图像编辑的一致性和保真度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14143 2026-02-17 cs.LG cs.CL

ROAST: Rollout-based On-distribution Activation Steering Technique

基于 rollout 的分布内激活引导技术:ROAST

Xuanbo Su, Hao Luo, Yingfang Zhang, Lijun Zhang

机构 * Bairong Inc.(柏隆公司) School of Mathematics, Harbin Institute of Technology(哈尔滨工业大学数学学院)

AI总结 ROAST 通过分布内 rollout 和连续软缩放技术提升大语言模型的推理性能,有效解决高幅度激活导致的引导方向不稳问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13818 2026-02-17 cs.CV cs.LG

VAR-3D: View-aware Auto-Regressive Model for Text-to-3D Generation via a 3D Tokenizer

VAR-3D: 基于视图感知的自回归模型用于文本到3D生成 via 3D标记器

Zongcheng Han, Dongyan Cao, Haoran Sun, Yu Hong

机构 * School of Computer Science and Technology(计算机科学与技术学院) Soochow University(苏州大学) Harbin Institute of Technology(哈尔滨工业大学)

AI总结 VAR-3D通过视图感知的3D标记器和渲染监督训练策略,提升文本到3D生成的质量和对齐性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13772 2026-02-17 cs.CV

Offline-Poly: A Polyhedral Framework For Offline 3D Multi-Object Tracking

Offline-Poly: 一种基于多边形框架的离线3D多目标跟踪

Xiaoyu Li, Yitao Wu, Xian Wu, Haolin Zhuo, Lijun Zhao, Lining Sun

机构 * State Key Laboratory of Robotics and System, Harbin Institute of Technology(机器人系统国家重点实验室,哈尔滨工业大学)

AI总结 Offline-Poly提出了一种基于跟踪-跟踪范式的通用离线3D多目标跟踪方法,通过离线优化提升跟踪精度,实现77.6% AMOTA和83.00% HOTA的优异性能。

Comments Based on this work, we achieved 1st place on the KITTI tracking leaderboard

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22920 2026-02-17 cs.CV

Q-Hawkeye: Reliable Visual Policy Optimization for Image Quality Assessment

Q-Hawkeye:用于图像质量评估的可靠视觉策略优化

Wulin Xie, Rui Dai, Ruidong Ding, Kaikui Liu, Xiangxiang Chu, Xinwen Hou, Jie Wen

机构 * Institute of Automation, Chinese Academy of Sciences, Beijing, China(中国科学院自动化研究所) University of Chinese Academy of Sciences, Beijing, China(中国科学院大学) Amap, Alibaba Group, Hangzhou, China(阿里云) Harbin Institute of Technology, Shenzhen, China(哈尔滨工业大学(深圳))

AI总结 Q-Hawkeye通过不确定性感知动态优化和感知感知优化提升图像质量评估的可靠性,实现更稳定的策略优化和更准确的质量判断。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07817 2026-02-17 cs.CV

PAGCNet: A Pose-Aware and Geometry Constrained Framework for Panoramic Depth Estimation

PAGCNet:一种具有姿态感知和几何约束的全景深度估计框架

Kanglin Ning, Ruzhao Chen, Penghong Wang, Xingtao Wang, Ruiqin Xiong, Xiaopeng Fan

机构 * Faculty of Computing, Harbin Institute of Technology(计算机学院,哈尔滨工业大学) Suzhou Research Institute of HIT(哈尔滨工业大学苏州研究院) Institute of Digital Media, School of Electronic Engineering and Computer Science, Peking University(数字媒体学院,北京大学电子工程与计算机科学学院) PengChengLab, Shenzhen(鹏城实验室,深圳)

AI总结 PAGCNet通过姿态感知和几何约束框架,有效解决复杂室内场景中全景深度估计的挑战,提升深度估计精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.12641 2026-02-17 cs.CV cs.AI

Single Image Reflection Separation via Dual Prior Interaction Transformer

单图像反射分离 via 双先验交互变换器

Yue Huang, Tianle Hu, Yu Chen, Zi'ang Li, Jie Wen, Xiaozhao Fang

机构 * School of Automation, Guangdong University of Technology(广东工业大学自动化学院) School of Computer Science and Technology, Guangdong University of Technology(广东工业大学计算机科学与技术学院) Shenzhen Key Laboratory of Visual Object Detection and Recognition, Harbin Institute of Technology(哈尔滨工业大学深圳视觉目标检测与识别重点实验室)

AI总结 本文提出双先验交互框架,通过轻量传输先验生成和有效先验融合,实现单图像反射分离的高性能表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13640 2026-02-17 cs.RO cs.AI

Hierarchical Audio-Visual-Proprioceptive Fusion for Precise Robotic Manipulation

层次化音频-视觉-本体感知融合用于精确机器人操作

Siyuan Li, Jiani Lu, Yu Song, Xianren Li, Bo An, Peng Liu

机构 * Harbin Institute of Technology, China(哈尔滨工业大学) Nanyang Technological University, Singapore(南洋理工大学)

AI总结 本文提出层次化多模态融合框架,通过整合音频、视觉和本体感知信息,提升机器人精确操作性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12919 2026-02-16 cs.CV cs.AI cs.NE

EPRBench: A High-Quality Benchmark Dataset for Event Stream Based Visual Place Recognition

EPRBench: 一种高质量的基于事件流的视觉位置识别基准数据集

Xiao Wang, Xingxing Xiong, Jinfeng Gao, Xufeng Lou, Bo Jiang, Si-bao Chen, Yaowei Wang, Yonghong Tian

机构 * School of Computer Science and Technology, Anhui University(安徽大学计算机科学与技术学院) Harbin Institute of Technology(哈尔滨工业大学) Peng Cheng Laboratory(鹏城实验室) School of Computer Science, Peking University(北京大学计算机科学学院) Shenzhen Graduate School, Peking University(北京大学深圳研究生院)

AI总结 EPRBench提出了一种高质量的基于事件流的视觉位置识别基准数据集,结合LLM生成场景描述与多模态融合方法,提升位置识别的准确性和模型透明度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.12685 2026-02-16 cs.CL cs.AI cs.LG

ToolACE-MT: Non-Autoregressive Generation for Agentic Multi-Turn Interaction

ToolACE-MT:非自回归生成用于代理多轮交互

Xingshan Zeng, Weiwen Liu, Lingzhi Wang, Liangyou Li, Fei Mi, Yasheng Wang, Lifeng Shang, Xin Jiang, Qun Liu

机构 * Huawei Technologies Co., Ltd(华为技术有限公司) Shanghai Jiao Tong University(上海交通大学) Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳))

AI总结 ToolACE-MT通过非自回归生成方法高效构建高质量多轮代理对话,解决传统自回归方法效率低下的问题。

Comments Accepted by ICLR2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12158 2026-02-13 cs.LG

SafeNeuron: Neuron-Level Safety Alignment for Large Language Models

SafeNeuron: 大语言模型的神经层面安全对齐

Zhaoxin Wang, Jiaming Liang, Fengbin Zhu, Weixiang Zhao, Junfeng Fang, Jiayi Ji, Handing Wang, Tat-Seng Chua

机构 * Xidian University, Xi'an, China(西安电子科技大学) Harbin Institute of Technology, Harbin, China(哈尔滨工业大学) National University of Singapore,Singapore(新加坡国立大学)

AI总结 SafeNeuron通过神经层面安全对齐框架提升模型鲁棒性,减少攻击风险并保持通用能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11980 2026-02-13 cs.CV

Spatial Chain-of-Thought: Bridging Understanding and Generation Models for Spatial Reasoning Generation

空间链式思考:连接理解与生成模型以实现空间推理生成

Wei Chen, Yancheng Long, Mingqiao Liu, Haojie Ding, Yankai Yang, Hongyang Wei, Yi-Fan Zhang, Bin Wen, Fan Yang, Tingting Gao, Han Li, Long Chen

机构 * The Hong Kong University of Science and Technology(香港科学与技术大学) Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) Tsinghua University(清华大学) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)

AI总结 本文提出SCoT框架,通过结合MLLMs的推理能力与扩散模型的生成能力,提升空间推理生成任务的性能。

Comments 19 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11636 2026-02-13 cs.CV cs.AI

ScalSelect: Scalable Training-Free Multimodal Data Selection for Efficient Visual Instruction Tuning

ScalSelect: 可扩展的无训练多模态数据选择用于高效的视觉指令微调

Changti Wu, Jiahuai Mao, Yuzhuo Miao, Shijie Lian, Bin Yu, Xiaopeng Lin, Cong Huang, Lei Zhang, Kai Chen

机构 * East China Normal University(华东师范大学) Zhongguancun Academy(中关村学院) The Hong Kong Polytechnic University(香港理工大学) Harbin Institute of Technology(哈尔滨工业大学) Huazhong University of Science and Technology(华中科技大学) The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Zhongguancun Institute of Artificial Intelligence(中关村人工智能研究院)

AI总结 ScalSelect提出一种无训练、可扩展的多模态数据选择方法,通过线性时间复杂度实现高效视觉指令微调,实验显示其性能接近甚至超越全数据训练。

Comments The code is available at \href{https://github.com/ChangtiWu/ScalSelect}{ScalSelect}

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11424 2026-02-13 cs.CL cs.AI cs.LG

Gradients Must Earn Their Influence: Unifying SFT with Generalized Entropic Objectives

梯度必须赢得其影响:统一监督微调与广义熵目标

Zecheng Wang, Deyuan Liu, Chunshan Li, Yupeng Zhang, Zhengyun Zhao, Dianhui Chu, Bingning Wang, Dianbo Sui

机构 * Harbin Institute of Technology(哈尔滨工业大学) WeChat, Tencent(微信、腾讯) Tsinghua University(清华大学)

AI总结 本文提出DEFT方法,通过广义熵目标统一SFT,解决塑性-稳定性困境,提升模型在探索与利用间的平衡性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10816 2026-02-12 cs.CL cs.AI

Beyond Confidence: The Rhythms of Reasoning in Generative Models

超越置信度:生成模型推理的节奏

Deyuan Liu, Zecheng Wang, Zhanyue Qin, Zhiying Tu, Dianhui Chu, Dianbo Sui

机构 * Harbin Institute of Technology(哈尔滨工业大学)

AI总结 本文提出δ_TC B度量标准,用于评估生成模型在预测稳定性方面的鲁棒性,揭示了传统度量在上下文学习中的不足,并为提升模型稳定性提供新方法。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10799 2026-02-12 cs.CV cs.AI

RSHallu: Dual-Mode Hallucination Evaluation for Remote-Sensing Multimodal Large Language Models with Domain-Tailored Mitigation

RSHallu: 远程传感多模态大语言模型的双模式幻觉评估与领域定制缓解

Zihui Zhou, Yong Feng, Yanying Chen, Guofan Duan, Zhenxi Song, Mingliang Zhou, Weijia Jia

机构 * College of Computer Science, Chongqing University(重庆大学计算机科学学院) Heavy Rainfall Research Center of China(中国强降水研究中心) CMA Key Open Laboratory of Transforming Climate Resources to Economy, Chongqing Institute of Meteorological Sciences(中国气象局气候资源转化经济重点开放实验室、重庆气象科学研究院) Chongqing Metropolitan College of Science(重庆科学理工学院) School of Intelligence Science(智能科学学院) College of Artificial Intelligence, Harbin Institute of Technology(人工智能学院、哈尔滨工业大学) BNU-UIC Institute of Artificial Intelligence(北京师范大学-国际学院人工智能与未来网络研究院) Future Networks, Beijing Normal University at Zhuhai(未来网络、北京师范大学珠海分校)

AI总结 RSHallu通过双模式检查和领域定制数据集,提升遥感多模态大语言模型的幻觉缓解效果,提高无幻觉率21.63个百分点。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06411 2026-02-11 cs.CL

Structured Episodic Event Memory

结构化事件记忆

Zhengxuan Lu, Dongfang Li, Yukun Shi, Beilun Wang, Longyue Wang, Baotian Hu

机构 * Southeast University(东南大学) Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳)) Shenzhen Loop Area Institute(深圳河套学院) Alibaba Group(阿里巴巴集团)

AI总结 SEEM通过结构化事件记忆框架提升自主代理的叙述连贯性和逻辑一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.10357 2026-02-11 cs.AI

Optimus-3: Dual-Router Aligned Mixture-of-Experts Agent with Dual-Granularity Reasoning-Aware Policy Optimization

Optimus-3: 具有双粒度推理感知策略优化的双路由对齐专家混合代理

Zaijing Li, Yuquan Xie, Rui Shao, Gongwei Chen, Weili Guan, Dongmei Jiang, Yaowei Wang, Liqiang Nie

机构 * School of Computer Science and Technology, Harbin Institute of Technology (Shenzhen Campus)(计算机科学与技术学院,哈尔滨工业大学(深圳校区)) Pengcheng Laboratory(鹏城实验室) School of Information Science and Technology, Harbin Institute of Technology (Shenzhen Campus)(信息科学与技术学院,哈尔滨工业大学(深圳校区)) Shenzhen Loop Area Institute(深圳河套学院)

AI总结 Optimus-3通过双路由对齐专家混合架构和双粒度推理感知策略优化,实现了系统1与系统2的协同,提升了开放性任务的解决能力。

Comments 16 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08679 2026-02-10 cs.LG cs.CR

Dashed Line Defense: Plug-And-Play Defense Against Adaptive Score-Based Query Attacks

虚线防御:对抗自适应分数查询攻击的即插即用防御

Yanzhang Fu, Zizheng Guo, Jizhou Luo

机构 * Harbin Institute of Technology(哈尔滨工业大学)

AI总结 本文提出Dashed Line Defense,一种即插即用的后处理方法,有效抵御自适应分数查询攻击,通过引入损失与对抗强度的模糊性,阻止攻击者适应策略,提升模型安全性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08548 2026-02-10 cs.CL

How Do Language Models Understand Tables? A Mechanistic Analysis of Cell Location

语言模型如何理解表格?对单元格定位的机制分析

Xuanliang Zhang, Dingzirui Wang, Keyan Xu, Qingfu Zhu, Wanxiang Che

机构 * Harbin Institute of Technology(哈尔滨工业大学)

AI总结 本研究通过分析语言模型处理表格的机制,揭示了单元格定位的三阶段流程,包括语义绑定、坐标定位和信息提取,并展示了模型如何通过离散分隔符计数和线性子空间编码实现表格理解。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08294 2026-02-10 cs.CL

When Does Context Help? Error Dynamics of Contextual Information in Large Language Models

何时上下文有助于?大型语言模型中上下文信息的误差动态

Dingzirui Wang, Xuanliang Zhang, Keyan Xu, Qingfu Zhu, Wanxiang Che, Yang Deng

机构 * Harbin Institute of Technology(哈尔滨工业大学) Singapore Management University(新加坡管理大学)

AI总结 本文提出统一理论框架,分析上下文信息对Transformer模型误差动态的影响,通过几何条件和范数约束揭示上下文校正的必要条件,并通过实验验证提升模型性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08230 2026-02-10 cs.CV cs.AI

Generating Adversarial Events: A Motion-Aware Point Cloud Framework

生成对抗事件:一种运动感知点云框架

Hongwei Ren, Youxin Jiang, Qifei Gu, Xiangqian Wu

机构 * Harbin Institute of Technology(哈尔滨理工大学)

AI总结 本文提出MA-ADV框架,通过点云表示生成对抗事件,解决事件表示非可微导致的对抗攻击难题,验证其在安全性和鲁棒性上的优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10152 2026-02-10 cs.CV

Color3D: Controllable and Consistent 3D Colorization with Personalized Colorizer

Color3D: 可控且一致的3D着色化方法,具有个性化着色器

Yecong Wan, Mingwen Shao, Renlong Wu, Wangmeng Zuo

机构 * Faculty of Computing, Harbin Institute of Technology(哈尔滨工业大学计算机学院) Harbin Institute of Technology Zhengzhou Research Institute(哈尔滨工业大学郑州研究所) Artificial Intelligence Research Institute, Shenzhen University of Advanced Technology(深圳先进技术大学人工智能研究所)

AI总结 Color3D通过个性化着色器实现可控且一致的3D着色化,提升动态和静态场景的色彩丰富度与用户可控性。

Comments ICLR 2026 Project Page https://yecongwan.github.io/Color3D/

详情

展开后加载摘要…

URL PDF HTML 收藏