arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Nanjing University(南京大学)

共收录 1177
2603.07078 2026-03-10 cs.AI cs.CL

CoTJudger: A Graph-Driven Framework for Automatic Evaluation of Chain-of-Thought Efficiency and Redundancy in LRMs

CoTJudger: 一种基于图的框架,用于自动评估链式推理效率和冗余性在LRMs中

Siyi Li, Jiajun Shi, Shiwen Ni, Ge Zhang, Shuaimin Li, Shijian Wang, Zhoufutu Wen, Yizhi Li, Hamid Alinejad-Rokny, Jiaheng Liu, Min Yang, Wenhao Huang

机构 * University of Science and Technology of China(科学技术大学) Shenzhen University of Advanced Technology(深圳先进技术大学) Shenzhen Institutes of Advanced Technology, CAS(深圳先进技术研究所,中国科学院) Southeast University(东南大学) Nanjing University(南京大学) Beihang University(北航) University of Manchester(曼彻斯特大学)

AI总结 CoTJudger通过构建依赖图提取最短有效路径,评估链式推理的效率与冗余,揭示模型中的冗余问题及失败模式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06766 2026-03-10 eess.IV cs.CV cs.MM

HiDE: Hierarchical Dictionary-Based Entropy Modeling for Learned Image Compression

HiDE:基于层次字典的熵建模用于学习图像压缩

Haoxuan Xiong, Yuanyuan Xu, Kun Zhu, Yiming Wang, Baoliu Ye

机构 * Hohai University(河海大学) Nanjing University of Aeronautics and Astronautics(南京航空航天大学) Nanjing Audit University(南京审计大学) Nanjing University(南京大学)

AI总结 HiDE通过层次字典结构和上下文感知参数估计器,提升学习图像压缩的压缩效率与性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.09486 2026-03-10 cs.CV cs.AI cs.MM

Video-EM: Event-Centric Episodic Memory for Long-Form Video Understanding

视频-EM:面向长视频理解的事件中心型片段记忆

Yun Wang, Long Zhang, Jingren Liu, Jiaqi Yan, Zhanjie Zhang, Jiahao Zheng, Ao Ma, Run Ling, Xun Yang, Dapeng Wu, Xiangyu Chen, Xuelong Li

机构 * City University of Hong Kong(香港城市大学) University of Science and Technology of China(中国科学技术大学) Tianjin University(天津大学) Nanjing University(南京大学) Zhejiang University(浙江大学) The Institute of Artificial Intelligence (TeleAI), China Telecom(中国电信人工智能研究所(TeleAI))

AI总结 Video-EM通过事件中心型片段记忆框架,将长视频问答转化为事件构建与记忆细化,提升长视频理解的连贯性与可靠性。

Comments 14 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11368 2026-03-09 cs.CV

LaxMotion: Rethinking Supervision Granularity for 3D Human Motion Generation

LaxMotion: 重新思考3D人体运动生成的监督粒度

Sheng Liu, Yuanzhi Liang, Sidan Du

机构 * Nanjing University, Nanjing, China(南京大学) TeleAI, Shanghai, China(TeleAI)

AI总结 LaxMotion通过放松监督粒度,以结构一致性代替精确坐标匹配,实现更高效且稳健的3D人体运动生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00204 2026-03-06 cs.CV

MorphAny3D: Unleashing the Power of Structured Latent in 3D Morphing

MorphAny3D: 解锁结构潜在力量在3D变形中的应用

Xiaokun Sun, Zeyu Cai, Hao Tang, Ying Tai, Jian Yang, Zhenyu Zhang

机构 * Nanjing University(南京大学) Peking University(北京大学)

AI总结 MorphAny3D通过结构潜在表示实现高质量3D变形,利用注意力机制生成合理变形序列,并支持解耦变形和3D风格迁移。

Comments Accepted by CVPR 2026; Project page: https://xiaokunsun.github.io/MorphAny3D.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04000 2026-03-05 cs.LG

On the Learnability of Offline Model-Based Optimization: A Ranking Perspective

关于离线模型驱动优化的可学习性:一种排序视角

Shen-Huan Lyu, Rong-Xi Tan, Ke Xue, Yi-Xiao He, Yu Huang, Qingfu Zhang, Chao Qian

机构 * Key Laboratory of Water Big Data Technology of Ministry of Water Resources, College of Computer Science and Software Engineering, Hohai University, Nanjing, China(水利部水大数据技术重点实验室,计算机科学与软件工程学院,河海大学,南京,中国) Department of Computer Science, City University of Hong Kong, Hong Kong, China(计算机科学系,香港城市大学,香港,中国) National Key Laboratory for Novel Software Technology, Nanjing University, Nanjing, China(新型软件技术国家实验室,南京大学,南京,中国) School of Artificial Intelligence and Information Technology, Nanjing University of Chinese Medicine, Nanjing, China(人工智能与信息技术学院,南京中医药大学,南京,中国)

AI总结 本文从排序视角研究离线模型驱动优化,提出基于排序的风险框架,揭示分布不匹配是主导误差,设计分布感知排序方法,实验证明优于现有方法并揭示其内在限制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03985 2026-03-05 cs.CV

RIVER: A Real-Time Interaction Benchmark for Video LLMs

RIVER:面向视频大语言模型的实时交互基准

Yansong Shi, Qingsong Zhao, Tianxiang Jiang, Xiangyu Zeng, Yi Wang, Limin Wang

机构 * School of Information Science And Technology, University of Science and Technology of China(信息科学与技术学院,中国科学技术大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) College of Computer Science and Artificial Intelligence, Fudan University(计算机科学与人工智能学院,复旦大学) State Key Lab of Novel Software Technology, Nanjing University(新型软件技术国家重点实验室,南京大学)

AI总结 RIVER基准通过引入实时交互任务框架,改进视频大语言模型的实时交互能力,提升长期记忆与未来感知表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03781 2026-03-05 cs.AI

LifeBench: A Benchmark for Long-Horizon Multi-Source Memory

LifeBench: 一个用于长周期多源记忆的基准

Zihao Cheng, Weixin Wang, Yu Zhao, Ziyang Ren, Jiaxuan Chen, Ruiyang Xu, Shuai Huang, Yang Chen, Guowei Li, Mengshi Wang, Yi Xie, Ren Zhu, Zeren Jiang, Keda Lu, Yihong Li, Xiaoliang Wang, Liwei Liu, Cam-Tu Nguyen

机构 * Institute for Clarity in Documentation(清晰文档研究所) Inria Paris-Rocquencourt(巴黎-罗克琴库特研究所) Rajiv Gandhi University(拉贾夫·甘地大学) Tsinghua University(清华大学) Palmer Research Laboratories(帕勒尔研究实验室) State Key Laboratory for Novel Software Technology, Nanjing University(新型软件技术国家重点实验室,南京大学) School of Artificial Intelligence, Nanjing University(人工智能学院,南京大学) Huawei Technologies Co., Ltd.(华为技术有限公司)

AI总结 Lifebench是一个用于长周期多源记忆的基准,通过密集连接的长周期事件模拟,推动AI代理在多样且时间延长的上下文中整合声明性和非声明性记忆推理。

Comments A total of 28 pages, 8 pages of main text, and 15 figures and tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16957 2026-03-05 cs.CV

MatPedia: A Universal Generative Foundation for High-Fidelity Material Synthesis

MatPedia: 一种通用生成基础,用于高保真材料合成

Di Luo, Shuhui Yang, Mingxin Yang, Jiawei Lu, Yixuan Tang, Xintong Han, Zhuo Chen, Beibei Wang, Chunchao Guo

机构 * Nankai University(南开大学) Tencent Hunyuan(腾讯文言) Xi’an Jiaotong University(西安交通大学) Nanjing University(南京大学)

AI总结 MatPedia是一种基于联合RGB-PBR表示的生成模型,能够统一处理多种材料生成任务,实现高质量的高保真材料合成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.19655 2026-03-05 cs.RO

LaViRA: Language-Vision-Robot Actions Translation for Zero-Shot Vision Language Navigation in Continuous Environments

LaViRA: 语言-视觉-机器人动作翻译用于连续环境中的零样本视觉语言导航

Hongyu Ding, Ziming Xu, Yudong Fang, You Wu, Zixuan Chen, Jieqi Shi, Jing Huo, Yifan Zhang, Yang Gao

机构 * School of Computer Science, Nanjing University(南京大学计算机科学学院) School of Intelligence Science and Technology, Nanjing University(南京大学智能科学与技术学院) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) University of Chinese Academy of Sciences(中国科学院大学)

AI总结 LaViRA通过分解动作层次结构,利用多模态大语言模型的优势,实现连续环境中零样本视觉语言导航的高效导航与泛化能力。

Comments ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22580 2026-03-05 cs.LG

The Lie of the Average: How Class Incremental Learning Evaluation Deceives You?

平均的谎言:如何使类增量学习评估欺骗你?

Guannan Lai, Da-Wei Zhou, Xin Yang, Han-Jia Ye

机构 * School of Artificial Intelligence, Nanjing University(人工智能学院,南京大学) National Key Laboratory for Novel Software Technology, Nanjing University(新型软件技术国家实验室,南京大学) School of Computing and Artificial Intelligence, Southwestern University of Finance and Economics(计算与人工智能学院,西南财经大学)

AI总结 本文提出EDGE评估协议,通过任务间相似性自适应识别极值序列,更准确地评估类增量学习的性能分布。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03293 2026-03-05 cs.CL

SE-Search: Self-Evolving Search Agent via Memory and Dense Reward

SE-Search: 通过记忆和密集奖励实现的自进化搜索代理

Jian Li, Yizhang Jin, Dongqi Liu, Hang Ding, Jiafu Wu, Dongsheng Chen, Yunhang Shen, Yulei Qin, Ying Tai, Chengjie Wang, Xiaotong Yuan, Yabiao Wang

机构 * Nanjing University(南京大学) Tencent YoutuLab(腾讯优图实验室)

AI总结 SE-Search通过记忆净化、原子查询训练和密集奖励提升搜索效率,优于现有基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03007 2026-03-04 cs.LG cs.DC

Breaking the Prototype Bias Loop: Confidence-Aware Federated Contrastive Learning for Highly Imbalanced Clients

打破原型偏见循环:面向高度不平衡客户端的置信度感知联邦对比学习

Tian-Shuang Wu, Shen-Huan Lyu, Ning Chen, Yi-Xiao He, Bing Tang, Baoliu Ye, Qingfu Zhang

机构 * Key Laboratory of Water Big Data Technology of Ministry of Water Resources, College of Computer Science and Software Engineering, Hohai University, Nanjing, China(水利部水大数据技术重点实验室,计算机科学与软件工程学院,河海大学,南京,中国) Department of Computer Science, City University of Hong Kong, Hong Kong, China(计算机科学系,香港城市大学,香港,中国) State Key Laboratory for Novel Software Technology, Nanjing University, Nanjing, China(新型软件技术国家重点实验室,南京大学,南京,中国) School of Artificial Intelligence and Information Technology, Nanjing University of Chinese Medicine, Nanjing, China(人工智能与信息技术学院,南京中医药大学,南京,中国)

AI总结 本研究提出CAFedCL框架,通过置信度感知聚合和生成增强等方法,解决联邦学习中因数据不平衡和异质性导致的原型偏见问题,提升模型准确性和客户端公平性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02802 2026-03-04 cs.CV

NOVA: Sparse Control, Dense Synthesis for Pair-Free Video Editing

NOVA:无配对视频编辑的稀疏控制与密集合成

Tianlin Pan, Jiayi Dai, Chenpu Yuan, Zhengyao Lv, Binxin Yang, Hubery Yin, Chen Li, Jing Lyu, Caifeng Shan, Chenyang Si

机构 * Nanjing University(南京大学) University of Chinese Academy of Sciences(中国科学院大学) WeChat, Tencent(微信、腾讯) The University of Hong Kong(香港大学)

AI总结 NOVA提出了一种无配对视频编辑框架,通过稀疏控制与密集合成提升编辑保真度和时间一致性。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02213 2026-03-04 cs.LG

Quantized SO(3)-Equivariant Graph Neural Networks for Efficient Molecular Property Prediction

量化SO(3)等价图神经网络用于高效分子性质预测

Haoyu Zhou, Ping Xue, Hao Zhang, Tianfan Fu

机构 * Suzhou Lab(苏州实验室) Nanjing University(南京大学)

AI总结 本文提出量化SO(3)等价图神经网络方法,通过低比特量化技术提升分子性质预测的效率,实现准确性和效率的平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01048 2026-03-03 cs.SE cs.AI

RepoRepair: Leveraging Code Documentation for Repository-Level Automated Program Repair

RepoRepair: 利用代码文档实现仓库级别的自动程序修复

Zhongqiang Pan, Chuanyi Li, Wenkang Zhong, Yi Feng, Bin Luo, Vincent Ng

机构 * State Key Laboratory for Novel Software Technology, Nanjing University(新型软件技术国家重点实验室,南京大学) Human Language Technology Research Institute, University of Texas at Dallas(人机语言技术研究院,德克萨斯大学达拉斯分校)

AI总结 RepoRepair通过生成代码文档增强LLM能力,实现仓库级别的自动程序修复,取得高修复率和低成本的优异表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19473 2026-03-03 cs.LG cs.AI

WavefrontDiffusion: Dynamic Decoding Schedule for Improved Reasoning

WavefrontDiffusion: 动态解码调度以提升推理性能

Haojin Yang, Rui Hu, Zequn Sun, Rui Zhou, Yujun Cai, Yiwei Wang

机构 * School of Software and Microelectronics, Peking University(北京大学软件与微电子学院) State Key Laboratory for Novel Software Technology, Nanjing University(南京大学软件新技术国家重点实验室) The University of Queensland(昆士兰大学) University of California, Merced(加州大学梅尔德分校)

AI总结 WavefrontDiffusion通过动态解码调度提升推理和代码生成的性能与语义连贯性。

Comments 19 pages. 3 figures

Journal ref ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.09285 2026-03-03 cs.CV

Spotlight on Token Perception for Multimodal Reinforcement Learning

多模态强化学习中的token感知聚焦

Siyuan Huang, Xiaoye Qu, Yafu Li, Yun Luo, Zefeng He, Daizong Liu, Yu Cheng

机构 * Shanghai AI Laboratory(上海人工智能实验室) Shanghai Jiao Tong University(上海交通大学) The Chinese University of Hong Kong(香港中文大学) Nanjing University(南京大学) Wuhan University(武汉大学)

AI总结 本文提出VPPO算法,通过token感知优化提升多模态强化学习的视觉推理能力。

Comments Accepted by ICLR 2026, project page: https://github.com/huaixuheqing/VPPO-RL

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07638 2026-03-03 cs.LG

Data Selection for LLM Alignment Using Fine-Grained Preferences

利用细粒度偏好进行LLM对齐的数据选择

Jia Zhang, Yao Liu, Chen-Xi Zhang, Yi Liu, Yi-Xuan Jin, Lan-Zhe Guo, Yu-Feng Li

机构 * National Key Laboratory for Novel Software Technology, Nanjing University(南京大学新型软件技术国家重点实验室) School of Artificial Intelligence, Nanjing University(南京大学人工智能学院) Algorithm Tech, Taobao & Tmall Group of Alibaba(阿里巴巴集团算法技术部) School of Intelligence Science and Technology, Nanjing University(南京大学智能科学与技术学院)

AI总结 本文提出了一种基于细粒度偏好的数据选择方法,通过优化偏好分歧来提升LLM对齐效果,实验表明在少量数据下也能实现显著改进。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.18991 2026-03-03 cs.CL cs.AI cs.LG

Inverse Reinforcement Learning with Dynamic Reward Scaling for LLM Alignment

逆强化学习与动态奖励缩放用于大语言模型对齐

Ruoxi Cheng, Haoxuan Ma, Weixin Wang, Ranjie Duan, Jiexi Liu, Xiaoshuang Jia, Simeng Qin, Xiaochun Cao, Yang Liu, Xiaojun Jia

机构 * Beijing Electronic Science and Technology Institute(北京电子科技学院) Alibaba Group(阿里巴巴集团) Nanjing University(南京大学) Duke University(杜克大学) BraneMatrix AI Renmin University of China(中国人民大学) Northeast University(东北大学) Nanyang Technological University(南洋理工大学) Zhejiang Lab(浙江实验室) Sun Yat-sen University(中山大学)

AI总结 DR-IRL通过动态奖励缩放和逆强化学习提升大语言模型的安全对齐性能,有效解决数据不平衡和静态奖励模型的局限性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.15483 2026-03-03 cs.LG cond-mat.mtrl-sci

MoMa: A Modular Deep Learning Framework for Material Property Prediction

MoMa:一种用于材料属性预测的模块化深度学习框架

Botian Wang, Yawen Ouyang, Yaohui Li, Mianzhi Pan, Yuanhang Tang, Yiqun Wang, Haorui Cui, Jianbing Zhang, Xiaonan Wang, Wei-Ying Ma, Hao Zhou

机构 * Institute for AI Industry Research (AIR), Tsinghua University(人工智能产业研究院(AIR),清华大学) Department of Computer Science and Technology, Tsinghua University(计算机科学与技术系,清华大学) School of Artificial Intelligence, Nanjing University(人工智能学院,南京大学) Department of Chemical Engineering, Tsinghua University(化学工程系,清华大学)

AI总结 MoMa提出了一种模块化深度学习框架,通过训练专门模块并自适应组合以提升材料属性预测的性能,实验表明其在多个数据集上表现优异。

Comments Accepted to ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00881 2026-03-03 cs.CV

Uncertainty-Aware Concept and Motion Segmentation for Semi-Supervised Angiography Videos

面向半监督血管影像视频的不确定性感知概念与运动分割

Yu Luo, Guangyu Wei, Yangfan Li, Jieyu He, Yueming Lyu

机构 * School of Mathematical Sciences, Ocean University of China, China(中国海洋大学数学科学学院) School of Haide, Ocean University of China, China(中国海洋大学海德学院) School of Computer Science and Engineering, Central South University, China(中南大学计算机科学与工程学院) The Second Xiangya Hospital of Central South University, China(中南大学湘雅医院第二医院) School of Intelligent Science and Technology, Nanjing University, China(南京大学智能科学与技术学院)

AI总结 SMART通过结合运动感知一致性与渐进置信度正则化,实现X射线造影视频中冠状动脉主干的高效半监督分割,减少标注需求并提升分割性能。

Comments 10 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00466 2026-03-03 cs.CV

DreamWorld: Unified World Modeling in Video Generation

DreamWorld: 视频生成中的统一世界建模

Boming Tan, Xiangdong Zhang, Ning Liao, Yuqing Zhang, Shaofeng Zhang, Xue Yang, Qi Fan, Yanyong Zhang

机构 * University of Science(科学技术大学) Shanghai Jiao Tong University, Shanghai, China.(上海交通大学) Nanjing University, Suzhou, China.(南京大学)

AI总结 DreamWorld通过联合世界建模范式和约束退火技术,提升视频生成的世界一致性,优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00413 2026-03-03 cs.CV cs.GR

DiffTrans: Differentiable Geometry-Materials Decomposition for Reconstructing Transparent Objects

DiffTrans: 可微几何-材料分解用于重建透明物体

Changpu Li, Shuang Wu, Songlin Tang, Guangming Lu, Jun Yu, Wenjie Pei

机构 * Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) Peng Cheng Laboratory(鹏城实验室) Nanjing University(南京大学)

AI总结 DiffTrans通过可微渲染框架实现透明物体的高效几何-材料分解,适用于复杂场景中的高精度重建。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00412 2026-03-03 cs.CV

PointAlign: Feature-Level Alignment Regularization for 3D Vision-Language Models

PointAlign:用于3D视觉-语言模型的特征级对齐正则化

Yuanhao Su, Shaofeng Zhang, Xiaosong Jia, Qi Fan

机构 * University of Science and Technology of China(中国科学技术大学) Fuzhou University(福州大学) Fudan University(复旦大学) Nanjing University(南京大学)

AI总结 PointAlign通过特征级对齐正则化提升3D视觉-语言模型的几何信息保留与任务性能

Comments CVPR 2026 Accepted

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24302 2026-03-03 cs.CL

Lookahead Tree-Based Rollouts for Enhanced Trajectory-Level Exploration in Reinforcement Learning with Verifiable Rewards

基于前瞻树的rollouts用于增强强化学习中轨迹层面的探索

Shangyu Xing, Siyuan Wang, Chenyuan Yang, Xinyu Dai, Xiang Ren

机构 * Nanjing University(南京大学) University of Southern California(南加州大学) Fudan University(复旦大学)

AI总结 基于前瞻树的rollouts通过促进轨迹多样性提升强化学习中策略学习效率

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18866 2026-03-03 cs.CL cs.AI cs.CV cs.LG cs.MA

LightMem: Lightweight and Efficient Memory-Augmented Generation

LightMem: 轻量级和高效的内存增强生成

Jizhan Fang, Xinle Deng, Haoming Xu, Ziyan Jiang, Yuqi Tang, Ziwen Xu, Shumin Deng, Yunzhi Yao, Mengru Wang, Shuofei Qiao, Huajun Chen, Ningyu Zhang

机构 * Zhejiang University(浙江大学) National University of Singapore(新加坡国立大学) State Key Lab. for Novel Software Technology, Nanjing University, P.R. China(南京大学软件新技术国家重点实验室,中国)

AI总结 LightMem通过三阶段内存系统提升LLM在动态环境中的效率和性能,实现问答准确率提升和token使用减少。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10575 2026-03-03 cs.CV

UniFlow: A Unified Pixel Flow Tokenizer for Visual Understanding and Generation

UniFlow:一种统一的像素流标记器用于视觉理解和生成

Zhengrong Yue, Haiyu Zhang, Xiangyu Zeng, Boyu Chen, Chenting Wang, Shaobin Zhuang, Lu Dong, Yi Wang, Limin Wang, Yali Wang

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai AI Laboratory(上海人工智能实验室) Beihang University(北京航空航天大学) Shenzhen Key Lab of Computer Vision and Pattern Recognition, Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences(深圳计算机视觉与模式识别重点实验室,深圳先进技术研究院,中国科学院) Nanjing University(南京大学) University of Science and Technology of China(中国科学技术大学) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)

AI总结 UniFlow是一种统一的像素流标记器,通过灵活适配视觉编码器和轻量级解码器,在视觉理解和生成任务中实现了性能的双赢。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.02245 2026-03-03 cs.LG cs.AI cs.CL

ExGRPO: Learning to Reason from Experience

ExGRPO:从经验中学习推理

Runzhe Zhan, Yafu Li, Zhi Wang, Xiaoye Qu, Dongrui Liu, Jing Shao, Derek F. Wong, Yu Cheng

机构 * University of Macau(澳门大学) Shanghai AI Laboratory(上海人工智能实验室) Nanjing University(南京大学) The Chinese University of Hong Kong(香港中文大学)

AI总结 ExGRPO通过组织和优先处理有价值的经验,提升大语言模型的推理性能并稳定训练过程。

Comments ICLR 2026 Camera Ready version

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21278 2026-03-03 cs.CV cs.AI cs.LG

Does FLUX Already Know How to Perform Physically Plausible Image Composition?

FLUX 是否已经能够进行物理上合理的图像合成?

Shilin Lu, Zhuming Lian, Zihan Zhou, Shaocong Zhang, Chen Zhao, Adams Wai-Kin Kong

机构 * Nanyang Technological University(南洋理工大学) Nanjing University(南京大学)

AI总结 FLUX能否通过SHINE框架实现物理合理的图像合成,通过引入无训练框架和降质抑制指导,提升高保真度和背景完整性。

Comments Accepted by ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏