arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-07-01 至 2026-07-01 共收录 28 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 28 篇

2606.30877 2026-07-01 eess.SY cs.LG cs.SY 新提交 92%

A Systematic Approach to Multi-Agent AI from Advanced Regulatory Control Theory: Safe and Auditable LLM Operator Agents for Process Control

基于先进调节控制理论的多智能体AI系统化方法:用于过程控制的安全且可审计的LLM操作员智能体

Idelfonso B. R. Nogueira, Sigurd Skogestad

机构 * Norwegian University of Science and Technology (NTNU)(挪威科技大学)

专题命中 指令微调 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 提出将先进调节控制理论映射为多智能体系统,每个反馈回路对应一个专业LLM操作员智能体,通过确定性或LLM编排器解决约束冲突,在奶牛场通风案例中实现可审计轨迹。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.10409 2026-07-01 cs.AR cs.AI 版本更新 92%

Dataset Construction for Training LLM to Learn Analog Circuit Knowledge

用于训练大语言模型学习模拟电路知识的数据集构建

Zihao Chen, Ji Zhuang, Jinyi Shen, Xiaoyue Ke, Xinyi Yang, Mingjie Zhou, Zhuoyao Du, Xu Yan, Zhouyang Wu, Zhenyu Xu, Jiangli Huang, Li Shang, Xuan Zeng, Fan Yang

机构 * Fudan University(复旦大学)

专题命中 指令微调 :LLM(title,abstract);SFT(summary_cn,abstract);large language model(abstract);language model(abstract)

AI总结 本文构建文本数据集并定制训练技术,使大语言模型学习模拟电路知识;通过多智能体框架生成结构化四元组,结合SFT与KL散度正则化提升性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16517 2026-07-01 cs.LG q-bio.QM 新提交 91%

How Post-Training Shapes Biological Reasoning Models

后训练如何塑造生物学推理模型

Lukas Fesser, Hanlin Zhang, Michelle M. Li, Eric Wang, Bryan Perozzi, Shekoofeh Azizi, Sham M. Kakade, Marinka Zitnik

机构 * Harvard University(哈佛大学) Google DeepMind(谷歌DeepMind) Google Research(谷歌研究院)

专题命中 指令微调 :SFT(summary_cn,abstract);post-training(title,abstract);language model(abstract);foundation model(abstract)

AI总结 研究后训练各阶段(CPT、SFT、RL)对生物学推理模型领域内和领域外性能的影响,发现SFT提升领域内性能但损害泛化,RL可部分恢复泛化,最佳策略是短SFT加长RL。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30899 2026-07-01 cs.CR cs.AI 新提交 89%

Curvature-Guided Module Localization for Low-Rank Detoxification of Backdoored Large Language Models

曲率引导的模块定位用于后门大语言模型的低秩解毒

Arash Raftari, Mehrdad Mahdavi, Nathan Blackthorn, Andrew Arash Mahyari

机构 * AIVault Inc.(AIVault公司)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract_cn);分类 cs.AI

AI总结 提出一种基于激活修补和Fisher/K-FAC曲率分析的机制引导权重空间修复框架,定位并低秩修复后门大语言模型中最有影响力的模块,有效抑制触发条件恶意行为同时保持良性性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.12341 2026-07-01 cs.CL cs.AI 版本更新 88%

Learning by Surprise: Adaptive Mitigation of Model Collapse in Large Language Models

通过惊喜学习:大型语言模型中模型崩溃的自适应缓解

Daniele Gambetta, Gizem Gezici, Fosca Giannotti, Dino Pedreschi, Alistair Knott, Luca Pappalardo

机构 * University of Pisa(比萨大学) ISTI-CNR(意大利国家研究委员会信息科学与技术研究所) Scuola Normale Superiore(比萨高等师范学校) Victoria University of Wellington(惠灵顿维多利亚大学)

专题命中 指令微调 :large language model(title);language model(title);LLM(abstract,abstract_cn);分类 cs.CL、cs.AI

AI总结 针对AI自噬导致的模型崩溃问题,提出基于困惑度的过滤策略,优先使用高惊喜文档进行微调,无需区分人写或AI生成内容,有效缓解崩溃并保持性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30943 2026-07-01 cs.CL 新提交 87%

Bridging Scientific Heritage: An Arabic--Russian Parallel Corpus and LLM Benchmark for Sustainable Knowledge Transfer

连接科学遗产:面向可持续知识转移的阿拉伯语-俄语平行语料库与LLM基准

M. K. Arabov

机构 * Kazan Federal University(喀山联邦大学)

专题命中 指令微调 :LLM(title,title_cn);language model(abstract);prompting(abstract);分类 cs.CL

AI总结 为解决阿拉伯语和俄语科学交流的语言障碍,构建了约2.7万句对的混合平行语料库,微调mT5、NLLB和Qwen2.5-7B模型,Qwen2.5-7B+QLoRA达到BLEU 23.15,推动跨语言知识转移与可持续发展。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30914 2026-07-01 cs.CL 新提交 86%

Beyond Clean Text: Evaluating Encoder and Decoder Robustness for Bangla Event Detection in Noisy Text

超越干净文本:评估编码器和解码器在孟加拉语噪声文本事件检测中的鲁棒性

Tanvir Ahmed Sijan, S. M Golam Rifat, Nayeemul Islam, Md. Musfique Anwar

机构 * Jahangirnagar University(贾汉吉尔纳加尔大学) Rajshahi University of Engineering & Technology(拉杰沙希工程技术大学) Bangladesh University of Engineering and Technology(孟加拉国工程技术大学)

专题命中 指令微调 :LLM(summary_cn,abstract_cn);large language model(abstract);language model(abstract);instruction tuning(abstract)

AI总结 针对孟加拉语事件检测在噪声文本中的鲁棒性问题,构建含9,979句标注的基准数据集,系统评估编码器模型(BanglaBERT、XLM-R)与解码器LLM(Llama 3、Gemma 3),发现解码器模型鲁棒性更强,而编码器模型在干净文本上表现更好但受噪声影响大。

Comments 17 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31166 2026-07-01 cs.CL cs.LG 新提交 86%

TAG-DLM: Diffusion Language Models for Text-Attributed Graph Learning

TAG-DLM:面向文本属性图学习的扩散语言模型

Lingjie Chen, Yuanchen Bei, Haobo Xu, Yanjun Zhao, Yuzhong Chen, Hanghang Tong

机构 * UIUC(伊利诺伊大学厄巴纳-香槟分校) VISA(VISA研究院)

专题命中 指令微调 :language model(title,abstract);LLM(abstract,abstract_cn);分类 cs.CL、cs.LG

AI总结 提出TAG-DLM方法,通过掩码扩散语言模型统一文本推理与图消息传递,线性化邻域并利用拓扑注意力掩码实现图结构注入,无需微调即可适应节点分类、链接预测等任务,性能优于现有基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31408 2026-07-01 cs.CR cs.OS 新提交 86%

EnclaveX: End-to-End Confidential AI with CPU/GPU TEEs

EnclaveX: 端到端机密AI与CPU/GPU TEE

Robert Schambach, Quoc Do Le, Sergei Arnautov, Christof Fetzer

专题命中 指令微调 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract)

AI总结 本文提出结合CPU和GPU TEE的端到端工作流,通过Intel TDX和AMD SEV-SNP等机制保障AI/LLM应用的机密性和完整性,并评估了性能开销。

Comments 8 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31846 2026-07-01 cs.RO cs.AI 新提交 84%

Z-1: Efficient Reinforcement Learning for Vision-Language-Action Models

Z-1: 面向视觉-语言-动作模型的高效强化学习

Lang Cao, Renhong Chen, Luyi Li, Peng Wang, Mofan Peng, Yitong Li

机构 * Zioneer Robot Team(Zioneer机器人团队)

专题命中 指令微调 :SFT(summary_cn,abstract);post-training(abstract);分类 cs.AI

AI总结 提出Z-1框架,结合共享前缀生成、树状轨迹分支、完成感知奖励校准和选择性联合训练,通过GRPO策略在24个RoboCasa任务上平均成功率80.6%,较SFT提升13.2%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25086 2026-07-01 cs.LG cs.AI stat.ML 新提交 84%

Training for the Model You Return: Improving Optimization for Iterate-Averaged Language Models

为返回的模型进行训练:改进迭代平均语言模型的优化

Kwok Chun Au, Adam Block

机构 * Department of Computer Science, Columbia University(哥伦比亚大学计算机科学系) Department of Electrical Engineering, Columbia University(哥伦比亚大学电气工程系)

专题命中 指令微调 :language model(title,abstract);pretraining(abstract);分类 cs.AI、cs.LG

AI总结 针对返回迭代平均而非最终迭代的语言模型,提出PACE方法,通过最优控制理论优化平均估计器,在二次模型中证明其能显著降低均方误差,并在1-2B参数LM微调和GPT-2预训练中优于AdamW。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31732 2026-07-01 cs.CV 新提交 83%

UniCoder: Unified Visual-to-Code Generation via Symbolic Rewards and Reference-Guided Code Optimization

UniCoder: 通过符号奖励和参考引导代码优化的统一视觉到代码生成

Yaozhi Zheng, Yilei Jiang, Manyuan Zhang, Yuxuan Wan, Kaituo Feng, Tianshuo Peng, Bo Zhang, Xiangyu Yue

机构 * The Chinese University of Hong Kong(香港中文大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)

专题命中 指令微调 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);SFT(abstract)

AI总结 提出UniCoder框架,通过符号属性对齐实现密集元素级奖励,并利用参考引导代码优化策略克服探索停滞,在多个基准上达到与专有模型相当的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31813 2026-07-01 cs.LG cs.AI 新提交 82%

Geometry-Preserving Orthonormal Initialization for Low-Rank Adaptation in RLVR

保持几何的正交初始化用于RLVR中的低秩适应

Ruijia Zhang, Jiacheng Zhu, Hanqing Zhu, Laixi Shi

机构 * Johns Hopkins University(约翰霍普金斯大学) Meta Superintelligence Labs(Meta超级智能实验室) The University of Texas at Austin(德克萨斯大学奥斯汀分校)

专题命中 指令微调 :SFT(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 针对RLVR中LoRA初始化问题,提出保持几何的正交初始化方法(RLPO和RLMO),理论证明其最小化与全微调差距,实验表明稳定训练且优于标准LoRA。

Comments 30 pages, accepted to ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31099 2026-07-01 cs.CV cs.AI 新提交 81%

Seeing Through Multiple Views: Parameter-Efficient Fine-Tuning via Selective Neurons for Consistent Radiology Report Generation

透视多视图:通过选择性神经元进行参数高效微调以实现一致的放射学报告生成

Yucheng Chen, Jinjing Zhu, Yang Yu, Yufei Shi, Hane Naghshbandi, Jinhua Liu, Angela S. Koh, Fang Fen, Kian Eng Ong, Si Yong Yeo

机构 * MedVisAI Lab(MedVisAI实验室) Lee Kong Chian School of Medicine, Nanyang Technological University, Singapore(新加坡南洋理工大学李光前医学院) Centre of AI in Medicine, Singapore(新加坡人工智能医学中心) The Chinese University of Hong Kong, Sha Tin, New Territories, Hong Kong(香港中文大学) National Heart Centre Singapore (NHCS), Singapore(新加坡国家心脏中心)

专题命中 指令微调 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出View-PNDF框架,通过检测和微调视图特定神经元,从神经元层面实现多视图X光报告的一致性生成,仅更新少量参数即可提升视图特定报告质量并保持通用性能。

Comments Accepted by MICCAI2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13368 2026-07-01 cs.AI cs.CV 新提交 81%

IterCAD: An Iterative Multimodal Agent for Visually-Grounded CAD Generation and Editing

IterCAD:一种用于视觉引导的CAD生成与编辑的迭代多模态智能体

Tao Hu, Jiaxin Ai, Licheng Wen, Xueheng Li, Shu Zou, Siqi Li, Nianchen Deng, Xinyu Cai, Hongbin Zhou, Pinlong Cai, Daocheng Fu, Yu Yang, Hairong Zhang, Botian Shi, Xuemeng Yang

机构 * University of Science and Technology of China(中国科学技术大学)

专题命中 指令微调 :SFT(summary_cn,abstract);分类 cs.AI

AI总结 提出IterCAD,一种闭环交互式CAD生成与编辑的多模态智能体框架,通过渐进式SFT和几何感知强化学习优化,在代码可执行性和几何精度上显著超越现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31719 2026-07-01 cs.CL cs.AI 新提交 81%

Seeing Is Not Sharing: Some Vision-Language Models Overestimate Common Ground in Asymmetric Dialogue

看见不等于共享:一些视觉-语言模型在非对称对话中高估共同基础

Nan Li, Albert Gatt, Massimo Poesio

机构 * Utrecht University(乌得勒支大学)

专题命中 指令微调 :language model(title,abstract);分类 cs.CL、cs.AI

AI总结 研究视觉-语言模型在对话中是否混淆潜在共享与已共享信息,发现模型过度依赖地图内容预测对齐,忽视对话历史中的基础建立过程。

Comments 17 pages, 9 figures, 8 tables; accepted to SIGDIAL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.21495 2026-07-01 cs.LG cs.AI cs.CL 版本更新 80%

Generalizing Numerical Reasoning in Table Data through Operation Sketches and Self-Supervised Learning

通过操作草图和自监督学习推广表格数据中的数值推理

Hanjun Cho, Gahyun Yoo, Hanseong Kim, Jay-Yoon Lee

机构 * Seoul National University(首尔国立大学) Soongsil University(顺天大学)

专题命中 指令微调 :SFT(abstract,abstract_cn);pretraining(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出TaNOS框架,通过操作草图和自监督学习提升表格数据中数值推理的泛化能力,实验显示其在FinQA数据集上表现优异,且在领域转移中鲁棒性更强。

Comments Accepted to TACL. This is a pre-MIT Press publication version

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16271 2026-07-01 cs.CV 版本更新 80%

VIGOR: VIdeo Geometry-Oriented Reward for Temporal Generative Alignment

VIGOR: 面向视频几何的时序生成对齐奖励

Tengjiao Yin, Jinglei Shi, Heng Guo, Xi Wang

机构 * Beijing University of Posts and Telecommunications(北京邮电大学)

专题命中 指令微调 :SFT(abstract,abstract_cn);foundation model(abstract);post-training(abstract)

AI总结 提出基于几何的奖励模型,利用预训练几何基础模型通过跨帧重投影误差评估多视图一致性,以点方式计算误差,并引入几何感知采样策略,通过后训练和推理时优化对齐视频扩散模型,提升生成视频的几何一致性。

Comments Project Page: https://vigor-geometry-reward.com/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31591 2026-07-01 cs.LG cs.AI 新提交 79%

Evil Spectra: How Optimisers can Amplify or Suppress Emergent Misalignment

邪恶光谱:优化器如何放大或抑制涌现性失调

Jason R. Brown, Patrick Leask, Lev McKinney

机构 * Astra Fellows Program(Astra Fellows 项目) University of Cambridge(剑桥大学) Durham University(杜伦大学) University of Toronto(多伦多大学)

专题命中 指令微调 :LLM(summary_cn,abstract_cn);分类 cs.AI、cs.LG

AI总结 研究优化器选择对LLM涌现性失调的影响,发现优化器导致7倍失调率差异,Muon通过隐式正则化奇异值分布保持对齐,谱正则化可缓解失调。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31392 2026-07-01 cs.AI 新提交 77%

ReGRPO: Reflection-Augmented Policy Optimization for Tool-Using Agents

ReGRPO: 用于工具使用智能体的反思增强策略优化

Binjie Zhang, Mike Zheng Shou

机构 * Show Lab, National University of Singapore(新加坡国立大学Show Lab)

专题命中 指令微调 :SFT(abstract,abstract_cn);language model(abstract);分类 cs.AI

AI总结 提出ReGRPO框架,通过反思数据引擎和联合优化反射令牌与纠正动作,提升工具使用智能体在故障后的恢复能力,在GTA和GAIA上取得最佳效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30704 2026-07-01 cs.LG cs.AI cs.CL 新提交 75%

From Search to Synthesis: Training LLMs as Zero-Shot Workflow Generators

从搜索到合成:训练大语言模型为零样本工作流生成器

Gan Luo, Zihan Qin, Bin Dong, Wotao Yin

机构 * School of Mathematics Science, Peking University(北京大学数学科学学院)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 提出MetaFlow,将工作流生成视为元学习问题,通过两阶段训练(监督微调+强化学习)使模型能生成可泛化的任务级工作流,在问答、代码生成和数学推理任务上实现零样本泛化。

Comments 35 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00810 2026-07-01 cs.CV cs.AI cs.CL cs.HC cs.LG 版本更新 75%

GUI-AIMA: Aligning Intrinsic Multimodal Attention with a Context Anchor for GUI Grounding

GUI-AIMA: 对齐内在多模态注意力与上下文锚点以实现GUI定位

Shijie Zhou, Viet Dac Lai, Hao Tan, Jihyung Kil, Wanrong Zhu, Changyou Chen, Ruiyi Zhang

机构 * University at Buffalo(布法罗大学) Adobe Research(Adobe研究院)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 GUI-AIMA通过多模态注意力对齐与上下文锚点,实现高效的GUI定位,无需坐标生成,提升数据效率和性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31963 2026-07-01 cs.LG cs.CL stat.ML 新提交 73%

Signed-Permutation Coordinate Transport for RMSNorm Transformers

RMSNorm Transformer的有符号排列坐标传输

John Sweeney

机构 * Sideplane AI

专题命中 指令微调 :LLM(abstract,abstract_cn);分类 cs.CL、cs.LG

AI总结 针对RMSNorm模型,提出有符号排列坐标传输方法,解决排列对齐不完整问题,在跨运行坐标恢复、工具迁移和训练状态保持上显著优于纯排列方法。

Comments 31 pages, 2 figures, 26 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30870 2026-07-01 cond-mat.mtrl-sci 新提交 71%

Adaptive fine-tuning of foundation models for crystal structure prediction: Discovery of high-pressure phases in the CaFeNi system

基础模型的自适应微调用于晶体结构预测:CaFeNi体系中高压相的发现

N. M. Chtchelkatchev, M. V. Magnitskaya, R. E. Ryltsev

专题命中 指令微调 :foundation model(title)

AI总结 提出一种结合进化搜索与自适应数据选择及微调的自洽基础模型辅助晶体结构预测工作流,通过迭代选择代表性结构进行DFT标记,高效探索Ca-Fe-Ni三元体系,预测了高压下稳定的新化合物Ca6FeNi。

Comments 10 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31207 2026-07-01 cs.AI cs.CY 新提交 70%

Towards Inclusive Mobility Modeling: Characterizing and Evaluating Elderly Trajectory Patterns in Urban Systems

迈向包容性移动建模:城市系统中老年人轨迹模式的特征化与评估

Zhengxuan Wang, Haohan He, Mengying Zhou

机构 * School of Computing and Artificial Intelligence, Shanghai University of Finance and Economics(上海财经大学计算机与人工智能学院) MOE Key Laboratory of Interdisciplinary Research of Computation and Economics, Shanghai University of Finance and Economics(上海财经大学计算与经济学交叉研究教育部重点实验室) Center for Data Science, New York University(纽约大学数据科学中心)

专题命中 指令微调 :LLM(abstract,abstract_cn);分类 cs.AI

AI总结 本研究利用共享单车数据,通过合成轨迹生成案例,定量评估老年人出行数据缺失对移动建模的偏差影响,并对比马尔可夫链与大语言模型在不同人口训练集下的表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23867 2026-07-01 cs.LG cs.AI cs.CV 版本更新 62%

Can VLMs Reason Robustly? A Neuro-Symbolic Investigation

VLM能稳健推理吗?一项神经符号研究

Weixin Chen, Antonio Vergari, Han Zhao

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) University of Edinburgh(爱丁堡大学)

专题命中 指令微调 :language model(abstract);分类 cs.AI、cs.LG

AI总结 研究视觉语言模型在分布偏移下的推理稳健性,提出结合VLM概念识别与电路符号推理的神经符号方法VLC,在三个视觉演绎推理任务上实现更高的分布外准确率。

Comments TMLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.09156 2026-07-01 cs.LG cs.AI stat.AP 版本更新 62%

Physics-Constrained Fine-Tuning of Flow-Matching Models for Generation and Inverse Problems

面向生成和逆问题的流匹配模型的物理约束微调

Jan Tauberschmidt, Sophie Fellenz, Sebastian J. Vollmer, Andrew B. Duncan

机构 * German Research Center for Artificial Intelligence (DFKI)(德国人工智能研究中心) Department of Computer Science, University of Kaiserslautern–Landau (RPTU)(凯泽斯劳滕-兰道大学计算机科学系) Department of Mathematics, Imperial College London(伦敦帝国理工学院数学系)

专题命中 指令微调 :post-training(abstract);分类 cs.AI、cs.LG

AI总结 提出一种微调流匹配生成模型以强制执行物理约束并解决科学系统逆问题的框架,通过微分后训练最小化偏微分方程弱形式残差,并联合优化可学习潜参数预测器,实现物理一致性与潜系数准确恢复。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31258 2026-07-01 cs.CV 新提交 50%

WarpHammer: Densifying Scene Warps with 3D Object Priors for Extreme View Synthesis

WarpHammer: 利用3D物体先验稠密化场景扭曲以实现极端视角合成

Michael Green, Gavriel Habib, Dvir Samuel, Tal Berkovitz Shalev, Issar Tzachor, Rami Ben-Ari, Or Litany

机构 * OriginAI, Israel(OriginAI,以色列) NVIDIA(英伟达) Technion(以色列理工学院)

专题命中 指令微调 :foundation model(abstract)

AI总结 针对投影条件新视角合成在大轨道运动下扭曲稀疏导致生成失败的问题,提出无需训练的WarpHammer框架,通过引入3D生成先验的物体显式重建来补充缺失前景并遮挡不应可见的背景点,恢复外观和相机线索,并首次支持融合外部辅助物体视图。

详情

展开后加载摘要…

URL PDF HTML 收藏