arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-08-04 至 2026-08-04 共收录 723 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 55 篇

2605.26045 2026-08-04 cs.CL cs.AI 版本更新 81%

Confidence and Calibration of Activation Oracles for Reliable Interpretation of Language Model Internals

激活预言机的置信度与校准:用于语言模型内部的可信解释

Federico Torrielli, Peter Schneider-Kamp, Lukas Galke Poech

机构 * University of Turin(都灵大学) University of Southern Denmark(南丹麦大学)

专题命中 其他LLM :language model(title,abstract);分类 cs.CL、cs.AI

AI总结 本文研究了6种激活预言机置信度估计方法,发现bootstrap模式频率在校准上优于其他方法(ECE 5.7% vs 25.5%),而log-prob基线可作为快速分诊信号。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00929 2026-08-04 cs.AI 新提交 79%

Modeling Social Dynamics with an LLM-Enabled Agent Based Network-Dynamic (LAND) Model

基于大语言模型的智能体网络动态(LAND)模型对社会动力学的建模

Lynnette Hui Xian Ng, Kathleen M. Carley

机构 * Carnegie Mellon University(卡内基梅隆大学)

专题命中 其他LLM :LLM(title,abstract);分类 cs.AI

AI总结 本文采用GhostField架构的LAND模型构建AuraSight场景,通过31万余智能体与人类主体的模拟,揭示社会动力学源于网络拓扑与叙事交换的递归互动。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02401 2026-08-04 cs.CV 新提交 78%

USP-Mamba: Unmixing-Derived Spectral and Structural Prompting for Hyperspectral Image Super-Resolution

USP-Mamba:基于解混的光谱与结构提示的高光谱图像超分辨率方法

Shi Chen, Jie Zhang, Yicong Zhou

专题命中 其他LLM :prompting(title,abstract)

AI总结 本文针对现有Mamba模型用于高光谱图像超分辨率时破坏空间邻接性、未对齐图像固有特征的问题,提出USP-Mamba框架,通过解混光谱提示、结构提示及互补扫描,在多数据集上性能优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00726 2026-08-04 cs.CV 新提交 78%

Foveated Probes Recover Localized Binding Information in Vision Foundation Models

凹点探测法在视觉基础模型中恢复局部绑定信息

Mateusz Michalkiewicz, Mahsa Baktashmotlagh, Guha Balakrishnan

专题命中 其他LLM :foundation model(title,abstract)

AI总结 该研究通过对比全局读出、凹点读出和神谕读出,发现冻结视觉基础模型的空间盲性源于全局嵌入界面,而非 patch 标记缺乏空间信息,凹点读出可有效恢复局部绑定信息。

Comments 15 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00235 2026-08-04 cs.CV 新提交 78%

Attention-Steered Vision-Language Models for Sign Language Translation

用于手语翻译的注意力引导视觉-语言模型

Meibo Hu, Guohao Sun, Annemarie D. Ross, Sheng Li, Zhiqiang Tao

机构 * Rochester Institute of Technology(罗切斯特理工学院) University of Virginia(弗吉尼亚大学) National Technical Institute for the Deaf(国家聋人技术学院)

专题命中 其他LLM :language model(title,abstract)

AI总结 针对视觉-语言模型在手语翻译中时空视觉定位差的问题,提出AttnSign框架,通过空间注意力监督和RL运动节奏引导提升性能,在How2Sign和OpenASL基准上表现优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00549 2026-08-04 cs.IR cs.AI cs.HC 新提交 77%

A Context-Aware Cultural Heritage Guide Powered by LLMs

由大语言模型(LLMs)驱动的上下文感知文化遗产指南

Liliana Ardissono, Fabio Ferrero, Angelo Geninatti Cossatin, Claudio Mattutino, Noemi Mauro

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本研究扩展了文化遗产网页应用Triangolazioni,构建与LLMs无关的松耦合架构,实现LLMs驱动的上下文感知文化遗产信息搜索与展示,丰富了文化遗产内容。

Journal ref In Proceedings of the 34th ACM Conference on User Modeling, Adaptation and Personalization (UMAP '26). 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26775 2026-08-04 cs.LG cs.AI cs.CL cs.CV 75%

Learning to Select Visual In-Context Demonstrations

学习选择视觉上下文示例

Eugene Lee, Yu-Chi Lin, Jiajie Diao

机构 * University of Cincinnati(辛辛那提大学) University of California, Los Angeles(加利福尼亚大学洛杉矶分校)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出LSD方法,通过强化学习构建最优演示集,提升多模态大语言模型在视觉回归任务中的表现,揭示了学习选择在视觉上下文学习中的必要性。

Comments 21 pages, 12 figure, accepted to Computer Vision and Pattern Recognition Conference (CVPR) 2026 Findings Track

Journal ref In Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (pp. 9455-9465) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13246 2026-08-04 cs.LG cs.AI 版本更新 73%

Reassessing Muon for Matrix Factorization

重新评估用于矩阵分解的Muon优化器

Ali Parviz, Gal Mishne, Alex Cloninger

机构 * Halicioğlu Data Science Institute, UC San Diego(加州大学圣地亚哥分校哈利西奥卢数据科学研究所) Department of Mathematics, UC San Diego(加州大学圣地亚哥分校数学系)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 研究在低秩矩阵分解问题上重新评估Muon优化器,通过与精心调整的自适应基线对比,发现Muon在此设置下不始终优于AdamW,一些优势对超参数选择敏感,更细致地展现谱感知正交化何时有益,主张在受控问题上评估优化器。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02288 2026-08-04 cs.LG cs.AI 版本更新 73%

AROpt: An Optimization Method for Autoregressive Time Series Forecasting

AROpt: 一种用于自回归时间序列预测的优化方法

Zheng Li, Jerry Cheng, Huanying Gu

机构 * Department of Computer Science(计算机科学系) New York Institute of Technology(纽约理工学院)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出一种新方法,通过强制预测误差随预测时间增加而增长,提升自回归时间序列预测的准确性与灵活性,实验表明在多个基准上取得新突破。

Comments 16 pages, 5 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02005 2026-08-04 cs.AI 新提交 70%

Evolving in the Agent Jungle via History-Informed Opponent Awareness

在智能体丛林中通过历史感知的对手意识进化

Zhaofeng Zhang, Linhan Xia, Rui Liu, Yihao Wang, Binrui Shen, Shengxin Zhu

机构 * University of Edinburgh(爱丁堡大学) University of Oklahoma(俄克拉荷马大学) Imperial College London(伦敦帝国学院) University of Michigan(密歇根大学) University of Southern California(南加州大学) Tencent(腾讯) Beijing Normal University(北京师范大学) Beijing Normal–Hong Kong Baptist University(北京师范大学-香港浸会大学联合国际学院)

专题命中 其他LLM :LLM(abstract,abstract_cn);分类 cs.AI

AI总结 针对多智能体环境中对手策略持续进化导致静态技能修改方法失效的问题,提出OASE方法,通过历史快照锚定的配对比较选择有益技能修改,在两类场景中实现更低均衡距离与更少无效策略变更。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00119 2026-08-04 cs.CV cs.AI 新提交 70%

Counting the Cost of War Under Satellite Embargo: Zero-Shot Estimation of Impacted Infrastructure

卫星禁运下的战争损失统计:受影响基础设施的零样本估计

Saleh Sakib Ahmed, M. Sohel Rahman

机构 * Bangladesh University of Engineering and Technology(孟加拉国工程技术大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 针对冲突区人道主义救援中受影响建筑估计受卫星数据禁运阻碍的问题,提出基于打击前地图的零样本几何投影方法,引入两项技术创新,在2026年中东冲突数据上验证了深度增强大视觉语言模型的优势,确立了混合零样本危机映射范式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.05633 2026-08-04 cs.AI 版本更新 70%

Answer Presence Drives RAG Rewriting Gains

答案存在驱动RAG重写收益

Yuejie Li, Yueying Hua, Ke Yang, Li Zhang, Yueping He, Yueping He, Ruiqi Li, Bolin Chen, Tao Wang, Bowen Li, Chengjun Mao

机构 * Ant Group(蚂蚁集团)

专题命中 其他LLM :LLM(abstract,abstract_cn);分类 cs.AI

AI总结 通过受控干预审计,发现检索增强问答中重写器带来的性能提升主要由黄金答案字符串出现在重写上下文中驱动,而非证据质量改善。

Comments The authors have withdrawn this manuscript after identifying errors in the experimental analysis reported in Sections 3 and 4. These errors affect the reported relationship between answer presence and RAG rewriting gains and undermine the paper's main conclusions. Therefore, the results and conclusions in the current version should not be relied upon

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02613 2026-08-04 cs.MA cs.AI cs.CY 版本更新 70%

Exploring Silicon-Based Societies: An Early Study of the Moltbook Agent Community

探索基于硅的社会:对Moltbook代理社区的早期研究

Yu-Zheng Lin, Bono Po-Jen Shih, Hsuan-Ying Alessandra Chien, Shalaka Satam, Jesus Horacio Pacheco, Naima Kaabouch, Sicong Shao, Soheil Salehi, Pratik Satam

机构 * 1 Department of Electrical Computer Engineering, University of Arizona 3 Department of Systems Industrial Engineering, University of Arizona 5 School of Electrical Engineering Computer Science, University of North Dakota 2 The Rock Ethics Institute \& The Leonhard Center for the Enhancement of Engineering Education, The Pennsylvania State University 4 Department of Industrial Engineering, University of Sonora 3 Telecommunication Laboratories, Chunghwa Telecom Co., Ltd. Corresponding Email

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文通过分析Moltbook平台,研究自主代理的社会结构形成,揭示了代理如何通过数据驱动的方法系统性地组织集体空间。

Comments 11 pages, 3 figures. Improves clarity and exposition and corrects minor errors. Technical content and conclusions remain unchanged

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01870 2026-08-04 cs.AI cond-mat.dis-nn math-ph math.MP math.NT 版本更新 70%

Testing Transformer Learnability on the Arithmetic Sequence of Rooted Trees

在根树的算术序列上测试Transformer的可学习性

Alessandro Breccia, Federica Gerace, Marco Lippi, Gabriele Sicuro, Pierluigi Contucci

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 该研究探讨了Transformer模型在根树算术序列上的学习能力,发现模型能部分捕捉序列的内部规律和相关性,表明可学习性可能延伸至算术结构本身。

Comments 33 pages, 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02064 2026-08-04 cs.LG cs.AI cs.CL 新提交 67%

Geometry-Guided Layerwise FFN Width Allocation in Transformers

Transformer中基于几何引导的分层前馈网络宽度分配

Timur Mudarisov, Mikhail Burtsev, Radu State

机构 * University of Luxembourg(卢森堡大学) London Institute of Mathematical Sciences(伦敦数学科学研究所)

专题命中 其他LLM :language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 该研究针对Transformer中FFN宽度恒定的问题,提出基于几何特征的分层宽度分配方法,在多个预训练语言模型实验中,其可降低验证损失且效果优于均匀宽度和余弦衰减方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00721 2026-08-04 cs.RO 新提交 67%

OmniAI: A Surface-Adaptive Aerial Projection Interface for Human--Drone Interaction

OmniAI:一种面向人机交互的表面自适应空中投影界面

Nikita Kuzmin, Yuhua Jin, Georgii Demianchuk, Mariya Lezina, Fawad Mehboob, Ivan Valuev, Nikolai Lutsenko, Miguel Altamirano Cabrera, Dzmitry Tsetserukou

机构 * Skolkovo Institute of Science and Technology(斯科尔科沃科学技术研究院) School of Science and Engineering, The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)理工学院)

专题命中 其他LLM :LLM(abstract,abstract_cn)

AI总结 OmniAI是一种具现化空中智能体,通过自适应投影实现人机交互,采用RGB-D与RANSAC检测投影表面,支持语音、手势控制,为情境感知人机交互提供移动空间AR界面。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04015 2026-08-04 eess.SP 版本更新 67%

GenED-SC: Generative Editing Semantic Communication with Integrated Multi-Modal LLMs

GenED-SC:集成多模态大模型的生成式编辑语义通信

Shuoyao Wang, Suzhi Bi, Mingze Gong, Zhanpeng Wang, Li Ping Qian, Qiang Ye

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 提出一种两阶段语义图像传输框架,结合JSCC判别传输与MLLM生成编辑,在低信噪比下提升语义保真度和感知质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01436 2026-08-04 cs.CY cs.AI cs.CL cs.HC 新提交 62%

Same violence, different answer: how AI responds to coercive control against women across languages

相同的暴力,不同的回应:人工智能如何对不同语言中针对女性的胁迫控制做出反应

Lyu Chang, Sònia Estradé Albiol, Núria Vergés Bosch

专题命中 其他LLM :language model(abstract);分类 cs.CL、cs.AI

AI总结 本研究分析7种语言模型对9种语言下女性受伴侣胁迫控制场景的回应,发现非英语开发者系统在母语中易失效,前沿系统可实现统一保护,主张为各语言设定AI保护的最低标准。

Comments 16 pages, 1 figure, 2 tables. Supplementary methods, coding manual, and data workbook included as ancillary files

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.24310 2026-08-04 cs.CL cs.LG 62%

Discovering Lexical Gaps Using Embeddings from Multilingual LLMs

利用多语言大语言模型的嵌入发现词汇空缺

Yoonwon Jung, Aaron S. Cohen, Benjamin K. Bergen

机构 * Department of Cognitive Science, University of California San Diego(加州大学圣地亚哥分校认知科学系)

专题命中 其他LLM :LLM(abstract_cn);分类 cs.CL、cs.LG

AI总结 提出一种数据驱动框架,通过多语言大语言模型的上下文嵌入计算语义相似度,以识别跨语言词汇空缺,在韩英和英韩方向上分别达到0.81和0.76的AUC。

Comments CoNLL 2026

Journal ref Yoonwon Jung, Aaron S. Cohen, and Ben Bergen. 2026. Discovering Lexical Gaps Using Embeddings from Multilingual LLMs. In Proceedings of the 30th Conference on Computational Natural Language Learning, pages 641-660

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.09935 2026-08-04 cs.CL cs.AI 版本更新 62%

Unpacking Hateful Memes: Presupposed Context and False Claims

解析仇恨表情包:预设语境与虚假主张

Weibin Cai, Jiayu Li, Reza Zafarani

机构 * Syracuse University(Syracuse大学)

专题命中 其他LLM :language model(abstract);分类 cs.CL、cs.AI

AI总结 本文针对仇恨表情包检测中忽略仇恨本质的问题,提出含PCM与FACT模块的SHIELD框架,实验显示其检测性能优于现有最优方法,且可用于假新闻检测等任务。

Comments Accepted to SDM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01793 2026-08-04 cs.LG 新提交 57%

ReFP-AD: Rectified Flow Preconditioning for Energy-Based Anomaly Detection

ReFP-AD:用于基于能量的异常检测的整流流预处理

Camile Lendering, Erkut Akdag, Joaquín Figueira, Egor Bondarev

机构 * Eindhoven University of Technology(埃因霍温理工大学)

专题命中 其他LLM :foundation model(abstract);分类 cs.LG

AI总结 该研究针对统一异常检测中高维token空间EBM训练不稳定问题,提出ReFP-AD方法,经实验在MVTec-AD和VisA数据集上取得优于基线的异常检测性能。

Comments Accepted at the European Conference on Computer Vision (ECCV) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01414 2026-08-04 cs.AI cs.CR 新提交 57%

No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks

无单一失效神经元:针对白盒攻击的分布式安全对齐

Simiao Xie, Chuancheng Shi, Shangze Li, Wenhua Wu, Fei Shen, Ying Zhou, Zhiyong Wang, Tat-Seng Chua

机构 * The University of Sydney(悉尼大学) National University of Singapore(新加坡国立大学)

专题命中 其他LLM :foundation model(abstract);分类 cs.AI

AI总结 针对现有安全对齐方法的单点失效问题,提出分布式安全对齐(DSA),通过冗余编码安全能力提升模型对抗白盒神经元级攻击的鲁棒性,且保留通用语言与多模态效用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01238 2026-08-04 cs.CL cs.MM 新提交 57%

Evaluating VLMs on Multimodal Aristotelian Persuasion Tasks

评估视觉语言模型(VLMs)在亚里士多德式多模态说服任务上的表现

Khondoker Ittehadul Islam

机构 * Saarland University(萨尔大学)

专题命中 其他LLM :language model(abstract);分类 cs.CL

AI总结 该研究采用ImageArg数据集评估VLMs在亚里士多德式多模态说服任务的表现,发现Qwen系列模型在相关检测任务上性能提升并发布代码。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00284 2026-08-04 cs.RO cs.AI 新提交 57%

Hybrid Attention Estimation Pipeline for Adaptive HRI Using an Expressive Robotic Head

基于富有表现力的机器人头部的自适应人机交互混合注意力估计流程

Pablo Moraes, Monica Rodriguez, Christopher Peters, Hiago Sodre, Tobias Doernbach, Bruna Guterres, Ricardo Grando

机构 * Technological University of Uruguay(乌拉圭科技大学) Ostfalia University of Applied Sciences(奥斯特法利亚应用科技大学)

专题命中 其他LLM :language model(abstract);分类 cs.AI

AI总结 该研究提出结合几何与语义感知层的混合注意力估计流程,通过有限状态机调节自适应人机交互,经10人40次试验验证其交互启动可靠、暂停行为一致且输出信息非冗余。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00247 2026-08-04 cs.SD cs.AI 版本更新 57%

Adaptive Perturbation Selection for Contrastive Audio Decoding

对比音频解码的自适应扰动选择

Aaron Isidore Grace, Zhouyuan Huo, Weiran Wang

机构 * Google(谷歌) University of Iowa(爱荷华大学)

专题命中 其他LLM :language model(abstract);分类 cs.AI

AI总结 针对大型音频语言模型幻觉问题,提出自适应选择最优音频扰动作为对比解码负分支的方法,在时序、存在性等任务上提升准确率。

Comments In submission

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00463 2026-08-04 cs.CV cs.MM cs.SD 新提交 50%

Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds

Scene2Sound:面向3D高斯世界的听觉锚定声景生成

Masaki Yoshida, Ren Togo, Takahiro Ogawa, Miki Haseyama

机构 * Hokkaido University(北海道大学)

专题命中 其他LLM :language model(abstract)

AI总结 Scene2Sound是一个无训练框架,通过听觉锚定和高斯集匹配为3D高斯世界生成空间一致的声景,在保留音频质量的同时解决了现有方法空间不一致的问题,经实验和用户研究验证有效。

Comments 14 pages. Project page: https://masaki-lmd.github.io/scene2sound/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03434 2026-08-04 hep-th gr-qc nlin.CD 版本更新 50%

Berry Picking: Random Wave Chaos Hierarchy for BPS Microstate Geometries

Berry采摘:BPS微观态几何的随机波混沌层次结构

Vladan Djukić, Milica Stepanović, Mihailo Čubrović

专题命中 其他LLM :LLM(abstract_cn)

AI总结 研究不同超引力背景下探测波与测地线的混沌强度,发现波混沌随超对称减少和喉道变长变强,测地线运动则相反,还通过相关测试及计算解释二者差异,指出BPS混沌层次在体和场论中作用不同。

Comments 40 pages, 9 figures; this version: additional explanations in section 5, improved figures, additional discussion in section 6

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.18309 2026-08-04 cs.GR cs.CV cs.SD eess.AS 50%

GCDance: Genre-Controlled Music-Driven 3D Full Body Dance Generation

GCDance:基于音乐的风格控制3D全身舞蹈生成

Xinran Liu, Xu Dong, Shenbin Qian, Diptesh Kanojia, Wenwu Wang, Zhenhua Feng

机构 * School of Computer Science and Electronic Engineering, University of Surrey(萨里大学计算机科学与电子工程学院) Department of Music and Media, University of Surrey(萨里大学音乐与媒体系) Department of Informatics, University of Oslo(奥斯陆大学信息学系) Centre for Vision, Speech and Signal Processing, University of Surrey(萨里大学视觉、语音与信号处理中心) School of Artificial Intelligence and Computer Science, Jiangnan University(江南大学人工智能与计算机科学学院)

专题命中 其他LLM :foundation model(abstract)

AI总结 本文提出GCDance框架,通过音乐和文本条件生成风格化的3D舞蹈,利用文本控制机制和音乐基础模型提升生成质量,实验验证其优于现有方法。

Journal ref IEEE Transactions on Multimedia, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.28568 2026-08-04 cs.CV 版本更新 50%

XSPA: Crafting Imperceptible X-Shaped Sparse Adversarial Perturbations for Transferable Attacks on VLMs

XSPA:构建不可察觉的X形稀疏对抗扰动以对视觉语言模型的可迁移攻击

Chengyin Hu, Jiaju Han, Xuemeng Sun, Qike Zhang, Luwei Yang, Lehan Sun, Jiahuan Long, Yiwei Wei, Jiujiang Guo

专题命中 其他LLM :language model(abstract)

AI总结 本文提出XSPA攻击,通过限制扰动为两条相交对角线,测试VLMs在稀疏扰动下的鲁棒性,实验表明其能显著破坏跨任务语义。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.25129 2026-08-04 cs.CV 版本更新 50%

AirSplat: Alignment and Rating for Robust Feed-Forward 3D Gaussian Splatting

AirSplat:基于鲁棒前馈3D高斯散射的对齐与评分

Minh-Quan Viet Bui, Jaeho Moon, Munchurl Kim

机构 * KAIST(韩国科学技术院)

专题命中 其他LLM :foundation model(abstract)

AI总结 本文提出AirSplat框架,通过自一致性姿态对齐和基于评分的透明度匹配技术,提升无姿态视角合成的重建质量。

Comments Project page: https://kaist-viclab.github.io/airsplat-site, accepted to ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏