arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-07-10 至 2026-07-10 共收录 47 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 47 篇

2607.08643 2026-07-10 cs.LG 新提交 94%

BiSCo-LLM: Lookup-Free Binary Spherical Coding for Extreme Low-Bit Large Language Model Compression

BiSCo-LLM:用于极低比特大语言模型压缩的无查找表二进制球面编码

Yuantian Shao, Peisong Wang, Zhilei Liu, Chuangyi Li, Yuanteng Chen, Pengcheng Xie, Yiwu Yao, Zhihui Wei, Jian Cheng

机构 * Nanjing University of Science and Technology(南京理工大学) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) Huawei(华为)

专题命中 效率与部署 :LLM(title,title_cn);large language model(title,abstract);language model(title,abstract);分类 cs.LG

AI总结 研究大语言模型部署时的压缩问题,提出BiSCo-LLM框架,通过将局部权重块映射到超球面二值化、编码重建误差、进行类别恢复蒸馏及设置保护通道路径等方法,实现极低比特权重压缩并减少存储开销。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08161 2026-07-10 cs.CL cs.CV 新提交 93%

SQuaD-SQL: Efficient Text-to-SQL with Small Language Models via LLM-Guided Knowledge Distillation

SQuaD-SQL:通过大语言模型引导的知识蒸馏,利用小语言模型实现高效的文本到SQL转换

Wangyu Wu, Xiaojian Lin, Rong Fu, Zaiyang Yu, Xuhang Chen, Wenjun Yu, Zhenhong Chen

机构 * The University of Liverpool(利物浦大学) University of Macau(澳门大学) University of Chinese Academy of Sciences(中国科学院大学) Tsinghua University(清华大学) Microsoft(微软) Shanghai University of International Business and Economics(上海国际经贸管理大学) Huizhou University(惠州市大学)

专题命中 效率与部署 :LLM(title,abstract);language model(title,abstract);small language model(title,abstract);large language model(abstract)

AI总结 研究如何让小语言模型在文本到SQL任务中接近大语言模型性能。核心方法是通过知识蒸馏和合成数据生成,包含基于大语言模型的合成数据生成、参数高效微调和领域自适应微调三个关键组件。主要贡献是在WikiSQL数据集上执行准确率达86.9%,推理更快、内存使用更低。

Comments Accepted at IEEE SMC 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08057 2026-07-10 cs.LG cs.AI cs.CL 新提交 91%

Towards Efficient Large Language Model Serving: A Survey on System-Aware KV Cache Optimization

迈向高效大语言模型服务:关于系统感知键值缓存优化的综述

Jiantong Jiang, Peiyu Yang, Rui Zhang, Feng Liu

机构 * School of Computing and Information Systems, The University of Melbourne(墨尔本大学计算与信息系统学院) School of Computer Science and Technology, Huazhong University of Science and Technology(华中科技大学计算机科学与技术学院)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract,abstract_cn);分类 cs.CL、cs.AI、cs.LG

AI总结 该综述聚焦大语言模型服务中系统感知的键值缓存优化,从执行与调度、放置与迁移、表示与保留三个维度回顾相关工作,分析跨行为协同设计及行为与目标联系,为理解和创新键值缓存设计提供基础。

Comments Accepted to ACL 2026 as a Findings paper

Journal ref Findings of the Association for Computational Linguistics: ACL 2026 (pp. 38450-38476)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03466 2026-07-10 quant-ph stat.ML 版本更新 90%

Quantum Circuit Generation via test-time learning with large language models

通过大语言模型的测试时学习生成量子电路

Adriano Macarone-Palmieri, Rosario Lo Franco

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract,abstract_cn)

AI总结 研究通过大语言模型进行量子电路生成,提出记忆增强测试时优化框架,结合情景记忆、分数差反馈和重新采样改进搜索。在量子电路合成任务中评估,结果显示该框架显著提高样本效率,为测试时优化提供挑战基准。

Comments 9 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08027 2026-07-10 cs.CL cs.AI 新提交 88%

Structured Pruning of Large Language Models via Power Transformation and Sign-Preserving Score Aggregation with Adaptive Feature Retention

通过幂变换和符号保留分数聚合与自适应特征保留对大语言模型进行结构化剪枝

Ryota Kobayashi, Tsubasa Hirakawa, Takayoshi Yamashita, Hironobu Fujiyoshi, Yasunori Ishii, Tomoyuki Okuno, Kazuki Kozuka

机构 * Chubu University(楚ubu大学) Panasonic Holdings Corporation(松下电器控股公司)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

AI总结 研究针对大语言模型结构化剪枝,改进自适应特征保留技术。结合幂变换、符号保留分数聚合及异常值去除方法,解决应用中出现的分布不匹配等问题。实验表明该方法能保持准确率,通过结构化剪枝加速推理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08377 2026-07-10 cs.LG 新提交 88%

Eigenvalue Calibration for Semantic Embeddings of Large Language Models

大语言模型语义嵌入的特征值校准

Sebastian G. Gruber, Nassim Walha, Francis Bach, Florian Buettner

机构 * KU Leuven(鲁汶大学) German Cancer Research Center (DKFZ)(德国癌症研究中心) German Cancer Consortium (DKTK)(德国癌症联盟) Goethe University Frankfurt(法兰克福歌德大学) PSL Research University / Inria(巴黎文理研究大学/法国国家信息与自动化研究所) Frankfurt Cancer Institute(法兰克福癌症研究所)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.LG

AI总结 针对大语言模型语义嵌入特征值校准问题,提出新框架,将其与生成答案的语义嵌入视为密度矩阵预测器,通过温度缩放校准,建立相关理论并经实验验证,推动语义嵌入不确定性量化发展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04983 2026-07-10 cs.NE cs.AI cs.ET cs.GL cs.LG 新提交 88%

LLM for the development of FCM

用于模糊认知图开发的语言模型

Alexis Kafantaris

机构 * Qwen2.5-32B

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 研究利用本地大语言模型开发模糊认知图,以Qwen2.5 - 32B从酒店评论提取数据构建模糊认知图,经训练、评估及外部验证,形成希腊评论的星型拓扑模糊认知图,关联评论星级与预测满意度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08740 2026-07-10 cs.AI cs.PL cs.SE 新提交 87%

Workflow as Knowledge: Semantic Persistence for LLM-Mediated Workflows

作为知识的工作流:大语言模型介导的工作流的语义持久性

Emanuele Quinto, Carlo Andrea Rozzi, Francesco Zanitti

机构 * UNHCR København(联合国难民署哥本哈根办事处) CNR—Istituto Nanoscienze Modena(意大利国家研究委员会-纳米科学研究所摩德纳分所) ZeLe & F ApS København(泽勒与F有限公司哥本哈根分公司)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究大语言模型介导的工作流,提出受Lisp启发的概念模型,用符号形式等作解释视角,将工作流相关元素表示为持久知识对象,区分派生和推理,初步阐述了工作流的语义持久性。

Comments 39 pages, 18 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08565 2026-07-10 cs.DC cs.AI 新提交 87%

SMetric: Rethink LLM Scheduling for Serving Agents with Balanced Session-centric Scheduling

SMetric:以平衡的会话中心调度重新思考面向服务代理的大语言模型调度

Jiahao Wang, Kaizhan Lin, Kaixi Zhang, Jinbo Han, Xingda Wei, Sijie Shen, Chenguang Fang, Wenyuan Yu, Rong Chen, Haibo Chen

机构 * Institute of Parallel and Distributed Systems, Shanghai Jiao Tong University(并行与分布式系统研究所,上海交通大学) Alibaba Group(阿里巴巴集团)

专题命中 效率与部署 :LLM(title,summary_cn);分类 cs.AI

AI总结 研究代理服务中LLM调度问题,提出基于全局层KV存储和会话内局部性的见解,设计SMetric平衡会话中心调度,相比先进调度器提升集群TPS及预填充TPS,降低每个令牌延迟。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08282 2026-07-10 cs.CR cs.AI cs.MA 新提交 87%

Multi-Agent Firewall Architecture for Privacy Protection of Sensitive Data in Interactions with Language Models

用于在与语言模型交互中保护敏感数据隐私的多智能体防火墙架构

Hugo García Cuesta, Pablo Mateo Torrejón, Alfonso Sánchez-Macián

机构 * Universidad Carlos III de Madrid(卡洛斯三世大学)

专题命中 效率与部署 :language model(title,abstract);LLM(abstract,abstract_cn);large language model(abstract);分类 cs.AI

AI总结 针对大语言模型集成到工作流程中缺乏保障措施的风险,提出开源多智能体防火墙架构,结合浏览器扩展和代理拦截流量,通过混合方法防止数据泄漏,分层架构可跨异构环境部署,最佳配置下F1分数达94.93%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23842 2026-07-10 cs.CL econ.GN q-fin.EC 版本更新 87%

Fair Document Valuation in LLM Summaries via Shapley Values

通过沙普利值实现大语言模型摘要中的公平文档评估

Zikun Ye, Hema Yoganarasimhan

机构 * University of Washington(华盛顿大学)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 研究大语言模型摘要中公平文档评估与补偿问题,提出基于沙普利值的框架,开发聚类沙普利值方法,在亚马逊产品评论数据上提升效率与准确性,且与多种因素无关,广泛适用于不同总结设置。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07984 2026-07-10 cs.AI 新提交 86%

Agentic Neural Architecture Search

智能体神经架构搜索

Seokhoon Jeong, Mijung Kim, Taehwan Kim

机构 * Artificial Intelligence Graduate School, Ulsan National Institute of Science and Engineering(人工智能研究生院,乌山科学与工程研究院) Department of Computer Science and Engineering, Ulsan National Institute of Science and Engineering(计算机科学与工程系,乌山科学与工程研究院)

专题命中 效率与部署 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究探索LLM驱动设计与NAS驱动搜索的分工,提出用LLM生成种子架构并分解为带插槽架构供NAS搜索的机制,在AgentNAS中实例化,在多任务上表现出色,两种搜索机制互补。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08010 2026-07-10 cs.CL cs.LG cs.SE 新提交 86%

Tool-Making and Self-Evolving LLM Agents in Low-Latency Systems

低延迟系统中的工具制作与自我进化大语言模型智能体

Kalle Kujanpää, Ning Liu, Shahnawaz Alam, Yeshwanth Reddy Sura, Tianyu Yang, Kristina Klinkner, Shervin Malmasi

机构 * Amazon(亚马逊)

专题命中 效率与部署 :LLM(title,summary_cn);分类 cs.CL、cs.LG

AI总结 研究如何解决生产LLM智能体因重复生成代码浪费延迟和可靠性的问题,提出用智能工具制作管道取代推理时编码循环,部署该方法使系统更快、更可靠、易操作,降低延迟和错误率,提高可审计性。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07817 2026-07-10 cs.CV cs.AI 新提交 85%

DreamCharacter-1: From 3D Generative Foundation Models to Product-Ready Character Generation

DreamCharacter-1:从3D生成基础模型到产品就绪的角色生成

Weizhe Liu, Yunjie Wu, Xiangqian Shu, Guangwei Wang, Xiangyu Xu, Peng Li, Yujie Li, Hengkai Guo

机构 * ByteDance(字节跳动)

专题命中 效率与部署 :foundation model(title,abstract);post-training(abstract);preference optimization(abstract);分类 cs.AI

AI总结 研究提出DreamCharacter-1框架,基于3D基础主干,通过几何后期训练、纹理后期训练和推理加速三个组件,将预训练模型校准用于3D角色生成,实验证明该框架能生成高质量角色资产,超越现有方法。

Comments Official Page: https://dreamcharacter-x.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08754 2026-07-10 cs.LG cs.AI 新提交 85%

SLORR: Simple and Efficient In-Training Low-Rank Regularization

SLORR:简单高效的训练中低秩正则化

David González-Martínez, Shiwei Liu

机构 * Max Planck Institute for Intelligent Systems(马克斯·普朗克智能系统研究所) University of Tübingen(图宾根大学) ELLIS Institute Tübingen(图宾根ELLIS研究所) Tübingen AI Center(图宾根人工智能中心)

专题命中 效率与部署 :LLM(summary_cn,abstract);pretraining(abstract);分类 cs.AI、cs.LG

AI总结 研究针对神经网络低秩正则化难题,提出简单无状态的SLORR框架,基于霍耶尔稀疏性度量和核范数有两个变体,通过GPU友好近似正则化权重矩阵,在ImageNet-1K及LLM预训练中验证其能在低开销下诱导可压缩性并保持性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08116 2026-07-10 cs.NI 新提交 85%

MORES: Mobile Reasoning-as-a-Service via Distributed LLM Inference-Time Scaling

MORES:通过分布式大语言模型推理时间缩放实现移动推理即服务

Guanchen Liu, Hongyang Du, Kaibin Huang

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 研究针对大语言模型推理时间缩放的计算和内存开销问题,提出MORES框架,利用隐式推理递归结构及基于语义MoE的DRL算法优化资源分配,实现边缘设备协作推理,提升系统吞吐量约18%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07760 2026-07-10 cs.AI cs.SI 新提交 84%

Adversarial Social Epistemology for Assemblies of Humans and Large Language Models

人类与大语言模型集合的对抗性社会认识论

Mihnea C. Moldoveanu, Joel A. C. Baum

专题命中 效率与部署 :large language model(title);language model(title);分类 cs.AI

AI总结 研究人类与大语言模型集合在密集互动交流场景中的信息问题,提出对抗性社会认识论,借助语言、机制及基于认知网络的 machinery 来分析、破坏信任并审计纠正信任违规。

Comments 50 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08326 2026-07-10 cs.CY 新提交 82%

Diagnosing and Repairing Persona Collapse in LLM Advice

诊断和修复大语言模型建议中的角色崩塌

Harsh Kumar, Karina Vold, Louis Tay, Ashton Anderson

专题命中 效率与部署 :LLM(title);post-training(abstract);prompting(abstract)

AI总结 研究大语言模型建议中的角色崩塌问题,提出逆过程蒸馏方法,将情境到角色的策略提炼出来进行训练,减少与人类角色分布的差异,但在盲测中发现多数经验丰富的建议者更青睐崩塌的默认回复。

Comments Working draft

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08180 2026-07-10 cs.CR cs.AI 新提交 81%

Out of Sight: Compression-Aware Content Protection against Agentic Crawlers

视线之外:针对智能爬虫的压缩感知内容保护

Xuefei Wang

机构 * Beihang University(北航大学)

专题命中 效率与部署 :LLM(summary_cn,abstract);分类 cs.AI

AI总结 研究基于LLM的智能体给在线内容带来的新威胁,提出CAPE框架,通过注入不可见扰动保护文本内容,在低查询预算下有效提升信息损失,实验证明其有效性与通用性,推动智能体时代内容保护研究。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07847 2026-07-10 cs.LG 新提交 81%

When Does Continual Learning Require Learning

持续学习何时需要学习

Anne Harrington, Nayan Saxena, Michael Murphy, Anastasia Borovykh, Zeyu Yun, Sridhar Kamath, Ara Eindra Kyi, Trevor Darrell, Jitendra Malik, Yutong Bai

机构 * UC Berkeley(加州大学伯克利分校) Capital Fund Management(资本基金管理公司)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);SFT(abstract)

AI总结 研究大语言模型持续学习问题,从空间和时间轴分解变化,通过重新设置基准和引入协议评估多种方法,发现持续学习非单一能力,不同环境变化需不同更新行为,为设计更强持续学习系统提供指导。

Comments Code: https://github.com/anneharrington/studying-cl. Project page: https://anneharrington.github.io/studying-cl/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24477 2026-07-10 cs.CV cs.AI cs.SD 新提交 81%

video-SALMONN-R$^3$: Learning to ReWatch, ReAsk, and ReAnswer for Efficient Video Understanding

video-SALMONN-R$^3$: 学习重看、重问和重答以实现高效视频理解

Yixuan Li, Guangzhi Sun, Yudong Yang, Chao Zhang

机构 * Tsinghua University(清华大学) ByteDance(字节跳动) University of Cambridge(剑桥大学)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);SFT(abstract)

AI总结 提出video-SALMONN-R$^3$,首个通过强化学习实现重看机制的视频大语言模型,无需链式思维冷启动,采用重答和重问策略提升视频问答效率与准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08529 2026-07-10 cs.IR 新提交 80%

Log-Insight: Automating Microservice Incident Diagnosis via Neuro-Symbolic Log Analysis

Log-Insight:通过神经符号日志分析实现微服务事件诊断自动化

Carlos Garcia-Hernandez, Aymane Abdali, Guangyu Wu, Mingxue Wang, Fei Shen, Zhaoyu Pang, Yanbin Zhang

专题命中 效率与部署 :LLM(summary_cn,abstract)

AI总结 研究针对大规模微服务系统生产事件诊断难题,提出Log-Insight系统,通过自动化SRE手动分类工作流程,经符号阶段处理后为LLM提供证据合成假设报告,六阶段管道减少大量原始事件,评估显示该系统能高效准确诊断根本原因,还报告了相关故障模式等内容。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.05240 2026-07-10 cs.RO cs.CV 版本更新 80%

StreamVLN: Streaming Vision-and-Language Navigation via SlowFast Context Modeling

StreamVLN:通过快慢上下文建模实现流式视觉与语言导航

Meng Wei, Chenyang Wan, Xiqian Yu, Tai Wang, Yuqiang Yang, Xiaohan Mao, Chenming Zhu, Wenzhe Cai, Hanqing Wang, Yilun Chen, Xihui Liu, Jiangmiao Pang

机构 * Shanghai AI Lab(上海人工智能实验室) The University of Hong Kong(香港大学) Zhejiang University(浙江大学) Shanghai Jiao Tong University(上海交通大学)

专题命中 效率与部署 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 研究现实世界中视觉与语言导航问题,提出StreamVLN框架,采用混合快慢上下文建模策略,通过快速流式对话上下文与缓慢更新内存上下文配合,实现实时对话,在VLN-CE基准实验中展现低延迟最优性能。

Comments Accepted to ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.09016 2026-07-10 cs.RO 版本更新 80%

Open-Vocabulary Object-Goal Navigation by Generalizing Semantic Mapping with Dense CLIP

通过用密集CLIP泛化语义映射实现开放词汇目标导航

Meng Wei, Chenyang Wan, Tai Wang, Yuqiang Yang, Wenzhe Cai, Yilun Chen, Hanqing Wang, Jiangmiao Pang, Xihui Liu

机构 * Shanghai AI Lab(上海人工智能实验室) The University of Hong Kong(香港大学) Zhejiang University(浙江大学)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);foundation model(abstract)

AI总结 研究面向对象的实体导航任务,提出OVExp框架,利用密集CLIP模型展示基于语义地图的目标预测网络泛化能力,设计跨模态转移策略解决训练成本高问题,在ObjectNav基准上对未知目标有强大泛化能力。

Comments Accepted by ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11530 2026-07-10 cs.CV cs.AI 版本更新 79%

Beyond Attention Scores: SVD-Based Vision Token Pruning for Efficient Vision-Language Models

超越注意力分数:基于SVD的视觉令牌修剪用于高效视觉-语言模型

Yvon Apedo, Martyna Poreba, Michal Szczepanski, Samia Bouchafa

机构 * anoncvlab(匿名计算机视觉实验室)

专题命中 效率与部署 :language model(title,abstract);分类 cs.AI

AI总结 本文提出SVD-Prune方法,通过SVD分解视觉令牌特征矩阵并利用统计杠杆分数选择顶级令牌,以在极端视觉令牌预算下保持高性能,优于现有修剪方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08662 2026-07-10 cs.CL cs.AI cs.MA 新提交 79%

WebSwarm: Recursive Multi-Agent Orchestration for Deep-and-Wide Web Search

WebSwarm:用于深度和广度网络搜索的递归多智能体编排

Xiaoshuai Song, Liancheng Zhang, Kangzhi Zhao, Yutao Zhu, Zhongyuan Wang, Guanting Dong, Jinghan Yang, Han Li, Kun Gai, Ji-Rong Wen, Zhicheng Dou

机构 * Kuaishou(快手)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 研究基于大语言模型的网络搜索任务,提出WebSwarm递归多智能体编排框架,在推理时联合构建任务分解等,动态实例化搜索节点,通过实验证明其在深度、广度等任务上优于基线,分析多种因素解释其有效性并为多智能体搜索提供见解。

Comments Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08766 2026-07-10 cs.CV 新提交 78%

OPSD-V: On-Policy Self-Distillation for Post-Training Few-Step Autoregressive Video Generators

OPSD-V:用于训练后少步自回归视频生成器的策略内自蒸馏

Hongyu Liu, Chun Wang, Feng Gao, Xuanhua He, Yue Ma, Ziyu Wan, Yong Zhang, Xiaoming Wei, Qifeng Chen

机构 * Meituan(美团) HKUST(香港科技大学) City University of Hong Kong(香港城市大学)

专题命中 效率与部署 :post-training(title,abstract)

AI总结 研究针对训练后少步自回归视频生成器存在的问题,提出OPSD-V策略内自蒸馏范式。通过引入真实长视频数据提供监督,学生和教师模型按特定方式运行,应用该范式于相关模型后,实验及用户研究表明其在多方面有改进且更受青睐。

Comments Project page: https://meigen-ai.github.io/OPSD-V ; Code: https://github.com/MeiGen-AI/OPSD-V

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.16456 2026-07-10 cs.CV 版本更新 78%

PhyMAGIC: Physical Motion-Aware Generative Inference with Confidence-guided LLM

PhyMAGIC:基于置信度引导的大语言模型的物理运动感知生成推理

Siwei Meng, Yawei Luo, Ping Liu

机构 * Department of Computer Science \& Engineering, University of Nevada, Reno, USA School of Software Technology, Zhejiang University, China

专题命中 效率与部署 :LLM(title,abstract)

AI总结 针对3D内容生成中动态模型物理一致性问题,PhyMAGIC提出无需训练的框架,整合图像到视频扩散模型、大语言模型置信度引导推理及可微物理模拟器,通过迭代优化和模拟反馈生成物理一致的运动,性能优于现有方法。

Comments This work is accepted by ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08734 2026-07-10 cs.AI 新提交 77%

The Illusion of Equivalency: Statistical Characterization of Quantization Effects in LLMs

等效性错觉:大语言模型量化效应的统计表征

Baha Rababah, Cuneyt Gurcan Akcora, Carson K. Leung

机构 * University of Manitoba(曼尼托巴大学) Red River College Polytechnic(红河理工学院) University of Central Florida(中佛罗里达大学)

专题命中 效率与部署 :large language model(abstract);language model(abstract);post-training(abstract);分类 cs.AI

AI总结 研究大语言模型量化效应,引入正确性一致性指标,发现适度量化下有行为差异,通过分析量化为结构算子及量化失真,揭示低比特宽度非线性断点等,促使超越传统指标评估行为。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22448 2026-07-10 cs.LG cs.CL 版本更新 76%

HeaPA: Difficulty-Aware Heap Sampling and On-Policy Query Augmentation for LLM Reinforcement Learning

HeaPA:用于大语言模型强化学习的难度感知堆采样和策略内查询增强

Weiqi Wang, Xin Liu, Binxuan Huang, Hejie Cui, Rongzhi Zhang, Changlong Yu, Shuowei Jin, Jingfeng Yang, Qingyu Yin, Zhengyang Wang, Zheng Li, Yifan Gao, Priyanka Nigam, Bing Yin, Lihong Li, Yangqiu Song

机构 * Stores Foundational AI, Amazon Inc.(亚马逊公司基础人工智能部) Department of Computer Science and Engineering, HKUST(香港科技大学计算机科学与工程系)

专题命中 效率与部署 :LLM(title);分类 cs.CL、cs.LG

AI总结 研究大语言模型强化学习中提示采样问题,提出HeaPA方法,通过难度感知堆采样和策略内查询增强,维持动态提示池,跟踪能力前沿,在多数据集和基准测试中提升准确率,减少计算量,尤其在中大型模型规模下效果显著。

Comments COLM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏