arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 74 信号源:cs.CV, cs.GR, cs.MM

1. 个性化与一致性 74 篇

2608.13925 2026-08-17 cs.LG cs.AI cs.CL 新提交 50%

CForce: Boosting Parallel Decoding for dLLMs via Consistency Forcing

CForce:通过一致性强制提升扩散大语言模型(dLLMs)的并行解码性能

Yuji Ren, Chenkai Xu, Zhuocheng Gong, Jianguo Li, Zhijie Deng

机构 * Shanghai Jiao Tong University(上海交通大学) Ant Group(蚂蚁集团)

专题命中 个性化与一致性 :diffusion(abstract)

AI总结 本文提出CForce方法,通过一致性强制提升dLLMs的并行解码性能,在LLaDA模型上实验证实其在高并行解码预算下可优化速度-质量权衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02828 2026-08-05 math.ST math.PR q-fin.ST stat.TH 新提交 50%

Proper-score observation-driven filters: local geometry, estimation, and continuous-time limits

恰当评分观测驱动滤波器:局部几何、估计与连续时间极限

Giulia Livieri, Gianluca Palmari

专题命中 个性化与一致性 :diffusion(abstract)

AI总结 该研究提出基于恰当评分规则的观测驱动滤波器,推导其局部动力学、渐近性质与连续时间极限,通过实验验证其在金融收益数据中的应用,为误设下的观测驱动滤波提供准则框架。

Comments 88 pages, 12 figures, 25 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27512 2026-07-31 cs.CL cs.MA cs.SI 新提交 50%

Belief Coevolution in a Social Network of Generalist and Specialist Large Language Models

通用型与专家型大语言模型组成的社交网络中的信念协同演化

Germans Savcisens, Samantha Dies, Courtney Maynard, Tina Eliassi-Rad

机构 * Khoury College of Computer Sciences, Northeastern University(东北大学库尔计算机科学学院) Network Science Institute, Northeastern University(东北大学网络科学研究所) Santa Fe Institute(圣塔菲研究所)

专题命中 个性化与一致性 :diffusion(abstract)

AI总结 该研究提出CoevolveSim框架,模拟通用型与专家型LLM组成的社交网络中信念扩散,发现专家型LLM可显著提升共识转变幅度,模拟多智能体LLM系统信念扩散需多样化底层LLM。

Comments 33 pages (14 pages of main text), 7 figures, 14 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22637 2026-07-28 cs.AI cs.IT math.IT 新提交 50%

Fast Cross-Scenario Adaptation of CSI Models via Channel Conditional Parameter Generation

通过信道条件参数生成实现CSI模型的快速跨场景自适应

Xudong Zou, Siyu Wu, Zunlei Feng, Jie Song, Yuanyu Wan, Mingli Song, Jiacong Hu

机构 * School of Software Technology, Zhejiang University(浙江大学软件学院) State Key Laboratory of Blockchain and Data Security, Zhejiang University Hangzhou High-Tech Zone (Binjiang) Institute of Blockchain and Data Security(浙江大学杭州高新技术产业开发区(滨江)区块链与数据安全国家重点实验室)

专题命中 个性化与一致性 :diffusion(abstract)

AI总结 研究针对CSI模型在不同场景适应性差的问题,提出CCPG方法,通过组件冻结实验识别瓶颈,生成轻量级LoRA权重,经多种技术处理实现快速跨场景自适应,实验表明该方法能高效部署CSI模型用于6G通信。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21620 2026-07-27 cs.AI 新提交 50%

From Profiles to Steering Vectors: Global Sparse Priors and Local Semantic Calibration for Personalized Text Generation

从概要到导向向量:用于个性化文本生成的全局稀疏先验和局部语义校准

Liuji Chen, Zeyu Zhang, Xinyuan Zhang, Shuai Nie, Qiang Liu, Shu Wu, Liang Wang

机构 * NLPR, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所模式识别国家重点实验室) Xiaomi(小米)

专题命中 个性化与一致性 :personalized generation(abstract)

AI总结 研究个性化文本生成问题,提出无训练框架GLASS,通过全局-局部激活导向与稀疏先验实现。利用稀疏自动编码器提取全局先验、构建局部向量,推理时注入模型层。实验证明其性能优于基线,能更好分离风格与语义信息。

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20127 2026-07-23 cs.CL 新提交 50%

Back to Back with a Copy: A Computational Analysis of AI-Generated Visual Contemporary Art Pastiches

与仿作并肩:人工智能生成的视觉当代艺术模仿作品的计算分析

Anca Dinu, Andreiana Mihail, Andra-Maria Florescu, Claudiu Creanga, Liviu Dinu

机构 * University of Bucharest(布加勒斯特大学)

专题命中 个性化与一致性 :image generation(abstract)

AI总结 本文研究更新的生成模型模仿当代艺术作品的能力及不同语言模型中风格评估的多维度一致性。利用五个计算机视觉模型,通过余弦距离捕捉多种特征,对比新旧模型。结果显示新模型语义对齐改进、多样性增加,但浅层特征表现稍弱,还通过艺术家反馈进行情境化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15643 2026-07-20 math.NA cs.NA 新提交 50%

Penalty-scaling effects in nonsymmetric interior-penalty DG discretizations of viscous rotating shallow-water equations

粘性旋转浅水方程非对称内罚 DG 离散化中的罚标度效应

Xue Zhang, Jingmin Xia, Xu Qian

专题命中 个性化与一致性 :diffusion(abstract)

AI总结 研究粘性旋转浅水方程非对称内罚 DG 离散化中内罚参数标度的影响,通过局部 Lax--Friedrichs 通量近似双曲项,比较$\beta = 1$和$\beta = 3$,建立相关性质,经测试表明标准标度在精度-成本折衷上表现更好。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10820 2026-07-14 stat.ME 新提交 50%

Causal Estimation of Share-Induced Engagement with Flywheel Effects

基于飞轮效应的分享诱导参与度的因果估计

Weitao Cheng, Yilin Li, Yong Wang, Nian Si

专题命中 个性化与一致性 :diffusion(abstract)

AI总结 研究在线平台分享功能的飞轮效应,开发考虑干扰的实验框架,提出基于流量平衡恒等式的估计器,降低偏差,建立A/A测试程序,扩展到用户级指标,并用真实平台验证方法。

Comments Accepted by KDD 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25169 2026-07-02 math.ST cs.LG stat.TH 新提交 50%

Laplace-Fisher Gate Identities for Optimal Matrix-Gated Blended Score Estimation

Laplace--Fisher 门恒等式用于最优矩阵门控混合得分估计

Alois Duston, Tan Bui-Thanh

机构 * The Oden Institute for Computational Engineering and Sciences(奥登计算工程与科学研究院) The University of Texas at Austin(德克萨斯大学奥斯汀分校) The Department of Aerospace Engineering & Engineering Mechanics(航空航天工程与机械系)

专题命中 个性化与一致性 :diffusion(abstract)

AI总结 针对非归一化目标采样中的得分估计问题,提出矩阵值门控混合得分估计方法,推导出方差最优门公式(Laplace-Fisher 门恒等式),并证明有限参考一致性,应用于贝叶斯逆问题的归一化密度评估。

Comments Provisional report

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26618 2026-06-26 cs.CL 新提交 50%

Closing the Quality Gap in Low-Resource Text-to-Speech: LoRA Fine-Tuning of VoxCPM2 for Khmer and Korean

缩小低资源文本转语音的质量差距:针对高棉语和韩语的VoxCPM2 LoRA微调

Phannet Pov, Sovandara Chhoun, Hyun Woo Park, Wan-Sup Cho, Saksonita Khoeurn

机构 * Department of Big Data, Chungbuk National University(Chungbuk National University大数据系) Institute of Digital Research and Innovation, Cambodia Academy of Digital Technology(柬埔寨数字技术研究院) Department of Management Information Systems, Chungbuk National University(Chungbuk National University管理信息系) BigData Labs Co., Ltd.(BigData Labs公司)

专题命中 个性化与一致性 :diffusion(abstract)

AI总结 针对高棉语和韩语,使用LoRA微调VoxCPM2模型,在仅训练0.19%-3.03%参数的情况下,高棉语MOS从3.85提升至4.23,而韩语无提升,表明适配主要帮助基础模型表现差的语言。

Comments 5 pages, 1 figure, 4 tables. IEEE conference format (IEEEtran)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22361 2026-06-23 cs.CL cs.AI 新提交 50%

First-Token Broadcasters: Mechanistic Origins of Language Identity and Distributed Robustness in Transformers

首个令牌广播者:Transformer中语言身份与分布式鲁棒性的机制起源

Arjun Pillai, Christian Hoang, Anjelo Jann Laroza

机构 * Irvington High School(欧文顿高中) GenAI4E Mapua University(马普阿大学)

专题命中 个性化与一致性 :diffusion(abstract)

AI总结 通过因果干预方法LIHA,发现Transformer中少量注意力头(如GPT-2的L6H1)持续关注首个令牌并广播语言信号,且消融后补偿呈现层级前馈模式;指令微调将语言身份电路重组至早期层。

Comments Under review at BlackboxNLP (EMNLP 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20532 2026-06-19 cs.AI 新提交 50%

How Do Instructions Shape Speech? Cross-Attention Attribution for Style-Captioned Text-to-Speech

指令如何塑造语音?面向风格描述文本到语音的交叉注意力归因

Nityanand Mathur, Hamees Sayed, Wasim Madha, Apoorv Singh, Sameer Khurana, Akshat Mandloi, Sudarshan Kamath

专题命中 个性化与一致性 :diffusion(abstract)

AI总结 提出交叉注意力归因方法,分析风格描述文本到语音系统中单词对声学输出的影响,发现风格标记在早期步骤和深层注意力峰值,且与基频和能量相关。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15148 2026-06-17 cs.RO cs.AI 新提交 50%

MimicIK: Real-Time Generative Inverse Kinematics from Teleoperation with FK Consistency

MimicIK: 基于遥操作且保持正运动学一致性的实时生成式逆运动学

Jiahao Yang, Shenhao Yan, Fan Feng, Chengsi Yao, Ge Wang, Zhixin Mai, Yiming Zhao, Yatong Han

机构 * Ising AI CUHK-Shenzhen(香港中文大学(深圳))

专题命中 个性化与一致性 :diffusion(abstract)

AI总结 提出MimicIK框架,利用条件流匹配从遥操作数据学习平滑鲁棒的关节空间运动先验,通过两阶段迭代优化和正运动学一致性损失实现实时逆运动学求解,在6-DOF机器人数据集上达到4.65mm位置误差和92.01%成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10126 2026-06-10 cs.CL cs.AI cs.CY cs.LG 新提交 50%

Pareto-Guided Teacher Alignment for Fair Personalized Text Generation

帕累托引导的教师对齐用于公平个性化文本生成

Tunazzina Islam

机构 * Purdue University(普渡大学)

专题命中 个性化与一致性 :personalized generation(abstract)

AI总结 提出帕累托引导的教师对齐框架,通过修订候选生成、对感知可行性门控、帕累托候选选择和偏好优化,在减少人口统计差异的同时保持个性化保真度,实验表明公平缓解效果依赖于目标且跨域迁移不一致。

详情

展开后加载摘要…

URL PDF HTML 收藏