arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of Texas at Austin(得克萨斯大学奥斯汀分校)

2026-04-20 至 2026-04-20 共收录 4
2603.03188 2026-04-20 stat.ML cs.LG

Scalable Posterior Uncertainty for Flexible Density-Based Clustering

可扩展的后验不确定性用于灵活的密度基于聚类

Nicola Bariletto, Stephen G. Walker

机构 * Department of Statistics and Data Sciences, UT Austin(统计与数据科学系,德克萨斯大学奥斯汀分校)

AI总结 本文提出一种结合martingale后验分布与密度聚类的新框架,通过预测重采样方案实现密度不确定性量化,利用可微密度估计器提升大规模数据处理效率,并在图像和单细胞RNA测序数据中验证了其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05201 2026-04-20 cs.CV cs.AI cs.CL

Mechanisms of Prompt-Induced Hallucination in Vision-Language Models

视觉-语言模型中提示诱导幻觉的机制

William Rudman, Michal Golovanevsky, Dana Arad, Yonatan Belinkov, Ritambhara Singh, Carsten Eickhoff, Kyle Mahowald

机构 * The University of Texas at Austin(德克萨斯大学奥斯汀分校) Brown University(布朗大学) Technion(技术学院) University of Tübingen(图宾根大学) Harvard University(哈佛大学)

AI总结 研究揭示了视觉-语言模型在提示诱导幻觉中的机制,通过分析三种模型发现特定注意力头可显著减少幻觉现象,揭示了模型对提示的响应差异。

Comments ACL 2026 Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.07173 2026-04-20 cs.LG

Improving the Throughput of Diffusion-based Large Language Models via a Training-Free Confidence-Aware Calibration

通过训练无关的置信度感知校准提高扩散式大语言模型的吞吐量

Jucheng Shen, Gaurav Sarkar, Yeonju Ro, Sharath Nittur Sridhar, Zhangyang Wang, Aditya Akella, Souvik Kundu

机构 * Rice University(里士大学) Intel(英特尔) The University of Texas at Austin(德克萨斯大学奥斯汀分校)

AI总结 本文提出CadLLM,一种无需训练的加速扩散式大语言模型(dLLMs)推理吞吐量的方法。通过动态调整生成块大小、步长和阈值,结合置信度控制,减少softmax开销,提升吞吐量。

Comments 12 pages, 3 figures. Accepted to Findings of ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.16315 2026-04-20 cs.CV cs.CL

SignX: Continuous Sign Recognition in Compact Pose-Rich Latent Space

SignX:在紧凑的姿态丰富潜在空间中实现连续手语识别

Sen Fang, Yalin Feng, Chunyu Sui, Hongbin Zhong, Yanxin Zhang, Hongwei Yi, Hezhen Hu, Dimitris N. Metaxas

机构 * Rutgers University(罗格斯大学) Nanyang Technological University(南洋理工大学) Columbia University(哥伦比亚大学) Georgia Institute of Technology(佐治亚理工学院) University of Wisconsin--Madison(威斯康星大学麦迪逊分校) Max Planck Institute for Intelligent Systems(马克斯·普朗克智能系统研究所) University of Texas at Austin(德克萨斯大学奥斯汀分校)

AI总结 本文提出SignX框架,通过统一潜在表示和ViT模型实现高效连续手语识别,显著降低计算消耗并在翻译任务中达到SOTA准确率。

Comments 33 pages, CSLR SOTA (2026). More demo at https://signerx.github.io/SignX/

详情

展开后加载摘要…

URL PDF HTML 收藏