arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

共收录 212
2606.27320 2026-06-29 cs.SD cs.LG eess.AS 新提交

Elastic Time: Dynamic Frame Rate Bottlenecks for Neural Audio Coding

弹性时间:神经音频编码的动态帧率瓶颈

Dimitrios Bralios, Paris Smaragdis, Minje Kim

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Massachusetts Institute of Technology(麻省理工学院)

AI总结 提出弹性时间方法,通过轻量级潜在预测器实现动态帧率瓶颈,将固定帧率自编码器转换为动态帧率,在推理时高效选择边界,提升效率-质量权衡。

Comments Interspeech 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26592 2026-06-26 cs.CE cs.LG 新提交

Latent Diffusion Posterior Sampling with Surrogate Likelihood Guidance for PDE Inverse Problems

基于代理似然引导的潜空间扩散后验采样用于PDE逆问题

Yuanzhe Wang, Alexandre M. Tartakovsky

机构 * Department of Civil and Environmental Engineering(土木与环境工程系) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

AI总结 提出L-DPS框架,结合VAE、潜扩散模型和可微代理,高效求解PDE逆问题,在达西流逆问题中优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26547 2026-06-26 cs.PL cs.CL cs.PF 新提交

Compiler-Driven Approximation Tuning for Hyperdimensional Computing

编译器驱动的超维计算近似调优

Xavier Routh, Abdul Rafae Noor, Akash Kothari, Zheyu Li, Mahbod Afarin, Tajana Rosing, Vikram Adve

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) University of California San Diego(加州大学圣迭戈分校)

AI总结 提出ApproxHDC框架,通过编译器自动识别和应用超维计算中的领域特定近似,结合高效搜索与多硬件后端支持,实现性能大幅提升且精度损失极小。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26432 2026-06-26 cs.LG econ.EM 新提交

Embedding Foundation Model Predictions in Discrete-Choice Models with Structural Guarantees

具有结构保证的嵌入基础模型预测的离散选择模型

Yingshuo Wang, Xian Sun, Yanhang Li, Zhichao Fan, Zexin Zhuang

机构 * University of California, Berkeley(加州大学伯克利分校) Duke University(杜克大学) Northeastern University(东北大学) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Southern Methodist University(南卫理公会大学)

AI总结 提出两阶段适配器,将基础模型的预测嵌入多项Logit效用中,通过符号约束保持边际替代率,在三个数据集上平均提升6.4个百分点准确率,并保证成本单调性和合理时间价值。

Comments Extends arXiv:2605.26559 (ICML 2026 FMSD Workshop)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26356 2026-06-26 cs.AI cs.IR cs.MA 新提交

Instruction Bleed: Cross-Module Interference in Prompt-Composed Agentic Systems

指令泄露:提示组合智能体系统中的跨模块干扰

Ching-Yu Lin, Yifan Liu

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) FAGEN

AI总结 研究提示组合智能体系统中模块间干扰问题,形式化定义为组合行为泄露(CBL),通过三通道协议实验验证内容通道产生可检测效应,贡献了操作定义、可复用协议和系统类特征。

Comments 8 pages, 2 tables. Accepted to the ICML 2026 Workshop on Failure Modes in Agentic AI (FAGEN), Seoul, South Korea

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26344 2026-06-26 cs.PL cs.CL cs.PF 新提交

Axon: A Synthesizing Superoptimizer for Tensor Programs

Axon:张量程序的综合超优化器

Akash Kothari, Shaowei Zhu, Daniel Kroening, Chungha Sung

机构 * University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Amazon Web Services(亚马逊网络服务)

AI总结 提出Axon,一种通过程序综合自动生成目标指令并探索语义等价变体以选择最佳性能内核的张量程序超优化器,利用SMT保证变换语义正确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20869 2026-06-26 cs.AR cs.AI 新提交

A3C3: AI Algorithm and Accelerator Co-design, Co-search, and Co-generation

A3C3:人工智能算法与加速器协同设计、协同搜索与协同生成

Selin Yildirim, Yingbing Huang, Deming Chen

机构 * Siebel School of Computing and Data Science(塞比尔计算与数据科学学院) Department of Electrical and Computer Engineering(电气与计算机工程系) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

AI总结 提出A3C3方法,通过联合参数化并搜索神经网络架构与硬件实现空间,自动生成模型-加速器对,以平衡精度、延迟、吞吐量、能效和硬件利用率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18394 2026-06-26 cs.CL 新提交

JetSpec: Breaking the Scaling Ceiling of Speculative Decoding with Parallel Tree Drafting

JetFlow: 通过并行树草稿突破推测解码的缩放上限

Lanxiang Hu, Zhaoxiang Feng, Yulun Wu, Haoran Yuan, Yujie Zhao, Yu-Yang Qian, Bojun Wang, Peng Zhao, Daxin Jiang, Yibo Zhu, Tajana Rosing, Hao Zhang

机构 * UC San Diego(加州大学圣地亚哥分校) Zhejiang University(浙江大学) UIUC(伊利诺伊大学厄巴纳-香槟分校) Nanjing University(南京大学) StepFun(阶跃星辰)

AI总结 提出JetFlow框架,通过因果并行草稿头结合树推测解码,将更大草稿预算转化为更长接受前缀和更高端到端加速,在Qwen3模型上实现最高9.64倍加速。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25178 2026-06-25 cs.AI 新提交

Transferability for General Reasoning: An Automated Curriculum for Multi-Domain RLVR

通用推理的可迁移性:多领域RLVR的自动课程

Yongjin Yang, Jiarui Liu, Yinghui He, Lechen Zhang, Bernhard Schölkopf, Zhijing Jin

机构 * Jinesis Lab, University of Toronto & Vector Institute(Jinesis实验室,多伦多大学与向量研究所) Carnegie Mellon University(卡内基梅隆大学) Princeton University(普林斯顿大学) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) ELLIS Institute Tübingen(ELLIS研究所图宾根) Max Planck Institute for Intelligent Systems(马克斯·普朗克智能系统研究所) EuroSafeAI

AI总结 提出迁移感知课程(TAC),利用优势信号和投影梯度估计跨领域可迁移性,在多领域推理套件上实现最佳平均准确率。

Comments 32 pages, including supplementary material; code available at https://github.com/YangYongJin/transfer-aware-curriculum

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24712 2026-06-24 cs.RO cs.AI 新提交

TACTFUL: Tactile-Driven Exploration For Object Localization and Identification in Confined Environments

TACTFUL: 受限环境中的触觉驱动探索用于物体定位与识别

Shivani Kamtikar, Chung Hee Kim, Camilla Tabasso, Tye Brady, Joshua Migdal, Taskin Padir

机构 * Amazon Fulfillment Technologies & Robotics(亚马逊履约技术与机器人) Siebel School of Computing and Data Science, University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校西贝尔计算与数据科学学院) Robotics Institute, Carnegie Mellon University(卡内基梅隆大学机器人研究所)

AI总结 提出无视觉触觉探索框架TACTFUL,使多指机器人通过动态奖励策略平衡全局探索与局部表面细化,实现物体自主发现与识别,平均重建误差0.015米,成功率77%。

Comments IROS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24669 2026-06-24 cs.AI 新提交

LaGO: Latent Action Guidance for Online Reinforcement Learning

LaGO:面向在线强化学习的潜在动作引导

Kuan-Yen Liu, Ren-Jyun Huang, Ti-Rong Wu

机构 * Siebel School of Computing(计算科学系) Data Science, University of Illinois Urbana-Champaign, USA(数据科学,伊利诺伊大学厄巴纳-香槟分校,美国) Department of Computer Science, National Yang Ming Chiao Tung University, Taiwan(计算机科学系,National Yang Ming Chiao Tung大学,台湾) Institute of Information Science, Academia Sinica, Taiwan(信息科学研究所, Academia Sinica,台湾)

AI总结 提出LaGO框架,利用预训练大语言模型作为潜在动作先验,软引导在线策略优化,在离散和连续控制基准上显著提升奖励与成功率。

Comments 9 pages, 2 figures. Accepted at the ICML 2026 Workshop on Large Language Models for Planning (LM4Plan)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24256 2026-06-24 cs.CV 新提交

Trimming the Long-Tail of Visual World Modeling Evaluation

修剪视觉世界建模评估的长尾

Bingxuan Li, Yining Hong, Cheng Qian, Hyeonjeong Ha, Jiateng Liu, Zhenhailong Wang, Yue Guo, Yunzhu Li, Heng Ji

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Stanford University(斯坦福大学) Columbia University(哥伦比亚大学)

AI总结 针对视觉世界模型在罕见物理交互上泛化不足的问题,提出Tailor-Bench基准,通过常规、非常规和不可能三种场景模式系统评估模型推理能力,揭示长尾性能差距。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18478 2026-06-24 cs.CV 新提交

Data-Forcing Distillation: Restoring Diversity and Fidelity in Few-Step Video Generation

数据强制蒸馏:恢复少步视频生成中的多样性和保真度

Siyi Chen, Shaowei Liu, Yixuan Jia, Zian Wang, Huan Ling, Qing Qu, Jun Gao

机构 * University of Michigan(密歇根大学) NVIDIA(英伟达) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

AI总结 针对分布匹配蒸馏(DMD)在少步视频生成中出现的模式坍塌和过饱和问题,提出数据强制蒸馏(DFD)框架,通过教师评分差异引导学生接近真实数据分布,仅需一行代码修改即可恢复多样性和保真度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23453 2026-06-23 cs.LG 新提交

Do Location Encoders Capture Spatial Effects? A GeoShapley Benchmark Across Scales

位置编码器能否捕捉空间效应?跨尺度的GeoShapley基准测试

Daniel Kiv, Shaowen Wang

机构 * Siebel School of Computing \& Data Science, University of Illinois Urbana-Champaign Urbana IL USA Department of Geography \& GIS Siebel School of Computing \& Data Science, University of Illinois Urbana-Champaign

AI总结 通过GeoShapley解释器,评估11种位置编码器在不同尺度下从嵌入中恢复空间变化系数的能力,发现主系数恢复稳定,次系数依赖尺度,原始坐标基线始终有竞争力。

Comments 4 pages, 2 figures, 2 tables, Submitted to SIGSPATIAL '26 short papers

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23155 2026-06-23 cs.GT cs.LG 新提交

Neural Parameter Calibration for Finite-State Mean Field Games

有限状态平均场博弈的神经参数校准

Anna C. M. Thöni, Grégoire Lambrecht, Gökçe Dayanıklı, Yonathan Efroni, Tal Kachman, Mathieu Laurière

机构 * Radboud University(拉德堡德大学) New York University(纽约大学) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Tel Aviv University(特拉维夫大学) New York University Shanghai(纽约大学上海)

AI总结 提出基于神经网络框架,通过隐式微分反向传播均衡,从观测群体动力学中学习有限状态平均场博弈的参数,无需个体动作或奖励数据。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22864 2026-06-23 cs.LG 新提交

When AUC 0.998 Is Not Enough: A Candidate Evaluation Protocol for Hidden-State Probes of Indirect Prompt Injection in Multimodal Computer-Use Agents

当AUC 0.998还不够:多模态计算机使用智能体中隐藏状态探针对间接提示注入的候选评估协议

Yanhang Li, Zhichao Fan, Zexin Zhuang

机构 * Northeastern University(东北大学) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Southern Methodist University(南卫理公会大学)

AI总结 本文通过单骨干案例研究,论证高AUC不能直接证明恶意内容检测,提出后验诊断和候选控制集来明确探针能力的边界。

Comments 17 pages, 3 figures. Camera-ready version for EvalMG '26, The 2nd Workshop on Evaluation for Multimodal Generation, co-located with SIGIR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22862 2026-06-23 cs.CV cs.LG 新提交

Chains That See, Answers That Don't: A Multi-Aspect Evaluation Recipe for Forced Chain-of-Thought on Video-MME

看得见的链,答不出的答案:针对视频MME上强制思维链的多方面评估方案

Zhichao Fan, Yanhang Li, Zexin Zhuang

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Northeastern University(东北大学) Southern Methodist University(南卫理公会大学)

AI总结 提出三探针评估方案检验强制思维链在视频问答中的可靠性,应用于Qwen2.5-VL发现思维链强依赖视频但未提升准确率,甚至在小模型上导致下降。

Comments 10 pages, 5 figures. To appear at The 2nd Workshop on Evaluation for Multimodal Generation @ SIGIR 2026 (EvalMG '26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22664 2026-06-23 cs.CE cs.LG 新提交

From Complaint Narratives to Monetary Relief: A Hybrid Machine Learning Framework for CFPB Consumer Complaints

从投诉叙述到金钱救济:面向CFPB消费者投诉的混合机器学习框架

Zhuoer Wang, Sizhen Zhu, Xiongyu Chen

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) North Carolina State University(北卡罗来纳州立大学) Carnegie Mellon University(卡内基梅隆大学)

AI总结 提出混合机器学习框架,利用投诉文本、主题表示和结构化特征预测消费者金融保护局投诉中的金钱救济结果,AUC-ROC从0.69提升至0.78。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22388 2026-06-23 cs.AI cs.CL 新提交

PlanBench-XL: Evaluating Long-Horizon Planning of LLM Tool-Use Agents in Large-Scale Tool Ecosystems

PlanBench-XL:评估大规模工具生态系统中LLM工具使用智能体的长时程规划能力

Jiayu Liu, Qihan Lin, Cheng Qian, Rui Wang, Emre Can Acikgoz, Xiaocheng Yang, Jiateng Liu, Zhenhailong Wang, Xiusi Chen, Heng Ji, Dilek Hakkani-Tür

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

AI总结 提出PlanBench-XL基准,包含327个零售任务和1665个工具,测试LLM智能体在检索受限工具环境下的长时程规划能力,实验表明GPT-5.4在无阻塞下准确率51.90%,严重阻塞下降至11.36%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21886 2026-06-23 cs.HC cs.AI cs.CL cs.CY 新提交

AI-Mediated Negotiation: Design Reflections and Lessons

AI中介谈判:设计反思与经验教训

Veda Duddu, Jash Rajesh Parekh, Andy Mao, Hanyi Min, Ziang Xiao, Vedant Das Swain, Koustuv Saha

机构 * University of Illinois Urbana Champaign(伊利诺伊大学厄巴纳-香槟分校) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Johns Hopkins University(约翰霍普金斯大学) New York University(纽约大学)

AI总结 通过构建理论驱动的教练系统Trucey并进行实验,发现对话AI在谈判准备中施加线性执行模型,而任务本质是递归的,静态手册反而优于AI条件,提出“先映射后路径,先路径后模拟”的序列原则。

Journal ref CSCW Companion '26: Companion Publication of the 2026 Conference on Computer-Supported Cooperative Work and Social Computing

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21792 2026-06-23 cs.RO cs.AI 新提交

THREAD: Trajectory Planning for Hybrid Rigid-Soft Manipulators with Environment-Aware Diffusion

THREAD: 面向混合刚柔机械臂的环境感知扩散轨迹规划

Shivani Kamtikar, Pranav Asthana, Naveen Kumar Uppalapati, Girish Krishnan, Girish Chowdhary

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) University of Maryland College Park(马里兰大学帕克分校)

AI总结 提出首个基于扩散的混合刚柔机械臂轨迹规划器THREAD,通过物理启发损失联合约束刚柔段,实现狭窄环境穿行,任务成功率92.4%,碰撞减少5倍。

Comments Project Page: https://robot-thread.github.io, IROS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21126 2026-06-23 cs.LG stat.ML 新提交

What Accuracy and Gradient Cosine Miss: Evaluating Feedback Alignment via Scale Stability, Reference Validity, and Depth Utility

准确率和梯度余弦遗漏了什么:通过尺度稳定性、参考有效性和深度效用评估反馈对齐

Yuren Hao, Xiang Wan, ChengXiang Zhai

机构 * University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Stanford University(斯坦福大学)

AI总结 针对反馈对齐方法评估中准确率和余弦相似度无法检测的两种隐性失效模式,提出包含尺度稳定性、参考有效性和深度效用三项检查的诊断协议,并采用逐层余弦报告。

Comments 12+10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21077 2026-06-23 cs.CR cs.CL 新提交

OTTER: A Red-Teaming System for Toxicity-Evading Jailbreak Prompt Optimization

OTTER:一种用于规避毒性检测的越狱提示优化的红队系统

Jerry Wang, Hsin-Ling Hsu, Yi-Cheng Lai, Nai-Chia Chen, Fang Yu

机构 * National Chengchi University, Taipei, Taiwan(国立中正大学,台北,台湾) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

AI总结 提出OTTER系统,通过替换少量令牌解耦表面毒性与对抗意图,在四个GPT模型上将平均攻击成功率从7.0%提升至84.0%,并首次量化分析毒性-绕过关系。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21045 2026-06-23 cs.CR cs.LG 新提交

OVIG: Optimistic Verification of AI Training Integrity via Gradient Signals

OVIG: 通过梯度信号乐观验证AI训练完整性

Hongxu Su, Jianzhu Yao, Huan Zhang, Xuechao Wang, Pramod Viswanath

机构 * Princeton University(普林斯顿大学) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

AI总结 提出OVIG框架,利用异构重放校准的梯度差异经验边界,通过乐观采样和步长参数审计外包训练完整性,在多种攻击下保持0%攻击成功率,存储和传输开销降低1996倍。

Comments 18 pages, 7 figures, 11 tables. Submitted to IEEE Symposium on Security and Privacy (S&P)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20970 2026-06-23 cs.CV 新提交

CogniRoute: Learning to Route Social Evidence in Omni-Modal Models

CogniRoute: 在全模态模型中学习路由社会证据

Yifan Shen, Pei Tian, Xinzhuo Li, Bowen Fang, Shujun Xia, Bingxuan Li, Ana Jojic, Wenming Ye, Xu Cao, James Matthew Rehg, Ismini Lourentzou

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Columbia University(哥伦比亚大学) Google(谷歌)

AI总结 提出CogniRoute框架,通过模式引导的专家混合和路由感知强化学习,解决全模态模型在社会视频问答中证据选择不足的问题,在OmniSocialBench上准确率达59.38%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20967 2026-06-23 cs.LG cs.SY eess.SY 新提交

Formalizing Task-Space Complexity for Zero-Shot Generalization

形式化零样本泛化的任务空间复杂度

Jung-Hoon Cho, Heling Zhang, Siqi Du, Roy Dong, Cathy Wu

机构 * Massachusetts Institute of Technology(麻省理工学院) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

AI总结 提出一种基于性能的有向任务差异(符号散度),用于界定零样本泛化差距,并推导出任务空间复杂度的概念,通过贪心选择源策略实现ε覆盖。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20905 2026-06-23 cs.RO cs.AI 新提交

Vesta: A Generalist Embodied Reasoning Model

Vesta: 一种通用具身推理模型

Johan Bjorck, Zhiqi Li, Yunze Man, Jing Wang, An-Chieh Cheng, Sifei Liu, Shihao Wang, Zhiding Yu, Abhishek Badki, Stan Birchfield, Valts Blukis, Yevgen Chebotar, Siyi Chen, Sicong Leng, Yu-Cheng Chou, Tianli Ding, Boyi Li, Zhengyi Luo, Hang Su, Jonathan Tremblay, Tingwu Wang, Bowen Wen, Jimmy Wu, Xianghui Xie, Hanrong Ye, Hongxu Yin, K. R. Zentner, Liangyan Gui, Yu-Xiong Wang, Yuke Zhu, Linxi "Jim" Fan, Jan Kautz

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) University of California, San Diego(加州大学圣地亚哥分校) The Hong Kong Polytechnic University(香港理工大学) University of Michigan(密歇根大学) Nanyang Technological University(南洋理工大学) Johns Hopkins University(约翰霍普金斯大学) University of Tübingen(图宾根大学)

AI总结 提出统一的基础模型Vesta,整合定位、空间推理、导航和长时规划能力,通过大规模空间感知语料库和简单多模态记忆机制,在多个基准上平均优于专用模型20%以上,在真实机器人任务中成功率提升35%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20676 2026-06-23 cs.CV cs.AI cs.CL 新提交

Jury Duty: Calibration and Orientation Failures in MLLM-as-a-Judge Under Cultural Ambiguity

陪审团职责:文化模糊性下MLLM作为评判者的校准与定向失败

Daniel Lee, Harsh Sharma, Eunkyu Park, Pranav Narayanan Venkit, Jeonghwan Kim, Kah Mun Chia, Andreas Vlachos, Shafiq Joty

机构 * Salesforce AI Research(Salesforce AI 研究院) University of Cambridge(剑桥大学) University of Colorado Boulder(科罗拉多大学博尔德分校) Carnegie Mellon University(卡内基梅隆大学) UIUC(伊利诺伊大学厄巴纳-香槟分校)

AI总结 针对MLLM作为评判者在跨文化场景中的偏差问题,提出VOIR DIRE基准,通过分析校准失败(压缩尺度)和定向失败(默认一种文化规范),揭示模型偏向于更宽容的文化解读。

Comments Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23575 2026-06-23 cs.LG cs.AI cs.NA math.NA stat.ML 新提交

Solve for the Hyperparameter, Skip the Search: Kolmogorov-Optimal Scaling Laws for Spline Regression

求解超参数,跳过搜索:样条回归的Kolmogorov最优缩放律

Yong Yi Bay, Kathleen A. Yearick

机构 * University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

AI总结 提出KORE算法,通过闭式求解样条回归的最优分辨率,避免网格搜索,在低交互阶数据上实现计算效率与精度的最优权衡。

Comments 49 pages, 26 figures, 12 tables. Code: https://github.com/bay-yearick-lab/kore

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18057 2026-06-23 cs.HC cs.AI cs.CL cs.CY cs.SI 新提交

When AI Says "I have been in similar situations": Synthetic Lived Experience in Peer-Like Caregiver Support

当AI说“我也有过类似经历”:同伴式照护支持中的合成生活经验

Drishti Goel, Agam Goyal, Veda Duddu, Olivia Pal, Violeta J. Rodriguez, Daniel S. Brown, Ravi Karkar, Dong Whi Yoo, Koustuv Saha

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) University of Massachusetts Amherst(马萨诸塞大学阿默斯特分校) Indiana University Indianapolis(印第安纳大学印第安纳波利斯分校)

AI总结 研究AI在同伴支持中生成“合成生活经验”的悖论,通过分析人类与AI在阿尔茨海默病照护社区中的叙事差异,揭示AI虽能模拟情感支持但缺乏真实经历,需建立机制区分支持性语言与虚构经历。

详情

展开后加载摘要…

URL PDF HTML 收藏