arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

共收录 1835
2512.18552 2026-06-03 cs.SE cs.AI cs.CL cs.LG

Toward Training Superintelligent Software Agents through Self-Play SWE-RL

通过自我对弈SWE-RL训练超级智能软件代理

Yuxiang Wei, Zhiqing Sun, Emily McMilin, Jonas Gehring, David Zhang, Gabriel Synnaeve, Daniel Fried, Lingming Zhang, Sida Wang

机构 * Meta FAIR University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Meta TBD Lab(Meta TBD 实验室) Carnegie Mellon University(卡内基梅隆大学)

AI总结 提出自我对弈SWE-RL(SSR)方法,通过强化学习在自对弈环境中训练单一LLM代理,使其在无需人工标注问题或测试的情况下,在真实代码库中迭代注入和修复软件缺陷,在SWE-bench基准上实现显著自我改进并超越人类数据基线。

Comments Accepted to ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15744 2026-06-03 cs.CL

Language, Place, and Social Media: Geographic Dialect Alignment in New Zealand

语言、地点与社交媒体:新西兰的地理方言对齐

Sidney Wong

机构 * Computer Science and Software Engineering, University of Canterbury(坎特伯雷大学计算机科学与软件工程系) Department of Linguistics, University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校语言学系) School of Psychology, Speech and Hearing, University of Canterbury(坎特伯雷大学心理学、语音与听力学校) Department of Linguistics, University of Canterbury(坎特伯雷大学语言学系)

AI总结 本研究通过整合用户感知的定性分析与计算方法,探究新西兰Reddit社区中地理方言对齐现象,发现地点相关社区形成连续言语社区,且高级语言建模揭示了语义变异与变化。

Comments PhD thesis

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04956 2026-06-03 cs.LG cs.IT math.IT

WaterSIC: Information-Theoretically (Near) Optimal Linear Layer Quantization

WaterSIC: 信息论(近乎)最优的线性层量化

Egor Lifar, Semyon Savkin, Or Ordentlich, Yury Polyanskiy

机构 * University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Stanford University(斯坦福大学) University of California, Berkeley(加州大学伯克利分校) University of Texas at Austin(德克萨斯大学奥斯汀分校)

AI总结 针对密集线性层低精度量化问题,提出WaterSIC算法,通过为权重矩阵不同列分配不同量化率,实现与信息论极限仅0.255比特的差距,并在Llama和Qwen系列大语言模型上达到1-4比特量化的最优性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12221 2026-06-03 cs.CV

Best of Both Worlds: Multimodal Reasoning and Generation via Unified Discrete Flow Matching

两全其美:通过统一离散流匹配实现多模态推理与生成

Onkar Susladkar, Tushar Prakash, Gayatri Deshmukh, Kiet A. Nguyen, Jiaxun Zhang, Adheesh Juvekar, Tianshu Bao, Lin Chai, Sparsh Mittal, Inderjit S Dhillon, Ismini Lourentzou

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Google Research(谷歌研究) Sony Research, India(索尼印度研究) Indian Institute of Technology, Roorkee(印度理工学院罗尔基分校) University of Texas at Austin(德克萨斯大学奥斯汀分校)

AI总结 提出UniDFlow框架,通过任务特定低秩适配器解耦理解与生成,并利用基于参考的多模态偏好对齐优化忠实性与可控性,在多个基准上达到最先进性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
1209.2058 2026-06-03 cs.RO cs.DC cs.MA cs.SY eess.SY

Safe and Stabilizing Distributed Multi-Path Cellular Flows

安全且稳定的分布式多路径蜂窝流

Taylor T. Johnson, Sayan Mitra

机构 * Coordinated Science Laboratory, University of Illinois at Urbana-Champaign,Urbana, IL 61801, USA(协调科学实验室,伊利诺伊大学厄巴纳-香槟分校)

AI总结 针对分区平面中的分布式交通控制问题,提出一种保证实体间最小安全距离并能在单目标下自稳定、多目标下避免死锁的协议,通过临时阻塞和局部地理路由实现安全与进展。

Comments An earlier version of this paper appeared in the 30th IEEE International Conference on Distributed Computing Systems (ICDCS 2010)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00946 2026-06-02 cs.DC cs.AI cs.LG

Lodestar: An Online-Learning LLM Inference Router

Lodestar: 一种在线学习的大语言模型推理路由器

Gangmuk Lim, Wanyu Zhao, Brighten Godfrey, Jiaxin Shan, Le Xu, Liguang Xie

机构 * UIUC(伊利诺伊大学香槟分校) Bytedance(字节跳动) University of Edinburgh(爱丁堡大学)

AI总结 提出Lodestar,一种基于在线学习的请求路由系统,通过实时收集集群状态并训练奖励预测器,以最小化TTFT为目标分配推理请求,在异构GPU集群上显著降低延迟。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00895 2026-06-02 math.OC cs.LG

Tiny Recursive Models for Solving the J2-Perturbed Lambert Problem

用于求解J2摄动兰伯特问题的小型递归模型

Minduli Wijayatunga, Roberto Armellin

机构 * Department of Aerospace Engineering, University of Illinois Urbana-Champaign(航空航天工程系,伊利诺伊大学厄巴纳-香槟分校) Te Pūnaha Ātea – Space Institute, University of Auckland(太空研究所,奥克兰大学)

AI总结 提出基于小型递归模型(TRM)的快速递归神经求解器TRM-PL,通过迭代深度而非参数数量实现有效容量,统一初始猜测生成与迭代校正,在多种轨道转移场景中显著降低终端位置误差。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00460 2026-06-02 cs.CL eess.AS

SALSA: Speech Aware LLM Adaptation via Learned Steering Activation Vectors

SALSA: 通过学习的引导激活向量实现语音感知的LLM适配

Yekaterina Yegorova, Argyrios Gerogiannis, Haolong Zheng, Julia Hockenmaier, Chang D. Yoo, Mark A. Hasegawa-Johnson

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Korea Advanced Institute of Science and Technology(韩国科学技术院)

AI总结 提出SALSA方法,通过监督学习优化逐层引导向量,在儿童语音、多语种语音和普通话-英语代码切换基准上显著提升零样本推理和语音上下文学习性能,最高相对提升46.8%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00408 2026-06-02 cs.CL cs.AI cs.IR

Masking Stale Observations Helps Search Agents -- Until It Doesn't: A Regime Map and Its Mechanism

掩盖过时观察帮助搜索智能体——直到适得其反:一个机制图谱及其机制

Haoxiang Zhang, Qixin Xu, Zhuofeng Li, Lei Zhang, Pengcheng Jiang, Yu Zhang, Julian McAuley

机构 * UC San Diego(加州大学圣地亚哥分校) UC Berkeley(加州大学伯克利分校) Texas A&M University(德克萨斯大学) UIUC(伊利诺伊大学厄巴纳-香槟分校)

AI总结 本文通过系统实验发现,在长时域搜索智能体中掩盖过时观察的效果呈现非对称倒U型曲线,取决于检索器召回率与模型隐式过滤能力的交互,并揭示了其背后的令牌-轮次权衡机制。

Comments 47 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00039 2026-06-02 cs.CY cs.AI cs.HC

Beyond Categories of Caste: Examining Caste Bias and Morality in Text-to-Image AI Models

超越种姓类别:审视文本到图像AI模型中的种姓偏见与道德

Divyanshu Kumar Singh, Dipto Das, Deepika Rama Subramanian, Koustuv Saha, Stephen Voida, Bryan Semaan

机构 * University of Colorado Boulder(科罗拉多大学波得尔分校) University of Toronto(多伦多大学) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

AI总结 通过算法审计与批判性话语分析,揭示文本到图像模型如何超越上下种姓二元对立而延续种姓偏见,并提出反种姓方法应对AI系统中的公平问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12792 2026-06-02 cs.RO

Actuation space reduction to facilitate insightful shape matching in a novel reconfigurable tendon driven continuum manipulator

驱动空间缩减以促进新型可重构腱驱动连续体机器人的形状匹配洞察

Sabyasachi Dash, John Golden, Girish Krishnan

机构 * Department of Industrial and Enterprise Systems Engineering, University of Illinois Urbana-Champaign(工业与企业系统工程系,伊利诺伊大学厄巴纳-香槟分校) Department of Mechanical Science and Engineering, University of Illinois, Urbana-Champaign(机械科学与工程系,伊利诺伊大学厄巴纳-香槟分校)

AI总结 提出一种通过旋转间隔盘重构腱路径的连续体机器人设计,利用曲率-扭转中间空间简化从期望骨架曲线到驱动器输入的映射,实现无模型的分步形状匹配策略。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01802 2026-06-02 cs.LG

Real-Time Sensing of Inaccessible Physical Fields via an Edge-Deployable Hardware-Portable Graph Neural Operator

通过边缘可部署的硬件可移植图神经算子实时感知不可及的物理场

William Howes, Jason Yoo, Kazuma Kobayashi, Subhankar Sarkar, Farid Ahmed, Souvik Chakraborty, Syed Bahauddin Alam

机构 * Grainger College of Engineering, Nuclear, Plasma & Radiological Engineering Department, University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校格拉inger工程学院、核物理与等离子体工程系) Yardi School of Artificial Intelligence, Indian Institute of Technology Delhi(印度理工学院德里分校人工智能学院) Department of Applied Mechanics, Indian Institute of Technology Delhi(印度理工学院德里分校应用力学系) National Center for Supercomputing Applications(国家超级计算应用中心)

AI总结 提出VIRSO,一种具有独特时空架构的神经算子,通过硬件协同设计实现边缘设备上从稀疏边界观测到内部多物理场的实时推理,在降低能耗的同时保持高精度。

Comments 36 pages, 5 figures, 16 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07356 2026-06-02 cs.LG

Controllable Value Alignment in Large Language Models through Neuron-Level Editing

大语言模型中通过神经元级编辑的可控价值对齐

Yonghui Yang, Yihui Wang, Junwei Li, Jilong Liu, Fengbin Zhu, Weibiao Huang, Le Wu, Richang Hong, Tat-Seng Chua

机构 * National University of Singapore(新加坡国立大学) Hefei University of Technology(合肥工业大学) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) ST Engineering Ltd.(ST工程有限公司)

AI总结 提出NeVA框架,通过识别稀疏价值相关神经元并进行推理时激活编辑,实现细粒度可控价值对齐,减少价值泄漏并保持通用能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30930 2026-06-01 cs.HC cs.AI cs.CL cs.CY

TUX: Measuring Human--AI Tacit Understanding

TUX:衡量人机默契理解

Yueshen Li, Hanyi Min, Vedant Das Swain, Koustuv Saha

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) New York University(纽约大学)

AI总结 通过光谱放置任务和TUX指数,量化人类与LLM之间的默契理解,发现人格特征影响对齐程度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30913 2026-06-01 cs.CL cs.AI cs.CY cs.HC

Toxic HallucinAItions: Perturbing Prompts and Tracing LLM Circuits

有毒幻觉:扰动提示与追踪LLM电路

Soorya Ram Shimgekar, Agam Goyal, Amruta Parulekar, Joshua Chen, Yian Wang, Navin Kumar, Hari Sundaram, Eshwar Chandrasekharan, Koustuv Saha

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Nimblemind

AI总结 研究有毒语言扰动对LLM事实可靠性的影响,发现有毒词汇降低准确率并增加不确定性,通过归因图分析揭示内部机制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30862 2026-06-01 cs.DB cs.AI

Sophrosyne: Agentic Exploration of Relational Data Systems Needs Moderation

Sophrosyne: 关系数据系统的智能体探索需要适度

Madhav Jivrajani, Ramnatthan Alagappan, Aishwarya Ganesan

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

AI总结 针对LLM驱动的Text2SQL智能体在探索数据系统时过度探索的问题,提出Sophrosyne环境,通过增强API响应中的指令来引导探索,减少过度探索并提升SQL生成准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30717 2026-06-01 cs.CL

Neuron-Level Interventions for Gendered and Gender-Neutral Generation in Language Models

语言模型中性别化与性别中立生成的神经元级干预

Zhiwen You, Nafiseh Nikeghbal, Jana Diesner

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Technical University of Munich(慕尼黑技术大学) Munich Center for Machine Learning(慕尼黑机器学习中心)

AI总结 提出神经元级干预方法,通过识别与女性、男性和性别中立相关的特定神经元,实现对语言模型生成文本的性别控制,并发现性别神经元主要集中在前几层。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30712 2026-06-01 cs.CL

ExpGraph: Model-Agnostic Experience Learning with Graph-Structured Memory for LLM Agents

ExpGraph: 面向LLM智能体的模型无关经验学习与图结构记忆

Tao Feng, Chongrui Ye, Tianyang Luo, Jingjun Xu, Xueqiang Xu, Haozhen Zhang, Zhigang Hua, Yan Xie, Shuang Yang, Ge Liu, Jiaxuan You

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Nanyang Technological University(南洋理工大学) Meta Monetization AI(Meta 营收人工智能)

AI总结 提出ExpGraph框架,通过图结构记忆和强化学习实现冻结LLM执行器的外部经验复用,在问答、数学推理、代码生成和多步智能体任务上显著提升性能并减少交互步骤。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30690 2026-06-01 cs.CL

ElasticMem: Latent Memory as a Learnable Resource for LLM Agents

ElasticMem: 将潜在记忆作为LLM智能体的可学习资源

Tao Feng, Chongrui Ye, Tianyang Luo, Jingjun Xu, Xueqiang Xu, Haozhen Zhang, Ge Liu, Jiaxuan You

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Nanyang Technological University(南洋理工大学)

AI总结 提出ElasticMem框架,通过可学习的弹性潜在记忆分配策略,在记忆密集型问答和具身智能体控制任务中显著提升准确率并降低token开销。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30621 2026-06-01 cs.AI

Harness Updating Is Not Harness Benefit: Disentangling Evolution Capabilities in Self-Evolving LLM Agents

利用更新并非利用收益:解构自演化LLM智能体中的演化能力

Minhua Lin, Juncheng Wu, Zijun Wang, Zhan Shi, Yisi Sang, Bing He, Zewen Liu, Tianxin Wei, Zongyu Wu, Zhiwei Zhang, Dakuo Wang, Xiang Zhang, Benoit Dumoulin, Cihang Xie, Yuyin Zhou, Suhang Wang, Hanqing Lu

机构 * The Pennsylvania State University(宾夕法尼亚州立大学) UC Santa Cruz(加州大学圣克鲁兹分校) Amazon(亚马逊) Emory University(埃默里大学) UIUC(伊利诺伊大学香槟分校) Northeastern University(东北大学)

AI总结 本文通过分析LLM智能体在外部框架(提示、技能、记忆和工具)上的自演化能力,发现框架更新能力与基础能力无关,而框架收益能力与基础能力呈非单调关系,中等能力模型受益最大。

Comments 24 pages, 9 figures, 12 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30611 2026-06-01 cs.CV cs.AI cs.CL

Crafter: A Multi-Agent Harness for Editable Scientific Figure Generation from Diverse Inputs

Crafter: 面向多样化输入的可编辑科学图表生成的多智能体框架

Haozhe Zhao, Shuzheng Si, Zhenhailong Wang, Zheng Wang, Liang Chen, Xiaotong Li, Zhixiang Liang, Maosong Sun, Minjia Zhang

机构 * University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Tsinghua University(清华大学) Peking University(北京大学)

AI总结 提出Crafter多智能体框架,通过结构化组合离散语义组件,实现跨图表类型和输入条件的可编辑科学图表生成,并引入CraftEditor将栅格输出转换为可编辑SVG,在CraftBench基准上显著优于现有方法。

Comments 24 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30526 2026-06-01 cs.LG cs.CL

Measuring, Localizing, and Ablating Alignment Signatures in LLMs

测量、定位和消融LLMs中的对齐特征

Aniket Anand, Janvijay Singh, Zhewei Sun, Dilek Hakkani-Tür, Nick Feamster

机构 * University of Chicago(芝加哥大学) University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Toyota Technological Institute at Chicago(芝加哥丰田技术研究所)

AI总结 研究通过对比人类文本、基模型和对齐模型生成,发现对齐训练引入AI风格特征,并提出PASTA方法通过消融对齐方向来降低AI检测率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30481 2026-06-01 cs.CL

When English Rewrites Local Knowledge: Global Narrative Dominance in Large Language Models

当英语重写地方知识:大语言模型中的全球叙事主导

Md Arid Hasan, Ruwad Naswan, Farhan Samir, Sharifa Sultana, Syed Ishtiaque Ahmed

机构 * University of Toronto(多伦多大学) BUET(巴特利特大学) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

AI总结 本研究通过构建孟加拉语文化数据集CulturalNB,评估大语言模型在低资源文化背景下的跨语言知识一致性,发现英语提问会系统性地增加全球替代和制度框架,减少地方视角覆盖,表明文化失败不仅是知识缺失,更是根基和叙事优先级问题。

Comments Submitted to ARR

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26396 2026-06-01 cs.AI cs.CL cs.LG

Advancing Creative Physical Intelligence in Large Multimodal Models

推进大型多模态模型中的创造性物理智能

Cheng Qian, Hyeonjeong Ha, Jiayu Liu, Jeonghwan Kim, Emre Can Acikgoz, Bingxuan Li, Kunlun Zhu, Jiateng Liu, Aditi Tiwari, Zhenhailong Wang, Xiusi Chen, Mahdi Namazifar, Heng Ji

机构 * UIUC(伊利诺伊大学香槟分校) Amazon(亚马逊)

AI总结 针对大型多模态模型在开放式环境中缺乏基于视觉的创造性工具使用能力的问题,提出MM-CreativityBench基准和基于偏好学习的具身对齐方法,显著提升实体选择并减少幻觉。

Comments 51 Pages, 9 Figures, 7 Tables, Previous Work CreativityBench: arXiv:2605.02910

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.00175 2026-06-01 cs.LG cs.AI

Who Gets Credit or Blame? Attributing Accountability in Modern AI Systems

谁获得功劳或责备?在现代AI系统中分配责任

Shichang Zhang, Hongzhe Du, Jiaqi W. Ma, Himabindu Lakkaraju

机构 * Harvard University, Cambridge, MA, USA(哈佛大学) University of California, Los Angeles, Los Angeles, CA, USA(加州大学洛杉矶分校) University of Illinois Urbana-Champaign, Urbana-Champaign, IL, USA(伊利诺伊大学厄巴纳-香槟分校)

AI总结 提出一个归因框架,通过反事实问题量化模型开发各阶段(预训练、微调等)对最终行为的影响,并设计无需重训练的估计器,成功识别并移除多阶段任务中的虚假关联。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.16187 2026-06-01 cs.SE cs.LG

MatchFixAgent: Language-Agnostic Autonomous Repository-Level Code Translation Validation and Repair

MatchFixAgent: 语言无关的自主仓库级代码翻译验证与修复

Ali Reza Ibrahimzada, Brandon Paulsen, Reyhaneh Jabbarvand, Joey Dodds, Daniel Kroening

机构 * Siebel School of Computing and Data Science, University of Illinois Urbana-Champaign, Urbana, IL, USA(伊利诺伊大学厄巴纳-香槟分校Siebel计算与数据科学学院) Amazon, Arlington, VA, USA(亚马逊公司,阿灵顿,弗吉尼亚州,美国) University of Oxford, Oxford, UK(牛津大学,牛津,英国)

AI总结 提出基于大语言模型的多智能体框架MatchFixAgent,实现语言无关的仓库级代码翻译等价性验证与修复,在验证覆盖率和修复成功率上显著优于现有方法。

Comments Published in ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.00419 2026-06-01 cs.LG

Learning a Zeroth-Order Optimizer for Fine-Tuning LLMs

学习零阶优化器以微调大语言模型

Kairun Zhang, Haoyu Li, Yanjun Zhao, Yifan Sun, Huan Zhang

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

AI总结 提出一种基于学习的零阶优化器ZO-Finetuner,通过紧凑且内存高效的设计自动学习高效扰动策略,实现大语言模型微调时避免反向传播并降低内存开销,在4个LLM和7个数据集上82.1%的任务-模型组合中优于现有零阶基线方法。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30344 2026-05-29 cs.AI

Tiny but Trusted: Efficient Vision-Language Reasoning for Time-Series Anomaly Detection

小巧但可信:面向时间序列异常检测的高效视觉-语言推理

Xiaona Zhou, Muntasir Wahed, Tianjiao Yu, Constantin Brif, Ismini Lourentzou

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Sandia National Laboratories(桑迪亚国家实验室)

AI总结 针对时间序列异常检测中缺乏自然语言解释的问题,构建VisAnomBench基准并微调参数高效的视觉-语言模型VisAnomReasoner,在准确性和泛化性上显著超越基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30273 2026-05-29 cs.HC cs.AI cs.CL cs.CY cs.SI

LLUMI: Improving LLM Writing Assistance for Mental Health Support with Online Community Feedback

LLUMI: 利用在线社区反馈改进心理健康支持中的LLM写作辅助

Jiwon Kim, Maya Ajit, Sherry Gong, Soorya Ram Shimgekar, Dong Whi Yoo, Eshwar Chandrasekharan, Koustuv Saha

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Indiana University Indianapolis(印第安纳大学印第安纳波利斯分校)

AI总结 提出LLUMI框架,通过在线社区反馈(如Reddit投票)构建偏好对,结合监督微调和直接偏好优化训练开源小模型,在隐私保护下实现与GPT相当的心理健康支持性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.29862 2026-05-29 eess.AS cs.AI cs.SD

Mitigating Stethoscope-Induced Shortcuts in Respiratory Sound Classification under Federated Domain Generalization with Causality-Inspired Interventions

在联邦域泛化下通过因果启发的干预减轻听诊器引起的呼吸音分类中的捷径

Heejoon Koo, Yoon Tae Kim, Miika Toikkanen, June-Woo Kim

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) RSC LAB(RSC实验室) Wonkwang University(Wonkwang大学)

AI总结 针对呼吸音分类中听诊器设备差异导致的域偏移问题,提出一种因果启发的多模态联邦域泛化框架,通过内容保持的风格扰动、反事实文本增强和梯度对齐实现设备不变表示,在ICBHI和SPRSound数据集上优于传统方法。

Comments 2 figures, 4 tables, and 5 pages

详情

展开后加载摘要…

URL PDF HTML 收藏