arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Georgia Institute of Technology(佐治亚理工学院)

2026-07-07 至 2026-07-07 共收录 7
2606.30444 2026-07-07 stat.ML cs.LG 版本更新

SGD Provably Prioritizes a Shortcut Spurious Feature in the XOR Model

SGD 在 XOR 模型中优先学习捷径虚假特征

Tyler LaBonte, Vidya Muthukumar

机构 * H. Milton Stewart School of Industrial and Systems Engineering, Georgia Institute of Technology(霍华德·米尔顿·斯图尔特工业与系统工程学院,佐治亚理工学院) School of Electrical and Computer Engineering, Georgia Institute of Technology(电气与计算机工程学院,佐治亚理工学院)

AI总结 本文通过在线小批量 SGD 训练两层 ReLU 神经网络,首次端到端理论刻画了虚假特征学习,发现 SGD 优先且指数级快速地学习虚假特征,且优化动力学中虚假与信号特征耦合,强虚假成分抑制信号学习。

Comments v2: Fixed typos

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29496 2026-07-07 cs.CV 版本更新

Rectifying Mask via Entropy for Distractor-Free 3DGS in Ambiguous Scenarios

通过熵修正掩码实现模糊场景中无干扰的3D高斯泼溅

Wongi Park, Jiyeon Lim, Minjae Lee, Myeongseok Nam, Seongjun Choi, Jungwoo Kim, Soomok Lee, William J. Beksi, Sang-Hyun Lee

机构 * Samsung Electronics(三星电子) Georgia Institute of Technology(佐治亚理工学院) GenGenAI Yonsei University(延世大学) Seoul National University(首尔国立大学) Kennesaw State University(肯纳邦州立大学) University of Texas at Arlington(德克萨斯大学阿灵顿分校)

AI总结 提出RefineSplat框架,利用熵感知自适应掩码和密度控制方法,有效识别并移除模糊场景中的动态干扰物,实现无干扰的新视角合成。

Comments 28 pages, 30 figures, and 24 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04424 2026-07-07 cs.CL 版本更新

Gavel: Agent Meets Checklist for Evaluating LLMs on Long-Context Legal Summarization

Gavel: 智能体结合检查表评估LLM长上下文法律摘要

Yao Dou, Benjamin Mamut, Wei Xu

机构 * Georgia Institute of Technology(佐治亚理工学院)

AI总结 提出Gavel框架,通过参考评估和免参考智能体评估12个前沿LLM在多文档法律摘要中的表现,发现模型易遗漏关键信息而非幻觉,且性能随案件长度增加而下降。

Comments webpage at https://yao-dou.github.io/gavel/

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12853 2026-07-07 eess.IV cs.CV 版本更新

BrainNormalizer: Anatomy-Informed Pseudo-Healthy Brain Reconstruction from Tumor MRI via Edge-Guided ControlNet

BrainNormalizer:通过边缘引导控制网络从肿瘤MRI进行解剖学信息伪健康脑重建

Min Gu Kwak, Yeonju Lee, Hairong Wang, Kristin R. Swanson, Jing Li

机构 * University of Pittsburgh(匹兹堡大学) Georgia Institute of Technology(佐治亚理工学院) University of Texas at Austin(德克萨斯大学奥斯汀分校) Cedars-Sinai Medical Center(西德萨斯医疗中心) Mayo Clinic Arizona(梅奥诊所亚利桑那分部)

AI总结 针对脑肿瘤致结构变形难区分肿瘤与解剖变异问题,提出BrainNormalizer框架,用两阶段训练学习解剖先验等,通过特定策略实现伪健康脑重建,实验表明其有优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.16923 2026-07-07 cs.CR cs.AI cs.LG 版本更新

UNDREAM: Bridging Differentiable Rendering and Photorealistic Simulation for End-to-end Adversarial Attacks

UNDREAM:为端到端对抗攻击弥合可微渲染与逼真模拟的差距

Mansi Phute, Matthew Hull, Haoran Wang, Alec Helbling, ShengYun Peng, Willian Lunardi, Martin Andreoni, Wenke Lee, Duen Horng Chau

机构 * Georgia Institute of Technology(佐治亚理工学院) Technology Innovation Institute(技术创新研究院)

AI总结 针对自动驾驶等安全关键应用中深度学习模型对抗攻击测试问题,介绍UNDREAM框架,通过弥合逼真模拟器与可微渲染器差距,实现对3D物体对抗扰动的端到端优化,开启物理对抗攻击研究新途径。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25533 2026-07-07 cs.CV cs.AI 版本更新

VISOR++: Universal Visual Inputs based Steering for Large Vision Language Models

VISOR++:基于通用视觉输入的大型视觉语言模型转向

Ravikumar Balakrishnan, Mansi Phute

机构 * HiddenLayer, USA(HiddenLayer美国分校) Georgia Institute of Technology, USA(佐治亚理工学院)

AI总结 研究视觉语言模型行为控制,针对现有方法局限,提出VISOR++,通过优化视觉输入实现行为控制,无需运行时访问模型内部,在多模型上验证有效性且能保持无关任务性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08521 2026-07-07 cs.CV cs.AI 版本更新

VISOR: Visual Input-based Steering for Output Redirection in Vision-Language Models

VISOR:视觉语言模型中用于输出重定向的基于视觉输入的转向

Mansi Phute, Ravikumar Balakrishnan

机构 * Georgia Institute of Technology(佐治亚理工学院) HiddenLayer, Inc(HiddenLayer公司)

AI总结 研究提出VISOR方法,通过优化视觉输入实现对视觉语言模型行为的精细控制,在关键对齐任务中验证其有效性,且具有低开销等优势,但也揭示了视觉通道安全漏洞。

详情

展开后加载摘要…

URL PDF HTML 收藏