arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of Pennsylvania(宾夕法尼亚大学)

共收录 961
2512.08920 2025-12-10 cs.RO cs.LG

OSMO: Open-Source Tactile Glove for Human-to-Robot Skill Transfer

OSMO:开源触觉手套用于人到机器人技能转移

Jessica Yin, Haozhi Qi, Youngsun Wi, Sayantan Kundu, Mike Lambeta, William Yang, Changhao Wang, Tingfan Wu, Jitendra Malik, Tess Hellebrekers

机构 * Meta FAIR University of Michigan(密歇根大学) University of Pennsylvania(宾夕法尼亚大学)

AI总结 OSMO通过触觉手套实现人到机器人技能转移,利用触觉数据提升机器人操作性能。

Comments Project website: https://jessicayin.github.io/osmo_tactile_glove/

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08754 2025-12-10 cs.RO

A Multi-Robot Platform for Robotic Triage Combining Onboard Sensing and Foundation Models

一种结合 onboard 感知与基础模型的多机器人平台用于机器人 triage

Jason Hughes, Marcel Hussing, Edward Zhang, Shenbagaraj Kannapiran, Joshua Caswell, Kenneth Chaney, Ruichen Deng, Michaela Feehery, Agelos Kratimenos, Yi Fan Li, Britny Major, Ethan Sanchez, Sumukh Shrote, Youkang Wang, Jeremy Wang, Daudi Zein, Luying Zhang, Ruijun Zhang, Alex Zhou, Tenzi Zhouga, Jeremy Cannon, Zaffir Qasim, Jay Yelon, Fernando Cladera, Kostas Daniilidis, Camillo J. Taylor, Eric Eaton

机构 * GRASP Lab, School of Engineering and Applied Sciences, University of Pennsylvania(GRASP实验室,工程与应用科学学院,宾夕法尼亚大学) Perelman School of Medicine, University of Pennsylvania(佩拉蒙医学学院,宾夕法尼亚大学)

AI总结 本文提出一种多机器人平台,结合 onboard 感知与基础模型,实现大规模伤亡事件中的机器人 triage,涵盖伤员定位、生命体征测量和伤情评估等关键步骤。

Comments Technical Report for the DARPA Triage Challenge PRONTO team

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17304 2025-12-10 cs.LG math.OC

Understanding the Implicit Regularization of Gradient Descent in Over-parameterized Models

理解过度参数化模型中梯度下降的隐式正则化

Jianhao Ma, Geyu Liang, Salar Fattahi

机构 * University of Pennsylvania(宾夕法尼亚大学) Amazon(亚马逊) University of Michigan(密歇根大学)

AI总结 本文提出 IPGD 方法,通过微小扰动和小偏差率,在过度参数化模型中实现隐式正则化,提升收敛到低维解的能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06924 2025-12-09 cs.CL

XAM: Interactive Explainability for Authorship Attribution Models

XAM:作者归属模型的交互式可解释性

Milad Alshomary, Anisha Bhatnagar, Peter Zeng, Smaranda Muresan, Owen Rambow, Kathleen McKeown

机构 * Columbia University(哥伦比亚大学) Stony Brook University(石溪大学) University of Pennsylvania(宾夕法尼亚大学)

AI总结 IXAM通过交互式探索嵌入空间,提供作者归属模型的多粒度写作风格解释,提升模型预测的可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.03764 2025-12-09 cs.LG stat.ME stat.ML

Covariate-Elaborated Robust Partial Information Transfer with Conditional Spike-and-Slab Prior

协变量细化的鲁棒部分信息转移与条件尖峰- slab先验

Ruqian Zhang, Yijiao Zhang, Annie Qu, Zhongyi Zhu, Juan Shen

机构 * Department of Statistics and Data Science, Fudan University(复旦大学统计与数据科学系) Department of Biostatistics, Epidemiology and Informatics, University of Pennsylvania(宾夕法尼亚大学生物统计学、流行病学与信息学系) Department of Statistics and Applied Probability, University of California, Santa Barbara(加州大学圣芭芭拉分校统计学与应用概率系)

AI总结 本文提出CONCERT方法,通过条件尖峰- slab先验实现高维数据的鲁棒部分信息转移,同时完成变量选择与信息转移,提升迁移学习性能。

Comments 35 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06688 2025-12-09 cs.CL

PersonaMem-v2: Towards Personalized Intelligence via Learning Implicit User Personas and Agentic Memory

PersonaMem-v2:通过学习隐式用户人设和代理记忆实现个性化智能

Bowen Jiang, Yuan Yuan, Maohao Shen, Zhuoqun Hao, Zhangchen Xu, Zichen Chen, Ziyi Liu, Anvesh Rao Vijjini, Jiashu He, Hanchao Yu, Radha Poovendran, Gregory Wornell, Lyle Ungar, Dan Roth, Sihao Chen, Camillo Jose Taylor

机构 * University of Pennsylvania(宾夕法尼亚大学) Massachusetts Institute of Technology(麻省理工学院) University of Washington(华盛顿大学) University of California Santa Barbara(加州大学圣巴巴拉分校) Meta University of Southern California(南加州大学) University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校) Microsoft Corporation(微软公司)

AI总结 PersonaMem-v2通过学习隐式用户人设和代理记忆提升LLM个性化能力,实验显示强化微调使模型在隐式个性化任务中准确率达53%。

Comments Data is available at https://huggingface.co/datasets/bowen-upenn/PersonaMem-v2

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06506 2025-12-09 econ.GN cs.AI q-fin.EC stat.AP

AI as "Co-founder": GenAI for Entrepreneurship

AI作为'联合创始人':生成式人工智能与创业

Junhui Jeff Cai, Xian Gu, Liugang Sheng, Mengjia Xia, Linda Zhao, Wu Zhu

机构 * Mendoza College of Business, University of Notre Dame(诺丁汉大学梅森商学院) Department of Finance, Durham University Business School(杜伦大学商学院金融系) Department of Economics, The Chinese University of Hong Kong(香港中文大学经济系) Department of Economics, The University of Pennsylvania(宾夕法尼亚大学经济系) Wharton School, The University of Pennsylvania(宾夕法尼亚大学沃顿商学院) Department of Finance, SEM, Tsinghua University(清华大学经济管理学院金融系)

AI总结 本文研究生成式人工智能对创业的影响,发现其通过促进小企业创立,增强了市场竞争力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.14568 2025-12-09 cs.LG physics.comp-ph

Evidential Physics-Informed Neural Networks for Scientific Discovery

证据物理指导神经网络用于科学发现

Hai Siong Tan, Kuancheng Wang, Rafe McBeth

机构 * Gryphon Center for A.I. and Theoretical Sciences(人工智能与理论科学研究中心) University of Pennsylvania, Perelman School of Medicine(宾夕法尼亚大学佩雷尔曼医学院)

AI总结 E-PINN通过证据深度学习的边际分布损失函数提升不确定性估计,有效应用于PDE求解和医学数据集分析。

Comments v3: minor revisions. To appear in TAAI 2025. Code available at https://github.com/HaiSiong-Tan/E-PINN

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.02031 2025-12-08 cs.CV

Neural Eulerian Scene Flow Fields

神经欧拉场景流场

Kyle Vedder, Neehar Peri, Ishan Khatri, Siyi Li, Eric Eaton, Mehmet Kocamaz, Yue Wang, Zhiding Yu, Deva Ramanan, Joachim Pehserl

机构 * University of Pennsylvania(宾夕法尼亚大学) NVIDIA(英伟达) Carnegie Mellon University(卡内基梅隆大学)

AI总结 EulerFlow通过神经先验估计空间时间微分方程,实现高质量场景流估计,在多个领域表现优异,超越现有方法。

Comments Accepted to ICLR 2025. Winner of CVPR 2024 WoD Argoverse Scene Flow Challenge, Unsupervised Track. Project page at https://vedder.io/eulerflow

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.05079 2025-12-05 cs.CV cs.RO

Object Reconstruction under Occlusion with Generative Priors and Contact-induced Constraints

在遮挡下利用生成先验和接触诱导约束进行物体重建

Minghan Zhu, Zhiyi Wang, Qihang Sun, Maani Ghaffari, Michael Posa

机构 * University of Pennsylvania(宾夕法尼亚大学) University of Michigan(密歇根大学)

AI总结 本文提出了一种结合生成先验和接触诱导约束的方法,用于在遮挡下提高物体重建的准确性。

Comments Project page: https://contactgen3d.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04985 2025-12-05 stat.ML cs.LG math.ST stat.TH

Towards a unified framework for guided diffusion models

迈向引导扩散模型的统一框架

Yuchen Jiao, Yuxin Chen, Gen Li

机构 * Department of Statistics, the Chinese University of Hong Kong, Hong Kong(香港中文大学统计学系) Department of Statistics and Data Science, the Wharton School, University of Pennsylvania(宾夕法尼亚大学沃顿商学院统计学与数据科学系)

AI总结 本文提出统一框架,通过引入奖励引导项提升扩散模型奖励表现,并首次理论化无分类器引导的性能指标。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21584 2025-12-05 stat.ML cs.LG

IndiSeek learns information-guided disentangled representations

IndiSeek 学习信息引导的解耦表示

Yu Gui, Cong Ma, Zongming Ma

机构 * Department of Statistics and Data Science, University of Pennsylvania(宾夕法尼亚大学统计与数据科学系) Department of Statistics, University of Chicago(芝加哥大学统计系) Department of Statistics and Data Science, Yale University(耶鲁大学统计与数据科学系)

AI总结 IndiSeek通过结合独立性强制目标和高效重建损失,有效学习信息引导的解耦表示,提升多模态学习性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04044 2025-12-04 cs.LG cs.AI cs.CR

MarkTune: Improving the Quality-Detectability Trade-off in Open-Weight LLM Watermarking

MarkTune: 改善开放权重语言模型水印中的质量-可检测性权衡

Yizhou Zhao, Zhiwei Steven Wu, Adam Block

机构 * University of Pennsylvania(宾夕法尼亚大学) Carnegie Mellon University(卡内基梅隆大学) Columbia University(哥伦比亚大学)

AI总结 MarkTune通过理论框架提升开放权重语言模型中质量与可检测性的平衡,优于GaussMark并保持生成质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01463 2025-12-03 cs.AR cs.LG hep-ex

hls4ml: A Flexible, Open-Source Platform for Deep Learning Acceleration on Reconfigurable Hardware

hls4ml:一种灵活、开源的深度学习在可重构硬件上加速平台

Jan-Frederik Schulte, Benjamin Ramhorst, Chang Sun, Jovan Mitrevski, Nicolò Ghielmetti, Enrico Lupi, Dimitrios Danopoulos, Vladimir Loncar, Javier Duarte, David Burnette, Lauri Laatu, Stylianos Tzelepis, Konstantinos Axiotis, Quentin Berthet, Haoyan Wang, Paul White, Suleyman Demirsoy, Marco Colombo, Thea Aarrestad, Sioni Summers, Maurizio Pierini, Giuseppe Di Guglielmo, Jennifer Ngadiuba, Javier Campos, Ben Hawks, Abhijith Gandrakota, Farah Fahim, Nhan Tran, George Constantinides, Zhiqiang Que, Wayne Luk, Alexander Tapper, Duc Hoang, Noah Paladino, Philip Harris, Bo-Cheng Lai, Manuel Valentin, Ryan Forelli, Seda Ogrenci, Lino Gerlach, Rian Flynn, Mia Liu, Daniel Diaz, Elham Khoda, Melissa Quinnan, Russell Solares, Santosh Parajuli, Mark Neubauer, Christian Herwig, Ho Fung Tsoi, Dylan Rankin, Shih-Chieh Hsu, Scott Hauck

机构 * Purdue University(普渡大学) ETH Zurich(苏黎世联邦理工学院) California Institute of Technology(加州理工学院) Fermi National Accelerator Lab(费米国家加速器实验室) European Organization for Nuclear Research (CERN)(欧洲核子研究中心) University of California San Diego(加州大学圣地亚哥分校) Imperial College London(伦敦帝国理工学院) National Technical University of Athens(希腊国家技术大学) University of Geneva(日内瓦大学) Altera Corporation(阿尔特拉公司) Discovery Partners Institute(发现伙伴研究所) Massachusetts Institute of Technology(麻省理工学院) National Yang Ming Chiao Tung University(国立阳明交通大学) Northwestern University(西北大学) Princeton University(普林斯顿大学) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) University of Michigan(密歇根大学) University of Pennsylvania(宾夕法尼亚大学) University of Washington(华盛顿大学)

AI总结 hls4ml是一种开源平台,用于将深度学习模型转换为可重构硬件上的HLS代码,以实现低延迟、低资源消耗的ML推理加速。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.13375 2025-12-03 econ.TH cs.AI

Pricing AI Model Accuracy

定价人工智能模型的准确性

Nikhil Kumar

机构 * University of Pennsylvania(宾夕法尼亚大学)

AI总结 本文研究了AI模型市场中企业竞争对模型准确性投资的影响,发现企业应根据自身竞争优势投资以优化利润,同时提升整体福利。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01922 2025-12-02 cs.CV

Med-VCD: Mitigating Hallucination for Medical Large Vision Language Models through Visual Contrastive Decoding

Med-VCD: 通过视觉对比解码缓解医疗大视觉语言模型的幻觉问题

Zahra Mahdavi, Zahra Khodakaramimaghsoud, Hooman Khaloo, Sina Bakhshandeh Taleshani, Erfan Hashemi, Javad Mirzapour Kaleybar, Omid Nejati Manzari

机构 * Department of computer science, University of Central Florida, Orlando, USA(计算机科学系,中央佛罗里达大学) Department of Bioengineering, University of Pennsylvania, Philadelphia, PA, USA(生物工程系,宾夕法尼亚大学) Department of electrical engineering, Columbia university, New York, NY, USA(电气工程系,哥伦比亚大学) Technical University of Applied Sciences Regensburg, Regensburg, Germany(应用科学技术大学(雷根斯堡)) Department of Surgery, University of Calgary, Calgary, Alberta, Canada(外科系,卡尔加里大学) University College of Nabi Akram, Tabriz, Iran(纳比阿克兰大学) School of Electrical Engineering, Iran University of Science and Technology, Tehran, Iran(电气工程学院,伊朗科学技术大学)

AI总结 Med-VCD通过视觉对比解码方法提升医疗大视觉语言模型的事实准确性与幻觉准确性,减少幻觉输出并提高推理效率。

Journal ref Computers in Biology and Medicine (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01913 2025-12-02 eess.IV cs.CV

Disentangling Progress in Medical Image Registration: Beyond Trend-Driven Architectures towards Domain-Specific Strategies

解构医学图像配准的进步:超越趋势驱动的架构,迈向领域特定的策略

Bailiang Jian, Jiazhen Pan, Rohit Jena, Morteza Ghahremani, Hongwei Bran Li, Daniel Rueckert, Christian Wachinger, Benedikt Wiestler

机构 * Technical University of Munich(慕尼黑技术大学) Munich Center for Machine Learning (MCML)(慕尼黑机器学习中心) Imperial College London(伦敦帝国理工学院) University of Pennsylvania(宾夕法尼亚大学) National University of Singapore(新加坡国立大学)

AI总结 本文通过模块化框架解构医学图像配准中趋势驱动架构与领域特定设计的影响,发现后者在性能提升上优于前者,推动研究重点转向领域特定原则。

Comments Submitted to Medical Image Analysis. Journal Extension of arXiv:2407.19274

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01199 2025-12-02 cs.LG q-bio.NC

Know Thyself by Knowing Others: Learning Neuron Identity from Population Context

通过了解他人来认识自己:从群体上下文学习神经元身份

Vinam Arora, Divyansha Lachi, Ian J. Knight, Mehdi Azabou, Blake Richards, Cole L. Hurwitz, Josh Siegle, Eva L. Dyer

机构 * University of Pennsylvania(宾夕法尼亚大学) Columbia University(哥伦比亚大学) McGill University(麦吉尔大学) Mila(Mila研究所) Allen Institute for Neural Dynamics(神经动态阿伦研究所)

AI总结 NuCLR通过自监督学习从群体上下文中的神经活动区分神经元身份,实现了细胞类型和大脑区域解码的最新成果。

Comments Accepted at Neurips 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01188 2025-12-02 cs.RO cs.AI cs.LG

Real-World Reinforcement Learning of Active Perception Behaviors

现实世界中主动感知行为的强化学习

Edward S. Hu, Jie Wang, Xingfang Yuan, Fiona Luo, Muyao Li, Gaspard Lambrechts, Oleh Rybkin, Dinesh Jayaraman

机构 * University of Pennsylvania(宾夕法尼亚大学) University of Liège(列日大学) UC Berkeley(伯克利大学)

AI总结 本文提出AAWR方法,通过特权传感器训练高效主动感知策略,提升机器人在部分可观测环境下的任务性能。

Comments NeurIPS 2025 camera ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00085 2025-12-02 cs.RO cs.AI

Hyper-GoalNet: Goal-Conditioned Manipulation Policy Learning with HyperNetworks

Hyper-GoalNet: 基于超网络的目标条件化操纵策略学习

Pei Zhou, Wanting Yao, Qian Luo, Xunzhe Zhou, Yanchao Yang

机构 * InfoBodied AI Lab, The University of Hong Kong(信息身体AI实验室,香港大学) University of Pennsylvania(宾夕法尼亚大学)

AI总结 Hyper-GoalNet通过超网络生成任务特定策略参数,提升机器人操纵在多样化目标和环境下的鲁棒性与性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22860 2025-12-01 cs.RO cs.CV

MARVO: Marine-Adaptive Radiance-aware Visual Odometry

MARVO: 适应海洋环境的辐射感知视觉里程计

Sacchin Sundar, Atman Kikani, Aaliya Alam, Sumukh Shrote, A. Nayeemulla Khan, A. Shahina

机构 * University of Michigan Ann Arbor, USA(密歇根大学安阿伯分校) Vellore Institute of Technology(韦洛雷理工学院) University of Pennsylvania(宾夕法尼亚大学) Sri Sivasubramaniya Nadar College of Engineering(Sri Sivasubramaniya工程学院)

AI总结 MARVO通过融合物理建模、可微匹配和强化学习优化,实现水下环境下的实时视觉里程计,提升在混浊水体中的定位精度。

Comments 10 pages, 5 figures, 3 tables, Submitted to CVPR2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.00526 2025-12-01 econ.EM cs.LG stat.CO

Pre-Training Estimators for Structural Models: Application to Consumer Search

结构模型的预训练估计器:应用于消费者搜索

Yanhao 'Max' Wei, Zhenling Jiang

机构 * Marshall School of Business, University of Southern California(美国南加州大学马歇尔商学院) The Wharton School, University of Pennsylvania(美国宾夕法尼亚大学沃顿商学院)

AI总结 本文提出了一种预训练估计器,用于结构模型中的消费者搜索问题,通过神经网络实现快速且高精度的参数估计。

Comments Originally posted on SSRN on June 7, 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.10641 2025-12-01 cs.CL

Toward Equitable Access: Leveraging Crowdsourced Reviews to Investigate Public Perceptions of Health Resource Accessibility

迈向公平获取:利用众包评论研究公众对健康资源可及性的感知

Zhaoqian Xue, Guanhong Liu, Chong Zhang, Kai Wei, Qingcheng Zeng, Songhua Hu, Wenyue Hua, Lizhou Fan, Yongfeng Zhang, Lingyao Li

机构 * University of Pennsylvania(宾夕法尼亚大学) Renmin University of China(中国人民大学) University of Liverpool(利物浦大学) University of Michigan(密歇根大学) Northwestern University(西北大学) Massachusetts Institute of Technology(麻省理工学院) University of California, Santa Barbara(加州大学圣巴巴拉分校) Harvard Medical School(哈佛医学院) Rutgers University(新泽西州立大学罗格斯大学) University of South Florida(佛罗里达州立大学)

AI总结 本研究利用众包评论和NLP技术,分析公众对健康资源可及性的时空感知,揭示疫情对健康资源可及性的影响及社会经济因素的作用。

Journal ref The 6th International Conference on Social Computing (ICSC 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21935 2025-12-01 cs.LG cs.GT

Breaking Algorithmic Collusion in Human-AI Ecosystems

打破人类-人工智能生态系统中的算法合谋

Natalie Collina, Eshwar Ram Arunachaleswaran, Meena Jagadeesan

机构 * University of Pennsylvania(宾夕法尼亚大学) Stanford University(斯坦福大学)

AI总结 本文研究了人类-人工智能生态系统中算法合谋的稳定性,发现单个或多个人类的背叛行为能破坏合谋并降低价格,揭示了合谋在混合生态系统中的脆弱性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.19104 2025-12-01 cs.LG eess.IV stat.ML

Composition and Alignment of Diffusion Models using Constrained Learning

扩散模型的组成与对齐:基于约束学习

Shervin Khalafi, Ignacio Hounie, Dongsheng Ding, Alejandro Ribeiro

机构 * University of Pennsylvania(宾夕法尼亚大学) University of Tennessee, Knoxville(田纳西大学,基洛那分校)

AI总结 本文提出了一种基于约束学习的框架,通过统一对齐和组成扩散模型,以提高生成样本的质量和符合用户需求的能力。

Comments 48 pages, 6 figures, 15 tables; Accepted to NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.04774 2025-11-26 cs.LG cs.AR

SLOFetch: Compressed-Hierarchical Instruction Prefetching for Cloud Microservices

SLOFetch:面向云微服务的压缩分层指令预取

Zerui Bao, Di Zhu, Liu Jiang, Shiqi Sheng, Ziwei Wang, Haoyun Zhang

机构 * University of Michigan(密歇根大学) Santa Clara University(圣克拉拉大学) Carnegie Mellon University(卡内基梅隆大学) University of Pennsylvania(宾夕法尼亚大学)

AI总结 SLOFetch通过压缩分层指令预取技术,优化云微服务的指令预取效率,减少芯片状态并提升网络化服务的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.02143 2025-11-26 stat.AP cs.AI cs.DL cs.LG

How to Find Fantastic AI Papers: Self-Rankings as a Powerful Predictor of Scientific Impact Beyond Peer Review

如何找到非凡的AI论文:自我排名作为预测科学影响的强大指标超越同行评审

Buxin Su, Natalie Collina, Garrett Wen, Didong Li, Kyunghyun Cho, Jianqing Fan, Bingxin Zhao, Weijie Su

机构 * University of Pennsylvania(宾夕法尼亚大学) Yale University(耶鲁大学) University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校) New York University(纽约大学) Princeton University(普林斯顿大学)

AI总结 本文通过研究作者自我排名发现其能有效预测AI领域高影响力论文,优于同行评审。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18102 2025-11-25 cs.CV

Spotlight: Identifying and Localizing Video Generation Errors Using VLMs

Spotlight: 利用视觉语言模型识别和定位视频生成错误

Aditya Chinchure, Sahithya Ravi, Pushkar Shukla, Vered Shwartz, Leonid Sigal

机构 * The University of British Columbia(不列颠哥伦比亚大学) Vector Institute of AI(向量人工智能研究所) The Wharton School, University of Pennsylvania(宾夕法尼亚大学沃顿商学院)

AI总结 Spotlight任务通过定位和解释视频生成错误,揭示VLMs在错误识别和定位上的不足,并提出改进策略以提升性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17828 2025-11-25 cs.CV cs.AI

Toward explainable AI approaches for breast imaging: adapting foundation models to diverse populations

迈向可解释AI方法的乳腺成像:适应基础模型以适应多样化人群

Guilherme J. Cavalcante, José Gabriel A. Moreira, Gabriel A. B. do Nascimento, Vincent Dong, Alex Nguyen, Thaís G. do Rêgo, Yuri Malheiros, Telmo M. Silva Filho, Carla R. Zeballos Torrez, James C. Gee, Anne Marie McCarthy, Andrew D. A. Maidment, Bruno Barufaldi

机构 * University of Pennsylvania(宾夕法尼亚大学) Federal University of Paraíba(帕拉州联邦大学) University of Bristol(布里斯托大学)

AI总结 本研究利用BiomedCLIP基础模型,通过多模态训练提升乳腺密度分类的准确性和泛化能力,验证了其在不同成像模态中的鲁棒性和可解释性。

Comments 5 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17825 2025-11-25 cond-mat.dis-nn cs.LG

Analog Physical Systems Can Exhibit Double Descent

类物理系统可以表现出双降现象

Sam Dillavou, Jason W Rocks, Jacob F Wycoff, Andrea J Liu, Douglas J Durian

机构 * Department of Physics and Astronomy, University of Pennsylvania, Philadelphia, PA, USA(物理学与天文学系,宾夕法尼亚大学,费城,PA,USA) Dayhoff Labs, Inc. Cambridge, MA, USA(Dayhoff实验室公司,剑桥,MA,USA) Santa Fe Institute, Santa Fe, NM, USA(圣菲研究所,圣菲,NM,USA)

AI总结 该研究展示了一种类物理系统通过特殊训练方法实现双降现象,揭示了其在能效和速度上的潜力,并暗示生物系统可能从过参数化中获益。

Comments 11 pages 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏