arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 7552 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 7552 篇

2505.12233 2025-05-20 eess.IV cs.CV 78%

PRETI: Patient-Aware Retinal Foundation Model via Metadata-Guided Representation Learning

Yeonkyung Lee, Woojung Han, Youngjun Jun, Hyeonmin Kim, Jungkyung Cho, Seong Jae Hwang

机构 * Yonsei University(延世大学) Mediwhale(Mediwhale公司)

专题命中 知识编辑与模型理解 :foundation model(title,abstract)

Comments MICCAI2025 early accept

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.09336 2025-05-15 cs.CV 78%

Unsupervised Multiview Contrastive Language-Image Joint Learning with Pseudo-Labeled Prompts Via Vision-Language Model for 3D/4D Facial Expression Recognition

Muzammil Behzad

专题命中 知识编辑与模型理解 :language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.11999 2025-04-17 cs.CV 78%

A Complex-valued SAR Foundation Model Based on Physically Inspired Representation Learning

Mengyu Wang, Hanbo Bi, Yingchao Feng, Linlin Xin, Shuo Gong, Tianqi Wang, Zhiyuan Yan, Peijin Wang, Wenhui Diao, Xian Sun

专题命中 知识编辑与模型理解 :foundation model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.05445 2025-04-09 cs.HC 78%

Probing the Visualization Literacy of Vision Language Models: the Good, the Bad, and the Ugly

Lianghan Dong, Anamaria Crisan

专题命中 知识编辑与模型理解 :language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.01009 2025-04-02 cs.CV 78%

GECKO: Gigapixel Vision-Concept Contrastive Pretraining in Histopathology

Saarthak Kapse, Pushpak Pati, Srikar Yellapragada, Srijan Das, Rajarsi R. Gupta, Joel Saltz, Dimitris Samaras, Prateek Prasanna

专题命中 知识编辑与模型理解 :pretraining(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.15356 2025-04-02 cs.CV 78%

Alleviating Hallucinations in Large Vision-Language Models through Hallucination-Induced Optimization

Xinyu Lyu, Beitao Chen, Lianli Gao, Jingkuan Song, Heng Tao Shen

专题命中 知识编辑与模型理解 :language model(title,abstract)

Comments Accepted by NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.18290 2025-03-27 cs.CV 78%

Stealthy Backdoor Attack in Self-Supervised Learning Vision Encoders for Large Vision Language Models

Zhaoyi Liu, Huan Zhang

专题命中 知识编辑与模型理解 :language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.15839 2025-03-18 cs.CV 78%

VaLiD: Mitigating the Hallucination of Large Vision Language Models by Visual Layer Fusion Contrastive Decoding

Jiaqi Wang, Yifei Gao, Jitao Sang

专题命中 知识编辑与模型理解 :language model(title,abstract)

Comments 17 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.04992 2025-02-27 eess.IV cs.CV 78%

VisionFM: a Multi-Modal Multi-Task Vision Foundation Model for Generalist Ophthalmic Artificial Intelligence

Jianing Qiu, Jian Wu, Hao Wei, Peilun Shi, Minqing Zhang, Yunyun Sun, Lin Li, Hanruo Liu, Hongyi Liu, Simeng Hou, Yuyang Zhao, Xuehui Shi, Junfang Xian, Xiaoxia Qu, Sirui Zhu, Lijie Pan, Xiaoniao Chen, Xiaojia Zhang, Shuai Jiang, Kebing Wang, Chenlong Yang, Mingqiang Chen, Sujie Fan, Jianhua Hu, Aiguo Lv, Hui Miao, Li Guo, Shujun Zhang, Cheng Pei, Xiaojuan Fan, Jianqin Lei, Ting Wei, Junguo Duan, Chun Liu, Xiaobo Xia, Siqi Xiong, Junhong Li, Benny Lo, Yih Chung Tham, Tien Yin Wong, Ningli Wang, Wu Yuan

专题命中 知识编辑与模型理解 :foundation model(title,abstract)

Journal ref The latest VisionFM work has been published in NEJM AI, 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.00095 2025-01-20 cs.CV 78%

OPCap:Object-aware Prompting Captioning

Feiyang Huang

专题命中 知识编辑与模型理解 :prompting(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.17345 2025-01-16 cs.CV 78%

3VL: Using Trees to Improve Vision-Language Models' Interpretability

Nir Yellinek, Leonid Karlinsky, Raja Giryes

专题命中 知识编辑与模型理解 :language model(title,abstract)

Comments accepted to IEEE TIP

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.04815 2025-01-10 cs.CV 78%

Towards Generalizable Trajectory Prediction Using Dual-Level Representation Learning And Adaptive Prompting

Kaouther Messaoud, Matthieu Cord, Alexandre Alahi

专题命中 知识编辑与模型理解 :prompting(title);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.18235 2024-12-25 cs.CV 78%

Band Prompting Aided SAR and Multi-Spectral Data Fusion Framework for Local Climate Zone Classification

Haiyan Lan, Shujun Li, Mingjie Xie, Xuanjia Zhao, Hongning Liu, Pengming Feng, Dongli Xu, Guangjun He, Jian Guan

专题命中 知识编辑与模型理解 :prompting(title,abstract)

Comments Accepted by ICASSP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.10843 2024-12-17 cs.CV 78%

Learning Semantic-Aware Representation in Visual-Language Models for Multi-Label Recognition with Partial Labels

Haoxian Ruan, Zhihua Xu, Zhijing Yang, Yongyi Lu, Jinghui Qin, Tianshui Chen

专题命中 知识编辑与模型理解 :language model(title,abstract)

Comments ACM Transactions on Multimedia Computing Communications and Applications

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.07518 2024-12-11 cs.CV 78%

Hallucination Elimination and Semantic Enhancement Framework for Vision-Language Models in Traffic Scenarios

Jiaqi Fan, Jianhua Wu, Hongqing Chu, Quanbo Ge, Bingzhao Gao

专题命中 知识编辑与模型理解 :language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.14064 2024-12-03 cs.CV 78%

HGCLIP: Exploring Vision-Language Models with Graph Representations for Hierarchical Understanding

Peng Xia, Xingtong Yu, Ming Hu, Lie Ju, Zhiyong Wang, Peibo Duan, Zongyuan Ge

专题命中 知识编辑与模型理解 :language model(title,abstract)

Comments COLING 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.11919 2024-12-03 cs.CV 78%

VL-Uncertainty: Detecting Hallucination in Large Vision-Language Model via Uncertainty Estimation

Ruiyang Zhang, Hu Zhang, Zhedong Zheng

专题命中 知识编辑与模型理解 :language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.15628 2024-11-26 cs.CV 78%

ACE: Action Concept Enhancement of Video-Language Models in Procedural Videos

Reza Ghoddoosian, Nakul Agarwal, Isht Dwivedi, Behzad Darisuh

专题命中 知识编辑与模型理解 :language model(title,abstract)

Comments Accepted at WACV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.13840 2024-11-22 cs.CV 78%

Segment Anything in Light Fields for Real-Time Applications via Constrained Prompting

Nikolai Goncharov, Donald G. Dansereau

专题命中 知识编辑与模型理解 :prompting(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.13777 2024-11-15 cs.RO 78%

Embedding Pose Graph, Enabling 3D Foundation Model Capabilities with a Compact Representation

Hugues Thomas, Mouli Sivapurapu, Jian Zhang

专题命中 知识编辑与模型理解 :foundation model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.00307 2024-11-04 cs.CV 78%

HENASY: Learning to Assemble Scene-Entities for Egocentric Video-Language Model

Khoa Vo, Thinh Phan, Kashu Yamazaki, Minh Tran, Ngan Le

专题命中 知识编辑与模型理解 :language model(title,abstract)

Comments Accepted to NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.20667 2024-10-29 q-bio.BM 78%

PepDoRA: A Unified Peptide Language Model via Weight-Decomposed Low-Rank Adaptation

Leyao Wang, Rishab Pulugurta, Pranay Vure, Yinuo Zhang, Aastha Pal, Pranam Chatterjee

专题命中 知识编辑与模型理解 :language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.01107 2024-10-17 cs.RO cs.MA cs.SY eess.SY 78%

CoViS-Net: A Cooperative Visual Spatial Foundation Model for Multi-Robot Applications

Jan Blumenkamp, Steven Morad, Jennifer Gielis, Amanda Prorok

专题命中 知识编辑与模型理解 :foundation model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.04035 2024-10-08 cs.HC 78%

Gamifying XAI: Enhancing AI Explainability for Non-technical Users through LLM-Powered Narrative Gamifications

Yuzhe You, Jian Zhao

专题命中 知识编辑与模型理解 :LLM(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.01144 2024-10-03 cs.CV 78%

Uncertainty-Guided Enhancement on Driving Perception System via Foundation Models

Yunhao Yang, Yuxin Hu, Mao Ye, Zaiwei Zhang, Zhichao Lu, Yi Xu, Ufuk Topcu, Ben Snyder

专题命中 知识编辑与模型理解 :foundation model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.19042 2024-10-01 eess.AS cs.SD 78%

Probing mental health information in speech foundation models

Marc de Gennes, Adrien Lesage, Martin Denais, Xuan-Nga Cao, Simon Chang, Pierre Van Remoortere, Cyrille Dakhlia, Rachid Riad

专题命中 知识编辑与模型理解 :foundation model(title,abstract)

Comments 6 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.13984 2024-09-24 cs.CV 78%

Cycle-Consistency Uncertainty Estimation for Visual Prompting based One-Shot Defect Segmentation

Geonuk Kim

专题命中 知识编辑与模型理解 :prompting(title,abstract)

Comments ECCV 2024 VISION workshop Most Innovative Prize

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.12528 2024-09-20 cs.SD eess.AS 78%

SoundBeam meets M2D: Target Sound Extraction with Audio Foundation Model

Carlos Hernandez-Olivan, Marc Delcroix, Tsubasa Ochiai, Daisuke Niizumi, Naohiro Tawara, Tomohiro Nakatani, Shoko Araki

专题命中 知识编辑与模型理解 :foundation model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.11630 2024-09-19 cs.SD eess.AS 78%

Speaking from Coarse to Fine: Improving Neural Codec Language Model via Multi-Scale Speech Coding and Generation

Haohan Guo, Fenglong Xie, Dongchao Yang, Xixin Wu, Helen Meng

专题命中 知识编辑与模型理解 :language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.06485 2024-09-11 cs.CV 78%

Mitigating Hallucination in Visual-Language Models via Re-Balancing Contrastive Decoding

Xiaoyu Liang, Jiayuan Yu, Lianrui Mu, Jiedong Zhuang, Jiaqi Hu, Yuchen Yang, Jiangnan Ye, Lu Lu, Jian Chen, Haoji Hu

专题命中 知识编辑与模型理解 :language model(title,abstract)

Comments PRCV

详情

展开后加载摘要…

URL PDF HTML 收藏