arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-08-14 至 2026-08-14 共收录 334 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 49 篇

2608.12745 2026-08-14 cs.LG cs.DC 新提交 70%

A Cloud-Edge System for Multimodal Clinical Screening in Resource-Constrained Rural Settings

面向资源受限农村地区多模态临床筛查的云边协同系统

Hei Ting, Chan, Chenwei Wu, Xueshen Liu, Zesen Zhao, Boyuan Zheng, Luis Filipe Nakayama, Michael G. Morley, Liyue Shen, Jiasi Chen, Z. Morley Mao

机构 * University of Michigan(密歇根大学) Massachusetts Institute of Technology(麻省理工学院) Harvard Medical School(哈佛医学院)

专题命中 效率与部署 :LLM(abstract,abstract_cn);分类 cs.LG

AI总结 该研究针对资源受限农村地区的多模态临床筛查问题,提出云边协同架构,经实验验证其诊断性能优异且成本更低,可适配部署约束。

Comments 31 pages, 3 figures. In Proceedings of Machine Learning Research, Volume 340, 2026 (Machine Learning for Healthcare Conference)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12724 2026-08-14 cs.LG 新提交 70%

MAG: MAnifold Guided Semi-Supervised Multi-modal In-Context Learning

MAG:流形引导的半监督多模态上下文学习

Zirui Cheng, Xun Xu, Tiankai Chen, Fady Rezk, Bowen Zheng, Xiaodong Shi, Shijie Li, Kangkang Lu, Bharadwaj Veeravalli, Nancy F. Chen

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本研究提出MAG框架,通过将未标记多模态数据用于半监督传播的演示选择,提升多模态大语言模型的上下文学习性能,在8个基准的标签稀缺场景下优于强基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13510 2026-08-14 math.ST cs.LG stat.TH 新提交 70%

On the Structural Limits of Machine Learning Decision Systems: An Information-Theoretic, Interaction-Based, and Stochastic-Dynamical Perspective

机器学习决策系统的结构极限:基于信息论、交互与随机动力学的视角

Nestor R. Barraza, Gabriel Pena

专题命中 效率与部署 :LLM(abstract,abstract_cn);分类 cs.LG

AI总结 本研究从信息论等视角分析机器学习决策系统的结构极限,通过Fano型边界等方法推导分类与参数估计的性能极限,指出合适的数据模型是拓展预测能力的前提。

Journal ref JAIIO 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12327 2026-08-14 cs.CL cs.AI cs.LG 新提交 67%

Comparative Analysis of Multilingual Pre-trained Models for Nepali Automatic Speech Recognition

用于尼泊尔语自动语音识别的多语言预训练模型对比分析

Suman Paudel, Sarbin Sayami

专题命中 效率与部署 :pretraining(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 该研究微调6种多语言预训练模型开展尼泊尔语ASR对比实验,发现语系邻近性可替代模型规模,CTC解码器效率更高,MMS-1B鲁棒性更强,还提供了首个标准化参考基准。

Comments 9 pages, 6 figures, 7 tables. Based on M.Sc. thesis (Institute of Science and Technology, Tribhuvan University). Code and models: https://github.com/p-sumann/nepali-asr-benchmark

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04032 2026-08-14 cs.LG cs.AI cs.CL cs.PF 版本更新 67%

Do Transformers Need Three Projections? Systematic Study of QKV Variants

Transformer 需要三个投影吗?QKV 变体的系统研究

Ali Kayyam, Anusha Madan Gopal, M Anthony Lewis

机构 * Ali Kayyam Anusha Madan Gopal M Anthony Lewis

专题命中 效率与部署 :language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文系统研究了注意力机制中查询、键、值投影共享的变体,发现 Q-K=V 共享在语言建模中仅以 3.1% 的困惑度损失实现 50% 的 KV 缓存减少,且与头共享结合可达到 96.9% 的缓存减少,从而支持设备端推理。

Comments Accepted at ICML 2026 (PMLR vol. 306). 26 pages, 12 figures, 16 tables. Code: https://github.com/Brainchip-Inc/Do-Transformers-Need-3-Projections

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03181 2026-08-14 cs.RO cs.CV 版本更新 67%

SpatialVAM:Spatial-Aware Multi-View Video Diffusion as a Data-Efficient Robot Policy

多视角视频扩散策略:一种3D空间-时间感知的视频动作模型

Peiyan Li, Yixiang Chen, Yuan Xu, Jiabing Yang, Xiangnan Wu, Jun Guo, Nan Sun, Long Qian, Xinghang Li, Xin Xiao, Jing Liu, Nianfeng Liu, Tao Kong, Yan Huang, Liang Wang, Tieniu Tan

机构 * New Laboratory of Pattern Recognition (NLPR), Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所模式识别国家重点实验室) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) FiveAges(五时代) Tsinghua University(清华大学) Xi’an Jiaotong University(西安交通大学) Wuhan University(武汉大学) Nanjing University(南京大学)

专题命中 效率与部署 :foundation model(abstract);pretraining(abstract)

AI总结 本文提出MV-VDP,通过联合建模环境的3D空间-时间状态,解决机器人操控中对3D空间结构和时间演变理解不足的问题,实现高效、鲁棒且可解释的动作执行。

Comments Updated Version; Project Website: https://spatialvam.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10560 2026-08-14 cs.MA cs.AI cs.CL 版本更新 62%

Learning Latency-Aware Orchestration for Multi-Agent Systems

学习面向延迟的并行多智能体系统编排

Xi Shi, Mengxin Zheng, Qian Lou

机构 * University of Central Florida(中央佛罗里达大学)

专题命中 效率与部署 :LLM(abstract);分类 cs.CL、cs.AI

AI总结 本文提出LAMaS框架,通过显式优化关键路径降低多智能体系统并行执行的延迟,提升效率和性能。

Comments Preprint. Previously this version appeared as arXiv:2607.13359 which was submitted as a new work by accident

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17897 2026-08-14 cs.CV cs.AI cs.LG cs.RO 版本更新 62%

RadarGen: Automotive Radar Point Cloud Generation from Cameras

RadarGen:从摄像头生成汽车雷达点云

Tomer Borreda, Fangqiang Ding, Sanja Fidler, Shengyu Huang, Or Litany

机构 * Technion(技术学院) MIT(麻省理工学院) NVIDIA(英伟达) University of Toronto(多伦多大学) Vector Institute(向量研究所)

专题命中 效率与部署 :foundation model(abstract);分类 cs.AI、cs.LG

AI总结 RadarGen通过扩散模型从摄像头图像生成逼真的雷达点云,结合BEV对齐的深度、语义和运动线索,提升雷达生成的物理合理性与多模态模拟能力。

Comments ECCV 2026. Project page: https://radargen.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.12532 2026-08-14 cs.CV cs.AI cs.LG eess.IV eess.SP 版本更新 62%

Exploring Sparsity for Parameter Efficient Fine Tuning Using Wavelets for Vision

探索用于视觉参数高效微调的小波稀疏性

Ahmet Bilican, M. Akın Yılmaz, A. Murat Tekalp, R. Gökberk Cinbiş

机构 * Dept. of Electrical and Electronics Engineering, Koç University(电子工程系,科奇大学) Codeway AI Research(Codeway人工智能研究) Dept. of Computer Engineering, Middle East Technical University(计算机工程系,中东技术大学)

专题命中 效率与部署 :foundation model(abstract);分类 cs.AI、cs.LG

AI总结 该研究提出小波微调(WaveFT),利用权重矩阵小波域的稀疏更新实现细粒度参数控制,在视觉任务的参数高效微调方法中达最优,已纳入Hugging Face PEFT库。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13524 2026-08-14 cs.LG 新提交 57%

DARTree: Speculative Diffusion Decoding with Autoregressive Draft Trees

DARTree:基于自回归草稿树的推测式扩散解码

Tianyi Li, Yaxin Luo, Xinyi Shang, Zhiqiang Shen

专题命中 效率与部署 :language model(abstract);分类 cs.LG

AI总结 DARTree是无需训练的推测式解码方法,将AR修正头从链扩展至树,在7个数学、代码、聊天基准的4种模型-温度配置下,实现最高平均接受长度与加速比,达9.73倍无损加速。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13387 2026-08-14 cs.CL 新提交 57%

CROP: Task Relevance via Counterfactuals for Selective On-Policy Distillation

CROP:基于反事实的任务相关性用于选择性在线策略蒸馏

Enhan Li, Junhao He, Hongyang Du

机构 * The University of Hong Kong(香港大学)

专题命中 效率与部署 :language model(abstract);分类 cs.CL

AI总结 针对选择性在线策略蒸馏中任务相关性表征不足的问题,提出基于反事实的CROP方法,可识别更有用的监督位置,在两种师生设置中分别提升性能1.92和2.96个百分点。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13293 2026-08-14 cs.AI 新提交 57%

NAS-Driven Hardware Accelerator Exploration for Edge AI and Quantization Effects on the Pareto Space

面向边缘AI的NAS驱动硬件加速器探索及量化对帕累托空间的影响

Eleftherios Mylonas, Angelos Kouprizas, Michael Birbas, Alexios Birbas

机构 * University of Patras(帕特雷大学)

专题命中 效率与部署 :post-training(abstract);分类 cs.AI

AI总结 本文针对边缘AI部署需求,提出结合NAS、量化与可重构加速器探索的三阶段流水线,实证分析INT4 PTQ对NAS帕累托空间的影响,发现FP32零样本代理覆盖度更优。

Comments 6 pages, 6 figures, accepted for presentation to the 39th IEEE International System-on-Chip Conference, Heidelberg, Germany, September 30 - October 2, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13226 2026-08-14 cs.CV cs.AI 新提交 57%

CoverPrune: Coverage-Driven Token Pruning for 3D VLMs via Optimal Transport

CoverPrune:基于最优传输的3D视觉语言模型的覆盖驱动型令牌剪枝

Peng Ling, Yingda Yin, Lingting Zhu, Weikai Chen, Shengju Qian, Zeyu Hu, Xin Wang, Wenming Yang

机构 * Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) LIGHTSPEED

专题命中 效率与部署 :language model(abstract);分类 cs.AI

AI总结 针对3D VLMs因大量视觉令牌导致的计算瓶颈,提出CoverPrune框架,将剪枝转化为最优传输问题,结合FST成本与SGS算法,实现高效剪枝且性能优异。

Comments Accepted to ECCV 2026 as an Oral Presentation

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12989 2026-08-14 cs.LG 新提交 57%

Balanced Adaptive Prototype Selection for Scalable TabPFN Inference on Large-Scale Tabular Data

面向大规模表格数据的可扩展TabPFN推理的平衡自适应原型选择

Mahboobe Jadid, Melika Rezaye Garkani, Ali Mousavi

机构 * Islamic Azad University(伊斯兰阿扎德大学)

专题命中 效率与部署 :foundation model(abstract);分类 cs.LG

AI总结 本文提出BAPS框架,无需修改预训练TabPFN模型,可将百万级表格数据集的上下文压缩约1953倍,用512个原型保留预测性能,实现其在大规模表格数据上的可扩展推理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12925 2026-08-14 cs.LG 新提交 57%

Momentum as Residual-Driven Multiplier Correction for Deep Learning Optimization

深度学习优化中作为残差驱动乘子校正的动量

Zhixin Ren, Yau Lyu, Congrong Li, Liping Zhang, Shengbo Eben Li

专题命中 效率与部署 :language model(abstract);分类 cs.LG

AI总结 本研究提出AIM框架将动量解释为残差驱动乘子校正,并基于此开发RADAR优化器,经多任务实验验证其性能优于现有强自适应优化器基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12611 2026-08-14 cs.CV cs.LG 新提交 57%

From Visual Widgets to UI Code: Efficient Tool-Grounded Generation

从视觉控件到UI代码:高效的基于工具的生成

Houston H. Zhang, Tao Zhang, Li Gu, Linfeng Ye, Yuanhao Yu, Xinxin Zuo, Yang Wang, Zhixiang Chi

机构 * McMaster University(麦克马斯特大学) University of Toronto(多伦多大学) Concordia University(康考迪亚大学)

专题命中 效率与部署 :prompting(abstract);分类 cs.LG

AI总结 本研究提出轻量级工具框架WidgetGen,在6个多模态模型和1000个控件上,其视觉重建指标优于直接提示和Widget2Code,且重建的图像-代码对可提升Qwen系列模型性能

Comments ECCV2026 (MUCG Workshop)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09233 2026-08-14 cs.LG cs.CV 版本更新 57%

DreOPD: Degraded-Reference Extrapolative On-Policy Distillation for Flow-matching Models

DreOPD:用于流匹配模型的退化参考外推式在线策略蒸馏

Mingfeng Lin, Chengfei Cai, Lin Xu, Yuxiang Wei, Liang Han

机构 * Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳)) Zhejiang University(浙江大学) Harbin Institute of Technology(哈尔滨工业大学)

专题命中 效率与部署 :post-training(abstract);分类 cs.LG

AI总结 本研究提出用于流匹配模型的DreOPD方法,将隐式奖励外推转为闭式速度回归并引入退化参考强化对比,在单/多教师设置下,其平均性能优于OPD及多任务RL基线,多数指标超专用教师。

Comments project page: https://sleepy1231.github.io/DreOPD/

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01735 2026-08-14 cs.AI 版本更新 57%

DAPD: Dual-Anchored Policy Distillation

DAPD:双锚定策略蒸馏

Jianyu Wu, Yizhou Wang, Encheng Su, Chen Tang, Shixiang Tang

专题命中 效率与部署 :post-training(abstract);分类 cs.AI

AI总结 针对在线策略蒸馏的特权幻觉问题,本文提出双锚定策略蒸馏框架,通过两级锚定机制缓解信息不对称,在Qwen3-4B等模型上显著提升性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23724 2026-08-14 cs.CV cs.AI 版本更新 57%

Zoom In, Reason Out: Efficient Far-field Anomaly Detection in Expressway Surveillance Videos via Focused VLM Reasoning Guided by Bayesian Inference

聚焦推理,推断出异常:通过贝叶斯推理引导的聚焦VLM推理实现高速公路视频远场异常检测

Xiaowei Mao, Bowen Sui, Weijie Zhang, Yawen Yang, Shengnan Guo, Shilong Zhao, Jiaqi Lin, Tingrui Wu, Youfang Lin, Huaiyu Wan

机构 * School of Computer Science and Technology, Beijing Jiaotong University(北京交通大学计算机科学与技术学院) Key Laboratory of Big Data & Artificial Intelligence in Transportation, Ministry of Education(教育部交通运输大数据与人工智能重点实验室) Beijing Key Laboratory of Traffic Data Mining and Embodied Intelligence (2018)(北京市交通数据挖掘与具身智能重点实验室)

专题命中 效率与部署 :language model(abstract);分类 cs.AI

AI总结 本文提出VIBES框架,通过贝叶斯推理引导的聚焦VLM推理,解决远场目标异常检测中的注意力稀释和计算成本问题,提升检测准确性和实时效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16878 2026-08-14 cs.LG 版本更新 57%

OC-Distill: Ontology-aware Contrastive Learning with Cross-Modal Distillation for ICU Risk Prediction

OC-Distill:基于跨模态蒸馏的面向本体的对比学习用于ICU风险预测

Zhongyuan Liang, Junhyung Jo, Hyang-Jung Lee, Sang Kyu Kim, Irene Y. Chen

机构 * UC Berkeley(伯克利大学) UCSF(旧金山大学) Samsung Advanced Institute of Technology (SAIT)(三星先进技术研究所)

专题命中 效率与部署 :pretraining(abstract);分类 cs.LG

AI总结 OC-Distill通过两阶段框架提升ICU风险预测性能,利用本体感知对比学习和跨模态知识蒸馏,提高模型对患者相似性的捕捉能力及预测效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21487 2026-08-14 math.OC cs.LG 版本更新 57%

Manifold constrained steepest descent for smooth and closed-set optimization

流形约束最速下降

Kaiwei Yang, Lexiao Lai

机构 * Department of Mathematics, University of Hong Kong, Hong Kong, China(香港大学数学系)

专题命中 效率与部署 :LLM(abstract_cn);分类 cs.LG

AI总结 本文提出流形约束最速下降(MCSD)方法,通过单循环框架在流形上进行优化,并引入SPEL在Stiefel流形上的应用,实现了更稳定的性能和可扩展性。

Comments 29 pages, 3 figures, and 2 tables. Compared to the previous version, introduced a new variant MCSD-TP and a hybrid algorithm MCSD-PGD for close-set optimization

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13502 2026-08-14 cs.CV 新提交 50%

GS$^{2}$CI: Robust Gaussian Splatting For Snapshot Compressive Imaging via Large Vision Model Priors

GS²CI:基于大视觉模型先验的快照压缩成像鲁棒高斯溅射方法

Yanming Yang, Chenxi Song, Ping Wang, Xin Yuan, Chi Zhang

机构 * Westlake University(西湖大学)

专题命中 效率与部署 :foundation model(abstract)

AI总结 该研究针对快照压缩成像的三维重建难题,提出结合三维高斯溅射与大视觉模型先验的框架,引入专属致密化策略提升稳定性,在多基准实验中实现了最优整体性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13343 2026-08-14 cs.CV 新提交 50%

AmalthAI: An Open-Source Computer Vision Platform for Cultural Heritage

AmalthAI:面向文化遗产的开源计算机视觉平台

Christos Chatzisavvas, Stelios Alvanos, Efstratios Politis, Panagiotis Rigas, Thomas Pappas, Ioannis Giannoukos, Nikolaos Mitianoudis, Agata Ulanowska, Katarzyna Żebrowska, Nazarij Buławka, Christina Margariti, George Pavlidis, Chairi Kiourt, Anestis Koutsoudis, Vassilis Katsouros, George Ioannakis

机构 * Democritus University of Thrace(德谟克利特色雷斯大学) Athena Research Center(雅典娜研究中心) National and Kapodistrian University of Athens(雅典国立卡波迪斯特里亚大学) University of Warsaw(华沙大学)

专题命中 效率与部署 :language model(abstract)

AI总结 AmalthAI是面向文化遗产领域专家的开源计算机视觉平台,通过集成Kubeflow、Katib等工具,支持数据集管理、模型训练与推理,可保障敏感考古数据安全,已在黏土织物印痕数据集上验证其功能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13045 2026-08-14 cs.CV 新提交 50%

P2Fusion: Prompt-based Progressive Infrared-Visible Image Fusion via Dual-Prior Distillation

P2Fusion:基于提示的双先验蒸馏红外-可见光图像渐进融合

Yi Shi, Huichao Xie, Yuqing Wang, Mingyu Wang, Kaihui Yang, Yu Liu, Ruitao Lu, Lizhe Li, Junwei Han, Dingwen Zhang

机构 * Northwestern Polytechnical University(西北工业大学) Hefei University of Technology(合肥工业大学) Rocket Force University of Engineering(火箭军工程大学) Chongqing University of Posts and Telecommunications(重庆邮电大学)

专题命中 效率与部署 :foundation model(abstract)

AI总结 针对红外-可见光图像融合的信息差异挑战,提出基于双固有提示的P2Fusion框架,结合Teach-to-Fuse机制与GDER模块,在多数据集上实现SOTA性能并提升下游感知鲁棒性。

Comments Accepted by ECCV 2026. Website: https://p2fusion.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 领域大模型 32 篇

2411.16818 2026-08-14 cs.CL cs.AI cs.LG 版本更新 90%

Enhancing In-Hospital Mortality Prediction Using Multi-Representational Learning with LLM-Generated Expert Summaries

利用结合大语言模型生成的专家摘要的多表征学习提升住院死亡率预测

Harshavardhan Battula, Jiacheng Liu, Jaideep Srivastava

专题命中 领域大模型 :LLM(title,summary_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本研究提出结合LLM生成的ICU记录专家摘要与生理数据的多表征框架,在MIMIC-III数据集上验证其可提升住院死亡率预测性能,且摘要主要通过重组记录已有信息实现提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30384 2026-08-14 astro-ph.IM astro-ph.GA 版本更新 89%

The EPS Research Astro-RAG Platform: A Unified Open-Science Infrastructure for Cross-Epoch Astrophysical Kinematic Analysis, LLM-Assisted Research Workflows, and Educational Outreach

EPS Research Astro-RAG平台:用于跨纪元天体物理运动学分析、LLM辅助研究工作流程和教育推广的统一开放科学基础设施

David C. Flynn

专题命中 领域大模型 :LLM(title,title_cn)

AI总结 提出一个开放科学平台,整合四个跨纪元天体物理语料库、120个可执行Jupyter笔记本示例,并利用LLM辅助检索增强生成(RAG)研究工作流程,通过ω运动学校正揭示从z=0到z~5的角速度符号反转。

Comments 5 pages, no figures, no tables. Platform release: four open astrophysical corpora (772 objects, z=0 to z~6), 120 verified Jupyter notebooks, QuickStart reproducibility pathway, and High-School Exploration Track. Zenodo DOIs: 10.5281/zenodo.19563417, 10.5281/zenodo.20320362, 10.5281/zenodo.19907765, 10.5281/zenodo.20369285. GitHub: github.com/eps-research/rag-corpus-series

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12407 2026-08-14 cs.DB 新提交 88%

From Relational and Property Graph Data to Large Language Models

从关系型和属性图数据到大语言模型

Malcolm Crowe, Fritz Laux

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract)

AI总结 本文提出一种结合关系型与属性图数据的数据管理服务器,通过引用值替代外键协调两种模型,将其知识模型提供给大语言模型生成工具,还给出基于三元组的知识库示例以验证该系统的可行性。

Comments 7 pages, 4 figures, 4 tables

Journal ref IARIA Congress 2026 : The 2026 IARIA Annual Congress on Frontiers in Science, Technology, Services, and Applications

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.02776 2026-08-14 cs.CL 版本更新 87%

Topics as Proxies for Sociodemographics: How Conversational Context Affects LLM Answers

话题作为社会人口统计的代理:对话上下文如何影响大语言模型的回答

Vera Neplenbroek, Gabriele Sarti, Arianna Bisazza, Raquel Fernández

机构 * Institute for Logic, Language and Computation, University of Amsterdam(逻辑、语言与计算研究所,阿姆斯特丹大学) Khoury College of Computer Sciences, Northeastern University(计算机科学学院,东北大学) Center for Language and Cognition, University of Groningen(语言与认知中心,格罗宁根大学)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 研究大语言模型在高风险场景中对话上下文对回答差异的影响,发现话题是社会人口统计差异的主要驱动因素,且影响方式不可预测。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13017 2026-08-14 cs.HC 新提交 86%

How LLMs Respond to Escalating Delusions: Four Longitudinal Trajectories of Model Behavior

大语言模型(LLM)对日益严重的妄想的反应:模型行为的四种纵向轨迹

Anna Sterna, Kacper Dudzic, Karolina Drożdż, Hubert Plisiecki, Marcin Rządeczka, Marcin Moskalewicz

专题命中 领域大模型 :LLM(title_cn,summary_cn)

AI总结 本研究通过30天的纵向实验,评估15种主流LLM对模拟精神症状进展的反应,识别出四种不同行为轨迹,提出需从识别时机、稳定性和干预准确性维度纵向评估LLM加剧AI精神病的潜力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08199 2026-08-14 cs.CV 版本更新 86%

Generalizable Operating Room Expert with Multimodal Enhancement

具备多模态增强能力的可泛化手术室专家

Peiqi He, Zhenhao Zhang, Yixiang Zhang, Jiaxin Liu, Xiongjun Zhao, Shaoliang Peng

专题命中 领域大模型 :language model(title,abstract);large language model(title)

AI总结 针对手术室空间建模的局限,提出仅用RGB图像推理的多模态大语言模型OR-Expert,通过内部推导空间线索实现三维推理,在手术室基准上达SOTA且泛化性良好。

Comments Accepted by ACM Multimedia 2026

详情

展开后加载摘要…

URL PDF HTML 收藏