arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-06-02 至 2026-06-02 共收录 848 信号源:cs.CL, cs.AI, cs.LG

1. 领域大模型 58 篇

2602.12984 2026-06-02 cs.CL 83%

SciAgentGym: Benchmarking Multi-Step Scientific Tool-use in LLM Agents

SciAgentGym:LLM代理中多步科学工具使用的基准测试

Yujiong Shen, Yajie Yang, Zhiheng Xi, Binze Hu, Huayu Sha, Jiazheng Zhang, Qiyuan Peng, Junlin Shang, Jixuan Huang, Yutao Fan, Jingqi Tong, Shihan Dou, Ming Zhang, Lei Bai, Zhenfei Yin, Tao Gui, Xingjun Ma, Qi Zhang, Xuanjing Huang, Yu-Gang Jiang

机构 * Fudan NLP Group(复旦大学自然语言处理组)

专题命中 领域大模型 :LLM(title,title_cn);分类 cs.CL

AI总结 为解决当前基准忽视代理在科学工作流中编排工具能力的问题,提出包含1780个领域特定工具的可扩展交互环境SciAgentGym和分层评估套件SciAgentBench,并设计数据合成方法SciForge,通过微调使SciAgent-8B超越更大模型,展示科学工具使用能力的跨领域正迁移。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.23220 2026-06-02 cs.CV cs.AI 83%

Med-Scout: Curing MLLMs' Geometric Blindness in Medical Perception via Geometry-Aware RL Post-Training

Med-Scout: 通过几何感知的强化学习后训练治愈多模态大语言模型在医学感知中的几何盲点

Anglin Liu, Ruichao Chen, Yi Lu, Hongxia Xu, Jintai Chen

机构 * HKUSTGZ-ML4Health-Lab(香港科技大学-ML4Health实验室)

专题命中 领域大模型 :post-training(title);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出Med-Scout框架,利用无标注医学图像中的内在几何逻辑,通过强化学习和三种代理任务(层次尺度定位、拓扑拼图重建、异常一致性检测)来缓解多模态大语言模型的几何盲点,并在新基准Med-Scout-Bench上提升超过40%的几何感知性能,同时泛化到更广泛的医学理解任务。

Comments 29 pages, 14 figures. Accepted at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00272 2026-06-02 cs.AI cs.CL cs.CY 82%

On Wednesdays, We Ask Questions: Optimizing "Active Listening" in Automated Legal Triage and Referral

在周三,我们提问:优化自动化法律分诊与转介中的“主动倾听”

Quinten Steenhuis, Jacqueline Harvey

机构 * Suffolk University Law School(苏福克大学法学院)

专题命中 领域大模型 :LLM(summary_cn,abstract);分类 cs.CL、cs.AI

AI总结 本文通过专家律师和LLM评估FETCH分类器的追问问题方法,发现低成本LLM在分类任务中表现良好但生成高质量问题需高成本模型,并提出法律分诊问题评估标准。

Comments Working paper submitted as accepted to AIDA2J workshop at International Conference for AI and Law in Singapore, June 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00125 2026-06-02 cs.IR cs.AI cs.LG cs.MM 82%

Multimodal Music Recommendation System using LLMs

使用LLMs的多模态音乐推荐系统

Srikar Prabhas Kandagatla, Sreehitha R. Narayana, Chandana Magapu, Swetha Mohan, Shamanth Kuthpadi, Hongjie Chen, Ryan A. Rossi, Franck Dernoncourt, Nesreen Ahmed

机构 * University of Massachusetts Amherst(马萨诸塞大学阿姆赫斯特分校) Dolby Laboratories(Dolby实验室) Adobe Research(Adobe研究) Cisco Research(Cisco研究)

专题命中 领域大模型 :LLM(summary_cn,abstract);分类 cs.AI、cs.LG

AI总结 提出一个多模态框架,通过融合音频、歌词、LLM生成的语义元数据和收听完成率,在基于会话的音乐推荐中显著提升Recall和NDCG。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06448 2026-06-02 cs.LG cs.AI 82%

Principle-Evolvable Scientific Discovery via Uncertainty Minimization

通过不确定性最小化实现原理可演化的科学发现

Yingming Pu, Tao Lin, Hongyu Chen

机构 * Westlake University(西lake大学) Zhejiang University(浙江大学)

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 提出PiEvo框架,将科学发现视为原理空间上的贝叶斯优化,通过信息导向假设选择与异常驱动增强机制,使智能体自主演化理论世界观,在四个基准上平均解质量达90.81%~93.15%,收敛速度提升83.3%。

Comments Proceedings of the 43rd International Conference on Machine Learning, Seoul, South Korea. PMLR 306, 2026. Copyright 2026 by the author(s)

Journal ref Proc. 43rd Intl. Conf. on Machine Learning (ICML 2026), PMLR 306

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.02276 2026-06-02 cs.CV cs.AI cs.CL cs.LG 82%

Cross-modal linkage risk in clinical vision-language models

临床视觉-语言模型中的跨模态链接风险

Soroosh Tayebi Arasteh, Mahshad Lotfinia, Sven Nebelung, Daniel Truhn

机构 * Lab for AI in Medicine(医学人工智能实验室) RWTH Aachen University(亚琛工业大学) Department of Diagnostic and Interventional Radiology(诊断与介入放射学部门)

专题命中 领域大模型 :language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 研究临床视觉-语言模型(VLM)在图像与报告分离场景下通过余弦相似度实现跨模态重链接的风险,并采用仅对投影头进行差分隐私微调的方法在保持图像效用同时显著降低重链接率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00370 2026-06-02 cs.HC cs.AI 81%

Agentic Authoring of Interactive Multiview Visualizations in Genomics

交互式多视图基因组学可视化的智能体创作

Astrid van den Brandt, Kiroong Choe, Sehi L'Yi, Devin Lange, Nils Gehlenborg

机构 * Harvard Medical School(哈佛医学院) Boston College(波士顿学院)

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 针对基因组学可视化创作中定制化不足和编程门槛高的问题,提出基于大语言模型的智能体方案,通过结构化输出和迭代优化提升可视化质量。

Comments 11 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00087 2026-06-02 cs.CV cs.AI 81%

Structured Visual Evidence Decomposition for Evidence-Grounded Multimodal Screening of Obstructive Sleep Apnea-Hypopnea Syndrome

结构化视觉证据分解用于阻塞性睡眠呼吸暂停低通气综合征的证据驱动多模态筛查

Chen Zhan, Yingchen Wei, Xiaoyu Tan, Jingjing Huang, Xihe Qiu

机构 * School of Electronic and Electrical Engineering, Shanghai University of Engineering Science(上海工程技术大学电子与电气工程学院) Tencent Youtu Lab(腾讯云视频实验室) ENT Institute and Department of Otorhinolaryngology, Eye & ENT Hospital of Fudan University(复旦大学耳鼻喉科医院耳鼻喉科研究所) National University of Singapore(新加坡国立大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);foundation model(abstract);prompting(abstract)

AI总结 提出EviOSAHS框架,通过将面部图像分解为七个解剖查询并生成结构化证据卡,结合临床信息进行高灵敏度OSAHS筛查。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26305 2026-06-02 cs.AI cs.SY eess.SY hep-ph 81%

Experiments in Agentic AI for Science

科学领域中的自主AI代理实验

Judy Fox, Geoffrey Fox

机构 * School of Data Science, Department of Computer Science, and Biocomplexity Institute, University of Virginia(数据科学学院、计算机科学系和生物复杂性研究所,弗吉尼亚大学)

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出两种基于本地体-远程脑架构的自主AI代理框架,通过系统工程技术克服上下文和推理限制,分别用于时间序列数据集的大规模自动整理和物理讲座的结构化报告生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23593 2026-06-02 cs.AI 81%

When AI reviews science: Can we trust the referee?

当AI评审科学:我们能信任审稿人吗?

Jialiang Wang, Yuchen Liu, Hang Xu, Kaichun Hu, Shimin Di, Wangze Ni, Linan Yue, Min-Ling Zhang, Kui Ren, Lei Chen

机构 * School of Electronic Engineering, Southeast University(东南大学电子工程学院) Zhejiang University(浙江大学)

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 针对AI审稿的安全性和可靠性问题,本文通过分类攻击类型并实验验证声望框架、断言强度、反驳谄媚和上下文投毒对评分的影响,为评估AI同行评审的可靠性提供基线。

Journal ref The Innovation Informatics 2:100030 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01800 2026-06-02 cs.AI 81%

REBot: From RAG to CatRAG with Semantic Enrichment and Graph Routing

REBot: 从RAG到CatRAG——语义增强与图路由

Thanh Ma, Tri-Tam La, Lam-Thu Le Huu, Minh-Nghi Nguyen, Khanh-Van Pham Luu

机构 * CTU(越南科技大学)

专题命中 领域大模型 :LLM(summary_cn,abstract);分类 cs.AI

AI总结 提出REBot,一种基于CatRAG混合检索推理框架的LLM增强咨询聊天机器人,通过语义增强的分层类别知识图谱和图路由实现学术法规建议,在分类和问答任务上达到98.89%的F1分数。

Comments Published in Communications in Computer and Information Science (CCIS), Springer, 2025. DOI: 10.1007/978-981-95-4960-3_35

Journal ref Communications in Computer and Information Science (CCIS), Springer, 2025, pp. 435-447

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01300 2026-06-02 cs.LG cs.AI 81%

ChronosAD: Leveraging Time Series Foundation Models for Accurate Anomaly Detection

ChronosAD:利用时间序列基础模型进行精确异常检测

Uzair Khan, Luigi Capogrosso, Francesco Biondani, Michele Magno, Franco Fummi, Francesco Setti, Marco Cristani

机构 * PR Veneto FESR 2021-2027(普罗文托地区FESR 2021-2027项目) Action 1.1.1(行动1.1.1) DGR 792 CUP D19J24000810007

专题命中 领域大模型 :foundation model(title,abstract);分类 cs.AI、cs.LG

AI总结 提出ChronosAD架构,通过时间序列基础模型提取特征并结合BiLSTM与多头注意力机制,实现跨域鲁棒的异常检测,在11个基准上平均AUC提升4.72%,AP提升6.60%。

Comments Accepted at the 24th IEEE International Conference on Industrial Informatics (INDIN) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00206 2026-06-02 cs.AI cs.CL 81%

Addressing Longstanding Challenges in Cognitive Science with Language Models

用语言模型应对认知科学中长期存在的挑战

Dirk U. Wulff, Rui Mata

机构 * Center for Adaptive Rationality, Max Planck Institute for Human Development(适应性理性中心,马克斯·普朗克人类发展研究所) Faculty of Psychology, University of Basel(心理学系,巴塞尔大学)

专题命中 领域大模型 :language model(title,abstract);分类 cs.CL、cs.AI

AI总结 本文探讨如何利用语言模型应对认知科学中研究整合、形式化、概念清晰度等长期挑战,并指出其风险与机遇。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.13805 2026-06-02 cs.LG cs.AI stat.ML 81%

Towards a Physics Foundation Model

迈向物理基础模型

Florian Wiesner, Zoë J. Gray, Matthias Wessling, Stephen Baek

机构 * University of Cambridge(剑桥大学)

专题命中 领域大模型 :foundation model(title,abstract);分类 cs.AI、cs.LG

AI总结 提出通用物理变换器(GPhyT),通过在大规模多样化模拟数据上训练,实现单一模型在多个物理领域(如流固耦合、冲击波、热对流和多相流)的零样本泛化与长期稳定预测,性能超越专用架构7倍以上。

Comments ICML-AI4Physics 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00042 2026-06-02 cs.CY cs.ET 80%

TransResAI: A Compound AI System for Coastal Transportation Resilience

TransResAI: 用于沿海交通韧性的复合AI系统

Qingwen Pu, Kun Xie, Chenyu Yan

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 提出TransResAI复合AI系统,通过自然语言交互集成大语言模型与多模块,实现洪水感知的交通韧性分析,在专家用户研究中将任务完成时间减少80-88%,准确率保持4.60/5.00。

Comments 36 pages, 13 figures, 3 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28334 2026-06-02 cs.CR 80%

Towards Cybersecurity SuperIntelligence (CSI): What's the best harness for cybersecurity?

迈向网络安全超级智能(CSI):什么是网络安全的最佳驾驭方式?

Víctor Mayoral-Vilches, Francesco Balassone, María Sanz-Gómez, Paul Zabalegui Landa, Daniel Sánchez Prieto, Marina Oteiza Álvarez, Davide Quarta, Martin Pinzger

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 提出一种元脚手架(meta-scaffold)统一异构智能体框架,通过黑板架构实现多框架并行协作,在33个cybench挑战中覆盖率达57.6%,相比最佳单一框架提升27%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21772 2026-06-02 cs.CR 80%

PhishLumos: An Adaptive Multi-Agent System for Proactive Phishing Campaign Mitigation

PhishLumos:一种用于主动缓解钓鱼攻击活动的自适应多智能体系统

Daiki Chiba, Hiroki Nakano, Takashi Koide

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 提出PhishLumos自适应多智能体系统,利用大语言模型智能体分析共享基础设施,在专家确认前一周主动识别钓鱼活动,实现从被动URL拦截到主动活动缓解的转变。

Comments Originally presented at IEEE ICC 2026. An extended version of this work has been published in IEEE Access: https://doi.org/10.1109/ACCESS.2026.3696597

Journal ref D. Chiba, H. Nakano, and T. Koide, "PhishLumos: From a Single URL to Campaign-Level Phishing Mitigation," IEEE Access, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00750 2026-06-02 cs.CL 79%

I-WebGenBench : Evaluating Interactivity in LLM-Generated Scientific Web Applications

I-WebGenBench: 评估大语言模型生成的科学网页应用中的交互性

Dasen Dai, Biao Wu, Meng Fang, Shuoqi Li, Wenhao Wang

机构 * Vast Intelligence Lab(vast 智能实验室) UTS University of Liverpool(利物浦大学)

专题命中 领域大模型 :LLM(title);language model(abstract);分类 cs.CL

AI总结 提出 Paper-to-Interactive-System Agent 将研究论文转化为可执行交互式网页系统,并构建 PaperVoyager 框架以显式建模机制和交互逻辑,显著提升生成质量。

Comments 9 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.02398 2026-06-02 cs.LG cs.CL 79%

A Local Perturbation Theory for Cross-Domain Interference and Recovery in Multi-Domain RL

跨域干扰与恢复的局部微扰理论:多领域强化学习

Lei Yang, Siyu Ding, Deyi Xiong

机构 * TJUNLP Lab, College of Intelligence and Computing, Tianjin University(天津大学智能与计算学院TJUNLP实验室) Baidu Inc.(百度公司)

专题命中 领域大模型 :large language model(abstract);language model(abstract);post-training(abstract);分类 cs.CL、cs.LG

AI总结 针对多领域RL训练中一个领域性能下降的问题,提出局部微扰理论,证明后期领域训练主要通过二阶损伤项在低维共享冲突子空间中损害早期领域,并通过短时领域刷新实现选择性恢复。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.02983 2026-06-02 cs.CL cs.AI 79%

Truth, Trust, and Trouble: Medical AI on the Edge

真相、信任与麻烦:边缘上的医疗AI

Mohammad Anas Azeez, Rafiq Ali, Ebad Shabbir, Zohaib Hasan Siddiqui, Gautam Siddharth Kashyap, Jiechao Gao, Usman Naseem

机构 * Jamia Hamdard(贾迈亚哈姆达德大学) DSEU-Okhla Macquarie University(麦考瑞大学) Center for SDGC, Stanford University(SDGC中心,斯坦福大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL、cs.AI

AI总结 通过一个包含1000多个健康问题的基准测试框架,评估Mistral-7B、BioMistral-7B-DARE和AlpaCare-13B三个模型在诚实、有用性和无害性方面的表现,发现AlpaCare-13B准确率最高(91.7%)且无害性最佳(0.92),而领域微调可提升安全性,少样本提示能提高准确率,但复杂查询下有用性下降。

Comments Accepted at EMNLP 2025 (Industry Track)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00282 2026-06-02 cs.IR cs.AI 77%

Synthetic Data from Cross-Domain Events for Large-Scale Recommendation Systems

跨域事件的合成数据用于大规模推荐系统

Xiangyu Wang, Yawen He, Shivendra Pratap Singh, Han Huang, Mengtong Hu, Sharath Ciddu, Yi-Hsuan Hsieh, Erik Groving, Yi Ding, Jieming Di, Tony Wang, Min Yun, Xiaoyu Chen, Ling Leng, Rob Malkin

机构 * Meta

专题命中 领域大模型 :LLM(abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出SCALR框架,通过源域事件生成目标域的合成用户-物品交互事件,以缓解数据稀疏和噪声反馈问题,并在工业推荐平台的在线A/B测试中取得显著改进。

Comments 13 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00005 2026-06-02 cs.AI 77%

Emergent Collaborative Deliberation in Multi-Model AI Systems: A BFT-Derived Protocol for Epistemic Synthesis

多模型AI系统中的涌现协作审议:一种源自BFT的认知综合协议

VD Doske

机构 * Independent Researcher(独立研究者) Consilia

专题命中 领域大模型 :RLHF(abstract,abstract_cn);language model(abstract);分类 cs.AI

AI总结 提出Consilium协议,一种基于拜占庭容错的多模型AI审议架构,将模型间分歧视为认知信号而非错误,通过认知角色分配和样本内外验证框架,实现低成本下与前沿模型相当的认知综合能力。

Comments 32 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.05671 2026-06-02 cs.CL 77%

ClinTutor-R1: Advancing Scalable and Robust One-to-Many Alignment in Clinical Socratic Education

ClinTutor-R1:在临床苏格拉底式教育中推进可扩展且稳健的一对多对齐

Zhitao He, Haolin Yang, Zeyu Qin, Yi R Fung

机构 * Hong Kong University of Science and Technology(香港理工大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);language agent(abstract);分类 cs.CL

AI总结 针对临床查房等一对多教学场景中上下文稀释与目标错位问题,提出基于多智能体模拟器ClinEdu构建的苏格拉底式教学数据集ClinTeach,并开发首个显式内部思维机制的一对多对齐视觉语言智能体ClinTutor-R1,通过建模个体信念状态与群体共识,在静态基准、交互评估、专家评审及200人真实用户研究中超越基线模型20%以上,达到与专有模型相当的性能,并展现出随学生规模扩展的教学质量可扩展性。

Comments Accepted by ICML 2026 (Spotlight)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01841 2026-06-02 cs.AI 74%

Retrieval-aligned Tabular Foundation Models Enable Robust Clinical Risk Prediction in Electronic Health Records Under Real-world Constraints

检索对齐的表格基础模型实现电子健康记录中在现实约束下的稳健临床风险预测

Minh-Khoi Pham, Thang-Long Nguyen Ho, Thao Thi Phuong Dao, Tai Tan Mai, Minh-Triet Tran, Marie E. Ward, Una Geary, Rob Brennan, Nick McDonald, Martin Crane, Marija Bezbradica

机构 * University of Cambridge(剑桥大学)

专题命中 领域大模型 :foundation model(title);分类 cs.AI

AI总结 针对电子健康记录中高维、异质、类别不平衡和分布偏移等挑战,提出任务对齐检索框架AWARE,通过监督嵌入学习和轻量适配器提升表格上下文学习性能,在极端不平衡下AUPRC提升高达12.2%。

Comments Not peer-reviewed

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00123 2026-06-02 cs.CV cs.AI cs.LG 73%

CardioLens: Revealing the Clinical Reality Gap of MLLMs via Multi-Sequence Cardiac MRI Evaluations

CardioLens: 通过多序列心脏MRI评估揭示MLLMs的临床现实差距

Zixian Su, Hongkai Zhang, Fan Gao, Encheng Su, Taiping Qu, Jingwei Guo, Nan Zhang, Hui Wang, Zhen Zhou, Kairui Bo, Yan Chen, Yue Ren, Shuai Li, Lei Xu, Henggui Zhang

机构 * Beijing Academy of Artificial Intelligence(北京人工智能研究院) Beijing Anzhen Hospital(北京安贞医院) Beihang University(北航) King Abdullah University of Science and Technology(国王 Abdullah 科学与技术大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 提出CardioLens测试平台,通过多序列心脏磁共振成像评估24个多模态大语言模型,发现其在临床工作流中表现不佳,存在类别崩溃失败模式,且输入选择和推理提示改进效果有限。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.02245 2026-06-02 cs.CL 70%

When Knowledge Is Not Free: Cost-Aware Evidence Selection in Retrieval-Augmented Generation

当知识并非免费:检索增强生成中的成本感知证据选择

Mingyan Wu, Han Yang, Omer Ben-Porat, Yftah Ziser

机构 * Northeastern University(东北大学) Technical University of Munich(慕尼黑技术大学) GESIS – Leibniz Institute for the Social Sciences(GESIS——莱比锡社会科学研究所) Technion–Israel Institute of Technology(技术学院——以色列理工学院) NVIDIA Research(NVIDIA研究) University of Groningen(格罗宁根大学)

专题命中 领域大模型 :LLM(abstract,abstract_cn);分类 cs.CL

AI总结 提出成本感知RAG设置,通过访问成本层级和预算约束,研究证据选择策略,发现静态选择脆弱而智能体方法有潜力但依赖模型和任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01783 2026-06-02 cs.IR cs.AI 70%

Breaking the Information Silo: Semantic Personas for Cross-Domain Recommendation

打破信息孤岛:面向跨域推荐的语义人物画像

Jonathan Mayo, Moshe Unger, Konstantin Bauman

机构 * Technology and Information Management Department, Coller School of Management, Tel Aviv University(技术与信息管理系,科勒管理学院,特拉维夫大学) Management Information Systems Department, Fox School of Business, Temple University(管理信息系统系,福克斯商学院, Temple大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出SPHERE方法,利用大语言模型生成语义人物画像,实现无共享用户或物品的跨域推荐,并通过双塔架构和动态融合门增强推荐性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01737 2026-06-02 cs.AI 70%

TrafficRAG: A Multimodal RAG Framework for Traffic Accident Liability Determination

TrafficRAG:用于交通事故责任认定的多模态RAG框架

Xu Li, Zedong Fu, Xinyi Li, Xun Han

机构 * Southwest Petroleum University(西南石油大学) Sichuan Police College(四川警察学院)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出TrafficRAG框架,通过视觉语言模型生成结构化描述、混合检索获取法规和案例、大语言模型融合多模态证据进行推理,实现自动化交通事故责任分析报告生成。

Comments 12 pages, 3 figures, accepted at ICANN 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00596 2026-06-02 cs.CL 70%

Toward Responsible and Epistemically Grounded Multilingual LLMs for Computational Social Science and Humanities

面向负责任且基于认识论的多语言大语言模型在计算社会科学与人文学科中的应用

Wajdi Zaghouani

机构 * Northwestern University in Qatar(卡塔尔西北大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文重新概念化多语言推理大语言模型为解释学工具,提出一个基于理论框架来评估其在社会科学与人文学科研究中的文化对齐、跨语言稳定性和推理忠实性。

Journal ref Proceedings of LLMs4SSH Workshop at LREC 2026, Palma de Mallorca, Spain, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00015 2026-06-02 cs.HC cs.AI cs.CY cs.ET 70%

SortingHat: Redefining Operating Systems Education with a Tailored Digital Teaching Assistant

SortingHat: 用定制的数字教学助手重新定义操作系统教育

Yifan Zhang, Xinkui Zhao, Zuxin Wang, Zhengyi Zhou, Guanjie Chen, Shuiguang Deng, Jianwei Yin

机构 * School of Software Technology, Zhejiang University(浙江大学软件学院)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 针对操作系统课程教学挑战,提出结合检索增强生成和多智能体强化学习的3D数字人教学助手SortingHat,提供个性化指导、自适应内容生成和自动评估。

Journal ref WWW '25: Companion Proceedings of the ACM on Web Conference 2025,Pages 2951 - 2954

详情

展开后加载摘要…

URL PDF HTML 收藏