arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-03-02 至 2026-03-02 共收录 12 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 12 篇

2602.03775 2026-03-02 cs.SI cs.AI 89%

An Empirical Study of Collective Behaviors and Social Dynamics in Large Language Model Agents

对大型语言模型代理中集体行为和社会动态的实证研究

Farnoosh Hashemi, Michael W. Macy

机构 * Cornell University(康奈尔大学)

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 本研究通过分析LLM代理的社会互动,发现其存在偏见和排斥行为,并提出CoST方法以防止有害内容的产生。

Comments Accepted at EACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23065 2026-03-02 cs.SE 85%

LLM-Powered Silent Bug Fuzzing in Deep Learning Libraries via Versatile and Controlled Bug Transfer

基于大语言模型的深度学习库中无声bug模糊测试技术:通过多功能且可控的bug转移

Kunpeng Zhang, Dongwei Xiao, Daoyuan Wu, Shuai Wang, Jiali Zhao, Yuanyi Lin, Tongtong Xu, Shaohua Wang

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 利用大语言模型实现深度学习库中无声bug的模糊测试,通过多功能且可控的bug转移技术发现79个新bug。

Journal ref ACM Program. Lang. 10, OOPSLA1, Article 150 (April 2026), 36 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23437 2026-03-02 cs.SI math.DS nlin.AO physics.soc-ph 85%

Learning dynamics from online-offline systems of LLM agents

从LLM代理的在线-离线系统学习动态

Moyi Tian, George Mohler, P. Jeffrey Brantingham, Nancy Rodríguez

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文研究了LLM代理在在线-离线系统中信息传播的动态,通过两种数学模型分析不同事件类型和性格对传播的影响,并发现SI模型能有效描述系统动态。

Comments 16 pages, 16 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21229 2026-03-02 q-fin.GN cs.CL cs.LG 82%

Forecasting Future Language: Context Design for Mention Markets

预测未来语言:提及市场中的上下文设计

Sumin Kim, Jihoon Kwon, Yoon Kim, Nicole Kagan, Raffi Khatchadourian, Wonbin Ahn, Alejandro Lopez-Lira, Jaewon Lee, Yoontae Hwang, Oscar Levy, Yongjae Lee, Chanyeol Choi

机构 * LinqAlpha Massachusetts Institute of Technology(麻省理工学院) Kalshi IBM LG AI Research(LG AI研究) University of Florida(佛罗里达大学) Seoul National University(首尔国立大学) Pusan National University(釜山国立大学) University of California, Berkeley(加州大学伯克利分校) UNIST(全南国立大学)

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 本文研究了提及市场中上下文设计对预测准确性的影响,提出市场条件提示(MCP)方法,通过结合市场概率和文本证据提升预测鲁棒性。

Comments 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07048 2026-03-02 q-fin.RM q-fin.ST 78%

LLM as a Risk Manager: LLM Semantic Filtering for Lead-Lag Trading in Prediction Markets

LLM作为风险管理者:用于预测市场领先滞后交易的LLM语义过滤

Sumin Kim, Minjae Kim, Jihoon Kwon, Yoon Kim, Nicole Kagan, Joo Won Lee, Oscar Levy, Alejandro Lopez-Lira, Yongjae Lee, Chanyeol Choi

专题命中 其他LLM :LLM(title,abstract)

AI总结 本文提出利用LLM进行语义过滤,以提升预测市场中领先滞后交易的稳定性与收益,通过因果筛选器优化交易策略,减少亏损风险。

Comments 11 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.24286 2026-03-02 cs.LG cs.AI 73%

CUDA Agent: Large-Scale Agentic RL for High-Performance CUDA Kernel Generation

CUDA Agent: 大规模代理强化学习用于高性能CUDA内核生成

Weinan Dai, Hanlin Wu, Qiying Yu, Huan-ang Gao, Jiahao Li, Chengquan Jiang, Weiqiang Lou, Yufan Song, Hongli Yu, Jiaze Chen, Wei-Ying Ma, Ya-Qin Zhang, Jingjing Liu, Mingxuan Wang, Xin Liu, Hao Zhou

机构 * Institute for AI Industry Research (AIR), Tsinghua University(人工智能产业研究院(AIR)、清华大学) SIA-Lab of Tsinghua AIR(清华大学AIR SIA实验室)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 CUDA Agent通过大规模代理强化学习系统,实现高性能CUDA内核生成,优于现有编译器和大型语言模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23547 2026-03-02 cs.CL 70%

France or Spain or Germany or France: A Neural Account of Non-Redundant Redundant Disjunctions

法国或西班牙或德国或法国:对非冗余冗余析取的神经账户

Sasha Boguraev, Qing Yao, Kyle Mahowald

机构 * Department of Linguistics The University of Texas at Austin(语言学系德克萨斯大学奥斯汀分校)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文通过神经机制解释了非冗余冗余析取现象,揭示了上下文敏感语义解释的机制,并补充了现有符号分析。

Comments 7 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.05535 2026-03-02 cs.RO cs.CL cs.HC cs.LG cs.MA 62%

Mixed-Initiative Dialog for Human-Robot Collaborative Manipulation

混合发起对话用于人机协作操作

Albert Yu, Chengshu Li, Luca Macesanu, Arnav Balaji, Ruchira Ray, Raymond Mooney, Roberto Martín-Martín

机构 * UT Austin(得克萨斯大学) OpenAI NYU(纽约大学) University of Edinburgh(爱丁堡大学)

专题命中 其他LLM :LLM(abstract);分类 cs.CL、cs.LG

AI总结 MICoBot通过混合发起对话范式提升人机协作任务的成功率和用户体验。

Comments Project website at https://robin-lab.cs.utexas.edu/MicoBot/

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23368 2026-03-02 cs.IR cs.AI 57%

Keyword search is all you need: Achieving RAG-Level Performance without vector databases using agentic tool use

关键词搜索足矣:无需向量数据库即可实现RAG级别的性能

Shreyas Subramanian, Adewale Akinfaderin, Yanyan Zhang, Ishan Singh, Mani Khanuja, Sandeep Singh, Maira Ladeira Tanke

专题命中 其他LLM :LLM(abstract);分类 cs.AI

AI总结 本文提出无需向量数据库,通过代理工具使用实现接近RAG的性能,展示了关键词搜索在问答任务中的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.24036 2026-03-02 cs.HC 50%

Designing AI Tutors for Interest-Based Learning: Insights from Human Instructors

为基于兴趣的学习设计AI导师:来自人类导师的见解

Abhishek Kulkarni, Sharon Lynn Chu

专题命中 其他LLM :LLM(abstract)

AI总结 本文通过分析人类导师的教学实践,揭示了基于兴趣的学习中兴趣整合的策略,并为大规模部署LLM驱动的AI导师提供了设计建议。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23869 2026-03-02 cs.CV 50%

Open-Vocabulary Semantic Segmentation in Remote Sensing via Hierarchical Attention Masking and Model Composition

通过层次化注意力掩码和模型组合实现遥感开放词汇语义分割

Mohammadreza Heidarianbaei, Mareike Dorozynski, Hubert Kanyamahanga, Max Mehltretter, Franz Rottensteiner

机构 * Institute of Photogrammetry and GeoInformation(摄影测量与地理信息研究所)

专题命中 其他LLM :language model(abstract)

AI总结 ReSeg-CLIP通过层次化注意力掩码和模型组合方法,实现无需训练的遥感开放词汇语义分割,取得最优性能。

Comments Published in the proceedings of the British Machine Vision Conference Workshops 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23746 2026-03-02 cs.HC cs.CV 50%

Shape vs. Context: Examining Human--AI Gaps in Ambiguous Japanese Character Recognition

形状与上下文:考察人类与AI之间的模糊日文字符识别差距

Daichi Haraguchi

机构 * CyberAgent

专题命中 其他LLM :language model(abstract)

AI总结 本研究通过比较人类与VLMs在模糊日文字符识别中的决策模式,揭示了形状上下文对人类与AI对齐的影响。

Comments Accepted to CHI 2026 Poster track

详情

展开后加载摘要…

URL PDF HTML 收藏