arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2026-05-04 至 2026-05-04 共收录 2 信号源:cs.CL, cs.AI, cs.LG

1. 代码与定理证明 2 篇

2605.00270 2026-05-04 cs.CL cs.AI cs.CY cs.HC 81%

Are You the A-hole? A Fair, Multi-Perspective Ethical Reasoning Framework

你真的是混蛋吗?一种公平、多视角的伦理推理框架

Sheza Munir, Ahanaf Rodoshi, Sumin Lee, Feiran Chang, Xujie Si, Syed Ishtiaque Ahmed

专题命中 代码与定理证明 :reasoning(title,abstract);分类 cs.CL、cs.AI

AI总结 本文提出一种结合神经语义提取与形式求解器的多视角伦理推理框架,通过MaxSAT解决高冲突领域中的逻辑一致性问题,实验显示其在Reddit论坛中生成的裁决在62%的情况下偏离流行标签,且与人类评估者一致率高达86%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19175 2026-05-04 cs.NI cs.AI cs.MA 57%

LLM-Based Agentic Negotiation for 6G: Addressing Uncertainty Neglect and Tail-Event Risk

基于大语言模型的6G智能协商:解决不确定性忽视和尾事件风险

Hatim Chergui, Farhad Rezazadeh, Mehdi Bennis, Merouane Debbah, Christos Verikoukis

机构 * i2CAT Foundation(i2CAT基金会) Technical University of Catalonia(技术大学巴塞罗那) University of Oulu(奥卢大学) Research Institute for Digital Future(数字未来研究院) Khalifa University(卡利法大学) ISI/ATH and University of Patras(ISI/ATH和帕特拉斯大学)

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.AI

AI总结 本文提出一个无偏、风险意识的智能协商框架,通过数字孪生和极值理论中的条件风险价值(CVaR)预测尾部风险,提升6G网络切片的资源分配鲁棒性,验证了无偏方法在消除SLA违规和降低延迟方面的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏