Code as Policies: Language Model Programs for Embodied Control
专题命中 数学推理 :reasoning(abstract)
AI 大模型
大模型数学、逻辑、规划、多步推理和测试时计算能力。
专题命中 数学推理 :reasoning(abstract)
专题命中 数学推理 :planning(abstract)
专题命中 数学推理 :reasoning(abstract)
专题命中 数学推理 :planning(abstract)
Journal ref Proc. IEEE Intl. Conf. Intelligent Transportation Systems, pp. 575-582, Hawaii, USA, Nov 2018
专题命中 数学推理 :reasoning(abstract)
专题命中 数学推理 :planning(abstract)
Comments 12 pages, 6 figures
专题命中 数学推理 :reasoning(abstract)
专题命中 数学推理 :reasoning(abstract)
Comments 12 pages
专题命中 数学推理 :planning(abstract)
Comments Accepted at GAMES 2016, the 5th World Congress of the Game Theory Society. High-level survey notably based on arXiv:1204.3283 and arXiv:1411.0835
专题命中 数学推理 :reasoning(abstract)
Comments Proceedings of the Sixth International Conference on Computer Supported Education (CSEDU 2014) (In Press)
专题命中 数学推理 :reasoning(abstract)
Comments Appeared in SOHUMAN, 2nd International Workshop on Social Media for Crowdsourcing and Human Computation, at ACM Web Science 2013, May 1, 2013, Paris http://eipcm.org/sohuman2013/
专题命中 数学推理 :planning(abstract)
Comments 23 pages, 4 figures
Journal ref Acta Polytechnica Scandinavica, No. 91 (1998). Farre, G.L. and Oksala, T. (eds.): Emergence, Complexity, Hierarchy, Organization - Selected and edited papers from the ECHO III conference. Finnish Academy of Technology. ISBN 952-5148-59-9, ISSN 1238-9803
可察觉的轨迹:利用思维链动态检测大语言模型中的推理失败
专题命中 代码与定理证明 :chain-of-thought(title,abstract);CoT(summary_cn,abstract);reasoning(title,abstract);分类 cs.CL、cs.AI、cs.LG
AI总结 本研究利用思维链动态特性,在不假设语言化CoT语义忠实性的情况下,检测大语言模型在布尔可满足性任务中的分布式推理失败,并通过针对性提示干预提升了Llama3-70B的准确率。
机构 * Electrical and Computer Engineering, Purdue University(电子与计算机工程系,普渡大学)
专题命中 代码与定理证明 :reasoning(title,abstract);logical reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract)
Comments EMNLP 2025 Main Conference
当推理对法律起草造成阻碍时:专利权利要求生成中的语言表达瓶颈
专题命中 代码与定理证明 :CoT(summary_cn,abstract);reasoning(title,abstract);chain-of-thought(abstract);分类 cs.CL
AI总结 研究专利权利要求生成中CoT提示是否有益,提出特定任务CoT方法并评估。结果显示推理增强提示可提升权利要求质量,且隐式CoT优于显式CoT,显式CoT会引入信息瓶颈,为法律任务和CoT应用提供新见解。
Comments Accepted to AI for Law Workshop @ ICML 2026
专题命中 代码与定理证明 :chain-of-thought(title,abstract);reasoning(title);CoT(abstract);verifier(abstract)
SemCoT:通过语义对齐的隐式令牌加速链式推理
机构 * University of Virginia(弗吉尼亚大学) ; LinkedIn Inc.(领英公司)
专题命中 代码与定理证明 :reasoning(title,abstract);chain-of-thought(title,abstract);CoT(abstract);分类 cs.CL
AI总结 SemCoT通过语义对齐的隐式令牌优化,提升链式推理的效率与准确性。
机构 * Centre for Quantum Software and Information(量子软件与信息中心) ; University of Technology Sydney(悉尼技术大学)
专题命中 代码与定理证明 :reasoning(title,abstract);chain-of-thought(title,abstract);CoT(abstract);分类 cs.AI
Comments Under review
机构 * Kuaishou Technology(快手科技)
专题命中 代码与定理证明 :reasoning(title,abstract);verifier(title,abstract);CoT(abstract);分类 cs.AI
Comments 23 pages, 13 figures
专题命中 代码与定理证明 :chain-of-thought(title,abstract);CoT(title,abstract);reasoning(abstract);分类 cs.AI
当链条断裂时:LLM推理错误的交互诊断
专题命中 代码与定理证明 :reasoning(title,abstract);chain-of-thought(title,abstract);CoT(abstract)
AI总结 本文提出ReasonDiag系统,通过结合外部事实核查与符号逻辑验证,帮助用户高效识别和诊断LLM推理链条中的错误步骤及根本原因。
Comments Accepted to EuroVis 2026
专题命中 代码与定理证明 :reasoning(title,abstract);chain-of-thought(title,abstract);CoT(abstract)
Comments NAACL 2025
专题命中 代码与定理证明 :reasoning(title,abstract);chain-of-thought(title,abstract);分类 cs.CL、cs.AI、cs.LG
专题命中 代码与定理证明 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.CL、cs.AI
对抗性欺骗的模仿游戏:生成AI中的链式推理
机构 * Information and Society Research Division, National Institute of Informatics(信息与社会研究部,国立信息研究所) ; Department of Information Engineering and Computer Science, Feng Chia University(信息工程与计算机科学系,逢甲大学)
专题命中 代码与定理证明 :reasoning(title,abstract);chain-of-thought(title,abstract);分类 cs.AI
AI总结 本文提出基于模仿游戏的对抗性欺骗防御框架,利用链式推理生成多模态代理,有效对抗生成AI中的演绎和归纳欺骗攻击。
Journal ref in IEEE Access, vol. 13, pp. 95085-95093, 2025
专题命中 代码与定理证明 :reasoning(title,abstract);chain-of-thought(title,abstract);分类 cs.CL
专题命中 代码与定理证明 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.CL
Comments Accepted to NAACL 2024 main conference
神经符号AI的RAIL原则:推理(Reasoning)、保证(Assurances)、接口(Interfacing)与学习(Learning)
机构 * Politecnico di Milano(米兰理工大学) ; ELLIS Institute Finland(芬兰ELLIS研究所) ; Åbo Akademi University(奥博 Akademi 大学) ; Samsung AI(三星人工智能研究院) ; Delft University of Technology(代尔夫特理工大学) ; Stony Brook University(石溪大学) ; Politecnico di Torino(都灵理工大学) ; University of Stuttgart(斯图加特大学) ; Graz University of Technology(格拉茨工业大学) ; Lockheed Martin, Advanced Technology Labs(洛克希德·马丁公司先进技术实验室) ; BrainCreators(BrainCreators公司) ; Vrije Universiteit Amsterdam(阿姆斯特丹自由大学) ; University of Amsterdam(阿姆斯特丹大学) ; University of Edinburgh(爱丁堡大学) ; UCLA(加利福尼亚大学洛杉矶分校)
专题命中 代码与定理证明 :reasoning(title,title_cn);分类 cs.AI、cs.LG
AI总结 该文提出神经符号AI的RAIL四项原则,可统一分析多类AI系统,助力工程师更科学地设计部署生产级AI,指导整合神经符号方法到下一代AI技术。
专题命中 代码与定理证明 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);logical reasoning(abstract)
Comments Accepted by COLING 2025 conference
一次形式化,其余编辑:基于Lean的高效数学推理答案选择
机构 * University of California, Riverside(加州大学河滨分校)
专题命中 代码与定理证明 :reasoning(title,abstract);math reasoning(title);分类 cs.CL、cs.AI、cs.LG
AI总结 提出BASE流水线,通过形式化一个候选答案并编辑其余答案,减少自动形式化调用约5倍,同时提升选择准确性。
Comments 15 pages, 1 figure. Code available at https://github.com/ucr-rai/base-and-edit