arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 1997 信号源:cs.CL, cs.AI, cs.LG

1. 测试时计算 1997 篇

2410.04249 2025-05-07 cs.SE 50%

DiffSpec: Differential Testing with LLMs using Natural Language Specifications and Code Artifacts

Nikitha Rao, Elizabeth Gilbert, Harrison Green, Tahina Ramananandro, Nikhil Swamy, Claire Le Goues, Sarah Fakhoury

专题命中 测试时计算 :verifier(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.17525 2025-04-25 cs.CV 50%

Text-to-Image Alignment in Denoising-Based Models through Step Selection

Paul Grimal, Hervé Le Borgne, Olivier Ferret

机构 * Université Paris-Saclay, CEA, List(巴黎-萨克雷大学、法国原子能委员会、List)

专题命中 测试时计算 :reasoning(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.06835 2025-04-10 cs.CV 50%

LVC: A Lightweight Compression Framework for Enhancing VLMs in Long Video Understanding

Ziyi Wang, Haoran Wu, Yiming Rong, Deyang Jiang, Yixin Zhang, Yunlong Zhao, Shuang Xu, Bo XU

专题命中 测试时计算 :reasoning(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12496 2025-03-31 cs.CV 50%

Does Your Vision-Language Model Get Lost in the Long Video Sampling Dilemma?

Tianyuan Qu, Longxiang Tang, Bohao Peng, Senqiao Yang, Bei Yu, Jiaya Jia

专题命中 测试时计算 :reasoning(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12271 2025-03-18 cs.CV 50%

Reflect-DiT: Inference-Time Scaling for Text-to-Image Diffusion Transformers via In-Context Reflection

Shufan Li, Konstantinos Kallidromitis, Akash Gokul, Arsh Koneru, Yusuke Kato, Kazuki Kozuka, Aditya Grover

专题命中 测试时计算 :reasoning(abstract)

Comments 17 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.06428 2025-02-12 cs.CV 50%

CoS: Chain-of-Shot Prompting for Long Video Understanding

Jian Hu, Zixu Cheng, Chenyang Si, Wei Li, Shaogang Gong

专题命中 测试时计算 :reasoning(abstract)

Comments A training-free test-time optimisation approach for long video understanding

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.16125 2025-02-12 cs.IR 50%

SampleLLM: Optimizing Tabular Data Synthesis in Recommendations

Jingtong Gao, Zhaocheng Du, Xiaopeng Li, Yichao Wang, Xiangyang Li, Huifeng Guo, Ruiming Tang, Xiangyu Zhao

专题命中 测试时计算 :chain-of-thought(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.00028 2025-02-04 cs.AR cs.PL 50%

VRank: Enhancing Verilog Code Generation from Large Language Models via Self-Consistency

Zhuorui Zhao, Ruidi Qiu, Ing-Chao Lin, Grace Li Zhang, Bing Li, Ulf Schlichtmann

专题命中 测试时计算 :chain-of-thought(abstract)

Comments accepted by ISQED2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.21534 2025-01-08 cs.CV 50%

ControlMLLM: Training-Free Visual Prompt Learning for Multimodal Large Language Models

Mingrui Wu, Xinyue Cai, Jiayi Ji, Jiale Li, Oucheng Huang, Gen Luo, Hao Fei, Guannan Jiang, Xiaoshuai Sun, Rongrong Ji

专题命中 测试时计算 :reasoning(abstract)

Comments Accepted to NeurIPS 2024; Code:https://github.com/mrwu-mac/ControlMLLM

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.01476 2025-01-06 physics.data-an 50%

Sparse identification of evolution equations via Bayesian model selection

Tim W. Kroll, Oliver Kamps

专题命中 测试时计算 :reasoning(abstract)

Comments 22 pages, 6 fgures

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.11333 2024-06-18 cs.CV 50%

Hallucination Mitigation Prompts Long-term Video Understanding

Yiwei Sun, Zhihang Liu, Chuanbin Liu, Bowei Pu, Zhihan Zhang, Hongtao Xie

专题命中 测试时计算 :chain-of-thought(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.16009 2024-05-28 cs.CV 50%

Streaming Long Video Understanding with Large Language Models

Rui Qian, Xiaoyi Dong, Pan Zhang, Yuhang Zang, Shuangrui Ding, Dahua Lin, Jiaqi Wang

专题命中 测试时计算 :reasoning(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.18689 2023-10-31 cs.CV 50%

Foundational Models in Medical Imaging: A Comprehensive Survey and Future Vision

Bobby Azad, Reza Azad, Sania Eskandari, Afshin Bozorgpour, Amirhossein Kazerouni, Islem Rekik, Dorit Merhof

专题命中 测试时计算 :reasoning(abstract)

Comments The paper is currently in the process of being prepared for submission to MIA

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.14931 2023-10-25 cs.RO 50%

Interaction-Aware Sampling-Based MPC with Learned Local Goal Predictions

Walter Jansma, Elia Trevisan, Álvaro Serra-Gómez, Javier Alonso-Mora

专题命中 测试时计算 :planning(abstract)

Comments Accepted for presentation at the 2023 IEEE International Symposium on Multi-Robot & Multi-Agent Systems

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.04945 2023-07-12 cs.NI cs.PL 50%

What do LLMs need to Synthesize Correct Router Configurations?

Rajdeep Mondal, Alan Tang, Ryan Beckett, Todd Millstein, George Varghese

专题命中 测试时计算 :verifier(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
1901.09769 2019-08-07 cs.CR 50%

Do Not Return Similarity: Face Recovery with Distance

Mingtian Tan, Zhe Zhou

专题命中 测试时计算 :verifier(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
1205.2649 2012-05-14 cs.GT 50%

A Sampling-Based Approach to Computing Equilibria in Succinct Extensive-Form Games

Miroslav Dudik, Geoffrey Gordon

专题命中 测试时计算 :reasoning(abstract)

Comments Appears in Proceedings of the Twenty-Fifth Conference on Uncertainty in Artificial Intelligence (UAI2009)

详情

展开后加载摘要…

URL PDF HTML 收藏