arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Tsinghua University(清华大学)

共收录 4547
2512.00412 2026-04-15 cs.CR cs.AI

Red Teaming Large Reasoning Models

对大型推理模型进行红队测试

Jiawei Chen, Yang Yang, Chao Yu, Yu Tian, Zhi Cao, Xue Yang, Linghao Li, Hang Su, Zhaoxia Yin

机构 * Shanghai Key Laboratory of Multidimensional Information Processing, East China Normal University(上海多维信息处理关键实验室,东华大学) Zhongguancun Academy(中关村学院) Shenzhen International Graduate School, Tsinghua University(深圳国际研究生院,清华大学) Dept. of Comp. Sci. and Tech., THBI Lab, Tsinghua University(计算机科学与技术系,清华THBI实验室) Beihang University(北京航空航天大学) Shanghai Jiao Tong University(上海交通大学)

AI总结 本文提出RT-LRM基准,评估大型推理模型的可信度,揭示其在面对推理风险时的脆弱性,并发布工具箱支持未来研究。

Comments 30 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.10471 2026-04-15 cond-mat.mtrl-sci cs.AI

Siamese Foundation Models for Crystal Structure Prediction

孪生基础模型用于晶体结构预测

Liming Wu, Wenbing Huang, Rui Jiao, Jianxing Huang, Liwei Liu, Yipeng Zhou, Hao Sun, Yang Liu, Fuchun Sun, Yuxiang Ren, Jirong Wen

机构 * Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学人工智能学院) Beijing Key Laboratory of Research on Large Models and Intelligent Governance(北京大型模型与智能治理研究重点实验室) Department of Computer Science and Technology, Tsinghua University(清华大学计算机科学与技术系) Institute for AI Industry Research, Tsinghua University(清华大学人工智能产业研究院) Advanced Computing and Storage Lab, Huawei Technologies(华为技术有限公司先进计算与存储实验室) School of Intelligence Science and Technology, Nanjing University(南京大学智能科学与技术学院) Engineering Research Center of Next-Generation Intelligent Search and Recommendation, MOE(教育部下一代智能搜索与推荐工程研究中心)

AI总结 本文提出Diffusion-based Crystal Omni框架,结合孪生生成模型和能量预测模型,提升晶体结构预测性能,并在实际超导材料中验证其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.20330 2026-04-15 cs.CV cs.AI cs.GR

OmniHands: Towards Robust 4D Hand Mesh Recovery via A Versatile Transformer

OmniHands: 一种通过通用变压器实现鲁棒四维手形重建的方法

Dixuan Lin, Yuxiang Zhang, Mengcheng Li, Wei Jing, Qi Yan, Qianying Wang, Yebin Liu, Hongwen Zhang

机构 * Beijing Normal University(北京师范大学) Tsinghua University(清华大学)

AI总结 本文提出OmniHands,通过通用变压器架构解决单目或多视角输入下手形及相对运动重建问题,引入关系感知双手分词和四维交互推理模块,提升真实场景中手部交互重建性能。

Comments An extended journal version of 4DHands, featured with versatile module that can adapt to temporal task and multi-view task. Additional detailed comparison experiments and results presentation have been added. More demo videos can be seen at our project page: https://OmniHand.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11792 2026-04-14 cs.CV

LottieGPT: Tokenizing Vector Animation for Autoregressive Generation

LottieGPT:为自回归生成设计向量动画的标记化

Junhao Chen, Kejun Gao, Yuehan Cui, Mingze Sun, Mingjin Chen, Shaohui Wang, Xiaoxiao Long, Fei Ma, Qi Tian, Ruqi Huang, Hao Zhao

机构 * Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) AIR, Tsinghua University(清华大学人工智能研究院) BAAI(百度人工智能研究院) The Hong Kong Polytechnic University(香港理工大学) Nanjing University(南京大学) Guangdong Laboratory of Artificial Intelligence and Digital Economy (SZ)(广东人工智能与数字经济实验室(深圳))

AI总结 本文提出首个向量动画标记化与自回归生成框架,基于Lottie标准设计标记器并构建大规模数据集,通过微调Qwen-VL生成可编辑的向量动画。

Comments Accepted by CVPR 2026. Project Page: https://lottiegpt.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11749 2026-04-14 cs.CL

HistLens: Mapping Idea Change across Concepts and Corpora

HistLens:跨概念和语料库的思想变化映射

Yi Jing, Weiyun Qiu, Yihang Peng, Zhifang Sui

机构 * Department of Computer Science and Technology, Tsinghua University, China(清华大学计算机科学与技术系) School of History, Nanjing University, China(南京大学历史学院) Department of Chinese Language and Literature, Tsinghua University, China(清华大学中国语言文学系) State Key Laboratory of Multimedia Information Processing, School of Computer Science, Peking University, China(北京大学计算机学院多媒体信息处理国家重点实验室)

AI总结 HistLens提出一种基于SAE的统一框架,用于多概念、多语料库的概念史分析,通过分解概念表示并追踪其激活动态,实现跨概念和语料库的思想演变模式计算。

Comments Accepted by ACL 2026 MainConference

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11359 2026-04-14 cs.AI cs.LG

CoRe-ECG: Advancing Self-Supervised Representation Learning for 12-Lead ECG via Contrastive and Reconstructive Synergy

CoRe-ECG:通过对比与重构协同提升12导联ECG的自监督表征学习

Zehao Qin, Xiaojian Lin, Ping Zhang, Hongliang Wu, Xinkang Wang, Guangling Liu, Bo Chen, Wenming Yang, Guijin Wang

机构 * Department of Electronic Engineering, Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院电子工程系) Department of Electronic Engineering, Tsinghua University(清华大学电子工程系) Shanghai AI Laboratory(上海人工智能实验室) Department of Cardiology, Beijing Tsinghua Changgung Hospital, School of Clinical Medicine, Tsinghua Medicine, Tsinghua University(清华大学临床医学院清华大学医学部北京清华长庚医院心内科) Department of Anesthesiology, National Cancer Center/National Clinical Research Center for Cancer/Cancer Hospital, Chinese Academy of Medical Sciences and Peking Union Medical College(中国医学科学院北京协和医学院国家癌症中心国家肿瘤临床医学研究中心肿瘤医院麻醉科) Department of Electrocardiographic Diagnosis, Fuzhou University Affiliated Provincial Hospital(福州大学附属省立医院心电图诊断科)

AI总结 本文提出CoRe-ECG方法,通过对比与重构协同机制提升12导联ECG的自监督表征学习,解决标注数据少和专家标注成本高的问题,引入FDA和STDM增强预训练效果,取得最佳性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11309 2026-04-14 cs.CR cs.AI cs.CL cs.CV cs.LG

The Salami Slicing Threat: Exploiting Cumulative Risks in LLM Systems

切肉威胁:在LLM系统中利用累积风险

Yihao Zhang, Kai Wang, Jiangrong Wu, Haolin Wu, Yuxuan Zhou, Zeming Wei, Dongxian Wu, Xun Chen, Jun Sun, Meng Sun

机构 * School of Mathematical Sciences, Peking University(北京大学数学科学学院) Sun Yat-sen University(中山大学) Wuhan University(武汉大学) Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) ByteDance(字节跳动) Singapore Management University(新加坡管理大学)

AI总结 本文提出Salami Slicing Risk,通过链式低风险输入累积有害意图,以触发高风险行为,提出Salami Attack框架并验证其有效性,同时提出防御策略以缓解多轮 jailbreak 风险。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11234 2026-04-14 cs.CV

Bridging the RGB-IR Gap: Consensus and Discrepancy Modeling for Text-Guided Multispectral Detection

弥合RGB-红外差距:面向文本引导多光谱检测的共识与差异建模

Jiaqi Wu, Zhen Wang, Enhao Huang, Kangqing Shen, Yulin Wang, Yang Yue, Yifan Pu, Gao Huang

机构 * Department of Automation, Tsinghua University(清华大学自动化系) State Key Laboratory of Blockchain and Data Security, Zhejiang University(浙江大学区块链与数据安全全国重点实验室) Tsinghua University(清华大学)

AI总结 本文提出一种语义桥融合框架,通过双支持建模解决文本引导多光谱检测中的共识与差异问题,提升跨模态交互的鲁棒性。

Comments 17 pages ,Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11202 2026-04-14 cs.AR cs.LG

CapBench: A Multi-PDK Dataset for Machine-Learning-Based Post-Layout Capacitance Extraction

CapBench:一种用于基于机器学习的后布局电容提取的多PDK数据集

Hector R. Rodriguez, Jiechen Huang, Wenjian Yu

机构 * Department of Computer Science \& Technology, BNRist, Tsinghua University Beijing China Department of Computer Science \& Technology, BNRist, Tsinghua University

AI总结 CapBench通过多PDK数据集支持基于机器学习的电容提取研究,包含61855个3D窗口用于迁移学习和可扩展性研究,评估了10种机器学习架构,展示了精度与速度的权衡。

Comments Accepted at the 63rd ACM/IEEE Design Automation Conference (DAC '26). 7 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11188 2026-04-14 cs.CL cs.AI

MathAgent: Adversarial Evolution of Constraint Graphs for Mathematical Reasoning Data Synthesis

MathAgent: 基于约束图的对抗进化用于数学推理数据合成

Zixiong Yu, Jun Rao, Guhan Chen, Songtao Tian, Bohan Li, Jiansheng Wei, Min Zhang, Xiaojun Meng

机构 * Huawei Large Model Data Technology Lab(华为大模型数据技术实验室) Tsinghua University(清华大学) Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) Kyoto University(京都大学)

AI总结 本文提出MathAgent框架,通过约束图的对抗进化生成高质量数学推理数据,提升模型在八个数学基准上的泛化能力。

Comments Accepted by ACL 2026 findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09066 2026-04-14 cs.CL

Anchored Sliding Window: Toward Robust and Imperceptible Linguistic Steganography

基于锚定滑动窗口:迈向稳健且不可察觉的语言隐写术

Ruiyi Yan, Shiao Meng, Yugo Murawaki

机构 * Graduate School of Informatics, Kyoto University(京都大学信息学研究科) School of Software, Tsinghua University(清华大学软件学院)

AI总结 本文提出锚定滑动窗口框架,通过引入提示和桥接上下文提升语言隐写术的隐蔽性和鲁棒性,实验表明其在文本质量、隐蔽性和鲁棒性上均优于基线方法。

Comments ACL2026 Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12639 2026-04-14 cs.CV

RoboStereo: Dual-Tower 4D Embodied World Models for Unified Policy Optimization

RoboStereo: 双塔4D具身世界模型用于统一策略优化

Ruicheng Zhang, Guangyu Chen, Zunnan Xu, Zihao Liu, Zhizhou Zhong, Mingyang Zhang, Jun Zhou, Xiu Li

机构 * Tsinghua University(清华大学) X Square Robot HKUST(香港科技大学)

AI总结 本文提出RoboStereo,通过双塔4D具身世界模型实现统一策略优化,解决几何幻觉和缺乏统一优化框架的问题,实验显示在细粒度操作任务中平均相对提升超过97%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07972 2026-04-14 cs.AI

SHE: Stepwise Hybrid Examination Reinforcement Learning Framework for E-commerce Search Relevance

SHE:面向电商搜索相关性的分步混合检验强化学习框架

Pengkun Jiao, Yiming Jin, Jianhui Yang, Chenhe Dong, Zerui Huang, Shaowei Yao, Xiaojiang Zhou, Dan Ou, Haihong Tang

机构 * Fudan University(复旦大学) Tsinghua University(清华大学)

AI总结 本文提出SHE框架,通过分步奖励策略优化提升电商搜索相关性预测的逻辑一致性与准确性,优于SFT、DPO等基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.02387 2026-04-14 cs.AI

VS-Bench: Evaluating VLMs for Strategic Abilities in Multi-Agent Environments

VS-Bench:评估多智能体环境中视觉语言模型的战略能力

Zelai Xu, Zhexuan Xu, Xiangmin Yi, Huining Yuan, Mo Guang, Kaiwen Long, Xinlei Chen, Yi Wu, Chao Yu, Yu Wang

机构 * EE, Tsinghua University(清华大学电子工程系) SIGS, Tsinghua University(清华大学深圳国际研究生院) Li Auto Inc.(理想汽车) IIIS, Tsinghua University(清华大学交叉信息研究院)

AI总结 VS-Bench是首个评估多智能体环境中视觉语言模型战略能力的多模态基准,涵盖合作、竞争和混合动机交互,通过感知、推理和决策三个维度评估15种领先模型,揭示当前模型在推理和决策上的显著差距。

Comments Published at CVPR 2026 (Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.04099 2026-04-14 cs.CV cs.AI

TARAC: Mitigating Hallucination in LVLMs via Temporal Attention Real-time Accumulative Connection

TARAC:通过时间注意力实时累积连接缓解大型视觉-语言模型中的幻觉

Lei Jiang, Chunzhao Xie, Tongxuan Liu, Yuting Zeng, jinrong Guo, Yunheng Shen, Weizhe Huang, Jing Li, Xiaohua Xu

机构 * University of Science and Technology of China(中国科学技术大学) Tsinghua University(清华大学)

AI总结 本文提出TARAC,一种无需训练的框架,通过动态累积和重注入历史注意力来维持视觉 grounding,实验表明其在减少幻觉和提升感知得分方面优于现有方法,且计算开销低。

Comments 8 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10988 2026-04-14 cs.AI cs.CV

WebForge: Breaking the Realism-Reproducibility-Scalability Trilemma in Browser Agent Benchmark

WebForge: 破解浏览器代理基准测试中的现实性-可重现性-可扩展性三重困境

Peng Yuan, Yuyang Yin, Yuxuan Cai, Zheng Wei

机构 * Tencent BAC(腾讯BAC) Tsinghua University(清华大学)

AI总结 WebForge通过四阶段流程生成自包含的网页环境,解决基准测试中的现实性、可重现性和可扩展性矛盾,构建包含934个任务的基准测试集,揭示多维评估对模型能力的深入刻画。

Comments 14 pages, 6 figures, 6 tables, plus 29-page supplementary. Code: https://github.com/yuandaxia2001/WebForge Dataset: https://huggingface.co/datasets/yuandaxia/WebForge

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10789 2026-04-14 cs.CV

ReplicateAnyScene: Zero-Shot Video-to-3D Composition via Textual-Visual-Spatial Alignment

ReplicateAnyScene:通过文本-视觉-空间对齐实现零样本视频到3D场景的合成

Mingyu Dong, Chong Xia, Mingyuan Jia, Weichen Lyu, Long Xu, Zheng Zhu, Yueqi Duan

机构 * Tsinghua University(清华大学) Zhejiang University(浙江大学)

AI总结 本文提出ReplicateAnyScene框架,通过五阶段流水线实现视频到结构化3D场景的零样本合成,引入C3DR基准评估重建质量,实验表明其在生成高质量3D场景方面优于现有方法。

Comments Project Page: https://xiac20.github.io/ReplicateAnyScene/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10715 2026-04-14 cs.CV

Defending against Patch-Based and Texture-Based Adversarial Attacks with Spectral Decomposition

通过谱分解防御基于补丁和纹理的对抗攻击

Wei Zhang, Xinyu Chang, Xiao Li, Yiming Zhu, Xiaolin Hu

机构 * Department of Computer Science and Technology, Tsinghua University(清华大学计算机科学与技术系) School of Software, Tsinghua University(清华大学软件学院) School of Computer and Communication Engineering, University of Science and Technology Beijing(北京科技大学计算机与通信工程学院) Institute for AI, BNRist, IDG/McGovern Institute for Brain Research, Tsinghua University(清华大学人工智能研究院、北京信息科学与技术国家研究中心、IDG/麦戈文脑科学研究院) Chinese Institute for Brain Research (CIBR)(北京脑科学与类脑研究中心)

AI总结 本文提出Adversarial Spectrum Defense (ASD),利用DWT进行谱分解分析对抗模式,结合Adversarial Training提升防御效果,实验表明ASD+AT在对抗攻击中表现优异。

Comments Accepted by IEEE TIFS

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10554 2026-04-14 cs.CV

Spatio-Temporal Difference Guided Motion Deblurring with the Complementary Vision Sensor

时空差分引导的运动去模糊方法:互补视觉传感器

Yapeng Meng, Lin Yang, Yuguo Chen, Xiangru Chen, Taoyi Wang, Lijian Wang, Zheyu Yang, Yihan Lin, Rong Zhao

机构 * Department of Precision Instrument, Tsinghua University(清华大学精密仪器系) Pen-Tung Sah Institute of Micro-Nano Science and Technology, Xiamen University(厦门大学萨本栋微米纳米科学技术研究院) Communication University of China(中国传媒大学) Primevision Technology(普视科技)

AI总结 本文提出STGDNet,利用互补视觉传感器的时空差分数据,通过递归多分支架构恢复模糊RGB图像的结构和颜色细节,在合成和真实场景中均优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10529 2026-04-14 econ.GN cs.AI cs.CL q-fin.EC q-fin.GN

AI Patents in the United States and China: Measurement, Organization, and Knowledge Flows

美国和中国的人工智能专利:测量、组织与知识流动

Hanming Fang, Xian Gu, Hanyin Yan, Wu Zhu

机构 * University of Pennsylvania(宾夕法尼亚大学) NBER(美国国家经济研究局) Durham University(杜伦大学) Tsinghua University(清华大学)

AI总结 研究通过高精度分类器测量AI专利,发现中美专利增长迅速且领域趋同,但组织模式差异显著,且中国在专利数量上超越美国。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10504 2026-04-14 cs.AI

CARO: Chain-of-Analogy Reasoning Optimization for Robust Content Moderation

CARO:用于鲁棒内容审核的类比推理优化

Bingzhe Wu, Haotian Lu, Yuchen Mou

机构 * National Engineering Laboratory for Big Data System Computing Technology(大数据系统计算技术国家工程实验室) Shenzhen University(深圳大学) Tsinghua University(清华大学) National University of Singapore(新加坡国立大学)

AI总结 CARO通过两阶段训练框架提升LLM的类比推理能力,有效缓解内容审核中的误导性决策短路问题,实验显示其在模糊审核基准上平均F1得分提升24.9%。

Comments Accepted to ACL 2026 findings; under official publication process

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10502 2026-04-14 cs.AI

CHAIRO: Contextual Hierarchical Analogical Induction and Reasoning Optimization for LLMs

CHAIRO:面向LLMs的上下文分层类比归纳与推理优化

Haotian Lu, Yuchen Mou, Bingzhe Wu

机构 * National Engineering Laboratory for Big Data System Computing Technology(国家大数据系统计算技术工程实验室) Shenzhen University(深圳大学) Tsinghua University(清华大学) National University of Singapore(新加坡国立大学)

AI总结 本文提出CHAIRO框架,通过类比示例提升规则归纳和决策可靠性,在内容审核中实现更准确和可解释的规则生成。

Comments Accepted to ACL 2026 main conference; under official publication process

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10456 2026-04-14 cs.CV

A Benchmark and Multi-Agent System for Instruction-driven Cinematic Video Compilation

一个用于指令驱动电影视频编译的基准和多智能体系统

Peixuan Zhang, Chang Zhou, Ziyuan Zhang, Hualuo Liu, Chunjie Zhang, Jingqi Liu, Xiaohui Zhou, Xi Chen, Shuchen Weng, Si Li, Boxin Shi

机构 * School of Artificial Intelligence, Beijing University of Posts and Telecommunications(北京邮电大学人工智能学院) AI Technology Center, Online Video Business Unit, Tencent PCG(腾讯PCG在线视频事业部AI技术中心) Tsinghua University(清华大学) Beijing Academy of Artificial Intelligence(北京智源人工智能研究院) State Key Lab of Multimedia Info. Processing, School of Computer Science, Peking University(北京大学计算机学院多媒体信息处理国家重点实验室) Nat’l Eng. Research Ctr. of Visual Technology, School of Computer Science, Peking University(北京大学计算机学院国家视觉技术工程研究中心) School of Software and Microelectronics, Peking University(北京大学软件与微电子学院)

AI总结 本文提出CineBench基准和CineAgents系统,解决电影视频编译中的上下文崩溃和时间碎片化问题,通过脚本逆向工程和迭代叙事规划生成更连贯的编译结果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02408 2026-04-14 cs.RO

F2F-AP: Flow-to-Future Asynchronous Policy for Real-time Dynamic Manipulation

F2F-AP: 流向未来异步策略用于实时动态操控

Haoyu Wei, Xiuwei Xu, Ziyang Cheng, Hang Yin, Angyuan Ma, Bingyao Yu, Jie Zhou, Jiwen Lu

机构 * Department of Automation, Tsinghua University(清华大学自动化系)

AI总结 本文提出F2F-AP策略,通过预测物体流合成未来观测,利用基于流的对比学习目标对齐视觉特征,提升实时动态操控任务的响应性和成功率。

Comments Tsinghua University, 14pages,12 fugures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24503 2026-04-14 cs.LG cs.AI

Can Small Training Runs Reliably Guide Data Curation? Rethinking Proxy-Model Practice

小规模训练能否可靠地指导数据整理?重新审视代理模型实践

Jiachen T. Wang, Tong Wu, Kaifeng Lyu, James Zou, Dawn Song, Ruoxi Jia, Prateek Mittal

机构 * Princeton University(普林斯顿大学) Tsinghua University(清华大学) UC Berkeley(加州大学伯克利分校) Stanford University(斯坦福大学) Virginia Tech(弗吉尼亚理工大学)

AI总结 本文探讨了小规模代理模型训练在数据整理中的可靠性问题,指出固定配置协议与全规模模型开发流程的差异,并提出通过降低学习率提升小规模实验的可靠性。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22403 2026-04-14 cs.LG

MoveFM-R: Advancing Mobility Foundation Models via Language-driven Semantic Reasoning

MoveFM-R: 通过语言驱动的语义推理推进移动基础模型

Fanjin Meng, Yuan Yuan, Jingtao Ding, Jie Feng, Chonghua Han, Yong Li

机构 * Department of Electronic Engineering, BNRist, Tsinghua University(清华大学电子工程系,BNRist) New York University (NYU)(纽约大学)

AI总结 MoveFM-R通过语言驱动的语义推理解决移动基础模型中地理坐标与语言 token 的词汇不匹配及潜在向量与语义世界之间的表示差距问题,实现更全面、可解释的人类移动建模。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.14800 2026-04-14 eess.SY cs.AI cs.SY

Large Language Model as An Operator: An Experience-Driven Solution for Distribution Network Voltage Control

大语言模型作为算子:一种经验驱动的配电网电压控制解决方案

Xu Yang, Chenhui Lin, Licheng Sha, Liping Yang, Shuzhou Wu, Xichen Tian, Haotian Liu, Wenchuan Wu

机构 * State Key Laboratory of Power Systems(电力系统国家重点实验室) State Grid Beijing Electric Power Company(国网北京市电力公司) Department of Electrical Engineering, Tsinghua University(清华大学电机工程与应用电子技术系)

AI总结 本文提出基于大语言模型的经验驱动日提前电压/无功调度方案,通过多模块协作实现调度策略的自进化,实验验证了该方法在信息不完整情况下的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17682 2026-04-14 cs.CL cs.AI

Tuning Language Models for Robust Prediction of Diverse User Behaviors

调优语言模型以鲁棒预测多样化用户行为

Fanjin Meng, Jingtao Ding, Jiahui Gong, Chen Yang, Hong Chen, Zuojian Wang, Haisheng Lu, Yong Li

机构 * Department of Electronic Engineering, BNRist, Tsinghua University(清华大学电子工程系,BNRist) Honor Device Co., Ltd(荣耀终端有限公司)

AI总结 本文提出BehaviorLM,通过分阶段微调提升模型对长尾用户行为的预测能力,实验表明其在两个真实数据集上有效提升了对锚点和长尾行为的预测性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.04272 2026-04-14 cs.IR cs.AI

PoTable: Towards Systematic Thinking via Plan-then-Execute Stage Reasoning on Tables

PoTable:通过表格推理中的计划-执行阶段推理实现系统性思维

Qingyang Mao, Qi Liu, Zhi Li, Mingyue Cheng, Zheng Zhang, Rui Li

机构 * State Key Laboratory of Cognitive Intelligence, University of Science and Technology of China(中国科学技术大学认知智能国家重点实验室) Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院)

AI总结 本文提出PoTable,一种基于计划-执行阶段的表格推理方法,通过明确的分析阶段和代码生成机制提升推理的系统性和可解释性。

Comments Accepted by IEEE TKDE 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10297 2026-04-14 cs.CV cs.AI

FashionMV: Product-Level Composed Image Retrieval with Multi-View Fashion Data

FashionMV:基于多视角时尚数据的产品级复合图像检索

Peng Yuan, Bingyin Mei, Hui Zhang

机构 * Tsinghua University(清华大学)

AI总结 本文提出FashionMV,首个大规模多视角时尚数据集,用于产品级复合图像检索。通过构建包含127K产品、472K多视角图像和220K三元组的数据集,结合ProCIR框架,采用多阶段对话、标题对齐和思维链引导等机制,提升了检索性能。

详情

展开后加载摘要…

URL PDF HTML 收藏