arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Peking University(北京大学)

2026-07-24 至 2026-07-24 共收录 11
2607.21570 2026-07-24 cs.CL cs.HC 新提交

MedGame: Storytelling Gamification Empowered by Large Language Models for Medical Education

MedGame:由大语言模型赋能的用于医学教育的故事化游戏化

Qian Wu, Xinrong Zhou, Zizhan Ma, Kai Chen, Zheyao Gao, Xun Lin, Hongqiu Wu, Longfei Gou, Yixiao Liu, Ann Sin Nga Lau, Qi Dou

机构 * CUHK(香港中文大学) Southern Medical University(南方医科大学) Peking University(北京大学) Tencent(腾讯)

AI总结 研究旨在利用大语言模型助力医学教育,提出MedGame框架,通过双引擎设计将临床病例转化为故事化游戏,构建MedGame Bench进行评估,实验显示特定任务微调提升开源模型表现,学生研究表明其更具吸引力和实用性。

Comments Work in Progress; an explorational design and study on AI+Education+Game

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21370 2026-07-24 cs.CV 新提交

ASTRA-Net: Anatomy-Specific Transfer and Representation Alignment for Drug-Induced Sleep Endoscopy Segmentation

ASTRA-Net:用于药物诱导睡眠内镜分割的特定解剖结构转移与表示对齐

Suhua Sun, Yuqiao Wang, Sheng Liu, Rui Fan, Jiajun Wang, Ruoyan Xu, Yixin Chen, Tao Li, Yan Yan

机构 * Department of Otolaryngology, Peking University Third Hospital(北京大学第三医院耳鼻咽喉科) Institute of Medical Technology, Peking University Health Science Center(北京大学医学部医学技术研究所) National Biomedical Imaging Center, College of Future Technology, Peking University(北京大学未来技术学院国家生物医学影像中心)

AI总结 针对像素级DISE注释稀缺、手动勾勒轮廓限制定量评估可扩展性的问题,开发ASTRA-Net,通过虚拟与真实帧特征对齐及多目标监督微调解码器,在真实注释有限时支持DISE边界描绘,取得良好分割和分类准确率。

Comments 20 pages, 6 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21239 2026-07-24 cs.CV 新提交

Stokes-Informed Diffusion for Robust Linear Polarization Estimation

用于稳健线性偏振估计的斯托克斯信息扩散

Yidong Luo, Chenggong Li, Yuchao Feng, Boxin Shi, Junchao Zhang, Xin Yuan

机构 * Zhejiang University(浙江大学) School of Engineering, Westlake University(西湖大学工学院) School of Automation, Central South University(中南大学自动化学院) College of Computer Science and Technology, Zhejiang University of Technology(浙江工业大学计算机科学与技术学院) School of Computer Science, Peking University(北京大学计算机科学学院)

AI总结 研究从单张RGB图像估计线性偏振问题,提出基于穆勒形式主义的GenPolar框架,通过预测斯托克斯分量并结合可观测性感知损失监督偏振角,采用两阶段训练策略,在多数据集实验中性能达先进水平,提升下游应用效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21085 2026-07-24 cs.CV 新提交

Geo3R: Mitigating Spatial Reasoning Hallucination in Multimodal Large Language Models

Geo3R:减轻多模态大语言模型中的空间推理幻觉

Mingyu Wang, Weilin Jin, Wenbo Li, Haoyang Huang, Tong Jia, Ying Li

机构 * Peking University(北京大学) Joy Future Academy(京东探索研究院)

AI总结 多模态大语言模型推理空间关系易产生幻觉,现有方法效果有限。本文定义空间推理幻觉及常见场景,提出无训练的Geo3R框架,结合几何证据和结构化3D推理减轻幻觉,实验证明该框架显著减少幻觉,优于现有模型和方法。

Comments Accepted by ACM MM 2026. This is the arXiv preprint version, not the camera-ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21023 2026-07-24 cs.CV 新提交

WAT3R: Feedforward Underwater 3D Reconstruction

WAT3R:前馈水下三维重建

Jiayi Xu, Jiahao Lu, Ziqiang Zheng, Yihao Tan, Yaolong Zhu, Yuan Liu, Sai-Kit Yeung

机构 * The Hong Kong University of Science and Technology(香港科技大学) The Chinese University of Hong Kong(香港中文大学) Peking University(北京大学)

AI总结 针对水下光衰减等导致三维重建难的问题,提出WAT3R前馈框架,利用退化适应及轻量级神经适应模块,单次前向传播直接输出三维点图和相机姿态,实验证明其在多类三维重建任务中优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20594 2026-07-24 cs.LG cs.AI stat.ML 新提交

When Does Recurrence Become an Algorithm? Convergence Selection in Weight-Tied Looped Transformers

循环何时成为一种算法?权重绑定循环变换器中的收敛选择

Tong Zhang, Junhao Hu, Yun Peng, Tao Xie

机构 * Fudan University(复旦大学) Peking University(北京大学)

AI总结 研究权重绑定循环变换器何时实现算法,通过群字问题得出预算定律、架构先验决定算法等四个发现,介绍收敛时间缩放工具并验证其因果关系,结果可复现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20465 2026-07-24 cs.LG cs.CL 新提交

DataPrep-Bench: Benchmarking LLMs as Training Data Preparators

数据准备基准:评估作为训练数据准备者的大语言模型

Hao Liang, Qifeng Cai, Yibo Lin, Jianzhuo Du, Qifeng Xia, Sizhe Qiu, Linzhuang Sun, Meiyi Qiang, Zhaoyang Han, Xiaochen Ma, Bohan Zeng, Ruichuan An, Conghui He, Wentao Zhang

机构 * Peking University(北京大学) Institute for Advanced Algorithms Research(先进算法研究院) OriginHub Technology(源创科技)

AI总结 研究LLMs作为训练数据准备者的表现,引入DataPrep - Bench统一基准,涵盖数据构建与质量评估,在多领域和模型上评估,发布相关智能体和评估器,为衡量LLM驱动数据准备能力提供框架。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20887 2026-07-24 cs.LG cs.AI math.AG 新提交

TwistedMerge: Certified Higher-Order Diagnostics and Abstention for Model Merging

TwistedMerge:用于模型合并的经过认证的高阶诊断与弃权

Ting Gong, Shitan Xu

机构 * Department of Mathematics, University of Washington(华盛顿大学数学系) Beijing International Center for Mathematical Research, Peking University(北京大学北京国际数学研究中心)

AI总结 研究模型合并中全局对齐问题,提出TwistedMerge认证管道,将合并视为有限下降问题,经多测试提升残差为上同调类,证明相关定理,通过实验展示该方法在处理多种情况时的表现,定位下降理论为可证伪框架。

Comments 34 Pages, Comments welcome!

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.09635 2026-07-24 cs.CL 版本更新

K12-KGraph: A Curriculum-Aligned Knowledge Graph for Benchmarking and Training Educational LLMs

K12-KGraph:一种对齐课程的图谱用于基准测试和训练教育大语言模型

Hao Liang, Qihan Lin, Zhaoyang Han, Xiaochen Ma, Zhen Hao Wong, Meiyi Qiang, Linzhuang Sun, Wentao Zhang

机构 * Peking University(北京大学) Institute for Advanced Algorithms Research(先进算法研究所) OriginHub Technology(OriginHub技术) Zhongguancun Academy(中关村学院)

AI总结 本文提出K12-KGraph,基于中小学教材构建的课程对齐知识图谱,用于构建多选基准测试K12-Bench和训练数据集K12-Train,验证课程结构监督在教育模型训练中的高效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21778 2026-07-24 cs.NE cs.LG 版本更新

Error Amplification Limits ANN-to-SNN Conversion in Continuous Control

误差放大限制了连续控制中的ANN到SNN转换

Zijie Xu, Zihan Huang, Yiting Dong, Kang Chen, Wenxuan Liu, Zhaofei Yu

机构 * Institute for Artificial Intelligence, Peking University, Beijing, China(人工智能研究院,北京大学,北京,中国) Beijing Key Laboratory of Brain-inspired Spiking Large Models, School of Computer Science, Peking University, Beijing, China(脑启发式脉冲大规模模型北京重点实验室,计算机科学学院,北京大学,北京,中国)

AI总结 针对连续控制中ANN到SNN转换性能差的问题,提出跨步残差电位初始化(CRPI)机制,通过抑制时间相关误差恢复性能。

Comments Accepted by ICML2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16615 2026-07-24 cs.CV 版本更新

Trainable Log-linear Sparse Attention for Efficient Diffusion Transformers

用于高效扩散变压器的可训练对数线性稀疏注意力

Yifan Zhou, Zeqi Xiao, Tianyi Wei, Shuai Yang, Xingang Pan

机构 * S-Lab, Nanyang Technological University(南洋理工大学S实验室) Wangxuan Institute of Computer Technology, Peking University(北京大学王萱计算机技术研究所)

AI总结 研究针对扩散变压器二次自注意力成本限制长序列扩展问题,提出可训练的对数线性稀疏注意力机制LLSA,通过分层结构降低成本,经实验验证其能加速注意力推理和DiT训练,为高效训练长序列DiTs提供方向。

Comments Code is available at: https://github.com/SingleZombie/LLSA

详情

展开后加载摘要…

URL PDF HTML 收藏