Mert Cemri, Andrei Cojocaru, Melissa Pan, Shu Liu, Shubham Agarwal, Alexander Krentsel, Jay Tang, Kannan Ramchandran, Joseph E. Gonzalez, Matei Zaharia, Alex Dimakis, Ion Stoica
机构
*
University of California, Berkeley(加州大学伯克利分校)
;
Apple(苹果公司)
;
Bespoke Labs(Bespoke实验室)
ClinFusion: A Vision-Centric Multimodal LLM System for Holistic Medical Understanding
ClinFusion:用于整体医学理解的以视觉为中心的多模态大语言模型系统
Hangjie Yuan, Yichen Qian, Zhiwei Tang, Xianzhe Xu, Lirong Wu, Sicheng Yang, Jinwang Wang, Pengju Wang, Zhitao Zeng, Yizeng Han, Yan Xing, Shengxuan Luo, Tao Feng, Qing Xie, Weigen Yao, Yi Yang, Zuozhu Liu, Jiasheng Tang, Shaocheng Wang, Jitao Wang, Jiahong Dong, Weihua Chen, Feng Xu, Fan Wang
机构
*
DAMO Academy, Alibaba Group(达摩院,阿里巴巴集团)
;
Hupan Laboratory(湖畔实验室)
;
College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院)
;
Department of Computer Science and Technology, Tsinghua University(清华大学计算机科学与技术系)
;
Department of Radiology, The Affiliated Yangming Hospital of Ningbo University(宁波大学附属阳明医院放射科)
;
Zhejiang University-University of Illinois Urbana-Champaign Institute, Zhejiang University(浙江大学伊利诺伊大学厄巴纳香槟校区联合学院,浙江大学)
;
Hepato-Pancreato-Biliary Center, Beijing Tsinghua Changgung Hospital, School of Clinical Medicine, Tsinghua Medicine, Tsinghua University(清华长庚医院肝胆胰中心,清华大学临床医学院,清华医学,清华大学)
;
School of Software, Tsinghua University(清华大学软件学院)
;
Beijing National Research Center for Information Science and Technology, Tsinghua University(清华大学北京信息科学与技术国家研究中心)
SPADER: Step-wise Peer Advantage with Diversity-Aware Exploration Rewards for Multi-Answer Question Answering
SPADER: 面向多答案问答的逐步同伴优势与多样性感知探索奖励
Qiming Shi, Zhaolu Kang, Yunfan Zhou, Di Weng, Yingcai Wu
机构
*
State Key Lab of CAD&CG, Zhejiang University(浙江大学CAD与CG国家重点实验室)
;
School of Software and Microelectronics, Peking University(北京大学软件与微电子学院)
;
School of Software Technology, Zhejiang University(浙江大学软件技术学院)
Dr-DCI: Scaling Direct Corpus Interaction via Dynamic Workspace Expansion
Dr-DCI: 通过动态工作空间扩展实现直接语料交互的规模化
Yi Lu, Zhuofeng Li, Ping Nie, Haoxiang Zhang, Yuyu Zhang, Kai Zou, Wenhu Chen, Jimmy Lin, Dongfu Jiang, Yu Zhang
机构
*
University of Toronto(多伦多大学)
;
Texas A&M University(德克萨斯A&M大学)
;
University of Waterloo(滑铁卢大学)
;
UC San Diego(加州大学圣迭戈分校)
;
Verdent AI
;
Netmind AI
ASA: Backbone-Training-Free Representation Engineering for Tool-Calling Agents
ASA:无需骨干训练的工具调用智能体表示工程
Youjin Wang, Run Zhou, Yingjie Ma, Rong Fu, Jiani Liang, Shuaishuai Cao, Min Huang, Tao Fang, Liangming Pan
机构
*
Renmin University of China(中国人民大学)
;
University of Macau(澳门大学)
;
Central South University(中南大学)
;
Jiangxi Normal University(江西师范大学)
;
Macau Millennium College(澳门 millennium 学院)
;
Peking University(北京大学)
CommentsThe manuscript consists of 24 pages formatted in the ACL style. Youjin Wang, Run Zhou, and Yingjie Ma contributed equally to this work. Tao Fang and Liangming Pan are the co-corresponding authors
机构
*
Shenzhen International Graduate School, Tsinghua University, Shenzhen, China(深圳国际研究生院,清华大学,深圳,中国)
;
Ant Group, Hangzhou, China(蚂蚁集团,杭州,中国)
;
Swinburne University of Technology, Melbourne, Australia(斯威本科技大学,墨尔本,澳大利亚)
;
The University of Adelaide, Adelaide, Australia(阿德莱德大学,阿德莱德,澳大利亚)
;
UNSW Sydney, Australia(悉尼大学,澳大利亚)
CommentsSubstantially revised version consolidating the paper as a formal SAT-Graph API specification: clarifies Probability Isolation and post-anchoring determinism, broadens semantic anchoring to open and thematic legal queries, refines the data models and temporal primitives, and strengthens the use cases, limitations, and bibliography
Deep-Reporter: Deep Research for Grounded Multimodal Long-Form Generation
Deep-Reporter:基于多模态长形式生成的深度研究
Fangda Ye, Zhifei Xie, Yuxin Hu, Yihang Yin, Shurui Huang, Shikai Dong, Jianzhu Bao, Shuicheng Yan
机构
*
National University of Singapore(新加坡国立大学)
;
Nanyang Technological University(南洋理工大学)
;
University of Edinburgh(爱丁堡大学)
;
Beijing Institute of Technology(北京理工大学)