Continual Learning of Domain-Invariant Representations
持续学习领域不变表示
Pascal Janetzky, Tobias Schlagenhauf, Stefan Feuerriegel
机构
*
Bosch Center for Artificial Intelligence(博世人工智能中心)
;
Munich Center for Machine Learning(慕尼黑机器学习中心)
;
Albstadt-Sigmaringen University(阿尔布斯塔德-西格马林根大学)
Rule2DRC: Benchmarking LLM Agents for DRC Script Synthesis with Execution-Guided Test Generation
Rule2DRC:用于DRC脚本合成的LLM代理基准测试
Jinuk Kim, Junsoo Byun, Donghwi Hwang, Seong-Jin Park, Hyun Oh Song
机构
*
Department of Computer Science and Engineering, Seoul National University(首尔国立大学计算机科学与工程系)
;
Neural Processing Research Center(神经处理研究所以)
;
Samsung Electronics Co., Ltd(三星电子公司)
Offline Reinforcement Learning with Universal Horizon Models
离线强化学习中的通用时间 horizon 模型
Hojun Chung, Junseo Lee, Songhwai Oh
机构
*
Interdisciplinary Program in Artificial Intelligence and ASRI, Seoul National University(人工智能交叉学科项目及首尔国立大学ASRI)
;
Department of Electrical and Computer Engineering, Seoul National University(电气与计算机工程系,首尔国立大学)
Position: Artificial Intelligence Needs Meta Intelligence -- the Case for Metacognitive AI
位置:人工智能需要元智能——元认知AI的案例
Sergei Chuprov, Richard D. Lange, Leon Reznik, Paulo Shakarian, Raman Zatsarenko, Dmitrii Korobeinikov
机构
*
University of Texas Rio Grande Valley, Edinburg, TX, USA(德克萨斯大学里奥格兰德谷分校)
;
Rochester Institute of Technology, Rochester, NY, USA(罗切斯特理工学院)
;
Syracuse University, Syracuse, NY, USA(锡拉库萨大学)
CommentsThis is a preliminary version accepted for presentation and publication at the 43rd International Conference on Machine Learning (ICML26). The modified final version will be available in the conference proceedings
From LLM-Generated Conjectures to Lean Formalizations: Automated Polynomial Inequality Proving via Sum-of-Squares Certificates
从LLM生成的猜想到Lean形式化:通过求和平方证书实现自动多项式不等式证明
Ruobing Zuo, Hanrui Zhao, Gaolei He, Zhengfeng Yang, Jianlin Wang
机构
*
School of Software Engineering, East China Normal University, Shanghai, China(东华大学软件工程学院)
;
College of Computer Science and Technology, National University of Defense Technology, Changsha, China(国防科技大学计算机科学与技术学院)
;
School of Computer and Information Engineering, Henan University, Kaifeng, China(河南大学计算机与信息工程学院)
PACER: Acyclic Causal Discovery from Large-Scale Interventional Data
PACER:从大规模干预数据中进行无环因果发现
Ramon Viñas Torné, Sílvia Fàbregas Salazar, Soyon Park, Ivo Alexander Ban, Artyom Gadetsky, Nikita Doikov, Maria Brbić
机构
*
Swiss Federal Technology Institute of Lausanne (EPFL), Switzerland(瑞士联邦理工学院洛桑分校)
;
Cornell University, USA(康奈尔大学)
;
ETH Zurich, Zurich, Switzerland(苏黎世联邦理工学院)
Beyond Distribution Estimation: Simplex Anchored Structural Inference Towards Universal Semi-Supervised Learning
超越分布估计:基于简单集锚定的结构推断以实现通用半监督学习
Yaxin Hou, Jun Ma, Hanyang Li, Bo Han, Jie Yu, Yuheng Jia
机构
*
Key Laboratory of New Generation Artificial Intelligence Technology and Its Interdisciplinary Applications (Southeast University), Ministry of Education, Nanjing, China(新一代人工智能技术及其交叉应用重点实验室(东南大学),教育部,南京,中国)
;
School of Computer Science and Engineering, Southeast University, Nanjing, China(计算机科学与工程学院,东南大学,南京,中国)
;
School of Electrical Engineering, Southeast University, Nanjing, China(电气工程学院,东南大学,南京,中国)
机构
*
School of Computer Science and Information Engineering, Hefei University of Technology, Hefei, China(合肥工业大学计算机科学与信息工程学院)
;
Wuhan University, Wuhan, China(武汉大学)
;
Lab for Intelligence and visiON (LION)(智能视觉实验室)
DR Tulu: Reinforcement Learning with Evolving Rubrics for Deep Research
DR Tulu:基于演进标准的深度研究强化学习
Rulin Shao, Akari Asai, Shannon Zejiang Shen, Hamish Ivison, Varsha Kishore, Jingming Zhuo, Xinran Zhao, Molly Park, Samuel G. Finlayson, David Sontag, Tyler Murray, Sewon Min, Pradeep Dasigi, Luca Soldaini, Faeze Brahman, Wen-tau Yih, Tongshuang Wu, Luke Zettlemoyer, Yoon Kim, Hannaneh Hajishirzi, Pang Wei Koh
机构
*
University of Washington(华盛顿大学)
;
Allen Institute for AI(人工智能研究院)
;
Carnegie Mellon University(卡内基梅隆大学)
;
Massachusetts Institute of Technology(麻省理工学院)
;
Seattle Children's Hospital(西雅图儿童医院)
;
University of California, Berkeley(加州大学伯克利分校)
Causal-Adapter: Taming Text-to-Image Diffusion for Faithful Counterfactual Generation
Causal-Adapter:驯服文本到图像扩散模型以实现忠实的反事实生成
Lei Tong, Zhihua Liu, Chaochao Lu, Dino Oglic, Tom Diethe, Philip Teare, Sotirios A. Tsaftaris, Chen Jin
机构
*
Centre for AI, DS\&AI, Astrazeneca, UK(英国阿斯利康人工智能中心)
;
Institute for Imaging, Data and Communications (IDCOM), School of Engineering, University of Edinburgh, Edinburgh, UK(爱丁堡大学工程学院影像、数据与通信研究所)
;
Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)
Blending Supervised and Reinforcement Fine-Tuning with Prefix Sampling
融合监督学习与强化学习微调的前缀采样
Zeyu Huang, Tianhao Cheng, Zihan Qiu, Zili Wang, Yinghui Xu, Edoardo M. Ponti, Ivan Titov
机构
*
ILCC, University of Edinburgh(爱丁堡大学ILCC)
;
Fudan University(复旦大学)
;
Qwen Team, Alibaba Group(阿里集团Qwen团队)
;
ILLC, University of Amsterdam(阿姆斯特丹大学ILLC)
CommentsAccepted for a presentation at ICML 2024 and an oral presentation at NeurIPS 2023 Workshop on Causal Representation Learning. Code is available at https://github.com/KihoPark/linear_rep_geometry
Journal refIn Proceedings of the 41st International Conference on Machine Learning (ICML), 2024