Enhancing Creativity in 3D Generative Design via a TRIZ-Inspired Text-to-CAD Framework
通过TRIZ启发的文本到CAD框架增强3D生成设计的创造力
Dongeon Lee, Leekyo Jeong, Soyoung Yoo, Sunwoong Yang, Namwoo Kang
机构
*
Cho Chun Shik Graduate School of Mobility, KAIST, Daejeon, Republic of Korea(韩国科学技术院(KAIST)赵正植移动研究生院,大田,韩国)
;
Samsung Electronics, Suwon, Republic of Korea(三星电子,水原,韩国)
;
Department of Mechanical Engineering, Hanyang University, Ansan, Republic of Korea(汉阳大学机械工程系,安山,韩国)
;
Narnia Labs, Daejeon, Republic of Korea(纳尼亚实验室,大田,韩国)
Finetuning Vision-Language-Action Models Requires Fewer Layers Than You Think
微调视觉-语言-动作模型所需的层数比你想象的少
Gia-Binh Nguyen, Trong-Bao Ho, Thien-Loc Ha, Khoa Vo, Philip Lund Møller, Quang T. Nguyen, Long Dinh, Tung M. Luu, Tuan Dam, Vu Duong, Trung Le, Nghi D. Q. Bui, Minh Vu, Tran Nguyen Le, An Thai Le, Ngan Le, Daniel Sonntag, James Zou, Jan Peters, Duy M. H. Nguyen, Ngo Anh Vien
机构
*
Center for AI Research, VinUniversity(VinUniversity人工智能研究中心)
;
VinRobotics
;
University of Arkansas(阿肯色大学)
;
Technical University of Denmark(丹麦技术大学)
;
Hanoi University of Science and Technology(河内科技大学)
;
KAIST(韩国科学技术院)
;
Monash University(莫纳什大学)
;
Oldenburg University(奥尔登堡大学)
;
DFKI(德国人工智能研究中心)
;
University of Stuttgart(斯图加特大学)
;
IMPRS-IS(国际马克斯·普朗克智能系统研究学院)
;
Stanford University(斯坦福大学)
;
Technische Universität Darmstadt(达姆施塔特工业大学)
Variable-Length Tokenization via Learnable Global Merging for Diffusion Transformers
基于可学习全局合并的可变长度分词用于扩散变换器
Dong Hoon Lee, Seunghoon Hong
机构
*
Kim Jaechul Graduate School of AI, KAIST, Daejeon, South Korea(韩国科学技术院金载哲人工智能研究生院,大田,韩国)
;
School of Computing, KAIST, Daejeon, South Korea(韩国科学技术院计算学院,大田,韩国)
TRAP: Benchmark for Task-completion and Resistance to Active Privacy-extraction
TRAP:任务完成与主动隐私提取抵抗基准
Moon Ye-Bin, Nam Hyeon-Woo, Baek Seong-Eun, Yejin Yeo, Tae-Hyun Oh
机构
*
Dept. of Electrical Engineering, POSTECH(POSTECH电子工程系)
;
Grad. School of Artificial Intelligence, POSTECH(POSTECH人工智能研究生院)
;
School of Computing, KAIST(韩国科学技术院计算机学院)
DREAM: Extending Vision-Language Models with Dual-Objective Encoding for Cross-Modal Retrieval
DREAM: 通过双目标编码扩展视觉-语言模型用于跨模态检索
Kaleem Ullah, Altaf Hussain, Muhammad Munsif, Sung Wook Baik
机构
*
Sejong University(世宗大学)
;
Korea Advanced Institute of Science and Technology(韩国科学技术院)
;
Ulsan National Institute of Science and Technology(乌山国立科学研究院)