EditRefiner: A Human-Aligned Agentic Framework for Image Editing Refinement
EditRefiner:一种对齐人类的代理框架用于图像编辑细化
Zitong Xu, Huiyu Duan, Yifei Nie, Mingda Du, Sijing Wu, Xiongkuo Min, Tianyi Zheng, Jian Zhang, Shusong Xu, Jinwei Chen, Bo Li, Guangtao Zhai
机构
*
Shanghai Jiao Tong University(上海交通大学)
;
Vivo Mobile Communication Co., Ltd(Vivo移动通信有限公司)
;
University of Electronic Science and Technology of China(电子科学与技术大学)
Towards Lawful Autonomous Driving: Deriving Scenario-Aware Driving Requirements from Traffic Laws and Regulations
迈向合法自动驾驶:从交通法规中推导场景感知的驾驶要求
Bowen Jian, Rongjie Yu, Hong Wang, Liqiang Wang, Zihang Zou
机构
*
College of Transportation, Tongji University(同济大学交通运输学院)
;
The Key Laboratory of Road and Traffic Engineering, Ministry of Education(教育部道路与交通工程重点实验室)
;
School of Vehicle and Mobility, Tsinghua University(清华大学车辆与移动性学院)
;
College of Computer Science, University of Central Florida(佛罗里达中央大学计算机科学学院)
;
Optixway AI
Diagnosing Urban Street Vitality via a Visual-Semantic and Spatiotemporal Framework for Street-Level Economics
通过视觉-语义和时空框架诊断城市街道活力
Xinxin Zhuo, Mengyuan Niu, Ruizhe Wang, Junyan Yang, Qiao Wang
机构
*
School of Economics and Management, Southeast University(经济管理学院,东南大学)
;
School of Information Science and Engineering, Southeast University(信息科学与工程学院,东南大学)
;
School of Architecture, Southeast University(建筑学院,东南大学)
Neuro-Symbolic AI for Cybersecurity: State of the Art, Challenges, and Opportunities
神经符号AI在网络安全中的应用:现状、挑战与机遇
Safayat Bin Hakim, Muhammad Adil, Alvaro Velasquez, Shouhuai Xu, Houbing Herbert Song
机构
*
Department of Information Systems, University of Maryland, Baltimore County(信息系统系,马里兰大学巴尔的摩分校)
;
Department of Computer Science and Engineering, University at Buffalo(计算机科学与工程系,布法罗大学)
;
Department of Computer Science, University of Colorado Boulder(计算机科学系,科罗拉多大学博尔德分校)
;
Laboratory for Cybersecurity Dynamics, Department of Computer Science, University of Colorado Colorado Springs(网络安全动力实验室,科罗拉多大学科罗拉多斯普林斯分校)
From Attenuation to Attention: Variational Information Flow Manipulation for Fine-Grained Visual Perception
从衰减到注意:用于细粒度视觉感知的变分信息流操控
Jilong Zhu, Yang Feng
机构
*
Key Laboratory of Intelligent Information Processing, Institute of Computing Technology, Chinese Academy of Sciences (ICT/CAS)(智能信息处理重点实验室,计算技术研究所,中国科学院(ICT/CAS))
;
State Key Laboratory of AI Safety, Institute of Computing Technology, Chinese Academy of Sciences (ICT/CAS)(人工智能安全国家重点实验室,计算技术研究所,中国科学院(ICT/CAS))
;
University of Chinese Academy of Sciences, Beijing, China(中国科学院大学,北京,中国)
专题命中
视觉定位与Grounding
:grounding(abstract);multimodal large language model(abstract);分类 cs.CV
FashionStylist: An Expert Knowledge-enhanced Multimodal Dataset for Fashion Understanding
FashionStylist: 一个增强专家知识的多模态数据集用于时尚理解
Kaidong Feng, Zhuoxuan Huang, Huizhong Guo, Yuting Jin, Xinyu Chen, Yue Liang, Yifei Gai, Li Zhou, Yunshan Ma, Zhu Sun
机构
*
Yanshan University(燕山大学)
;
Central South University(中南大学)
;
Zhejiang University(浙江大学)
;
Southwest University(西南大学)
;
Singapore Management University(新加坡管理大学)
;
Singapore University of Technology and Design(新加坡科技设计大学)