arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型对齐与安全

大模型对齐、安全、越狱、红队、提示注入和可信评测。

共收录 686 信号源:cs.CL, cs.AI, cs.CY, cs.LG

1. 隐私与版权 686 篇

2410.21060 2025-04-22 cs.CR cs.AI cs.LG 62%

CTINexus: Automatic Cyber Threat Intelligence Knowledge Graph Construction Using Large Language Models

Yutong Cheng, Osama Bajaber, Saimon Amanuel Tsegai, Dawn Song, Peng Gao

机构 * Virginia Tech(弗吉尼亚理工大学) UC Berkeley(加州大学伯克利分校)

专题命中 隐私与版权 :alignment(abstract);分类 cs.AI、cs.LG

Comments Accepted at 2025 IEEE European Symposium on Security and Privacy (Euro S&P)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.08536 2025-04-14 cs.LG cs.AI 62%

Explainability and Continual Learning meet Federated Learning at the Network Edge

Thomas Tsouparopoulos, Iordanis Koutsopoulos

专题命中 隐私与版权 :trustworthy(abstract);分类 cs.AI、cs.LG

Comments 8 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12239 2025-03-18 cs.LG cs.AI cs.IT math.IT 62%

A Novel Double Pruning method for Imbalanced Data using Information Entropy and Roulette Wheel Selection for Breast Cancer Diagnosis

Soufiane Bacha, Huansheng Ning, Belarbi Mostefa, Doreen Sebastian Sarwatt, Sahraoui Dhelim

专题命中 隐私与版权 :safety(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.02246 2025-03-03 cs.LG cs.AI 62%

PFGuard: A Generative Framework with Privacy and Fairness Safeguards

Soyeon Kim, Yuji Roh, Geon Heo, Steven Euijong Whang

专题命中 隐私与版权 :trustworthy(abstract);分类 cs.AI、cs.LG

Comments In Proceedings of the 13th International Conference on Learning Representations (ICLR), 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.10158 2025-02-19 cs.NI cs.AI cs.CR cs.DC cs.LG 62%

DISTINQT: A Distributed Privacy Aware Learning Framework for QoS Prediction for Future Mobile and Wireless Networks

Nikolaos Koursioumpas, Lina Magoula, Ioannis Stavrakakis, Nancy Alonistioti, M. A. Gutierrez-Estevez, Ramin Khalili

专题命中 隐私与版权 :safety(abstract);分类 cs.AI、cs.LG

Comments 12 Pages Double Column, 10 Figures, (Minor Revised Version) Accepted for publication in the IEEE Transactions on Vehicular Technology (IEEE TVT)

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.03325 2025-01-22 cs.RO cs.AI cs.LG cs.NE 62%

Embodied Neuromorphic Artificial Intelligence for Robotics: Perspectives, Challenges, and Research Development Stack

Rachmad Vidya Wicaksana Putra, Alberto Marchisio, Fakhreddine Zayer, Jorge Dias, Muhammad Shafique

专题命中 隐私与版权 :safety(abstract);分类 cs.AI、cs.LG

Comments To appear at the 18th International Conference on Control, Automation, Robotics and Vision (ICARCV), December 2024, Dubai, UAE

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.08787 2024-12-10 cs.LG cs.CL 62%

Rethinking Machine Unlearning for Large Language Models

Sijia Liu, Yuanshun Yao, Jinghan Jia, Stephen Casper, Nathalie Baracaldo, Peter Hase, Yuguang Yao, Chris Yuhao Liu, Xiaojun Xu, Hang Li, Kush R. Varshney, Mohit Bansal, Sanmi Koyejo, Yang Liu

专题命中 隐私与版权 :trustworthy(abstract);分类 cs.CL、cs.LG

Comments Accepted by Nature Machine Intelligence

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.04950 2024-12-09 cs.LG cs.AI 62%

Bed-Attached Vibration Sensor System: A Machine Learning Approach for Fall Detection in Nursing Homes

Thomas Bartz-Beielstein, Axel Wellendorf, Noah Pütz, Jens Brandt, Alexander Hinterleitner, Richard Schulz, Richard Scholz, Olaf Mersmann, Robin Knabe

专题命中 隐私与版权 :safety(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.10692 2024-11-19 cs.LG cs.AI cs.NE 62%

DEBUG-HD: Debugging TinyML models on-device using Hyper-Dimensional computing

Nikhil P Ghanathe, Steven J E Wilton

专题命中 隐私与版权 :safety(abstract);分类 cs.AI、cs.LG

Comments Accepted at the Machine Learning for Systems Workshop at NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.14353 2024-10-29 cs.CY cs.AI 62%

Assistive AI for Augmenting Human Decision-making

Natabara Máté Gyöngyössy, Bernát Török, Csilla Farkas, Laura Lucaj, Attila Menyhárd, Krisztina Menyhárd-Balázs, András Simonyi, Patrick van der Smagt, Zsolt Ződi, András Lőrincz

专题命中 隐私与版权 :alignment(abstract);分类 cs.AI、cs.CY

Comments 37 pages, 6 figures; Changes: Revised references (k-anonimity)

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.13892 2024-10-28 cs.LG cs.AI 62%

Generalizing Differentially Private Decentralized Deep Learning with Multi-Agent Consensus

Jasmine Bayrooti, Zhan Gao, Amanda Prorok

专题命中 隐私与版权 :trustworthy(abstract);分类 cs.AI、cs.LG

Comments Published in Distributed Autonomous Robotic Systems (DARS) 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.07087 2024-10-07 cs.CL cs.LG 62%

CopyBench: Measuring Literal and Non-Literal Reproduction of Copyright-Protected Text in Language Model Generation

Tong Chen, Akari Asai, Niloofar Mireshghallah, Sewon Min, James Grimmelmann, Yejin Choi, Hannaneh Hajishirzi, Luke Zettlemoyer, Pang Wei Koh

专题命中 隐私与版权 :alignment(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.02783 2024-10-07 cs.CY cs.AI cs.HC 62%

Enhancing Mental Health Support through Human-AI Collaboration: Toward Secure and Empathetic AI-enabled chatbots

Rawan AlMakinah, Andrea Norcini-Pala, Lindsey Disney, M. Abdullah Canbaz

专题命中 隐私与版权 :trustworthy(abstract);分类 cs.AI、cs.CY

Comments 17 pages, 9 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.16538 2024-09-26 cs.CV cs.AI cs.LG 62%

Source-Free Domain Adaptation for YOLO Object Detection

Simon Varailhon, Masih Aminbeidokhti, Marco Pedersoli, Eric Granger

专题命中 隐私与版权 :alignment(abstract);分类 cs.AI、cs.LG

Comments ECCV 2024: European Conference on Computer Vision - Workshop on Out-of-Distribution Generalization in Computer Vision Foundation Models, Milan Italy

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.20503 2024-07-31 cs.LG cs.AI 62%

A federated large language model for long-term time series forecasting

Raed Abdel-Sater, A. Ben Hamza

专题命中 隐私与版权 :alignment(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.11594 2024-07-17 cs.CV cs.AI cs.LG 62%

DiNO-Diffusion. Scaling Medical Diffusion via Self-Supervised Pre-Training

Guillermo Jimenez-Perez, Pedro Osorio, Josef Cersovsky, Javier Montalt-Tordera, Jens Hooge, Steffen Vogler, Sadegh Mohammadi

专题命中 隐私与版权 :alignment(abstract);分类 cs.AI、cs.LG

Comments 12 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.04110 2024-07-09 cs.LG cs.AI cs.CV 62%

Privacy Meets Explainability: A Comprehensive Impact Benchmark

Saifullah Saifullah, Dominique Mercier, Adriano Lucieri, Andreas Dengel, Sheraz Ahmed

专题命中 隐私与版权 :safety(abstract);分类 cs.AI、cs.LG

Comments Under Submission

Journal ref Frontiers in Artificial Intelligence, 2024 (7), 1236947

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.15789 2024-06-25 cs.LG cs.AI cs.CR 62%

Privacy Implications of Explainable AI in Data-Driven Systems

Fatima Ezzeddine

专题命中 隐私与版权 :trustworthy(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.13534 2024-06-18 cs.CL cs.AI 62%

Building Trust in Conversational AI: A Comprehensive Review and Solution Architecture for Explainable, Privacy-Aware Systems using LLMs and Knowledge Graph

Ahtsham Zafar, Venkatesh Balavadhani Parthasarathy, Chan Le Van, Saad Shahid, Aafaq Iqbal khan, Arsalan Shahid

专题命中 隐私与版权 :trustworthy(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.14883 2024-06-06 cs.CR cs.AI cs.LG 62%

Double-I Watermark: Protecting Model Copyright for LLM Fine-tuning

Shen Li, Liuyi Yao, Jinyang Gao, Lan Zhang, Yaliang Li

专题命中 隐私与版权 :harmlessness(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.07298 2024-05-07 cs.AI cs.LG 62%

Beyond Memorization: Violating Privacy Via Inference with Large Language Models

Robin Staab, Mark Vero, Mislav Balunović, Martin Vechev

专题命中 隐私与版权 :alignment(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.03004 2024-05-07 cs.CL cs.LG 62%

Exploring prompts to elicit memorization in masked language model-based named entity recognition

Yuxi Xia, Anastasiia Sedova, Pedro Henrique Luz de Araujo, Vasiliki Kougia, Lisa Nußbaumer, Benjamin Roth

专题命中 隐私与版权 :safety(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.11536 2024-04-30 cs.LG cs.AI 62%

FedPFT: Federated Proxy Fine-Tuning of Foundation Models

Zhaopeng Peng, Xiaoliang Fan, Yufan Chen, Zheng Wang, Shirui Pan, Chenglu Wen, Ruisheng Zhang, Cheng Wang

专题命中 隐私与版权 :alignment(abstract);分类 cs.AI、cs.LG

Comments Accepted by IJCAI'24

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.07061 2024-04-08 cs.LG cs.AI 62%

Machine Unlearning: Solutions and Challenges

Jie Xu, Zihan Wu, Cong Wang, Xiaohua Jia

专题命中 隐私与版权 :trustworthy(abstract);分类 cs.AI、cs.LG

Journal ref IEEE Transactions on Emerging Topics in Computational Intelligence 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.10553 2024-03-19 cs.LG cs.AI cs.CR 62%

Learning to Watermark LLM-generated Text via Reinforcement Learning

Xiaojun Xu, Yuanshun Yao, Yang Liu

专题命中 隐私与版权 :alignment(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.12751 2024-03-15 cs.CY cs.AI cs.HC 62%

Human-Centred Learning Analytics and AI in Education: a Systematic Literature Review

Riordan Alfredo, Vanessa Echeverria, Yueqiao Jin, Lixiang Yan, Zachari Swiecki, Dragan Gašević, Roberto Martinez-Maldonado

专题命中 隐私与版权 :safety(abstract);分类 cs.AI、cs.CY

Comments 40 pages, 6 figures, 1 table in Appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.15237 2024-02-19 cs.CY cs.AI cs.ET cs.HC 62%

User Experience Design Professionals' Perceptions of Generative Artificial Intelligence

Jie Li, Hancheng Cao, Laura Lin, Youyang Hou, Ruihao Zhu, Abdallah El Ali

专题命中 隐私与版权 :alignment(abstract);分类 cs.AI、cs.CY

Comments accepted to CHI 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.14195 2024-02-06 cs.CL cs.AI 62%

HumBEL: A Human-in-the-Loop Approach for Evaluating Demographic Factors of Language Models in Human-Machine Conversations

Anthony Sicilia, Jennifer C. Gates, Malihe Alikhani

专题命中 隐私与版权 :alignment(abstract);分类 cs.CL、cs.AI

Comments 17 pages, 9 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2206.04891 2024-01-15 cs.LG cs.AI 62%

Explaining Neural Networks without Access to Training Data

Sascha Marton, Stefan Lüdtke, Christian Bartelt, Andrej Tschalzev, Heiner Stuckenschmidt

专题命中 隐私与版权 :safety(abstract);分类 cs.AI、cs.LG

Journal ref Machine Learning (2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.03040 2024-01-09 cs.LG cs.AI cs.CV cs.DC 62%

AccidentGPT: Large Multi-Modal Foundation Model for Traffic Accident Analysis

Kebin Wu, Wenbin Li, Xiaofei Xiao

专题命中 隐私与版权 :safety(abstract);分类 cs.AI、cs.LG

Comments 8 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏