arXivDaily arXiv每日学术速递 周一至周五更新

大厂专区

Oracle(甲骨文)

共收录 104
2504.19472 2026-02-03 cs.CL

Conflicts in Texts: Data, Implications and Challenges

文本中的冲突:数据、影响与挑战

Siyi Liu, Dan Roth

机构 * University of Pennsylvania(宾夕法尼亚大学) Oracle AI

AI总结 本文探讨了文本中冲突的数据、影响与挑战,提出了统一冲突信息的概念,分析了其影响并讨论了缓解策略,旨在开发更有效处理冲突信息的NLP系统。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.15830 2026-01-27 cs.CL cs.AI

DAIQ: Auditing Demographic Attribute Inference from Question in LLMs

DAIQ:从LLM中的问题审计人口属性推断

Srikant Panda, Hitesh Laxmichand Patel, Shahad Al-Khalifa, Amit Agarwal, Hend Al-Khalifa, Sharefah Al-Ghamdi

机构 * Lam Research Oracle AI King Saud University(沙特国王大学)

AI总结 DAIQ研究了LLM在中性问题中推断人口属性的问题,发现模型倾向于社会主导类别并生成刻板印象推理,通过回避导向提示可减少无意推断。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15709 2026-01-23 cs.AI cs.DB cs.LG

AgentSM: Semantic Memory for Agentic Text-to-SQL

AgentSM: 语义记忆用于代理文本到SQL

Asim Biswal, Chuan Lei, Xiao Qin, Aodong Li, Balakrishnan Narayanaswamy, Tim Kraska

机构 * Amazon Web Services(亚马逊网络服务) University of California, Berkeley(加州大学伯克利分校) Oracle Corporation(甲骨文公司) Snowflake Inc.(Snowflake公司)

AI总结 AgentSM通过构建可解释的语义记忆,提升文本到SQL任务的效率和准确性,减少令牌使用和轨迹长度,达到更高执行精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06477 2026-01-14 cs.CL cs.CY cs.SI

IndRegBias: A Dataset for Studying Indian Regional Biases in English and Code-Mixed Social Media Comments

IndRegBias:一个用于研究印度地区偏见的英文及混合语言社交媒体评论数据集

Debasmita Panda, Akash Anil, Neelesh Kumar Shukla

机构 * Department of Data Science and Engineering, Indian Institute of Science Education and Research(数据科学与工程系,印度科学教育与研究学院) Oracle Industries AI, Oracle Corporation(Oracle人工智能部,Oracle公司)

AI总结 本文提出IndRegBias数据集,用于研究印度地区偏见,通过多级标注策略评估LLM和ILM在检测地区偏见及严重性方面的性能。

Comments Preprint. Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04230 2026-01-14 cs.CL

Pushing on Multilingual Reasoning Models with Language-Mixed Chain-of-Thought

通过语言混合的推理模型推动多语言推理

Guijin Son, Donghun Yang, Hitesh Laxmichand Patel, Amit Agarwal, Hyunwoo Ko, Chanuk Lim, Srikant Panda, Minhyuk Kim, Nikunj Drolia, Dasol Choi, Kyong-Ha Lee, Youngjae Yu

机构 * OneLineAI KISTI Oracle AI Korea University(韩国大学) Modulabs Seoul National University(首尔国立大学) University College Dublin(都柏林大学学院) Yonsei University(延世大学)

AI总结 本文提出语言混合的推理方法,通过多语言推理提升模型性能,展示在韩国案例研究中达到最先进的表现。

Comments Work in Progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04210 2025-12-05 cs.AI cs.CL cs.CY

Balancing Safety and Helpfulness in Healthcare AI Assistants through Iterative Preference Alignment

通过迭代偏好对齐平衡医疗AI助手的安全性与帮助性

Huy Nghiem, Swetasudha Panda, Devashish Khatwani, Huy V. Nguyen, Krishnaram Kenthapadi, Hal Daumé

机构 * University of Maryland(马里兰大学) Oracle Labs(Oracle实验室) Oracle Health AI(Oracle健康AI)

AI总结 本文提出通过迭代偏好对齐框架提升医疗AI助手的安全性与帮助性,通过KTO和DPO优化改进模型,提升有害查询检测性能并平衡安全与效用。

Comments ML4H 2025 Proceedings, Best Paper Award

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18717 2025-11-25 cs.IR cs.LG

When and What to Recommend: Joint Modeling of Timing and Content for Active Sequential Recommendation

何时推荐什么:主动序列推荐的时机与内容联合建模

Jin Chai, Xiaoxiao Ma, Jian Yang, Jia Wu

机构 * School of Computing, Macquarie University(麦考瑞大学计算学院) Oracle Analytics Cloud, Oracle Corporation(Oracle公司分析云)

AI总结 PASRec通过联合建模时机与内容,主动预测用户交互时间并推荐感兴趣物品,优于现有基线方法。

Comments 10 pages, 5 figures. Submitted to arXiv

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.13361 2025-11-18 cs.AI cs.MA

MedDCR: Learning to Design Agentic Workflows for Medical Coding

Jiyang Zheng, Islam Nassar, Thanh Vu, Xu Zhong, Yang Lin, Tongliang Liu, Long Duong, Yuan-Fang Li

机构 * Oracle Health and AI(Oracle健康与AI) Sydney AI Center, The University of Sydney(悉尼AI中心,悉尼大学)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17330 2025-11-13 cs.CV cs.AI cs.CL cs.IR cs.LG

FS-DAG: Few Shot Domain Adapting Graph Networks for Visually Rich Document Understanding

Amit Agarwal, Srikant Panda, Kulbhushan Pachauri

机构 * OCI, Oracle USA(Oracle USA)

Comments Proceedings of the 31st International Conference on Computational Linguistics (COLING 2025), Industry Track, pages 100-114

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.04508 2025-11-12 cs.CL

ProST: Progressive Sub-task Training for Pareto-Optimal Multi-agent Systems Using Small Language Models

Biddut Sarker Bijoy, Mohammad Saqib Hasan, Pegah Alipoormolabashi, Avirup Sil, Aruna Balasubramanian, Niranjan Balasubramanian

机构 * Stony Brook University(石溪大学) Oracle Applied Science(Oracle应用科学)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00804 2025-11-11 cs.LG cs.CV

EraseFlow: Learning Concept Erasure Policies via GFlowNet-Driven Alignment

Abhiram Kusumba, Maitreya Patel, Kyle Min, Changhoon Kim, Chitta Baral, Yezhou Yang

机构 * Arizona State University(亚利桑那州立大学) Capital One(Capital One公司) Oracle(Oracle公司) Soongsil University(顺天大学)

Comments NeurIPS'25 Spotlight | Project page: https://eraseflow.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25007 2025-10-30 cs.AI cs.LG

Taming the Real-world Complexities in CPT E/M Coding with Large Language Models

Islam Nassar, Yang Lin, Yuan Jin, Rongxin Zhu, Chang Wei Tan, Zenan Zhai, Nitika Mathur, Thanh Tien Vu, Xu Zhong, Long Duong, Yuan-Fang Li

机构 * Oracle Health & AI(Oracle健康与人工智能)

Comments EMNLP 2025 Industry Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.23870 2025-10-29 cs.CL cs.AI

OraPlan-SQL: A Planning-Centric Framework for Complex Bilingual NL2SQL Reasoning

Marianne Menglin Liu, Sai Ashish Somayajula, Syed Fahad Allam Shah, Sujith Ravi, Dan Roth

机构 * Oracle AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.23854 2025-10-29 cs.CL cs.AI

Can LLMs Narrate Tabular Data? An Evaluation Framework for Natural Language Representations of Text-to-SQL System Outputs

Jyotika Singh, Weiyi Sun, Amit Agarwal, Viji Krishnamurthy, Yassine Benajiba, Sujith Ravi, Dan Roth

机构 * Oracle AI

Comments Accepted at EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23659 2025-10-28 cs.CL cs.AI

Aligning LLMs for Multilingual Consistency in Enterprise Applications

Amit Agarwal, Hansa Meghwani, Hitesh Laxmichand Patel, Tao Sheng, Sujith Ravi, Dan Roth

机构 * Oracle AI

Comments Accepted at EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.09572 2025-10-22 cs.CL

Rethinking LLM Uncertainty: A Multi-Agent Approach to Estimating Black-Box Model Uncertainty

Yu Feng, Phu Mon Htut, Zheng Qi, Wei Xiao, Manuel Mager, Nikolaos Pappas, Kishaloy Halder, Yang Li, Yassine Benajiba, Dan Roth

机构 * University of Pennsylvania(宾夕法尼亚大学) AWS AI Labs(AWS人工智能实验室) Johannes Gutenberg University of Mainz(美因茨约翰内斯·古滕贝格大学) Oracle AI(Oracle人工智能)

Comments EMNLP 2025 Findings

Journal ref EMNLP 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.17614 2025-10-21 cs.AI cs.IR

OG-Rank: Learning to Rank Fast and Slow with Uncertainty and Reward-Trend Guided Adaptive Exploration

Praphul Singh, Corey Barrett, Sumana Srivasta, Irfan Bulu, Sri Gadde, Krishnaram Kenthapadi

机构 * Oracle Health & AI(Oracle健康与人工智能)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.16540 2025-10-21 cs.CV cs.AI

Enhancing Compositional Reasoning in CLIP via Reconstruction and Alignment of Text Descriptions

Jihoon Kwon, Kyle Min, Jy-yong Sohn

机构 * Seoul National University(首尔国立大学) Oracle(Oracle公司) Yonsei University(延世大学) Intel Labs(英特尔实验室)

Comments Accepted at NeurIPS 2025 (poster). This is the camera-ready version

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.14169 2025-10-20 cs.AI

JEDA: Query-Free Clinical Order Search from Ambient Dialogues

Praphul Singh, Corey Barrett, Sumana Srivasta, Amitabh Saikia, Irfan Bulu, Sri Gadde, Krishnaram Kenthapadi

机构 * Oracle Health & AI(Oracle健康与人工智能)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.05310 2025-10-08 cs.CL cs.AI

RAG Makes Guardrails Unsafe? Investigating Robustness of Guardrails under RAG-style Contexts

Yining She, Daniel W. Peterson, Marianne Menglin Liu, Vikas Upadhyay, Mohammad Hossein Chaghazardi, Eunsuk Kang, Dan Roth

机构 * Carnegie Mellon University(卡内基梅隆大学) Oracle Cloud Infrastructure(Oracle 云基础设施) University of Pennsylvania(宾夕法尼亚大学)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.05040 2025-10-07 cs.LG cs.AI

Test-Time Scaling in Diffusion LLMs via Hidden Semi-Autoregressive Experts

Jihoon Lee, Hoyeon Moon, Kevin Zhai, Arun Kumar Chithanar, Anit Kumar Sahu, Soummya Kar, Chul Lee, Souradip Chakraborty, Amrit Singh Bedi

机构 * Yonsei University(延世大学) Oracle(Oracle公司) CMU(卡内基梅隆大学) UMD(马里兰大学) UCF(佛罗里达大学)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.02338 2025-10-06 cs.CL cs.AI

Optimizing Long-Form Clinical Text Generation with Claim-Based Rewards

Samyak Jhaveri, Praphul Singh, Jangwon Kim, Tara Taghavi, Krishnaram Kenthapadi

机构 * Oracle Health AI(Oracle健康AI)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.22860 2025-10-06 cs.CR cs.AI cs.LG

Permissioned LLMs: Enforcing Access Control in Large Language Models

Bargav Jayaraman, Virendra J. Marathe, Hamid Mozaffari, William F. Shen, Krishnaram Kenthapadi

机构 * Oracle Labs(Oracle实验室) University of Cambridge(剑桥大学)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.02133 2025-10-03 cs.AI cs.LG

FlexDoc: Parameterized Sampling for Diverse Multilingual Synthetic Documents for Training Document Understanding Models

Karan Dua, Hitesh Laxmichand Patel, Puneet Mittal, Ranjeet Gupta, Amit Agarwal, Praneet Pabolu, Srikant Panda, Hansa Meghwani, Graham Horwood, Fahad Shah

机构 * Oracle Corporation(Oracle公司)

Comments Accepted at EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01549 2025-10-03 cs.LG

MIRA: Towards Mitigating Reward Hacking in Inference-Time Alignment of T2I Diffusion Models

Kevin Zhai, Utsav Singh, Anirudh Thatipelli, Souradip Chakraborty, Anit Kumar Sahu, Furong Huang, Amrit Singh Bedi, Mubarak Shah

机构 * University of Central Florida(中央佛罗里达大学) University of Maryland, College Park(马里兰大学学院公园分校) Oracle(Oracle公司)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.14270 2025-10-03 cs.CL cs.AI cs.LG cs.MM cs.SD eess.AS

SpeechWeave: Diverse Multilingual Synthetic Text & Audio Data Generation Pipeline for Training Text to Speech Models

Karan Dua, Puneet Mittal, Ranjeet Gupta, Hitesh Laxmichand Patel

机构 * Oracle AI

Comments Accepted at ACL 2025

Journal ref Proceedings of the 63rd Annual Meeting of the Association for Computational Linguistics (Volume 6: Industry Track) - 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23879 2025-09-30 cs.CV cs.AI cs.CL cs.MM

PCRI: Measuring Context Robustness in Multimodal Models for Enterprise Applications

Hitesh Laxmichand Patel, Amit Agarwal, Srikant Panda, Hansa Meghwani, Karan Dua, Paul Li, Tao Sheng, Sujith Ravi, Dan Roth

机构 * Oracle AI

Comments Accepted in EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23673 2025-09-30 cs.CV cs.AI cs.CL cs.MM

RCI: A Score for Evaluating Global and Local Reasoning in Multimodal Benchmarks

Amit Agarwal, Hitesh Laxmichand Patel, Srikant Panda, Hansa Meghwani, Jyotika Singh, Karan Dua, Paul Li, Tao Sheng, Sujith Ravi, Dan Roth

机构 * Oracle AI

Comments Accepted in EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22703 2025-09-30 cs.CL cs.AI cs.CY

AccessEval: Benchmarking Disability Bias in Large Language Models

Srikant Panda, Amit Agarwal, Hitesh Laxmichand Patel

机构 * Oracle AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.15241 2025-09-29 cs.CL

MrGuard: A Multilingual Reasoning Guardrail for Universal LLM Safety

Yahan Yang, Soham Dan, Shuo Li, Dan Roth, Insup Lee

机构 * University of Pennsylvania(宾夕法尼亚大学) Microsoft(微软公司) Oracle AI

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏