


default search action
EMNLP 2025: Suzhou, China - Industry Track
- Saloni Potdar, Lina Maria Rojas-Barahona, Sébastien Montella:

Proceedings of the 2025 Conference on Empirical Methods in Natural Language Processing, EMNLP 2025 - Industry Track, Suzhou, China, November 4-9, 2025. Association for Computational Linguistics 2025 - Frontmatter.

- Deyi Ji, Yuekui Yang, Liqun Liu, Peng Shu, Haiyang Wu, Shaogang Tang, Xudong Chen, Shaoping Ma, Tianrun Chen, Lanyun Zhu:

RAVEN++: Pinpointing Fine-Grained Violations in Advertisement Videos with Active Reinforcement Reasoning. 1-10 - Madhur Jindal

, Hari Shrawgi, Parag Agrawal, Sandipan Dandapat:
SAGE: A Generic Framework for LLM Safety Evaluation. 11-33 - Hanmeng Zhong, Linqing Chen, Wentao Wu, Weilei Wang:

CRAB: A Benchmark for Evaluating Curation of Retrieval-Augmented LLMs in Biomedicine. 34-49 - Minyi Zhao, Yi Liu, Jianfeng Wen, Boshen Zhang, Hailang Chang, Zhiheng Ouyang, Jie Wang, Wensong He, Shuigeng Zhou:

VENUS: A VLLM-driven Video Content Discovery System for Real Application Scenarios. 50-64 - Yuheng Li, Jiechao Gao, Wei Han, Wenwen Ouyang, Wei Zhu, Hui Yi Leong:

FT-MDT: Extracting Decision Trees from Medical Texts via a Novel Low-rank Adaptation Method. 65-76 - Michel Wong, Ali Alshehri, Sophia Kao, Haotian He:

PolyNorm: Few-Shot LLM-Based Text Normalization for Text-to-Speech. 77-85 - Naveen Vakada, Arvind Krishna Sridhar, Yinyi Guo, Erik Visser:

Audio Query Handling System with Integrated Expert Models and Contextual Understanding. 86-97 - Nicolas Bougie, Narimawa Watanabe:

Generative Reviewer Agents: Scalable Simulacra of Peer Review. 98-116 - Amit Agarwal, Hansa Meghwani, Hitesh Laxmichand Patel, Tao Sheng, Sujith Ravi, Dan Roth:

Aligning LLMs for Multilingual Consistency in Enterprise Applications. 117-137 - Amit Agarwal, Hitesh Laxmichand Patel, Srikant Panda, Hansa Meghwani, Jyotika Singh

, Karan Dua, Paul Li, Tao Sheng, Sujith Ravi, Dan Roth:
RCI: A Score for Evaluating Global and Local Reasoning in Multimodal Benchmarks. 138-157 - Yungi Kim, Hyunsoo Ha, Seonghoon Yang, Sukyung Lee, Jihoo Kim, Chanjun Park:

LP Data Pipeline: Lightweight, Purpose-driven Data Pipeline for Large Language Models. 158-172 - Moy Yuan, Han-Chin Shing, Mitch Strong, Chaitanya Shivade:

Toward Reliable Clinical Coding with Language Models: Verification and Lightweight Adaptation. 173-184 - Jihang Li

, Bing Xu, Zulong Chen, Chuanfei Xu, Minping Chen, Suyu Liu, Ying Zhou, Zeyi Wen:
Enhancing Talent Search Ranking with Role-Aware Expert Mixtures and LLM-based Fine-Grained Job Descriptions. 185-194 - Hitesh Laxmichand Patel, Amit Agarwal, Srikant Panda, Hansa Meghwani, Karan Dua, Paul Li, Tao Sheng, Sujith Ravi, Dan Roth:

PCRI: Measuring Context Robustness in Multimodal Models for Enterprise Applications. 195-214 - Nicolas Bougie, Narimawa Watanabe:

CitySim: Modeling Urban Behaviors and City Dynamics with Large-Scale LLM-Driven Agent Simulation. 215-229 - Justyna Gromada, Alicja Kasicka, Ewa Komkowska, Lukasz Krajewski, Natalia Krawczyk

, Morgan Veyret, Bartosz Przybyl, Lina Maria Rojas-Barahona, Michal Szczerbak:
Evaluating Conversational Agents with Persona-driven User Simulations based on Large Language Models: A Sales Bot Case Study. 230-245 - Zhao Wang, Bowen Chen, Yotaro Shimose, Sota Moriyama, Heng Wang, Shingo Takamatsu:

Mirror in the Model: Ad Banner Image Generation via Reflective Multi-LLM and Multi-modal Agents. 246-266 - Bryan Zhang, Suleiman A. Khan, Stephan Walter:

Leveraging Product Catalog Patterns for Multilingual E-commerce Product Attribute Prediction. 267-275 - Haoxin Wang, Xianhan Peng, Huang Cheng, Yizhe Huang, Ming Gong, Chenghan Yang, Yang Liu, Jiang Lin:

ECom-Bench: Can LLM Agent Resolve Real-World E-commerce Customer Support Issues? 276-284 - Zhentao Xu

, Fengyi Li, Albert C. Chen, Xiaofeng Wang:
ProCut: LLM Prompt Compression via Attribution Estimation. 285-309 - Xiaoyun Zhang, Jingqing Ruan, Xing Ma, Yawen Zhu, Jiansong Chen, Ke Zeng, Xunliang Cai:

A Reasoner for Real-World Event Detection: Scaling Reinforcement Learning via Adaptive Perplexity-Aware Sampling Strategy. 310-324 - Achir Oukelmoun, Nasredine Semmar, Gaël de Chalendar, Clément Cormi, Mariame Oukelmoun, Eric Vibert, Marc-Antoine Allard:

Detecting Omissions in LLM-Generated Medical Summaries. 325-337 - Hieu Tran, Junda Wang, Yujan Ting

, Hong Yu, Weijing Huang
, Terrence Chen:
LEAF: Learning and Evaluation Augmented by Fact-Checking to Improve Factualness in Large Language Models. 338-363 - James T. Rayfield, Shuxin Lin, Nianjun Zhou, Dhaval Patel:

ReAct Meets Industrial IoT: Language Agents for Data Access. 364-382 - Jingheng Ye, Yong Jiang, Xiaobin Wang, Yinghui Li, Yangning Li, Pengjun Xie, Fei Huang:

ProductAgent: Benchmarking Conversational Product Search Agent with Asking Clarification Questions. 383-398 - Mingjin Li

, Yu Liu, Huayi Liu, Xiang Ye, Chao Jiang, Hongguang Zhang, Yu Ruan:
MADS: Multi-Agent Dialogue Simulation for Diverse Persuasion Data Generation. 399-415 - Ondrej Bohdal, Konstantinos Theodosiadis, Asterios Mpatziakas, Dimitrios Filippidis, Iro Spyrou, Christos Zonios, Anastasios Drosou, Dimosthenis Ioannidis, Kyeng-Hun Lee, Jijoong Moon, Hyeonmok Ko, Mete Ozay, Umberto Michieli:

On-device System of Compositional Multi-tasking in Large Language Models. 416-424 - Soham Shah, Kumar Shridhar:

Select-then-Route : Taxonomy guided Routing for LLMs. 425-441 - Anna Tigunova, Philipp Schmidt, Damla Ezgi Akçora:

FABRIC: Fully-Automated Broad Intent Categorization in E-commerce. 442-450 - Peng Xing, Yinghui Li, Shirong Ma, Xinnian Liang, Haojing Huang, Yangning Li, Shu-Yu Guo, Hai-Tao Zheng, Wenhao Jiang, Ying Shen:

MKT: A Multi-Stage Knowledge Transfer Framework to Mitigate Catastrophic Forgetting in Multi-Domain Chinese Spelling Correction. 451-462 - Ilya Boytsov, Vinny DeGenova, Mikhail Balyasin, Joseph Walt, Caitlin Eusden, Marie-Claire Rochat, Margaret Pierson:

End-to-End Aspect-Guided Review Summarization at Scale. 463-471 - Zhengyuan Shen, Darren Yow-Bang Wang, Soumya Smruti Mishra, Zhichao Xu, Yifei Teng, Haibo Ding:

SLOT: Structuring the Output of Large Language Models. 472-491 - Yijun Ge

, Zijian Chen, Jimmy Lin:
QuackIR: Retrieval in DuckDB and Other Relational Database Management Systems. 492-500 - Prafulla Kumar Choubey, Xiangyu Peng, Shilpa Bhagavath, Kung-Hsiang Huang, Caiming Xiong, Chien-Sheng Wu:

Benchmarking Deep Search over Heterogeneous Enterprise Data. 501-517 - Lucas Spangher, Rama Kumar Pasumarthi, Nick Masiewicki, William F. Arnold, Aditi Kaushal, Dale Johnson, Peter Grabowski, Eugene Ie:

RLHF Algorithms Ranked: An Extensive Evaluation Across Diverse Tasks, Rewards, and Hyperparameters. 518-529 - Satoshi Akasaki:

Predicting Cross-lingual Trends in Microblogs. 530-539 - Xinyi Gu, Jiayuan Mao:

Generating Fine Details of Entity Interactions. 540-563 - Davide Sanvito, Giovanni Arriciati, Giuseppe Siracusano, Roberto Bifulco, Michele Carminati

:
AutoCVSS: Assessing the Performance of LLMs for Automated Software Vulnerability Scoring. 564-575 - Fabio Mercorio, Filippo Pallucchini, Daniele Potertì, Antonio Serino, Andrea Seveso:

SFAL: Semantic-Functional Alignment Scores for Distributional Evaluation of Auto-Interpretability in Sparse Autoencoders. 576-583 - Hayate Nakano, Nobuhiro Kaji:

Just One is Enough: An Existence-based Alignment Check for Robust Japanese Pronunciation Estimation. 584-594 - Naama Zwerdling, David Boaz, Ella Rabinovich, Guy Uziel, David Amid, Ateret Anaby-Tavor:

Towards Enforcing Company Policy Adherence in Agentic Workflows. 595-606 - Nathaniel Berger, Johannes Eschbach-Dymanus, Miriam Exel, Matthias Huck, Stefan Riezler:

Learning to Translate Ambiguous Terminology by Preference Optimization on Post-Edits. 607-617 - Yike Zhao, Simin Guo, Ziqing Yang, Shifan Han, Dahua Lin, Fei Tan:

More Data or Better Data? A Critical Analysis of Data Selection and Synthesis for Mathematical Reasoning. 618-629 - Wiktor Kamzela, Mateusz Lango, Ondrej Dusek:

SRS-Stories: Vocabulary-constrained multilingual story generation for language learning. 630-645 - Xin Jie Chua, Jeraelyn Ming Li Tan, Jia Xuan Tan, Soon Chang Poh, Yi Xian Goh, Debbie Hui Tian Choong, Chee Mun Foong, Sze Jue Yang, Chee Seng Chan:

Banking Done Right: Redefining Retail Banking with Language-Centric AI. 646-658 - Daniel Schwartz, Dmitriy Bespalov, Zhe Wang, Ninad Kulkarni, Yanjun Qi:

Graph of Attacks with Pruning: Optimizing Stealthy Jailbreak Prompt Generation for Enhanced LLM Content Moderation. 659-671 - Xiaoyu Liu, Di Liang, Hongyu Shan, Peiyang Liu, Yonghao Liu, Muling Wu, Yuntao Li, Xianjie Wu, Li Miao, Jiangrong Shen, Minlong Peng:

Structural Reward Model: Enhancing Interpretability, Efficiency, and Scalability in Reward Modeling. 672-685 - Kerria Pang-Naylor, Shivani Manivasagan, Aitong Zhong, Mehak Garg, Nicholas Mondello, Blake Buckner, Jonathan P. Chang, Khyati Mahajan, Masoud Hashemi, Fabio Casati:

Controllable Clustering with LLM-driven Embeddings. 686-702 - Kadri Hacioglu, Manjunath K. E, Andreas Stolcke:

SpeechLLMs for Large-scale Contextualized Zero-shot Slot Filling. 703-715 - Md. Tawkat Islam Khondaker, Julia Harrington, Shady Shehata:

NurseLLM: The First Specialized Language Model for Nursing. 716-752 - Mengze Hong

, Chen Jason Zhang, Di Jiang, Yuanqin He:
Augmenting Compliance-Guaranteed Customer Service Chatbots: Context-Aware Knowledge Expansion with Large Language Models. 753-765 - Congzheng Song, Xinyu Tang:

Memory-Efficient Backpropagation for Fine-Tuning LLMs on Resource-Constrained Mobile Devices. 766-774 - Mohammad Kachuee, Teja Gollapudi, Minseok Kim, Yin Huang, Kai Sun, Xiao Yang, Jiaqi Wang, Nirav Shah, Yue Liu, Aaron Colak, Anuj Kumar, Wen-tau Yih, Xin Luna Dong:

PrismRAG: Boosting RAG Factuality with Distractor Resilience and Strategized Reasoning. 775-798 - Manveer Singh Tamber, Forrest Sheng Bao, Chenyu Xu, Ge Luo, Suleman Kazi, Minseok Bae, Miaoran Li, Ofer Mendelevitch, Renyi Qu, Jimmy Lin:

Benchmarking LLM Faithfulness in RAG with Evolving Leaderboards. 799-811 - Sayani Kundu, Dushyant Sahoo, Victor Li, Jennifer Rabowsky, Amit Varshney:

A Multi-Agent Framework for Quantitative Finance : An Application to Portfolio Management Analytics. 812-824 - Ishani Mondal, Jack W. Stokes, Sujay Kumar Jauhar, Longqi Yang, Mengting Wan, Xiaofeng Xu, Xia Song, Jordan Lee Boyd-Graber, Jennifer Neville:

Group Preference Alignment: Customizing LLM Responses from In-Situ Conversations Only When Needed. 825-849 - Can Cui, Yongkang Liu, Seyhan Ucar, Juntong Peng, Ahmadreza Moradipari, Maryam Khabazi, Ziran Wang:

DASR: Distributed Adaptive Scene Recognition - A Multi-Agent Cloud-Edge Framework for Language-Guided Scene Detection. 850-858 - Jean-Philippe Corbeil, Asma Ben Abacha, George Michalopoulos

, Phillip Swazinna, Miguel A. del Agua, Jérôme Tremblay, Akila Jeeson Daniel, Cari Bader, Kevin Cho, Pooja Krishnan, Nathan Bodenstab, Thomas Lin, Wenxuan Teng, François Beaulieu, Paul Vozila:
Empowering Healthcare Practitioners with Language Models: Structuring Speech Transcripts in Two Real-World Clinical Applications. 859-870 - Yajie Li, Albert Galimov, Mitra Datta Ganapaneni, Pujitha Thejaswi, De Meng, Priyanshu Kumar, Saloni Potdar:

Leveraging the Power of Large Language Models in Entity Linking via Adaptive Routing and Targeted Reasoning. 871-882 - Jyotika Singh

, Weiyi Sun, Amit Agarwal, Viji Krishnamurthy, Yassine Benajiba, Sujith Ravi, Dan Roth:
Can LLMs Narrate Tabular Data? An Evaluation Framework for Natural Language Representations of Text-to-SQL System Outputs. 883-902 - Xiran Fan, Zhimeng Jiang, Chin-Chia Michael Yeh, Yuzhong Chen, Yingtong Dou, Menghai Pan, Yan Zheng:

Enhancing Foundation Models in Transaction Understanding with LLM-based Sentence Embeddings. 903-911 - Ninad Kulkarni, Xian Wu, Siddharth Varia, Dmitriy Bespalov:

Agent vs. Agent: Automated Data Generation and Red-Teaming for Custom Agentic Workflows. 912-936 - Soham Satyadharma

, Fatemeh Sheikholeslami, Swati Kaul, Aziz Umit Batur, Suleiman Ali Khan:
Auto prompting without training labels: An LLM cascade for product quality assessment in e-commerce catalogs. 937-953 - Xujun Peng, Anoop Kumar, Jingyu Wu, Parker Glenn, Daben Liu:

Harmonizing Diverse Models: A Layer-wise Merging Strategy for Consistent Generation. 954-962 - Subin An, Yugyeong Ji, Junyoung Kim, Heejin Kook, Yang Lu, Josh Seltzer:

Transparent Reference-free Automated Evaluation of Open-Ended User Survey Responses. 963-982 - Ruizhe Chen, Tianze Luo, Zhiting Fan, Heqing Zou, Zhaopeng Feng, Guiyang Xie, Hansheng Zhang, Zhuochen Wang, Zuozhu Liu, Huaijian Zhang:

Datasets and Recipes for Video Temporal Grounding via Reinforcement Learning. 983-992 - Yuheng Zou, Yiran Wang, Yuzhu Tian, Min Zhu, Yanhua Huang:

SEARA: An Automated Approach for Obtaining Optimal Retrievers. 993-1006 - Zhendong Chu

, Jian Xie, Shen Wang, Zichao Wang, Qingsong Wen:
UniEDU: Toward Unified and Efficient Large Multimodal Models for Educational Tasks. 1007-1016 - Mohammad Anas Azeez, Rafiq Ali

, Ebad Shabbir, Zohaib Hasan Siddiqui, Gautam Siddharth Kashyap
, Jiechao Gao, Usman Naseem
:
Truth, Trust, and Trouble: Medical AI on the Edge. 1017-1025 - Gokul Swamy, Aman Gulati, Srinivas Virinchi, Anoop Saladi:

An Address Intelligence Framework for E-commerce Deliveries. 1026-1034 - Zohaib Hasan Siddiqui, Jiechao Gao, Ebad Shabbir, Mohammad Anas Azeez, Rafiq Ali

, Gautam Siddharth Kashyap
, Usman Naseem
:
LLMs on a Budget? Say HOLA. 1035-1043 - Zhiyu Chen, Biancen Xie, Sidarth Srinivasan, Manikandarajan Ramanathan, Rajashekar Maragoud, Qun Liu:

LLM-Based Dialogue Labeling for Multiturn Adaptive RAG. 1044-1056 - Ian Poey, Jiajun Liu, Qishuai Zhong

:
RAGulator: Lightweight Out-of-Context Detectors for Grounded Text Generation. 1057-1071 - Ziji Zhang, Michael Yang, Zhiyu Chen, Yingying Zhuang, Shu-Ting Pi, Qun Liu, Rajashekar Maragoud, Vy Nguyen, Anurag Beniwal:

REIC: RAG-Enhanced Intent Classification at Scale. 1072-1080 - Wen-Kwang Tsao, Yao-Ching Yu, Chien-Ming Huang:

Mapping Smarter, Not Harder: A Test-Time Reinforcement Learning Agent That Improve Without Labels or Model Updates. 1081-1091 - Sujatha Das Gollapalli, Mouad Hakam, Mingzhe Du, See-Kiong Ng, Mohammed Hamzeh:

On Assigning Product and Software Codes to Customer Service Requests with Large Language Models. 1092-1103 - Zixuan Wang

, Yu Sun
, Hongwei Wang, Baoyu Jing, Xiang Shen, Xin Dong, Zhuolin Hao
, Hongyu Xiong, Yang Song:
Reasoning-Enhanced Domain-Adaptive Pretraining of Multimodal Large Language Models for Short Video Content Governance. 1104-1112 - Haiyang Yang, Qinye Xie, Qingheng Zhang, Chen Li Yu, Huike Zou, Chengbao Lian, Shuguang Han, Fei Huang, Jufeng Chen, Bo Zheng:

GSID: Generative Semantic Indexing for E-Commerce Product Understanding. 1113-1121 - Yingxue Zhou, Tan Zhu, Tao Zeng, Zigeng Wang, Wei Shen:

Learning from LLM Agents: In-Context Generative Models for Text Casing in E-Commerce Ads. 1122-1133 - Yuki Ichihara, Yuu Jinnai:

Auto-Weighted Group Relative Preference Optimization for Multi-Objective Text Generation Tasks. 1134-1147 - Asier Gutiérrez-Fandiño, Jorge Yero Salazar, Clement Ruin, Alejandro Quintero Roba, Shangeetha Ravichandran, Jesus Perez-Martin, Pankaj Adsul, Suruchi Garg, Leonardo Lezcano:

Cost-Effective E-Commerce Catalog Translation at Scale Ensuring Named Entity Protection. 1148-1157 - Myeongjun Erik Jang

, Fran Silavong:
InstaJudge: Aligning Judgment Bias of LLM-as-Judge with Humans in Industry Applications. 1158-1172 - Sunwoo Lee, Daseong Jang, Dhammiko Arya, Gyoung-eun Han, Injee Song, SaeRom Kim, Sangjin Kim, Seojin Lee, Seokyoung Hong, Sereimony Sek, Seung-Mo Cho, Sohee Park, Sungbin Yoon, Wonbeom Jang, Eric Davis:

TelAgentBench: A Multi-faceted Benchmark for Evaluating LLM-based Agents in Telecommunications. 1173-1211 - Islam Nassar, Yang Lin, Yuan Jin, Rongxin Zhu, Chang Wei Tan, Zenan Zhai, Nitika Mathur, Thanh Tien Vu, Xu Zhong, Long Duong, Yuan-Fang Li:

Taming the Real-world Complexities in CPT E/M Coding with Large Language Models. 1212-1226 - Thomas Gschwind, Shramona Chakraborty, Nitin Gupta, Sameep Mehta:

Classifier-Augmented Generation for Structured Workflow Prediction. 1227-1238 - Vera Pavlova, Mohammed Makhlouf:

Efficient and Versatile Model for Multilingual Information Retrieval of Islamic Text: Development and Deployment in Real-World Scenarios. 1239-1249 - Xiaochong Lan, Jie Feng, Yinxing Liu, Xinleishi, Yong Li:

AutoQual: An LLM Agent for Automated Discovery of Interpretable Features for Review Quality Assessment. 1250-1264 - Sarel Duanis, Asnat Greenstein-Messica, Eliya Habba:

JSON Whisperer: Efficient JSON Editing with LLMs. 1265-1274 - Jiyong Li, Dilshod Azizov, Shangsong Liang:

L4: Mutual Learning Helps Lifelong Language Learning. 1275-1286 - Chetan Sharma, Ramasuri Narayanam, Soumyabrata Pal, Kalidas Yeturu, Shiv Kumar Saini, Koyel Mukherjee:

TTD-SQL: Tree-Guided Token Decoding for Efficient and Schema-Aware SQL Generation. 1287-1298 - Kawin Mayilvaghanan, Siddhant Gupta, Ayush Kumar:

Spot the BlindSpots: Systematic Identification and Quantification of Fine-Grained LLM Biases in Contact Center Call Summarization. 1299-1340 - Ziheng Ni, Congcong Liu, Yuying Chen, Zhiwei Fang, Changping Peng, Zhangang Lin, Ching Law, Jingping Shao:

HierDiffuse: Progressive Diffusion for Robust Interest Fusion in CTR Prediction. 1341-1348 - Savini Kashmira, Jayanaka L. Dantanarayana, Joshua Brodsky, Ashish Mahendra, Yiping Kang, Krisztián Flautner, Lingjia Tang, Jason Mars:

TOBUGraph: Knowledge Graph-Based Retrieval for Enhanced LLM Performance Beyond RAG. 1349-1356 - Wenrui Cai, Chengyu Wang, Junbing Yan, Jun Huang, Xiangzhong Fang:

Thinking with DistilQwen: A Tale of Four Distilled Reasoning and Reward Model Series. 1357-1365 - Elena Senger, Yuri Campbell, Rob van der Goot, Barbara Plank:

Crossing Domains without Labels: Distant Supervision for Term Extraction. 1366-1378 - Aniket Joshi, Cyrus Andre DSouza

, Sejal Jain, Jitenkumar Babubhai Rana, Promod Yenigalla:
I-SEE: An Instruction-tuned, SOP-Enhanced Quality Evaluator for Product Content. 1379-1388 - Jeong-Hoon Kim, Jinwoo Nam, GeunSik Jo:

Computational Blueprints: Generating Isomorphic Mathematics Problems with Large Language Models. 1389-1401 - Soumick Sarker, Abhijit Kumar Rai:

Fin-ExBERT: User Intent based Text Extraction in Financial Context using Graph-Augmented BERT and trainable Plugin. 1402-1411 - Yongqi Leng, Yikun Lei, Xikai Liu, Meizhi Zhong, Bojian Xiong, Yurong Zhang, Yan Gao, Yi Wu, Yao Hu, Deyi Xiong:

DecEx-RAG: Boosting Agentic Retrieval-Augmented Generation with Decision and Execution Optimization via Process Supervision. 1412-1425 - Evelyn Duesterwald, Siyu Huo, Vatche Isahagian, K. R. Jayaram, Ritesh Kumar, Vinod Muthusamy, Punleuk Oum, Debashish Saha, Gegi Thomas, Praveen Venkateswaran:

FLOW-BENCH: Towards Conversational Generation of Enterprise Workflows. 1426-1436 - Seungseop Lim, Gibaeg Kim, Wooseok Han, Jean Seo, Hyunkyung Lee, Jaehyo Yoo, Eunho Yang:

Format Inertia: A Failure Mechanism of LLMs in Medical Pre-Consultation. 1437-1450 - Jakub Piskorski, Dominik Skotarczak:

Extraction of Information Provision Activity Requirements from EU Acquis. 1451-1471 - Anastasia Zhukova

, Jonas Lührs, Christian E. Lobmüller, Bela Gipp:
Contrastive Learning Using Graph Embeddings for Domain Adaptation of Language Models in the Process Industry. 1472-1484 - Karen Zhou, John Michael Giorgi, Pranav Mani, Peng Xu, Davis Liang, Chenhao Tan:

From Feedback to Checklists: Grounded Evaluation of AI-Generated Clinical Notes. 1485-1499 - Karan Dua, Hitesh Laxmichand Patel, Puneet Mittal, Ranjeet Gupta, Amit Agarwal, Praneet Pabolu, Srikant Panda, Hansa Meghwani, Graham Horwood, Fahad Shah:

FlexDoc: Parameterized Sampling for Diverse Multilingual Synthetic Documents for Training Document Understanding Models. 1500-1521 - Jisoo Lee, Raeyoung Chang, Dongwook Kwon, Harmanpreet Singh, Nikhil Verma:

GEMMAS: Graph-based Evaluation Metrics for Multi Agent Systems. 1522-1532 - Longpeng Qiu, Ting Li, Shuai Mao, Nan Yang, Xiaohui Yan:

Knowledge-Augmented Question Error Correction for Chinese Question Answer System with QuestionRAG. 1533-1542 - Karan Malhotra, Arihant Jain, Purav Aggarwal, Anoop Saladi:

SMART: Scalable Multilingual Approach for a Robust TOD System. 1543-1554 - Bojian Xiong, Yikun Lei, Xikai Liu, Shaowei Zhang, Pengyun Zhu

, Yan Liu, Yongqi Leng, Ling Shi, Meizhi Zhong, Yurong Zhang, Yan Gao, Yi Wu, Yao Hu, Deyi Xiong:
Think-Search-Patch: A Retrieval-Augmented Reasoning Framework for Repository-Level Code Repair. 1555-1566 - Victor Junqiu Wei

, Weicheng Wang, Di Jiang, Yuanfeng Song, Lu Wang:
ASR-EC Benchmark: Evaluating Large Language Models on Chinese ASR Error Correction. 1567-1575 - Muhammad Rafsan Kabir, Jawad Ibn Ahad, Robin Krambroeckers, Silvia Ahmed, Mirza M. Lutfe Elahi

, Nabeel Mohammed, Shafin Rahman:
Bidirectional Reasoning Supervision for Multilingual Financial Decision Making. 1576-1587 - Dang Van Thin, Cuong Xuan Chu, Christian Graf, Tobias Kaminski, Trung-Kien Tran:

Automotive Document Labeling Using Large Language Models. 1588-1595 - Nan Li, Bo Kang, Tijl De Bie:

Building Data-Driven Occupation Taxonomies: A Bottom-Up Multi-Stage Approach via Semantic Clustering and Multi-Agent Collaboration. 1596-1614 - Luca Gioacchini, Alexander Delsanto, Idilio Drago, Marco Mellia, Giuseppe Siracusano, Roberto Bifulco:

AutoPenBench: A Vulnerability Testing Benchmark for Generative Agents. 1615-1624 - Yufei He, Ruoyu Li, Alex Chen, Yue Liu, Yulin Chen, Yuan Sui, Cheng Chen, Yi Zhu, Luca Luo, Frank Yang, Bryan Hooi:

Enabling Self-Improving Agents to Learn at Test Time With Human-In-The-Loop Guidance. 1625-1653 - Zhiwei Li, Yong Hu, Wenqing Wang:

Encouraging Good Processes Without the Need for Good Answers: Reinforcement Learning for LLM Agent Planning. 1654-1666 - Marco Zocca, Per Fallgren, David Buffoni:

Experience Report: Implementing Machine Translation in a Regulated Industry. 1667-1673 - Junyi Zhu, Savas Özkan, Andrea Maracani, Sinan Mutlu, Cho Jung Min, Mete Ozay:

Multi-Task Pre-Finetuning of Lightweight Transformer Encoders for Text Classification and NER. 1674-1686 - Kayhan Behdin, Ata Fatahi Baarzi, Qingquan Song, Yun Dai, Aman Gupta, Zhipeng Wang, Hejian Sang, Shao Tang, Gregory Dexter, Sirou Zhu, Siyu Zhu, Tejas Dharamsi, Vignesh Kothapalli, Zhoutong Fu, Yihan Cao, Pin-Lun Hsu, Fedor Borisyuk, Natesh S. Pillai, Luke Simon, Rahul Mazumder:

Scaling Down, Serving Fast: Compressing and Deploying Efficient LLMs for Recommendation Systems. 1687-1702 - Shramona Chakraborty, Shashank Mujumdar, Nitin Gupta, Sameep Mehta, Ronen Kat, Itay Etelis, Mohamed Mahameed, Itai Guez, Rachel Tzoref-Brill:

Group, Embed and Reason: A Hybrid LLM and Embedding Framework for Semantic Attribute Alignment. 1703-1710 - Prajwal Sood, Rajdeep Agrawal, Mayank Sati, Digvijay Ingle, Cijo George:

STREAQ: Selective Tiered Routing for Effective and Affordable Contact Center Quality Assurance. 1711-1726 - Kiran Pradeep, Kirushikesh D. B., Nishtha Madaan, Sameep Mehta, Pushpak Bhattacharyya:

Divide, Link, and Conquer: Recall-oriented Schema Linking for NL-to-SQL via Question Decomposition. 1727-1743 - Elham Khabiri, Jeffrey O. Kephart, Fenno F. Terry Heath III, Srideepika Jayaraman, Yingjie Li, Fateh Tipu, Dhruv Shah, Achille Fokoue, Anuradha Bhamidipaty:

Declarative Techniques for NL Queries over Heterogeneous Data. 1744-1761 - Jean Seo, Hyunkyung Lee, Gibaeg Kim, Wooseok Han, Jaehyo Yoo, Seungseop Lim, Kihun Shin, Eunho Yang:

Taxonomy of Comprehensive Safety for Clinical Agents. 1762-1779 - Andrei Niculae

, Adrian Cosma, Cosmin Dumitrache, Emilian Radoi:
Dr. Copilot: A Multi-Agent Prompt Optimized Assistant for Improving Patient-Doctor Communication in Romanian. 1780-1792 - Ervine Zheng, Yikuan Li

, Geoffrey J. Tso, Jilong Kuang:
Data-Efficient Automatic Prompt Optimization for Memory-Enhanced Conversational Agents. 1793-1804 - Vladimir Shaposhnikov, Alexandr Nesterov, Ilia Kopanichuk, Ivan Bakulin, Egor Zhelvakov, Ruslan Abramov, Ekaterina Tsapieva, Iaroslav Bespalov, Dmitry V. Dylov, Ivan V. Oseledets:

CLARITY: Clinical Assistant for Routing, Inference, and Triage. 1805-1821 - Spandan Anaokar, Shrey Ganatra, Harshvivek Kashid, Swapnil Bhattacharyya, Shruthi Nair, Reshma Sekhar, Siddharth Manohar, Rahul Hemrajani, Pushpak Bhattacharyya:

HalluDetect: Detecting, Mitigating, and Benchmarking Hallucinations in Conversational Systems in the Legal Domain. 1822-1847 - Xiliang Zhu, Shi Zong, David Rossouw:

How Accurate Are LLMs at Multi-Question Answering on Conversational Transcripts? 1848-1855 - Md. Tahmid Rahman Laskar, Julien Bouvier Tremblay, Xue-Yong Fu, Cheng Chen, Shashi Bhushan TN:

AI Knowledge Assist: An Automated Approach for the Creation of Knowledge Bases for Conversational AI Agents. 1856-1866 - Elena Khasanova, Harsh Saini, Md. Tahmid Rahman Laskar, Xue-Yong Fu, Cheng Chen, Shashi Bhushan TN:

DACIP-RC: Domain Adaptive Continual Instruction Pre-Training via Reading Comprehension on Business Conversations. 1867-1877 - João Vitor Mariano Correia, Murilo Missano Bell

, João Vitor Robiatti Amorim, Jonas F. P. Queiroz
, Daniel C. G. Pedronette, Ivan Rizzo Guilherme, Felipe L. Oliveira:
Analysis of Automated Document Relevance Annotation for Information Retrieval in Oil and Gas Industry. 1878-1889 - Vashu Chauhan, Shobhit Raj, Shashank Mujumdar, Avirup Saha, Anannay Jain:

Mind the Query: A Benchmark Dataset towards Text2Cypher Task. 1890-1905 - Md. Tahmid Rahman Laskar, Mohammed Saidul Islam

, Ridwan Mahbub, Mizanur Rahman, Amran Bhuiyan, Israt Jahan, Mir Tafseer Nayeem, Shafiq Joty, Enamul Hoque
, Jimmy Huang:
Deploying Tiny LVLM Judges for Real-World Evaluation of Chart Models: Lessons Learned and Best Practices. 1906-1918 - Cen Mia Zhao, Tiantian Zhang, Hanchen Su, Yufeng Wayne Zhang, Shaowei Su, Mingzhi Xu, Yu Liu, Wei Han, Jeremy Werner, Claire Na Cheng, Yashar Mehdad:

Agent-in-the-Loop: A Data Flywheel for Continuous Improvement in LLM-based Customer Support. 1919-1930 - Fangyi Yu, Nabeel Seedat, Drahomira Herrmannova, Frank Schilder, Jonathan Richard Schwarz:

Beyond Pointwise Scores: Decomposed Criteria-Based Evaluation of LLM Responses. 1931-1954 - Anup Pattnaik, Sasanka Vutla, Hamvir Dev, Jeevesh Nandan, Cijo George:

Scalable and Cost Effective High-Cardinality Classification with LLMs via Multi-View Label Representations and Retrieval Augmentation. 1955-1969 - Anh C. Pham, Mihir Thalanki, Michael Sun, Aditya Chaloo, Ankita Gupta, Tian Xia, Aditya Mate, Ehi Nosakhare, Soundararajan Srinivasan:

How to Fine-Tune Safely on a Budget: Model Adaptation Using Minimal Resources. 1970-1981 - Aman Goel, Daniel Schwartz, Yanjun Qi:

Zero-knowledge LLM hallucination detection and mitigation through fine-grained cross-model consistency. 1982-1999 - Yisha Wu, Cen Mia Zhao, Yuanpei Cao, Xiaoqing Xu, Yashar Mehdad, Mindy Ji, Claire Na Cheng:

Incremental Summarization for Customer Support via Progressive Note-Taking and Agent Feedback. 2000-2015 - Weizhi Zhang, Liangwei Yang, Wooseong Yang, Henry Peng Zou, Yuqing Liu, Ke Xu, Sourav Medya, Philip S. Yu:

LLMInit: A Free Lunch from Large Language Models for Selective Initialization of Recommendation. 2016-2024 - Mateusz Lango, Ondrej Dusek:

LLM Agents Implement an NLG System from Scratch: Building Interpretable Rule-Based RDF-to-Text Generators. 2025-2040 - João D. S. Marques, André V. Duarte, André Mendes Marques de Carvalho, Gil Rocha

, Bruno Martins, Arlindo L. Oliveira:
Leveraging LLMs to Streamline the Review of Public Funding Applications. 2041-2060 - Hui Yi Leong, Yuheng Li, Yuqing Wu, Wenwen Ouyang, Wei Zhu, Jiechao Gao, Wei Han:

AMAS: Adaptively Determining Communication Topology for LLM-based Multi-agent System. 2061-2070 - Ahmed Masry, Megh Thakkar, Patrice Béchard, Sathwik Tejaswi Madhusudhan, Rabiul Awal, Shambhavi Mishra, Akshay Kalkunte Suresh, Srivatsava Daruru, Enamul Hoque

, Spandana Gella, Torsten Scholak, Sai Rajeswar:
ColMate: Contrastive Late Interaction and Masked Text for Multimodal Document Retrieval. 2071-2080 - Jiaxin Zhang:

Confidence-Aware Reasoning: Optimizing Self-Guided Thinking Trajectories in Large Reasoning Models. 2081-2095 - Huike Zou, Haiyang Yang, Yindu Su, Chen Li Yu, Qinye Xie, Chengbao Lian, Qingheng Zhang, Shuguang Han, Fei Huang, Jufeng Chen:

Multi-Value-Product Retrieval-Augmented Generation for Industrial Product Attribute Value Identification. 2096-2105 - Yunhan Huang, Klevis Ramo, Andrea Iovine, Melvin Monteiro, Sedat Gokalp, Arjun Bakshi

, Hasan Turalic, Arsh Kumar, Jona Neumeier, Ripley Yates, Rejaul Monir, Simon Hartmann, Tushar Manglik, Mohamed Yakout:
AttributeForge: An Agentic LLM Framework for Automated Product Schema Modeling. 2106-2121 - Tanmana Sadhu, Yanan Chen, Ali Pesaranghader:

VestaBench: An Embodied Benchmark for Safe Long-Horizon Planning Under Multi-Constraint and Adversarial Settings. 2122-2145 - Qi Gou, Zehua Xia, Juan Li, Qingyang Zhao, Wenjing Yang:

Advancing E-commerce Merchants Telemarketing with Synthetic Data-Driven LLMs. 2146-2154 - Xiaochong Lan, Zhiguang Han, Yiming Cheng, Li Sheng, Jie Feng, Chen Gao, Yong Li:

Depression Detection on Social Media with Large Language Models. 2155-2171 - Kanishk Verma, Sri Balaaji Natarajan Kalaivendan, Arefeh Kazemi, Joachim Wagner, Darragh McCashin, Isobel Walsh, Sayani Basak, Sinan Asçi, Yelena Cherkasova, Alexandrous Poullis, James O'Higgins Norman, Rebecca Umbach, Tijana Milosevic, Brian Davis

:
BullyBench: Youth & Experts-in-the-loop Framework for Intrinsic and Extrinsic Cyberbullying NLP Benchmarking. 2172-2208 - Anwesan Pal, Karen Hovsepian, Tinghao Guo, Mengnan Zhao, Somendra Tripathi, Nikos Kanakaris, George Mihaila, Sumit Nigam:

Tagging-Augmented Generation: Assisting Language Models in Finding Intricate Knowledge In Long Contexts. 2209-2220 - Joachim Daiber, Victor Maricato, Ayan Sinha, Andrew Rabinovich:

DispatchQA: A Benchmark for Small Function Calling Language Models in E-Commerce Applications. 2221-2233 - Christodoulos Constantinides, Shuxin Lin, Dhaval C. Patel:

Generalized Embedding Models for Industry 4.0 Applications. 2234-2251 - Maryam Dialameh, Rezaul Karim, Hossein Rajabzadeh, Omar Mohamed Awad, Boxing Chen, Hyock Ju Kwon, Walid Ahmed, Yang Liu:

ECHO-LLaMA: Efficient Caching for High-Performance LLaMA Training. 2252-2269 - Steve Bakos, Chen Xing, Heidar Davoudi, Aijun An

, Ron DiCarlantonio:
Generating Spatial Knowledge Graphs from Automotive Diagrams for Question Answering. 2270-2286 - Shinnosuke Nozue, Yuto Nakano, Yotaro Watanabe, Meguru Takasaki, Shoji Moriya, Reina Akama, Jun Suzuki:

Enhancing Persuasive Dialogue Agents by Synthesizing Cross-Disciplinary Communication Strategies. 2287-2312 - Sanya A. Chetwani, Jaseem Mahmmdla:

BIOPSY - Biomarkers In Oncology: Pipeline for Structured Yielding. 2313-2321 - Yi Shen

, Jian Zhang, Jieyun Huang
, Shuming Shi, Wenjing Zhang, Jiangze Yan
, Ning Wang, Kai Wang, Zhaoxiang Liu, Shiguo Lian:
DAST: Difficulty-Adaptive Slow-Thinking for Large Reasoning Models. 2322-2331 - Han Zhang, Yunjiang Jiang, Mingming Li, Haowei Yuan

, Yiming Qiu
, Wen-Yun Yang:
pEBR: A Probabilistic Approach to Embedding Based Retrieval. 2332-2342 - Yohan Lee

, Yongwoo Song, Sangyeop Kim:
Finding Diamonds in Conversation Haystacks: A Benchmark for Conversational Data Retrieval. 2343-2366 - Sachin Kumar Giroh, Pushpendu Ghosh, Aryan Jain, Harshal Giridhari Paunikar, Aditi Rastogi, Promod Yenigalla, Anish Nediyanchath:

SYNTACT>: Structuring Your Natural Language SOPs into Tailored Ambiguity-Resolved Code Templates. 2367-2376 - Devleena Das, Rajeev Patwari, Ashish Sirasao:

Recover-LoRA: Data-Free Accuracy Recovery of Degraded Language Models via Low-Rank Adaptation. 2377-2386 - Seonwu Kim, Yohan Na, Kihun Kim, Hanhee Cho, Geun Lim, Mintae Kim, Seongik Park, Ki Hyun Kim, Youngsub Han, Byoung-Ki Jeon:

ixi-GEN: Efficient Industrial sLLMs through Domain Adaptive Continual Pretraining. 2387-2404 - Himanshu Dutta, Sunny Manchanda, Prakhar Bapat, Meva Ram Gurjar, Pushpak Bhattacharyya:

GRAFT: A Graph-based Flow-aware Agentic Framework for Document-level Machine Translation. 2405-2428 - Satyam Shukla, Himanshu Dutta, Pushpak Bhattacharyya:

Recon, Answer, Verify: Agents in Search of Truth. 2429-2448 - Vignesh Ethiraj, Ashwath David, Sidhanth Menon, Divya Vijay, Vidhyakshaya Kannan:

T-VEC: A Telecom-Specific Vectorization Model with Enhanced Semantic Understanding via Deep Triplet Loss Fine-Tuning. 2449-2460 - He Zhu, Junyou Su, Minxin Chen, Wen Wang, Yijie Deng, Guanhua Chen, Wenjia Zhang:

PlanGPT-VL: Enhancing Urban Planning with Domain-Specific Vision-Language Models. 2461-2483 - Aosong Feng, Balasubramaniam Srinivasan, Yun Zhou, Zhichao Xu, Kang Zhou, Sheng Guan, Yueyan Chen, Xian Wu, Ninad Kulkarni, Yi Zhang, Zhengyuan Shen, Dmitriy Bespalov, Soumya Smruti Mishra, Yifei Teng, Darren Yow-Bang Wang, Haibo Ding, Lin Lee Cheong:

IPR: Intelligent Prompt Routing with User-Controlled Quality-Cost Trade-offs. 2484-2498 - Duncan Soiffer, Steven Kolawole, Virginia Smith:

Semantic Agreement Enables Efficient Open-Ended LLM Cascades. 2499-2537 - Haotan Guo, Jianfei He, Jiayuan Ma, Hongbin Na, Zimu Wang, Haiyang Zhang, Qi Chen, Wei Wang, Zijing Shi, Tao Shen, Ling Chen:

Lost in Pronunciation: Detecting Chinese Offensive Language Disguised by Phonetic Cloaking Replacement. 2538-2550 - Jinhyeong Lim, Jeongwan Shin, Seeun Lee, Seongdeok Kim, Joungsu Choi, Jongbae Kim, Chun Hwan Jung, Youjin Kang:

Distilling Cross-Modal Knowledge into Domain-Specific Retrievers for Enhanced Industrial Document Understanding. 2551-2563 - André Melo, Enting Chen, Pavlos Vougiouklis, Chenxin Diao, Shriram Piramanayagam, Ruofei Lai, Jeff Z. Pan:

Don't Forget the Base Retriever! A Low-Resource Graph-based Retriever for Multi-hop Question Answering. 2564-2572 - Yi Zhang

, Kai Zhang, Zheyang Li, Wenming Tan, Ye Ren, Jilin Hu:
Beyond Dynamic Quantization: An Efficient Static Hierarchical Mix-precision Framework for Near-Lossless LLM Compression. 2573-2587 - Shashank Kirtania, Naman Gupta, Priyanshu Gupta, Sumit Gulwani, Arun Iyer

, Suresh Parthasarathy Iyengar, Arjun Radhakrishna, Sriram K. Rajamani, Gustavo Soares:
STACKFEED: Structured Textual Actor-Critic Knowledge base editing with FEEDback. 2588-2606 - Yuya Sawada, Hiroki Ouchi, Yuichiro Yasui, Hiroki Teranishi, Yuji Matsumoto, Taro Watanabe, Masayuki Ishii:

JaCorpTrack: Corporate History Event Extraction for Tracking Organizational Changes. 2607-2623 - Erxue Min, Hsiu-Yuan Huang, Xihong Yang, Min Yang, Xin Jia, Yunfang Wu, Hengyi Cai, Junfeng Wang, Shuaiqiang Wang, Dawei Yin:

CTR-Guided Generative Query Suggestion in Conversational Search. 2624-2634 - Egor Fadeev, Dzhambulat Mollaev, Aleksei Shestov, Dima Korolev, Omar Zoloev, Ivan Kireev, Andrey V. Savchenko, Maksim Makarenko:

LATTE: Learning Aligned Transactions and Textual Embeddings for Bank Clients. 2635-2647 - Fei Zhao, Chonggang Lu, Wangyue, Zheyong Xie, Ziyan Liu, Haofu Qian, Jianzhao Huang, Fangcheng Shi, Zijie Meng, Hongcheng Guo, Mingqian He, Xinze Lyu, Zheyu Ye, Weiting Liu, Boyang Wang, Shaosheng Cao:

RedOne: Revealing Domain-specific LLM Post-Training in Social Networking Services. 2648-2674 - Chengze Ge, Yu Xu, Qi Shao, Shengping Liu:

High-Quality Medical Dialogue Synthesis for Improving EMR Generation. 2675-2687 - Zhaojian Yu, Yinghao Wu, Yilun Zhao, Arman Cohan, Xiao-Ping Zhang:

Z1: Efficient Test-time Scaling with Code. 2688-2712 - Ashlesha Akella, Akshar Kaul, Krishnasuri Narayanam

, Sameep Mehta:
Quality Assessment of Tabular Data using Large Language Models and Code Generation. 2713-2748 - Anubhav Shrimal, Aryan Jain, Soumyajit Chowdhury, Promod Yenigalla:

PARSE: LLM Driven Schema Optimization for Reliable Entity Extraction. 2749-2763 - Xiangfeng Wang, Xiao Li, Yadong Wei, Xueyu Song, Yang Song, Xiaoqiang Xia, Fangrui Zeng, Zaiyi Chen, Liu Liu, Gu Xu, Tong Xu:

From Long Videos to Engaging Clips: A Human-Inspired Video Editing Framework with Multimodal Narrative Understanding. 2764-2781 - Zhiyuan Peng, Ting-Ruen Wei, Tingyu Song, Yilun Zhao:

Efficiency-Effectiveness Reranking FLOPs for LLM-based Rerankers. 2782-2791 - Niloufar Beyranvand, Hamidreza Dastmalchi, Aijun An

, Heidar Davoudi, Winston Chan, Ron DiCarlantonio:
GEAR: A Scalable and Interpretable Evaluation Framework for RAG-Based Car Assistant Systems. 2792-2810 - Sanghyun Seo, Bumsoo Kang, Dahm Lee, Jaeheon Kim, Joongbo Shin, Euisoon Kim, Kijeong Jeon:

FQ-Eval: Building Evaluation Dataset for User-centered Follow-up Question Generation. 2811-2827 - Divij Chawla, Ashita Bhutada, Duc Anh Do, Abhinav Raghunathan, Vinod SP, Cathy Guo, Dar Win Liew, Prannaya Gupta, Rishabh Bhardwaj, Rajat Bhardwaj, Soujanya Poria:

Evaluating AI for Finance: Is AI Credible at Assessing Investment Risk Appetite? 2828-2839 - Md. Ismail Hossain, Shahriyar Zaman Ridoy

, Moshiur Farazi, Nabeel Mohammed, Shafin Rahman:
CAPSTONE: Composable Attribute-Prompted Scene Translation for Zero-Shot Vision-Language Reasoning. 2840-2851 - Hojun Cho

, Donghu Kim, Soyoung Yang, Chan Lee, Hunjoo Lee, Jaegul Choo:
Building Resource-Constrained Language Agents: A Korean Case Study on Chemical Toxicity Information. 2852-2880 - Nafew Azim, Abrar Ur Alam, Hasan Bin Omar, Abdullah Mohammad Muntasir Adnan Jami, Jawad Ibn Ahad, Muhammad Rafsan Kabir, Md. Ismail Hossain, Fuad Rahman, Mohammad Ruhul Amin, Shafin Rahman, Nabeel Mohammed:

AutoDSPy: Automating Modular Prompt Design with Reinforcement Learning for Small and Large Language Models. 2881-2896 - Maryam Fatima:

A Proactive Reliability Metric for Detecting Failures in Language Model Training. 2897-2913

manage site settings
To protect your privacy, all features that rely on external API calls from your browser are turned off by default. You need to opt-in for them to become active. All settings here will be stored as cookies with your web browser. For more information see our F.A.Q.


Google
Google Scholar
Semantic Scholar
Internet Archive Scholar
CiteSeerX
ORCID













