


default search action
64th ACL 2026: San Diego, California, USA - Short Papers
- Maria Liakata, Viviane P. Moreira, Jiajun Zhang, David Jurgens:

Proceedings of the 64th Annual Meeting of the Association for Computational Linguistics (Volume 2: Short Papers), ACL 2026, San Diego, California, United States, July 2-7, 2026. Association for Computational Linguistics 2026, ISBN 979-8-89176-391-3 - Frontmatter.

- Zheng Gong, Ying Sun, Ping Li, Yi Zheng, Zhefeng Wang:

Punctuation-Steered Representation Fine-Tuning. 1-8 - Sho Hoshino, Ukyo Honda, Peinan Zhang:

Does Self-Consistency Improve the Recall of Encyclopedic Knowledge? 9-17 - Guy Yariv, Idan Schwartz, Yossi Adi, Sagie Benaim:

LaMI: Augmenting Large Language Models via Late Multi-Image Fusion. 18-26 - Guan-Ting Lin, Shih-Yun Shan Kuan, Jiatong Shi, Kai-Wei Chang, Siddhant Arora, Shinji Watanabe, Hung-Yi Lee:

Full-Duplex-Bench-v2: A Multi-Turn Evaluation Framework for Duplex Dialogue Systems with an Automated Examiner. 27-36 - Junjie Wu, Jiangnan Li, Yuqing Li, Lemao Liu, Liyan Xu, Jiwei Li, Dit-Yan Yeung, Jie Zhou, Mo Yu:

Situated Embedding Models for Context-Aware Dense Retrieval. 37-49 - Steven Bird:

Big AI is Accelerating the Metacrisis: What Can We Do? 50-61 - Daohuan Liu, Xia Lun, Yuer Wang, Jiaoyang Su, Xuri Tang:

From Factuality to Meta-Factivity: A Cognitive Blueprint for Trustworthy LLMs. 62-69 - Yuval Ran-Milo:

Attention Sinks Are Provably Necessary in Softmax Transformers: Evidence from Trigger-Conditional Tasks. 70-89 - Yuval Ran-Milo, Hila Ofek, Shahar Mendel:

A Mechanistic Account of Attention Sinks in GPT-2: One Circuit, Broader Implications for Mitigation. 90-98 - Mateusz Klimaszewski, Piotr Andruszkiewicz:

Is a Document Educational or Just Wikipedia-Style? - Pitfalls of Classifier-Based Quality Filtering. 99-108 - Aleksandar Fontana, Marco Simoni, Giulio Rossolini, Paolo Mori, Andrea Saracino:

On the Hidden Objective Biases of Group-based Reinforcement Learning. 109-121 - Buqiang Xu, Yijun Chen, Jizhan Fang, Ruobin Zhong, Yunzhi Yao, Yuqi Zhu, Lun Du, Shumin Deng:

StructMem: Structured Memory for Long-Horizon Behavior in LLMs. 122-146 - Nikita Drozdov, Andrey Lemeshko, Nikita Gavrilov, Anton Konushin, Danila Rukhovich, Maksim Kolodiazhnyi:

Z3D: Zero-Shot 3D Visual Grounding from Images. 147-154 - Gongbo Zhang, Yifan Peng, Chunhua Weng:

Improving Retrieval-Augmented Generation without Taxonomy-based Error Categorization. 155-165 - Zixi Zhang, Zhiwen Mo, Yiren Zhao, Robert D. Mullins:

Deep Kernel Fusion for Transformers. 166-173 - Hillary N. Owusu, Naomi H. Feldman:

Anchoring Depends on Confidence and Post-Training in Language Models. 174-180 - Paolo Gajo, Domenic Rosati, Hassan Sajjad, Alberto Barrón-Cedeño:

LLMs Underperform Graph-Based Parsers on Supervised Relation Extraction for Complex Graphs. 181-193 - Immanuel Abdi, Akshat Gupta, Micah Mok, Alexander Lu, Nicholas Lee, Gopala Anumanchipalli:

Evolutionary Strategies at Scale lead to Catastrophic Forgetting. 194-204 - Zhenwen Liang, Yujun Zhou, Sidi Lu, Xiangliang Zhang, Haitao Mi, Dong Yu:

Too Correct to Learn: Reinforcement Learning on Saturated Reasoning Data. 205-215 - Zhikun Xu, Xiaodong Yu, Ben Zhou, Jiang Liu, Jialian Wu, Ze Wang, Ximeng Sun, Hao Chen, Zicheng Liu:

Reliable Use of Lemmas via Eligibility Reasoning and Section-Aware Reinforcement Learning. 216-226 - Mafizur Rahman, Lijun Qian:

Attention Under Attack: Analog Noise Effects and Mechanistic Vulnerabilities in Transformer Models. 227-237 - Priyaranjan Pattnayak, Apoorv Bhatia:

ReproEvalCard: A Reporting Standard for Reproducible Evaluation of LLM Pipelines. 238-249 - Nishant Balepur, Atrey Desai, Rachel Rudinger:

Test-Time Reasoners Are Strategic Multiple-Choice Test-Takers. 250-272 - Yi Lin, Yihao Ding, Yonghui Wu, Yifan Peng:

MARCH: Multi-Agent Radiology Clinical Hierarchy for CT Report Generation. 273-285 - Clemente Pasti, Andreas Opedal, Timothy J. O'Donnell, Ryan Cotterell, Tim Vieira:

Prefix Parsing is Just Parsing. 286-309 - Kevin Everson, Mari Ostendorf:

Privacy-preserving Prosody Representation Learning. 310-315 - Atsuki Yamaguchi, Maggie Mi, Nikolaos Aletras:

Enhancing Linguistic Competence of Language Models through Pre-training with Language Learning Tasks. 316-336 - Yuanjian Xu, Tianze Sun, Changwei Xu, XinLong Zhao, Jianing Hao, Ran Chen, Yang Liu, Ruijie Xu, Stephen Chen, Guang Zhang:

Rethinking Data Mixing from the Perspective of Large Language Models. 337-349 - Danlu Chen, Ka Sing He, Jiahe Tian, Chenghao Xiao, Zhaofeng Wu, Taylor Berg-Kirkpatrick, Freda Shi:

Translation or Recitation? Calibrating Evaluation Scores for Machine Translation of Extremely Low-Resource Languages. 350-363 - Jeffrey George Wang, Jason Wang, Marvin Li, Seth Neel:

CheckMIABench: Firm Foundations For Membership Inference Attacks on Language Models. 364-370 - Shiying Fan, Mareike Bassenge, Martin Steinebach:

Luring as a Proxy: Evaluating Corpus Transferability for Cybergrooming Detection. 371-385 - Erum Mushtaq, Anil Ramakrishna, Satyapriya Krishna, Sattvik Sahai, Prasoon Goyal, Kai-Wei Chang, Tao Zhang, Rahul Gupta:

From Narrow Unlearning to Emergent Misalignment in LLMs. 386-395 - Kisu Yang, Yoonna Jang, Hwanseok Jang, Kenneth Choi, Isabelle Augenstein, Heuiseok Lim:

Reliable Evaluation Protocol for Low-Precision Retrieval. 396-409 - Rhea Kapur, Robert D. Hawkins, Elisa Kreiss:

When More Words Say Less: Decoupling Length and Specificity in Image Description Evaluation. 410-422 - Chaewon Yoon, Dongjun Kim, Hyun-Je Song:

Selective Span-Level Unlearning for Large Language Models. 423-431 - Alberto Testoni, Iacer Calixto:

Calibrated? Not for Everyone: How Sexual Orientation and Religious Markers Distort LLM Accuracy and Confidence in Medical QA. 432-447 - Yunxiang Mo, Tianshi Zheng, Qing Zong, Jiayu Liu, Baixuan Xu, Yauwai Yim, Chunkit Chan, Jiaxin Bai, Yangqiu Song:

DIXITWORLD: Evaluating Multimodal Abductive Reasoning in Vision-Language Models with Multi-Agent Dixit Gameplay. 448-462 - Yong Guan, Zhiyuan Li, Shaoru Guo:

UERLens: Understanding Event Relations in Large Language Models. 463-471 - Andreas Van Cranenburgh, Xiaoyan Yang, Alvanita, Cecilia Nicole Di Domenico, Maria Ferragud, Arianna Graciotti, Byungjun Kim, Seonyeong Park, Noa Visser Solissa, Xiaoyu Zhou, Federico Pianzola:

GOLEMcoref: A Multilingual Coreference Dataset of Fiction. 472-480 - Trapoom Ukarapol, Pakhapoom Sarapat, Nut Chukamphaeng:

Language-Aware Token Boosting: LLM Language Confusion Reduction Without Tuning. 481-489 - Imranul Ashrafi, Inigo Jauregi Unanue, Massimo Piccardi:

Pref-CTRL: Preference Driven LLM Alignment using Representation Editing. 490-500 - Venkata S. Govindarajan, Laura Biester:

Dark & Stormy: Modeling Humor in Sentences from the Bulwer-Lytton Fiction Contest. 501-510 - Xi Fang, Weijie Xu, Yuchong Zhang, Scott Nickleach, Stephanie Eckman, Chandan K. Reddy:

The Personalization Trap: How User Memory Alters Emotional Reasoning in LLMs. 511-529 - Zhenhan Huang:

Neuro-Symbolic Agentic Reinforcement Learning for Long-Term Original Character Companionship and Interaction. 530-539 - Cheng Wang, Qin Liu, Wenxuan Zhou, Muhao Chen:

Taming Extreme Tokens: Covariance-Aware GRPO with Gaussian-Kernel Advantage Reweighting. 540-546 - Ayoub Hammal, Pierre Zweigenbaum, Caio Corro:

On the Rejection Criterion for Proxy-based Test-time Alignment. 547-554 - Havva Alizadeh Noughabi, Fattane Zarrinkalam, Ali Dehghantanha:

Defense Against Knowledge Poisoning Attack on GraphRAG. 555-563 - Tanmay Parekh, Ella Hofmann-Coyle, Shuyi Wang, Sachith Sri Ram Kothur, Srivas Prasad, Yunmo Chen:

PExA: Parallel Exploration Agent for Complex Text-to-SQL. 564-594 - Lechen Zhang, Yunxiang Zhang, Wei Hu, Lu Wang:

Skill-Aware Data Selection and Fine-Tuning for Data-Efficient Reasoning Distillation. 595-604 - Seyedali Mohammadi, Manas Gaur, Francis Ferraro:

Experiments or Outcomes? Probing Scientific Feasibility in Large Language Models. 605-614 - Mohammadsadegh Abolhasani, Reza Mousavi, Paul Jen-Hwa Hu:

CaBSALLM: Efficient Context-Aware Batch Annotation of Conversational Streams with Large Language Models. 615-636 - Yuchen Huang, Junpeng Zhang, Quanshi Zhang:

Challenging the Explanation Based on Preceding Tokens: Discovering Transferable Non-Literal Biasing. 637-645 - Jedrzej Warczynski, Ondrej Dusek, Mateusz Lango:

One-step Nonautoregressive Natural Language Generation with Shortcut Flow Matching Models. 646-655 - Yijie Chen, Yijin Liu, Fandong Meng:

SED-SFT: Selectively Encouraging Diversity in Supervised Fine-Tuning. 656-663 - Shahid Iqbal Rai, Danilo Croce, Roberto Basili:

Frame-Semantic Knowledge Injection for Event-Level Inference in LLMs. 664-678 - Tinnakit Udsa, Can Udomcharoenchaikit, Patomporn Payoungkhamdee, Sarana Nutanong, Norrathep Rattanavipanon:

Exploring Cross-Client Memorization of Training Data in Large Language Models for Federated Learning. 679-693 - Lu Shijia, Fumiyo Fukumoto, Xiaoxi Huang, Yoshimi Suzuki:

FL-MSCL: A Unified Figurative Language Detection Model Driven by Multi-Type Signals and Contrastive Learning. 694-702 - Anuj Kumar, Satyadev Ahlawat, Yamuna Prasad, Virendra Singh:

Revisiting Evaluation of Question Answering Systems in Low-Resource Indic Languages: Bridging Human and Metric Alignment. 703-718 - Rikuto Kotoge, Yuichi Sasaki:

Data-efficient Targeted Token-level Preference Optimization for LLM-based Text-to-Speech. 719-726 - Pratham Yashwante, Davit Abrahamyan, Shresth Grover, Sukruth Rao:

How Do Inpainting Artifacts Propagate to Language? 727-745 - Obed Junias, Maria Leonor Pacheco:

LOGICAL-COMMONSENSEQA: A Benchmark for Logical Commonsense Reasoning. 746-758 - Mengfei Lan, Lecheng Zheng, Halil Kilicoglu:

BioHiCL: Hierarchical Multi-Label Contrastive Learning for Biomedical Retrieval with MeSH Labels. 759-769 - Mert Inan, Malihe Alikhani, Anthony Sicilia:

Dialogue is the Plan: From Interface to Joint Action in Agentic AI. 770-779 - Seungmin Oh, Eunseok Lee:

Late Code Chunking: A Code Chunking Strategy for Repository-Level Code Completion. 780-786 - Ali El Lahib, Ying-Jieh Xia, Zehan Li, Yuxuan Wang, Xinyu Pi:

Temporal Leakage in Search-Engine Date-Filtered Web Retrieval: A Retrospective Forecasting Case Study. 787-795 - Stefano Civelli, Pietro Bernardelle, Nicolò Brunello, Gianluca Demartini:

A Shared Geometry of Difficulty in Multilingual Language Models. 796-807 - Hanchen Xia, Baoyou Chen, Yutang Ge, Guojiang Zhao, Siyu Zhu:

T^\star: Progressive Block Scaling for Masked Diffusion Language Models Through Trajectory Aware Reinforcement Learning. 808-816 - Hang Lv, Hongchao Gu, Ruiqing Yang, Liangyue Li, Zulong Chen, Defu Lian, Hao Wang, Enhong Chen:

Learning from Emptiness: De-biasing Listwise Rerankers with Content-Agnostic Probability Calibration. 817-826 - Nitin Vetcha, Binqian Xu, Dianbo Liu:

Decoupling Generalization and Adaptation in Meta-Learning for Large Language Models. 827-840 - Yujie Luo, Zhuoyun Yu, Xuehai Wang, Yuqi Zhu, Ningyu Zhang, Lanning Wei, Lun Du, Da Zheng, Huajun Chen:

What Makes AI Research Replicable? Executable Knowledge Graphs as Scientific Knowledge Representations. 841-861 - Sai Srinivas Kancheti, Aditya Sanjiv Kanade, Vineeth N. Balasubramanian, Tanuja Ganu:

Chain-of-Thought Degrades Visual Spatial Reasoning Capabilities of Multimodal LLMs. 862-876 - Long Hai Trieu, Hieu Minh Phi, Makoto Miwa:

Reviving Iterative Refinement in Diffusion-based NER with an Initializer-Restorer Approach. 877-882 - Nabil Ibtehaz, Daisuke Kihara:

Protein-STORY: Semantic Text-Oriented Representation Yields biologically meaningful Protein embeddings. 883-897 - Chenyang Huang, Osmar Zaïane:

Diving into the Decoding Space of Non-Autoregressive Models via Lexically Constrained Search. 898-906

manage site settings
To protect your privacy, all features that rely on external API calls from your browser are turned off by default. You need to opt-in for them to become active. All settings here will be stored as cookies with your web browser. For more information see our F.A.Q.


Google
Google Scholar
Semantic Scholar
Internet Archive Scholar
CiteSeerX
ORCID













