


default search action
10th LaTeCH-CLfL 2026: Rabat, Morocco
- Diego Alves, Yuri Bizzoni, Stefania Degaetano-Ortlieb, Anna Kazantseva, Janis Pagel, Stan Szpakowicz:

Proceedings of the 10th Joint SIGHUM Workshop on Computational Linguistics for Cultural Heritage, Social Sciences, Humanities and Literature 2026, LaTeCH-CLfL 2026, Rabat, Morocco, March 28-29, 2026. Association for Computational Linguistics 2026, ISBN 979-8-89176-373-9 - Hamest Tamrazyan, Kamal Nour, Emanuela Boros:

From Corpus to Concept Scheme: Developing a SKOS Vocabulary for Armenian Epigraphic Heritage. 1-10 - Hamest Tamrazyan, Emile Cornamusaz, Emanuela Boros:

Armenian AutoEpiDoc: Automated Extraction and Encoding of Armenian Inscriptions into EpiDoc TEI/XML. 11-15 - Carmen Schacht, Renate Delucchi Danhier:

Studying Expert-ese: Profiling and Classification of Domain-Specific Language Variation in Architecture with Traditional Machine Learning and LLMs. 16-29 - Louis Escouflaire:

CroCoSyn: A Cross-Lingual and Cross-Model Corpus of LLM-Generated Film Synopses. 30-35 - Lorella Viola

:
Identity Without Action: Rethinking Collective Action Models in Disinformation Research. 36-47 - Marco Sorbi, Laurent Moccozet, Stéphane Marchand-Maillet:

Weakly Supervised Named Entity Recognition for Historical Texts. 48-65 - Milena Belosevic:

Invisible Speakers? Gender Disparity in German AI Discourse and Its Reflection in Language Models. 66-79 - Katharina Zeh

, Hannes Essfors, Juliane Benson, Lale Tüver, Andreas Baumann, Hannes Fellner:
GlobLingDiv: A global dataset linking linguistic diversity and digital support to reveal landscapes with under-resourced languages for NLP. 80-86 - Stergios Chatzikyriakidis, Anastasia Natsina:

LLMs Got Rhyme? Hybrid Phonological Filtering for Greek Poetry Rhyme Detection and Generation. 87-101 - Ioana-Roxana Boriceanu, Liviu P. Dinu:

Style as Signature: Profile-Based Authorship Verification of Mihai Eminescu's Journalistic Corpus. 102-110 - Joonatan Laato, Veera Schroderus, Jenna Kanerva, Jenni Kauppi, Virpi Lummaa, Filip Ginter:

Measuring Social Integration Through Participation: Categorizing Organizations and Leisure Activities in the Displaced Karelians Interview Archive using LLMs. 111-127 - Mark Hill

, Ayse Bulus, Paul Spence
:
Catalogues as Data: Interpretable NLP Pipelines for Ottoman-Turkish Bibliographies. 128-134 - Jay Chooi:

Stylistic Transfer from Annotator Communities to Large Language Models. 135-145 - Sofía Aguilar-Valdez

, Stefania Degaetano-Ortlieb:
Modeling Changing Scientific Concepts with Complex Networks: A Case Study on the Chemical Revolution. 146-156 - Ali Al-Laith

, Alexander Conroy, Kirstine Nielsen Degn
, Jens Bjerring-Hansen
, Daniel Hershcovich
:
Speaking on Their Behalf: Detecting Indirect Speech in Historical Danish and Norwegian Texts. 157-163 - Ronja Laarmann-Quante, Stefanie Dipper

:
Harder than Finding the Lost Sheep? Towards Automatically Suggesting Deliberate Metaphor Annotations in German Sermons. 164-175 - Oliver Müller:

Semantic Factor Analysis: Validating Personality Structure Recovery from empirically-mediated Word Embeddings. 176-188 - Jan-Felix Klumpp:

Quantitative Analysis of Rhyme and Metre in LLM-generated Translations of Poetry. 189-201 - Hannes Essfors, Andreas Baumann:

WikiLingDiv: a dataset for quantifying digital linguistic diversity using Wikipedia page views. 202-211 - Anastasiia Vestel, Stefania Degaetano-Ortlieb:

Modeling Linguistic Imprints of War Propaganda in a Russian Wikipedia Fork: A Comparative Analysis with the Original Wikipedia. 212-220 - Adam Pawlowski, Tomasz Walkowiak:

Stylometric Approach to AI-generated Texts. An Analysis of Contemporary French-Language Literature. 221-226 - Maciej Rapacz

, Aleksander Smywinski-Pohl
:
Degree Zero of Translation: Using Interlinear Baselines to Quantify Translator Intervention. 227-240 - Donghan Bian, Marie Puren, Florian Cafiero:

How to Efficiently Explore Noisy Historical Data? Leveraging Corpus Pre-Targeting to Enhance Graph-based RAG. 241-250 - Agustin Dei

:
Detecting reported speech as a token classification task: an application to Classical Latin? 251-256 - Hans Ole Hatzel, Haimo Stiemer, Evelyn Gius, Chris Biemann:

Narrative in Short German Prose: A Multi-Phenomenon Dataset for Computational Literary Analysis. 257-265 - Andrea Farina, Michele Ciletti, Barbara McGillivray

, Andrea Ballatore
:
Sense-Based Annotation of Geographical Nouns in Ancient Greek and Latin: A Diachronic Study with LLMs. 266-279 - Axel Pichler, Janis Pagel:

Evaluating Humanities Theory Alignment in Large Language Models: Incremental Prompting and Statistical Assessment. 280-294 - Sil Hamilton, Rebecca M. M. Hicke, Mia Ferrante, Matthew Wilkens, David Mimno:

Too Long, Didn't Model: Decomposing LLM Long Context Understanding With Novels. 295-304 - Jirí Milicka, Tomás Machálek:

AI Corpus Linguist: More than a Year of Experience. 305-310 - Robin Winkle, Manfred Stede

, Jörn Kreutel:
Generative Information Extraction from Biographical Sources. 311-322 - Dung Nguyen, G. Çagatay Sat, Evgeny Pyshkin, John Blake

:
WikiFirst: A Genre-Fixed, Content-controlled Corpus for Evaluating Content Effects in Authorship Analysis. 323-327 - Yin Jou Huang, Fei Cheng:

Measuring the Symbolic Power of Languages with LLM-based Multilingual Persuasion Simulation. 328-338

manage site settings
To protect your privacy, all features that rely on external API calls from your browser are turned off by default. You need to opt-in for them to become active. All settings here will be stored as cookies with your web browser. For more information see our F.A.Q.


Google
Google Scholar
Semantic Scholar
Internet Archive Scholar
CiteSeerX
ORCID













