- Published on
ACL 2026 — Machine Translation & Multilingual
Machine Translation & Multilingual
112 papers Links not yet available — ACL proceedings pending on ACL Anthology.
- Parallel Universes, Parallel Languages: A Comprehensive Study on LLM-based Multilingual Counterfactual Example Generation
- CLEAR: Cross-Lingual Enhancement in Retrieval via Reverse-training
- SACTOR: LLM-Driven Correct and Idiomatic C to Rust Translation with Static Analysis and FFI-Based Verification
- Hierarchical Policy Optimization for Simultaneous Translation of Unbounded Speech
- MORPHOGEN: A Multilingual Benchmark for Evaluating Gender-Aware Morphological Generation
- EMCEE: Improving Multilingual Capability of LLMs via Bridging Knowledge and Reasoning with Extracted Synthetic Multilingual Context
- TRACE: Evaluating Execution Efficiency of LLM-Based Code Translation
- One Tokenizer To Rule Them All: Emergent Language Plasticity via Multilingual Tokenizers
- LLM-XTM: Enhancing Cross-Lingual Topic Models with Large Language Models
- Beyond Literal Mapping: Benchmarking and Improving Non-Literal Translation Evaluation
- Incentivizing Parametric Knowledge via Reinforcement Learning with Verifiable Rewards for Cross-Cultural Entity Translation
- What Does LLM Refinement Actually Improve? A Systematic Study on Document-Level Literary Translation
- DeReA: Improving Idiom Translation with Detect-Retrieve-Arbitrate Reasoning
- All Languages Matter: Understanding and Mitigating Language Bias in Multilingual RAG
- Parity-Aware Byte-Pair Encoding: Improving Cross-lingual Fairness in Tokenization
- NeoAMT: Neologism-Aware Agentic Machine Translation with Reinforcement Learning
- DART: Disambiguation-Aware Reasoning for Video-guided Machine Translation
- Gained in Translation: Privileged Pairwise Judges Enhance Multilingual Reasoning
- VFA: Empoweing Multilingual MLLMs via Vision-Free Adaptation
- Think in Latent Thoughts: A New Paradigm for Gloss-Free Sign Language Translation
- MT³: A Synergistic Multi-Task RL Framework for Specializing MLLMs in Text Image Machine Translation
- M²PO: Multi-Perspective Multi-Pair Preference Optimization for Machine Translation
- Losing our Tail, Again: (Un)Natural Selection & Multilingual LLMs
- Multilingual Idioms in Sentences and Conversations Across High-, Medium-, and Low-Resource Languages
- Is Human-Like Text Liked by Humans? Multilingual Human Detection and Preference Against AI
- LiveCLKTBench: Towards Reliable Evaluation of Cross-Lingual Knowledge Transfer in Multilingual LLMs
- Evaluating the Impact of Verbal Multiword Expressions on Machine Translation
- HAT: Hallucination Annotation for Translation
- Evaluating Robustness of Large Language Models Against Multilingual Typographical Errors
- ParaCodex: A Profiling-Guided Autonomous Coding Agent for Reliable Parallel Code Generation and Translation
- MultiFinBen: Benchmarking Large Language Models for Multilingual and Multimodal Financial Application
- Lost in Translation, and Found: Detecting and Interpreting Translation Effects
- Paraphrasing as Zero-shot Translation with Feature-guided Diversity Enhancement
- XToM: Exploring the Multilingual Theory of Mind for Large Language Models
- TAMA: Target-Aware Multilingual Abuse Detection by Cascaded Conditional Multi-Task Learning
- GBV-SQL: Guided Generation and SQL2Text Back-Translation Validation for Multi-Agent Text2SQL
- MSMO-ABSA: Multi-Scale and Multi-Objective Optimization for Cross-Lingual Aspect-Based Sentiment Analysis
- Think Natively: Unlocking Multilingual Reasoning with Consistency-Enhanced Reinforcement Learning
- Language on Demand, Knowledge at Core: Composing LLMs with Encoder-Decoder Translation Models for Extensible Multilinguality
- SAME: Signer-Aware Mixture-of-Experts for Test-Time Adaptation in Sign Language Translation
- The GaoYao Benchmark: A Comprehensive Framework for Evaluating Multilingual and Multicultural Abilities of Large Language Models
- MMAC: A Multilingual, Multimodal Alignment Framework for Cultural Grounding Evaluation
- How Can Synthetic Data Improve Multilingual Language Model Pretraining? A Data Quality Perspective
- Translation or Recitation? Calibrating Evaluation Scores for Machine Translation of Extremely Low-Resource Languages
- IRIS: Interleaved Reinforcement with Incremental Staged Curriculum for Cross-Lingual Mathematical Reasoning
- Right at My Level: A Unified Multilingual Framework for Proficiency-Aware Text Simplification
- Knowledge Beyond Language: Bridging the Gap in Multilingual Machine Unlearning Evaluation
- Unlocking Multilingual Reasoning Capability of LLMs and LVLMs through Representation Engineering
- NiuTrans.LMT: Toward Inclusive and Scalable Multilingual Machine Translation with LLMs
- Revisiting Metric Reliability for Fine-grained Evaluation of Machine Translation and Summarization in Indian Languages
- LLM-ForcedAligner: A Non-Autoregressive and Accurate LLM-Based Forced Aligner for Multilingual and Long-Form Speech
- A Data-Efficient Path to Multilingual LLMs: Language Expansion via Post-training PARAMΔ Integration into Upcycled MoE
- Improving Long-Context Translation via Self-Supervised Dual Learning
- Multilingual and Cross-Lingual Citation Needed Detection on Wikipedia for Lower-Resource Languages
- Location Not Found: Exposing Implicit Local and Global Biases in Multilingual LLMs
- TOWER+: Bridging Generality and Translation Specialization in Multilingual LLMs
- Culture-Aware Machine Translation in Large Language Models: Benchmarking and Investigation
- GOLEMcoref: A Multilingual Coreference Dataset of Fiction
- How Good is Your Wikipedia? Auditing Data Quality for Low-resource and Multilingual NLP
- MPR-GUI: Benchmarking and Enhancing Multilingual Perception and Reasoning in GUI Agents
- Less Languages, Less Tokens: An Efficient Unified Logic Cross-lingual Chain-of-Thought Reasoning Framework
- Beyond Atomic Characters: Glyph-Aware Sub-character Alignment for Low-Resource Multilingual OCR
- Translation with Thought: Difficulty-Adaptive Reasoning via Reinforcement Learning for Multi-Domain Machine Translation
- CURE-Med: Curriculum-Informed Reinforcement Learning for Multilingual Medical Reasoning
- An Experimental Study on the Influence of Culture on Cross-Lingual Sentiment Transfer
- SwissGov-RSD: A Human-annotated, Cross-lingual Benchmark for Token-level Recognition of Semantic Differences Between Related Documents
- When Does Mixing Help? Analyzing Query Embedding Interpolation in Multilingual Dense Retrieval
- Alexandria: A Multi-Domain Dialectal Arabic Machine Translation Dataset for Culturally Inclusive and Linguistically Diverse LLMs
- Vocabulary Shapes Cross-Lingual Variation of Word-Order Learnability in Language Models
- MQM Re-Annotation: A Technique for Collaborative Evaluation of Machine Translation
- Multilingual Language Models Encode Script Over Linguistic Structure
- ChiKhaPo: A Large-Scale Multilingual Benchmark for Evaluating Lexical Comprehension and Generation in Large Language Models
- Beyond Code Pairs: Dialogue-Based Data Generation for LLM Code Translation
- MMSciCode: Real-world Evaluation of Multilingual Multi-Discipline Scientific Research Coding
- Where the Cat Sat: A Multilingual Framework for Spatial Language Understanding
- LCMA-SRT: Language-Conditional Mixture-of-Experts Adapters for Joint Multilingual Speech Recognition and Translation
- Massively Multilingual Joint Segmentation and Glossing
- Bootstrapping Code Translation with Weighted Multilanguage Exploration
- LangSAE Editing: Improving Multilingual Information Retrieval via Post-hoc Language Identity Removal
- Framing Political Bias in Multilingual LLMs Across Pakistani Languages
- Mitigating Tokenization-Induced Distance Distortion in Long-Context Multilingual Machine Translation
- The Role of Mixed-Language Documents for Multilingual Large Language Model Pretraining
- FairQE: Multi-Agent Framework for Mitigating Gender Bias in Translation Quality Estimation
- AdaDPI: Document-level Translation Adaptive Agent via Dynamic Parametric Internalization
- DetectRL-X: Towards Reliable Multilingual and Real-World LLM-Generated Text Detection
- G-IdiomAlign: A Gloss-Pivoted Benchmark for Cross-Lingual Idiom Alignment
- Towards Fast and Accurate Modeling for Cross-Lingual Label Projection
- False Friends or Cognates? A Cross-lingual Semantic Ambiguity Evaluation for Galician, Portuguese and Spanish
- Phonemes to the Rescue: Multilingual Tokenization Based on International Phonetic Alphabet
- DimABSA: Building Multilingual and Multidomain Datasets for Dimensional Aspect-Based Sentiment Analysis
- One Pair Suffices: Unlocking Universal Zero-Shot Translation via Cross-Architecture Alignment
- Quantifying the Impact of Translation Errors on Multilingual LLM Evaluation
- Prosody as Supervision: Bridging the Non-Verbal–Verbal for Multilingual Speech Emotion Recognition
- Measuring User’s Mental Models of Speech Translation in Human-AI Collaboration
- PEAR: Pairwise Evaluation for Automatic Relative Scoring in Machine Translation
- LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance
- Lost in Execution: On the Multilingual Robustness of Tool Calling in Large Language Models
- POLYCHARTQA: Benchmarking Large Vision-Language Models with Multilingual Chart Question Answering
- CLAOCS-TX: Cross-Lingual Triplet Extraction with Aspect-Opinion-Aware Code-Switched Prompting and LLM-Guided Contrastive Distillation
- When Does Language Matter? Multilingual Instructions Reveal Step-wise Language Sensitivity in Vision-Language-Action Models
- A Shared Geometry of Difficulty in Multilingual Language Models
- Authorship Attribution in Multilingual Machine-Generated Texts
- Combining Distantly Supervised Models with In Context Learning for Monolingual and Cross-Lingual Relation Extraction
- Selective Contrastive Learning For Gloss Free Sign Language Translation
- Mind the Pause: Disfluency-Aware Objective Tuning for Multilingual Speech Correction with LLMs
- MUTANT: A Recipe for Multilingual Tokenizer Design
- Characterizing and Evaluating Working Emotion Vocabularies in Multilingual Large Language Models
- Toward Robust Evaluation for Multilingual Grammatical Error Correction: Can Large Language Models Replace Human References?
- A Multilingual Social Bias Benchmark Incorporating Thinking Processes
- Macaron: Controlled, Human-Written Benchmark for Multilingual and Multicultural Reasoning via Template-Filling
- Typology-Aware Multilingual Morphosyntactic Parsing with Joint Abstract Node Modeling