R
Published on

ACL 2026 — Other / Unclassified

Other / Unclassified

267 papers Links not yet available — ACL proceedings pending on ACL Anthology.

  • Empowering Tabular Data Preparation with Language Models: Why and How?
  • Learning Diverse Responses with Prefix-Conditioned Supervised Fine-Tuning
  • Hybrid Autoregressive-Diffusion Model for Real-Time Sign Language Production
  • A Game-Theoretica Negotiation Framework for Cross-Cultural Consensus
  • Identifying the Periodicity of Information in Natural Language
  • EmoHarbor: Evaluating Personalized Emotional Support by Simulating the User’s Internal World
  • Punctuation-Steered Representation Fine-Tuning
  • J4R: Learning to Judge with Equivalent Initial State Group Relative Policy Optimization
  • Not All Directions Matter: Towards Structured and Task-Aware Low-Rank Model Adaptation
  • ReContraster: Making Your Posters Stand Out with Regional Contrast
  • CARES: Context-Aware Resolution Selector for VLMs
  • Think in Sentences: Explicit Sentence Boundaries Enhance Language Model’s Capabilities
  • GenDis: Generative-Discriminative Dual-View Co-Training for Generalized Category Discovery
  • DE-CLIP: Few-Shot Anomaly Detection via Difference-Guided Embedding Editing
  • Culinary Crossroads: A RAG Framework for Enhancing Diversity in Cross-Cultural Recipe Adaptation
  • Splits! Flexible Sociocultural Linguistic Investigation at Scale
  • Breaking the Generator Barrier: Disentangled Representation for Generalizable AI-Text Detection
  • PUPPET: Neural-Symbolic Standardized Patients for Mental Health
  • AwarenessBench: Assessing Cognitive Capabilities of Language Models
  • HOPE: Hybrid Optimized Parallel Encoding with Supervised and Unsupervised Semantic Fusion for Depression Symptom Detection
  • Rethinking Sample Polarity in Reinforcement Learning with Verifiable Rewards
  • DIA-HARM: Dialectal Disparities in Harmful Content Detection Across 50 English Dialects
  • Inferring Events from Time Series using Language Models
  • Big AI is Accelerating the Metacrisis: What Can We Do?
  • Crossing the Reward Bridge: Expanding Reinforcement Learning with Verifiable Rewards Across Diverse Domains
  • IMPACT: Importance-Aware Activation Space Reconstruction
  • CTTA-T: Continual Test-Time Adaptation for Text Understanding via Teacher-Student with a Domain-aware and Generalized Teacher
  • EventWeave: A Dynamic Framework for Capturing Core and Supporting Events in Dialogue Systems
  • G²RPO-A: Guided Group Relative Policy Optimization with Adaptive Guidance
  • Analytical FFN-to-MoE Restructuring via Activation Pattern Analysis
  • Uncovering Temporal Framing in the News
  • GenProve: Learning to Generate Text with Fine-Grained Provenance
  • Everyone is unique: Towards Behaviorally Heterogeneous Negotiation Dialogue Systems for Debt Collection
  • BaseCal: Unsupervised Confidence Calibration via Base Model Signals
  • Investigating the Representation of Backchannels and Fillers in Fine-tuned Language Models
  • The Stackelberg Speaker: Optimizing Persuasive Communication in Social Deduction Games
  • Writing-RL: Advancing Long-form Writing via Adaptive Curriculum Reinforcement Learning
  • EXCEEDS: Extracting Complex Events via Nugget-based Grid Modeling in Scientific Domain
  • Heterogeneous Adaptive Policy Optimization: Tailoring Optimization to Every Token’s Nature
  • Mirroring Users: Towards Building Preference-aligned User Simulator with User Feedback in Recommendation
  • Structured Episodic Event Memory
  • Unlocking the Potential of Diffusion Language Models through Template Infilling
  • Diff4TST: Masked Diffusion Language Model for Text Style Transfer
  • DPC: Training-Free Text-to-SQL Candidate Selection via Dual-Paradigm Consistency
  • Beyond Hard Masks: Progressive Token Evolution for Diffusion Language Models
  • What Makes an Ideal Quote? Recommending “Unexpected yet Rational” Quotations via Novelty
  • RSDA: Restoring Stale Data Affinity via Dynamic Renovation Strategy for Mitigating Data Scarcity
  • Ted-Tok: Maintaining an Evolving Vocabulary for Lifelong Learning
  • SEA-BED: How Do Embedding Models Represent Southeast Asian Languages?
  • LVLMs and Humans Ground Differently in Referential Communication
  • Hierarchical Acoustic-Semantic Modeling: Modality Separation and Semantic Coherence for Full-Duplex SLMs
  • Automatic Correction of Writing Anomalies in Hausa Texts
  • Understanding or Memorizing? A Case Study of German Definite Articles in Language Models
  • AdaJudge: Adaptive Multi-Perspective Judging for Reward Modeling
  • ThinkPersona: Thinking with Persona Graphs for Faithful Individualized Role-Playing
  • A Layer-wise Analysis of Supervised Fine-Tuning
  • Feeling Rules in Language Models: Mapping Norms of Emotional Appropriateness Across Roles, Institutions, and Intensity
  • When Morphology Hides in Plain Sight: Breaking the Isolation in Vietnamese and Beyond
  • C2: Scalable Rubric-Augmented Reward Modeling from Binary Preferences
  • A Dual-Task Paradigm to Investigate Sentence Comprehension Strategies in Language Models
  • PRISM: Probabilistic Reward Model with Inherent Structural Modeling
  • WeightLoRA: Keep Only Necessary Adapters
  • GASim: A Graph-Accelerated Hybrid Framework for Social Simulation
  • Investigating Cross-Modal Skill Injection: Scenarios, Methods, and Hyperparameters
  • The Bidirectional Process Reward Model
  • A Model of the Language Process
  • Among Us: Language of Conspiracy Theorists on Mainstream Reddit
  • Bridging Distance and Spectral Positional Encodings via Anchor-Based Diffusion Geometry Approximation
  • Inside Out: Evolving User-Centric Core Memory Trees for Long-Term Personalized Dialogue Systems
  • Toward Consistent World Models with Multi-Token Prediction and Latent Semantic Enhancement
  • Language Model as Planner and Formalizer under Constraints
  • Anchoring Depends on Confidence and Post-Training in Language Models
  • Locket: Robust Feature-Locking Technique for Language Models
  • Closing the Spatial Execution Gap in Digital Whiteboards via Verifiable Reinforcement Learning
  • Hyperion: Private Token Sampling with Homomorphic Encryption
  • HistLens: Mapping Idea Change across Concepts and Corpora
  • Stable Signer: Hierarchical Sign Language Generative Model
  • AI use in American newspapers is widespread, uneven, and rarely disclosed
  • The Illusion of Specialization: Unveiling the Domain-Invariant “Standing Committee” in Mixture-of-Experts Models
  • Evolutionary Strategies at Scale lead to Catastrophic Forgetting
  • Generating Literature-Driven Scientific Theories at Scale
  • Digitizing Nepal’s Written Heritage: A Comprehensive HTR Pipeline for Old Nepali Manuscripts
  • Implicit Representations of Grammaticality in Language Models
  • Uncovering Intervention Opportunities for Suicide Prevention with Language Model Assistants
  • Robertha: Eigenspectrum Regularized Attention for Robust Natural Language Understanding
  • MetFuse: Figurative Fusion between Metonymy and Metaphor
  • Exploring Concreteness Through a Figurative Lens
  • Act-Adaptive Margin: Dynamically Calibrating Reward Models for Subjective Ambiguity
  • Among Us: Measuring and Mitigating Malicious Contributions in Model Collaboration Systems
  • Function Words as Statistical Cues for Language Learning
  • Measuring What Matters!! Assessing Therapeutic Principles in Mental-Health Conversation
  • Knowing When Not to Answer: Lightweight KB-Aligned OOD Detection for Safe RAG
  • Guidelines as Environments: A World Model Approach to Rule Following
  • Prefix Parsing is Just Parsing
  • Sigmoid Head for Quality Estimation under Language Ambiguity
  • Domain Generalizable AI Guardrails with Augmented Policy Training
  • TabEmb: Joint Semantic-Structure Embedding for Table Annotation
  • Text-to-Distribution Prediction with Quantile Tokens and Neighbor Context
  • Mapping the Circumplex of Affect: Geometric Analysis of Emotion Representations via Hyperspherical Contrastive Learning
  • All Changes May Have Invariant Principles: Improving Ever-Shifting Harmful Meme Detection via Design Concept Reproduction
  • REZE: Representation Regularization for Domain-adaptive Text Embedding Pre-finetuning
  • MeepleLM: A Virtual Playtester Simulating Diverse Subjective Experiences
  • Is the Attention Matrix Really the Key to Self‑Attention in Multivariate Long‑Term Time Series Forecasting?
  • TellWhisper: Tell Whisper Who Speaks When
  • WildReward: Learning Reward Models from In-the-Wild Human Interactions
  • FocalOrder: Focal Preference Optimization for Reading Order Detection
  • Triviality Corrected Endogenous Reward
  • PaTaRM: Bridging Pairwise and Pointwise Signals via Preference-Aware Task-Adaptive Reward Modeling
  • Think Before Writing: Feature-Level Multi-Objective Optimization for Generative Citation Visibility
  • Language Reconstruction with Brain Predictive Coding from fMRI Data
  • ChatHLS: Towards Systematic Design Automation and Optimization for High-Level Synthesis
  • Placing Puzzle Pieces Where They Matter: A Question Augmentation Framework for Reinforcement Learning
  • LEDOM: Reverse Language Model
  • METRO: Towards Strategy Induction from Expert Dialogue Transcripts for Non-collaborative Dialogues
  • The Digital Dunning-Kruger Effect: Decoupling Hallucinations via Geometric Hidden-state Observation for Semantic Truthfulness
  • d-TreeRPO: Towards More Reliable Policy Optimization for Diffusion Language Models
  • Nirvana: A Specialized Generalist Model With Task-Aware Memory Mechanism
  • AutoReproduce: Automatic AI Experiment Reproduction with Paper Lineage
  • Counteracting the Matthew Effect in Self-Improvement of LVLMs through Head-Tail Re-balancing
  • Template-assisted Contrastive Learning of Task-oriented Dialogue Sentence Embeddings
  • Luring as a Proxy: Evaluating Corpus Transferability for Cybergrooming Detection
  • MAESTRO: Meta-learning Adaptive Estimation of Scalarization Trade-offs for Reward Optimization
  • MoEC: A Memory-Routed Mixture-of-Experts Controller for Adaptive Minecraft Control
  • MECH: A Cost-Effective Multi-Task Cascade Framework for Classroom Opinion Evolution Recognition
  • Comparative Analysis of the Intrinsic Metrics for Tokenizers and their effect on Downstream Tasks for Hindi and Marathi
  • Comparing human and language models sentence processing difficulties on complex structures
  • The Proxy Presumption: From Semantic Embeddings to Valid Social Measures
  • DVCQR: Dual-View Conversational Query Rewriting with Stage-wise Reinforcement Learning
  • PAR: Training-Free Positional Perturbation and Attention Recycling for Faithful OCR
  • SAIR-Comb : A Structure-Aware Iterative Refinement Framework for Combinatorics Autoformalization
  • I²B-LPO: Latent Policy Optimization via Iterative Information Bottleneck
  • What Do Prosody and Text Convey? Characterizing How Meaningful Information is Distributed Across Multiple Channels
  • ADVICE: Answer-Dependent Verbalized Confidence Estimation
  • Powering Verifiable Learning via Automated Evolutionary Data Synthesis
  • Text-Guided Multi-Scale Frequency Representation Adaptation
  • GeoRA: Geometry-Aware Low-Rank Adaptation for RLVR
  • LAMCL: A Length-aware Momentum Contrastive Learning Framework for Multiscale Machine-Revised Text Detection
  • Lingua-Graph: A Unified Representation of Cross-Task Common Substructures for Analytic Language Processing
  • FOREVER: Forgetting Curve-Inspired Memory Replay for Language Model Continual Learning
  • TPA: Next Token Probability Attribution for Detecting Hallucinations in RAG
  • Towards Stable and Effective Reinforcement Learning for Mixture-of-Experts
  • Forget What Matters, Keep the Rest: Selective Unlearning of Informative Tokens
  • Can Spectral-Clipping Enable Better Learning While Forgetting Less for Low-Rank Adaptation?
  • MaDS: Long-Horizon GUI Automation via Synergizing Dual-Layer Memory and Multi-Round Debate
  • Exons-Detect: Identifying and Amplifying Exonic Tokens via Hidden-State Discrepancy for Robust AI-Generated Text Detection
  • Localized Low-Rank Adaptation within Clustered Parameter Subspaces
  • Does Memory Need Graphs? A Unified Framework and Empirical Analysis for Long-Term Dialog Memory
  • CoCoNUTS: Concentrating on Content while Neglecting Uninformative Textual Styles for AI-Generated Peer Review Detection
  • AlphaContext: An Evolutionary Tree-based Psychometric Context Generator for Creativity Assessment
  • SOCIA-EVO: Automated Simulator Construction via Dual-Anchored Bi-Level Optimization
  • Read As Human: Compressing Context via Parallelizable Close Reading and Skimming
  • Enhancing Two Steps Textual Anomaly Detection through Anisotropy Mitigation
  • CURE: Critique-Driven Unified Reinforcement Learning for Test-Time Self-Improvement
  • Don’t Act Blindly: Robust GUI Automation via Action-Effect Verification and Self-Correction
  • What If Consensus Lies? Selective-Complementary Reinforcement Learning at Test Time
  • Modal Dependency Parsing as Structured Prediction over Source-Cue Scope
  • Learning from Near-Misses: Error-Aware Contrastive Few-Shot Learning for NL2Formula
  • From Weights to Activations: Is Steering the Next Frontier of Adaptation?
  • From Language to Driving: A Dual-Loop SLM-Enhanced Framework for Multi-Planner Scheduling via a Domain-Specific Language
  • SSA: Improving Performance With a Better Scoring Function
  • Segment, Embed, and Align: A Universal Recipe for Aligning Subtitles to Signing
  • Expect the Unexpected? Testing the Surprisal of Salient Entities
  • Language Models Learn Universal Representations of Numbers and Here’s Why You Should Care
  • Too Nice to Tell the Truth: Quantifying Agreeableness-Driven Sycophancy in Role-Playing Language Models
  • Rethinking Entropy Interventions in RLVR: An Entropy Change Perspective
  • RubricBench: Aligning Model-Generated Rubrics with Human Standards
  • Dark & Stormy: Modeling Humor in Sentences from the Bulwer-Lytton Fiction Contest
  • The Prosody of Emojis
  • Why Steering Works: Toward a Unified View of Language Model Parameter Dynamics
  • Gated Differentiable Working Memory for Long-Context Language Modeling
  • PASs-MoE: Mitigating Misaligned Co-drift among Router and Experts via Pathway Activation Subspaces for Continual Learning
  • On the Proper Treatment of Units in Surprisal Theory
  • Token-Level Policy Optimization: Linking Group-Level Rewards to Token-Level Aggregation via sequence-level likelihood
  • De-Anonymization at Scale via Tournament-Style Attribution
  • Cross-Modal Masked Compositional Concept Modeling for Enhancing Visio-Linguistic Compositionality
  • CO-EVO: Co-evolving Semantic Anchoring and Style Diversification for Federated DG-ReID
  • Discovering Properties of Inflectional Morphology in Neural Emergent Communication
  • Bayesian Social Deduction with Graph-Informed Language Models
  • Diagnosing Hidden Instabilities in Model Editing via Uncertainty Quantification
  • Parameter Importance is Not Static: Evolving Parameter Isolation for Supervised Fine-Tuning
  • Leveraging Outline-Optimized Generative Interactions and Critique for Self-Refining Outlines with Reinforcement Learning
  • CommonLID: Re-evaluating State-of-the-Art Language Identification Performance on Web Data
  • Clozing the Gap: Exploring Why Language Model Surprisal Outperforms Cloze Surprisal
  • Tailored Primitive Initialization is the Secret Key to Reinforcement Learning
  • Mitigating Lost in Multi-turn Conversation via Curriculum RL with Verifiable Accuracy and Abstention Rewards
  • PEARL: Self-Evolving Assistant for Time Management with Reinforcement Learning
  • Taming Extreme Tokens: Covariance-Aware GRPO with Gaussian-Kernel Advantage Reweighting
  • Memory efficiency and resource-rational encoding in sentence processing
  • RAG-on-a-Diet: A Reinforcement Learning-Based Dynamic Resource Optimization Framework for RAG
  • The Subjectivity of Respect in Police Traffic Stops: Modeling Community Perspectives in Body-Worn Camera Footage
  • PRInTS: Reward Modeling for Long-Horizon Information Seeking
  • Rethinking the Idiomaticity Decomposability Hypothesis: Evidence from Distributional Learning
  • KinyaProp: Fine-Grained Propaganda Annotation in Kinyarwanda
  • R1-RE: Cross-Domain Relation Extraction with RLVR
  • DRInQ: Evaluating Conversational Implicature with Controlled Context Variation
  • From Individual to Common: An Early Exploration of Consensus in Non-verifiable Data for Balanced Preference Optimization
  • SOAPTriage: SOAP-Guided Multi-View Clinical Text Modeling Framework for Automated ESI Prediction
  • From Regulatory Approvals to Patents: Cross-Domain Linking for Cardiovascular Device Traceability
  • Reinforcement Learning–Guided Adaptive Tuning for Out-of-Distribution Harmful Text Detection
  • HyperMem: Hypergraph Memory for Long-Term Conversations
  • ReflectRM: Boosting Generative Reward Models via Self-Reflection within a Unified Judgment Framework
  • SQL-Trail: Multi-Turn Reinforcement Learning with Interleaved Feedback for Text-to-SQL
  • Turning Failures into Value: Negative Experience Replay for RLVR via Confidence Gating and Boundary Failure Sampling
  • MiniRAG: A Lightweight RAG system with Small Language Models
  • AG-GRPO: Answer-Guided GRPO for Masked Diffusion Language Models
  • Beyond Majority Voting: Towards Fine-grained and More Reliable Reward Signal for Test-Time Reinforcement Learning
  • DUAL RM: Beyond Rule-based Preference Reward Modeling via Meta-Reward
  • CE-GPPO: Coordinating Entropy via Gradient-Preserving Clipping Policy Optimization in Reinforcement Learning
  • Vocabulary Hijacking in LVLMs: Unveiling Critical Attention Heads by Excluding Inert Tokens to Mitigate Hallucination
  • Confidence Should Be Calibrated More Than One Turn Deep
  • NaviMaster: Learning a Unified Policy for GUI and Embodied Navigation Tasks
  • Surprisal Minimisation over Goal-directed Alternatives Predicts Production Choice in Dialogue
  • ERCThinker: Fast-Slow Thinking for Emotion Recognition in Conversation
  • ConsistRM: Improving Generative Reward Models via Consistency-Aware Self-Training
  • LoRA on the Go: Instance-level Dynamic LoRA Selection and Merging
  • Rethinking Depression Prediction from a Fine-Grained Subscore Modeling Perspective via Multi-Task Learning
  • FL-MSCL: A Unified Figurative Language Detection Model Driven by Multi-Type Signals and Contrastive Learning
  • Libra-VLA: Achieving Learning Equilibrium via Asynchronous Coarse-to-Fine Dual-System
  • HiEdit: Lifelong Model Editing with Hierarchical Reinforcement Learning
  • On-the-Fly VLA Adaptation via Test-Time Reinforcement Learning
  • VISTA: Verification In Sequential Turn-based Assessment
  • Amadeus: Autoregressive Model with Bidirectional Attribute Modelling for Symbolic Music
  • FedMental: Evaluating Federated Learning for Mental Health Detection from Social Media Data
  • Edit-Aware Reward Modeling for Chinese Grammatical Error Correction
  • Modeling Annotator Disagreement with Demographic-Aware Experts and Synthetic Perspectives
  • Towards A Scanpath-Conditioned Surprisal Theory: Modeling Reader Information States
  • From log π to π: Taming Divergence in Soft Clipping via Bilateral Decoupled Decay of Probability Gradient Weight
  • Linear-Time and Constant-Memory Text Embeddings Based on Recurrent Language Models
  • Who Plays Which Role When? Communication Role Dynamics for Peer Recognition and Team Performance Prediction
  • When in Doubt, Consult: Expert Debate for Sexism Detection via Confidence-Based Routing
  • On the Effect of Hyperparameters in Language Modeling for Computational Linguistics
  • Wait! There’s a Way Out: A Decision Mechanism for Forecasting Conversational Derailment
  • Evaluating Language Model Pluralism through In-the-wild Crowd Discussions
  • Simulated Students in Tutoring Dialogues: Substance or Illusion?
  • The African Languages Lab: A Collaborative Approach to Advancing Low-Resource African NLP
  • Effects of Collaboration on the Performance of Interactive Theme Discovery Systems
  • ARES: Adaptive Red-Teaming and End-to-End Repair of Policy-Reward System
  • Credal Concept Bottleneck Models for Epistemic–Aleatoric Uncertainty Decomposition
  • When Personalization Tricks Detectors: The Feature-Inversion Trap in Machine-Generated Text Detection
  • SiLP: Enhancing Non-Dominant Language Capabilities with a Selective Bidirectional Language Projection Framework
  • P-Check: Advancing Personalized Reward Model via Learning to Generate Dynamic Checklist
  • RATE: Reviewer Profiling and Annotation-free Training for Expertise Ranking in Peer Review Systems
  • Feeling Right vs. Being Right: How AI Sycophancy Affects Value-Laden Deliberation
  • Through the Magnifying Glass: Adaptive Perception Magnification for Hallucination-Free VLM Decoding
  • Beyond Fully Random Masking: Attention-Guided Denoising and Optimization for Diffusion Language Models
  • GMoE: Global Mixture of Experts with Logit Propagation
  • Fine-Grained Analysis of Shared Syntactic Mechanisms in Language Models
  • Learning How and What to Memorize: Cognition-Inspired Two-Stage Optimization for Evolving Memory
  • On the Role of Discriminative Models in Generative Relation Extraction
  • Legal Judgment Prediction: A Reflection on the State of the Art
  • GRAD: Generalizing RAG Adaptation with Decoding
  • Why Do More Experts Fail? A Theoretical Analysis of Model Merging
  • TRACE: A Corpus of Team Creative Discussions
  • NSF-SciFy: Mining the NSF Awards Database for Scientific Claims
  • Evaluating Temporal Consistency in Multi-Turn Language Models
  • Overcoming Copyright Barriers in Corpus Distribution Through Non-Reversible Hashing
  • An Information-Theoretic Foundation for the Subregular Hierarchy
  • Generalizing Trust: Weak-to-Strong Trustworthiness in Language Models
  • Reviving Iterative Refinement in Diffusion-based NER with an Initializer-Restorer Approach
  • Reframing Responsibility: Framing-Aware Event Causality Identification
  • DyBBT: Dynamic Balance via Bandit-inspired Targeting for Dialog Policy with Cognitive Dual Systems
  • Why Mean Pooling Works: Quantifying Second-Order Collapse in Text Embeddings
  • HalluCitation Matters: Revealing the Impact of Hallucinated References with 300 Hallucinated Papers in ACL Conferences
  • Cell-Based Representation of Relational Binding in Language Models
  • CIG: Measuring Conversational Information Gain in Deliberative Dialogues with Semantic Memory Dynamics
  • TRAC: Teacher-Guided Token Reward with Adaptive Calibration for Robust Policy Optimization
  • Follow: