- Published on
ACL 2026 — Other / Unclassified
Other / Unclassified
267 papers Links not yet available — ACL proceedings pending on ACL Anthology.
- Empowering Tabular Data Preparation with Language Models: Why and How?
- Learning Diverse Responses with Prefix-Conditioned Supervised Fine-Tuning
- Hybrid Autoregressive-Diffusion Model for Real-Time Sign Language Production
- A Game-Theoretica Negotiation Framework for Cross-Cultural Consensus
- Identifying the Periodicity of Information in Natural Language
- EmoHarbor: Evaluating Personalized Emotional Support by Simulating the User’s Internal World
- Punctuation-Steered Representation Fine-Tuning
- J4R: Learning to Judge with Equivalent Initial State Group Relative Policy Optimization
- Not All Directions Matter: Towards Structured and Task-Aware Low-Rank Model Adaptation
- ReContraster: Making Your Posters Stand Out with Regional Contrast
- CARES: Context-Aware Resolution Selector for VLMs
- Think in Sentences: Explicit Sentence Boundaries Enhance Language Model’s Capabilities
- GenDis: Generative-Discriminative Dual-View Co-Training for Generalized Category Discovery
- DE-CLIP: Few-Shot Anomaly Detection via Difference-Guided Embedding Editing
- Culinary Crossroads: A RAG Framework for Enhancing Diversity in Cross-Cultural Recipe Adaptation
- Splits! Flexible Sociocultural Linguistic Investigation at Scale
- Breaking the Generator Barrier: Disentangled Representation for Generalizable AI-Text Detection
- PUPPET: Neural-Symbolic Standardized Patients for Mental Health
- AwarenessBench: Assessing Cognitive Capabilities of Language Models
- HOPE: Hybrid Optimized Parallel Encoding with Supervised and Unsupervised Semantic Fusion for Depression Symptom Detection
- Rethinking Sample Polarity in Reinforcement Learning with Verifiable Rewards
- DIA-HARM: Dialectal Disparities in Harmful Content Detection Across 50 English Dialects
- Inferring Events from Time Series using Language Models
- Big AI is Accelerating the Metacrisis: What Can We Do?
- Crossing the Reward Bridge: Expanding Reinforcement Learning with Verifiable Rewards Across Diverse Domains
- IMPACT: Importance-Aware Activation Space Reconstruction
- CTTA-T: Continual Test-Time Adaptation for Text Understanding via Teacher-Student with a Domain-aware and Generalized Teacher
- EventWeave: A Dynamic Framework for Capturing Core and Supporting Events in Dialogue Systems
- G²RPO-A: Guided Group Relative Policy Optimization with Adaptive Guidance
- Analytical FFN-to-MoE Restructuring via Activation Pattern Analysis
- Uncovering Temporal Framing in the News
- GenProve: Learning to Generate Text with Fine-Grained Provenance
- Everyone is unique: Towards Behaviorally Heterogeneous Negotiation Dialogue Systems for Debt Collection
- BaseCal: Unsupervised Confidence Calibration via Base Model Signals
- Investigating the Representation of Backchannels and Fillers in Fine-tuned Language Models
- The Stackelberg Speaker: Optimizing Persuasive Communication in Social Deduction Games
- Writing-RL: Advancing Long-form Writing via Adaptive Curriculum Reinforcement Learning
- EXCEEDS: Extracting Complex Events via Nugget-based Grid Modeling in Scientific Domain
- Heterogeneous Adaptive Policy Optimization: Tailoring Optimization to Every Token’s Nature
- Mirroring Users: Towards Building Preference-aligned User Simulator with User Feedback in Recommendation
- Structured Episodic Event Memory
- Unlocking the Potential of Diffusion Language Models through Template Infilling
- Diff4TST: Masked Diffusion Language Model for Text Style Transfer
- DPC: Training-Free Text-to-SQL Candidate Selection via Dual-Paradigm Consistency
- Beyond Hard Masks: Progressive Token Evolution for Diffusion Language Models
- What Makes an Ideal Quote? Recommending “Unexpected yet Rational” Quotations via Novelty
- RSDA: Restoring Stale Data Affinity via Dynamic Renovation Strategy for Mitigating Data Scarcity
- Ted-Tok: Maintaining an Evolving Vocabulary for Lifelong Learning
- SEA-BED: How Do Embedding Models Represent Southeast Asian Languages?
- LVLMs and Humans Ground Differently in Referential Communication
- Hierarchical Acoustic-Semantic Modeling: Modality Separation and Semantic Coherence for Full-Duplex SLMs
- Automatic Correction of Writing Anomalies in Hausa Texts
- Understanding or Memorizing? A Case Study of German Definite Articles in Language Models
- AdaJudge: Adaptive Multi-Perspective Judging for Reward Modeling
- ThinkPersona: Thinking with Persona Graphs for Faithful Individualized Role-Playing
- A Layer-wise Analysis of Supervised Fine-Tuning
- Feeling Rules in Language Models: Mapping Norms of Emotional Appropriateness Across Roles, Institutions, and Intensity
- When Morphology Hides in Plain Sight: Breaking the Isolation in Vietnamese and Beyond
- C2: Scalable Rubric-Augmented Reward Modeling from Binary Preferences
- A Dual-Task Paradigm to Investigate Sentence Comprehension Strategies in Language Models
- PRISM: Probabilistic Reward Model with Inherent Structural Modeling
- WeightLoRA: Keep Only Necessary Adapters
- GASim: A Graph-Accelerated Hybrid Framework for Social Simulation
- Investigating Cross-Modal Skill Injection: Scenarios, Methods, and Hyperparameters
- The Bidirectional Process Reward Model
- A Model of the Language Process
- Among Us: Language of Conspiracy Theorists on Mainstream Reddit
- Bridging Distance and Spectral Positional Encodings via Anchor-Based Diffusion Geometry Approximation
- Inside Out: Evolving User-Centric Core Memory Trees for Long-Term Personalized Dialogue Systems
- Toward Consistent World Models with Multi-Token Prediction and Latent Semantic Enhancement
- Language Model as Planner and Formalizer under Constraints
- Anchoring Depends on Confidence and Post-Training in Language Models
- Locket: Robust Feature-Locking Technique for Language Models
- Closing the Spatial Execution Gap in Digital Whiteboards via Verifiable Reinforcement Learning
- Hyperion: Private Token Sampling with Homomorphic Encryption
- HistLens: Mapping Idea Change across Concepts and Corpora
- Stable Signer: Hierarchical Sign Language Generative Model
- AI use in American newspapers is widespread, uneven, and rarely disclosed
- The Illusion of Specialization: Unveiling the Domain-Invariant “Standing Committee” in Mixture-of-Experts Models
- Evolutionary Strategies at Scale lead to Catastrophic Forgetting
- Generating Literature-Driven Scientific Theories at Scale
- Digitizing Nepal’s Written Heritage: A Comprehensive HTR Pipeline for Old Nepali Manuscripts
- Implicit Representations of Grammaticality in Language Models
- Uncovering Intervention Opportunities for Suicide Prevention with Language Model Assistants
- Robertha: Eigenspectrum Regularized Attention for Robust Natural Language Understanding
- MetFuse: Figurative Fusion between Metonymy and Metaphor
- Exploring Concreteness Through a Figurative Lens
- Act-Adaptive Margin: Dynamically Calibrating Reward Models for Subjective Ambiguity
- Among Us: Measuring and Mitigating Malicious Contributions in Model Collaboration Systems
- Function Words as Statistical Cues for Language Learning
- Measuring What Matters!! Assessing Therapeutic Principles in Mental-Health Conversation
- Knowing When Not to Answer: Lightweight KB-Aligned OOD Detection for Safe RAG
- Guidelines as Environments: A World Model Approach to Rule Following
- Prefix Parsing is Just Parsing
- Sigmoid Head for Quality Estimation under Language Ambiguity
- Domain Generalizable AI Guardrails with Augmented Policy Training
- TabEmb: Joint Semantic-Structure Embedding for Table Annotation
- Text-to-Distribution Prediction with Quantile Tokens and Neighbor Context
- Mapping the Circumplex of Affect: Geometric Analysis of Emotion Representations via Hyperspherical Contrastive Learning
- All Changes May Have Invariant Principles: Improving Ever-Shifting Harmful Meme Detection via Design Concept Reproduction
- REZE: Representation Regularization for Domain-adaptive Text Embedding Pre-finetuning
- MeepleLM: A Virtual Playtester Simulating Diverse Subjective Experiences
- Is the Attention Matrix Really the Key to Self‑Attention in Multivariate Long‑Term Time Series Forecasting?
- TellWhisper: Tell Whisper Who Speaks When
- WildReward: Learning Reward Models from In-the-Wild Human Interactions
- FocalOrder: Focal Preference Optimization for Reading Order Detection
- Triviality Corrected Endogenous Reward
- PaTaRM: Bridging Pairwise and Pointwise Signals via Preference-Aware Task-Adaptive Reward Modeling
- Think Before Writing: Feature-Level Multi-Objective Optimization for Generative Citation Visibility
- Language Reconstruction with Brain Predictive Coding from fMRI Data
- ChatHLS: Towards Systematic Design Automation and Optimization for High-Level Synthesis
- Placing Puzzle Pieces Where They Matter: A Question Augmentation Framework for Reinforcement Learning
- LEDOM: Reverse Language Model
- METRO: Towards Strategy Induction from Expert Dialogue Transcripts for Non-collaborative Dialogues
- The Digital Dunning-Kruger Effect: Decoupling Hallucinations via Geometric Hidden-state Observation for Semantic Truthfulness
- d-TreeRPO: Towards More Reliable Policy Optimization for Diffusion Language Models
- Nirvana: A Specialized Generalist Model With Task-Aware Memory Mechanism
- AutoReproduce: Automatic AI Experiment Reproduction with Paper Lineage
- Counteracting the Matthew Effect in Self-Improvement of LVLMs through Head-Tail Re-balancing
- Template-assisted Contrastive Learning of Task-oriented Dialogue Sentence Embeddings
- Luring as a Proxy: Evaluating Corpus Transferability for Cybergrooming Detection
- MAESTRO: Meta-learning Adaptive Estimation of Scalarization Trade-offs for Reward Optimization
- MoEC: A Memory-Routed Mixture-of-Experts Controller for Adaptive Minecraft Control
- MECH: A Cost-Effective Multi-Task Cascade Framework for Classroom Opinion Evolution Recognition
- Comparative Analysis of the Intrinsic Metrics for Tokenizers and their effect on Downstream Tasks for Hindi and Marathi
- Comparing human and language models sentence processing difficulties on complex structures
- The Proxy Presumption: From Semantic Embeddings to Valid Social Measures
- DVCQR: Dual-View Conversational Query Rewriting with Stage-wise Reinforcement Learning
- PAR: Training-Free Positional Perturbation and Attention Recycling for Faithful OCR
- SAIR-Comb : A Structure-Aware Iterative Refinement Framework for Combinatorics Autoformalization
- I²B-LPO: Latent Policy Optimization via Iterative Information Bottleneck
- What Do Prosody and Text Convey? Characterizing How Meaningful Information is Distributed Across Multiple Channels
- ADVICE: Answer-Dependent Verbalized Confidence Estimation
- Powering Verifiable Learning via Automated Evolutionary Data Synthesis
- Text-Guided Multi-Scale Frequency Representation Adaptation
- GeoRA: Geometry-Aware Low-Rank Adaptation for RLVR
- LAMCL: A Length-aware Momentum Contrastive Learning Framework for Multiscale Machine-Revised Text Detection
- Lingua-Graph: A Unified Representation of Cross-Task Common Substructures for Analytic Language Processing
- FOREVER: Forgetting Curve-Inspired Memory Replay for Language Model Continual Learning
- TPA: Next Token Probability Attribution for Detecting Hallucinations in RAG
- Towards Stable and Effective Reinforcement Learning for Mixture-of-Experts
- Forget What Matters, Keep the Rest: Selective Unlearning of Informative Tokens
- Can Spectral-Clipping Enable Better Learning While Forgetting Less for Low-Rank Adaptation?
- MaDS: Long-Horizon GUI Automation via Synergizing Dual-Layer Memory and Multi-Round Debate
- Exons-Detect: Identifying and Amplifying Exonic Tokens via Hidden-State Discrepancy for Robust AI-Generated Text Detection
- Localized Low-Rank Adaptation within Clustered Parameter Subspaces
- Does Memory Need Graphs? A Unified Framework and Empirical Analysis for Long-Term Dialog Memory
- CoCoNUTS: Concentrating on Content while Neglecting Uninformative Textual Styles for AI-Generated Peer Review Detection
- AlphaContext: An Evolutionary Tree-based Psychometric Context Generator for Creativity Assessment
- SOCIA-EVO: Automated Simulator Construction via Dual-Anchored Bi-Level Optimization
- Read As Human: Compressing Context via Parallelizable Close Reading and Skimming
- Enhancing Two Steps Textual Anomaly Detection through Anisotropy Mitigation
- CURE: Critique-Driven Unified Reinforcement Learning for Test-Time Self-Improvement
- Don’t Act Blindly: Robust GUI Automation via Action-Effect Verification and Self-Correction
- What If Consensus Lies? Selective-Complementary Reinforcement Learning at Test Time
- Modal Dependency Parsing as Structured Prediction over Source-Cue Scope
- Learning from Near-Misses: Error-Aware Contrastive Few-Shot Learning for NL2Formula
- From Weights to Activations: Is Steering the Next Frontier of Adaptation?
- From Language to Driving: A Dual-Loop SLM-Enhanced Framework for Multi-Planner Scheduling via a Domain-Specific Language
- SSA: Improving Performance With a Better Scoring Function
- Segment, Embed, and Align: A Universal Recipe for Aligning Subtitles to Signing
- Expect the Unexpected? Testing the Surprisal of Salient Entities
- Language Models Learn Universal Representations of Numbers and Here’s Why You Should Care
- Too Nice to Tell the Truth: Quantifying Agreeableness-Driven Sycophancy in Role-Playing Language Models
- Rethinking Entropy Interventions in RLVR: An Entropy Change Perspective
- RubricBench: Aligning Model-Generated Rubrics with Human Standards
- Dark & Stormy: Modeling Humor in Sentences from the Bulwer-Lytton Fiction Contest
- The Prosody of Emojis
- Why Steering Works: Toward a Unified View of Language Model Parameter Dynamics
- Gated Differentiable Working Memory for Long-Context Language Modeling
- PASs-MoE: Mitigating Misaligned Co-drift among Router and Experts via Pathway Activation Subspaces for Continual Learning
- On the Proper Treatment of Units in Surprisal Theory
- Token-Level Policy Optimization: Linking Group-Level Rewards to Token-Level Aggregation via sequence-level likelihood
- De-Anonymization at Scale via Tournament-Style Attribution
- Cross-Modal Masked Compositional Concept Modeling for Enhancing Visio-Linguistic Compositionality
- CO-EVO: Co-evolving Semantic Anchoring and Style Diversification for Federated DG-ReID
- Discovering Properties of Inflectional Morphology in Neural Emergent Communication
- Bayesian Social Deduction with Graph-Informed Language Models
- Diagnosing Hidden Instabilities in Model Editing via Uncertainty Quantification
- Parameter Importance is Not Static: Evolving Parameter Isolation for Supervised Fine-Tuning
- Leveraging Outline-Optimized Generative Interactions and Critique for Self-Refining Outlines with Reinforcement Learning
- CommonLID: Re-evaluating State-of-the-Art Language Identification Performance on Web Data
- Clozing the Gap: Exploring Why Language Model Surprisal Outperforms Cloze Surprisal
- Tailored Primitive Initialization is the Secret Key to Reinforcement Learning
- Mitigating Lost in Multi-turn Conversation via Curriculum RL with Verifiable Accuracy and Abstention Rewards
- PEARL: Self-Evolving Assistant for Time Management with Reinforcement Learning
- Taming Extreme Tokens: Covariance-Aware GRPO with Gaussian-Kernel Advantage Reweighting
- Memory efficiency and resource-rational encoding in sentence processing
- RAG-on-a-Diet: A Reinforcement Learning-Based Dynamic Resource Optimization Framework for RAG
- The Subjectivity of Respect in Police Traffic Stops: Modeling Community Perspectives in Body-Worn Camera Footage
- PRInTS: Reward Modeling for Long-Horizon Information Seeking
- Rethinking the Idiomaticity Decomposability Hypothesis: Evidence from Distributional Learning
- KinyaProp: Fine-Grained Propaganda Annotation in Kinyarwanda
- R1-RE: Cross-Domain Relation Extraction with RLVR
- DRInQ: Evaluating Conversational Implicature with Controlled Context Variation
- From Individual to Common: An Early Exploration of Consensus in Non-verifiable Data for Balanced Preference Optimization
- SOAPTriage: SOAP-Guided Multi-View Clinical Text Modeling Framework for Automated ESI Prediction
- From Regulatory Approvals to Patents: Cross-Domain Linking for Cardiovascular Device Traceability
- Reinforcement Learning–Guided Adaptive Tuning for Out-of-Distribution Harmful Text Detection
- HyperMem: Hypergraph Memory for Long-Term Conversations
- ReflectRM: Boosting Generative Reward Models via Self-Reflection within a Unified Judgment Framework
- SQL-Trail: Multi-Turn Reinforcement Learning with Interleaved Feedback for Text-to-SQL
- Turning Failures into Value: Negative Experience Replay for RLVR via Confidence Gating and Boundary Failure Sampling
- MiniRAG: A Lightweight RAG system with Small Language Models
- AG-GRPO: Answer-Guided GRPO for Masked Diffusion Language Models
- Beyond Majority Voting: Towards Fine-grained and More Reliable Reward Signal for Test-Time Reinforcement Learning
- DUAL RM: Beyond Rule-based Preference Reward Modeling via Meta-Reward
- CE-GPPO: Coordinating Entropy via Gradient-Preserving Clipping Policy Optimization in Reinforcement Learning
- Vocabulary Hijacking in LVLMs: Unveiling Critical Attention Heads by Excluding Inert Tokens to Mitigate Hallucination
- Confidence Should Be Calibrated More Than One Turn Deep
- NaviMaster: Learning a Unified Policy for GUI and Embodied Navigation Tasks
- Surprisal Minimisation over Goal-directed Alternatives Predicts Production Choice in Dialogue
- ERCThinker: Fast-Slow Thinking for Emotion Recognition in Conversation
- ConsistRM: Improving Generative Reward Models via Consistency-Aware Self-Training
- LoRA on the Go: Instance-level Dynamic LoRA Selection and Merging
- Rethinking Depression Prediction from a Fine-Grained Subscore Modeling Perspective via Multi-Task Learning
- FL-MSCL: A Unified Figurative Language Detection Model Driven by Multi-Type Signals and Contrastive Learning
- Libra-VLA: Achieving Learning Equilibrium via Asynchronous Coarse-to-Fine Dual-System
- HiEdit: Lifelong Model Editing with Hierarchical Reinforcement Learning
- On-the-Fly VLA Adaptation via Test-Time Reinforcement Learning
- VISTA: Verification In Sequential Turn-based Assessment
- Amadeus: Autoregressive Model with Bidirectional Attribute Modelling for Symbolic Music
- FedMental: Evaluating Federated Learning for Mental Health Detection from Social Media Data
- Edit-Aware Reward Modeling for Chinese Grammatical Error Correction
- Modeling Annotator Disagreement with Demographic-Aware Experts and Synthetic Perspectives
- Towards A Scanpath-Conditioned Surprisal Theory: Modeling Reader Information States
- From log π to π: Taming Divergence in Soft Clipping via Bilateral Decoupled Decay of Probability Gradient Weight
- Linear-Time and Constant-Memory Text Embeddings Based on Recurrent Language Models
- Who Plays Which Role When? Communication Role Dynamics for Peer Recognition and Team Performance Prediction
- When in Doubt, Consult: Expert Debate for Sexism Detection via Confidence-Based Routing
- On the Effect of Hyperparameters in Language Modeling for Computational Linguistics
- Wait! There’s a Way Out: A Decision Mechanism for Forecasting Conversational Derailment
- Evaluating Language Model Pluralism through In-the-wild Crowd Discussions
- Simulated Students in Tutoring Dialogues: Substance or Illusion?
- The African Languages Lab: A Collaborative Approach to Advancing Low-Resource African NLP
- Effects of Collaboration on the Performance of Interactive Theme Discovery Systems
- ARES: Adaptive Red-Teaming and End-to-End Repair of Policy-Reward System
- Credal Concept Bottleneck Models for Epistemic–Aleatoric Uncertainty Decomposition
- When Personalization Tricks Detectors: The Feature-Inversion Trap in Machine-Generated Text Detection
- SiLP: Enhancing Non-Dominant Language Capabilities with a Selective Bidirectional Language Projection Framework
- P-Check: Advancing Personalized Reward Model via Learning to Generate Dynamic Checklist
- RATE: Reviewer Profiling and Annotation-free Training for Expertise Ranking in Peer Review Systems
- Feeling Right vs. Being Right: How AI Sycophancy Affects Value-Laden Deliberation
- Through the Magnifying Glass: Adaptive Perception Magnification for Hallucination-Free VLM Decoding
- Beyond Fully Random Masking: Attention-Guided Denoising and Optimization for Diffusion Language Models
- GMoE: Global Mixture of Experts with Logit Propagation
- Fine-Grained Analysis of Shared Syntactic Mechanisms in Language Models
- Learning How and What to Memorize: Cognition-Inspired Two-Stage Optimization for Evolving Memory
- On the Role of Discriminative Models in Generative Relation Extraction
- Legal Judgment Prediction: A Reflection on the State of the Art
- GRAD: Generalizing RAG Adaptation with Decoding
- Why Do More Experts Fail? A Theoretical Analysis of Model Merging
- TRACE: A Corpus of Team Creative Discussions
- NSF-SciFy: Mining the NSF Awards Database for Scientific Claims
- Evaluating Temporal Consistency in Multi-Turn Language Models
- Overcoming Copyright Barriers in Corpus Distribution Through Non-Reversible Hashing
- An Information-Theoretic Foundation for the Subregular Hierarchy
- Generalizing Trust: Weak-to-Strong Trustworthiness in Language Models
- Reviving Iterative Refinement in Diffusion-based NER with an Initializer-Restorer Approach
- Reframing Responsibility: Framing-Aware Event Causality Identification
- DyBBT: Dynamic Balance via Bandit-inspired Targeting for Dialog Policy with Cognitive Dual Systems
- Why Mean Pooling Works: Quantifying Second-Order Collapse in Text Embeddings
- HalluCitation Matters: Revealing the Impact of Hallucinated References with 300 Hallucinated Papers in ACL Conferences
- Cell-Based Representation of Relational Binding in Language Models
- CIG: Measuring Conversational Information Gain in Deliberative Dialogues with Semantic Memory Dynamics
- TRAC: Teacher-Guided Token Reward with Adaptive Calibration for Robust Policy Optimization
- Follow: