Computation and Language
Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
10,681 to 10,740 of 11,263
Variable-Width Transformers
Zhaofeng Wu, Oliver Sieberling, Shawn Tan +3
cs.CLarXiv:2606.18246v12026MCompassRAG: Topic Metadata as a Semantic Compass for Paragraph-Level Retrieval
Amirhossein Abaskohi, Raymond Li, Gaetano Cimino +3
cs.CLcs.IRarXiv:2606.18508v12026SproutRAG: Attention-Guided Tree Search with Progressive Embeddings for Long-Document RAG
Amirhossein Abaskohi, Issam H. Laradji, Peter West +1
cs.CLcs.IRarXiv:2606.18381v12026Morpheus: A Morphology-Aware Neural Tokenizer and Word Embedder for Turkish
Tolga Şakar
cs.CLcs.AIarXiv:2606.18717v12026Sumi: Open Uniform Diffusion Language Model from Scratch
Mengyu Ye, Keito Kudo, Wataru Ikeda +3
cs.CLcs.LGarXiv:2606.19005v12026PerceptionDLM: Parallel Region Perception with Multimodal Diffusion Language Models
Yueyi Sun, Yuhao Wang, Jason Li +8
cs.CVcs.AIcs.CLarXiv:2606.19534v12026HydraHead: From Head-Level Functional Heterogeneity to Specialized Attention Hybridization
Zhentao Tan, Wei Chen, Jingyi Shen +4
cs.CLarXiv:2606.20097v12026EnterpriseClawBench: Benchmarking Agents from Real Workplace Sessions
Jincheng Zhong, Weizhi Wang, Che Jiang +5
cs.CLcs.SEarXiv:2606.23654v12026PhoneBuddy: Training Open Models for Agentic Phone Use
Zhengyang Tang, Xin Lai, Pengyuan Lyu +23
cs.CLcs.AIarXiv:2606.23049v22026VeriEvol: Scaling Multimodal Mathematical Reasoning via Verifiable Evol-Instruct
Haoling Li, Kai Zheng, Jie Wu +4
cs.AIcs.CLcs.CVarXiv:2606.23543v12026OpenBioRQ: Unsolved Biomedical Research Questions for Agents
Minbyul Jeong
cs.CLarXiv:2606.21959v12026Lexical Consensus: Grounded Word Learning and Shared Meaning in Artificial Agents
Patricio M. Vera
cs.CLcs.AIarXiv:2606.22207v12026Deeper is Not Always Better: Mitigating the Alignment Tax via Confident Layer Decoding
Xuanming Zhang, Sining Zhoubian, Yuxuan Chen +8
cs.CLarXiv:2606.21906v12026Interleaved Speech Language Models Latently Work In Text
Talia Sternberg, Gallil Maimon, Yossi Adi
cs.CLcs.LGcs.SDarXiv:2606.22473v12026Toward Open Weight Models Without Risks: Separating Public and Private Capabilities in LLMs
Charbel El Feghali, Arkil Patel, Nicholas Meade +3
cs.CRcs.CLarXiv:2606.21638v12026From Entity Mentions to Tone: An LLM-Based Pipeline for Media Bias Analysis
Klesti Hoxha, Olti Qirici
cs.CLarXiv:2608.17454v12026PrivacyAlign: Contextual Privacy Alignment for LLM Agents
Manveer Singh Tamber, Abhay Puri, Marc-Etienne Brunet +3
cs.CLcs.AIcs.IRarXiv:2606.21710v12026BioMatrix: Towards a Comprehensive Biological Foundation Model Spanning the Modality Matrix of Sequences, Structures, and Language
Qizhi Pei, Zhimeng Zhou, Yi Duan +9
cs.CLcs.AIcs.LGarXiv:2606.22138v12026Balanced Aggregation: Understanding and Fixing Aggregation Bias in GRPO
Zhiyuan Zeng, Jiameng Huang, Zhangyue Yin +8
cs.LGcs.AIcs.CLarXiv:2605.04077v12026Taming Actor-Observer Asymmetry in Agents via Dialectical Alignment
Bobo Li, Rui Wu, Zibo Ji +5
cs.CLcs.AIcs.CYarXiv:2604.19548v12026TexOCR: Advancing Document OCR Models for Compilable Page-to-LaTeX Reconstruction
Chengye Wang, Lin Fu, Zexi Kuang +1
cs.CLarXiv:2604.22880v12026Talker-T2AV: Joint Talking Audio-Video Generation with Autoregressive Diffusion Modeling
Zhen Ye, Xu Tan, Aoxiong Yin +8
cs.CVcs.CLcs.MMarXiv:2604.23586v22026Characterizing Narrative Content in Web-scale LLM Pretraining Data
Teagan Johnson, Elliott Ash, Andrew Piper +1
cs.CLarXiv:2606.19468v12026Skill2Query: Exploiting Skill Structure to Generate Pseudo-Queries for Agent Skill Retrieval
Lihui Ding, Zihan Guo, Bingwei Lu +5
cs.CLcs.IRarXiv:2608.16071v12026Multi-turn Conversational AI from Text to Multimodal Interaction: Data, Models, Evaluation, and Open Challenges
Syeda Faiza Ahmed, Zien Sheikh Ali, Hunzalah Hassan Bhatti +2
cs.CLcs.AIcs.SDarXiv:2608.17605v12026LLM-Derived Preference Judgments Are Not Self-Consistent
Matthew T. Ford, Francis Bahk, Jingjing Wang +4
cs.AIcs.CLarXiv:2608.17644v12026Do Large Language Models Play Six Degrees of Separation? Measuring Topological Compression in Long-Context Manifolds
Md. Faiyaz Abdullah Sayeedi
cs.CLarXiv:2608.17950v12026Whether LLMs Can Navigate Beliefs and Facts Depends on How You Phrase It
Quang Minh Nguyen, Luis Frentzen Salim
cs.CLarXiv:2608.17809v12026TraceSQL: Traceable Answerability Estimation for Reference-Free Text-to-SQL Verification
Neelesh Kumar Shukla, Debasmita Panda, Srutanik Bhaduri +2
cs.CLarXiv:2608.17795v12026SpeechSense: A Paralinguistic-Focused Dataset for Fine-Grained Speech Sentiment Analysis
Shicheng Ma, Wenqian Cui, Irwin King
cs.CLcs.MMcs.SDarXiv:2608.17931v12026Multi-Agent AI System for Radiology Report Structuring and Quality Assurance with Independent Radiologist Evaluation
Iryna Hartsock, Cesar Lam, Christopher Otteni +4
cs.CLarXiv:2608.18072v12026Judge, Retrieve, or Abstain: Uncertainty-Guarded LLM Judging with Provable Risk Guarantees
Sher Badshah, Ali Emami, Hassan Sajjad
cs.CLarXiv:2608.17994v12026When Writing Style Drifts: Benchmarking Authorship Verification under Distribution Shifts in Genre, Time and the AI-Era
Lotta Kiefer, Brisca Balthes, Christoph Leiter +3
cs.CLarXiv:2608.17979v12026BayesPrompt: human readable prompts that make sense
Franky Kevin Nando Tezoh, Ali Hussaini Umar, Alessandro Laio +2
cs.CLarXiv:2608.17866v12026From Global Benchmarks to Local Evaluations: Benchmarking LLMs for the German Public Sector
Camilla Dalerci, Thilo Michael, Robin Schaefer +1
cs.CLarXiv:2608.17827v12026On the Fragility of Self-Improving Agents: Variance, Task Order, and Underspecification
Qinyuan Ye, Yu Li, Yada Pruksachatkun +2
cs.AIcs.CLcs.LGarXiv:2608.18066v12026An Empirical Study of Reward Specification and Benchmark Reliability in GRPO-based LLM Unlearning
Rubén Balbastre, Juan Manuel Orduña, Mariano Pérez
cs.LGcs.CLarXiv:2608.17804v12026Interpretable Humans, Alien LLMs: Expert Analysis of Latent Structures in Assessment Responses
Alona Strugatski, Licol Zeinfeld, Jason Cooper +3
cs.CLcs.AIcs.HCarXiv:2608.17810v12026Efficient Pre-Training with Token Superposition
Bowen Peng, Théo Gigant, Jeffrey Quesnelle
cs.CLarXiv:2605.06546v22026Heterogeneous Scientific Foundation Model Collaboration
Zihao Li, Jiaru Zou, Feihao Fang +6
cs.AIcs.CLcs.LGarXiv:2604.27351v12026Synthetic Computers at Scale for Long-Horizon Productivity Simulation
Tao Ge, Baolin Peng, Hao Cheng +1
cs.AIcs.CLcs.LGarXiv:2604.28181v12026MiA-Signature: Approximating Global Activation for Long-Context Understanding
Yuqing Li, Jiangnan Li, Mo Yu +3
cs.CLarXiv:2605.06416v12026MobileEgo Anywhere: Open Infrastructure for long horizon egocentric data on commodity hardware
Senthil Palanisamy, Abhishek Anand, Satpal Singh Rathore +3
cs.CVcs.CLarXiv:2605.05945v72026RouteProfile: Graph-Based Profiling for Cold-Start LLM Routing
Jingjun Xu, Hongji Pu, Tao Feng +3
cs.NIcs.CLarXiv:2605.00180v22026Chain of Evidence: Pixel-Level Visual Attribution for Iterative Retrieval-Augmented Generation
Peiyang Liu, Ziqiang Cui, Xi Wang +2
cs.CVcs.AIcs.CLarXiv:2605.01284v22026SpecBlock: Block-Iterative Speculative Decoding with Dynamic Tree Drafting
Weijie Shi, Qiang Xu, Fan Deng +9
cs.CLarXiv:2605.07243v22026TextLDM: Language Modeling with Continuous Latent Diffusion
Jiaxiu Jiang, Jingjing Ren, Wenbo Li +10
cs.CLarXiv:2605.07748v12026Queryable LoRA: Instruction-Regularized Routing Over Shared Low-Rank Update Atoms
Omatharv Bharat Vaidya, Connor T. Jerzak, Nhat Ho +1
cs.LGcs.CLstat.MLarXiv:2605.08423v12026Safe, or Simply Incapable? Rethinking Safety Evaluation for Phone-Use Agents
Zhengyang Tang, Yi Zhang, Chenxin Li +18
cs.CLcs.AIcs.LGarXiv:2605.07630v12026Faithfulness Metrics Don't Measure Faithfulness: A Meta-Evaluation with Ground Truth
Yoav Gur-Arieh, Ana Marasović, Mor Geva
cs.CLarXiv:2605.25052v12026ZeroUnlearn: Few-Shot Knowledge Unlearning in Large Language Models
Yujie Lin, Chengyi Yang, Zhishang Xiang +2
cs.LGcs.AIcs.CLarXiv:2605.18879v32026Safety Alignment as Continual Learning: Mitigating the Alignment Tax via Orthogonal Gradient Projection
Guanglong Sun, Siyuan Zhang, Liyuan Wang +3
cs.LGcs.CLarXiv:2602.07892v22026Trust Is Not Enough: Influence Calibration for On-Policy Self-Distillation in Agentic RL
Qizhen Lan, Xi Xiao, Xiangchen Guan +4
cs.AIcs.CLarXiv:2608.14945v12026A Causal Language Modeling Detour Improves Encoder Continued Pretraining
Rian Touchent, Eric de la Clergerie
cs.CLcs.AIarXiv:2605.12438v12026The Unlearnability Phenomenon in RLVR for Language Models
Yulin Chen, He He, Chen Zhao
cs.LGcs.CLarXiv:2605.16787v12026ORBIT: Preserving Foundational Language Capabilities in GenRetrieval via Origin-Regulated Merging
Neha Verma, Nikhil Mehta, Shao-Chuan Wang +7
cs.CLcs.IRcs.LGarXiv:2605.12419v12026PresentAgent-2: Towards Generalist Multimodal Presentation Agents
Wei Wu, Ziyang Xu, Zeyu Zhang +2
cs.CVcs.CLarXiv:2605.11363v12026PreScam: A Benchmark for Predicting Scam Progression from Early Conversations
Weixiang Sun, Shang Ma, Yiyang Li +5
cs.CLarXiv:2605.12243v12026LiSA: Lifelong Safety Adaptation via Conservative Policy Induction
Minbeom Kim, Lesly Miculicich, Bhavana Dalvi Mishra +6
cs.LGcs.CLcs.CRarXiv:2605.14454v12026ATLAS: Agentic or Latent Visual Reasoning? One Word is Enough for Both
Ziyu Guo, Rain Liu, Xinyan Chen +1
cs.CVcs.AIcs.CLarXiv:2605.15198v12026