Computation and Language
Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
4,561 to 4,620 of 11,332
Probe Generalization as Subspace Selection for OOD Deception Detection
Daniel Yoo, Adrians Skapars
cs.CLarXiv:2609.02893v12026Counterexamples as Feedback for Agent Self-Correction
Sidhesh Badrinarayan, Adithya Parthasarathy
cs.CLcs.AIarXiv:2609.02892v12026SenseBERT: Driving Some Sense into BERT
Yoav Levine, Barak Lenz, Or Dagan +6
cs.CLcs.LGarXiv:1908.05646v22019Before the Script, Set the Stage: How Worldview Simulation Amplifies Psychologically Grounded Persuasion in Multi-Turn Jailbreaking
Siyu Chen, Haoran Wang, Xiaojian Li +3
cs.CLcs.AIarXiv:2609.02414v12026BharatGather: A Culturally-Informed Benchmark Dataset for Misinformation and Fake News Detection in Indian Public Events
Parth Bramhecha, Smit Deshmukh, Sairaj Bodhale +2
cs.CLcs.LGarXiv:2609.02895v12026Personalizing Dialogue Agents via Meta-Learning
Zhaojiang Lin, Andrea Madotto, Chien-Sheng Wu +1
cs.CLcs.AIarXiv:1905.10033v12019Text Segmentation as a Supervised Learning Task
Omri Koshorek, Adir Cohen, Noam Mor +2
cs.CLarXiv:1803.09337v12018SFAD: Speculative Factuality-Aware Decoding
Guanqiao Chen, Di Wang, Lijie Hu
cs.CLarXiv:2609.00796v22026SimpleRL-Zoo: Investigating and Taming Zero Reinforcement Learning for Open Base Models in the Wild
Weihao Zeng, Yuzhen Huang, Qian Liu +4
cs.LGcs.AIcs.CLarXiv:2503.18892v32025Scaling Near-Optimal SFT-RL Annotation Budget Allocation from Small to Large LLMs
Jingtan Wang, Arun Verma, Xiaoqiang Lin +4
cs.CLcs.AIcs.LGarXiv:2609.01573v12026Debug like a Human: A Large Language Model Debugger via Verifying Runtime Execution Step-by-step
Li Zhong, Zilong Wang, Jingbo Shang
cs.SEcs.AIcs.CLarXiv:2402.16906v62024GEPA: Reflective Prompt Evolution Can Outperform Reinforcement Learning
Lakshya A Agrawal, Shangyin Tan, Dilara Soylu +14
cs.CLcs.AIcs.LGarXiv:2507.19457v22025Sequence-to-Sequence Knowledge Graph Completion and Question Answering
Apoorv Saxena, Adrian Kochsiek, Rainer Gemulla
cs.CLcs.LGarXiv:2203.10321v12022HealthBench: Evaluating Large Language Models Towards Improved Human Health
Rahul K. Arora, Jason Wei, Rebecca Soskin Hicks +9
cs.CLarXiv:2505.08775v12025LIMO: Less is More for Reasoning
Yixin Ye, Zhen Huang, Yang Xiao +3
cs.CLcs.AIarXiv:2502.03387v32025Fast-dLLM: Training-free Acceleration of Diffusion LLM by Enabling KV Cache and Parallel Decoding
Chengyue Wu, Hao Zhang, Shuchen Xue +6
cs.CLarXiv:2505.22618v32025The Entropy Mechanism of Reinforcement Learning for Reasoning Language Models
Ganqu Cui, Yuchen Zhang, Jiacheng Chen +14
cs.LGcs.AIcs.CLarXiv:2505.22617v12025MedGemma Technical Report
Andrew Sellergren, Sahar Kazemzadeh, Tiam Jaroensri +78
cs.AIcs.CLcs.CVarXiv:2507.05201v42025Vision-R1: Incentivizing Reasoning Capability in Multimodal Large Language Models
Wenxuan Huang, Bohan Jia, Zijie Zhai +7
cs.CVcs.AIcs.CLarXiv:2503.06749v42025Simple linear attention language models balance the recall-throughput tradeoff
Simran Arora, Sabri Eyuboglu, Michael Zhang +6
cs.CLcs.LGarXiv:2402.18668v22024Beyond the 80/20 Rule: High-Entropy Minority Tokens Drive Effective Reinforcement Learning for LLM Reasoning
Shenzhi Wang, Le Yu, Chang Gao +15
cs.CLcs.AIcs.LGarXiv:2506.01939v22025Optimus: Organizing Sentences via Pre-trained Modeling of a Latent Space
Chunyuan Li, Xiang Gao, Yuan Li +4
cs.CLcs.LGstat.MLarXiv:2004.04092v42020MMLongBench-Doc: Benchmarking Long-context Document Understanding with Visualizations
Yubo Ma, Yuhang Zang, Liangyu Chen +13
cs.CVcs.CLarXiv:2407.01523v32024Qwen3-Omni Technical Report
Jin Xu, Zhifang Guo, Hangrui Hu +35
cs.CLcs.AIcs.CVarXiv:2509.17765v12025CrossFit: A Few-shot Learning Challenge for Cross-task Generalization in NLP
Qinyuan Ye, Bill Yuchen Lin, Xiang Ren
cs.CLcs.LGarXiv:2104.08835v22021Phi-4-Mini Technical Report: Compact yet Powerful Multimodal Language Models via Mixture-of-LoRAs
Microsoft, :, Abdelrahman Abouelenin +73
cs.CLcs.AIcs.LGarXiv:2503.01743v22025Self-Distilled Reasoner: On-Policy Self-Distillation for Large Language Models
Siyan Zhao, Zhihui Xie, Mengchen Liu +4
cs.LGcs.CLarXiv:2601.18734v32026SCX Router: Streaming Zero-Shot Model Selection with a Decoder-KV Classifier and a Real-World Task Ontology
Ihor Stepanov, Aleksandr Smechov, Mykhailo Shtopko +2
cs.AIcs.CLarXiv:2609.02292v12026Linguistic Binding in Diffusion Models: Enhancing Attribute Correspondence through Attention Map Alignment
Royi Rassin, Eran Hirsch, Daniel Glickman +3
cs.CLcs.CVarXiv:2306.08877v32023BrowseComp: A Simple Yet Challenging Benchmark for Browsing Agents
Jason Wei, Zhiqing Sun, Spencer Papay +7
cs.CLarXiv:2504.12516v12025UI-TARS: Pioneering Automated GUI Interaction with Native Agents
Yujia Qin, Yining Ye, Junjie Fang +32
cs.AIcs.CLcs.CVarXiv:2501.12326v12025GoLLIE: Annotation Guidelines improve Zero-Shot Information-Extraction
Oscar Sainz, Iker García-Ferrero, Rodrigo Agerri +3
cs.CLarXiv:2310.03668v52023Dream 7B: Diffusion Large Language Models
Jiacheng Ye, Zhihui Xie, Lin Zheng +5
cs.CLarXiv:2508.15487v12025RoboTwin 2.0: A Scalable Data Generator and Benchmark with Strong Domain Randomization for Robust Bimanual Robotic Manipulation
Tianxing Chen, Zanxin Chen, Baijun Chen +23
cs.ROcs.AIcs.CLarXiv:2506.18088v22025Mem0: Building Production-Ready AI Agents with Scalable Long-Term Memory
Prateek Chhikara, Dev Khant, Saket Aryan +2
cs.CLcs.AIarXiv:2504.19413v12025MemeCULT-1K: Benchmarking South Asian Cultural Context and Humor Understanding of Multimodal Models
Tawsif Tashwar Dipto, Mehedi Ahamed, Radib Bin Kabir +5
cs.CLcs.CVarXiv:2609.01772v12026Group Sequence Policy Optimization
Chujie Zheng, Shixuan Liu, Mingze Li +9
cs.LGcs.AIcs.CLarXiv:2507.18071v22025A Token-level Reference-free Hallucination Detection Benchmark for Free-form Text Generation
Tianyu Liu, Yizhe Zhang, Chris Brockett +4
cs.CLcs.AIarXiv:2104.08704v22021Distilled Rapid Embedding Transfer (DRET): Parameter-Efficient Biomedical Domain Adaptation via Priority-Based Embedding Transfer
Girish Sundaram, Daniel Berleant
cs.CLarXiv:2609.02898v12026Under the Hood: Using Diagnostic Classifiers to Investigate and Improve how Language Models Track Agreement Information
Mario Giulianelli, Jacqueline Harding, Florian Mohnert +2
cs.CLcs.AIarXiv:1808.08079v32018DisclosureBeta: A Measurement-Channel Theory for Regime-Conditioned Betas from LLM-Read Risk Disclosures
Ping Kuen Wong
q-fin.RMcs.CLq-fin.GNarXiv:2609.02900v12026Give Us the Facts: Enhancing Large Language Models with Knowledge Graphs for Fact-aware Language Modeling
Linyao Yang, Hongyang Chen, Zhao Li +2
cs.CLcs.AIarXiv:2306.11489v22023RL-ADA: A World-Feedback Framework for Adversarially Robust Enterprise Dialogue Agents
Ram Narayanan, Harshit Rajgarhia, Abhishek Mukherji
cs.CLarXiv:2609.02902v12026Dual-Form ASR: Semantics-Aware Inverse Text Normalization for Chinese Speech Recognition
Fengrun Zhang, Li Fu, Wangjin Zhou +3
cs.CLcs.SDarXiv:2609.02901v12026SGD-KV: Summarization Guided KV Cache Compression
Zeyu Liu, Woomin Song, Xuandi Fu +5
cs.CLarXiv:2609.03235v12026Investigating Linear Probe Robustness to Linguistic Register, Medical Specialty, and Corpus Shifts in Medical QA
Nishant Mishra, Ameen Abu-Hanna, Iacer Calixto
cs.CLcs.LGarXiv:2609.01361v12026Creative Generation via Multi-Agent Debate: Does Debate Suppress Diversity?
Tien Anh Nguyen, Khanh-Binh Nguyen, Van Dai Do +2
cs.CLarXiv:2609.00683v12026An Empirical Study of Mamba-based Language Models
Roger Waleffe, Wonmin Byeon, Duncan Riach +13
cs.LGcs.CLarXiv:2406.07887v12024It's All in the Name: Mitigating Gender Bias with Name-Based Counterfactual Data Substitution
Rowan Hall Maudslay, Hila Gonen, Ryan Cotterell +1
cs.CLcs.CYarXiv:1909.00871v32019TEIDAN: A Multilingual Multiparty Dialogue Corpus
Taiga Mori, Koji Inoue, Mikey Elmers +2
cs.CLcs.HCarXiv:2609.00802v12026Learning to select data for transfer learning with Bayesian Optimization
Sebastian Ruder, Barbara Plank
cs.CLcs.LGarXiv:1707.05246v12017TinyLLaVA: A Framework of Small-scale Large Multimodal Models
Baichuan Zhou, Ying Hu, Xi Weng +5
cs.LGcs.CLarXiv:2402.14289v12024A-MEM: Agentic Memory for LLM Agents
Wujiang Xu, Zujie Liang, Kai Mei +3
cs.CLcs.HCarXiv:2502.12110v112025Large Language Diffusion Models
Shen Nie, Fengqi Zhu, Zebin You +7
cs.CLcs.LGarXiv:2502.09992v32025Auxiliary-Loss-Free Load Balancing Strategy for Mixture-of-Experts
Lean Wang, Huazuo Gao, Chenggang Zhao +2
cs.LGcs.CLarXiv:2408.15664v12024Summarizing Opinions: Aspect Extraction Meets Sentiment Prediction and They Are Both Weakly Supervised
Stefanos Angelidis, Mirella Lapata
cs.CLcs.AIcs.LGarXiv:1808.08858v12018Universal Self-Consistency for Large Language Model Generation
Xinyun Chen, Renat Aksitov, Uri Alon +7
cs.CLcs.AIarXiv:2311.17311v12023Qwen3 Embedding: Advancing Text Embedding and Reranking Through Foundation Models
Yanzhao Zhang, Mingxin Li, Dingkun Long +9
cs.CLarXiv:2506.05176v32025SemEval-2020 Task 9: Overview of Sentiment Analysis of Code-Mixed Tweets
Parth Patwa, Gustavo Aguilar, Sudipta Kar +6
cs.CLarXiv:2008.04277v12020Qwen2.5-Omni Technical Report
Jin Xu, Zhifang Guo, Jinzheng He +11
cs.CLcs.CVcs.SDarXiv:2503.20215v12025