Computation and Language

Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

4,561 to 4,620 of 11,332

  1. Probe Generalization as Subspace Selection for OOD Deception Detection

    Daniel Yoo, Adrians Skapars

    cs.CLarXiv:2609.02893v12026
  2. Counterexamples as Feedback for Agent Self-Correction

    Sidhesh Badrinarayan, Adithya Parthasarathy

    cs.CLcs.AIarXiv:2609.02892v12026
  3. SenseBERT: Driving Some Sense into BERT

    Yoav Levine, Barak Lenz, Or Dagan +6

    cs.CLcs.LGarXiv:1908.05646v22019
  4. Before the Script, Set the Stage: How Worldview Simulation Amplifies Psychologically Grounded Persuasion in Multi-Turn Jailbreaking

    Siyu Chen, Haoran Wang, Xiaojian Li +3

    cs.CLcs.AIarXiv:2609.02414v12026
  5. BharatGather: A Culturally-Informed Benchmark Dataset for Misinformation and Fake News Detection in Indian Public Events

    Parth Bramhecha, Smit Deshmukh, Sairaj Bodhale +2

    cs.CLcs.LGarXiv:2609.02895v12026
  6. Personalizing Dialogue Agents via Meta-Learning

    Zhaojiang Lin, Andrea Madotto, Chien-Sheng Wu +1

    cs.CLcs.AIarXiv:1905.10033v12019
  7. Text Segmentation as a Supervised Learning Task

    Omri Koshorek, Adir Cohen, Noam Mor +2

    cs.CLarXiv:1803.09337v12018
  8. SFAD: Speculative Factuality-Aware Decoding

    Guanqiao Chen, Di Wang, Lijie Hu

    cs.CLarXiv:2609.00796v22026
  9. SimpleRL-Zoo: Investigating and Taming Zero Reinforcement Learning for Open Base Models in the Wild

    Weihao Zeng, Yuzhen Huang, Qian Liu +4

    cs.LGcs.AIcs.CLarXiv:2503.18892v32025
  10. Scaling Near-Optimal SFT-RL Annotation Budget Allocation from Small to Large LLMs

    Jingtan Wang, Arun Verma, Xiaoqiang Lin +4

    cs.CLcs.AIcs.LGarXiv:2609.01573v12026
  11. Debug like a Human: A Large Language Model Debugger via Verifying Runtime Execution Step-by-step

    Li Zhong, Zilong Wang, Jingbo Shang

    cs.SEcs.AIcs.CLarXiv:2402.16906v62024
  12. GEPA: Reflective Prompt Evolution Can Outperform Reinforcement Learning

    Lakshya A Agrawal, Shangyin Tan, Dilara Soylu +14

    cs.CLcs.AIcs.LGarXiv:2507.19457v22025
  13. Sequence-to-Sequence Knowledge Graph Completion and Question Answering

    Apoorv Saxena, Adrian Kochsiek, Rainer Gemulla

    cs.CLcs.LGarXiv:2203.10321v12022
  14. HealthBench: Evaluating Large Language Models Towards Improved Human Health

    Rahul K. Arora, Jason Wei, Rebecca Soskin Hicks +9

    cs.CLarXiv:2505.08775v12025
  15. LIMO: Less is More for Reasoning

    Yixin Ye, Zhen Huang, Yang Xiao +3

    cs.CLcs.AIarXiv:2502.03387v32025
  16. Fast-dLLM: Training-free Acceleration of Diffusion LLM by Enabling KV Cache and Parallel Decoding

    Chengyue Wu, Hao Zhang, Shuchen Xue +6

    cs.CLarXiv:2505.22618v32025
  17. The Entropy Mechanism of Reinforcement Learning for Reasoning Language Models

    Ganqu Cui, Yuchen Zhang, Jiacheng Chen +14

    cs.LGcs.AIcs.CLarXiv:2505.22617v12025
  18. MedGemma Technical Report

    Andrew Sellergren, Sahar Kazemzadeh, Tiam Jaroensri +78

    cs.AIcs.CLcs.CVarXiv:2507.05201v42025
  19. Vision-R1: Incentivizing Reasoning Capability in Multimodal Large Language Models

    Wenxuan Huang, Bohan Jia, Zijie Zhai +7

    cs.CVcs.AIcs.CLarXiv:2503.06749v42025
  20. Simple linear attention language models balance the recall-throughput tradeoff

    Simran Arora, Sabri Eyuboglu, Michael Zhang +6

    cs.CLcs.LGarXiv:2402.18668v22024
  21. Beyond the 80/20 Rule: High-Entropy Minority Tokens Drive Effective Reinforcement Learning for LLM Reasoning

    Shenzhi Wang, Le Yu, Chang Gao +15

    cs.CLcs.AIcs.LGarXiv:2506.01939v22025
  22. Optimus: Organizing Sentences via Pre-trained Modeling of a Latent Space

    Chunyuan Li, Xiang Gao, Yuan Li +4

    cs.CLcs.LGstat.MLarXiv:2004.04092v42020
  23. MMLongBench-Doc: Benchmarking Long-context Document Understanding with Visualizations

    Yubo Ma, Yuhang Zang, Liangyu Chen +13

    cs.CVcs.CLarXiv:2407.01523v32024
  24. Qwen3-Omni Technical Report

    Jin Xu, Zhifang Guo, Hangrui Hu +35

    cs.CLcs.AIcs.CVarXiv:2509.17765v12025
  25. CrossFit: A Few-shot Learning Challenge for Cross-task Generalization in NLP

    Qinyuan Ye, Bill Yuchen Lin, Xiang Ren

    cs.CLcs.LGarXiv:2104.08835v22021
  26. Phi-4-Mini Technical Report: Compact yet Powerful Multimodal Language Models via Mixture-of-LoRAs

    Microsoft, :, Abdelrahman Abouelenin +73

    cs.CLcs.AIcs.LGarXiv:2503.01743v22025
  27. Self-Distilled Reasoner: On-Policy Self-Distillation for Large Language Models

    Siyan Zhao, Zhihui Xie, Mengchen Liu +4

    cs.LGcs.CLarXiv:2601.18734v32026
  28. SCX Router: Streaming Zero-Shot Model Selection with a Decoder-KV Classifier and a Real-World Task Ontology

    Ihor Stepanov, Aleksandr Smechov, Mykhailo Shtopko +2

    cs.AIcs.CLarXiv:2609.02292v12026
  29. Linguistic Binding in Diffusion Models: Enhancing Attribute Correspondence through Attention Map Alignment

    Royi Rassin, Eran Hirsch, Daniel Glickman +3

    cs.CLcs.CVarXiv:2306.08877v32023
  30. BrowseComp: A Simple Yet Challenging Benchmark for Browsing Agents

    Jason Wei, Zhiqing Sun, Spencer Papay +7

    cs.CLarXiv:2504.12516v12025
  31. UI-TARS: Pioneering Automated GUI Interaction with Native Agents

    Yujia Qin, Yining Ye, Junjie Fang +32

    cs.AIcs.CLcs.CVarXiv:2501.12326v12025
  32. GoLLIE: Annotation Guidelines improve Zero-Shot Information-Extraction

    Oscar Sainz, Iker García-Ferrero, Rodrigo Agerri +3

    cs.CLarXiv:2310.03668v52023
  33. Dream 7B: Diffusion Large Language Models

    Jiacheng Ye, Zhihui Xie, Lin Zheng +5

    cs.CLarXiv:2508.15487v12025
  34. RoboTwin 2.0: A Scalable Data Generator and Benchmark with Strong Domain Randomization for Robust Bimanual Robotic Manipulation

    Tianxing Chen, Zanxin Chen, Baijun Chen +23

    cs.ROcs.AIcs.CLarXiv:2506.18088v22025
  35. Mem0: Building Production-Ready AI Agents with Scalable Long-Term Memory

    Prateek Chhikara, Dev Khant, Saket Aryan +2

    cs.CLcs.AIarXiv:2504.19413v12025
  36. MemeCULT-1K: Benchmarking South Asian Cultural Context and Humor Understanding of Multimodal Models

    Tawsif Tashwar Dipto, Mehedi Ahamed, Radib Bin Kabir +5

    cs.CLcs.CVarXiv:2609.01772v12026
  37. Group Sequence Policy Optimization

    Chujie Zheng, Shixuan Liu, Mingze Li +9

    cs.LGcs.AIcs.CLarXiv:2507.18071v22025
  38. A Token-level Reference-free Hallucination Detection Benchmark for Free-form Text Generation

    Tianyu Liu, Yizhe Zhang, Chris Brockett +4

    cs.CLcs.AIarXiv:2104.08704v22021
  39. Distilled Rapid Embedding Transfer (DRET): Parameter-Efficient Biomedical Domain Adaptation via Priority-Based Embedding Transfer

    Girish Sundaram, Daniel Berleant

    cs.CLarXiv:2609.02898v12026
  40. Under the Hood: Using Diagnostic Classifiers to Investigate and Improve how Language Models Track Agreement Information

    Mario Giulianelli, Jacqueline Harding, Florian Mohnert +2

    cs.CLcs.AIarXiv:1808.08079v32018
  41. DisclosureBeta: A Measurement-Channel Theory for Regime-Conditioned Betas from LLM-Read Risk Disclosures

    Ping Kuen Wong

    q-fin.RMcs.CLq-fin.GNarXiv:2609.02900v12026
  42. Give Us the Facts: Enhancing Large Language Models with Knowledge Graphs for Fact-aware Language Modeling

    Linyao Yang, Hongyang Chen, Zhao Li +2

    cs.CLcs.AIarXiv:2306.11489v22023
  43. RL-ADA: A World-Feedback Framework for Adversarially Robust Enterprise Dialogue Agents

    Ram Narayanan, Harshit Rajgarhia, Abhishek Mukherji

    cs.CLarXiv:2609.02902v12026
  44. Dual-Form ASR: Semantics-Aware Inverse Text Normalization for Chinese Speech Recognition

    Fengrun Zhang, Li Fu, Wangjin Zhou +3

    cs.CLcs.SDarXiv:2609.02901v12026
  45. SGD-KV: Summarization Guided KV Cache Compression

    Zeyu Liu, Woomin Song, Xuandi Fu +5

    cs.CLarXiv:2609.03235v12026
  46. Investigating Linear Probe Robustness to Linguistic Register, Medical Specialty, and Corpus Shifts in Medical QA

    Nishant Mishra, Ameen Abu-Hanna, Iacer Calixto

    cs.CLcs.LGarXiv:2609.01361v12026
  47. Creative Generation via Multi-Agent Debate: Does Debate Suppress Diversity?

    Tien Anh Nguyen, Khanh-Binh Nguyen, Van Dai Do +2

    cs.CLarXiv:2609.00683v12026
  48. An Empirical Study of Mamba-based Language Models

    Roger Waleffe, Wonmin Byeon, Duncan Riach +13

    cs.LGcs.CLarXiv:2406.07887v12024
  49. It's All in the Name: Mitigating Gender Bias with Name-Based Counterfactual Data Substitution

    Rowan Hall Maudslay, Hila Gonen, Ryan Cotterell +1

    cs.CLcs.CYarXiv:1909.00871v32019
  50. TEIDAN: A Multilingual Multiparty Dialogue Corpus

    Taiga Mori, Koji Inoue, Mikey Elmers +2

    cs.CLcs.HCarXiv:2609.00802v12026
  51. Learning to select data for transfer learning with Bayesian Optimization

    Sebastian Ruder, Barbara Plank

    cs.CLcs.LGarXiv:1707.05246v12017
  52. TinyLLaVA: A Framework of Small-scale Large Multimodal Models

    Baichuan Zhou, Ying Hu, Xi Weng +5

    cs.LGcs.CLarXiv:2402.14289v12024
  53. A-MEM: Agentic Memory for LLM Agents

    Wujiang Xu, Zujie Liang, Kai Mei +3

    cs.CLcs.HCarXiv:2502.12110v112025
  54. Large Language Diffusion Models

    Shen Nie, Fengqi Zhu, Zebin You +7

    cs.CLcs.LGarXiv:2502.09992v32025
  55. Auxiliary-Loss-Free Load Balancing Strategy for Mixture-of-Experts

    Lean Wang, Huazuo Gao, Chenggang Zhao +2

    cs.LGcs.CLarXiv:2408.15664v12024
  56. Summarizing Opinions: Aspect Extraction Meets Sentiment Prediction and They Are Both Weakly Supervised

    Stefanos Angelidis, Mirella Lapata

    cs.CLcs.AIcs.LGarXiv:1808.08858v12018
  57. Universal Self-Consistency for Large Language Model Generation

    Xinyun Chen, Renat Aksitov, Uri Alon +7

    cs.CLcs.AIarXiv:2311.17311v12023
  58. Qwen3 Embedding: Advancing Text Embedding and Reranking Through Foundation Models

    Yanzhao Zhang, Mingxin Li, Dingkun Long +9

    cs.CLarXiv:2506.05176v32025
  59. SemEval-2020 Task 9: Overview of Sentiment Analysis of Code-Mixed Tweets

    Parth Patwa, Gustavo Aguilar, Sudipta Kar +6

    cs.CLarXiv:2008.04277v12020
  60. Qwen2.5-Omni Technical Report

    Jin Xu, Zhifang Guo, Jinzheng He +11

    cs.CLcs.CVcs.SDarXiv:2503.20215v12025