Computation and Language

Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

4,021 to 4,080 of 11,233

  1. Simple Applications of BERT for Ad Hoc Document Retrieval

    Wei Yang, Haotian Zhang, Jimmy Lin

    cs.IRcs.CLarXiv:1903.10972v12019
  2. A Comprehensive Exploration on WikiSQL with Table-Aware Word Contextualization

    Wonseok Hwang, Jinyeong Yim, Seunghyun Park +1

    cs.CLarXiv:1902.01069v22019
  3. Large Language Models Are Latent Variable Models: Explaining and Finding Good Demonstrations for In-Context Learning

    Xinyi Wang, Wanrong Zhu, Michael Saxon +2

    cs.CLcs.AIcs.LGarXiv:2301.11916v42023
  4. MiMo-V2-Flash Technical Report

    Xiaomi LLM-Core Team, :, Bangjun Xiao +124

    cs.CLcs.AIarXiv:2601.02780v22026
  5. ShinkaEvolve: Towards Open-Ended And Sample-Efficient Program Evolution

    Robert Tjarko Lange, Yuki Imajuku, Edoardo Cetin

    cs.CLcs.LGarXiv:2509.19349v12025
  6. MEM1: Learning to Synergize Memory and Reasoning for Efficient Long-Horizon Agents

    Zijian Zhou, Ao Qu, Zhaoxuan Wu +6

    cs.CLcs.AIcs.IRarXiv:2506.15841v22025
  7. Generalizing Verifiable Instruction Following

    Valentina Pyatkin, Saumya Malik, Victoria Graf +5

    cs.CLarXiv:2507.02833v32025
  8. MMSI-Bench: A Benchmark for Multi-Image Spatial Intelligence

    Sihan Yang, Runsen Xu, Yiman Xie +10

    cs.CVcs.CLarXiv:2505.23764v32025
  9. Supervised Speech Separation Based on Deep Learning: An Overview

    DeLiang Wang, Jitong Chen

    cs.CLcs.LGcs.NEarXiv:1708.07524v22017
  10. Ready to Speak: Aligning LLMs for TTS-Friendly Text Generation

    Thibaut Thonet, Jos Rozen, Laurent Besacier

    cs.CLarXiv:2609.01246v12026
  11. BROS: A Pre-trained Language Model Focusing on Text and Layout for Better Key Information Extraction from Documents

    Teakgyu Hong, Donghyun Kim, Mingi Ji +3

    cs.CLarXiv:2108.04539v52021
  12. An Illusion of Progress? Assessing the Current State of Web Agents

    Tianci Xue, Weijian Qi, Tianneng Shi +5

    cs.AIcs.CLarXiv:2504.01382v42025
  13. SimpleVLA-RL: Scaling VLA Training via Reinforcement Learning

    Haozhan Li, Yuxin Zuo, Jiale Yu +18

    cs.ROcs.AIcs.CLarXiv:2509.09674v12025
  14. MiMo-Audio: Audio Language Models are Few-Shot Learners

    Xiaomi LLM-Core Team, :, Dong Zhang +98

    cs.CLcs.SDeess.ASarXiv:2512.23808v12025
  15. Semantic Evaluation for Text-to-SQL with Distilled Test Suites

    Ruiqi Zhong, Tao Yu, Dan Klein

    cs.CLcs.AIarXiv:2010.02840v12020
  16. Scaling Latent Reasoning via Looped Language Models

    Rui-Jie Zhu, Zixuan Wang, Kai Hua +30

    cs.CLarXiv:2510.25741v52025
  17. Skywork-Reward-V2: Scaling Preference Data Curation via Human-AI Synergy

    Chris Yuhao Liu, Liang Zeng, Yuzhen Xiao +9

    cs.CLcs.AIcs.LGarXiv:2507.01352v32025
  18. Learning Global Features for Coreference Resolution

    Sam Wiseman, Alexander M. Rush, Stuart M. Shieber

    cs.CLarXiv:1604.03035v12016
  19. Multi-Modal Masked Autoencoders for Medical Vision-and-Language Pre-Training

    Zhihong Chen, Yuhao Du, Jinpeng Hu +4

    cs.CVcs.CLarXiv:2209.07098v12022
  20. Learning to Reason without External Rewards

    Xuandong Zhao, Zhewei Kang, Aosong Feng +2

    cs.LGcs.CLarXiv:2505.19590v52025
  21. Backdoor Learning in Language Models and Vision-Language Models

    Weimin Lyu

    cs.CLcs.AIarXiv:2608.18095v12026
  22. From Inference to Adaptation: A Unified Optimal Transport View of Vision Language Model

    Qi Yu, Zhichen Zeng, Katherine Tieu +8

    cs.CVcs.AIcs.CLarXiv:2608.18339v12026
  23. Debiased Inference for AI-Generated Data without Gold-Standard Labels: Identification via Multiple Imperfect Measurements

    Naoki Egami, Sooahn Shin

    stat.MEcs.AIcs.CLarXiv:2608.18294v12026
  24. Against Political Polarization: A Unified Framework for Tracing Evolving Political Ideologies on Social Media

    Yijie Xu, Chao Wang, Hui Xiong

    cs.SIcs.AIcs.CLarXiv:2608.17987v12026
  25. Code as Representation: A Compilable Parsing Paradigm for Academic Documents

    Rihui Jin, Jun Wang, chengyuan zhu +11

    cs.CVcs.CLarXiv:2608.17550v12026
  26. Decomposition Attacks Across Unlinkable Identities: Limits of Stateful Defenses for LLM Services

    Bowen Sun, Zhengyue Zhao, Xiaogeng Liu +2

    cs.CRcs.CLarXiv:2608.17445v12026
  27. PCA-guided Activation Scaling for Monotonic Bidirectional Control over LLM Sycophancy

    Zheng Chen, Zhaoxin Feng, Yip Tin Po +3

    cs.CLarXiv:2608.16650v12026
  28. HalluTracer: Hallucination Detection via Depth-Averaging Truth Signals

    Zhihao Guo, Zonghan Wu, Huan Huo +6

    cs.CLcs.AIarXiv:2608.16353v12026
  29. HyperSkill: Self-Evolving LLM Agents via Hypergraph-Structured Skill Memory

    Ruiyao Xu, Tiankai Yang, Wei-Chieh Huang

    cs.CLarXiv:2608.16114v12026
  30. Human language reveals a universal positivity bias

    Peter Sheridan Dodds, Eric M. Clark, Suma Desu +11

    physics.soc-phcs.CLcs.SIarXiv:1406.3855v12014
  31. When Do Concepts Become Functionally Sufficient During Language-Model Training?

    Raphael Bernas, Paul G. Chevalier, Fanny Jourdan +1

    cs.CLarXiv:2608.15323v12026
  32. Logical Embeddings for Argument Analysis

    Leander Heldring, Santiago Torres

    cs.CLcs.AIarXiv:2608.15325v12026
  33. Which Question Is Your Attention Metric Answering? Attention Rows as Compositional Data

    Marios Papamichalis, Regina Ruane

    cs.CLcs.AIcs.LGarXiv:2608.14712v12026
  34. Optimal Watermark Localization in Mixed-Source Large Language Model Texts

    Jose H. Blanchet, T. Tony Cai, Xiang Li +3

    stat.MEcs.CLcs.LGarXiv:2608.14906v12026
  35. From Positionwise Confidence to Prefix Scheduling: Verifier Skipping in Speculative Decoding

    Haoxuan Luo, Jameson Sandler, Ferdinando Fioretto

    cs.CRcs.CLarXiv:2608.14787v12026
  36. Whose doctor does the AI recommend? An algorithm audit of reputation and demographic signals in large language model-assisted physician choice

    Syeda Anshrah Gillani, Mirza Samad Ahmed Baig

    cs.CYcs.AIcs.CLarXiv:2608.14399v12026
  37. Consistency-Driven Co-Evolution for Self-Supervised Cross-Representation Learning

    Xuehang Guo, Pengyuan Li, Tom Hope +3

    cs.LGcs.AIcs.CLarXiv:2608.04926v12026
  38. Scaling Creative Writing Beyond Story-Centric Data with Attribute-Guided Genre Expansion

    Hwan Chang, Yongil Kim, Heuiyeen Yeen +3

    cs.CLarXiv:2608.13947v12026
  39. Poor Man's Agentic Modeling: Simulating Large LLM-Agent Societies on a Laptop

    Igor Itkin

    cs.AIcond-mat.stat-mechcs.CLarXiv:2608.11215v12026
  40. ChronoLens: Measuring Language Change Across Time, Languages, and Linguistic Levels

    Gagan Bhatia, Julian Schlenker, Simone Paolo Ponzetto +1

    cs.CLcs.AIarXiv:2608.03507v12026
  41. MemSFT: Mitigating Alignment Tax with an External Parametric Memory

    Jiarui Wang, Xiang Shi, Jiaqi Cao +8

    cs.LGcs.CLarXiv:2607.25614v12026
  42. Revisiting Lossy Verification in Speculative Decoding: Mechanisms, Trade-offs, and Failure Modes

    Tianyu Wang, Yuxuan Zhou, Wenbin Wang +3

    cs.CLarXiv:2607.26627v12026
  43. Kimi Linear: An Expressive, Efficient Attention Architecture

    Kimi Team, Yu Zhang, Zongyu Lin +57

    cs.CLcs.LGarXiv:2510.26692v22025
  44. Token Time Continuous Diffusion for Language Modeling

    Parikshit Bansal, Sujay Sanghavi

    cs.CLcs.AIarXiv:2607.14106v12026
  45. Group Entropy-Controlled Policy Optimization

    Guangran Cheng, Chengqi Lyu, Songyang Gao +2

    cs.CLarXiv:2607.16850v12026
  46. UI-MOPD: Multi-Platform On-Policy Distillation for Unified GUI Agents

    Niu Lian, Tongbo Chen, Zhehao Yu +8

    cs.CLcs.AIcs.CVarXiv:2607.04425v22026
  47. SeKV: Resolution-Adaptive KV Cache with Hierarchical Semantic Memory for Long-Context LLM Inference

    Amirhossein Abaskohi, Giuseppe Carenini, Peter West +1

    cs.CLarXiv:2606.31145v12026
  48. Capable but Careless: Do Computer-Use Agents Follow Contextual Integrity?

    Anmol Goel, Iryna Gurevych

    cs.AIcs.CLarXiv:2606.23189v12026
  49. Orchestra-o1: Omnimodal Agent Orchestration

    Fan Zhang, Vireo Zhang, Shengju Qian +8

    cs.AIcs.CLcs.CVarXiv:2606.13707v12026
  50. Redesign Mixture-of-Experts Routers with Manifold Power Iteration

    Songhao Wu, Ang Lv, Ruobing Xie +1

    cs.LGcs.AIcs.CLarXiv:2606.12397v12026
  51. UnpredictaBench: A Benchmark for Evaluating Distributional Randomness in LLMs

    Amirhossein Abaskohi, Amirhossein Dabiriaghdam, Liang Luo +4

    cs.CLarXiv:2606.06622v32026
  52. Do Coding Agents Deceive Us? Detecting and Preventing Cheating via Capped Evaluation with Randomized Tests

    Thanawat Lodkaew, Johannes Ackermann, Soichiro Nishimori +3

    cs.LGcs.AIcs.CLarXiv:2606.07379v22026
  53. AdaPlanBench: Evaluating Adaptive Planning in Large Language Model Agents under World and User Constraints

    Jiayu Liu, Cheng Qian, Zhenhailong Wang +10

    cs.CLarXiv:2606.05622v22026
  54. GRAIL: Gradient-Reweighted Advantages for Reinforcement Learning with Verifiable Rewards

    Tej Deep Pala, Vernon Toh, Soujanya Poria

    cs.CLarXiv:2606.04889v12026
  55. OmniOPD: Logit-Free On-Policy Distillation via Speculative Verification

    Yuhang Zhou, Lizhu Zhang, Yifan Wu +5

    cs.LGcs.CLarXiv:2606.01476v22026
  56. MemTrace: Tracing and Attributing Errors in Large Language Model Memory Systems

    Xinle Deng, Ruobin Zhong, Hujin Peng +15

    cs.CLcs.AIcs.LGarXiv:2605.28732v32026
  57. Parallax: Parameterized Local Linear Attention for Language Modeling

    Yifei Zuo, Dhruv Pai, Zhichen Zeng +3

    cs.LGcs.AIcs.CLarXiv:2605.29157v12026
  58. RUBRIC-ARROW: Alternating Pointwise Rubric Reward Modeling for LLM Post-training in Non-verifiable Domains

    Haoxiang Jiang, Zihan Dong, Tianci Liu +5

    cs.LGcs.CLarXiv:2605.29156v12026
  59. Pruning and Distilling Mixture-of-Experts into Dense Language Models

    Junhyuck Kim, Jihun Yun, Haechan Kim +3

    cs.CLcs.AIcs.LGarXiv:2605.28207v22026
  60. Monitoring the Internal Monologue: Probe Trajectories Reveal Reasoning Dynamics

    Maciej Chrabąszcz, Aleksander Szymczyk, Marcin Sendera +2

    cs.CLcs.CRarXiv:2605.18549v12026