Computation and Language
Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
4,021 to 4,080 of 11,233
Simple Applications of BERT for Ad Hoc Document Retrieval
Wei Yang, Haotian Zhang, Jimmy Lin
cs.IRcs.CLarXiv:1903.10972v12019A Comprehensive Exploration on WikiSQL with Table-Aware Word Contextualization
Wonseok Hwang, Jinyeong Yim, Seunghyun Park +1
cs.CLarXiv:1902.01069v22019Large Language Models Are Latent Variable Models: Explaining and Finding Good Demonstrations for In-Context Learning
Xinyi Wang, Wanrong Zhu, Michael Saxon +2
cs.CLcs.AIcs.LGarXiv:2301.11916v42023MiMo-V2-Flash Technical Report
Xiaomi LLM-Core Team, :, Bangjun Xiao +124
cs.CLcs.AIarXiv:2601.02780v22026ShinkaEvolve: Towards Open-Ended And Sample-Efficient Program Evolution
Robert Tjarko Lange, Yuki Imajuku, Edoardo Cetin
cs.CLcs.LGarXiv:2509.19349v12025MEM1: Learning to Synergize Memory and Reasoning for Efficient Long-Horizon Agents
Zijian Zhou, Ao Qu, Zhaoxuan Wu +6
cs.CLcs.AIcs.IRarXiv:2506.15841v22025Generalizing Verifiable Instruction Following
Valentina Pyatkin, Saumya Malik, Victoria Graf +5
cs.CLarXiv:2507.02833v32025MMSI-Bench: A Benchmark for Multi-Image Spatial Intelligence
Sihan Yang, Runsen Xu, Yiman Xie +10
cs.CVcs.CLarXiv:2505.23764v32025Supervised Speech Separation Based on Deep Learning: An Overview
DeLiang Wang, Jitong Chen
cs.CLcs.LGcs.NEarXiv:1708.07524v22017Ready to Speak: Aligning LLMs for TTS-Friendly Text Generation
Thibaut Thonet, Jos Rozen, Laurent Besacier
cs.CLarXiv:2609.01246v12026BROS: A Pre-trained Language Model Focusing on Text and Layout for Better Key Information Extraction from Documents
Teakgyu Hong, Donghyun Kim, Mingi Ji +3
cs.CLarXiv:2108.04539v52021An Illusion of Progress? Assessing the Current State of Web Agents
Tianci Xue, Weijian Qi, Tianneng Shi +5
cs.AIcs.CLarXiv:2504.01382v42025SimpleVLA-RL: Scaling VLA Training via Reinforcement Learning
Haozhan Li, Yuxin Zuo, Jiale Yu +18
cs.ROcs.AIcs.CLarXiv:2509.09674v12025MiMo-Audio: Audio Language Models are Few-Shot Learners
Xiaomi LLM-Core Team, :, Dong Zhang +98
cs.CLcs.SDeess.ASarXiv:2512.23808v12025Semantic Evaluation for Text-to-SQL with Distilled Test Suites
Ruiqi Zhong, Tao Yu, Dan Klein
cs.CLcs.AIarXiv:2010.02840v12020Scaling Latent Reasoning via Looped Language Models
Rui-Jie Zhu, Zixuan Wang, Kai Hua +30
cs.CLarXiv:2510.25741v52025Skywork-Reward-V2: Scaling Preference Data Curation via Human-AI Synergy
Chris Yuhao Liu, Liang Zeng, Yuzhen Xiao +9
cs.CLcs.AIcs.LGarXiv:2507.01352v32025Learning Global Features for Coreference Resolution
Sam Wiseman, Alexander M. Rush, Stuart M. Shieber
cs.CLarXiv:1604.03035v12016Multi-Modal Masked Autoencoders for Medical Vision-and-Language Pre-Training
Zhihong Chen, Yuhao Du, Jinpeng Hu +4
cs.CVcs.CLarXiv:2209.07098v12022Learning to Reason without External Rewards
Xuandong Zhao, Zhewei Kang, Aosong Feng +2
cs.LGcs.CLarXiv:2505.19590v52025Backdoor Learning in Language Models and Vision-Language Models
Weimin Lyu
cs.CLcs.AIarXiv:2608.18095v12026From Inference to Adaptation: A Unified Optimal Transport View of Vision Language Model
Qi Yu, Zhichen Zeng, Katherine Tieu +8
cs.CVcs.AIcs.CLarXiv:2608.18339v12026Debiased Inference for AI-Generated Data without Gold-Standard Labels: Identification via Multiple Imperfect Measurements
Naoki Egami, Sooahn Shin
stat.MEcs.AIcs.CLarXiv:2608.18294v12026Against Political Polarization: A Unified Framework for Tracing Evolving Political Ideologies on Social Media
Yijie Xu, Chao Wang, Hui Xiong
cs.SIcs.AIcs.CLarXiv:2608.17987v12026Code as Representation: A Compilable Parsing Paradigm for Academic Documents
Rihui Jin, Jun Wang, chengyuan zhu +11
cs.CVcs.CLarXiv:2608.17550v12026Decomposition Attacks Across Unlinkable Identities: Limits of Stateful Defenses for LLM Services
Bowen Sun, Zhengyue Zhao, Xiaogeng Liu +2
cs.CRcs.CLarXiv:2608.17445v12026PCA-guided Activation Scaling for Monotonic Bidirectional Control over LLM Sycophancy
Zheng Chen, Zhaoxin Feng, Yip Tin Po +3
cs.CLarXiv:2608.16650v12026HalluTracer: Hallucination Detection via Depth-Averaging Truth Signals
Zhihao Guo, Zonghan Wu, Huan Huo +6
cs.CLcs.AIarXiv:2608.16353v12026HyperSkill: Self-Evolving LLM Agents via Hypergraph-Structured Skill Memory
Ruiyao Xu, Tiankai Yang, Wei-Chieh Huang
cs.CLarXiv:2608.16114v12026Human language reveals a universal positivity bias
Peter Sheridan Dodds, Eric M. Clark, Suma Desu +11
physics.soc-phcs.CLcs.SIarXiv:1406.3855v12014When Do Concepts Become Functionally Sufficient During Language-Model Training?
Raphael Bernas, Paul G. Chevalier, Fanny Jourdan +1
cs.CLarXiv:2608.15323v12026Logical Embeddings for Argument Analysis
Leander Heldring, Santiago Torres
cs.CLcs.AIarXiv:2608.15325v12026Which Question Is Your Attention Metric Answering? Attention Rows as Compositional Data
Marios Papamichalis, Regina Ruane
cs.CLcs.AIcs.LGarXiv:2608.14712v12026Optimal Watermark Localization in Mixed-Source Large Language Model Texts
Jose H. Blanchet, T. Tony Cai, Xiang Li +3
stat.MEcs.CLcs.LGarXiv:2608.14906v12026From Positionwise Confidence to Prefix Scheduling: Verifier Skipping in Speculative Decoding
Haoxuan Luo, Jameson Sandler, Ferdinando Fioretto
cs.CRcs.CLarXiv:2608.14787v12026Whose doctor does the AI recommend? An algorithm audit of reputation and demographic signals in large language model-assisted physician choice
Syeda Anshrah Gillani, Mirza Samad Ahmed Baig
cs.CYcs.AIcs.CLarXiv:2608.14399v12026Consistency-Driven Co-Evolution for Self-Supervised Cross-Representation Learning
Xuehang Guo, Pengyuan Li, Tom Hope +3
cs.LGcs.AIcs.CLarXiv:2608.04926v12026Scaling Creative Writing Beyond Story-Centric Data with Attribute-Guided Genre Expansion
Hwan Chang, Yongil Kim, Heuiyeen Yeen +3
cs.CLarXiv:2608.13947v12026Poor Man's Agentic Modeling: Simulating Large LLM-Agent Societies on a Laptop
Igor Itkin
cs.AIcond-mat.stat-mechcs.CLarXiv:2608.11215v12026ChronoLens: Measuring Language Change Across Time, Languages, and Linguistic Levels
Gagan Bhatia, Julian Schlenker, Simone Paolo Ponzetto +1
cs.CLcs.AIarXiv:2608.03507v12026MemSFT: Mitigating Alignment Tax with an External Parametric Memory
Jiarui Wang, Xiang Shi, Jiaqi Cao +8
cs.LGcs.CLarXiv:2607.25614v12026Revisiting Lossy Verification in Speculative Decoding: Mechanisms, Trade-offs, and Failure Modes
Tianyu Wang, Yuxuan Zhou, Wenbin Wang +3
cs.CLarXiv:2607.26627v12026Kimi Linear: An Expressive, Efficient Attention Architecture
Kimi Team, Yu Zhang, Zongyu Lin +57
cs.CLcs.LGarXiv:2510.26692v22025Token Time Continuous Diffusion for Language Modeling
Parikshit Bansal, Sujay Sanghavi
cs.CLcs.AIarXiv:2607.14106v12026Group Entropy-Controlled Policy Optimization
Guangran Cheng, Chengqi Lyu, Songyang Gao +2
cs.CLarXiv:2607.16850v12026UI-MOPD: Multi-Platform On-Policy Distillation for Unified GUI Agents
Niu Lian, Tongbo Chen, Zhehao Yu +8
cs.CLcs.AIcs.CVarXiv:2607.04425v22026SeKV: Resolution-Adaptive KV Cache with Hierarchical Semantic Memory for Long-Context LLM Inference
Amirhossein Abaskohi, Giuseppe Carenini, Peter West +1
cs.CLarXiv:2606.31145v12026Capable but Careless: Do Computer-Use Agents Follow Contextual Integrity?
Anmol Goel, Iryna Gurevych
cs.AIcs.CLarXiv:2606.23189v12026Orchestra-o1: Omnimodal Agent Orchestration
Fan Zhang, Vireo Zhang, Shengju Qian +8
cs.AIcs.CLcs.CVarXiv:2606.13707v12026Redesign Mixture-of-Experts Routers with Manifold Power Iteration
Songhao Wu, Ang Lv, Ruobing Xie +1
cs.LGcs.AIcs.CLarXiv:2606.12397v12026UnpredictaBench: A Benchmark for Evaluating Distributional Randomness in LLMs
Amirhossein Abaskohi, Amirhossein Dabiriaghdam, Liang Luo +4
cs.CLarXiv:2606.06622v32026Do Coding Agents Deceive Us? Detecting and Preventing Cheating via Capped Evaluation with Randomized Tests
Thanawat Lodkaew, Johannes Ackermann, Soichiro Nishimori +3
cs.LGcs.AIcs.CLarXiv:2606.07379v22026AdaPlanBench: Evaluating Adaptive Planning in Large Language Model Agents under World and User Constraints
Jiayu Liu, Cheng Qian, Zhenhailong Wang +10
cs.CLarXiv:2606.05622v22026GRAIL: Gradient-Reweighted Advantages for Reinforcement Learning with Verifiable Rewards
Tej Deep Pala, Vernon Toh, Soujanya Poria
cs.CLarXiv:2606.04889v12026OmniOPD: Logit-Free On-Policy Distillation via Speculative Verification
Yuhang Zhou, Lizhu Zhang, Yifan Wu +5
cs.LGcs.CLarXiv:2606.01476v22026MemTrace: Tracing and Attributing Errors in Large Language Model Memory Systems
Xinle Deng, Ruobin Zhong, Hujin Peng +15
cs.CLcs.AIcs.LGarXiv:2605.28732v32026Parallax: Parameterized Local Linear Attention for Language Modeling
Yifei Zuo, Dhruv Pai, Zhichen Zeng +3
cs.LGcs.AIcs.CLarXiv:2605.29157v12026RUBRIC-ARROW: Alternating Pointwise Rubric Reward Modeling for LLM Post-training in Non-verifiable Domains
Haoxiang Jiang, Zihan Dong, Tianci Liu +5
cs.LGcs.CLarXiv:2605.29156v12026Pruning and Distilling Mixture-of-Experts into Dense Language Models
Junhyuck Kim, Jihun Yun, Haechan Kim +3
cs.CLcs.AIcs.LGarXiv:2605.28207v22026Monitoring the Internal Monologue: Probe Trajectories Reveal Reasoning Dynamics
Maciej Chrabąszcz, Aleksander Szymczyk, Marcin Sendera +2
cs.CLcs.CRarXiv:2605.18549v12026