Computation and Language

Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

11,341 to 11,400 of 11,411

  1. Task-Conditional Flow Matching for Balanced Multilingual Text Embedding Adaptation

    Tirth Bhatt, Naren Kumar S, Mayank Singh

    cs.CLcs.AIarXiv:2608.05785v12026
  2. Reinforcement Learning with Evolving Rubrics as Rewards for Audio Reasoning

    Fangxu Yu, Tao Feng, Dehai Min +6

    cs.SDcs.CLarXiv:2608.02831v12026
  3. When Memory Lies: An Empirical Study of Spatial Memory Staleness in VLM Agents

    Yushi Sun, Yanjie Zhang

    cs.CLarXiv:2608.04574v12026
  4. Information Satisfaction: A Reader-Centered Axis for Summarization Evaluation

    Isabel Cachola, William Walden, Reno Kriz +1

    cs.CLarXiv:2608.14457v12026
  5. WCM: A World Critic Model for Vision-Language-Action Reinforcement Learning

    Senyu Fei, Xiaopeng Yu, Siyin Wang +3

    cs.ROcs.CLcs.CVarXiv:2607.29613v12026
  6. A Four-Axis Trustworthiness Benchmark for LLM-as-Judge in Principle-Based Regulation

    Dipankar Sarkar

    cs.CRcs.AIcs.CLarXiv:2608.14329v12026
  7. Seeing Red, Thinking Bad: Color Bias in Vision Language Models

    Kohsuke Ide, Ryousuke Yamada, Yoshihiro Fukuhara +2

    cs.CVcs.AIcs.CLarXiv:2608.14286v12026
  8. CoinRAG: Contextualized Information Nugget KV Cache Reuse for Long-Context RAG

    Gyuwan Kim, Cheoneum Park, Tao Yang

    cs.CLcs.AIcs.IRarXiv:2608.07458v12026
  9. VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation

    Kangning Zhang, Yixing Li, Shuai Shao +9

    cs.CVcs.CLarXiv:2607.28590v12026
  10. ContinualSkillBench: Can LLM Agents Truly Evolve Their Capabilities?

    Tianyi Guan, Yiding Wang, Haotong Yang +5

    cs.AIcs.CLcs.LGarXiv:2608.03874v12026
  11. K-EXAONE 2.0 Technical Report

    Eunbi Choi, Kibong Choi, Sehyun Chun +74

    cs.CLarXiv:2608.04505v12026
  12. GradCuit: Credit-Assigned Gradient Flow Enables Robust and Interpretable Test-Time Latent Reasoning

    Zhaoxin Yu, Qi Shen, Hengli Li +4

    cs.LGcs.CLarXiv:2608.02585v22026
  13. Local and Global Regimes of Geometric Complexity in Language Model Representations

    Arwa Osman, Marco Baroni, Iuri Macocco

    cs.CLarXiv:2608.14361v12026
  14. Wrong but Useful: Trajectory Value Beyond Answer Correctness in Multi-Agent Messages

    Chih-Hsuan Yang, Anjir Ahmed Chowdhury, Cheng-Hau Yang +7

    cs.AIcs.CLcs.LGarXiv:2608.14375v12026
  15. Relevant but Incomplete: Referential Dangling as a Paradigm-Level Failure Mode in Hard Prompt Compression

    Zhengpei Hu, Kai Li, Dapeng Fu +5

    cs.CLcs.LGarXiv:2608.04569v12026
  16. Skaling: Chinchilla's Exponents Meet Kaplan's Coupling

    Mathurin Videau, Badr Youbi-Idrissi, David Lopez-Paz +1

    cs.CLarXiv:2608.07222v12026
  17. VoiceChat-TTS: A Low-Latency Continuous Speech Synthesis Model for Interactive Agents

    Edresson Casanova, Jaehyeon Kim, Mariana Graterol Fuenmayor +17

    eess.AScs.CLarXiv:2608.13831v12026
  18. MameLoshnLM: Yiddish Language Model and Evaluation Benchmark

    Uri Katz, Omer Goldman, Tomasz Limisiewicz +2

    cs.CLcs.AIarXiv:2608.05850v12026
  19. NOLLI: A Difficulty-Calibrated Puzzle Benchmark for Diagnosing the English-Korean Performance Gap

    Dasol Choi, Joonyong Park, Daegon Yu +3

    cs.CLarXiv:2608.04397v12026
  20. Mitigating Gender Bias in English to Romanian Machine Translation

    Ioana Grigore, Sergiu Nisioi

    cs.CLcs.AIarXiv:2608.08606v12026
  21. TurnSight: Turn-Level Hindsight Self-Distillation for Tool-Integrated Reasoning

    Changle Qu, Sunhao Dai, Hengyi Cai +4

    cs.CLcs.AIarXiv:2608.04007v12026
  22. HarnessOpt-Bench: Evaluating LLMs at Harness Optimization

    Varun Ursekar, Apaar Shanker, Yash Maurya +4

    cs.AIcs.CLcs.LGarXiv:2608.06301v12026
  23. OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents

    Jingsheng Zheng, Xinyuan Fang, Jintian Zhang +3

    cs.CLcs.AIcs.HCarXiv:2608.05013v12026
  24. OpenART: Scaling Agent Red Teaming via Open-Ended Environment Evolution

    Yunhao Chen, Xin Wang, Yixu Wang +6

    cs.CLarXiv:2608.00677v12026
  25. CLAIR-Fin: An Adversarial Multi-Agent Framework for Claim-Level Verification and Adaptive Debate in Cross-Modal Financial QA

    Fatema Tuj Johora Faria, Mukaffi Bin Moin, Jubayer Al Mahmud +2

    cs.CLcs.AIarXiv:2608.13706v12026
  26. On-Policy Delta Distillation for Multilingual Math Reasoning

    Byeongho Heo, Jaehui Hwang, Sangdoo Yun +1

    cs.CLcs.LGarXiv:2608.05802v12026
  27. Progressive Agent Skill Generation via Reinforcement Learning

    Junhao Shen, Zhanqiu Zhang, Yiwen Guo +1

    cs.LGcs.CLarXiv:2608.01678v12026
  28. From Passive Delegates to Strategic Negotiators: Reinforcing Social Reasoning in Small Language Models with SocialRL

    Wenyue Hua, Zachary Huang, Tyler Payne +3

    cs.AIcs.CLcs.LGarXiv:2608.13787v12026
  29. How Much Do Legal RAG Systems Still Hallucinate?

    Souvick Das, Sallam Abualhaija, Domenico Bianculli

    cs.CLcs.AIarXiv:2608.14210v12026
  30. MINT: A Universal Zero-Shot Predictor for Transaction Data

    Parameswaran Kamalaruban, Viktor Drobnyi, Maeve Madigan +3

    cs.LGcs.CLarXiv:2608.14198v12026
  31. HERMES: a multi-agent framework for structured knowledge extraction from ultra-long documents in geoscience

    Ziqi Song, Zongyuan Xiang, James G. Ogg +12

    cs.CLarXiv:2608.14055v12026
  32. IterCOMP: Reasoning-aware Adaptive Prompt Compression for Multi-hop Question Answering

    JungMin Yun, YoungBin Kim

    cs.CLcs.AIarXiv:2608.13588v12026
  33. On-Policy Delta Distillation

    Byeongho Heo, Jaehui Hwang, Sangdoo Yun +1

    cs.LGcs.CLarXiv:2607.15161v12026
    Summaries:한국어
  34. Weak-to-Strong Generalization via Direct On-Policy Distillation

    Shiyuan Feng, Huan-ang Gao, Haohan Chi +7

    cs.LGcs.AIcs.CLarXiv:2607.05394v22026
    Summaries:한국어
  35. BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding

    Jacob Devlin, Ming-Wei Chang, Kenton Lee +1

    cs.CLarXiv:1810.04805v12018
    Summaries:한국어
  36. Attention Is All You Need

    Ashish Vaswani, Noam Shazeer, Niki Parmar +5

    cs.CLcs.LGarXiv:1706.03762v72017
  37. A Survey of Large Models in Sports

    Yichen Xu, Jianzhe Ma, Chuhan Wang +4

    cs.CLcs.CVarXiv:2608.14377v12026
  38. Repair, Not Improvement: Decomposing Constrained Decoding in Tool-Call Abstention

    Janghoon Lee

    cs.CLarXiv:2608.13959v12026
  39. Regime-Conditional Verification: Correctness Estimation for Adapting and Monitoring Safety Classifiers

    Thiago Sandoval, Ufuk Topcu

    cs.AIcs.CLcs.CRarXiv:2608.14089v12026
  40. CForce: Boosting Parallel Decoding for dLLMs via Consistency Forcing

    Yuji Ren, Chenkai Xu, Zhuocheng Gong +2

    cs.LGcs.AIcs.CLarXiv:2608.13925v12026
  41. Think in Latent, Explain in Language: Self-Explainable Latent Reasoning

    Dayuan Zhao, Shengcao Cao, Yu-Xiong Wang +1

    cs.CLcs.AIcs.LGarXiv:2608.13570v12026
  42. ASSERT: A Measurement Pipeline for GenAI Audits

    Riccardo Fogliato, Abhinav Palia, Xiawei Wang +11

    cs.CLcs.AIcs.CYarXiv:2608.13840v12026
  43. Not All Tokens Are Equal: Inflation-Aware Routing for Agentic LLM Systems

    Heming Fu, Shan Lin, Qianqian Xie +1

    cs.CLcs.AIarXiv:2608.13571v12026
  44. Bootstrapping Niche Multilingual Code Translation via Reinforcement Learning with Execution-Based Verifiable Supervision

    Kouki Yuki, Jie Zeng, Kyoko Ogawa +6

    cs.CLarXiv:2608.13854v12026
  45. BCMT: Blockwise Causal Memory Transformer

    Rachid Arezki

    cs.CLcs.AIcs.LGarXiv:2608.13578v12026
  46. S2Dialog: Multimodal Dialogue Retrieval with Semantic and Acoustic-Style Modeling

    Xueqi Wang, Zhigang Wang, Runqing Zhang +2

    cs.CLarXiv:2608.14029v12026
  47. Amplified Does Not Mean Predictive: Reasoning Behaviors in Thinking Models

    Jean de Dieu Nyandwi, Leena Mathur, Yonatan Bisk +2

    cs.CLcs.AIcs.CVarXiv:2608.13760v12026
  48. Stable Miscalibration in Large Language Models: A Practical View of High-Confidence Errors

    Akira Okutomi

    cs.AIcs.CLarXiv:2608.13591v12026
  49. DFM Mimir v1: An Open HRM Delivering Frontier Performance at 1B Parameters Using Only Permissible Post-Training Data

    Peter Schneider-Kamp, Jacob Nielsen, Gianluca Barmina +2

    cs.CLcs.AIarXiv:2608.13517v12026
  50. Beyond NL2Code: A Structured Survey of Multimodal Code Intelligence

    Xuanle Zhao, Qiushi Sun, Jingyu Xiao +16

    cs.CLarXiv:2606.15932v22026
    Summaries:한국어
  51. Improved Large Language Diffusion Models

    Shen Nie, Qiyang Min, Shaoxuan Xu +7

    cs.CLcs.AIcs.LGarXiv:2606.25331v12026
  52. Sequence to Sequence Learning with Neural Networks

    Ilya Sutskever, Oriol Vinyals, Quoc V. Le

    cs.CLcs.LGarXiv:1409.3215v32014
  53. Unlimited OCR Works

    Youyang Yin, Huanhuan Liu, YY +14

    cs.CVcs.CLarXiv:2606.23050v12026
  54. Nemotron-Labs-Diffusion: A Tri-Mode Language Model Unifying Autoregressive, Diffusion, and Self-Speculation Decoding

    Yonggan Fu, Lexington Whalen, Abhinav Garg +23

    cs.CLarXiv:2607.05722v12026
  55. RoFormer: Enhanced Transformer with Rotary Position Embedding

    Jianlin Su, Yu Lu, Shengfeng Pan +3

    cs.CLcs.AIcs.LGarXiv:2104.09864v52021
  56. Demystifying On-Policy Distillation: Roles, Pathologies, and Regulations

    Rui Wang, Hongru Wang, Yi Chen +4

    cs.CLcs.LGarXiv:2607.13399v12026
  57. Are You Sure You're Sure? On the Impact of Instruction Tuning on Confidence and Lexical Diversity

    Irina Proskurina, Mayank Kumar, Oyindolapo O. Komolafe

    cs.CLcs.AIarXiv:2608.13430v12026
  58. Are We Ready For An Agent-Native Memory System?

    Wei Zhou, Xuanhe Zhou, Shaokun Han +5

    cs.CLcs.DBcs.IRarXiv:2606.24775v12026
  59. DanceOPD: On-Policy Generative Field Distillation

    Wei Zhou, Xiongwei Zhu, Zelin Xu +8

    cs.CVcs.CLcs.LGarXiv:2606.27377v22026
  60. Self-Evolving Embodied Agents via Skill-Harness Evolution

    Peidong Wang, Zhiming Ma, Ying Chang +5

    cs.CLcs.ROarXiv:2608.11350v12026