Computation and Language
Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
1,261 to 1,320 of 11,244
GANDR: Claim Auditing for Verifiable Legal Answer Generation
Chen Qian, Yimeng Wang, Yu Chen +2
cs.CLcs.AIcs.IRarXiv:2609.10293v12026DiSCo: A Distribution-First Steering and Cultural Prior Evaluation Framework for Measuring Cultural Preference Bias in LLMs
Bhuvan Arora, Devesh Saraogi, Sravya Varada +1
cs.CLcs.AIarXiv:2609.10253v12026LiteRAG: Cost-Efficient Graph-Based Retrieval-Augmented Generation
Daniel Alejandro Coll Tejeda, Pedro García López, Daniel Barcelona-Pons
cs.IRcs.AIcs.CLarXiv:2609.10239v12026GenSim: Generating Robotic Simulation Tasks via Large Language Models
Lirui Wang, Yiyang Ling, Zhecheng Yuan +6
cs.LGcs.CLcs.CVarXiv:2310.01361v22023Active Adaptation, Not Static Defense: Temporal Dynamics of Preventative Steering in Adversarial Fine-Tuning
Jing Guan, Yachao Yang, Zhaoliang Liu +3
cs.CLcs.AIcs.CRarXiv:2609.10142v12026Weak Supervision for Fake News Detection via Reinforcement Learning
Yaqing Wang, Weifeng Yang, Fenglong Ma +4
cs.SIcs.CLcs.LGarXiv:1912.12520v22019Evaluating the Factual Consistency of Large Language Models Through News Summarization
Derek Tam, Anisha Mascarenhas, Shiyue Zhang +3
cs.CLarXiv:2211.08412v22022Train Smarter, Not Harder: Switching Signal-Guided Training in Active Learning
Nagham Omar, Maya Rozenshtein, Evgeny Mishlyakov +1
cs.LGcs.CLarXiv:2609.06806v12026Affective Neural Response Generation
Nabiha Asghar, Pascal Poupart, Jesse Hoey +2
cs.CLcs.AIcs.CYarXiv:1709.03968v12017End-to-end LSTM-based dialog control optimized with supervised and reinforcement learning
Jason D. Williams, Geoffrey Zweig
cs.CLcs.AIcs.LGarXiv:1606.01269v12016Toward Gender-Inclusive Coreference Resolution
Yang Trista Cao, Hal Daumé
cs.CLarXiv:1910.13913v42019NOPE-HYPE: A Structured Simulation Workflow for Robust Speech-to-Text Across Diverse Acoustic Environments
Niramay M. Patel, Bibek Behera, Raksha Sharma
cs.SDcs.AIcs.CLarXiv:2609.10058v12026Does Gender Matter? Towards Fairness in Dialogue Systems
Haochen Liu, Jamell Dacon, Wenqi Fan +3
cs.CLcs.AIarXiv:1910.10486v32019Direct Diversity Optimization for Diverse Successful Trajectories in Preference Post-Training
Junwon Ko, Dong-Jae Lee, Minchan Kwon +2
cs.CLcs.AIcs.LGarXiv:2609.10052v12026MetroLLM-Bench: Evaluating Language Models as Transit Kiosk Runtimes
Remco Hendriks
cs.LGcs.AIcs.CLarXiv:2609.10016v12026Chatlaw: A Multi-Agent Legal Assistant based on a Role-Aligned Mixture-of-Experts Architecture
Jiaxi Cui, Munan Ning, Zongjian Li +6
cs.CLarXiv:2306.16092v32023Improving Cross-Lingual Token Representations by Adding a Pinch of SALT
Guillem Ramírez
cs.CLcs.AIarXiv:2609.09953v12026OUTFOX: LLM-Generated Essay Detection Through In-Context Learning with Adversarially Generated Examples
Ryuto Koike, Masahiro Kaneko, Naoaki Okazaki
cs.CLarXiv:2307.11729v32023Strangers to Themselves: What Language Models Say About Themselves Is Generic
Phil Blandfort, Urja Pawar
cs.LGcs.AIcs.CLarXiv:2609.09899v12026DSGAN: Generative Adversarial Training for Distant Supervision Relation Extraction
Pengda Qin, Weiran Xu, William Yang Wang
cs.CLarXiv:1805.09929v12018From Audio to Semantics: Approaches to end-to-end spoken language understanding
Parisa Haghani, Arun Narayanan, Michiel Bacchiani +6
eess.AScs.CLcs.SDarXiv:1809.09190v12018Fine-Tuning a KV Cache Concatenation-Aware Model or Recomputing KV Caches? Why Not Both?
Fumihiko Tachibana, Daisuke Miyashita, Jun Deguchi
cs.LGcs.AIcs.CLarXiv:2609.09768v12026deltaBLEU: A Discriminative Metric for Generation Tasks with Intrinsically Diverse Targets
Michel Galley, Chris Brockett, Alessandro Sordoni +6
cs.CLarXiv:1506.06863v22015How Fragile Is Safety Alignment at Frontier Scale? A Single-Direction Attack on a 320B MoE
Yi Shi, Tanyu Chen, Kai Shen
cs.CRcs.AIcs.CLarXiv:2609.09793v12026LogiScope-VQA: Benchmarking Vision-Language Models for Logistics Hazard Identification in Industrial Scenarios
Hanjing Zhou, Mingze Yin, Ying Lian +3
cs.CVcs.AIcs.CLarXiv:2609.09790v12026Advancing Multimodal Medical Capabilities of Gemini
Lin Yang, Shawn Xu, Andrew Sellergren +44
cs.CVcs.AIcs.CLarXiv:2405.03162v12024Probing the Need for Visual Context in Multimodal Machine Translation
Ozan Caglayan, Pranava Madhyastha, Lucia Specia +1
cs.CLarXiv:1903.08678v22019Parameterized Convolutional Neural Networks for Aspect Level Sentiment Classification
Binxuan Huang, Kathleen M. Carley
cs.CLarXiv:1909.06276v12019Grounded Conversation Generation as Guided Traverses in Commonsense Knowledge Graphs
Houyu Zhang, Zhenghao Liu, Chenyan Xiong +1
cs.CLcs.AIarXiv:1911.02707v32019VLM: Task-agnostic Video-Language Model Pre-training for Video Understanding
Hu Xu, Gargi Ghosh, Po-Yao Huang +5
cs.CVcs.CLarXiv:2105.09996v32021Intra-Prompt Parallel Decoding for Common-Context Question Answering
Theodore Glavas, Nikhita Vedula, Dushyanta Dhyani +3
cs.CLarXiv:2609.05707v12026Looped GPT-BERT: Trading Parameters for Computation in Small Language Modeling
Tingshuo Fan, Hongtao Mu, Tianyu Zhou +2
cs.CLcs.AIarXiv:2609.09691v12026A Large-scale Dataset for Argument Quality Ranking: Construction and Analysis
Shai Gretz, Roni Friedman, Edo Cohen-Karlik +4
cs.CLarXiv:1911.11408v12019To BERT or Not To BERT: Comparing Speech and Language-based Approaches for Alzheimer's Disease Detection
Aparna Balagopalan, Benjamin Eyre, Frank Rudzicz +1
cs.CLcs.LGarXiv:2008.01551v12020Fastformer: Additive Attention Can Be All You Need
Chuhan Wu, Fangzhao Wu, Tao Qi +2
cs.CLarXiv:2108.09084v62021OpenWebMath: An Open Dataset of High-Quality Mathematical Web Text
Keiran Paster, Marco Dos Santos, Zhangir Azerbayev +1
cs.AIcs.CLcs.LGarXiv:2310.06786v12023When Auditors Fabricate: Batch-Size Degradation and Confident Hallucination in LLM Detection of Planted Document Contamination
Karan Parekh, Sanjana Pendyala Ravinder, Sana Mhapsekar +1
cs.CLcs.AIarXiv:2609.09696v12026SSMBA: Self-Supervised Manifold Based Data Augmentation for Improving Out-of-Domain Robustness
Nathan Ng, Kyunghyun Cho, Marzyeh Ghassemi
cs.CLcs.LGstat.MLarXiv:2009.10195v22020Which Medical Questions Deserve Rationales? Perturbation-Sensitive Selection for Robust QA
Yuexin Wu, Dayou Yu, Vasile Rus
cs.CLcs.AIarXiv:2609.09684v12026Towards Improving Adversarial Training of NLP Models
Jin Yong Yoo, Yanjun Qi
cs.CLcs.AIcs.LGarXiv:2109.00544v22021ConE: Cone Embeddings for Multi-Hop Reasoning over Knowledge Graphs
Zhanqiu Zhang, Jie Wang, Jiajun Chen +2
cs.AIcs.CLarXiv:2110.13715v22021SemEval-2023 Task 10: Explainable Detection of Online Sexism
Hannah Rose Kirk, Wenjie Yin, Bertie Vidgen +1
cs.CLcs.CYarXiv:2303.04222v22023Can Large Language Models Reason and Plan?
Subbarao Kambhampati
cs.AIcs.CLcs.LGarXiv:2403.04121v22024Language Models as Knowledge Bases: On Entity Representations, Storage Capacity, and Paraphrased Queries
Benjamin Heinzerling, Kentaro Inui
cs.CLarXiv:2008.09036v22020Thrilled by Your Progress! Large Language Models (GPT-4) No Longer Struggle to Pass Assessments in Higher Education Programming Courses
Jaromir Savelka, Arav Agarwal, Marshall An +2
cs.CYcs.AIcs.CLarXiv:2306.10073v12023Edu-QuRating: Multi-Dimensional Educational Data Curation with Distilled Pairwise Judgements
Oliver G. B. Garrod, Robin A. A. Ince, Meng Liu +5
cs.CLcs.AIarXiv:2609.09425v12026Sycophancy in Large Language Models: Causes and Mitigations
Lars Malmqvist
cs.CLcs.AIarXiv:2411.15287v12024From Fixed Keys to Readable Schemas: Small Language Models for Vehicle Agent Function Calls
Hamed Jafarzadeh Asl, Yuanhao Yu, Vahid Partovi Nia
cs.LGcs.AIcs.CLarXiv:2609.09476v12026Picking on the Same Person: Does Algorithmic Monoculture lead to Outcome Homogenization?
Rishi Bommasani, Kathleen A. Creel, Ananya Kumar +2
cs.LGcs.AIcs.CLarXiv:2211.13972v12022Guiding Large Language Models via Directional Stimulus Prompting
Zekun Li, Baolin Peng, Pengcheng He +3
cs.CLarXiv:2302.11520v42023Physics of Language Models: Part 3.3, Knowledge Capacity Scaling Laws
Zeyuan Allen-Zhu, Yuanzhi Li
cs.CLcs.AIcs.LGarXiv:2404.05405v12024Examining Inter-Consistency of Large Language Models Collaboration: An In-depth Analysis via Debate
Kai Xiong, Xiao Ding, Yixin Cao +2
cs.CLcs.AIarXiv:2305.11595v32023The Ghost in the Machine has an American accent: value conflict in GPT-3
Rebecca L Johnson, Giada Pistilli, Natalia Menédez-González +4
cs.CLcs.AIarXiv:2203.07785v12022Augmenting Self-attention with Persistent Memory
Sainbayar Sukhbaatar, Edouard Grave, Guillaume Lample +2
cs.LGcs.CLstat.MLarXiv:1907.01470v12019Auditable Emergency Triage for Maternal and Newborn Care in India
Shobhit Jagga, Aman Dalmia, Niharika Priyadarshini +7
cs.CLcs.AIcs.CYarXiv:2609.09356v12026Self-Attentional Acoustic Models
Matthias Sperber, Jan Niehues, Graham Neubig +2
cs.CLarXiv:1803.09519v22018Does BERT Pretrained on Clinical Notes Reveal Sensitive Data?
Eric Lehman, Sarthak Jain, Karl Pichotta +2
cs.CLcs.AIcs.LGarXiv:2104.07762v22021Eight Things to Know about Large Language Models
Samuel R. Bowman
cs.CLcs.AIarXiv:2304.00612v12023JanusFlow: Harmonizing Autoregression and Rectified Flow for Unified Multimodal Understanding and Generation
Yiyang Ma, Xingchao Liu, Xiaokang Chen +11
cs.CVcs.AIcs.CLarXiv:2411.07975v22024Agent Smith: A Single Image Can Jailbreak One Million Multimodal LLM Agents Exponentially Fast
Xiangming Gu, Xiaosen Zheng, Tianyu Pang +5
cs.CLcs.CRcs.CVarXiv:2402.08567v22024