Papers
Deep, long-form breakdowns of recent research in AI, machine learning, security & programming languages.
58 results on this page · clear filters
From Parameters to Answers: How LLMs Retrieve and Use Their Internal Knowledge
by Wenkang Wei, Yuan Fang, Renhe Jiang, Hong Cheng, Xingtong Yu
BlueSTAR: Tiered Agentic Architecture for Autonomous Cyber Defense
by Simona Boboila, Xavier Cadet, Edward Koh, Daniel Balasubramanian, Dirk Van Bruggen, Peter Chin, Alina Oprea
Target leakage, not model class, explains reported accuracy in survey-based cardiovascular screening: a leakage-tiered audit of glass-box and tabular foundation models
by Raad Bin Tareaf, Murad Al-Rajab, Samia Loucif, Samer Ellaham, Cedric Schmitz
RAGTIMER 1.0: Rapid Rare-Event Partial State Space Construction for Stochastic VAS (extended version)
by Landon Taylor, Joshua Jeppson, Bingqing Hu, Lukas Buecherl, Zhen Zhang
JarvisGUI: Towards Cross-Device GUI Agents with Dynamic Task Composition
by Zixiang Chen, Yuheng Lu, Zihao Cheng, Zeming Liu, Jizeng Bai, Ziye Huang, Zhiyin Lin, Zihan Li, Yuhang Guo, Yunhong Wang, Haifeng Wang
ConvMem: Convolutional Memory for Long-Context Reasoning
by Hongming Zhang, Zhaozhen Gu, Fengshuo Bai, Ming Hao, Qingyang Zhang, Yuanyuan Wang, Shiyang Tang, Yanna Wang, Bo Xu
Forgetting Only What Matters: Layer-Selective Unlearning toward Robust LLMs
by Ravi Ranjan, Olivera Kotevska, Agoritsa Polyzou
Do speech foundation models really learn words?
by Robin Huo, Ewan Dunbar
Co-Evolving Harnesses and Models: On-Policy Correction Helps Weaker Models Catch Up Where Imitation Fails
by Zhou Yu, Bin Bi, Shiva Kumar Pentyala, Shubham Mehrotra, Sougata Chaudhuri, Shilpa Bhagavath, Zeyuan Chen, Ran Xu, Phil Mui, James Zhu, Sitaram Asur
Same Trajectory, Contradictory Rewards (ROBORMBENCH): Paraphrase Fragility in Vision Language Reward Models
by Wonje Jeung, Sangyeon Yoon, Hyesoo Hong, Yoonjun Cho, Dongjae Jeon, Bumjun Kim, Jean Oh, Youngjae Yu, Albert No