58 results on this page · clear filters

ai Sep 11 From Parameters to Answers: How LLMs Retrieve and Use Their Internal Knowledge by Wenkang Wei, Yuan Fang, Renhe Jiang, Hong Cheng, Xingtong Yu ai Sep 11 BlueSTAR: Tiered Agentic Architecture for Autonomous Cyber Defense by Simona Boboila, Xavier Cadet, Edward Koh, Daniel Balasubramanian, Dirk Van Bruggen, Peter Chin, Alina Oprea ai Sep 11 Target leakage, not model class, explains reported accuracy in survey-based cardiovascular screening: a leakage-tiered audit of glass-box and tabular foundation models by Raad Bin Tareaf, Murad Al-Rajab, Samia Loucif, Samer Ellaham, Cedric Schmitz ai Sep 11 RAGTIMER 1.0: Rapid Rare-Event Partial State Space Construction for Stochastic VAS (extended version) by Landon Taylor, Joshua Jeppson, Bingqing Hu, Lukas Buecherl, Zhen Zhang ai Sep 10 JarvisGUI: Towards Cross-Device GUI Agents with Dynamic Task Composition by Zixiang Chen, Yuheng Lu, Zihao Cheng, Zeming Liu, Jizeng Bai, Ziye Huang, Zhiyin Lin, Zihan Li, Yuhang Guo, Yunhong Wang, Haifeng Wang ai Sep 10 ConvMem: Convolutional Memory for Long-Context Reasoning by Hongming Zhang, Zhaozhen Gu, Fengshuo Bai, Ming Hao, Qingyang Zhang, Yuanyuan Wang, Shiyang Tang, Yanna Wang, Bo Xu ai Sep 10 Forgetting Only What Matters: Layer-Selective Unlearning toward Robust LLMs by Ravi Ranjan, Olivera Kotevska, Agoritsa Polyzou ai Sep 10 Do speech foundation models really learn words? by Robin Huo, Ewan Dunbar ai Sep 09 Co-Evolving Harnesses and Models: On-Policy Correction Helps Weaker Models Catch Up Where Imitation Fails by Zhou Yu, Bin Bi, Shiva Kumar Pentyala, Shubham Mehrotra, Sougata Chaudhuri, Shilpa Bhagavath, Zeyuan Chen, Ran Xu, Phil Mui, James Zhu, Sitaram Asur ai Sep 07 Same Trajectory, Contradictory Rewards (ROBORMBENCH): Paraphrase Fragility in Vision Language Reward Models by Wonje Jeung, Sangyeon Yoon, Hyesoo Hong, Yoonjun Cho, Dongjae Jeon, Bumjun Kim, Jean Oh, Youngjae Yu, Albert No