The Research Desk.

The most upvoted and starred AI research crossing the community today.

Last Brew Time: Aug 9, 2026, 10:22 AM PT

AlphaXiv Trending

Leanstral
AlphaXiv
92

Leanstral

Aditi Kabra, Albert Q. Jiang, Andrew Zhao

Machine Learning
Towards Physics of Multimodal Pretraining: Knowledge Flow, Modality Synergy, Early Unification, and Recipes
AlphaXiv
85

Towards Physics of Multimodal Pretraining: Knowledge Flow, Modality Synergy, Early Unification, and Recipes

Junlin Han, Shengbang Tong, David Fan

FAIR, Meta, Reality Labs, Meta, University of Oxford

Computer Vision
On-Policy Self-Distillation without Any Supervision
AlphaXiv
68

On-Policy Self-Distillation without Any Supervision

Yijiang Li, Bingyang Wang, Yijun Liang

Georgia Institute of Technology, University of Maryland, College Park, ByteDance

Reinforcement Learning
Argus: A General-Purpose Agentic Runtime for Long-Horizon Reasoning
AlphaXiv
49

Argus: A General-Purpose Agentic Runtime for Long-Horizon Reasoning

Boxiu Li, Zimo Wen, Yijia Fan

Microsoft, Shanghai Jiao Tong University, Fudan University, Nanjing University, Tsinghua University

Reinforcement Learning
AgentOPSD: Recursive Self-Distillation for Agentic Reinforcement Learning
AlphaXiv
48

AgentOPSD: Recursive Self-Distillation for Agentic Reinforcement Learning

Zi-Han Wang, Zhengxi Lu, Zhiyuan Yao

Tsinghua University, Zhejiang University

NLP
Test-Time Scaling in Reasoning LLMs: Inference Regimes, Evaluation, and Reproducibility
AlphaXiv
48

Test-Time Scaling in Reasoning LLMs: Inference Regimes, Evaluation, and Reproducibility

Mohsen Hariri, Weicong Chen, Nahal Shahini

Case Western Reserve University

HuggingFace Daily Papers

Reinforcement Learning
DataSpace: Benchmarking Data Agents for Verifiable Analytics over Heterogeneous Workspaces
HuggingFace
30

DataSpace: Benchmarking Data Agents for Verifiable Analytics over Heterogeneous Workspaces

Boyan Li, Zhuowen Liang, Yupeng Xie, Xiaotian Lin, Tianqi Luo

HKUSTDial

Reinforcement Learning
Activity Frames: Deterministic Screen-Activity Compilation for Agent Memory and Replay
HuggingFace
23

Activity Frames: Deterministic Screen-Activity Compilation for Agent Memory and Replay

Nossa Iyamu

NLP
KVAE: Family of Tokenizers for Multimodal Generative Models
HuggingFace
20

KVAE: Family of Tokenizers for Multimodal Generative Models

Andrey Shutkin, Denis Parkhomenko, Ivan Kirillov, Kirill Chernyshev, Kirill Malakhov

Kandinsky Lab

Robotics
Weights or Skills? A Survey of Robot-Learning Techniques: from Action-Predicting Weights to Robots that Write their Own Skills
HuggingFace
10

Weights or Skills? A Survey of Robot-Learning Techniques: from Action-Predicting Weights to Robots that Write their Own Skills

Gaytri Jena, Kapil Wanaskar, Vinija Jain, Aman Chadha, Vasu Sharma

Reinforcement Learning
FactorJEPA: Factorizing Monolithic Futures into Layout-Agent-Interaction Channels for Crowded and Chaotic Global South Urban Worlds
HuggingFace
10

FactorJEPA: Factorizing Monolithic Futures into Layout-Agent-Interaction Channels for Crowded and Chaotic Global South Urban Worlds

Kapil Wanaskar, Gaytri Jena, Aman Chadha, Vinija Jain, Vasu Sharma

Computer Vision
GaussianSelector: Lightweight Human-Guided Object Selection in 3D Gaussian Splatting with Graph Optimization
HuggingFace
9

GaussianSelector: Lightweight Human-Guided Object Selection in 3D Gaussian Splatting with Graph Optimization

Baihan Yang, Tiexin Li, Yuheng Liu, Xin Lin, Xinke Li

LL Lab

AI Research Papers — August 9, 2026 Edition | Agentic Brew