The Research Desk.

The most upvoted and starred AI research crossing the community today.

Last Brew Time: Aug 3, 2026, 7:35 PM PT

X.com Research Buzz

NLP
LLMs can’t jump: Scientific Invention Position Paper
X.com
5824

LLMs can’t jump: Scientific Invention Position Paper

T. Zahavy

Google DeepMind

SITUATIONAL AWARENESS: The Decade Ahead
X.com
3158

SITUATIONAL AWARENESS: The Decade Ahead

Leopold Aschenbrenner

NLP
Inducing language models to assert their own consciousness restores human beliefs and values
X.com
2602

Inducing language models to assert their own consciousness restores human beliefs and values

Junsol Kim, Winnie Street, Roberta Rocca, Diane M. Korngiebel, Adam Waytz, James Evans, Geoff Keeling

Google, University of Chicago, University of London, University of Washington, Northwestern University, Santa Fe Institute

AlphaXiv Trending

Ten Advances in Mathematics and Theoretical Computer Science
AlphaXiv
130

Ten Advances in Mathematics and Theoretical Computer Science

OpenAI

Reasoning
AlphaXiv
92

Qwen3.8-Max: A New Bar for Coding and Cowork

Qwen Team

Metis: Memory Foundation Model
AlphaXiv
88

Metis: Memory Foundation Model

Zeyu Zhang, Ziliang Guo, Yihang Sun

Renmin University of China, National University of Singapore, Shanghai Jiao Tong University, Tongji University, Metis: Memory Foundation Model

Machine Learning
Frontis-MA1: Training an AI4AI Model towards Recursive Self-Improvement in Machine Learning Engineering
AlphaXiv
77

Frontis-MA1: Training an AI4AI Model towards Recursive Self-Improvement in Machine Learning Engineering

Junlin Yang, Che Jiang, Yu Fu

Pangram 4 Technical Report
AlphaXiv
76

Pangram 4 Technical Report

Ben Glickenhaus, Katherine Thai, Jenna Russell

Machine Learning
Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation
AlphaXiv
75

Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation

Alexi Gladstone, Heng Ji, Yilun Du

HuggingFace Daily Papers

Reinforcement Learning
Weak-to-Strong On-Policy Distillation
HuggingFace
41

Weak-to-Strong On-Policy Distillation

Fangxu Yu, Zinan Lin, Xiaodong Liu, Weijia Xu, Michael Xu

Microsoft Research

Reinforcement Learning
SAF-OPD: Stable Advantage Fusion for On-Policy Distillation
HuggingFace
23

SAF-OPD: Stable Advantage Fusion for On-Policy Distillation

Yifan Ding, Xincheng Wei, Yoshua Y. Li, Ziheng Li, Yuquan Lu

Reinforcement Learning
EMBL AI Librarian: Life-Sciences Knowledge Layer for AI Agents
HuggingFace
4

EMBL AI Librarian: Life-Sciences Knowledge Layer for AI Agents

Luigi Sigillo, Matteo Silvestri, Francesco Tabaro, Rajat Bhatnagar, Syed Irtaza Mubashar

European Molecular Biology Laboratory

Computer Vision
RL^2-VLA: Adaptive RL Latent Compositional Steering with Test-Time Scaling for Vision-Language-Action Models
HuggingFace
4

RL^2-VLA: Adaptive RL Latent Compositional Steering with Test-Time Scaling for Vision-Language-Action Models

Derek Ming Siang Tan, Shailesh Shailesh, Srikrishna Iyer, William Wei Jie Teo, Yuanliang Ju

National University of Singapore

Machine Learning
Constitutional Midtraining: Content Presence Drives Alignment Gains
HuggingFace
3

Constitutional Midtraining: Content Presence Drives Alignment Gains

Desiree Cho, Cameron Tice, Bernie Hogan, Hunar Batra, Puria Radmard

University of Oxford

Reasoning
Not All Tokens Deserve Equal Credit: Counterfactual Sensitivity Credit Reallocation for Long-CoT Reasoning
HuggingFace
2

Not All Tokens Deserve Equal Credit: Counterfactual Sensitivity Credit Reallocation for Long-CoT Reasoning

Qiangqiang He, Zhongheng Wu, ZiJian Wang

Nanjing University