The Research Desk.

The most upvoted and starred AI research crossing the community today.

Last Brew Time: Aug 10, 2026, 5:05 PM PT

X.com Research Buzz

Retrieval
The Tragedy of the Cognitive Commons: How AI Could Disrupt the Regeneration of Professional Expertise
X.com
15832

The Tragedy of the Cognitive Commons: How AI Could Disrupt the Regeneration of Professional Expertise

Nolan Lovett

Reinforcement Learning
Modeling Earth-Scale Human-Like Societies with One Billion Agents
X.com
4870

Modeling Earth-Scale Human-Like Societies with One Billion Agents

Haoxiang Guan, Jiyan He, Liyang Fan, Zhenzhen Ren, Shaobin He, Xin Yu, Yuan Chen, Xueyin Xu, Shuxin Zheng, Yan Gao, Enhong Chen, Tie-Yan Liu, Zhen Liu

AlphaXiv Trending

Computer Vision
On-Policy Self-Distillation without Any Supervision
AlphaXiv
119

On-Policy Self-Distillation without Any Supervision

Yijiang Li, Bingyang Wang, YL, Yijun Liang

Georgia Institute of Technology, University of Maryland, College Park, ByteDance

Reinforcement Learning
AgentOPSD: Recursive Self-Distillation for Agentic Reinforcement Learning
AlphaXiv
80

AgentOPSD: Recursive Self-Distillation for Agentic Reinforcement Learning

Zi-Han Wang, Zhengxi Lu, Zhiyuan Yao

Tsinghua University, Zhejiang University

Reinforcement Learning
Argus: A General-Purpose Agentic Runtime for Long-Horizon Reasoning
AlphaXiv
74

Argus: A General-Purpose Agentic Runtime for Long-Horizon Reasoning

Boxiu Li, Zimo Wen, Yijia Fan

Microsoft, Shanghai Jiao Tong University, Fudan University, Nanjing University, Tsinghua University

NLP
HarnessOpt-Bench: Evaluating LLMs at Harness Optimization
AlphaXiv
49

HarnessOpt-Bench: Evaluating LLMs at Harness Optimization

VU, Varun Ursekar, AS, Apaar Shanker, Yash Maurya

https://scale.com/research

Reinforcement Learning
Self-Evolving Coding Agents
AlphaXiv
48

Self-Evolving Coding Agents

Hao Zhou, Haichuan Hu, Ye Shang

Nanjing University of Science and Technology, Nanjing University

Energy-Guided Flow Matching
AlphaXiv
44

Energy-Guided Flow Matching

Haoyang Tong, Yu He, Fang Li

HuggingFace Daily Papers

Reinforcement Learning
MatrAIx: Simulating the World with 8.3 Billion Persona Agents
HuggingFace
14

MatrAIx: Simulating the World with 8.3 Billion Persona Agents

Xiaomin Li, Yuexing Hao, Jianheng Hou, Jintao Huang, Qianfeng Wen

MatrAIx

Reinforcement Learning
DCAS: Decoupling CLI Agent Scaffolding to Internalize Planning across Scaffolds
HuggingFace
12

DCAS: Decoupling CLI Agent Scaffolding to Internalize Planning across Scaffolds

Kishanthan Thangarajah, Boyuan Chen, Ahmed E. Hassan

Centre for Software Excellence

Robotics
Enfold: Folding World Model Imagination into Predictive Representations for Ultra-Efficient Embodied Control
HuggingFace
1

Enfold: Folding World Model Imagination into Predictive Representations for Ultra-Efficient Embodied Control

Weili Zeng, Yitong Xing, Fulong Liu, Chengqun Yang, Antao Xiang

NLP
CLIP-CC-Bench: Evaluating Paragraph-Level Video Descriptions in Video-Language Models
HuggingFace
1

CLIP-CC-Bench: Evaluating Paragraph-Level Video Descriptions in Video-Language Models

Mukhtiar Ali, Harsh Dubey, Sugam Mishra, Chulwoo Pack

MINT Lab

Duplexgen
DuplexGen: Adaptive Synthesis of Human-AI Turn-Taking Dialogues
HuggingFace
1

DuplexGen: Adaptive Synthesis of Human-AI Turn-Taking Dialogues

Takyoung Kim, Kang-wook Kim, Sang Hoon Woo, Julia Hirschberg, Gunhee Kim

University of Illinois at Urbana-Champaign

Complementary Matrix-Gated QKAN Fast-Weight Programmers for Quantum Dynamics Forecasting
HuggingFace
1

Complementary Matrix-Gated QKAN Fast-Weight Programmers for Quantum Dynamics Forecasting

Kuo-Chung Peng, Samuel Yen-Chi Chen, Jiun-Cheng Jiang, Chen-Yu Liu, En-Jui Kuo

AI Research Papers — August 11, 2026 Edition | Agentic Brew