The Research Desk.

The most upvoted and starred AI research crossing the community today.

Last Brew Time: Aug 29, 2026, 10:51 AM PT

AlphaXiv Trending

Human–AI Collaboration at Scale: Task Criticality, Agency, and Friction Across 250,000 Conversations
AlphaXiv
295

Human–AI Collaboration at Scale: Task Criticality, Agency, and Friction Across 250,000 Conversations

View PDF

Retrieval
Accelerating Scientific Research with Gemini in the Real-World
AlphaXiv
183

Accelerating Scientific Research with Gemini in the Real-World

View PDF

Affiliation: Google DeepMind, Affiliation: Duke University, Affiliation: Columbia University, Affiliation: Google Research, Affiliation: Texas A&M University

Reinforcement Learning
Code World Model: Coding Agent as World Brain
AlphaXiv
113

Code World Model: Coding Agent as World Brain

View PDF

Westlake AGI Lab, AGI Lab, Westlake University, Nanyang Technological University

Efficiency
Prefix Sliding for efficient test-time scaling
AlphaXiv
74

Prefix Sliding for efficient test-time scaling

View PDF

Affiliation: s Stanford University c University of California at Santa Barbara p Prime Intellect, Affiliation: w University of Washington, Stanford University, University of California at Santa Barbara, University of Washington

Retrieval
Automated Researchers Can Reliably Mitigate Alignment Failures
AlphaXiv
56

Automated Researchers Can Reliably Mitigate Alignment Failures

View PDF

Computer Vision
Zero-WAM: In-Context World-Action Modeling from Human Videos for Open-Ended Task Generalization
AlphaXiv
52

Zero-WAM: In-Context World-Action Modeling from Human Videos for Open-Ended Task Generalization

View PDF

https://robbyant-research.github.io/Zero-WAM/

HuggingFace Daily Papers

Reinforcement Learning
PILOT in the Loop: Live Self-Improvement for Long-Horizon Agents
HuggingFace
26

PILOT in the Loop: Live Self-Improvement for Long-Horizon Agents

Yang Xiao, Yusong Sun, Haoyi Wu, Wenyang Hui, Wen Da

The Hong Kong Polytechnic University

Computer Vision
Luce: Relightable Gaussians for 3D Asset Generation
HuggingFace
7

Luce: Relightable Gaussians for 3D Asset Generation

Mayank Singh, Michele Stoppa, Alvise Memo, Rui Yu, Harsha Kalli

Apple

NLP
CritICL: Inference-Time Weak-to-Strong Generalization from Small Language Model Failure Modes
HuggingFace
6

CritICL: Inference-Time Weak-to-Strong Generalization from Small Language Model Failure Modes

Yufan Wu, Yinghui He, Zhengyi Hu, Lang Wei, Ruichen Li

TacForcing: Streaming Action Generation with Execution-Time Tactile Feedback
HuggingFace
5

TacForcing: Streaming Action Generation with Execution-Time Tactile Feedback

Jianbo Zhou, Boyuan Zhao, Yuzheng Zhang, Yiyang Chen, Wenxin Chen

Computer Vision
EditaLive! Unified Character Video Editing for Live Streaming
HuggingFace
3

EditaLive! Unified Character Video Editing for Live Streaming

Zhiyuan Li, Chi-Man Pun, Peng-Tao Jiang, Bo Li, Xiaodong Cun

GVC Lab at Great Bay University

Efficiency
What Does an Evaluation License? A Commit-Bound Census of Claim-Relative Inference in Inspect Evals
HuggingFace
2

What Does an Evaluation License? A Commit-Bound Census of Claim-Relative Inference in Inspect Evals

Xi Qin