The Research Desk.

The most upvoted and starred AI research crossing the community today.

Last Brew Time: Oct 9, 2026, 11:25 AM PT

X.com Research Buzz

Speech Audio
An Industrial-Strength Audio Search Algorithm
X.com
12863

An Industrial-Strength Audio Search Algorithm

Avery Li-Chun Wang

Columbia University

What if automating AI R&D triggers an intelligence explosion?
X.com
8154

What if automating AI R&D triggers an intelligence explosion?

Alan Chan, Christoph Winter, Andrew Barto, Jakub Pachocki, Geoffrey Hinton, Eric Horvitz, Yoshua Bengio, Dawn Song, Jack Clark, Hilary Greaves, Anton Korinek, Samuel Hammond, Thore Graepel, Ben Bariach, Philip H. S. Torr, Sheila A. McIlraith, Jeff Clune, Sam Manning, Girish Sastry, Tom Davidson, Daniel Eth, Sören Mindermann

CASP, University of Cambridge, GovAI, University of Massachusetts Amherst, OpenAI, University of Toronto, Vector Institute, Microsoft, Mila (Université de Montréal), Anthropic, University of Oxford, University of Virginia, Foundation for American Innovation, University College London, University of British Columbia, Guidelight, Forethought, AI Policy Institute

AlphaXiv Trending

Computer Vision
H-JEPA: End-to-End Learning of Hierarchical World Models for Visual Planning
AlphaXiv
217

H-JEPA: End-to-End Learning of Hierarchical World Models for Visual Planning

4k, Views

Affiliation: Brown University, Affiliation: Advanced Machine Intelligence Affiliation: Brown University, Brown University

Robotics
RoboJEPA: Scaling Robotic Latent World Models
AlphaXiv
74

RoboJEPA: Scaling Robotic Latent World Models

Views

Affiliation: FAIR at Meta, Affiliation: Chandar Research Lab, Affiliation: Mila - Quebec AI Institute, Affiliation: Chandar Research Lab Affiliation: Mila - Quebec AI Institute Affiliation: Polytechnique Montréal, Affiliation: FAIR at Meta Joint last author

Long-WAM: Scaling the Context of World-Action Models
AlphaXiv
60

Long-WAM: Scaling the Context of World-Action Models

Views, 3k

NVIDIA MIT HKU UCSD

Robotics
Embodied Turing Machines: Stateful Code for Robot Recursive Self-Improvement
AlphaXiv
19

Embodied Turing Machines: Stateful Code for Robot Recursive Self-Improvement

Views

Affiliation: Nanyang Technological University Ropedia, Nanyang Technological University

Computer Vision
SuperNav: An Agentic Navigation System for Any Task in Any Scene
AlphaXiv
14

SuperNav: An Agentic Navigation System for Any Task in Any Scene

Views

Affiliation: Zhejiang University, Affiliation: Shenzhen University, Zhejiang University, Shenzhen University

Reinforcement Learning
AgentGarten: Code Worlds for Evolving Agents
AlphaXiv
10

AgentGarten: Code Worlds for Evolving Agents

Views

https://github.com/MirroS-Lab/AgentGarten, https://mirros-lab.github.io/agent-garten

HuggingFace Daily Papers

Reinforcement Learning
Synthesis Through Simulation: Generating Coherent Enterprise Data via Scalable Agent-System Interaction
HuggingFace
3

Synthesis Through Simulation: Generating Coherent Enterprise Data via Scalable Agent-System Interaction

Yipeng Li, Ashutosh Hathidara, Jane Lo, Harshavardhan Abichandani, Gunraj Singh

SAP

Multimodal
Frozen Models, Evolving Expertise: Model-Agnostic Learning from Deployment Experience for Multimodal Medical AI
HuggingFace
2

Frozen Models, Evolving Expertise: Model-Agnostic Learning from Deployment Experience for Multimodal Medical AI

Yexiao He, Yucheng Tang, Pengfei Guo, Yufan He, Andriy Myronenko

NVIDIA

Reinforcement Learning
A GPU-Parallel Framework for Heterogeneous Multi-Task Reinforcement Learning
HuggingFace
1

A GPU-Parallel Framework for Heterogeneous Multi-Task Reinforcement Learning

Rui Zhang, Qiwei Wu, Zhengyu Zhang, Tao Li, Hongyu Zhou

NVIDIA

Ant Research
Mara Chain: Rethinking Failure as a Stepping Stone for AI System Auto-Evolution
HuggingFace
1

Mara Chain: Rethinking Failure as a Stepping Stone for AI System Auto-Evolution

Yubin Lyu, Fu Li, Jiawei Fei, Yang Zhao, Weixing Mei

Ant Group

NLP
Incidental information contaminates patient notes and disrupts clinical reasoning in large language models
HuggingFace
1

Incidental information contaminates patient notes and disrupts clinical reasoning in large language models

Krithik Vishwanath, Brandon Ye, Anton Alyakin, John E. Markert, Aaron Hsieh

NYU Langone Health OLAB

NLP
SpecFold: Folding Multi-Branch Redundancy for Faster Speculative Decoding in Diffusion Language Models
HuggingFace
1

SpecFold: Folding Multi-Branch Redundancy for Faster Speculative Decoding in Diffusion Language Models

Chung-En Ho, Weiyu Sun, Cheng-Jhih Shih, He Li, Yong Liu

Georgia Institute of Technology