## Episode Summary
In this episode, we cover:
- **Don't Drop the BATON: Long-Horizon Robot Manipulation via Agentic Subtask Exploration and Transition-aware Memory** (arXiv)
- [Read more](http://arxiv.org/abs/2608.16889v1)
- **How Do Agents Fail on AutoResearch: End-to-End Diagnostic Evaluation on 100 Real-World Frontier Research Tasks** (Hugging Face Daily)
- [Read more](https://huggingface.co/papers/2608.14905)
- **StateM: Reaching 95.3% Raw Accuracy, or a \$15 Frontier Run, on Terminal-Bench 2.1 via Harness Scaling** (Hugging Face Daily)
- [Read more](https://huggingface.co/papers/2608.15089)
- **Advancing Open and Reproducible Relational Learning: RelArena-α, TabPFN-Rel and RPI** (Hugging Face Daily)
- [Read more](https://huggingface.co/papers/2608.16319)
- **Large Discovery Models: Empirically-grounded Model-Based Open-Ended Search** (Hugging Face Daily)
- [Read more](https://huggingface.co/papers/2608.15669)
---
*Sponsored by Ada, Ago Consulting, and Zen Semiconductor*