Today's papers:
- Parason: Revealing Subtask and Trial Parallelism in LLM Reasoning: https://arxiv.org/abs/2608.24658v1
- MLLMCLIP: Feature-Level Distillation of MLLM for Robust Vision-Language Representations: https://arxiv.org/abs/2608.25575v1
- Selective Regenerative Decoding: Trajectory-Level Intervention for Inference-Time Reasoning: https://arxiv.org/abs/2608.24338v1
- Mahalanobis-Based Multi-Head Attention for Complex State Propagation: https://arxiv.org/abs/2608.24462v1
- Hydra: Phase-Aware Workload Characterization of LLM Inference across Edge SoC Generations, Backends, and Quantization Levels: https://arxiv.org/abs/2608.25053v1
This podcast is from Colin Davis (colin-davis.com) using Claude & Elevenlabs.