Jul 27, 2026 SuperThoughts — Reasoning Tokens in Superposition Jul 18, 2026 Blend-ASC — Optimal Self-Consistency via Power-Law Sample Efficiency Jul 18, 2026 SOL — Self-Optimizing Language Models via Token-Level Efficiency Policies May 21, 2026 AlpaServe — Statistical Multiplexing with Model Parallelism for DL Serving May 18, 2026 MEMENTO: Teaching Reasoning Models to Compress Their Own Thinking