Inception AI's Mercury 2.5 Hits Over 1,100 Tokens Per Second

Inception AI has released Mercury 2.5 Preview on OpenRouter, a diffusion-based LLM that achieves 1,107 tokens per second through parallel token generation.

2026-09-02 ~ 2026-09-02 · 2 related posts

1 near-duplicate retellings: volokuleshov