Inception Labs danas je objavio model umjetne inteligencije Mercury 2.5, najnapredniji diffusion LLM na tržištu. Model donosi 40 % veću inteligenciju u odnosu na prethodnu verziju Mercury 2 i usporediv je s modelima poput GPT-5.6 Luna, Gemini 3.5 Flash-Lite i Claude Haiku 4.5. Brzina obrade iznosi 1 107 tokena u sekundi na široko dostupnim NVIDIA grafičkim procesorima. Cijena iznosi 0,20 USD po milijun ulaza i 0,75 USD po milijun izlaza, a pri lansiranju je ponuđena s popustom od 80 % po cijeni od 0,04 USD i 0,15 USD. Mercury 2.5 podržava prilagodljivo rasuđivanje, paralelne pozive alata i generiranje JSON-a usklađenog sa šemom. Prema podacima, model je smanjio medijan latenciju na 170 ms u AI telefonskim agentima i skratio P99 vrijeme odgovora s nekoliko minuta na jednu sekundu.