Inception Labs danas je objavio model umjetne inteligencije Mercury 2.5, najnapredniji diffusion LLM na tržištu. Model donosi 40 % veću inteligenciju u odnosu na prethodnu verziju Mercury 2 i usporediv je s modelima poput GPT-5.6 Luna, Gemini 3.5 Flash-Lite i Claude Haiku 4.5. Brzina obrade iznosi 1 107 tokena u sekundi na široko dostupnim NVIDIA grafičkim procesorima. Cijena iznosi 0,20 USD po milijun ulaza i 0,75 USD po milijun izlaza, a pri lansiranju je ponuđena s popustom od 80 % po cijeni od 0,04 USD i 0,15 USD. Mercury 2.5 podržava prilagodljivo rasuđivanje, paralelne pozive alata i generiranje JSON-a usklađenog sa šemom. Prema podacima, model je smanjio medijan latenciju na 170 ms u AI telefonskim agentima i skratio P99 vrijeme odgovora s nekoliko minuta na jednu sekundu.
Inception Labs predstavio Mercury 2.5, najnapredniji diffusion LLM
Izvori
Originalni sadržaj iz javnih izvora. Pune članke ne objavljujemo — kliknite za izvornu publikaciju.
- Hacker News Front (2026-09-08 20:14) Pročitaj original ↗
AI će pretražiti dodatne izvore i sintetizirati detaljniji sažetak (8-12 rečenica) iz više izvora. Rezultat se ne sprema javno i ne indeksira.