Tvrtka Moondream razvila je Photon, inference engine koji omogućuje gotovo realno vrijeme izvođenja velikih modela jezika (VLM) s prosječnim vremenom od 33 milisekunde na NVIDIA B200.
Moondream predstavio Photon za ubrzanje AI modela
Izvori
Originalni sadržaj iz javnih izvora. Pune članke ne objavljujemo — kliknite za izvornu publikaciju.
- Hacker News Front (2026-06-30 05:14) Pročitaj original ↗
AI će pretražiti dodatne izvore i sintetizirati detaljniji sažetak (8-12 rečenica) iz više izvora. Rezultat se ne sprema javno i ne indeksira.