U posljednjih nekoliko godina, modeli slika i videa znatno su poboljšani, iako su njihovi unutarnji mehanizmi ostali gotovo nepromijenjeni od Stable Diffusion 3. Postignuća u ovom području djelomično se pripisuju poboljšanju kvalitete podataka. Ranije se vjerovalo da je potrebno sakupiti što više podataka za treniranje generativnih modela, no sada se zna da loši podaci mogu otežati učenje modela. Kvalitetno filtriranje podataka omogućava modelu da se usredotoči na važnije informacije. Razvoj pristupa filtriranju podataka od 2024. godine doveo je do poboljšanja učinkovitosti generativnih modela. Za filtriranje velikih količina podataka, koriste se računalni algoritmi za obradu slika i videa. Posebna pažnja posvećena je predobradi videa, koji zahtijeva dodatnu obradu prije nego što se može koristiti za obuku modela.