Stability AI vydala predbežnú verziu svojho modelu Stable Diffusion 3.0, ktorý je ďalšou generáciou generatívneho modelu umelej inteligencie pre prevod textu na obraz. Spoločnosť v uplynulom roku neustále zlepšovala svoje obrazové modely a cieľom nového modelu je poskytnúť lepšiu kvalitu a výkonnosť obrazu. Zameriava sa tiež na zlepšenie typografie, čo je oblasť, v ktorej mali predchádzajúce modely problémy. Stable Diffusion 3.0 je založený na novej architektúre nazývanej difúzne transformátory, ktoré umožňujú novú éru generovania obrazu. Model sa vyvíja vo viacerých veľkostiach, od 800M do 8B parametrov. Spoločnosť Stability AI experimentuje aj s inými prístupmi, napríklad s Würstchenovou architektúrou v systéme Stable Cascade. Vylepšená typografia vo verzii Stable Diffusion 3.0 je dosiahnutá použitím architektúry transformátorov a dodatočných kódovačov textu. Model je spočiatku demonštrovaný ako technológia prevodu textu na obraz, ale bude slúžiť ako základ pre budúce vizuálne modely vrátane generovania videa a 3D obrazu.
