Tämä lehti syntyi yksinkertaisesta havainnosta: kuvia, videota ja kolmiulotteista maailmaa luova tekoäly liikkuu nyt niin nopeasti, ettei kukaan ehdi seurata sitä työkseen — mutta aamukahvin mittainen päivälehti ehtii. Pikselipaino tutkii joka aamu viimeisen 48 tunnin julkaisut kahdeksalta alueelta kuvasta kuvaksi, kuvasta kolmiulotteiseksi, kuvasta videoksi ja niiden välimaastoista, ja kertoo omin sanoin, mikä on tekijälle merkityksellistä.
Ensimmäisen numeron teema tarjoili itse itsensä: yksittäisen tekijän voima. Päivän molemmat pääuutiset kertovat samaa tarinaa eri kulmista — harrastaja, joka laajensi kuvamallin arkkitehtuuria omalla pelikoneellaan ja vuokratulla klusterilla, ja yhteisö, joka pakkaa studiotason videomallia kotikoneen kokoon nopeammin kuin valmistaja ehtii julkaista. Suuret laboratoriot rakentavat moottorit; kentän äärellä istuvat ihmiset päättävät, mitä niillä ajetaan.
Anima-2.9B julkaistiin keskiviikkoaamuna — illalla se oli jo koko text-to-image-listan ykkösenä.
Nimimerkki Gazingstars123 julkaisi keskiviikkona mallin, jollaista ei ihan joka viikko nähdä: Anima-2.9B ei ole pelkkä hienosäätö, vaan pohjana olevan Anima-kuvamallin arkkitehtuurilaajennos. Tekijä kasvatti mallin muuntajakerrosten määrän 28:sta 40:een — noin 2,9 miljardiin parametriin — ja jatkoi koulutusta 1,7 miljoonalla uudella anime- ja kuvituskuvalla. Kuvien tekstitykset laadittiin sekoituksella tageja ja luonnollista kieltä, apuna kielimalleja Geministä Claude Sonnetiin.
Kiinnostavinta on mittakaava: koulutus ajettiin kahdeksan RTX 5080:n vuokraklusterilla, varhaisimmat vaiheet tekijän omalla kotikoneella. Rahoitus kerätään Ko-fi- ja PayPal-lahjoituksin. Silti mallikortti lupaa heinäkuulle 2026 ulottuvan tietopohjan — tekijän mukaan tuoreimpia anime- ja kuvitustyylin malleja julkaisuhetkellä — ja yhteisö näyttää uskovan: malli keräsi kymmeniä tykkäyksiä ensimmäisten tuntien aikana ja nousi trending-listan kärkeen ohi vakiintuneiden nimien. Työ on kesken ilmoitetustikin ("training in progress"), joten seuraamme, kantaako lupaus. Käyttö vaatii toistaiseksi oman ComfyUI-solmun, ja lisenssi on ei-kaupallinen.
Lähteet: mallikortti, ComfyUI-solmu, Hugging Face API (trending 13.8.)
48 tunnissa videomallista ilmestyi GGUF-, FP8-, NVFP4- ja INT4-pakkaukset. Sama näytelmä nähtiin LTX-2.3:lla — nyt kierros kesti viikkoja, ei kuukausia.
Lightricksin heinäkuussa julkaisema LTX-2.5 on studioluokan videomalli, jonka 22 miljardin parametrin koko on pitänyt sen konesalien herkkuna. Viimeisen kahden vuorokauden aikana Hugging Faceen on kuitenkin ilmestynyt tasainen virta yhteisön pakkauksia: tislattu GGUF-versio, kaksi FP8-muunnosta, NVFP4-kokeilu ja eksoottisempi INT4-kvantisointi. Suomeksi: mallista puristetaan bittejä pois niin, että se mahtuu pelinäytönohjaimen muistiin — laadun siitä juuri kärsimättä.
Ilmiö toistaa LTX-2.3:n kaaren, jossa GGUF-pakkaukset toivat ääntä ja kuvaa yhdistävän videogeneraation kotikoneille ja poikivat NVIDIAn omat ComfyUI-oppaat asti. Uutta on tahti: 2.3:n kohdalla kierros kesti kuukausia, nyt viikkoja. Lightricks ei katsele sivusta, vaan julkaisi tiistaina oman Pixel-Spatial-Upscaler-lisäosansa — LoRA-tarkennin, joka skaalaa videon yksityiskohdat terävämmiksi jälkikäteen. Kotivideogeneraation ekosysteemi järjestäytyy nyt samaan tapaan kuin kuvagenerointi pari vuotta sitten: valmistaja tuo moottorin, yhteisö tekee siitä ajettavan.
Lähteet: Hugging Face API (image-to-video & video-to-video, 48 h), HackerNoon: LTX-2.3 GGUF, DEV: LTX GGUF -asennusopas
Tekstintunnistus: harrastajan hayai-ocr-v2 jatkaa pienten, nopeiden OCR-mallien aaltoa — kuvasta tekstiksi -alue on hiljalleen siirtymässä jättimalleista täsmätyökaluihin.
Asentotunnistus: tutkimusryhmä pudotti neljän mallin GKDT-sarjan avainpistetunnistukseen — tarjolla erikseen tutkimus- ja sovellusversiot, mikä on kentällä harvinaisen siisti ele.
Animointi: Wan2.2-Animate sai W4A4-pakkauksen — hahmoanimaatio kuvasta seuraa videomallien kotikonepolkua.
Kuvamallit: Krea-2 Turbosta ilmestyi GGUF-käännös, ja avatar-puolella cicada-ai työnsi videosta videoksi -mallinsa toisen sukupolven.
Microsoftin avoin 3D-malli on kerännyt yli 1,2 miljoonaa latausta — tässä siihen tartutaan käytännön kautta.
Sarjamme esittelee joka numerossa yhden suositun mallin sen kautta, mitä sillä oikeasti saa aikaan. Aloitamme TRELLIS.2-4B:stä, koska se tekee jotakin, mikä vielä hetki sitten kuulosti tieteiskirjallisuudelta: yksi valokuva sisään, valmis kolmiulotteinen esine ulos — pintamateriaaleineen, jopa läpinäkyvyyksineen. MIT-lisenssi tekee siitä poikkeuksellisen: tuotoksia saa käyttää myös kaupallisesti.
Mitä sillä tekee? Peliprototyyppi: kuvaa lautapelinappula tai konseptipiirros, aja se mallin läpi, ja saat meshin PBR-materiaaleineen suoraan Blenderiin tai pelimoottoriin — tuntien mallinnustyö kutistuu minuuteiksi, ja juuri tähän esituotantokäyttöön pelistudiotkin näitä nyt sovittavat (ks. Nostot). Esineistön monistus: kirpputorilöytö, museoesine tai vintage-lamppu digitoituu sisustus- tai VR-projektiin yhdellä kännykkäkuvalla. 3D-tulostus: luonnos paperilla aamulla, tulostettava kappale illalla. Teknisesti mallin "field-free" O-Voxel-rakenne tarkoittaa, ettei se kompastu aiempien menetelmien kompastuskiviin — avoimiin pintoihin ja monimutkaisiin muotoihin — vaan käsittelee reikäiset, ohuet ja sisäkkäiset rakenteet siinä missä umpinaisetkin.
Käytännön vinkit: paras tulos syntyy selkeästä kohteesta neutraalilla taustalla ja hyvässä valossa. Resoluution voi valita 512³:sta aina 1536³:een — aloita pienestä, nosta kun sommitelma toimii. Ja kannattaa kokeilla nimenomaan "mahdottomia" muotoja: verkkoaitoja, lasiesineitä, kasveja — juuri niissä ero edeltäjiin näkyy.
Lähteet: mallikortti, tutkimusartikkeli, projektisivu
Pelistudiot: Lies of P -pelistä tunnettu Round8 Studio rakentaa generatiivista tekoälyä osaksi taidetuotantoaan — julkaisija Neowizin mukaan tekoälykuvat toimivat esituotannon sisäisenä referenssinä, ja lopulliset assetit tekevät taiteilijat. Studio on palkkaamassa "AI Creatoria", jonka työkalupakkiin listattiin mm. Stable Diffusion ja Midjourney sekä tekoälyavusteinen teksturointi. Kiistelty mutta suuntaa näyttävä ratkaisu: tekoäly luonnostelee, ihminen viimeistelee. (TheGamer, Wccftech)
Hahmosuunnittelijat: yhteisön CharacterSheet-lisäosa tuottaa yhdestä kuvasta kokonaisen hahmoarkin — sama hahmo edestä, sivulta ja eri ilmeillä. Juuri tällaista johdonmukaisuutta pelinkehittäjät, sarjakuvantekijät ja kumppanisovellusten rakentajat ovat kaivanneet: hahmo, joka pysyy itsenään kuvasta toiseen.
Asentokontrolli palaa muotiin: Krea-2:n pose-ControlNet kerää tasaista suosiota — merkki siitä, että ohjattu generointi (hahmo täsmälleen haluttuun asentoon) on siirtymässä SD-aikakaudelta uusien mallien vakiovarusteeksi.
Kun Stable Diffusionin alkuperäistekijät perustivat Black Forest Labsin ja julkaisivat kesällä 2024 FLUX.1:n, avoin kuvagenerointi sai uuden mittatikun: valokuvamainen laatu, toimivat kädet ja luettava teksti kuvissa. Kaksi vuotta myöhemmin FLUX.1-dev pitää yhä paikkaansa ladatuimpien mallien joukossa — tämän lehden trending-listalla se oli tänäänkin kolmantena, 14 000 tykkäyksen voimin.
Perhe on sittemmin kasvanut: FLUX.2-dev nosti rimaa marraskuussa 2025, ja tammikuun FLUX.2-klein-9B pakkasi laadun yhdeksään miljardiin parametriin — sadointuhansin kuukausilatauksin. Aloittelijalle FLUX on turvallinen ensiaskel: dokumentaatio on runsas, LoRA-hienosäätöjä löytyy joka lähtöön ja ComfyUI-työnkulut ovat kypsiä. Kokeneemmalle klein-versio on kiinnostava juuri siksi, että se mahtuu kotikoneelle tinkimättä liikaa — ja siihen teemaan tämä lehti tulee palaamaan usein.
Sarjassa seuraavaksi: Stable Diffusion → SDXL — kaiken alku.
Pikselipaino · Nro 001 · 13.8.2026 · POC-seurantajakso — lehteä ei julkaista, arkisto elää Lehtikioskissa.
Tutkimus: Hugging Face API (8 seuranta-aluetta, 48 h -ikkuna ja trending), verkkohaku ja lähdesivut. Kuvitus: gemini-3.1-flash-image, art deco -tyyliohje. Tekstit kirjoitettu omin sanoin, lähteet juttujen lopussa.