Siirry sisältöön
LaFoto

Tekoälykuvasanasto

Sanasto, jonka tekoälykuvageneraattori olettaa sinun jo osaavan

Jokainen alla oleva termi esiintyy oikeassa käyttöliittymässä tai oikeassa promptissa. Kukin määritellään ensin yhdellä lauseella, koska määritelmä, joka pitää lukea kahdesti, on epäonnistunut.

Suurin osa vaikeuksista tekoälykuvien generoinnissa on sanastoa, ei tekniikkaa. Seed, denoise-voimakkuus, guidance scale ja inpainting nimeävät kukin yhden tietyn käyttäytymisen, ja kun sana merkitsee jotain, ohjaus muuttuu ilmeiseksi. Nämä termit kannattaa tuntea — siinä järjestyksessä, jossa niihin törmäät.

Miten generointi toimii

diffuusio
Tekniikka, johon useimmat nykyiset kuvamallit perustuvat: koulutetaan lisäämällä kohinaa oikeisiin kuviin ja oppimalla kumoamaan se, sitten prosessi ajetaan takaperin puhtaasta kohinasta uudeksi kuvaksi.
Tekstistä kuvaksi
Uuden kuvan generointi pelkän kirjallisen kuvauksen perusteella ilman lähdekuvaa. Myös “text to photo”, kun tavoite on valokuvamainen tulos.
Kuvasta kuvaksi
Uuden kuvan generointi olemassa olevan kuvan ja promptin pohjalta, jossa denoise-voimakkuus määrää, kuinka paljon lähteestä säilyy.
Checkpoint
Tallennettu joukko mallin painoja. Saman arkkitehtuurin eri checkpointit tuottavat näkyvästi erilaista jälkeä samoilla prompteilla.

Säätimet ja parametrit

Seed
Luku, joka määrää, millaisesta lähtökohinasta generointi alkaa. Sama seed saman promptin ja saman mallin kanssa tuottaa saman kuvan uudelleen.
Denoise-voimakkuus
Kuvasta kuvaan -generoinnissa, kuinka paljon lähdekuvastasi hylätään ennen uudelleengenerointia. Pienet arvot säilyttävät alkuperäisen; suuret kohtelevat sitä löyhänä viitteenä.
Ohjausaste
Kuinka voimakkaasti mallia työnnetään kohti promptia jokaisessa vaiheessa. Liian matalalla se harhailee; liian korkealla tulos jäykistyy ja ylisaturoituu.
LoRA
Pieni koulutettu lisäosa, joka opettaa perusmallille tietyn tyylin, hahmon tai objektin ilman koko mallin uudelleenkoulutusta.
Negatiivinen prompt
Erillinen kenttä sille, mitä halutaan välttää. Kaikki päätepisteet eivät tue sitä — jos tukea ei ole, kaikki kirjoittamasi on positiivinen ohje.
Näytteenotin
Algoritmi, joka vie kohinanpoistoa vaihe vaiheelta eteenpäin. Eri näytteenottimet konvergoivat eri vauhdilla ja tuottavat hieman erilaisen tuloksen samasta seedistä.

Muokkaustoiminnot

Inpainting
Maskatun alueen uudelleengenerointi kuvan sisällä säilyttäen kaiken maskin ulkopuolella koskemattomana. Perusta kohteiden poistolle ja kohdennetulle editoinnille.
Outpainting
Uuden kuvasisällön generointi alkuperäisen kehyksen ulkopuolelle. Sillä voi laajentaa valokuvan leveämpään kuvasuhteeseen ilman rajausta.

Tiedostot ja ulostulo

Kuvasuhde
Kuvan leveyden ja korkeuden välinen suhde, kuten 1:1, 4:5 tai 16:9. Valitaan ennen generointia, koska malli sommittelee kehyksen mukaan.
Ylösskaalaus
Kuvan suurentaminen yli sen alkuperäisten pikselimittojen. Tekoälysuurennus rekonstruoi uskottavaa yksityiskohtaa sen sijaan, että vain interpoloisi olemassa olevien pikselien välistä.
Alfakanava
Kuvan läpinäkyvyyskanava. PNG ja WebP tukevat sitä; JPEG ei, minkä vuoksi JPEG-muotoon tallennettu läpinäkyväksi rajattu kuva saa peittävän taustan.
EXIF
Valokuvaan upotettu metadata, joka tallentaa kameran, objektiivin, valotuksen, päivämäärän ja usein GPS-koordinaatit. Poistuu aina, kun tiedosto uudelleenkoodataan.

Miten tämä sanasto toimii

Termit
Vain sellaiset, joita kohtaat oikeassa käyttöliittymässä
Määritelmät
Aina yksi lause ensin
Oma sivu
Vain kun kappale ei riitä
Skeema
DefinedTermSet, linkitetyin jäsenin
Päivitetään
Kun mallien toiminta muuttuu
Hinta
Maksuton, ei tiliä

Käytännössä

Useimmat tekoälykuvan vaikeudet ovat sanastoa

Seed, denoise strength, guidance scale ja inpainting nimeävät kukin täsmälleen yhden käyttäytymisen. Kun sana merkitsee jotain, sitä kuvaava säätö on ilmeinen — siihen asti käyttöliittymä näyttää mielivaltaiselta liukusäädinseinältä.

Siksi täällä määritelmä tulee ensin ja selitys toisena. Määritelmä, joka on luettava kahdesti, epäonnistui ainoassa tehtävässään.

avoin tekninen hakuteos lämpimällä paperilla, suurennuslasi kaavioiden sivun päällä

Kolme tapaa lähestyä

Mistä aloittaa

Miten kuvat syntyvät

Diffuusio, text to image, image to image ja checkpointit. Mekaniikka, joka selittää miksi sama prompt tuottaa eri tuloksia.

  • Aloita diffuusiosta, sitten seed.
  • Text to image ja image to image ovat eri tiloja.
  • Checkpointit muuttavat ulostuloa enemmän kuin promptit.
tekoälyn tuottama muotokuvatutkielma

Yksityiskohdat

Kysymyksiä sanastosta

Useimmin nousevat sanastokysymykset.

Miksi sama prompt antaa eri kuvia

Seed ei ollut lukittu. Generointi alkaa satunnaiskohinasta, ja lähtöpiste vaikuttaa tulokseen enemmän kuin useimmat prompt-muutokset.

Mitä denoise strength tekee

Määrittää, kuinka paljon lähdekuvasta säilyy image-to-image-generoinnissa. Se on tärkein säätö siinä tilassa.

Ero inpaintingin ja outpaintingin välillä

Inpainting generoi uudelleen kehyksen sisällä; outpainting sen ulkopuolelle. Sama toiminto, eri alue.

Toimiiko seed mallien yli

Ei. Seed indeksoi yhden mallin kohina-avaruuteen, joten sama numero muualla tuottaa jotain aivan muuta.

Miksi kuvasuhde kannattaa valita ensin

Malli sommittelee annetulle kehykselle, joten jälkikäteen rajaaminen heittää pois järjestelyä, joka tehtiin tarkoituksella.

Tekoälyn luoma tuotevalokuva valkoisella kaarevalla taustalla

Jatka tutkimista

Muualla LaFotossa

Jokainen termi kuvaa jotakin, mitä jokin näistä tekee.

Vocabulary

Kysymyksiä tekoälykuvatermeistä

Mikä on seed tekoälykuvien generoinnissa?
Seed on luku, joka kiinnittää satunnaiskohinan, josta generointi alkaa. Sama seed, prompt ja malli toistavat saman kuvan — siksi sen kiinnittäminen on ainoa tapa testata, mitä yhden sanan muutos oikeasti teki.
Mitä denoise-voimakkuus säätää?
Kuinka paljon lähtökuvastasi säilyy image-to-image-generoinnissa. Arvolla 0,2 valokuva on käytännössä ehjä; 0,5:ssä sommittelu pysyy mutta sisältö neuvotellaan uudelleen; 0,85:ssä lähde on enää lähinnä moodboard.
Mikä ero on inpaintingilla ja outpaintingilla?
Inpainting generoi uudelleen maskatun alueen olemassa olevan kehyksen sisällä; outpainting luo uutta sisältöä alkuperäisten reunojen ulkopuolelle. Sama toimenpide eri kohtaan — toinen korjaa, toinen laajentaa.
Mitä guidance scale tarkoittaa?
Kuinka voimakkaasti mallia ohjataan kohti prompttiasi jokaisessa denoise-askeleessa. Liian matalana se ajautuu sanoistasi; liian korkeana tulos jäykistyy ja ylikyllästyy, kun malli ylioikaisee.
Mikä on LoRA?
Pieni koulutettu lisä, joka opettaa perusmallille tietyn tyylin, hahmon tai objektin ilman koko mallin uudelleenkoulutusta. Näin avointen mallien käyttäjät saavat yhtenäiset hahmot moniin kuviin.
Miksi kuvasuhde pitää valita ennen generointia?
Malli sommittelee annetulle kehylle: 16:9 vaakaan ja 4:5 pystyyn. Jälkikäteen rajaaminen heittää pois sommittelua, jonka se teki tarkoituksella.
Mikä on alfakanava?
Kuvan läpinäkyvyyskerros. PNG ja WebP tukevat alfakanavaa; JPEG ei, minkä vuoksi leikattu kohde, joka tallennetaan JPEGinä, saa taustakseen valkoisen.
Toimiiko sama seed eri mallissa?
Ei. Seed indeksoi yhden tietyn mallin kohina-avaruudessa, joten sama luku toisessa mallissa — tai usein saman mallin toisessa versiossa — tuottaa jotain epäolennaisesti erilaista. Tallenna malli siemenen yhteyteen.

Aloita luominen tänään

Luo ensimmäinen kuvasi parhaalla tekoälykuvageneraattorilla.

Muunna lause valmiiksi, fotorealistiseksi kuvaksi sekunneissa — ja hio jokaista yksityiskohtaa. Ei asennusta, ei Discordia, ei GPU:ta.

Liity 4 200+ tekijän joukkoon, jotka käyttävät LaFotoa