Egy egyszerű döntéshozó egység
A neurális háló apró számoló egységekből épül fel, amelyeket a laza hasonlat kedvéért neuronoknak nevezünk. Egy ilyen egység nagyon egyszerű dolgot csinál. Fogadja a bemenő számokat, mindegyiket megszorozza egy súllyal, összeadja őket, és az eredmény alapján ad egy kimenő értéket. A súly azt fejezi ki, mennyire fontos az adott bemenet. Ha egy bemenet erős súlyt kap, akkor nagyban befolyásolja a kimenetet, ha gyengét, akkor alig. Ennyi az egész, egyetlen egység szintjén.
A varázslat nem egyetlen egységben van, hanem abból fakad, hogy nagyon sokat kötünk össze belőlük. Egyetlen neuron csak egy nagyon egyszerű döntést tud meghozni. De ha ezret vagy milliót kapcsolunk egymáshoz, akkor a hálózat együtt már bonyolult összefüggéseket is meg tud ragadni. A rész egyszerű, az egész viszont meglepően kifejező.
Rétegek egymás után
Az egységeket rétegekbe rendezzük. Az első réteg fogadja a nyers bemenetet, például egy kép pontjait. Ez a réteg továbbadja az eredményét a következőnek, az annak, és így tovább, amíg a végső réteg megadja a választ. A köztes rétegek dolga, hogy a nyers adatot fokozatosan hasznosabb formába alakítsák. Ez a lépcsőzetes feldolgozás a neurális háló ereje.
Szemléletes példa a képfelismerés. Az első réteg még csak egyszerű dolgokat vesz észre, például éleket és foltokat. A következő réteg ezekből az élekből már formákat áll össze, mondjuk egy görbét vagy egy sarkot. A rá következő réteg a formákból nagyobb részeket ismer fel, egy szemet vagy egy fület. A végén a háló összerakja, hogy mindezek együtt egy arcot alkotnak. Minden réteg az előző eredményére épít, és egyre elvontabb, egyre értelmesebb mintázatot ismer fel. Senki nem mondta meg a hálónak, hogy éleket keressen. Ezt magától találta ki a tanulás során, mert ez bizonyult hasznosnak.
Hogyan tanul a háló
A tanulás a súlyok beállítása. Kezdetben a súlyok szinte véletlen értékek, ezért a háló válaszai rosszak. A tanuló példákon a rendszer megnézi, mekkorát tévedett, tehát mennyire tért el a válasza a helyes eredménytől. Ebből a hibából visszafelé haladva kiszámolja, melyik súlyt melyik irányba kell egy kicsit igazítani, hogy a következő tipp jobb legyen. Ezt az igazítást sok millió példán, számtalanszor megismétli.
Minden egyes lépés picike. Egyetlen igazítás önmagában alig változtat valamin. De a sok apró lépés összeadódik, és a háló válaszai fokozatosan egyre pontosabbak lesznek. Ez a türelmes, ismételt finomhangolás a lényeg. A háló nem egy nagy felismerésben tanul, hanem sok millió picike igazításban. A végén a súlyok együttese hordozza mindazt a tudást, amit a példákból magába gyűjtött.
Mitől mély a mélytanulás
A mélytanulás egyszerűen azt jelenti, hogy sok réteget építünk egymásra. A mély itt a rétegek nagy számára utal. Minél több réteg épül egymásra, annál összetettebb mintázatokat képes a háló megragadni, mert minden réteg az előző eredményét emeli egy elvontabb szintre. Ez tette lehetővé, hogy a rendszerek olyan feladatokban is jók legyenek, amelyeket korábban reménytelennek tartottak, mint a kép- és beszédfelismerés vagy a folyékony nyelvi feldolgozás.
Ennek ára is van. A mély hálók tanulásához rengeteg adat és jelentős számítási teljesítmény kell. Emellett a háló belső működése nehezen átlátható, mert a tudás sok millió súly finom együttesében rejlik, nem egy szabályban, amit el tudnánk olvasni. Ezért mondjuk gyakran, hogy a mély hálók fekete dobozként viselkednek. Kiválóan működnek, de nem mindig tudjuk pontosan megindokolni, miért adtak egy adott választ. A következő leckében ezt az alapot visszük tovább a nyelv világába, és megnézzük, hogyan lesz a hálóból nyelvi modell.
Miért éppen most jött el az ideje
A neurális hálók ötlete nem új, évtizedekkel ezelőtt is ismert volt. Sokáig mégsem váltották be a hozzájuk fűzött reményeket, és a terület időnként háttérbe szorult. A közelmúlt áttörése nem egyetlen zseniális ötletnek köszönhető, hanem annak, hogy három feltétel egyszerre teljesült. Először is óriási mennyiségű adat vált elérhetővé, elsősorban az internet révén, és láttuk, hogy a hálók éppen adatból tanulnak. Másodszor a számítási teljesítmény sokszorosára nőtt, különösen az eredetileg látványos grafikára tervezett, sok párhuzamos műveletre képes hardver révén, amely szinte véletlenül épp a hálók tanításához illik.
A harmadik feltétel maga a felhalmozott tudás volt, sok apró módszertani javítás, amely stabillá és taníthatóvá tette a mély hálókat. Ez a három tényező együtt hozta el azt, amit ma mélytanulási forradalomként emlegetünk. A tanulság nem csak történeti. Jól mutatja, hogy egy technológia sikere nem csupán az ötleten múlik, hanem azon is, hogy megérnek-e körülötte a feltételek. Amikor tehát egy új AI képességről hallunk, érdemes megnézni, milyen adat, milyen infrastruktúra és milyen felhalmozott tapasztalat áll mögötte, mert ezek nélkül a legjobb ötlet is várat magára.
Három fogalom vezet át a hálón. A súly azt fejezi ki, mennyire fontos egy bemenet. A réteg a feldolgozás egy lépcsője, amely elvontabbá teszi az adatot. A mélytanulás pedig sok réteg egymásra építése, amely egyre összetettebb mintázatot tanul meg.
Workshop
AI Transformation Day
Egésznapos, vezetőknek szóló program. Feltérképezzük, hol tart a szervezet, mi az első reális lépés, és milyen belső feltételek szükségesek a sikerhez. A nap végén konkrét, prioritizált cselekvési lista.
Érdekel a program →