Term van de dag
Q-learning
Q-learning is een versterkingsleeralgoritme dat agenten leert optimale acties in verschillende situaties uit te voeren. Het algoritme leert de waarschijnlijkheid of bruikbaarheid van elke mogelijke actie in elke toestand, opgeslagen in een waardentabel of Q-tabel.
Q-learning is model-vrij, wat betekent dat het agenten toestaat te leren zonder volledig begrip van de omgeving. Het algoritme werkt door middel van trial-and-error, waarbij beloning signal aangeeft of acties goed of slecht waren. Dit maakt het zeer nuttig voor robotica en spelspelen.
Voorbeeld: Stel je een robot voor die een maze moet uitvinden. Q-learning stelt de robot in staat om verschillende routes uit te proberen. Voor elke route staat een beloning (positief of negatief) opgeslagen in de Q-tabel. Na veel iteraties leert de robot de snelste weg naar het einde door de waarden met de hoogste beloningen te volgen.
Term van de dag archief
Alle AI-termen op één plek. Blader door het volledige archief, gesorteerd op alfabet.