Të dhëna & IA

Reinforcement learning

Në shqip: Mësim përmes shpërblimit

ShpjegimiSQ

Në mësimin përmes shpërblimit, programi mëson duke provuar: merr „shpërblim“ kur bën diçka mirë dhe „ndëshkim“ kur gabon, derisa e gjen strategjinë më të mirë. Kështu mësuan kompjuterët të fitojnë në shah dhe në Go.

EnglishEN

In reinforcement learning, the program learns by trying: it gets a “reward” when it does well and a “penalty” when it gets it wrong, until it finds the best strategy. That's how computers learned to win at chess and Go.

Si ta mendosh

Si stërvitja e një qeni: kur ulet me komandë merr një biskotë, dhe me kohë e mëson pa e menduar.

Lexoje në anglisht

Like training a dog: when it sits on command it gets a treat, and over time it learns without thinking.

Terma të lidhur