Tema

I concettimachine-learningNel grafo

Apprendimento per rinforzo

Imparare da azioni e ricompense invece che da esempi: la macchina-bambina istruita per punizioni e premi (Turing 1950), la routine di Samuel (1959), e il metodo dietro i modelli di ragionamento di oggi

Si lega a

è un modo dell'apprendimento automatico; la serie lo riprenderà per i modelli di ragionamento

Da qui ci si arriva

  1. Rinforzo da preferenze umane

    Il rinforzo la cui ricompensa è un gusto: classifiche umane, un modello di ricompensa, e l'addestramento a produrre risposte preferite

  2. Rinforzo con ricompense verificabili

    Il rinforzo la cui ricompensa è un fatto: la risposta giusta, il test che passa; da qui emergono i modelli di ragionamento

  3. Apprendimento automatico

    Far ricavare le regole alla macchina dagli esempi, invece di scrivergliele: nelle parole di Samuel (1959), programmare un calcolatore perché si comporti in un modo che chiameremmo apprendimento, eliminando gran parte della programmazione minuziosa

Dove se ne parla

  1. Le origini del machine learning: programmare una macchina, o farla apprendere