Lezione (2025-10-03)
Modelli lineari
Section titled “Modelli lineari”I modelli lineari servono a generalizzare problemi in cui la relazione tra il cambiamento di valore dell’input e l’output può essere trovata attraverso la soluzione di un sistema lineare.
Ciò li rende molto semplici sia da allenare che da capire, basta analizzare i parametri per capire quali sono quelli che maggiormente influenzano il risultato.
Esempio: si può generalizzare la relazione tra la potenza e il costo di automobile:

Regressione lineare
Section titled “Regressione lineare”In un modello lineare, ogni componente di è moltiplicata da un parametro . Possiamo generalizzare e scrivere che il risultato è dato dal prodotto scalare tra la matrice trasposta dei parametri e il vettore input.
Tecniche di approssimazione non lineare
Section titled “Tecniche di approssimazione non lineare”La prima restrizione che incontriamo usando la definita sopra è che si assume che .
Per risolvere il problema basta aggiungere una dimensione fittizia ad e poi fissare la nuova componente del vettore input a 1.
Questi modelli vengono detti affini.
In questo caso sarà la funzione lineare e la funzione affine:
Questo è un caso particolare di modellazione di dipendenze non lineari pur continuando ad usare l’approssimazione della retta che minimizza la somma degli errori quadratico.
Per usare l’algebra lineare per ottimizzare è necessario che i pesi siano lineari, non i dati in input. Infatti durante l’ottimizzazione la variabile da trovare è , mentre rimane costante.
Generalizzazione
Section titled “Generalizzazione”In pratica i dati di input possono essere processati a piacimento per estrarre più features.
Possiamo definire una funzione che applica trasformazioni arbitrarie al vettore di input (anche non lineari). Poi daremo quel risultato in pasto al nostro modello lineare:
Classificazione lineare
Section titled “Classificazione lineare”Nel caso della classificazione possiamo usare il risultato della regressione lineare come discriminante.
Il prodotto scalare tra 2 vettori e permette di delimitare 2 iperpiani, uno dove il risultato è positivo, l’altro dove è negativo. La frontiera tra 2 i iperpiani è data dai vettori perpendicolari a .
Ottimizzazione attraverso la pseudo-inversa
Section titled “Ottimizzazione attraverso la pseudo-inversa”Come visto in precedenza, dobbiamo trovare il valore dei pesi in modo da minimizzare gli errori del modello:
Nel caso ideale, senza errori di misurazione sul dataset degli esempi, si potrebbero trovare i pesi attraverso un sistema di equazioni lineari, che si risolve invertendo la matrice dei coefficienti:
Nella realtà, purtroppo, ci sono sempre errori di misurazione. Quindi si ottiene un sistema non lineare dove alcune equazioni danno risultati contraddittori. Occorre quindi approssimare la soluzione che permetta di minimizzare anche se difficilmente si arriverà allo .
Per fare ciò possiamo usare la matrice , detta pseudoinversa di e definita:
Noi dobbiamo risolvere il sistema di equazioni usando tutti gli esempi, quindi otteniamo la seguente formula: