CompactifAI: comprimere gli LLM con reti tensoriali quantum-inspired
Un gruppo di fisici propone di rimpicciolire i modelli linguistici non tagliando neuroni, ma le correlazioni tra i loro pesi,…
Un gruppo di fisici propone di rimpicciolire i modelli linguistici non tagliando neuroni, ma le correlazioni tra i loro pesi,…
Comprimere un modello a quattro bit fa risparmiare memoria e calcolo, ma spesso ne intacca l'accuratezza. Un report tecnico di…
Hai addestrato un modello che funziona, poi hai chiuso il notebook e l'hai perso per sempre? In questo tutorial impari…
Come fa un programma a capire se una recensione è entusiasta o furiosa? In questo tutorial costruiamo un classificatore di…
Un progetto completo di machine learning sull'audio: sintetizziamo tre strumenti con NumPy, estraiamo le feature MFCC con librosa e addestriamo…
Nel software normale la pipeline chiede "il codice compila e i test passano?". Con un modello la domanda cambia: "questa…
«Sul mio computer funziona» non è una battuta, è un problema reale che costa ore. In questo tutorial impari i…
Far girare un LLM sul proprio computer è diventato un comando da terminale. Ma cosa ci si può fare realisticamente,…
Un modello linguistico non sa che ore sono e non può leggere un database. Con il function calling gli diamo…
Un modello da 8 miliardi di parametri addestrato non a rispondere, ma a smistare: chiama gli strumenti e i modelli…