NVFP4: recuperare l’accuratezza dei modelli a 4 bit con la distillazione
Comprimere un modello a quattro bit fa risparmiare memoria e calcolo, ma spesso ne intacca l'accuratezza. Un report tecnico di…
Comprimere un modello a quattro bit fa risparmiare memoria e calcolo, ma spesso ne intacca l'accuratezza. Un report tecnico di…
Prior Labs pubblica la nuova generazione del suo modello per dati tabellari: una rete che predice da una tabella senza…
Un paper di OpenAI del 2025 sostiene che le allucinazioni non sono un mistero: nascono come normali errori statistici durante…
Hai addestrato un modello che funziona, poi hai chiuso il notebook e l'hai perso per sempre? In questo tutorial impari…
Un progetto completo di machine learning sull'audio: sintetizziamo tre strumenti con NumPy, estraiamo le feature MFCC con librosa e addestriamo…
Come fa un programma a capire se una recensione è entusiasta o furiosa? In questo tutorial costruiamo un classificatore di…
Nell'ottobre 2024 Anthropic ha dato a Claude un mouse e una tastiera: guarda lo schermo con uno screenshot, decide dove…
Un modello linguistico non vede nulla: legge numeri. LLaVA mostra che per dargli la vista basta un pezzo sorprendentemente semplice…
Nel 2023 un gruppo di ricercatori della Fudan University prova a mettere ordine nella parola più abusata dell'anno: "agente". Rileggiamo…
Un transformer dimentica tutto ciò che esce dalla sua finestra di attenzione; una rete ricorrente comprime il passato in uno…