LeJEPA: il self-supervised learning senza trucchi euristici
Balestriero e LeCun sostituiscono la pila di accorgimenti che tiene in piedi il self-supervised learning con un solo principio dimostrabile:…
Balestriero e LeCun sostituiscono la pila di accorgimenti che tiene in piedi il self-supervised learning con un solo principio dimostrabile:…
I modelli neurali che simulano la fisica schiacciano ogni grandezza su dei punti. Questo paper propone di rimettere ciascuna al…
Un gruppo di Caltech modella l'addestramento come un'equazione differenziale stocastica e mostra che i valori singolari dei pesi si comportano…
Il reinforcement learning premia di solito la risposta finale di un modello. Un gruppo tra Google, UC Davis e Princeton…
Gli agenti addestrati con reinforcement learning imparano per tentativi ed errori, senza fermarsi a capire perché hanno sbagliato. Un gruppo…
Nell'RL per gli LLM si campiona un gruppo di risposte a un prompt e le si valuta. TPO separa due…
Rimuovere un oggetto da un video è la parte facile; togliere anche l'ombra e il riflesso che si lascia dietro…
Quattro ricercatori del MIT sostengono che reti neurali diverse per architettura, obiettivo e persino tipo di dato stiano convergendo verso…
Un team di Google DeepMind sostiene che un modello video generativo come Veo 3 sappia risolvere decine di compiti visivi…
Un modello linguistico non calcola la parola giusta all'ultimo livello. La azzarda subito, scegliendo la più comune, e poi la…