RePo: quando un LLM decide da sé come riposizionare il contesto
Da nove anni le parole di un prompt ricevono un numero di posizione fisso, 0, 1, 2, fino alla fine.…
Rilettura accessibile di un paper
Da nove anni le parole di un prompt ricevono un numero di posizione fisso, 0, 1, 2, fino alla fine.…
Un gruppo di Stanford, NVIDIA e Berkeley riformula il contesto lungo come apprendimento continuo: invece di ricordare ogni token, il…
Rimuovere un oggetto da un video è la parte facile; togliere anche l'ombra e il riflesso che si lascia dietro…
Quattro ricercatori del MIT sostengono che reti neurali diverse per architettura, obiettivo e persino tipo di dato stiano convergendo verso…
Un gruppo del MIT propone SEAL: davanti a un testo nuovo, il modello si scrive da solo i dati su…
Un team di Google DeepMind sostiene che un modello video generativo come Veo 3 sappia risolvere decine di compiti visivi…
Un modello linguistico non calcola la parola giusta all'ultimo livello. La azzarda subito, scegliendo la più comune, e poi la…
Un agente autonomo affianca due giudici — un revisore addestrato sui referaggi di ICLR e l'esecuzione del codice — per…
Meta addestra un modello di visione da 7 miliardi di parametri senza una sola etichetta umana, e per la prima…
Ricercatori di Apple mostrano che un modello può migliorare a scrivere codice riaddestrandosi sui propri output grezzi, senza verificatore, insegnante…