Guess-then-Refine: come gli LLM usano davvero la propria profondità
Un modello linguistico non calcola la parola giusta all'ultimo livello. La azzarda subito, scegliendo la più comune, e poi la…
Un modello linguistico non calcola la parola giusta all'ultimo livello. La azzarda subito, scegliendo la più comune, e poi la…
Un team di Google DeepMind sostiene che un modello video generativo come Veo 3 sappia risolvere decine di compiti visivi…
Un gruppo del MIT propone SEAL: davanti a un testo nuovo, il modello si scrive da solo i dati su…
Quattro ricercatori del MIT sostengono che reti neurali diverse per architettura, obiettivo e persino tipo di dato stiano convergendo verso…
Meta addestra un modello di visione da 7 miliardi di parametri senza una sola etichetta umana, e per la prima…
Quando il testo di qualità finisce ma il calcolo abbonda, ripassare gli stessi dati smette presto di aiutare un modello.…
Uno studio di PricewaterhouseCoopers mette alla prova un'intuizione scomoda: nella ricerca agentica il vecchio grep batte spesso la ricerca semantica…
Ricercatori di Apple mostrano che un modello può migliorare a scrivere codice riaddestrandosi sui propri output grezzi, senza verificatore, insegnante…
Le reti ricorrenti sono efficienti ma dimenticano; i transformer ricordano tutto ma costano il quadrato. Un gruppo di Google propone…
Da mesi si distribuiscono "skill" per gli agenti AI, schede di procedure che dovrebbero renderli più bravi. Un benchmark le…