Tokenizzare con la programmazione lineare: oltre gli algoritmi greedy come BPE
Ogni modello linguistico comincia spezzando il testo in token, e da trent'anni lo fa con un algoritmo goloso che decide…
Rilettura accessibile di un paper
Ogni modello linguistico comincia spezzando il testo in token, e da trent'anni lo fa con un algoritmo goloso che decide…
Addestrare un modello a prevedere come cambia il mondo richiede di solito traiettorie in cui ogni azione è annotata a…
Un nuovo benchmark mette venti compiti di programmazione lunghi e realistici davanti agli agenti CLI più avanzati. Nessuno supera il…
Dentro i modelli linguistici alcuni numeri interni esplodono e alcune parole calamitano l'attenzione: due anomalie che compaiono sempre insieme. Un…
I video generati dall'AI sono spesso bellissimi e fisicamente impossibili: oggetti che cadono verso l'alto, velocità che cambiano dal nulla.…
Un modello da 8 miliardi di parametri addestrato non a rispondere, ma a smistare: chiama gli strumenti e i modelli…
Un consorzio di ricercatori mette alla prova dieci modelli di frontiera non su quiz di scienza, ma su scenari di…
Un gruppo di Princeton propone una via di mezzo tra i database rigidi e i mondi interamente generati dall'AI: il…
Un gruppo di ricercatori indiani mette a confronto le reti di Kolmogorov-Arnold e i classici percettroni multistrato su quattro compiti,…
Balestriero e LeCun sostituiscono la pila di accorgimenti che tiene in piedi il self-supervised learning con un solo principio dimostrabile:…