DeepSeek-R1, o come insegnare a un modello a ragionare senza insegnargli niente
Il paper che ha aperto il 2025 mostra che la capacità di ragionare può emergere dal solo reinforcement learning, senza…
Rilettura accessibile di un paper
Il paper che ha aperto il 2025 mostra che la capacità di ragionare può emergere dal solo reinforcement learning, senza…
Il modello aperto che a fine 2024 ha rivaleggiato con i migliori sistemi chiusi lo ha fatto con un conto…
Nell'estate 2024 Meta rilascia un modello da 405 miliardi di parametri con i pesi aperti e, cosa più rara, un…
Mentre l'attenzione era sui modelli che ragionano, alla fine del 2024 Alibaba pubblica sette modelli aperti di ogni dimensione, dal…
Con "Scaling Monosemanticity" Anthropic ha estratto milioni di concetti interpretabili dagli strati interni di Claude. Il caso del Golden Gate…
Le reti neurali imparano regolando i pesi sui collegamenti e lasciando fisse le funzioni di attivazione nei neuroni. Le Kolmogorov-Arnold…
I modelli a spazio degli stati e l'attenzione sembrano due mondi lontani: una ricorrenza che scorre in linea, una matrice…
Per un decennio abbiamo migliorato i modelli linguistici rendendoli più grandi e addestrandoli su più dati. Con o1 OpenAI aggiunge…
Fino al 2024 la finestra di contesto di un modello linguistico si misurava in centinaia di migliaia di token. Gemini…
A gennaio 2024 Mistral pubblica un modello da 47 miliardi di parametri che al momento di rispondere ne accende solo…