Percorso di lettura
86 articoli in ordine di lettura: dalle fondamenta matematiche fino a LLM, agenti e produzione. Ogni numero è un piano dell'edificio.
LLM & Agenti
- Function calling: quando l’LLM usa gli strumenti tutorial
- Modelli locali con Ollama: cosa ci fai davvero tutorial
- DeepSeek-R1, o come insegnare a un modello a ragionare senza insegnargli niente paper-summary
- DeepSeek-V3: seicento miliardi di parametri, ma solo trentasette accesi alla volta paper-summary
- Llama 3, la ricetta scritta per intero paper-summary
- Qwen2.5, la famiglia che copre ogni taglia paper-summary
- OpenAI o1 (2024): pensare più a lungo per rispondere meglio paper-summary
- Gemini 1.5 (2024): milioni di token di contesto paper-summary
- Mixtral of Experts (2024): il mixture-of-experts open paper-summary
- Phi-3 (2024): quando la qualità dei dati batte la dimensione paper-summary
- Oltre DPO: SimPO e KTO, allineare preferenze con meno ingredienti paper-summary
- AlphaGeometry: la macchina che sa dove tracciare la linea giusta paper-summary
- Scaling test-time compute (2024): più inferenza, meno addestramento paper-summary
- Many-shot in-context learning (2024): centinaia di esempi nel prompt paper-summary
- Agenti LLM: la mappa del 2025 paper-summary
- LLaVA (2024): dare gli occhi a un modello linguistico paper-summary
- Computer use (2024-25): agenti che usano il computer come noi paper-summary
- L’RL insegna davvero a ragionare? Il paper che mette alla prova RLVR paper-summary
- L’illusione dell’illusione del pensiero: perché i modelli di ragionamento non collassano davvero paper-summary
- SkillsBench: le ‘skill’ per agenti funzionano davvero? Un benchmark lo misura paper-summary
- Self-distillation semplice: un LLM che migliora nel codice imparando dai propri output paper-summary
- Is Grep All You Need? Come l’harness dell’agente cambia la ricerca agentica paper-summary
- SEAL: i modelli linguistici che si riscrivono i propri dati di addestramento paper-summary
- AlphaResearch: un agente LLM che prova a scoprire algoritmi nuovi paper-summary
- Matrix: generare dati sintetici con sciami di agenti senza un direttore d’orchestra paper-summary
- Experiential Reinforcement Learning: far riflettere il modello sui propri errori prima di premiarlo paper-summary
- Target Policy Optimization: separare ‘cosa premiare’ da ‘come aggiornare i pesi’ nell’RL per LLM paper-summary
- ARE e Gaia2: come Meta misura (e mette in crisi) gli agenti AI generalisti paper-summary
- DS-STAR: l’agente che pianifica ed esplora i tuoi dati passo dopo passo paper-summary
- Memory as Action: quando l’agente impara a gestire la propria memoria paper-summary
- ToolOrchestra: un piccolo modello che dirige un’orchestra di strumenti paper-summary
- Quanto sanno fare scienza gli LLM? Un’analisi sistematica paper-summary
- Web World Models: mondi persistenti per agenti costruiti col codice, non generati paper-summary
- LongCLI-Bench: mettere alla prova gli agenti di programmazione su compiti lunghi da terminale paper-summary
- RAG: dare una memoria esterna ai modelli linguistici deep-dive
- Sette repo su dieci: la «skill» è diventata il pacchetto degli agenti
- Due terzi degli zeri di Riemann: venticinque punti in una volta, e la firma è di un modello deep-dive
MLOps & Infra
Safety & Allineamento
- Il microscopio per leggere dentro un modello linguistico paper-summary
- Alignment Faking (2024): quando il modello finge di essere allineato paper-summary
- Sleeper Agents: la backdoor che sopravvive all’addestramento di sicurezza paper-summary
- RLAIF (2024): feedback dall’AI invece che dall’uomo paper-summary
- Perché i modelli linguistici allucinano: il paper di OpenAI (2025) paper-summary
- La geometria bayesiana dell’attention: cosa fanno davvero i transformer quando ‘inferiscono paper-summary
- Decomposizione bi-ortogonale: separare contenuto e posizione dentro un Vision Transformer paper-summary
- Guess-then-Refine: come gli LLM usano davvero la propria profondità paper-summary
- Cosa pensano davvero i ricercatori AI dell’automazione della ricerca (e dell’esplosione di intelligenza) paper-summary
- Attivazioni massive e attention sink: due fenomeni distinti, non uno solo paper-summary
Deep Learning
- KAN (2024): funzioni sugli archi, non sui nodi paper-summary
- Mamba-2 (2024): SSM e attention sono la stessa cosa paper-summary
- Byte Latent Transformer (2024): addio al tokenizer paper-summary
- Titans (2025): una memoria che impara al momento del test paper-summary
- CompactifAI: comprimere gli LLM con reti tensoriali quantum-inspired paper-summary
- LLM-JEPA: quando gli LLM imparano ad allenarsi come i modelli visivi paper-summary
- Free Transformer: dare al Transformer una variabile latente per pensare prima di scrivere paper-summary
- CAT: comprimere e attendere per un’attention efficiente a piacere paper-summary
- Generative Modeling via Drifting: la generazione in un solo passo che evolve durante il training paper-summary
- Memory Caching: dare alle RNN una memoria che cresce come quella dei transformer paper-summary
- q0: pretraining a iper-epoca, o come sfruttare il budget di calcolo oltre la saturazione paper-summary
- L’ipotesi della rappresentazione platonica: i modelli stanno convergendo verso una sola visione del mondo? paper-summary
- RePo: quando un LLM decide da sé come riposizionare il contesto paper-summary
- Test-time training end-to-end: comprimere il contesto lungo nei pesi del modello paper-summary
- Reinforced Attention Learning: ottimizzare dove un modello guarda, non solo cosa dice paper-summary
- Dallo SGD agli spettri: la teoria dietro l’evoluzione dei pesi paper-summary
- LeJEPA: il self-supervised learning senza trucchi euristici paper-summary
- KAN contro MLP: un confronto pratico su accuratezza e costo computazionale paper-summary
- SWIRL: imparare a modellare il mondo senza etichette d’azione paper-summary
- Backpropagation: come una rete neurale impara dai propri errori deep-dive
NLP, Vision & Multimodale
- SAM 2 (2024): segmentare qualsiasi cosa, anche nei video paper-summary
- AlphaFold 3: prevedere non una molecola, ma un incontro paper-summary
- Movie Gen, o come si insegna a un modello a immaginare i fotogrammi successivi paper-summary
- DexWM: insegnare la manipolazione robotica guardando video umani paper-summary
- DINOv3: la visione self-supervised che non ha più bisogno di etichette paper-summary
- Veo 3 e l’apprendimento zero-shot: i modelli video stanno diventando i nuovi foundation model della vision? paper-summary
- Object-WIPER: cancellare oggetti (e le loro ombre) dai video senza addestramento paper-summary
- PhysInOne: due milioni di video per insegnare la fisica ai modelli generativi paper-summary
- Tokenizzare con la programmazione lineare: oltre gli algoritmi greedy come BPE paper-summary