Due terzi degli zeri di Riemann: venticinque punti in una volta, e la firma è di un modello
Il 10 agosto è uscito un paper che sposta il limite inferiore di zeri della zeta sulla linea critica dal…
LLM, RAG, Agents, MCP
Il 10 agosto è uscito un paper che sposta il limite inferiore di zeri della zeta sulla linea critica dal…
I modelli linguistici rispondono a memoria, e la memoria finisce. Il RAG li trasforma in studenti che consultano il libro…
La classifica GitHub di questi giorni dice una cosa sola, e la ripete sette volte. Non è più il protocollo…
Un nuovo benchmark mette venti compiti di programmazione lunghi e realistici davanti agli agenti CLI più avanzati. Nessuno supera il…
Un modello da 8 miliardi di parametri addestrato non a rispondere, ma a smistare: chiama gli strumenti e i modelli…
Un consorzio di ricercatori mette alla prova dieci modelli di frontiera non su quiz di scienza, ma su scenari di…
Un gruppo di Princeton propone una via di mezzo tra i database rigidi e i mondi interamente generati dall'AI: il…
Meta pubblica ARE, una piattaforma per costruire ambienti simulati in cui il tempo scorre da solo, e Gaia2, un benchmark…
Un agente di Google per la data science che non si ferma quando il codice gira, ma quando un giudice…
Un agente che affronta compiti lunghi affoga nel proprio contesto. Un paper di ottobre 2025 propone di rendere la potatura…