Prime Agent: l’harness aperto che dà al modello un REPL, dei subagenti e una memoria, e su ARC-AGI-3 passa da 30 a 95,5%
Prime Intellect pubblica il proprio harness per agenti: un interprete Python che resta acceso fra un turno e l'altro, subagenti…

Prime Intellect pubblica il proprio harness per agenti: un interprete Python che resta acceso fra un turno e l'altro, subagenti…

Un gruppo di NTU e NUS propone una memoria pensata per i modelli che parlano: un emisfero per i fatti,…

Lo Shanghai AI Laboratory non tocca una riga dell'architettura di MinerU2.5 e rifà tutto il resto: da meno di 10…

Tre ricercatori della Jiao Tong di Shanghai descrivono ARIS, un'impalcatura open source che porta un agente dall'idea al PDF di…

Le dimostrazioni scritte in Lean si possono controllare a macchina, ma rischiano di smettere di compilare a ogni aggiornamento della…

Il gruppo PaddleOCR di Baidu smette di far trascrivere la pagina a un modello in un'unica fila di token: un…

Un gruppo con Ion Stoica e Matei Zaharia fra i firmatari presenta FreeToken, un motore che serve modelli mixture-of-experts da…

Baidu riparte da DeepSeek-OCR e cambia una cosa sola: ogni token che il modello scrive guarda tutta la pagina ma…

Un world model video genera il mondo mentre lo esplori, ma quando giri la testa e torni indietro spesso trova…

I generatori video producono fotogrammi belli che non stanno insieme come scena. Un gruppo di HKUST e Tencent ARC Lab…