RAG: dare una memoria esterna ai modelli linguistici
I modelli linguistici rispondono a memoria, e la memoria finisce. Il RAG li trasforma in studenti che consultano il libro…
LLM, RAG, Agents, MCP
I modelli linguistici rispondono a memoria, e la memoria finisce. Il RAG li trasforma in studenti che consultano il libro…
La classifica GitHub di questi giorni dice una cosa sola, e la ripete sette volte. Non è più il protocollo…
Un nuovo benchmark mette venti compiti di programmazione lunghi e realistici davanti agli agenti CLI più avanzati. Nessuno supera il…
Un consorzio di ricercatori mette alla prova dieci modelli di frontiera non su quiz di scienza, ma su scenari di…
Gli agenti addestrati con reinforcement learning imparano per tentativi ed errori, senza fermarsi a capire perché hanno sbagliato. Un gruppo…
Nell'RL per gli LLM si campiona un gruppo di risposte a un prompt e le si valuta. TPO separa due…
Ricercatori di Apple mostrano che un modello può migliorare a scrivere codice riaddestrandosi sui propri output grezzi, senza verificatore, insegnante…
Uno studio di PricewaterhouseCoopers mette alla prova un'intuizione scomoda: nella ricerca agentica il vecchio grep batte spesso la ricerca semantica…
Da mesi si distribuiscono "skill" per gli agenti AI, schede di procedure che dovrebbero renderli più bravi. Un benchmark le…
Un gruppo di Tsinghua misura i modelli "ragionanti" con pass@k invece che sulla media. La scoperta scomoda: il reinforcement learning…