Frontis-MA1: addestrare le quattro mosse dell’ingegnere ML invece dell’agente intero
Frontis.AI e l'Università Tsinghua addestrano un modello aperto da 35 miliardi di parametri non a risolvere compiti di machine learning…

Frontis.AI e l'Università Tsinghua addestrano un modello aperto da 35 miliardi di parametri non a risolvere compiti di machine learning…

I modelli visione-linguaggio-azione guidano i robot senza chiedersi che cosa succederà dopo. Un gruppo di Fudan raccoglie in 69 pagine…

Il laboratorio di visione di AMAP, la divisione mappe di Alibaba, descrive un world model video che risponde alla tastiera,…

Un laboratorio austriaco sostiene che Whisper sappia già trascrivere esitazioni, ripetizioni e parole troncate, e che il problema sia soltanto…

Un gruppo di NVIDIA addestra un solo riconoscitore vocale che trascrive sia a registrazione finita sia in diretta, fino a…

Vast Intelligence Lab e University of Technology Sydney trasformano la generazione di un articolo scientifico, dall'idea al PDF compilato, in…

Da una frase o da una foto, un mondo 3D in cui si può camminare; da un video, la sua…

Un gruppo dell'Università dell'Illinois rilascia un toolkit open source che tratta il debug degli agenti come un ciclo chiuso: rilevare…

I modelli che ricostruiscono una scena 3D da una sola foto sbagliano proprio dove la scena è più fine: ringhiere,…

Oxford e Meta riprendono VGGT, il modello che da una manciata di foto ricava in un colpo solo camere e…