GRAIL: NVIDIA addestra un umanoide con dati generati, partendo da scene 3D di cui conosce ogni misura
Invece di ricostruire i movimenti da video trovati in rete, dove camera, scala e forma degli oggetti vanno indovinate, NVIDIA…

Invece di ricostruire i movimenti da video trovati in rete, dove camera, scala e forma degli oggetti vanno indovinate, NVIDIA…

Un gruppo della Huazhong University of Science and Technology propone di togliere il grande modello linguistico dal percorso che porta…

Un gruppo di NVIDIA, con lo stesso primo autore di OpenRLHF, propone un'infrastruttura per addestrare agenti con il reinforcement learning…

Microsoft Research porta in diretta il suo trascrittore che distingue le voci: un solo modello linguistico ascolta l'audio a pezzi…

Un gruppo di 44 ricercatori, coordinato da MMLab dell'Università di Hong Kong e dall'Università di Pechino, propone un banco di…

Un gruppo dell'Accademia cinese delle scienze mette dieci agenti di frontiera davanti a un dizionario di 131.072 feature di Gemma…

I generatori di mondi 3D consegnano scene bellissime ma fuse in un blocco solo, dove una sedia non si può…

I generatori 3D di oggi trasformano una foto in una mesh fedele ma saldata in un blocco unico, mentre chi…

I generatori video che producono un pezzo di video dopo l'altro, abbastanza in fretta da andare in diretta, nascono distillando…

Un gruppo guidato dalla University of North Carolina presenta una pipeline open source che porta un'idea di machine learning fino…