LLM & Agenti
Paper Summary
DeepSeek-R1, o come insegnare a un modello a ragionare senza insegnargli niente
Il paper che ha aperto il 2025 mostra che la capacità di ragionare può emergere dal solo reinforcement learning, senza…