Sfoglia per Correlatore TOSCHI, FEDERICO
Mostrati risultati da 1 a 3 di 3
Do we really need GRPO? Rethinking reinforcement learning for reasoning in LLMs
2024/2025 Carrino, Gabriele
Don't overthink it: intermittent self-evaluation in reasoning language models playing textual games
2024/2025 Dimaglie, Gregorio
Verbalized uncertainty calibration of multimodal LLMs in Medical VQA
2025/2026 Senoglu, Eren
| Fulltext | Data | Tipo | Titolo | Autore (i) |
|---|---|---|---|---|
| 2025-10-23 | Tesi di laurea Magistrale | Do we really need GRPO? Rethinking reinforcement learning for reasoning in LLMs | Carrino, Gabriele | |
| 2025-12-10 | Tesi di laurea Magistrale | Don't overthink it: intermittent self-evaluation in reasoning language models playing textual games | Dimaglie, Gregorio | |
| 2026-03-26 | Tesi di laurea Magistrale | Verbalized uncertainty calibration of multimodal LLMs in Medical VQA | Senoglu, Eren |
Mostrati risultati da 1 a 3 di 3
Legenda icone accesso al fulltext
- File accessibili da tutti
- File accessibili dagli utenti autorizzati
- File accessibili da tutti o solo dagli utenti autorizzati, a partire dalla la data indicata nella scheda
- File non accessibili