Sumários
Alignment and Reasoning
20 Maio 2026, 18:00 • Ana Catarina dos Santos Martins
1. Reasoning Models
AlignmentPreference tuning, Data collection, Reinforcement Learning from Human Feedback
15 Maio 2026, 18:00 • Ana Catarina dos Santos Martins
1. Preference tuning
Implementation and introduction to training
14 Maio 2026, 18:00 • Ana Catarina dos Santos Martins
1. Implementation of the models presented in asynchronous lectures
Multimodality
8 Maio 2026, 18:00 • Ana Catarina dos Santos Martins
1. Embeddings and Representation Learning
From Large Language Models to Mixture of Experts
6 Maio 2026, 18:00 • Ana Catarina dos Santos Martins
1. Mixture of Experts