reinforcement-learning
13 talks
Coding Agents Are Secretly General Agents
Inside OpenAI's AI Agent Collaboration System
How Reinforcement Learning Can Improve Your Agent
PodcastTricks to Fine Tuning
PodcastFrom Shiny to Strategic: The Maturation of AI Across Industries
PodcastBeyond the Matrix: AI and the Future of Human Creativity
Reading groupDeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning
Why Agents Are Stupid & What We Can Do About It
Goal Oriented Retrieval Agents
PodcastPyTorch for Control Systems and Decision Making
Explaining ChatGPT to Anyone in 10 Minutes
RLHF Data Collection in Practice
Building and Curating Datasets for RLHF and LLM Fine-tuning