Программа обучения: от нуля до Research Scientist / MTS
24 недели. Построена на открытых первоисточниках: Stanford CS336, оригинальных статьях и технических отчётах моделей. Список тем и приоритеты сверялись с публичными конспектами и разбором 57 интервью исследователя из OpenAI (см. «Ресурсы»), плюс навыки, которых там нет, но которые спрашивают на интервью и нужны в работе.
Нагрузка: вся программа занимает 20–25 часов в неделю, около 520 часов за 24 недели. Ядро каждой недели занимает 10–14 часов: если есть только 10–15 часов в неделю, проходи ядро, а глубину отложи на второй проход (маршрут в «Карте программы»). Порядок недель не меняй.
До и после ядра. Перед неделей 1 идёт входная диагностика и Модуль 0 (2–6 недель, только если диагностика показала пробелы). После недели 22 идёт опциональный исследовательский Capstone на 4–6 недель.
У каждой недели в конце два блока. «Результаты недели»: что ты должен уметь сделать. «Самопроверка»: от 3 до 11 вопросов (по числу тем недели), на которые надо ответить вслух без подглядывания, примерно по минуте на вопрос. Если не ответил, неделя не закрыта.
Как устроена неделя
Каждая неделя = 1 тема + 5 параллельных треков, которые идут всю программу насквозь.
| Трек | Что | Сколько в неделю |
|---|---|---|
| A. Теория | Тема недели: конспект своими словами + вывод формул на бумаге | 6–8 ч |
| B. ML-код с нуля | 1 имплементация недели, без AI-ассистента | 4–6 ч |
| C. LeetCode | 3 задачи в неделю по списку трека C | 3 ч |
| D. Математика | 2 задачи в неделю по треку D | 2 ч |
| E. Повторение | Anki + «трансформер по памяти за 25 минут» | 3 ч |
Железное правило: треки B и E пишутся при полностью выключенном AI. Иначе ты переоценишь себя ровно на столько, на сколько опираешься на автодополнение.
Ядро и глубина. Под заголовком каждой недели стоит строка «Ядро: … · Глубина: …» с оценкой времени. Ядро это темы ★-навыков из карты навыков, главный код недели и трек E: без них интервью на RS/MTS не пройти. Глубину можно отложить: блоки «по желанию», разделы 05-ГЛУБИНА, трек D и вторую половину задач трека C. Запись «≈ 11 ч ядро / 21 ч всё» значит: ядро вместе с треком E и одной-двумя задачами трека C займёт около 11 часов, вся неделя со всеми пятью треками около 21.
Ритуал недели:
- Пн–Чт: теория + код
- Пт: трек E, с пустого файла написать трансформер на время. Записать время.
- Сб: LeetCode + математика
- Вс: ретроспектива. Что не понял → в список дыр. 1 час на закрытие одной дыры.
Модуль 0
- Модуль 0. Фундамент до стартаДля тех, кому нужен фундамент перед неделей 1: входная диагностика и шесть недель F1–F6.
24 недели ядра
Фаза 1. Фундамент
- Неделя 1. Нейросети и градиенты
- Неделя 2. Backpropagation
- Неделя 3. Оптимизаторы и режим обучения
- Неделя 4. Теория информации и численная стабильность
Фаза 2. Современный трансформер
- Неделя 5. Токенизация
- Неделя 6. Архитектура, часть I
- Неделя 7. Внимание
- Неделя 8. Собрать трансформер целиком
- Неделя 9. Бухгалтерия: параметры, FLOPs, память
- Неделя 10. Обучение
Фаза 3. Инференс, GPU, масштабирование
- Неделя 11. Инференс
- Неделя 12. Стратегии сэмплирования
- Неделя 13. GPU и FlashAttention
- Неделя 14. Scaling laws, точность, параллелизм
Фаза 4. Post-training
- Неделя 15. SFT и данные
- Неделя 16. RL: от REINFORCE до PPO
- Неделя 17. RLHF, GRPO, DPO
- Неделя 18. Оценка
Фаза 5. Расширение
- Неделя 19. Другие архитектуры: RNN, SSM, MoE
- Неделя 20. Мультимодальность и длинный контекст
- Неделя 21. Продакшн-LLM: RAG, агенты, оценка
- Неделя 22. Инфраструктура и research craft
Фаза 6. Режим интервью
Сквозные метрики прогресса
Отмечай каждую неделю:
- [ ] Время написания трансформера с нуля (цель: ≤25 мин)
- [ ] Решено задач LeetCode (цель: 72, то есть весь трек C)
- [ ] Реализаций с нуля (цель: 24)
- [ ] Прочитано статей (цель: 100+)
- [ ] Карточек Anki в активном повторении
- [ ] Mock-интервью проведено
Чего в этой программе нет намеренно
- Классического ML (деревья, SVM) сверх минимума: на интервью на LLM-роли это редкость. Минимум (логистическая регрессия, k-means, PCA, дерево, метрики) есть в Модуле 0, неделя F6
- Глубокой теории оптимизации: уровень «понимаю, что происходит» достаточен
- Computer vision за пределами того, что нужно для мультимодальности
Зачем это всё, кроме оффера
Главный аргумент за такую подготовку не в том, что она помогает пройти интервью. Систематическое закрытие пробелов в фундаменте даёт эффект, который ценнее самого оффера: растёт продуктивность в текущей работе. Появляются технические идеи, до которых раньше было просто не дотянуться, и расширяется круг задач, о которых вообще получается думать. Откуда этот вывод, рассказано в «Карте программы».
Двадцать четыре недели кажутся слишком большим сроком, чтобы терпеть их ради одного собеседования. Но если считать, что на выходе меняется уровень, на котором ты способен работать, срок выглядит иначе.