Профессор Тан Цзе из Цинхуа: битва за чат-ботов закончена, будущее за ИИ-агентами.
В Университете Цинхуа стартовал новый набор курса Advanced Machine Learning. Его ведёт профессор Тан Цзе, один из авторов большой языковой модели GLM. Курс начался 16 сентября и рассчитан на 16 недель.
На первой лекции Тан Цзе заявил студентам, что «битва за чат уже закончена». Простые чаты с ИИ больше никому не нужны, а цель обучения — создание агентов уровня AGI и ASI. По словам профессора, современный подход к обучению LLM состоит в том, чтобы убрать как можно больше людей из цикла обучения. Всё должны делать агенты, иначе человек становится бутылочным горлом сингулярности самообучения ИИ.
Тан Цзе также отметил, что такое количество студентов не нужно для обучения LLM. Он не ставит цель довести до результата всех: его интересуют только отличники, остальных он отчислит. При этом на видео хорошо виден энтузиазм студентов, которые хотят приобщиться к элите ИИ.
Что входит в курс
За 16 недель студенты должны собрать полный пайплайн LLM: база, Scaling, синтетические данные, preference/RL, агенты, непрерывное обучение, «AI учит AI».
- С нуля написать Tokenizer и Transformer.
- Провести сквозное обучение модели.
- Написать Triton attention kernel и замерить прирост.
- Очистить данные из raw dump, подогнать scaling law и выполнить экстраполяцию.
- Сравнить SFT, DPO и RLVR на одной базе.
- Построить верифицируемую среду и harness, обучить long-horizon агента с self-judge loop.
Работа идёт не индивидуально, а в группах по 2-3 человека. Студентов сразу учат работать когортой, потому что только устаревшие университеты готовят одиночек. На 16-й неделе нужно защитить работающий прототип и подготовить его описание в формате научной публикации NeurIPS.

