Каталог курсов
🎨
Машинное обучениеПродвинутыйPRO

Секрет внимания

Байтик попадает в Детективное агентство связей! 12 миссий о трансформерах: self-attention, Query-Key-Value, multi-head attention, позиционное кодирование, энкодеры (BERT), декодеры (GPT) и Vision Transformer.

12 уроков9–14 лет~6 часовИнтерактивные задания
Начать бесплатно

Первые 3 урока этого курса — бесплатно, без карты. Дальше — подписка от 699 ₽ в месяц на все курсы.

Или сначала поиграть — без регистрации

О чём этот курс

Курс раскрывает архитектуру трансформеров — основу ChatGPT, BERT и других современных моделей. Дети узнают о self-attention, Query-Key-Value, multi-head attention, позиционном кодировании, энкодерах (BERT) и декодерах (GPT), Vision Transformer. Каждый концепт объясняется через понятные аналогии.

Чему научитесь

  • Понимание механизма внимания (attention)
  • Знание архитектуры трансформера
  • Query, Key, Value — как ИИ ищет связи
  • Различие энкодеров (BERT) и декодеров (GPT)
  • Представление о Vision Transformer

Для кого

Продвинутый уровень, от 9 лет. Для тех, кто хочет понять, как устроен ChatGPT.

Как проходит обучение

Интерактивные задания

Квизы, головоломки, симуляторы и творческие задачи в каждом уроке

Система XP и наград

За правильные ответы начисляются очки опыта и открываются достижения

12 уроков по ~30 минут

Каждый урок — самостоятельная тема с теорией и практикой

Робот-проводник Байтик

Дружелюбный персонаж объясняет сложные темы простым языком

Программа курса

1

Одна архитектура правит всеми

Бесплатно

Почему рекуррентные сети уступили трансформеру и что изменила статья Attention Is All You Need.

~30 мин

2

Что значит обращать внимание?

Бесплатно

Self-attention: каждое слово опрашивает остальные и решает, на что смотреть.

~30 мин

3

Запрос, ключ, значение

Бесплатно

Запрос, ключ и значение: как скалярное произведение и softmax превращаются в веса внимания.

~30 мин

4

Много голов лучше одной

PRO

Многоголовое внимание: почему одной головы мало и как результаты голов склеиваются.

~30 мин

5

Где моё место?

PRO

Позиционное кодирование: без него трансформер не отличает предложение от мешка слов.

~30 мин

6

Полный слой трансформера

PRO

Полный блок трансформера: внимание, полносвязный слой и две пары Add & Norm.

~30 мин

7

Стопка блоков

PRO

Стопка блоков: нижние слои ловят синтаксис, верхние — смысл, и откуда берутся новые способности.

~30 мин

8

Трансформер читает

PRO

BERT: двунаправленное чтение и обучение методом маскирования слов.

~30 мин

9

Трансформер пишет

PRO

GPT: авторегрессия слово за словом и что делает температура с распределением.

~30 мин

10

Трансформер видит

PRO

Vision Transformer: изображение как последовательность патчей и роль токена [CLS].

~30 мин

11

Проект: Разбираем трансформер

PRO

Проект: разобрать трансформер по шагам — от токенизации до оценок внимания.

~30 мин

12

Выпускной: Мастер внимания

PRO

Итог курса: чем внимание принципиально лучше последовательной обработки.

~30 мин

Похожие курсы

Начать бесплатно

Регистрация бесплатная. Первые 3 урока этого курса — без карты, а курс «Знакомство с ИИ» открыт целиком.