Этап 3 — NLP / LLM

Цель: трансформеры, fine-tune и RAG на практике. Срок: 3–4 недели.

Программа

Квиз (проверь себя)

  1. Почему attention is all you need: что заменила self-attention по сравнению с RNN?
  2. Что делает [CLS]-токен в BERT-классификации?
  3. LoRA: что обучаем и почему это дёшево?
  4. RAG: почему «наивный» чанкинг по 512 токенов часто плохо работает и как чинить?

Мини-проект

Sentiment-классификатор отзывов (данные возвратов/отзывов RuOpt) + RAG-поиск по нашей внутренней документации. Это уже близко к прод-задачам.

Дальше — Этап 4 · Специализация.