
Полный путь: классика NLP, трансформеры, смесь экспертов (MoE), дообучение, речь (распознавание и синтез), ответы с опорой на документы и практика для банка и других отраслей.
История NLP/LLM, термины, карта задач, пайплайн, риски — теория + ≥10 тестов + практика
Нормализация, токенизация, BPE, русский язык, токены и стоимость — теория + ≥10 тестов + практика
Частоты, BoW, TF-IDF и границы классических признаков.
Эмбеддинги, соседи, skip-gram/CBOW и практические ограничения.
Два пути к векторным представлениям и русский морфологический выигрыш.
Интенты, сущности, разметка, правила и безопасный банковский пайплайн.
Последовательности, затухающие градиенты и ворота памяти.
Bahdanau, Luong, self-attention и мост к Transformer.
Encoder/decoder, multi-head attention, position и transfer learning.
Почему большие модели работают, чем base отличается от instruct и как запускать безопасно.
Не один врач, а вызов узкого специалиста.
Как ускоряют генерацию ответа.
Где модель «теряет» начало длинного документа.
Квантование, дистилляция — обзор для продакшена.
Вызов поиска и API вместо «всё из головы».
Близость текстов и гибрид с ключевыми словами.
Найти → прочитать → ответить. Цитаты обязательны.
Нарезка, гибрид, переранжирование, переформулировка и др.
Окна, сжатие, self-RAG, граф, cite-or-refuse.
Чеклист качества выдачи перед дообучением.
Промпт vs документы vs дообучение.
Качество важнее объёма.
Тонкая наклейка вместо перепечатки всей книги.
Форматы примеров и перекос стиля.
Учим, какой ответ считают лучшим.
Регрессии, забывание, канарейка, откат.
Эхо, гул, детектор речи.
Распознавание речи и метрики ошибок.
Синтез речи, естественность, этика.
Очистка → ASR → понимание/документы → ответ → TTS.
Метрики, персональные данные, облако vs on-prem.
Банк, отрасли, шпаргалка, ТЗ итогового проекта.
Войдите и запишитесь, чтобы открывать уроки и сохранять прогресс.
Запишитесь на созвон с ментором: разбор кода, проекта, карьерного плана или практики с материалами платформы. Это часть консультационной услуги, не массовый онлайн-курс.