ИИ на видео в онлайн-обучении: пять функций по порядку

18/4/2025
·
Обновлено
8.20.2026
Цифровое видео: 5 функций на базе ИИ, которые меняют дистанционное обучение — обложка

Ученик открывает часовую лекцию и закрывает её на пятой минуте. Так происходит с большей частью длинных роликов без разбивки: внимание к видео одним планом резко падает уже после нескольких минут, а к середине лекции досматривают единицы. Платформа при этом обычно винит контент или мотивацию ученика, хотя проблема почти всегда в самом видеослое, а не в программе курса.

Узкое место дистанционного обучения: то, как устроено видео и что ИИ умеет делать поверх него, а не интерфейс личного кабинета и не качество самого курса. Разберём пять функций, которые реально повышают завершаемость, в каком порядке их строить и когда ИИ в обучении применять не стоит.

Почему порядок внедрения важен больше, чем сам список функций

Каждая из пяти функций опирается на данные, которые генерирует предыдущая. Субтитры и транскрипция дают точный текст с таймкодами. На этом тексте строятся автоматические главы и тесты. На главах и тестах строится ИИ-репетитор, который отвечает на вопросы по материалам курса. На поведении учеников внутри уже работающих функций строится аналитика вовлечённости. И только когда накопилось достаточно данных о том, где ученики буксуют, имеет смысл включать адаптивную подачу материала.

Если поменять порядок, каждый следующий слой строится на плохих данных: репетитор, запущенный до того, как транскрипция стала точной, отвечает с ошибками, унаследованными от плохой расшифровки. Адаптивная подача, включённая до накопления данных о поведении учеников, вынуждена гадать вместо того, чтобы опираться на реальные сигналы. Поэтому вопрос, какой ИИ в платформе онлайн-обучения реально работает, почти всегда сводится к порядку слоёв, а не к длине списка возможностей.

Функция Что даёт На чём строится
Субтитры и транскрипция доступность и точный текст с таймкодами ничего, это фундамент
Главы, конспекты и тесты завершаемость и экономия времени преподавателя точная расшифровка
ИИ-репетитор по курсу ответы ученику по материалам курса главы, конспекты и структура курса
Аналитика вовлечённости сигналы о том, где ученики буксуют поведение учеников внутри первых трёх функций
Адаптивная подача материала персонализация следующего шага накопленные данные о прогрессе учеников

Функция 1: субтитры, транскрипция и перевод

Если внедрять только одну функцию в этом квартале, это она. Субтитры и расшифровка помогают сразу нескольким группам учеников: тем, кто плохо слышит, тем, для кого язык курса не родной, и просто тем, кому легче удерживать внимание, когда звук сопровождается текстом. Это же самая безопасная с точки зрения права функция: она не требует согласия на обработку биометрии и не подпадает под особые категории персональных данных.

Здесь разумно покупать готовое распознавание речи, а не строить своё: это давно отраслевой стандарт, где выигрывать не на чем. Отдельный практический момент: доступность зарубежных сервисов распознавания речи и перевода из России ограничена, а рабочая замена это российские сервисы распознавания и синтеза речи или открытые модели, развёрнутые на собственных серверах, если данные учеников нельзя выпускать за периметр.

Это же основа, на которой строятся все остальные четыре функции: точная расшифровка с таймкодами служит входом для генерации глав, тестов, поиска репетитора и аналитики вовлечённости.

Функция 2: автоматические главы, конспекты и тесты

Из расшифровки лекции модель за минуты собирает структурированный учебный материал: главы, конспект, тест с вариантами ответа. Разбивка часовой лекции на десятиминутные главы работает почти как психологический трюк: длинное занятие превращается в ощущение нескольких коротких, и пересматривают такие записи заметно чаще. Побочный эффект здесь не менее ценный: главы и конспект делают архив находимым, а ИИ-поиск и навигация по видеоурокам начинают работать по смыслу фразы, а не по названию файла.

Главный риск здесь: тест с уверенно сформулированным, но фактически неверным вопросом разрушает доверие преподавателей быстрее, чем полное отсутствие такого теста. Рабочая защита простая: каждый вариант ответа должен цитировать конкретный фрагмент расшифровки, а вопрос без такой цитаты в исходном материале отбраковывается ещё до публикации. В первый месяц стоит вручную проверять часть сгенерированных тестов, а не доверять автоматике полностью.

Функция 3: ИИ-репетитор по материалам курса

Репетитор, который отвечает на вопросы ученика по конкретному курсу, а не из общих знаний модели: самая заметная и самая рискованная функция во всей архитектуре. Работающая схема требует привязки каждого ответа к конкретному фрагменту курса и порога уверенности: если подходящего фрагмента не нашлось, репетитор честно признаёт, что материал курса это не покрывает, вместо того чтобы отвечать наугад. Для несовершеннолетних учеников разумен ещё и сократический режим: репетитор подводит к ответу вопросами, вместо того чтобы сразу выдать готовое решение.

Такой репетитор это частный случай давно описанного класса: интеллектуальные обучающие системы строятся вокруг модели знаний ученика, и репетитор по курсу наследует их логику. Здесь достаточно знать, что запускать репетитора стоит только после того, как транскрипция и структура курса уже стабильны, иначе он унаследует их ошибки.

Функция 4: аналитика вовлечённости, где проходит граница

Это самая рискованная с точки зрения права функция из пяти. Есть безопасные поведенческие сигналы: паузы и перемотки на видео, время на странице, доля сложных вопросов в тестах, частота сообщений в чате. Они не требуют согласия на обработку биометрии и дают большую часть пользы для преподавателя.

Есть и рискованная категория: распознавание эмоций или внимания по камере ученика. По 152-ФЗ биометрические персональные данные, включая изображение лица, обрабатываются по особым правилам с отдельным согласием, а для несовершеннолетних это согласие даёт законный представитель. Для взрослых учеников в корпоративном обучении такой сигнал иногда оправдан при явном согласии. Для школьников смысла в нём почти нет: юридическая нагрузка перевешивает пользу, а точность распознавания эмоций у детей и подростков ниже, чем у взрослых.

Практический вывод: начинать стоит с поведенческих сигналов без камеры, они закрывают основную часть задачи, и только для взрослой корпоративной аудитории при прямом согласии добавлять сигналы с камеры.

Функция 5: адаптивная подача контента

Финальный слой: платформа подбирает ученику следующее видео или задание по тому, что конкретно этот ученик уже освоил, а не по общей логике курса для всех. Здесь работает та же логика холодного старта, что и в рекомендательных системах в целом: новому ученику без истории нужна разумная последовательность по умолчанию, пока не накопятся данные о его прогрессе. Включать эту функцию раньше, чем накопится телеметрия с предыдущих четырёх слоёв, означает подбирать материал вслепую.

Когда ИИ не тот инструмент

Итоговая аттестация с высокими ставками: ИИ может предварительно отфильтровать или подсветить работы, но финальное решение должно оставаться за человеком, и ради справедливости, и ради юридической защиты вуза или компании. Мотивация и групповая динамика по-прежнему держатся на живых людях, а не на репетиторе. Практические лабораторные занятия с реальным оборудованием ИИ не контролирует и не должен имитировать контроль. Аналитика вовлечённости не годится для оценки психологического состояния ученика: если платформа работает с уязвимой аудиторией, путь к живой поддержке должен быть продуман заранее, а не появиться только после первого тревожного случая. И курс, который обновляется каждую неделю, плохо подходит для репетитора на основе фиксированной базы знаний: либо материалы нужно переобрабатывать каждую ночь, либо отказаться от репетитора именно в этом разделе.

Что требует закон

Платформа хранит расшифровки, результаты тестов и, если используется аналитика вовлечённости, поведенческие данные ученика. Это персональные данные, и по 152-ФЗ базы с ними размещаются на серверах в России. Любая обработка изображения лица или голоса для распознавания эмоций подпадает под особые категории персональных данных с отдельным согласием. Для несовершеннолетних учеников такое согласие даёт законный представитель. Для вуза дополнительно действует 273-ФЗ «Об образовании»: результаты работы ИИ-репетитора и аналитики должны попадать в ту же систему учёта, что и обычная успеваемость.

Фора Софт в реестре отечественного ПО, реестровая запись № 21522.

Сколько стоит разработка

Разработка ИИ на видео начинается от 310 000 ₽. В эту сумму входит рабочая база: распознавание речи и субтитры для одной функции. Дальше цена растёт от того, сколько из пяти функций нужно, в каком порядке их запускать и насколько глубокой должна быть защита от галлюцинаций и юридический слой согласий.

Список желаемых функций для оценки почти ничего не даёт, поэтому мы считаем иначе: описание требований, архитектуру и смету отдаём за 24 часа. План MVP, аудит кода и аудит архитектуры делаем бесплатно, за 3 рабочих дня.

В команде 50 специалистов в штате, без субподряда, а собственный процесс агентной разработки ускоряет такие проекты в 4-10 раз по сравнению с традиционным подходом, но под контролем ведущих инженеров. Видео и аудио занимаемся с 2005 года, за это время сделали 250+ проектов, включая заказчиков из 17+ стран. На КарьерПойнт, платформе с видеоуроками, мы обслуживали 100 000+ пользователей: на таком масштабе видно, что порядок внедрения функций и защита от галлюцинаций в тестах решают завершаемость сильнее, чем количество функций само по себе.

Частые вопросы

Какую ИИ-функцию запускать первой?

Субтитры и транскрипцию. Они повышают завершаемость почти для любой аудитории, закрывают требования доступности и становятся основой для всех остальных функций.

Можно ли использовать распознавание эмоций по камере для оценки вовлечённости?

Для взрослых учеников при явном согласии иногда оправдано. Для школьников юридическая нагрузка по 152-ФЗ перевешивает пользу, а поведенческие сигналы без камеры дают большую часть той же информации.

Как защититься от того, что ИИ-репетитор выдумывает ответы?

Привязкой каждого ответа к конкретному фрагменту курса, порогом уверенности при поиске и, для несовершеннолетних, сократическим режимом, который подводит к ответу вопросами, а не выдаёт готовый вариант.

В каком порядке внедрять пять функций?

Субтитры и транскрипция, затем главы и тесты, затем ИИ-репетитор, затем аналитика вовлечённости, и только потом адаптивная подача материала. Каждый следующий слой опирается на данные, которые собрал предыдущий.

Сколько времени занимает разработка полного набора из пяти функций?

Зависит от того, сколько функций нужно на старте и насколько глубокой должна быть защита от галлюцинаций и юридический слой согласий. Одна функция собирается заметно быстрее, чем последовательный запуск всех пяти.

Если платформе онлайн-обучения нужно внедрение ИИ в продукт с размещением данных в России, расскажите задачу, и мы вернёмся с архитектурой и сметой за 24 часа.

  • Технологии