Каждое заклинание в Hogwarts Legacy читается с одного взгляда: взмах палочкой — короткий и точный, как выпад в фехтовании. Такая отзывчивость не случайна. Анимация здесь несёт саму «магию» — ощущение, что заклинание действительно вылетает из палочки, — и работает на неё полноценный производственный конвейер: от оптической площадки, где несколько актёров снимаются одновременно, до финальной сборки сцены в Unreal Engine.
Разбираем, как этот конвейер устроен: где игра опирается на фильмы о Гарри Поттере, откуда берётся мимика, привязанная к голосу, и почему аниматорам приходилось выяснять, сколько весит тролль.
Источник деталей — раунд-стол Game Anim с участием команды Avalanche Software: ведущий кинематографический аниматор Kevin Chesnos, старший аниматор Matt Dibb, техник захвата движения Moira Rausch и ассоциированный аниматор Brendan Casey.
Пайплайн: Maya и MotionBuilder под одним колпаком
Основа конвейера — связка Autodesk Maya и MotionBuilder, и уже оттуда анимация уезжает в Unreal Engine. Схема сама по себе не экзотика, но в масштабе Hogwarts Legacy она решает принципиальную задачу: персонажи, существа и кинематографические сцены движутся параллельно, по единым правилам и с одним стандартом качества. Без этого проект с сотнями NPC и десятками существ развалился бы на несшиваемые куски.
Координация живёт в Autodesk ShotGrid — там же, где задачи, версии и ревью. Для распределённой команды это не бюрократия, а способ не потерять контекст: подрядчик передаёт контент через тот же процесс проверки, что и внутренний отдел. Так, Technicolor Games, отвечавшая за анимацию животных и существ, работала в общем пайплайне, а не в изолированной силиконовой долине.

Несколько актёров одновременно, трекинг пальцев и тайм-коды
Захват движения в Hogwarts Legacy — оптический, на системе Vicon. Камеры двух семейств — Vantage и Vero — покрывают площадку так, чтобы несколько актёров работали в кадре одновременно. Для игры, где диалоги и магические дуэли почти всегда происходят минимум вдвоём, это базовое требование: поодиночке эти сцены не снимешь.
Отдельный фронт работы — кисти. Жест волшебника живёт в пальцах не меньше, чем в корпусе, поэтому трекинг пальцев здесь не роскошь, а условие задачи: взмах, хват и «почерк» палочкой должны дожить до финального рига.
Синхронизация — через тайм-коды: данные тела и лицевой захвата сводятся на общей временной шкале. А «шлемы» с интегрированными камерами регистрируют детальную мимику прямо на площадке — лицо не отрывается от тела в отдельный процесс, и актёрская игра остаётся целостной: реплика, взгляд и жест принадлежат одному дублю.
Мимика из аудиодорожки: Speech Graphics SGX
Самое интересное инженерное решение проекта — Speech Graphics SGX, система лицевой анимации, управляемой аудио. Классический путь — вручную подгонять формы губ под каждую реплику. SGX идёт иначе: система анализирует звуковую дорожку и сама генерирует мимику, синхронную с речью.
Аниматор под каждую реплику подбирает формы губ и выстраивает мимику вручную. Полный контроль, но на сотни NPC времени и команды не хватит — массовые сцены неизбежно упрощаются.
Система читает аудио и генерирует синхронную мимику автоматически. Контроль тоньше — там, где нужна актёрская деталь, в дело всё равно вступает ручная полировка.
Avalanche пошли дальше липсинка: метаданные, которые SGX извлекает из речи, использовались для автоматизации жестов тела. Высота тона, интенсивность, просодия — из них можно понять, в каком состоянии персонаж произносит фразу, и подставить жест, который этому соответствует.
Главный выигрыш — массовка. Сотни NPC получили убедительную анимацию без ручной работы над каждым: система генерирует и губы, и телесную реакцию из одного аудиофайла.
Заклинания как фехтование
Источник пластики боя разработчики называли прямо: фильмы о Гарри Поттере. Но перенести «киношные» движения в геймплей как есть нельзя — на экране они живут дольше, чем игрок готов ждать в бою. Темп сознательно ускорили до фехтовального: заклинание должно быть коротким, читаемым и отзывчивым.
Второе решение — собственный визуальный язык для каждого заклинания. Игрок различает их взглядом, без подсказок интерфейса: у каждого — свой рисунок движения палочкой.
Захват таких боёв требовал от актёров физической подготовки и понимания хореографии: каждый взмах — осмысленное движение, а не импровизация. А финальная анимация — результат многократных итераций, в которых данные захвата сочетались с ключевой анимацией, доработанной вручную: машина даёт основу, аниматоры — почерк.

Сколько весит тролль?
В видео для Wizarding World разработчики с юмором вспоминали вопросы, которые ставили сами себе: «Сколько весит тролль?» Шутка шуткой, но вопрос правильный: у веса есть инерция, а у инерции — пластика, которую зритель считывает мгновенно и не прощает фальши.
Рецепт убеждения — реальный мир. Команда брала референсы из животного царства и адаптировала их под фантастическую анатомию: дракон должен быть тяжёлым, как дракон, а не как человек в костюме дракона.
Крупный подряд здесь — снова Technicolor Games: риггинг и анимация животных и существ, включая анатомически точные перья и движения птиц. Только отполированной анимации студия произвела более двух миллионов кадров — цифра, которая хорошо показывает, сколько «невидимой» работы стоит за парой секунд полёта гиппогрифа.


Что из этого следует
Hogwarts Legacy не изобретала новых технологий захвата — она собрала проверенные в один конвейер и доверила ему главное: актёрскую игру. Тело — с оптической площадки Vicon, мимика — из аудиодорожки, жесты — из метаданных речи, поверх — ручная полировка. Каждый слой закрывает свою часть задачи, и потому система выдерживает масштаб игры с сотнями персонажей.
Для студий, работающих с захватом движения, урок здесь шире самой игры: mocap перестаёт быть «поставщиком сырья для аниматоров» и становится основой выразительности. Если хотите, чтобы движение рассказывало историю, — производственный опыт Avalanche Software стоит изучить в деталях.
- Пайплайн: Autodesk Maya + MotionBuilder → Unreal Engine, координация и ревью — в ShotGrid; подрядчики работают в тех же процессах, что и внутренние отделы.
- Оптический захват Vicon (камеры Vantage и Vero): несколько актёров одновременно, трекинг пальцев и сведение тела с лицом через тайм-коды; мимика снимается шлемами с камерами прямо на площадке.
- Speech Graphics SGX генерирует мимику из аудио, а её метаданные (тон, интенсивность, просодия) автоматизируют ещё и жесты тела — так сотни NPC получили анимацию без ручной работы над каждым.
- Бой построен на движениях из фильмов о Гарри Поттере, но ускорен до фехтования: у каждого заклинания — собственный визуальный язык, а финальная пластика — mocap плюс ручная ключевая анимация.
- Существа собирали из реальных референсов, подогнанных под фантастическую анатомию; Technicolor Games сделала риггинг и анимацию животных и существ — более 2 млн кадров отполированной анимации.

