Глава 6 из 6
Глава 6. Пространственный звук, измерение качества и будущее
Двенадцать статей по порядку – 4 часа 27 минут чтения. Ниже маршрут главы: высота каждого шага соответствует времени чтения.
Глава 6 из 6
От стерео к объектному и сценному звуку: Atmos, MPEG-H, Ambisonics и бинауральный рендеринг для VR и конференций. Рядом – как качество звука измеряют объективно и на слушателях, и что уже умеют нейросетевые кодеки и ИИ-дубляж.
Маршрут главы
12 статей · 4 ч 27 мин6.1От стерео к иммерсивному звуку: 60-летняя история многоканального аудиоМногоканальный звук прошёл путь от одного динамика к множеству – три крупных этапа: стерео (два канала, 1930-е),…21 мин·от начала главы 0 ч 0 мин6.2Канальное, объектное и сценное аудио: в чём разницаОписать звуковую сцену компьютеру можно тремя способами: перечислить динамики (канальное аудио), указать звуки и их…19 мин·от начала главы 0 ч 21 мин6.3Dolby Atmos для кино, вещания, музыки и стримингаDolby Atmos – это один формат, принимающий четыре разных облика: в кинозале – до 128 аудиодорожек, рендеримых в реальном…25 мин·от начала главы 0 ч 40 мин6.4MPEG-H 3D Audio: открытый стандарт иммерсивного звука ISOMPEG-H 3D Audio – это открытая система звука, стандартизированная в ISO, на основе которой строятся вещание нового…18 мин·от начала главы 1 ч 5 мин6.5Ambisonics, HRTF и бинауральный рендерингПространственный звук в наушниках строится на трёх ключевых идеях, объединённых в единый конвейер: способ записи или…17 мин·от начала главы 1 ч 23 мин6.6Пространственный звук в VR/AR-стримингеПространственный звук в VR и AR строится на одном ключевом различии: реагирует ли звук только на то, куда вы *смотрите*…15 мин·от начала главы 1 ч 40 мин6.7Пространственный звук в конференциях и групповых звонкахПространственный звук в видеозвонке размещает голос каждого участника там, где на экране находится его плитка: говорящий…23 мин·от начала главы 1 ч 55 мин6.8Объективные метрики качества аудио: PESQ, POLQA, ViSQOL, AAC-QОбъективная метрика качества аудио – это программа, которая «слушает» обработанный аудиофайл так, как это сделала бы…25 мин·от начала главы 2 ч 18 мин6.9Субъективное тестирование звука: MUSHRA, MOS, AB и ABXСубъективное тестирование аудио – это когда реальные люди слушают аудиоклипы и оценивают или сравнивают их, ведь…28 мин·от начала главы 2 ч 43 мин6.10ИИ в аудио для видео: клонирование голоса, дубляж, реставрация, генерация музыкиМашинное обучение теперь задействовано на каждом этапе звукового тракта видеопродукта и проникло через четыре основные…28 мин·от начала главы 3 ч 11 мин6.11Нейросетевые аудиокодеки: Lyra, EnCodec, SoundStream и что дальшеНейросетевой аудиокодек – это программа сжатия, в которой вместо ручного алгоритма используется нейросеть, обученная на…29 мин·от начала главы 3 ч 39 мин6.12Будущее: сквозной обучаемый звук, громкость на базе ИИ, персональные миксыСорок лет звук для видео был жёстко фиксированным продуктом: один микс, один уровень громкости, одна звуковая дорожка –…19 мин·от начала главы 4 ч 8 мин
✓Конец курса – это была последняя глава
Строите такую систему?
Поможем выбрать кодек и собрать пайплайн под ваши объёмы – 20 лет в видеоразработке, 250+ проектов.