Хилько о звуке для взрослых
СтатистикаЯ саунд-дизайнер, композитор, руководитель студии саунд-дизайна и основатель школы игрового звука. Мне 41 год. А это мой личный блог. https://хилько.рф/
- Последний пост
- 09:24
- Последнее чтение
- 18:01
- Постов за неделю
- 3
- Всего постов
- 23
- Тип
- открытый
- Язык
- русский
- Категория
- Дизайн
- В каталоге с
- 12 авг.
- 1/24сутки в ленте
- 290
- 1/48двое суток
- 332
- 1/72трое суток
- 358
Оценка по просмотрам недавних постов: пост набирает почти всё за первые сутки.
Посты
На днях со мной случился довольно интересный опыт. Я уже более трёх лет ничего не публикую сам и не листаю запрещённую инсту. Не по идеологическим соображениям, а потому что потребление такого контента плохо моего здоровья. Спустя несколько лет я решил вновь установить приложение и зайти посмотреть, что там новенького, интересненького. И с ужасом для себя обнаружил, насколько много там всего интересного. Буквально сразу на меня накинулась куча разных ярких видеороликов и фоточек, которые идеально подходит моей внутренней обезьяне. Посмотрев на часы, я с ужасом обнаружил, что прошло уже больше получаса. Но тем не менее я не могу вспомнить ничего, что я посмотрел за это время. Вообще, ни одного ролика, ни одной фотографии. То, что мне запомнилось - это то, что это было ужасно увлекательно и интересно и хочется ещоооооооооооо. Как вообще можно конкурировать в современном мире за внимание людей, когда вокруг так много одноминутного, интересного, увлекательного контента на любые вкусы и интересы. Здесь вам и ловкие дамы с пышными формами, и интересные музыканты, и лайфхаки про жизнь на любой вкус, и многое-многое другое. Как можно созадавать что-нибудь сложное и вдумчивое, когда вокруг сплошная короткая форма? Я имею в виду шортсы, рилсы и прочие тиктоки. Как можно рассчитывать на то, что пользователи будут читать что-то, где больше ста слов, которые не появляются по одному на экране. На этой мысли я сразу же удалил приложение. Тем не менее в мире, где есть Тиндер, я думаю, что осталось ещё место обычным, нормальным знакомствам (горжусь тем, что ни разу не открывал и тем более не был зарегистрирован в подобных приложениях). В мире, в котором есть дешёвая вкусная неполезная нямка, есть ещё место рыбке на пару. Ну и, конечно, мир, который заполнен яркой короткой формой, в нём всё ещё есть место вдумчивым, многобуквенным рассуждениям и мыслям.
Я уже говорил, что во времена сплошного нейрогена, мы в команде Точки Сборки придерживаемся иного, хардкорный подход. Для звука мы выбрали все синтезировать на синтезаторе: выстрелы, попадания, взрывы, ui и т. д. И вот сейчас, синтезируя звук колёс по песку, я задумался о том, как это подключить. Наша текущая концепция - это гранулярный лупер. И для того, чтобы звук заработал, нужно из физики игры правильно отдавать параметры силы качения колеса, силы трения-скольжения. А ещё менять звук от глубины воздействия на поверхность. Ни в одном AAA-проекте (я работал на двух) я не видел такой крутой детализации для звука. А вот Женя взял и сделал круче, чем в любом из видимых мной симуляторов. Возможно, где-то тоже так заморачивались, но большинство игр ограничиваются скоростью колёс, выбором поверхности и силы давления. Как минимум в тех, что я вдумчиво разбирал. А теперь ещё есть возможность на ходу в игру закидывать из Reaper доработанный контент, и новый рендер звука поверхности подхватывается на лету. Ну не магия ли?
Одна из самых важных встреч с заказчиками - это первая встреча. Здесь в ограниченное время заказчику нужно погрузить вас в проект и вам рассказать, чем вы можете быть полезны. За долгие годы переговоров с разными игровыми студиями, продюсерами и геймдизайнерами я, кажется, наконец-то понял, что самое важное. Сначала надо готовиться к встрече! Это, казалось бы, так очевидно, что долгое время я этого не делал, а старался выходить на чистой интуиции. И да, периодически она меня подводила. Ну вот, например, вам пишет представитель студии. Обычно заказчикам важно, сможете ли вы сделать, что им нужно, по минимальной цене, а ещё бы за минимальные сроки. Чтобы определить, что вы подходите, они, конечно, будут искать в портфолио похожие или знакомые им проекты. Но и вам, как исполнителю тоже важна информация о заказчике. Вам важно, смогут ли они себе позволить ваши услуги, не кинут ли и выйдет ли игра. Остальное тоже важно, но на первой встрече вам важны финансы и безопасность. Если так примитивизировать потребности обеих сторон, то готовиться к встрече становится проще. Для этого нужно найти и структурировать информацию о заказчике: а) Что за студия, б) какие проекты были выпущены, в) откуда деньги, г) что за команда. На самом деле почти все вопросы можно найти в открытых источниках: страница в Steam, обсуждение в Steam игр заказчика, посты в Linkedin (простой поиск по названию может открыть кучу подводных камней) и т.д. Подготавливаясь к встрече, вы не только произведёте хорошее впечатление (90% ваших конкурентов не готовятся к встрече), но и продемонстрируете, что вам важно будущее сотрудничество с заказчиком настолько, что вы готовы потратить своё время, чтобы изучить их проект. По сути, потратив два часа на подготовку, ещё до официального знакомства вы можете произвести более благоприятное впечатление, даже если вы интроверт и не любите общаться и тем более не обладаете способностью нравиться людям. Понимая ключевые потребности заказчика, можно очень правильно структурировать своё предложение и с большей вероятностью получить проект. Кейс из моего опыта. Я увидел, что одному проекту (называть имя сейчас не буду) требуется помочь сделать хорошим звук. Первое, что у меня совпало - это то, что паблишера я знал. Даже ранее с ними сотрудничал. Тему проекта я тоже хорошо знал - имел опыт не одного проекта в подобном сеттинге. Осталось понять, откуда деньги. Зайдя на страницу паблишера, я увидел только один проект с подобной тематикой, все остальные проекты прямо сильно отличались. Я сразу предположил, что деньги из одного известного фонда, и даже имею чёткое представление, как это работает (и какие есть очевидные риски сотрудничества с этим фондом). Затем почитал посты в стиме, посмотрел, что проект живёт и постоянно пополняется, поискал в интернете информацию, статьи, комментарии. И в результате даже примерно смог понять, какое уже сейчас комьюнити вокруг проекта. В интервью были указаны референсы. С ними я тоже познакомился. После этого я еще раз вдумчиво посмотрел картинки и трейлер игры и кратко записал свои мысли по тому, как это должно зазвучать. Я уже знал ответы на большинство вопросов, которые могут возникнуть. Но формально записал ещё несколько, которые задал на созвоне. Просто было бы слишком странным, если бы я сказал: мне всё понятно, спрашивать нечего, давайте вы поспрашивайте. Хорошая и вдумчивая подготовка очень часто может уберечь не только от зря потраченного времени, но и от более серьёзных проблем. Долгое время я вообще предпочитал переговоры вывозить, только используя чутьё. Как-то ко мне обратился заказчик (сами нашли мою студию и написали), задавал вопросы, как всегда, просили точно (?!) посчитать смету и т.д., мы даже созвонились. И на самом созвоне я почувствовал, что меня начинают брать в оборот: не партнёрское, а скорее подчинённое общение с порога (со мной же сам Продюсер общался), навязывание глубоко изучать их проект до подписания и предоплаты, и вообще моя внутренняя нейронка орала всеми системами оповещения. В результате я прямо на созвоне доверился своим ощущениям и сказал, что на этом не вижу смысла продолжать тратить своё время. А если бы я провёл дополнительную работу, чтобы изучить, что за компания, кто лицо игры, был ли у них уже опыт успешных или неуспешных игр, то я бы сразу для себя увидел несколько красных флагов и даже не стал бы тратить время. Поэтому если есть опыт и время, то можно почти всегда в первом же живом общении понять, подходим ли мы друг другу, но спустя годы я понял, что лучше делать домашнюю работу и не тратить когнитивные ресурсы на пустое общение.
За успехом большинства людей стоят другие люди. Они не ищут славы, их успех - это результаты их труда. Многие люди считают, что Мик Гордон сделал весь звук Doom. Я не буду оспаривать вклад Мика и его способность к самопиару. Только посмотрите его выступления на GDC - он стелет, как американский священник во время службы. Я даже как-то пытался косплеить подобный стиль выступлений, но это точно не моё. Но тем не менее на звучание Doom и саундтрека, и самой игры сильно повлияли участники всей команды id Software. Среди них Chad Mossholder. Во времена первого Doom, где писал музыку Мик, Чад был Principal Audio Designer. В Doom Eternal - уже Lead Audio Designer. Причём в титрах Doom и Doom Eternal у него есть ещё и additional music. Я давно подписан на его канал, где он выкладывает своё синтовое задротство. Модуляры, странные патчи, обработка, эксперименты с сигналами. Смотря на творчество Чадвика и его коллег, я понимаю, кто влиял на звучание саундтреков. И почему звучание Doom получилось именно таким. Я как-то прочитал интервью про то, как проходил процесс создания музыки к Doom: Была примерно такая задача: сделать музыку, которую никто раньше не слышал, которая при этом сразу воспринималась бы как Doom (звучит примерно, как "Сделать самый крутой звук!"). И одно из первых ограничений саунд-трека: никаких гитар. Мик начал искать звук через синтез: синусы, нойз, дисторшн и прочая обработка. В какой-то момент он сделал демку и получил ответ: "Meh." (что-то вроде "ну такое") Но дальше была еще одна фраза: "I feel you've taken the first step on a journey toward the perfect destination. Keep going. You're almost there." Первая идея могла оказаться посредственной. Вторая и третья тоже. Но постоянно двигаясь по пути, перенимая опыт своих коллег, вдохновляясь, итерируя, всё-таки можно выполнить задачу: "Самый крутой звук". Мик в конце этой истории фактически приходит к мысли, что команда, которая создаёт среду, где тебе комфортно ошибаться, позволяет тебе расти. Кстати, я сам работал в команде, в которой один человек почему-то решил, что он талантлив от Бога и благодаря ему живёт звук в проекте. Спойлер: я сейчас не про себя. Такие персонажи обычно не упоминают, сколько людей вокруг постоянно корректируют результаты их "гениальности". Такие персонажи не могут надолго прижиться в команде, и большинство из них заканчивают свою карьеру довольно посредственно. Очень часто люди в игре воспринимают только музыку, в плане замечают, что музыка классная. А звук, микс или аудиодирекшн люди вообще не замечают. Я понимаю их, эти сущности невозможно воспроизвести в плейере или авто. Хотя именно эти вещи делают игру звучащей! Решения аудиодиректора спасают игру от большинства субъективных решений саунд-дизайнеров и композиторов. Я видел, как много влияния оказывают "незаметные" герои на посредственные идеи, и в итоге результат оказывается прекрасно звучащим.
Составить смету для озвучки игры обычно похоже на призыв духов деревенским шаманом. Нужно из воздуха придумать стоимость своей работы, которую вы совершите в будущем, и в процессе попробовать не обмануть клиента и себя. На практике, какую бы я ни сказал сумму, я обязательно ошибусь, так как предположить-то возможно, но зачастую на стадии знакомства не дают всей полноты информации и аппетиты к звуку у заказчиков в процессе работы с нами растут. Тем не менее я всё-таки придумал, как этот "ритуал" проводить без обмана. За годы работы студии AK Audio у нас накопилась статистика фактически затраченного времени на разные задачи: оружие, персонажей, транспорт, интерфейсы, окружение, музыку, интеграцию и сложные звуковые системы. Мы работали с проектами разных жанров, масштабов и платформ, поэтому этих данных уже достаточно, чтобы искать повторяющиеся закономерности. Историю выполненных задач можно выгрузить в таблицу, сгруппировать по типу работы и посмотреть, сколько времени похожие задачи занимали в реальных проектах. Это всё ещё не даёт точного ответа о будущем, но позволяет опираться не только на ощущения, а на реальную статистику. Но даже для похожих игр, как оказалось, системы всё равно делаются по-разному. Ну вот, например, у меня есть проект шутера от первого лица (вы точно про него слышали, так как база у них сотня миллионов игроков), для которого я делал оружие. Я знаю точно, сколько потратил времени на дизайн и имплементацию каждого вида оружия. Соответственно, из этих данных можно предположить, что для шутера от первого лица в VR-арене это будет примерно столько же по времени, но, как оказалось, на практике вылезло много нюансов. Например, звуки по дистанции выстрелов воспринимаются совсем иначе. Микс для колонок, наушников и динамиков гарнитуры делать нужно иначе. А ещё на длительность выполнения задачи влияет, какой аудиодвижок используется, типы оружия и наличие записей. Если мы ищем реализма, то надо делать дизайн или записывать реальные виды оружия. А если в игре сай-фай сеттинг, то здесь нужно погрузиться в синтез и делать уникальный контент, по которому будет на слух легко определяться тип оружия. Поэтому и приходится использовать метод "пальцем в небо" и просто предполагать. Хотя у меня за 15 лет работы AK Audio не было опыта, когда бы заказчик заставлял укладываться в цифру сметы и при этом требовал выше качества. Но это, наверно, только потому, что я не работал с госами. На этапе начала работы всегда вспоминаю пример, когда я хотел сделать ремонт в новой квартире, я, конечно же, просил посчитать, примерно, сколько это будет стоить. И исходя из сметы понимать: а) смогу ли себе позволить этого мастера или бригаду; б) что можно подрезать, чтобы влезть в примерный бюджет. В стройках я никогда не влазил в желаемый бюджет. Я своих заказчиков прекрасно понимаю, поэтому я выделил несколько простых способов сделать понятной работу с ними: Вариант 1: я примерно говорю, сколько готов выделять времени (а исходя из стоимости часа я могу предположить, сколько это будет стоить им в месяц) + сказать, сколько месяцев примерно стоит работать над их глобальной задачей. Вариант 2: начать с того, чтобы примерно по методу "пальцем в небо" рассчитать вилку. Далее для всего скоупа оценить уровень детализации звука (P0 - самый важный приоритет и детализация, P3 - можно драфтовое качество) и с горем пополам дать коллегам хоть какие-то цифры. Сразу скажу, такой способ может быть только с каким-то конечным числом задач (например, вертикальный срез, демо игры или какой-то прототип), а не просто сколько стоит озвучить игру. При этом более или менее реальные цифры можно посчитать, когда говорят что-то вроде "нам нужно озвучить демо, там вот это, это и это есть. а этого не будет". На мой взгляд, самая честная работа начинается со взаимного уважения и доверия между мастером и заказчиком.
Друзья, я уже не раз рассказывал о том, что есть такой сервис LinkedIn, где мою ленту с постами специалистов в игровом звуке засоряет нытьё айтишников о том, что кто-то не может найти работу, а также рекрутеров, которые плачутся, что все плохие и их обижают. К сожалению, подобные настроения присутствуют и в приватных беседах специалистов. Поэтому я решил записать видеобеседу со своим выпускником Никитой Манчуром, который недавно закончил обучение и уже трудится на AAA-шутере. Его история, на мой взгляд, перекликается с моей: тоже опыт в смежной индустрии, тоже не спать по ночам, а курить тему, тоже максимально выкладываться перед общением с заказчиками. Тем не менее этот подход не для каждого, но если вы вступите на этот путь, дальше будет точно лучше! Мы поговорили о: 02:07 - Кто такой Никита Манчур и чем он занимается 03:11 - Что было до игрового звука 05:40 - Почему решил пойти учиться 06:50 - Навык, который изменил всё 08:45 - Какие навыки пригодились в работе 10:30 - Что оказалось самым сложным в игровой индустрии 11:40 - Как получить работу на крупном проекте 15:03 - Что действительно сработало при поиске работы 17:18 - Что помогло выделиться среди других кандидатов 21:25 - Советы тем, кто сейчас ищет работу 26:03 - Три вещи, необходимые для работы в игровом звуке 31:11 - Следующий профессиональный шаг 32:39 - Переход к аудиодирекшну 34:30 - Мой путь в игровой индустрии P.S. Сайт моей школы https://xssracademy.com 🟥 YouTube | 💙 Вконтакте | 📹 RuTube | ⭐ Dzen
Роль учителя сложно переоценить. Нас с детства приучали к тому, что учитель - это очень важная фигура в жизни каждого человека. Но проблема заключалась в том, что этой ролью наделяли абсолютно рандомных людей. То есть если человек получает статус учителя, он наделялся (как минимум в моём воображении) неким определённым статусом. Первая учительница, учитель русского и литературы, преподаватель по основам электротехники - всё это звучит очень значимо, но это не гарантирует, что незнакомцы являются настоящими Учителями. Я очень часто рассуждаю о роли Учителя, особенно в контексте поиска для своих детей. Учитель - это не тот человек, который просто зачитывает учебник и проверяет конспекты, а человек, который передаёт любовь к предмету, вдохновляет на самостоятельное вдумчивое изучение темы и открывает для ученика предмет с новой, увлекательной и волнительной стороны. Тем не менее уже последние несколько лет в нашей жизни активно присутствуют нейросети, которые часто могут наделяться в умах людей какими-то потусторонними способностями: всезнанием, всевидением и вообще полноценным всемогуществом. И я замечал не раз, как только люди получают доступ к обычной LLM, у них начинают гореть глаза и появляется ощущение, что они вот сейчас прикоснулись к всемогуществу. Спустя некоторое время каждый из нас успел разочароваться, привыкнуть, ещё раз вдохновиться и снова разочароваться. И сегодня абсолютно любой из нас может буквально одним промптом написать себе любой учебник на любую тему. Есть возможность не просто получить доступ к знаниям, а получить доступ к информации, которая будет построена специально для вас, сделана в интерактивной игровой форме, с красивыми подвижными графиками - ну, в общем, прелесть, а учебник. То есть, по сути, вместо того чтобы учиться по учебникам, на которых зарабатывает определённый тип элит, можно создавать свои интерактивные учебники, в тысячи раз лучше, персонализированные и более интересные, с игровой формой. Но люди, я полагаю, не будут этим пользоваться. Личность и роль учителя в жизни абсолютно не изменится, даже во время того, когда любой может моментально получить ответ на любой вопрос. Просто с ошибками и опечатками задав его нейронке. крч обясни как дебилу что такое теория струна Сейчас мы не говорим про достоверность информации, которую получит в ответ на свой промпт человек. Я говорю том, что, по сути, мы можем узнать о чём угодно буквально за один запрос, в той форме, в которой я хочу. Вчера я подумал, что хочу вспомнить основы электроники, которые когда-то мне давали двадцать лет назад. Написал один большой промпт (с уточнениями, стилистикой, дополнительными проверками и прочим), чтобы получить на выходе классный интерактивный учебник по электронике. Если кому-то из вас захочется посмотреть, то вот ссылка на учебник, по которому я решил учиться: https://хилько.рф/electrobook/ И вот самое интересное: несмотря на то что, к примеру, каждый из вас может получить доступ к этим знаниям, большинство просто не стремится учиться, не стремится получать знания, а стремится получать быстрый результат. Вместо того чтобы понять, как это делается, мы хотим узнать уже финальный результат. Желательно саммари. Поэтому, на мой взгляд, роль хорошего учителя, наставника, человека, который может вдохновлять, научить рассуждать и думать не то что не исчезнет, но элитизируется и будет необходима людям, которые хотят быть успешными в этой жизни. А вот как найти такого человека, к сожалению, у меня на этот вопрос нет ответа. Такие люди в моей жизни появлялись практически случайно.
😻🧐😻🧐❤️ Пандора звучит как кино — и это не случайно. Разбираю с коллегой звук Avatar: Frontiers of Pandora: как интерактивная музыка ведёт игрока, как выстрел считает эхо в реальном времени, как собран живой мир, в который веришь. Разбор для тех, кто растёт в game audio: смотрим эталон кинематографичного звучания и уносим приёмы в свою работу. ⏱️ Таймкоды: 00:00 Зачем разбирать звук Пандоры — метод анализа 01:22 Главная фишка — как работает музыка 03:33 Музыка по дистанции: лейтмотив у ключевых локаций, фейд 06:50 Кинематографичность: музыка ведёт как в кино (UX-сигнал) 09:29 Почему «кинематографичный» звук — лейтмотивы и драматургия 11:38 Полёт на икране: музыка появляется/исчезает при перемещении 15:14 «Земля Саренту»: музыка по коллайдеру — кино-момент 19:19 Интерактивная музыка боя: саспенс → бой по зонам и стейтам 25:36 Почему микс так сбалансирован (команда The Division) 26:06 Живой мир: дождь, позиционирование, детализация окружения 28:01 Система движения: босиком, масса аватаров, отзывчивость 33:58 Indoor/outdoor через шлюз: кроссфейд и реверб 36:46 Меню, UI/UX: стингеры + превью громкости на фейдере 40:08 Как это сделано: рантайм-система отражений (слэпбэк из The Division) 43:16 Итог: что берём как референс 💻Работа со звуком в Unreal Engine 5 — набор открыт, старт 3 сентября ☠️ Бесплатный плагин akSmartRender (рендер в REAPER) Новости, контент и общение ✓ Сайт: https://xssracademy.com ✓ Точка Звука: https://tochkazvuka.com/ ✓ Спонсор: https://sponsr.ru/xssracademy/ ✓ ВК: https://vk.com/xssracademy ✓ RuTube: https://rutube.ru/channel/39099444/ ✓ Дзен: https://dzen.ru/xssracademy #саунддизайн #gameaudio #звуквиграх #avatar #frontiersofpandora 🟥 YouTube | 💙 Вконтакте | 📹 RuTube | ⭐ Dzen
Последнее время я замечаю, как всё больше людей из IT-среды, которые раньше не занимались написанием каких-то программных модулей или приложений, делают свои решения - кто-то, чтобы изначально облегчить труд, а некоторые просто воплощают свою мечту. И здесь чётко видно: раньше создание приложений, плагинов, модулей было доступно только командам программистов, и сделать какую-то кастомную историю для себя стоило денег или времени. А сейчас любой человек, который способен сформулировать мысль, может написать для себя практически любое приложение, потому что современные нейросети, обученные на различных опенсорсных решениях, легко генерят нечто подобное. С одной стороны, я понимаю людей, которые потратили много лет жизни на то, чтобы создать свой продукт, найти аудиторию, выстроить архитектуру, безопасность и прочее, - а здесь, по сути, абсолютно любой, даже человек, который не владеет дисциплиной и контекстом, может создать себе любую систему. Но с другой стороны, для увлечённых, вдохновлённых людей это открывает потенциально новые возможности. Я вижу, как множество моих коллег аудиодизайнеров создают свои плагины, о которых они мечтали, делают различные системы - например, пространственного звука, как в Wwise. Я уже видел где-то пять или семь различных видов: на основе пучков рейкастов, на основе румов и порталов, на основе поиска пути. Понятно, что нейросети не генерируют ничего нового, они комбинируют и, скорее всего, выдают кэшированные версии того, что уже много раз делали и выдавали, - так как все поголовно начали делать что-то своё. Но, тем не менее, в умелых руках, не без пенделей нейронкам, можно пытаться сделать что-то особенное - не уникальное, но хотя бы особенное. И тут появляется особенность, которую многие не замечают, так как вдохновлены "всесильностью" нейросетей. Проблема в том, что они генерируют то, что уже было создано, могут обернуть в любую интерфейсную обёртку, но ничего уникального здесь вы не найдёте. И самое интересное, что с точки зрения бизнеса, владея большой лингвистической моделью, нет смысла под каждый запрос генерировать новый уникальный ответ. Для экономии, мне кажется, намного проще похожим запросам выдавать одинаковые ответы - это дешевле, потому что не тратятся вычислительные мощности, а людей ответы устраивают. И в итоге, особенно в интерфейсе и в текстах, это заметно: если присмотреться, то во всех новых решениях, которые генерируют люди - в сайтах, в программах, в каких-то оболочках - проглядываются одни и те же интерфейсные ходы. То есть прям сразу невооружённым глазом видно, как это было сгенерированно и сколько времени на это потратили. Тем не менее не отрицаю, что для людей, которые всегда стремились сделать что-то своё, изобрести какую-то систему, это довольно неплохой инструмент. А для тех, кто всегда пытался переложить на других свою работу, я вижу только один исход: они потеряют работу, потому что зачем платить людям, если все прекрасно знают, что с этим справится любая бесплатная нейросетка.
Привет, друзья. Я не часто публикую какие-то интересные ссылки здесь, кроме своих видео и исследований, но сегодня как раз тот момент, когда хочу поделиться с вами замечательным фильмом об игровом звуке, который вышел на днях на ютуб-канале Audiokinetic "Sounds of Dreamers". В этом фильме профессионалы рассказывают о том, как обстояли раньше дела с игровой индустрией, как они там работали, чем их сегодняшний пайплайн отличается от того, что было раньше, как работает индустрия с точки зрения аудиодизайнеров. Для меня этот фильм очень близок, потому что я вижу там много знакомых лиц. С кем-то я сотрудничал и знаю лично, а кого-то знаю по их книгам. В фильме вы встретите действительно профессионалов, людей, которые внесли большой вклад в игровой звук. Гейм-аудио сегодня именно такое, потому что эти люди его сделали таким. Очень рекомендую к просмотру, очень вдохновляет. https://www.youtube.com/watch?v=mG9Gs0IQ_f0
Я с коллегами часто говорю, что звук сильно влияет на эмоцию. Но это высказывание скорее субъективное. Мы можем даже привести ряд примеров, подкладывая разную музыку под сцену, меняется характер её восприятия. На днях я наткнулся как раз на исследования на сколько звук влияет на эмоцию "Emotion-specific modality effects in auditory and visual perception of emotion": В исследовании изучалось, как восприятие эмоций меняется в разных модальностях и зависят ли эти изменения от категорий эмоций. Мы провели эксперимент по восприятию эмоций, используя речевые стимулы трёх типов: только аудио (AO), только видео (VO) и аудиовидео (AV). Участники оценивали валентность стимулов — положительная или отрицательная — и возбуждение/активацию — слабое или сильное — для семи эмоций: гнев, спокойствие, отвращение, страх, радость, грусть и удивление. Другими словами, попытались по факту понять, что больше влияет на восприятие эмоции картинка или звук. Для теста на контрольной группе взяли 10 актёров. Каждому испытуемому давали 2 актёра, которые произносили фразы "Kids are talking by the door" и "Dogs are sitting by the door". Делали это с разными эмоциями и экспрессией. Вот что выяснили: - Эмоция не усиливается автоматически от сочетания звука и картинки. Нельзя категорично сказать: добавили звук к картинке - эмоция всегда стала сильнее и понятнее. Иногда да, но не универсально. - Важность влияния на эмоцию звука или картинки зависит от конкретной эмоции. Восприятие радости, отвращения, удивления, страха, гнева и грусти не используют звук и картинку в одинаковых пропорциях. - Эмоции, воспринимаемые только через слух, в среднем казались более негативными и менее интенсивными. Радость, транслируемая только через звук, имела меньшую яркость, то есть оценивались как менее позитивные и менее возбуждающие (excited). - Эмоция отвращения тоже сильно зависит от картинки. Для этой эмоции важны мимика актёра. Гнев, страх и грусть сохраняют хорошую распознаваемость, даже если убрать картинку или звук. Не удивительно, думаю это эволюционный механизм. - А вот удивление более точно считывалось, когда был звук. Удивление при опасности, радости, негативное удивление или нейтральное без звука сложнее понять. Вывод можно сделать, что каждая эмоция больше опирается на свой канал восприятия. Для аудиодизайнеров это важно понимать, так как если мы хотим управлять эмоцией игрока, то нужно работать в жёсткой связке со всей командой разработки.
В Monument Valley 3 музыка, эмбиенты и интерактивные эффекты работают как единая система. Почти все звуки подчинены общей тональности, поэтому каждое действие игрока дополняет музыкальную композицию и поддерживает удивительно спокойную атмосферу игры. В этом видео разбираю, как устроена интерактивная музыка Monument Valley 3, что происходит внутри Wwise и почему даже простые звуки взаимодействия воспринимаются как часть музыки. Показываю события, стейты, свитчи и маппинги, а в конце выделяю приёмы, которые можно применить в своих проектах. Меня зовут Александр Хилько. Я аудиодиректор студии AK Audio и основатель школы звука XSSR Academy. Более 15 лет создаю звук для игр и обучаю игровых саунд-дизайнеров. ⏱️ Таймкоды: 00:00 — Вступление: что разбираем 00:27 — Почему Monument Valley 3 00:59 — Главная фишка: всё звучит в одной тональности 02:59 — Разбор уровня: случайный луп и звуки взаимодействия 04:14 — Звук и музыка как метафора изображения 05:30 — Интерактивная музыка: переходы между стейтами 07:54 — Метафора кроссфейдера 09:47 — Распаковка банков Wwise: как всё устроено 12:16 — Возвращаемся в игру: «мандала» и рисование фактур 16:14 — Разбор банка в REAPER: события и маппинги 20:37 — Ротейтор и переключение свитчей 22:32 — Что взять в свой проект: эстетика, мозаика и эмбиент 25:50 — Смена аккорда и живые струнные 32:20 — Итоги: ключевые звуковые решения 33:53 — Пасхалка: персонажи качаются в такт 34:37 — Гармония как палитра игрового мира 36:48 — Похожие игры: Rytmos и Cocoon 38:33 — Выводы и завершение 🎓 Научиться создавать звук для игр можно на курсе «Саунд-дизайн для игр и видео»: 🎁 Бесплатный плагин akSmartRender для REAPER: YouTube | Вконтакте | RuTube | Dzen
Нейросети, помогая быстро решать вопросы и создавать проекты, лишают создателей, изобретателей и инженеров той самой награды. Того гормонального всплеска, который приходит, когда сложная задача выполнена, код взломан, а какой-то труд, недоступный большинству, наконец окончен. Разными исследовательскими проектами я активно занимаюсь уже довольно долго, больше половины из них даже здесь не публикую - это разные изобретения и системы. И вот из-за того, что такие инструменты, как нейросети для кода, сильно облегчают сам процесс, проявляются негативные последствия. Первое - это дофаминовая зависимость от результата. Я ещё помню, когда сложную задачу можно решать полгода и так и не решить. Да, это сложно, да, местами обидно. Но когда сложные проекты получается делать за неделю, а некоторые и за сутки, поначалу это обилие дофамина очень сильно окрыляет. А потом появляется зависимость от таких состояний. А неизбежности, когда что-то не получается, тоже никуда не деваются - их полно. Просто из-за того, что всё это спрессовано по времени, и вылезает зависимость от достижения результата. Но это ещё не главная проблема. На мой взгляд, главная - менее заметная и менее очевидная. Для инженера-изобретателя большое обилие проектов не просто размывает фокус с задач, которые действительно важны. Оно может привести к подмене сущности, когда новыми достижениями мы подменяем достижение в каком-то по-настоящему важном проекте. Постоянный расфокус потому, что быстрый дофамин от решённой задачи всегда под рукой. Кто бы мог подумать, год назад про быстрый дофамин я рассуждал в контексте коротких форматов видео (шортсов и рилсов), а сегодня говорю контексте решения инженерных задач. И это может привести к истощению любознательности, изобретательского чутья и, конечно же, самой способности решать задачи. Когда в руки попадает инструмент, который позволяет быстро закрывать то, что раньше было для меня либо сложным, либо вообще невозможным из-за нехватки компетенций, то, создавая проекты и продукты пачками, можно прийти к тому, что, потратив на это всю ману, делать больше просто не захочется. И ещё одна неочевидная, но жутко затратная по ресурсам штука. Из-за того, что сложные задачи теперь решаются быстро, даже самые маленькие задачки - те, что, может, и решения-то не требуют, - начинают решаться через оверинжиниринг. Мы не просто реализуем какой-то функционал, а под этот функционал, который, возможно, и не понадобится, создаём новые сущности и нанизываем ещё больше новых сущностей. А это, конечно же, огромные затраты ресурсов, энергии и времени. Пока я нашёл только одно решение (скучное и жутко очевидное) - это продолжать делать какие-то проекты хардкорным олдскульным методом. Если бы я был программистом, то посоветовал бы писать код руками в IDE. Это не секси, но вдолгую полезно.
Assassin's Creed Odyssey не просто рисует Античную Грецию — она в неё погружает звуком. Разбираю с коллегой, как реагирующие системы — слоистые шаги, голоса по приоритетам, живой эмбиент — делают огромный открытый мир достоверным. Разбор для тех, кто растёт в game audio: смотрим эталон open-world звучания и уносим приёмы в свою работу. ⏱️ Таймкоды: 00:00 Зачем разбирать звук Одиссеи — достоверная Античность как референс 03:38 Достоверность: музыка с гранитного столба — первое записанное произведение 04:45 Общий микс города: интерактивный мир, живые NPC 10:58 Эмбиент по вертикали: поднимаешься — мир звучит иначе 12:10 Озвучка главных механик: фокус на системе движения 16:00 Система шагов: слои (шаги + одежда + оружие), нет повторяемости 19:39 Голоса: правило «не больше 3-4» + фокус камеры 21:33 Как это сделано: приоритеты и виртуализация в движке 25:47 Передвижение на лошади и соколе: смена стейта окружения 30:00 Корабль, который поёт: динамические песни команды 34:23 Маскировка переходов: стейт окружения через всплеск воды 35:56 Итог: что забираю как референс (движение, погружение, детали) 🟥 YouTube | 💙 Вконтакте | 📹 RuTube | ⭐ Dzen 💻 Работа со звуком в Unreal Engine 5 — набор открыт, старт 3 сентября ☠️ Бесплатный плагин akSmartRender (рендер в REAPER)
Вчера созвонились со Стёпой для того, чтобы поработать над звуками двигателя. В современном мире нейрослопа и генеративной музыки осталось совсем не много места для хардкорного синтеза в саунд-дизайне. В видео рассказываю о подходе обработки шума через свёртку разных тембров: органа, трубы и прочих. Кстати, мои коллеги по проекту делают такой же хардкор в своей области: программирование, моделирование, сетевая архитектура и прочее дофаминовое.
Есть у меня одна мысль, которая долгое время меня не отпускает. Кажется, работа с нейросетями похожа на постоянное и бесполезное сжигание энергии. Как майнинг крипты. Когда у человека появляются очень комфортные условия, вся та энергия, которую мы раньше тратили просто на жизнь, вдруг, оказывается, лишней. Раньше надо было добраться до работы, выполнять физическую нагрузку, самому себе приготовить, заставить себя сделать зарядку. А теперь вместо того чтобы перемещаться пешком - корпоративный автобус. Вместо того чтобы выйти пообедать - корпоративная кухня и неограниченный запас быстрых углеводов. Плюс сидячая работа сверху. И желание тратить физические усилия просто исчезает, потому что незачем. Это приводит к быстрому набору веса. Сначала с появлением интернета, а теперь и нейросетей теперь не просто мгновенный доступ к знаниям. У нас есть возможность в одном месте задать вопрос по любой теме и получить ответ в нужной форме - хочешь упрощённо... (хотел написать "хочешь сложно", но понял, что всем надо упрощённо). Результат тот же, что и с физической нагрузкой. Мы перестаём тратить энергию, перестаём напрягать когнитивные способности, чтобы открыть книгу, прочитать, понять. Проще спросить нейронку. И ведь это логично. Зачем искать нужную книгу, зачем тратить на это время, если ответ в нужной форме доступен прямо здесь и сейчас. Мозгу теперь незачем что-то запоминать - ему надо понимать, какую кнопку нажать. С нейросетями к нам в руки попадает доступ к неплохому программированию, к созданию не только картинок, но и целых фильмов и музыке - по сути можно сгенерировать почти что угодно. И при процессе генерации сгорает огромное количество энергии. Современные LLM могут провести глубокое исследование на основе научных статей. А вместо этого мы просим нейросеть сгенерировать простую картинку или написать простой кусок кода. Зачем писать руками, зачем вспоминать, как работают циклы - проще попросить: напиши сама, разберись и сделай коммит. И снова большие мощности крутятся ради запуска этой самой сети. Мне это очень напоминает бессмысленный майнинг крипты. Когда компьютеры тратят огромные мощности просто на то, чтобы перебирать хэш-функцию. Меня всегда возмущала эта мысль: вместо того чтобы этими же машинами считать геном человека или какие-то сложные неразгаданные задачи, люди повально ставят фермы, чтобы расшифровывать бессмысленный набор символов. И современное использование сложных языковых моделей по сути на это и, похоже - на бессмысленный майнинг, гриндинг. Мы просто снимаем с себя скучную задачу: написать статью, предложение или даже сообщение другу. Жмыкнул кнопку "улучшить с помощью AI" - и готово. И всё-таки. Из-за доставки еды и дешёвых калорий не всё вокруг поголовно с лишним весом. Рядом хватает и стройных, здоровых людей. Возможно, с нейросетями будет так же. Может, нас будут окружать не поголовно глупые золотые рыбки, которые не способны прочитать больше тысячи символов за раз и удержать их в голове, а люди, которые умеют держать внимание, находить нужную информацию и её анализировать. Мне очень хочется в будущем быть частью именно этой группы. Но, как мне кажется, без усилий и без сопротивления всем этим улучшаторам и облегчаторам точно не обойтись.
Вчера после выходных приехал в студию. Основным экраном у меня служит 50-дюймовый Samsung, я его ещё в 2020-м брал. Включаю телек - нет изображения. Сначала подумал, что комп завис. Перезагрузил, полез в настройки. Но заметил чёткую тенденцию - телевизор вошёл в "луп перезагрузки". Моргает лампочка питания, подсветка матрицы пытается включиться, погасла, снова пытается. Честно говоря, ощущение было такое, будто в машине крутит стартер, а двигатель никак не заводится. Симптомы я сразу закинул в нейронку - поискать, какие у моей модели бывают известные болячки. Предполагаю, что это плата управления подсветкой, матрица или что-то с питанием. Но точно сказать на глаз нельзя. Дальше у меня появилась первая развилка. Можно было вообще не использовать телевизор: у меня стоят в кладовой два игровых монитора. Небольшая перестановка и проблема решена. Но, как некоторые из вас уже знают, для меня важен комфорт. Когда долго работаешь за компьютером и весь день смотришь в экран, комфорт глаз - это не роскошь. С этим телевизором я пришёл к пониманию, когда могу смотреть на картинку часами и глаза не устают. Вторая развилка - чинить или брать новый. И вот здесь я решил посчитать. Чтобы вообще понять, что сломалось, телевизор надо разобрать: проверить входные напряжения, ключевые точки, посмотреть, что чаще всего вылетает первым. Например, вспухшие электролиты, может, пробитый mosfet. Это не мой профиль, поэтому логично отдать тем, кто в этом разбирается. Но «отдать» - это вовсе не бесплатно. Сначала надо найти подходящего мастера, это уже время. Потом проехать через город и привезти мастеру телевизор - снова время. Потом несколько дней ждать вердикта, потом ждать, пока закажут запчасти. А ещё постараться, чтобы не впарили неправильную дорогую причину вроде «отслоилась матрица» и тихо не забрали телевизор себе на запчасти. В голове ремонт у меня выходил примерно от четверти до половины цены нового телевизора. Посчитав в столбик - дешевле. Но это только стоимость на первый взгляд, а реальная цена за ремонт - это деньги за сам ремонт, плюс стоимость моего времени, плюс стоимость простоя, плюс риск, что ремонт вообще не поможет. Если знать стоимость своего часа, то можно прикинуть настоящую цену решения, а не только ту, что на первый взгляд. Стоит подставить эту цифру и ремонт тысяч за пятнадцать-двадцать, да ещё с вознёй на день и неделей простоя, перестаёт быть дешёвым. Новый похожий по картинке телевизор стоит приемлемо. За полчаса я его забрал. И за эти деньги я сразу возвращаю себе рабочее место, с гарантией, без поиска запчастей и без риска, что ремонт не поможет. Единственный недочёт в моей капиталистической математике в том, что по той же логике мне стоило не ехать самому, а заказать доставку - она вышла бы дешевле, чем стоимость времени, которое я потратил на поездку (30 минут + 15 минут на разговор с продавцом по телефону). Очень часто в таких ситуациях мы не просчитываем математику и забываем про стоимость своего времени. И тогда принимаем решения, неправильные по эффективности, по комфорту и деньгам. С тех пор как я стал активным читателем школы капитализма, я всё чаще считаю стоимость самого решения, а не только стоимость товара или услуги.
Silent Hill 2 пугает не скримерами, а искусством. Разбираю с коллегой, как звук — динамика, дроны, тишина — держит напряжение сильнее графики. Разбор для тех, кто хочет расти в game audio: смотрим эталон атмосферного звучания и уносим приёмы в свою работу. ⏱️ Таймкоды: 00:00 Зачем слушать звук в играх — насмотренность профессионала 03:48 Почему Silent Hill 2: триллер vs хоррор, референс атмосферы 09:38 Метод разбора: записывать моменты и сортировать 11:21 Шаги и поверхности — как читается мир 16:00 Динамика — главный приём напряжения (тихо → громкий удар) 19:27 Атмосфера: реверб и пустой мир, который звучит живым 20:32 Кинематографичность: брошенная трубка «по-киношному» 24:56 Интенсивный микс и переходы в пустоту 29:38 Монстры: аттенюация и позиционирование 31:11 Интерактивная музыка: боевая ↔️ exploration 33:56 Технически: Wwise + Unreal, порталы, конволюционные ревербы 36:38 Триллерность: как нагнетают напряжение 41:12 Итог: Silent Hill 2 как референс 💻 Работа со звуком в Unreal Engine 5 — набор открыт, старт 3 сентября ☠️ Бесплатный плагин akSmartRender (рендер в REAPER) 🟥 YouTube | 💙 Вконтакте | 📹 RuTube | ⭐Dzen
Чтобы понять, чем аудиодизайнерам могут угрожать нейросети, я провожу разные эксперименты и читаю исследования. Например, на arxiv какие технологические новые решения происходят в исследовательском поле. Гуглится легко: например, вот, вот, вот. Есть решения по генерации звуков с помощью нейросетей. Например, Stable Audio 3 - диффузная модель. Она предназначена для генерации в том числе звуковых эффектов. И вместо того, чтобы читать "техноблогеров", которые репостят сгенерированные статьи, я люблю пробовать поковыряться руками. Вчера решил поэкспериментировать, как нейросети способны делать вариации одного звука (это может быть хорошим дополнением для некоторых саунд-дизайнеров). В целом, выглядит как рабочая схема: берём исходный звук (например, взрыв), а скрипт отдаёт его нейросети Stable Audio с текстовым описанием. Модель берёт исходник как отправную точку и "перерисовывает" его: добавляет немного шума поверх оригинала и заново восстанавливает звук, ориентируясь на промпт. Ползунок Init noise решает, насколько сильно отойти от оригинала. Чтобы вариации не были одинаковыми, на каждую из них слегка по-разному крутятся настройки. В итоге получается несколько родственных дублей одного звука, похожих по характеру, но с вариативностью. Есть один важный нюанс. Stable Audio, как и Woosh от Sony AI (открытая версия), обучались не только на профессиональных библиотеках сэмплов, но и открытых стоках звуков (Stable Audio конкретно заявили, что для саунд-эффектов использовали Freesound), так как необходима лицензия для использования конкретных данных. В результате качество контента всегда будет не лучше, чем использованный датасет. Я попробовал дообучить на нескольких библиотеках - пока получилась фигня, но уверен, что при больших инвестициях времени я бы смог сделать более качественный выход. Проверяя работу на более оригинальном звуке, который я синтезировал, нейронка "округляет" уникальность до обычности. Вот для меня это хороший маркер, что будет цениться в профессии. Думаю, стоит подробнее рассказать об этом в видео.
Обожаю всякие виды досок (бордов). Сёрфборды, скейтборды, сёрфскейты, сапборды (кроме сноубордов). И так как на Балтике заниматься сёрфингом такое себе удовольствие (хотя у нас даже соревнования проходили), а сёрфинг я люблю, то я решил попробовать для себя сёрфинг по асфальту на сёрфскейте. И это оказалось обалденно. У меня 3 разных сёрфскейта от фирмы Carver. И вот недавно я купил себе Carver CX Fishbeard. Он отличается от других двух тем, что он на подвеске CX и длиной 74 с копейками сантиметров. И мне достаточно было минуты прокатиться, чтобы понять, насколько это идеальная для меня доска. Она довольно подвижная, как доски с подвеской C7, но при этом очень "игривая" и контролируемая. Обкатали с дочкой на выходных вдоль моря доски. Carver - ванлав.