Сеньор генеративщик 🏴☠️
СтатистикаМы сразу решили дать работу нейросетям, чтобы когда они захватят мир, считали нас своими друзьями 🏴☠️ Делюсь применением и лайфхаками ИИ в контенте. Автор → @wowkozin Чат канала: https://t.me/+HHfbGB34SAE4ZGIy
- Последний пост
- 12 авг.
- Последнее чтение
- 20:37
- Постов за неделю
- 1
- Всего постов
- 21
- Тип
- открытый
- Язык
- русский
- Категория
- Технологии
- В каталоге с
- 13 авг.
- 1/24сутки в ленте
- 493
- 1/48двое суток
- 564
- 1/72трое суток
- 609
Оценка по просмотрам недавних постов: пост набирает почти всё за первые сутки.
Посты
Новый сиденс лайк конечно
Сеньор генеративщик 🏴☠️ pinned a photo
Поздравляю, вы в канале генеративщика Меня зовут Максим, в настоящий момент работаю Ai-лидом в крупной студии графики ADService. Мы делаем много большой рекламы, там, где нужна компьютерная графика. Хотел сказать "внедряем", но этот этап уже пройден. Сегодня нейронки пронизывают все этапы создания рекламы — начиная от самых "пристрелочных" концептуальных кадров, тримтментов, раскадровок, нейроматиков, заканчивая генерацией конкретных финальных кадров, которые стоят рядом со съемочными, а также созданием full-AI-роликов. Внутри еще много всего: Ai-запчасти, концепты, заплатки, тут заменить человечка, тут убрать или покачать деревья, здесь сделать фон, и многое-многое другое. В основном, мы работаем с крупными клиентами, такими как ВТБ, Т2, ОЗОН, Avito, Т-Банк, Ростелеком и др., продакшенами и агентствами. Среди моих клиентов также Билайн, Москвариум, СТС, Москвариум и др. В последнее время не так много времени на создание творческих видео (сказано с болью и ностальгией), но стараюсь приходить с рабочими лайфхаками или интересными сервисами, которые обнаруживаем в работе. Из нейросетей используем все доступные на сегодня генераторы изображений, видео и 3д. Чаще всего используется: kling, nano banana, gtp-image, seedance. У нас в канале есть чат, он не особо активный, но там можно спросить совета или потрепаться. Состою во многих профильных чатах каналов, там мы с вами могли видеться раньше) Что тут из последнего интересного: ▪️ Метод "Скетча" для перегенрации изображений искаженных после нано-бананы, либо для адресной перегенерации кадров. Скринкасты. ▪️ Пост с оплатой зарубежных сервисов (в комментах накидали годноты). ▪️ Тут можно оставить инфу о себе, вдруг у нас будет не хватать рук, а вы как раз ждете новых проектов) ▪️ Скринкаст по работе в Kling Elements. До сих пор актуален) Мой принцип в генерации: нет невозможного, есть недостаточно попыток. Стараюсь руководствоваться логикой и люблю последовательное решение задач, практикую итерационный подход. Стараюсь смотреть на решение задач широко и не зацикливаться на одном инструменте, в котором "не получилось". Вайбкожу в тихоря, как и все) Если бы исчезла необходимость зарабатывать и можно было заниматься любым делом — я бы генерил. Пишите в комментах, чем занимаетесь, что прикольного делаете?) Для связи — @wowkozin
думаю пора закреп обновить, не пугайтесь
видео или голосовое, без подписи
Как упоминал вчера, метод скетчей имеет очень широкое применение. Например, так можно очень просто зафиксировать нужную позу в кадре и создать такой кадр хоть с 100 людьми, они будут в этой же позе. Или когда нужно заменить одну деталь в кадре, но чтобы она сгенерилось не замыленной. Или еще 100500 случаев применения) Пайплайн такой: 1️⃣ Генеративно меняем часть кадра на скетч. Фиксируем в нем детали / или наоборот не учитывем их, фиксируем позу / положение в кадре, все что нужно перенести в следующий кадр. 2️⃣ Генерим с вложением с уточнением замены именно части кадра, которая нарисована скетчем. 3️⃣ Не забываем использовать исходный кадр как реф по областям, которые не подверглись изменениям и при необходимости совмещать лучшие варианты в фотошопе. Я прям радуюсь, как это облегчает жизнь, обычно генеришь человека в стиле "замени этого на этого", то поза не та, то детали переймет лишние, то еще что. Так уходят часы попыток и куча токенов в расход. Или делаешь просто двумя тремя действиями и готово)
видео или голосовое, без подписи
видео или голосовое, без подписи
видео или голосовое, без подписи
Методы восстановления кадров после редактирования через Nano Banana Хорошая новость — Nano Banana классно генерит изображения, плохая — редактирует она их мягко говоря, не очень 😬 После первой перегенерации теряется свет и цвет, а на третьей превращается в ужасное мыло. Все текстуры, объекты и лица плывут как тапки в огороде после дождя. Закинуть кадр взад в банану "а ну повысь качество!" получается не очень. Генеративщики в курсе про этот бич, побеждать его не просто. Но я придумал как) Делюсь рабочими способами, которые каждый день использую. Во вложении скринкасты — как восстанавливать качество через скетчи, GPT-Image, Nano Banana (спойлер — толку нет). Работая постоянно с кучей правок от клиентов, однажды допер до прикольного метода перегенеривания кадра через скетчи. На простых кадрах он работает буквально за две тычки (особенно, если есть вложения, с которыми генерился кадр до изменений), со сложными чуть дольше. Есть ощущение, что говорить про его применение можно как минимум целый день, а не час. Менять ракурсы, впиливать объекты и все такое. Давно хотел поселить это зерно про скетчи, оказалось, очень универсальная история. Приятного просмотра. Старался особо не сокращать басню, чтобы показать какой-то кусочек своего образа мыслей. Качество видео пришлось чуть даунгрейднуть, чтобы вес не зашкаливал, но на пояснение способов это не влияет. Лучше способов чем эти, и еще заплаточной генерации, пока не придумал. Приятного генерения.
Наконец-то дошли руки записать скринкаст с методами по восстановлению кадров после изменений в нано банане. Очень давно собирался, и вот последний день отпуска — чем не дедлайн? Дальше будет некогда) сейчас gpt поймет как их сжать, чтобы весили не триллион мб, выложу
Такие кадры на изи делает без перешарпов своих (но с магическими тремя словами)
видео или голосовое, без подписи
видео или голосовое, без подписи
видео или голосовое, без подписи
видео или голосовое, без подписи
Боремся с артефактами GPT-Image 2 Новый гпт имейдж крутой! В отличие от прошлой модели, этот сразу встал рядом с бананой в рабочие пайплайны. — понимает лучше запросы на смену ракурса / композиции — делает по 10 опций за раз (на тарифе "pro") — с легкостью сохраняет стиль, продолжая серию Однако, накидывет свои странные мелкоячеистые текстурки, делает перешарп, это видно и это напрягает. И теперь гпт-шные генерации видно за версту. Собственно, как и раньше — прошлые были желтые, теперь с какими-то резкими текстурками ¯\_(ツ)_/¯ Вот к чему я пришел сейчас в борьбе с этими артефактами: ▪️ Лучше всего работает методика "продолжения видео" Идея в том, чтобы дать нейросети отправную точку по стилю. Возьмем любой скриншот из классной рекламы или фильма (или из нашей же рекламы из бананы) как отправную точку. Дальше прикладываем необходимые вложения — людей / предметы и тд, пишем полноценный запрос на кадр. Он цепляется за приложенный стиль и продолжает его, что существенно снижает типичные артефакты в выдаче. Если вы прям генерите реально следующие ключевые кадры для видео на основе уже готовых, и они не из GPT-Image, вообще проблем быть должно 0. Если с чужими кадрами, важно лишний раз уточнить, что мы не должны видеть в кадре (объекты с референсов). ▪️ Неплохо работает методика "референсы по стилю и вайбу" Метод похож на предыдущий, только наряду с нашими вложениями людей / предметов и тд мы прикладываем референсы по стилю и вайбу (те же скриншоты / кадры из крутых видео), уточняя в запросе, чтобы использовал их как соответствующие референсы. ▪️ Совсем наскоряк — проговариваем, что не хотим получить. Но если уж совсем на бегу, даже если просто уточнить в запрете "перешарп" и накидывание "странных текстур", то и с этими магическими словами результат будет лушче. —— По вложениям: 1 — сильный перешарп, 2 — уже поменьше, 3 — еще поменьше, 4 — более cinematic, но не ушло до конца. 5 — больше уточнений, еще лучше. Видимо, кадры с большим количеством мелких объектов / текстур не самая сильная сторона этой нейросети сейчас. Это сложный пример, какой-нибудь крупнячок или там предметный кадр гпт делает на раз. Также, важно не лениться прописывать в запросе все важные моменты: что происходит в кадре, кто где расположен и чем занят, обязательно — чего быть не должно, что запрещено делать. Я поленился в этом тесте, потому что он про другое — посмотрите, как меняется результат от уточнений и вложений. Как сами это побеждаете? Делитесь лайфхаками еще тесты в комменты покидаю Сеньор генеративщик скоро вернется с еще одной интересной штучкой
угадайте бренд
видео или голосовое, без подписи
видео или голосовое, без подписи