Stable Diffusion | Automatic 1111 | ComfiUI
СтатистикаВидеоуроки и новинки ИИ 📌 YouTube: https://youtube.com/@StableDiff 📌RuTube: https://rutube.ru/channel/28380669/ 📌 Курс "Automatic1111": https://stabledif.ru 📌 Курс "ComfyUI": https://stabledif.ru/comfyui Канал в MAX: https://max.ru/stable_dif
- Последний пост
- 14 авг.
- Последнее чтение
- 12:44
- Постов за неделю
- 1
- Всего постов
- 23
- Тип
- открытый
- Язык
- русский
- Категория
- Видео
- В каталоге с
- 13 авг.
- 1/24сутки в ленте
- 1 104
- 1/48двое суток
- 1 265
- 1/72трое суток
- 1 364
Оценка по просмотрам недавних постов: пост набирает почти всё за первые сутки.
Посты
MiniMaxH3 практический гайд, low vram, ускорение генерации, качество видео! 🎦 СМОТРЕТЬ НА YOUTUBE 🎦 СМОТРЕТЬ НА RUTUBE 🎓 Boosty: перейти 🖐Всем привет сегодня расскажу про модель MiniMax H3, покажу на что она способна, как писать prompt и как ускорить генерацию и снизить потребление видеопамяти. 🛠 MiniMax H3 - это опенсорс модель для генерации видео современного уровня, на уровне онлайн сервисов. 👌 Ее можно использовать в коммерческих целях. 🛠 LTX и Wan модели заметно слабее на фоне новой MiniMax H3. ☑️ Нам доступны две модели: - FL2VA - модель для генерации видео по подсказке, по входному изображению и по первому и конечному кадру. - Ref2VA - модель для работы с референсами. Эта модель поддерживает до 12 референсов изображений, 3 референса аудио и 3 референса видео. 👌Подсказку естественно тоже поддерживает. 🔞NSFW тоже работает из коробки. 📌Видеопамяти ест много, но она отлично распределяется с RAM и получается запустить генерацию даже на RTX 3060 12Гб с некоторыми нюансами по схеме, которые мы разберем чуть позже в схемах 🚀 ☑️ Скорость генерации медленная. 15 секундный ролик в 1 МП генерируется 450 секунд на RTX 5090 без turbo лор. С Lora будет быстрее, но качество будет хуже. Мои ресурсы: 🔥 Курс по "ComfyUI" 🔑 BOOSTY 📺 СТРИМЫ+АРХИВ 📎 MAХ \ 📎 VK
Style Selector (OreX) — обновление В Style Selector (OreX) добавлен новый функционал и 120 поз. 🔹 Добавлен масштаб превью и он сохраняется между перезапусками ComfyUI 🔹 Добавлен полноэкранный режим выбора стилей 🔹 Добавлена возможность выбора стилей из разных файлов 🔹 Добавлена кнопка выбора всех стилей файла 🔹 Добавлен режим редактирования стилей и смены их позиции в списке. JSON редактируется прямо из узла 🔹 Добавлены 120 поз для Krea2 🔹 Позы и стили для Krea2 нормально сочетаются В планах: • Добавить функцию добавления стиля из URL • Добавить вид съемки Как установить: Установите или обновите узлы Orex-nodes и добавьте узел Style Selector (OreX) Мои ресурсы: 🔥 Курс по "ComfyUI" 🔑 BOOSTY 📺 СТРИМЫ+АРХИВ 📎 MAX 📎 VK
Floating Launcher OreX — обновление Полностью переработанный лаунчер для быстрого запуска приложений. Тёмная тема, мультиязычный интерфейс, индивидуальные шаблоны оформления и монолитный EXE-файл в одной сборке. 🔹 Полностью переработано меню Settings и добавлены новые опции выравнивания и размера текста подписи. 🔹 Вынесена кнопка Settings (шестеренка). 🔹 Единое оформление для всех окон. 🔹 Каждый значок теперь можно оформить индивидуально — цвет фона, цвет текста и есть шаблоны. 🔹 Каждую вкладку теперь можно оформить индивидуально — фон и цвет текста и есть шаблоны. 🔹 Обратная совместимость: старые конфигурации без индивидуального стиля продолжают использовать общие настройки 🔹 Монолитный EXE-файл ❗️Не забывайте делать Export настроек в Settings на случай если что-то слетит. Позже сделаю авто сохранение backup в папке программы. ⏬ Скачать приложение: GitHub Мои ресурсы: 🔥 Курс по "ComfyUI" 🔑 BOOSTY 📺 СТРИМЫ+АРХИВ 📎 MAX 📎 VK
✂️ Krea2LoRACompressor — сжатие больших Krea2 LoRA Подготовил программу для создания облегчённых версий Krea2 LoRA и LoKr в формате SafeTensors. Можно выбрать степень сжатия и заметно уменьшить размер модели. 🔹 Доступны уровни сжатия: 5%, 25%, 50%, 75% и 95% 🔹 Программа удаляет целые transformer-блоки от краёв архитектуры к центру 🔹 Исходная LoRA не удаляется и не перезаписывается 🔹 Результат сохраняется рядом с оригиналом под новым именем 🔹 Есть тёмный графический интерфейс и поддержка 12 языков 🔹 Portable-сборка уже содержит Python и необходимые библиотеки 🔹 Особенно полезно для LoRA размером около одного гигабайта и больше 🔹 Сжатие не проходит без потерь: вместе с блоками удаляются тензоры, поэтому качество, детали и стабильность генерации могут измениться 🔹 Это не замена правильно выбранному factor или rank при обучении: здесь уменьшается уже готовая модель 🔹 Результат рекомендуется сравнивать с оригиналом на одинаковых prompt, seed и настройках ⬇️ Скачать Portable версию ⬇️ Репозиторий GitHub Тут примеры сжатия на больших форматах Portable распаковать и запустить RUN.bat Мои ресурсы: 🔥 Курс 🔑 BOOSTY 📺 СТРИМЫ 📎 MAX 📎 VK
🎦 СМОТРЕТЬ НА YOUTUBE 🎦 СМОТРЕТЬ НА RUTUBE 🛠 Boosty: скачать файлы со стрима 📣 Большой стрим по искусственному интеллекту где мы разбираем много нового и актуального. Будет много советов и практические применения по следующим тема: 📘 Разное 1. Презентация Powerpoint на Bionic 2. Cherry-Studio 3. Hermes - Установка и подключение локальной модели 4. Gemini Flow - Influencer - создания датасета на персонажа 5. Описание изображений 6. UI-Toolkit - Обновление и настройки 📕 ComfyUI 1. Identity Forge - создание персонажа из промпта 2. Ideogram создания датасета на персонажа 3. Krea2 - Стили 4. Krea2 - Эмоции 5. Krea2 - Постеры с текстом по референсу 6. JoyAI Image Edit - новая модель для редактирования изображений 7. Итоги стрима Мои ресурсы: 🔥 Курс по "ComfyUI" 🔑 BOOSTY 📺 СТРИМЫ+АРХИВ 📎 MAX / 📎 VK
🎦 СМОТРЕТЬ НА YOUTUBE 🎦 СМОТРЕТЬ НА RUTUBE 🎓 Boosty: перейти 🛠 Собрал масштабный узел с большой коллекцией стилей для Krea2 и Flux2 Klein. ☑️ Стили можно добавлять в избранное, чтобы не искать нужный стиль среди кучи других стилей и можно пачкой генерировать с выбранными стилями для теста моделей и схем. ☑️ Можно комбинировать стили. Один удобный узел с информативными preview сделает вашу работу в ComfyUI существенно удобнее. 👌 Узел и стили доступны бесплатно. А если нужно еще что-то интересное, то увидимся на Boosty. 🔗 Все ссылки на узлы и схемы бесплатно в описании под уроком на YouTube/Rutube. Мои ресурсы: 🔥 Курс по "ComfyUI" 🔑 BOOSTY 📺 СТРИМЫ+АРХИВ 📎 MAX / 📎 VK
🎦 СМОТРЕТЬ НА YOUTUBE 🎦 СМОТРЕТЬ НА RUTUBE 🎓 Boosty: перейти 💥LM-Studio обновилась, точнее преобразовалась в Bionic Agent. Теперь этот интерфейс может не только работать с LLM моделями, но и выполнять агентные задачи. 🛠 Что такое агентные задачи - это возможность интерфейса: работать с файлами (создавать, удалять, изменять), отправлять почту, делать посты в соц. сети, деплоить проекты в GitHub и на другие ресурсы, работать с облачными дисками и так далее. Если кратко, Agent Bionic - это LLM с руками. Узлы LM-Studio orex так же будут работать с Bionic как с LM-Studio без изменений. По умолчанию Bionic имеет доступ только к песочнице, но вы можете предоставить ему доступ и к другим директориям вашего ПК. Снести данные без разрешений он не сможет. 🛠 Это локальный интерфейс, но он может работать как с локальными моделями, так и с онлайн моделями Kimi, GLM и DeepSeek. 📎 LM-Studio Bionic: ссылка Мои ресурсы: 🔥 Курс по "ComfyUI" 🔑 BOOSTY 📺 СТРИМЫ+АРХИВ 📎 MAX / 📎 VK
🎦 СМОТРЕТЬ НА YOUTUBE 🎦 СМОТРЕТЬ НА RUTUBE 🎓 Boosty: перейти 🛠 В этом видео вы узнаете как обучать Krea2 Lora онлайн бесплатно на modelscope. 🛠 Можно обучать по несколько Lora в день без задействования ресурсов вашего компьютера. 👌Эту Lora можно протестировать сразу онлайн. 👌 В ComfyUI и Forge Neo она так же работает. 🛠 Обучать Lora можно лицу или стилю. Мои ресурсы: 🔥 Курс по "ComfyUI" 🔑 BOOSTY 📺 СТРИМЫ+АРХИВ 📎 MAX / 📎 VK
🎦 СМОТРЕТЬ НА YOUTUBE 🎦 СМОТРЕТЬ НА RUTUBE 🔥🛠 FloatingLauncherOreX — это легковесный, плавающий менеджер ярлыков и папок для ОС Windows, созданный для того, чтобы навсегда освободить ваш рабочий стол от беспорядка. 👌🛠Программа позволяет удобно структурировать софт, директории и быстрые заметки по вкладкам, обеспечивая молниеносный доступ к нужным инструментам в один клик. ❗️🛠 FloatingLauncherOreX распространяется бесплатно. 📎 Ссылка на программу в описании под видеообзором! Мои ресурсы: 🔥 Курс по "ComfyUI" 🔥 Курс по "AUTOMATIC" 🔑 BOOSTY 📺 СТРИМЫ+АРХИВ 📎 MАХ / 📎 VK
KREA2 text 2 image, Edit, Controlnet, style transfer 🎦 СМОТРЕТЬ НА YOUTUBE 🎦 СМОТРЕТЬ НА RUTUBE 🎓 Boosty: перейти 📣 Сегодня поговорим про модель Krea2. Это одна из лучших моделей для генерации изображений в open source на сегодня она, уступающая только более тяжёлой Ideogram4. 👌 Krea2 это text 2 image модель, но благодаря его гибким возможностям к обучению на этой модель можно также делать и редактирование изображений. 🚀 Потребление видеопамяти в районе 15 Гб, но модель отлично работает на 12 Гб - модель доступная для пользователей! 🔞NSFW Lora и схему под нее приложу на Boosty бонусом. Мои ресурсы: 🔥 Курс по "ComfyUI" 🔥 Курс по "AUTOMATIC" 🔑 BOOSTY 📺 СТРИМЫ+АРХИВ 📎 MАХ / 📎 VK
🎦 СМОТРЕТЬ НА YOUTUBE 🎦 СМОТРЕТЬ НА RUTUBE 🎓 Boosty: перейти 🛠🎭 Krea2 отлично подходит для обучения LORA на лицо или стиль ✅🔥 Я подготовил Portable Ostris UI-Toolkit на последнем окружении (бесплатно можно скачать по ссылке в описании под уроками) и записал этот подробный ролик с хорошо подобранными настройками для обучения лицу Lora ✅ Так же собрал рабочий процесс для пакетного описания изображений и их конвертации и сжатия на специально написанных для этого узлах. 🚀 Обучение Lora на RTX 5090 занимает 30 мин, это очень быстро. Training должен запустится от 12 Гб VRAM с выгрузкой слоёв модели. Мои ресурсы: 🔥 Курс по "ComfyUI" 🔥 Курс по "AUTOMATIC" 🔑 BOOSTY 📺 СТРИМЫ+АРХИВ 📎 MAX / 📎 VK
⚙️ Обновил узлы ComfyUI-GigaAM - Audio to Text ❌ Если кто пользовался свежими сборками ComfyUI и деклассировал свой torch, то теперь эта жесть исправлена. Проверено на torch 2.12. Последнее окружение ComfyUI на сегодня. 🤖 Установка: Manager -> Install via git Url -> https://github.com/orex2121/ComfyUI-GigaAM.git После этого устанавливаем зависимости, запустив: custom_nodes\ComfyUI-GigaAM\INSTALL_DEPS.bat 🔗 Простенький workflow тут: ССЫЛКА 📼 Пост с переводчиком видео на этой штуке тут: ССЫЛКА
🎦 СМОТРЕТЬ НА YOUTUBE 🎦 СМОТРЕТЬ НА RUTUBE 🛠 Поговорим про обновленную технологию Scail 2, для переноса движения с видео. Scail 2 может работать с длинными видео❗️ 🎓 BOOSTY: перейти Что может эта модель: ✅ Scail 2 может переносить движение в новую сцену. Вы загружаете видео и изображение и изображение начинает повторять действия, которые происходят на видео. В итоге у вас получается полностью новая сцена. ✅ Вы можете заменять только персонажей в исходном видео, сохраняя фон в оригинале. ✅ Вы можете изменять стиль оригинального видео до момента смены объектов на этом видео. ✅ Модель Scail 2 основана на модели Wan 2.1, но потребление видео памяти всё же немного выше. Около 20Гб Vram потребляет генерация в 0,6 МП и около 24Гб в разрешении 0,8-1 МП. ❗️Но на 16Гб VRAM эти схемы точно работают. Время генерации 10 сек ролика в разрешении 0,6 МП на RTX5090 занимает около 150 сек. В разрешении 0,8МП около 200 сек. Мои ресурсы: 🔥 Курс по "ComfyUI" 🔥 Курс по "AUTOMATIC" 🔑 BOOSTY 📺 СТРИМЫ+АРХИВ 📎 MАХ / 📎 VK
🎦 СМОТРЕТЬ НА YOUTUBE 🎦 СМОТРЕТЬ НА RUTUBE 🎓 Boosty: перейти 💥Boogu-Image — это универсальная фундаментальная модель для генерации и редактирования изображений. 🛠 Технологически Boogu выделяется тем, что это _единая архитектура_, которая изначально тренировалась не только на генерацию с нуля (Text-to-Image), но и на глубокое понимание структуры изображения для его редактирования. Лицензией Apache 2.0. 🛠 Boogu-Image представлена в 3х моделях: - Boogu Image Base - Boogu Image Turbo - Boogu Image Edit ✅ Преимущества: - Хорошо работает с текстом, в том числе и на русском языке - Отлично понимает сложные, многосоставные запросы - Хорошо работает с разными стилями - Низкое потребление VRAM (FP8 13.5 Гб и GGUF Q4 10.5 Гб) Мои ресурсы: 🔥 Курс по "ComfyUI" 🔥 Курс по "AUTOMATIC" 🔑 BOOSTY 📺 СТРИМЫ+АРХИВ 📎 MАХ / 📎 VK
🔥 Перевод больших видео и транскрибация русской речи с GigaAM 🎦 СМОТРЕТЬ НА YOUTUBE 🎦 СМОТРЕТЬ НА RUTUBE 🎓 Boosty: перейти ☑️ Это многофункциональная схема для перевода видео на различные языки. ☑️ Схему можно использовать как транскрибатор аудио в текст. 🛠 Модель для транскрибирования аудио GigaAM - это модель от российских разработчиков Giga которая обучалась на Русском языке и с русской речью работает очень, хорошо ❗️, а так же быстро и с низким потреблением VRAM (в пределах 8Гб). 🛠 На выходе вы можете получать текст с таймингами с разными разбивками по словам или предложениями, а так же делать диаризацию говорящих (разделение по говорящим). В схеме используются LLM модели для корректировки транскрибированного текста и перевода. Чтобы LLM хватило контекста, текст разбивается на чанки (части). 🛠 Загрузчик аудио/видео специально разработан под эту схему, чтобы переваривать многочасовые аудио/видео. Озвучка переведенного текста может быть сделана на любой TTS модели, в этой схеме CosyVoice3 и OmniVoice3. Причем озвучку можно делать в режиме Multi Speak. 🛠Для склейки видео и новой аудио дорожки специально разработан для больших видео файлов - работает моментально. 👌Обязательно пользуйте меню, так как видео очень большое. Мои ресурсы: 🔥 Курс по "ComfyUI" 🔥 Курс по "AUTOMATIC" 🔑 BOOSTY 📺 СТРИМЫ+АРХИВ 📎 MAX / 📎 VK
🔥 Перевод больших видео и транскрибация русской речи с GigaAM 🛠 Многофункциональная схема 🎦 СМОТРЕТЬ НА YOUTUBE 🎦 СМОТРЕТЬ НА RUTUBE 🎓 Boosty: перейти
🔥 Gemini Pro - это мощнейшая LLM модель, на уровне Chat GPT и Grok, которая отлично подходит для написания кода и решения различных ошибок. 🛠 Nano Banana Pro мощнейшее решение для генерации и редактирования изображений. 🛠 Gemini Omni видео нейронка для редактирования видео. ☑️ Доступ к Gemini Pro с комфортными лимитами можно приобрести за 400-700 руб (цены меняются) на 18 месяцев. 👌В придачу получаете 5 Терабайт Google диска на 18 мес. И 1000 токенов для генерации видео на каждый месяц из 18. По Nano Banana никогда не доходил до лимитов, но они скорее всего есть. 🎓📎 Boosty: подробный урок
🎦СМОТРЕТЬ НА YOUTUBE 🎦СМОТРЕТЬ НА RUTUBE 🎓Boosty: перейти 👌В этом видео разбираем свежий релиз — Ideogram 4.0. Разработчики пошли по правильному пути: перевели модель на открытые веса (open-weight, 9.3B параметров) и заточили её под реальные ❗️рабочие задачи, а не просто под красивые арты. ✔️Посмотрим на примеры генераций, проверим, насколько точно модель слушается сложных структурных промптов, и стоит ли внедрять её в свой пайплайн. 📌 Что обсудим в видео: ☑️ Честное 2K-разрешение: генерация идет сразу в высоком качестве (до 2048px). Без костылей и сторонних апскейлеров — сразу готово к печати. ☑️ JSON-промптинг: полный контроль над композицией. Теперь можно жестко задавать координаты объектов (bounding boxes) и цвета в HEX-кодах. ☑️ Лучшая генерация текста: нейросеть отлично понимает мультиязычные надписи, сложные шрифты, плакаты и многострочные блоки. ☑️ Открытая архитектура: модель доступна в ComfyUI. Мои ресурсы: 🔥 Курс "ComfyUI" 🔥 Курс "AUTOMATIC" 🔑 BOOSTY 📺 СТРИМЫ 📎 MAX/ 📎VK
Видео является дополнением к прошлому видео: • PID Upscaler - Быстро и хорошие детали • 👌🔥Выяснилось, что PID не хорошо работал на пропорциях отличных от 1:1, но в новой схеме я исправил это и теперь вы на любых пропорциях изображений будете получать отличные результаты по апскейлу. 🎓 Boosty: обновленный пост 🎦 СМОТРЕТЬ НА YOUTUBE 🎦 СМОТРЕТЬ НА RUTUBE
🎦 СМОТРЕТЬ НА YOUTUBE 🎦 СМОТРЕТЬ НА RUTUBE 🎓 Boosty: инструкции 😱 Надоело, что ваши нейросети "мылят" мелкие детали, а связка из генерации и последующего апскейла занимает кучу времени и видеопамяти? 🚀 Встречайте PID для быстрого и качественного апскейла изображений. PiD расшифровывается как Pixel Diffusion Decoder. ✅ Это новейшая технология от NVIDIA, которая берет на себя роль декодера и объединяет перевод в пиксели и апскейл в один процесс. ☑️ Потребление VRAM от 12 Гб на модели 1024 в 4096 пикселей. Скорость у меня на 5090 около 8 секунд на такой апскейл. 👌Заслуживает внимания именно PID Upscaler. Мои ресурсы: 🔥 Курс по "ComfyUI": ссылка 🔥 Курс по "AUTOMATIC" 🔑 BOOSTY 📺 СТРИМЫ+АРХИВ 📎 MAX / 📎 VK