Ai Новости нейросети | Технологии ИИ
СтатистикаПо вопросам: @R4d0stb
- Последний пост
- 31 мая 2025 г.
- Последнее чтение
- 12:06
- Постов за неделю
- 0
- Всего постов
- 57
- Тип
- открытый
- Язык
- русский
- Категория
- Технологии
- В каталоге с
- 13 авг.
- 1/24сутки в ленте
- —
- 1/48двое суток
- —
- 1/72трое суток
- —
Оценка по просмотрам недавних постов: пост набирает почти всё за первые сутки.
Посты
БЕСКОНЕЧНЫЙ ИИ-агент flowith теперь доступен ВСЕМ юзерам — у него вообще нет ограничений на время работы и контекст. Освежим память: • Flowith Neo обрабатывает БЕСКОНЕЧНОЕ количество задач одновременно — кодит, пишет тексты, анализирует данные, ищет инфу в сети или дизайнит. • Все таски варятся БЕЗ вашего участия — можете пойти пить кофе. • Контекст каждой задачи — сумасшедшие 10 миллионов (!) токенов, а количество шагов достигает сотен тысяч. Пробуем прямо сейчас и без инвайтов — здесь.
видео или голосовое, без подписи
видео или голосовое, без подписи
Veo 3 — новая лучша модель для генерации видео Похоже, новая SOTA для видео. Кроме видео может генерить ещё и звуки, в том числе и диалоги! Все видосы в посте были сгенерены чисто через Veo 3. Будет доступна уже сегодня. 👉 ДОСТУП к каналу #нейросети #технологии #ии #нейросеть
видео или голосовое, без подписи
видео или голосовое, без подписи
видео или голосовое, без подписи
видео или голосовое, без подписи
Hunyuan Image 2.0 Tencent выкатил генератор картинок 2.0 Генерит мгновенно! Высокая реалистичность. Dual-Canvas Studio - редактор с холстом позволяет смешивать слои. Как пользоваться - непонятно, все на китайском. Для начала надо войти по имейлу. Вот куда-то ткнул, сделал котика. Первая картинка с котиком - моя, просто по запросу Cat, непонятно новой моделью или старой. Вообще выглядит впечатляюще #text2image #realtime #imageediting
MoviiGen 1.1 Файнтюн Wan 2.1 с заявкой на кинокачество, видео по тексту. 720P и 1080P Должно работать с любым родным Wan 2.1 t2v вокрфлоу есть GGUF #text2video
видео или голосовое, без подписи
Wan2.1-VACE, All-in-One Video Creation and Editing model WAN релизнули код и веса модели создания и редактирования видео. Прежде была опубликована превью модель 1.3B Теперь же доступны 1.3B и 14B - видео по референсу - видео по видео - видео по видео с маской Гитхаб Веса API Ждем на wan.video 👉 ДОСТУП к каналу #нейросети #технологии #ии #нейросеть #text2image #ComfyUI #workflow #text2image #ComfyUI #workflow #text2video #video2video #personalization #videoediting #referencing
видео или голосовое, без подписи
ComfyUI-DreamO Подвезли #ComfyUI враппер персонализатора-кастомизатора изображений #personalization #referenceing #tex2image
TaylorSeer: From Reusing to Forecasting: Accelerating Diffusion Models with TaylorSeers Ускорение генерации FLUX, HunyuanVideo, Wan, HiDream "в 5 раз" (на самом деле вдвое) с портерей качества меньше чем у Teacache Код ComfyUI #optimization #ComfyUI
FramePack_with_Video_Input Форк FramePack, принимающий на вход видео и продолжающий его. На примере первые 3 секунды видео - исходник, дальше - генерация FramePack Ветка на официальном FramePack #videoextension #video2video
FlexiAct: Towards Flexible Action Control in Heterogeneous Scenarios Оживлятор персонажей по образцу движения от Tencent. Перенос движения на картинку. На основе CogVideoX-5B Код Веса #characteranimation #image2video #motion2video
ACE-Step: A Step Towards Music Generation Foundation Model Генератор музыки в опенсорсе? базовая модель, пригодная для дальнейшего файнтюна. Мультиязычный, есть русский! Помимо собственно генерации музыки по тексту, умеет делать вариации, смену пола вокалиста, замену слов, замену музыкальных фрагментов. Обещают лоры с контролнетами, генерацию стемов (отдельных партий), вокал по готовому аккомпанементу Звучит пока не очень, надеемся на пластичность в файнтюне Код Демо Веса #music #text2music #musicediting
видео или голосовое, без подписи
SuperEdit: Rectifying and Facilitating Supervision for Instruction-Based Image Editing Редактор картинок текстом от ByteDance Авторы обнаружили, что разные шаги генерации играют разные роли в генерации изображений, независимо от промта. В частности, диффузионные модели фокусируются на (а) глобальном макете на ранних стадиях, (б) локальных атрибутах объекта на средних стадиях, (в) деталях изображения на поздних стадиях и (г) стиле изображения на всех стадиях выборки. Это вдохновило их на использование VLM. На схеме видно что ее используют вместо CLIP Код #imageediting