tgindex
DM
@ai_generatрусский

DmitriyM Media Art, AI, Dev ТСХР мультимедиа 🛸 Вопросы и предложения: https://t.me/mantunamochil

Последний пост
11 авг.
Последнее чтение
13 авг.
Постов за неделю
1
Всего постов
31
Тип
открытый
Язык
русский
В каталоге с
13 авг.
Подписчики
227
0 за сутки
Сутки
 
Неделя
 
Месяц
 
Просмотров на пост
84
31 постов
Вовлечённость
37,0%
к подписчикам
Постов в день
0,1
всего 31
Упоминаний
0
каналов
Охват размещения
оценка
1/24сутки в ленте
36
1/48двое суток
41
1/72трое суток
44

Оценка по просмотрам недавних постов: пост набирает почти всё за первые сутки.

Посты

  • видео или голосовое, без подписи

  • 7 авг.6222из cgevent

    Будущее Минимакса Красавчики. Пришли на реддит и бахнули огромную АМА сессию. Ответили на тьму вопросов. https://www.reddit.com/r/StableDiffusion/s/O0rqbtpxzn Для староверов и ADHD: Tldr: 2K Regenerate - будет open-source и, судя по формулировке команды, относительно скоро; Sparse Attention - первая версия тоже “near term”; официальный 4/8-step рассматривается, но без обещаний по срокам; отдельная image-модель из линии H3 - в разработке. Для нормисов : Самое главное: нативный H3-Regenerate-2K действительно откроют. Это не обычный апскейлер и не «второй прогон тем же H3». Команда пояснила за отдельный latent-space DiT regeneration checkpoint, который генерирует на более высоком разрешении, используя результат базовой модели как дополнительный контекст. Часть референсов также подаётся в повышенном разрешении. Модуль сейчас дорабатывают по скорости и качеству именно для локального использования, поэтому точной даты нет, но на отдельный вопрос «аскороли?» разработа ответили буквально: “yep, not very far”. По Sparse Attention ещё наряднее. H3 не использует MSA из MiniMax M3, как многие предполагали. Их схема ближе к MoBA-style block selection: соседние visual tokens сильно коррелируют, поэтому MiniMax делает mean-pooling блоков и по этому представлению определяет важные блоки, без отдельного обученного indexer. Сейчас 3D sparsification применяется только к video tokens, потому что именно они съедают большую часть sequence. Image/text tokens пока изучаются как следующие кандидаты. Кто нихрена не понял - первую открытую реализацию sparse attention обещают в ближайшее время, причём сначала в консервативной конфигурации с целью получить ускорение без заметной потери качества. (Это круто, скорость - главный минус) С 4/8-step H3 всё чуть менее нарядно. Выпущенный checkpoint уже содержит CFG distillation, плюс на финальной стадии обучения использовалась дополнительная стратегия, благодаря которой модель и сейчас умеет несколько снижать число inference steps. Но это не полноценная step-distilled Turbo-модель. MiniMax продолжает исследовать distillation и прямо рассматривает официальный 4-NFE или 8-NFE вариант, однако честно пишет, что не может пообещать его в ближайшее время. То есть community Turbo LoRA пока останутся актуальны. Ещё одна неожиданно прельстивая новость - картинки!! На вопрос про настоящий Text-to-Image / single-frame H3 MiniMax ответил, что они уже делают отдельную image model из общего предка H3 (круто звучит) и рассчитывают выпустить её для сообщества. То есть нынешние хаки «сгенерировать 5 кадров и выдернуть первый» действительно временные - полноценная H3 image-модель официально в разработке. Из архитектурных деталей команда также поъяснила за prompt adherence. По их словам, дело не в каком-то одном хитром модуле, а в очень широком и разнообразном наборе данных и задач, обученных на общей масштабируемой архитектуре. Иными словами, меньше магических костылей под отдельные задачи, больше общего multimodal training. (Gemini Omni нервничает и готовится апдейтнуться) За цензуру не говорили. Но видео в шапке говорит само за себя. Красавцы, чо. @cgevent

  • 🎬 Seedance 2.5 держит до 50 референсов за раз 50 картинок, клипов и аудио одновременно, этого хватает, чтобы собрать толпу в 3000 человек на перекрестке Сибуя с сохранением деталей у каждого. 🧠 Следи за AItoolz — новые модели для видео #Seedance #ByteDance

  • 3 авг.5922из Cbpub

    В ЕС с 1 августа действует штраф до €150 млн (≈1,5 млрд. рублей) за контент без пометки «создано ИИ», сообщили в Еврокомиссии. Такая маркировка теперь обязательна для ИИ-фото, видео, аудио и некоторых текстов. Закон касается компаний, СМИ, блогеров и всех, кто использует нейросети в работе.

  • 2 авг.581из ai_newz

    Нейродайджест за неделю (#125) LLM - Веса Kimi K3 — Moonshot выложили веса крупнейшей открытой модели на 2.8T параметров (104B активных). Для локального запуска потребуется система с 2 ТБ памяти. - Снижение цен на GPT 5.6 — OpenAI уронили цены: Luna подешевела в 5 раз ($0.2/$1.2), Terra — на 20%. Для флагмана Sol запустили Fast-режим (в 2.5 раза быстрее за 2x прайс). - DeepSeek V4 Flash — Свежая версия 0731 в API обходит GLM 5.2 и совместима с Codex, оставаясь дешевле Luna и по токенам и в пересчете на таск. Релиз V4 Pro ждут в начале августа. - Astra от OpenAI — Новая мультиагентная модель доказала 10 открытых математических задач при помощи Lean, потратив менее $2000 на токены по расценкам Sol. Генеративные модели - Seedance 2.5 — Генератор видео от ByteDance научился делать ролики до 180 секунд, получил интеграцию с Blender и точечное редактирование, но стал самым дорогим на рынке ($6 за 30 сек). > Читать дайджест #124 #дайджест @ai_newz

  • 2 авг.571из ai_newz

    Нейродайджест за неделю (#124) LLM - Opus 5 — Новая модель Anthropic обгоняет Fable 5 на нескольких бенчмарках. Доступна по API за $5/$25 — вдвое дешевле Fable. - Gemini 3.6 Flash — Минорный апдейт от Google: чуть дешевле ($7.5 вместо $9 за выход), а Flash Lite наоборот подорожал вдвое по стоимости за таск. Генеративные модели - FLUX 3 — Black Forest Labs наконец анонсировали видеомодель. Одна модель на картинки, видео и аудио. - Clean Plate для LTX-2.3 — Lightricks выкатили LoRA, которая вычищает людей и транспорт из видео. Прочее - GTM Lead в GenPeach AI — Ищу человека на founding GTM роль в нашем стартапе. > Читать дайджест #123 #дайджест @ai_newz

  • видео или голосовое, без подписи

  • 31 июл.702из neyr0graph

    Час назад несколько крупных платформ типа RunWay, Magnific выложили видео, что вот-вот коминсун Seedance 2.5

  • 31 июл.7322из neurogen_news

    [Open-source] Kimi K3 Уверенно конкурирует с Claude Fable 5, GPT-5.6 Sol, Claude Opus 4.8 на большинстве бенчмарков, а по агентным задачам, работе с документами и видео лидирует MoE-гигант с окном контекста в 1 миллион токенов, нативным зрением и агентными возможностями уровня фронтира 2.8T параметров, активных параметров 104 Экспертов всего / активных, 896 / 16 (+ 2 shared) K3 держит длинные инженерные сессии с минимальным контролем человека: навигация по огромным репозиториям, оркестрация терминальных инструментов, оптимизация GPU-ядер, разработка компиляторов, vision-in-the-loop геймдев, CAD и даже проектирование чипов Единая модель понимает текст, изображения и видео в одном контексте на 1M токенов HuggingFace Попробовать Пост про К3

  • 31 июл.46из GreenNeuralRobots

    Seedance 2.5 Глобальный запуск. Появился на Dreamina, Open Design, должен появиться на Pika Короче, ищите там где у вас есть подписка #t2v #seedance25

  • Gaussian Splatting plugin by KIRI Engine KIRI, известные приложением для фотограмметрии, выпустили плагин к AfterEffects для работы с гауссианами #AE #gaussian #plugin

  • 31 июл.46из GreenNeuralRobots

    Превью вдеогенератора FLUX 3 доступно в Hermes на ближайшие 48 часов (уже чуть меньше) Спасибо @m_franz #t2v #giveaway

  • видео или голосовое, без подписи

  • 31 июл.50из GreenNeuralRobots

    LTX-2.3 22B IC-LoRA Relight (Sun Direction) Лора #ltx23 для релайтинга экстерьерных видео. Меняет направление и жёсткость света в соответствии с шариком направления света в углу кадра #lora #relighting

  • 20 июл.832из cryptoEssay

    После нескольких дней тестов Кими, ситуация перестаёт быть томной: Трамп планирует запретить или ограничить использование модели компаниями в Штатах Модель заняла первое место на агентском бенчмарке Colibrix по цене/качеству Она же значительно уделала Sol и Fable на приватном лигал бенче от Harvey У Moonshot (производителя модели) закончились GPU и они приостановили регистрацию новых пользователей Выводы: 1. Дистилляция такое не дает 2. GPU и физические ресурсы важнее моделей 3. Разрыв лаб с OSS меньше, чем казалось

  • 20 июл.805из vibecoding_tg

    Инженер Google Кормак Брик объяснил, как дообучить крошечную LLM прямо на телефоне и повысить её точность с 46% до 90%. Схема такая: 1. Выбрать Gemma 270M. 2. Сгенерировать синтетические данные для своей задачи. 3. Дообучить модель с помощью LoRA. 4. Квантизировать её до int4. 5. Развернуть на Pixel и получить скорость до 2000 токенов в секунду. Именно благодаря такому циклу модель на 270 млн параметров может превзойти модель на 70 млрд параметров в конкретной задаче - при этом полностью работать офлайн прямо у вас в кармане. > ютуб

  • Жать клод вам дам(с) Сегодня ночью антрорик обнулили недельные лимиты и открыли Fable. Недельную квоту уже не успеваю физически отработать - не даёт лимит 5ти часовой сессии. будильник на 09:51. #Fable #agents #сlaude

  • "фраза вырвана из контекста"

  • Кто что успел интересного сделать на Fable?

  • 13 июн.1832из data_secrets

    Fable – все 🤷‍♂️🤷‍♂️🤷‍♂️ Правительство США «из соображений национальной безопасности» буквально приказало Anthropic закрыть доступ к Mythos и Fable для всех иностранных граждан. Включая тех, кто находится в США. Включая даже иностранных сотрудников Anthropic. Anthropic в этой ситуации поделать нечего. Они, конечно, принесли извинения, но доступ к моделям уже у всех отрубили. Мы приносим извинения за это нарушение для наших клиентов. Мы считаем, что это недоразумение, и работаем над тем, чтобы восстановить доступ как можно скорее. Без комментариев. www.anthropic.com/news/fable-mythos-access

DM — tgindex