Hallucinations | Артём Орлов
СтатистикаИнновации начинаются там, где заканчивается предсказуемость. Здесь про ИИ, emergent-технологии и продукты. Для связи @temgaOrlov Директор по инновациям Wink
- Последний пост
- 2 авг.
- Последнее чтение
- 17:07
- Постов за неделю
- 0
- Всего постов
- 20
- Тип
- открытый
- Язык
- русский
- Категория
- Технологии
- В каталоге с
- 12 авг.
- 1/24сутки в ленте
- 54
- 1/48двое суток
- 61
- 1/72трое суток
- 66
Оценка по просмотрам недавних постов: пост набирает почти всё за первые сутки.
Посты
Геометрия сильнее декорации Hermes Agent — открытый AI-агент от Nous Research. Мощный, расширяемый, с поддержкой десятков платформ. Но он спроектирован в мире, где OpenAI, Anthropic и Telegram работают из коробки. В 1920-е годы Россию отрезали от Европы — но Малевич, Татлин, Лисицкий и Родченко не остановились. Они построили авангард — язык, который Европа потом учила. Изоляция стала материалом, а не приговором. Сегодня ограничений снова много, но останавливаться никто не собирается. Этот репозиторий — набор плагинов для Hermes Agent: провайдеры моделей, мессенджеры, генерация изображений. Открытый код, MIT. https://github.com/temga/hermes-ru-ecosystem О чем вообще это, читайте постом выше. Галлюцинации Артёма
видео или голосовое, без подписи
Русский Hermes и Маяковский на тарелке. Новая рубрика — «вайбово вайбкожу». Я не только продукты пилим, но и люблю в классных местах потусоваться. Сегодня — Чтиво Дом. Оттуда задачи агенту ставил. Давно не писал. Nous Portal меня забанил — видимо, зря хвалил. $40 там и осталось на аккаунте. Но съезжать с Гермеса я не собирался: не знаю лучшего вендор-нейтрального решения, которое можно как личного ассистента использовать. Алиса и Гига ангажированы, DeerFlow больше в энтерпрайз, OpenClaw до сих пор нестабильный. Поэтому сел и начал всё переводить на локально доступные инструменты. Делал это через Koda Code — с ребятами сейчас пилот на работе запускаем. Подключил туда RouterAI, NeuralDeep. Плюс у меня уже был плагин для Max. Решил собрать всё в одну кучу — сделал единый репо с установкой в одну строку, чтобы про пользовательский опыт не забывать. Теперь можно быстро и просто поднять агента сразу с инструментами, доступными из России. Буду наполнять по мере необходимости, ну или кто-то туда PR отправит. Напомню на всякий: я не разработчик. Последний раз писал код по работе 12 лет назад, поэтому с радостью приму все доработки со стороны) А на тарелке в Чтиво Доме мне попалась цитата Маяковского — и захотелось, чтобы этот репозиторий стал авангардным. Ссылка следующим сообщением. Галлюцинации Артёма
Clean Plate IC-LoRA для LTX-2.3 Редко выходят модели для серьезного прода и постобработки. И вот Lightricks выкатили ин-контекст модель Clean Plate для своей 22B видеомодели LTX-2.3. Нейросеть удаляет из видео людей, пешеходов и транспорт, автоматически восстанавливая чистый задний план за ними. Все работает в режиме video-to-video LoRA и интегрируется в стандартные воркфлоу ComfyUI. Не хватает только готового плагина для Premier или DaVinci. Веса @ai_newz
Искусственный интеллект открыл новую страницу в истории мокбастеров ИИ-фильмы — это недорого. ИИ-фильмы — это быстро. Как раз то сочетание, которое больше всего нравится создателям второсортных киносодержащих продуктов, паразитирующих на хайповых тайтлах. Раньше главным производителем мокбастеров, выходящих одновременно с громкими премьерами, была студия The Asylum. Сегодня ее бизнес-модель уже кажется безнадежно устаревшей, ведь подделку могут сделать два иранца, вооруженные китайской нейросетью. Англо-иранский режиссер Эш Куша как раз этим сейчас и промышляет. В прошлом году он, вооружившись нейросетями, снял ИИ-фильм об иранских протестах, а теперь представляет свою экранизацию "Одиссеи" Гомера. 135-минутный нейрофильм был сделан всего за три месяца в китайской нейросети Kling — казалось бы, при чем тут громкий фильм Кристофера Нолана? В коротком интервью THR Куша не стесняется признаться в том, что идет по следам громкого фильма. Да, он запрыгнул на поезд хайпа, но не с целью заработать шальных денег, а чтобы продемонстрировать возможности современного ИИ-продакшна. Нолану потребовалось несколько лет съемок и $250 млн от крупной студии. Он же сделал свою версию сюжета за банку варенья и корзину печенья. "Вы можете снимать отличные фильмы так, как это делает Кристофер Нолан. Но вы также можете снимать великолепные фильмы, используя модели ИИ". Вот это мы понимаем — наглость, которая второе счастье.
А точно за банку варенья? где стоимость компьюта? Хигсы свой Hell Grind за 500k$ сделали. Там не банка, а бассейн с вареньем. 135 мин ИИ Одесеи тоже не дешево, особенно если это Kling. UPD: Поковырялся и нашел прайс. 50K$. Тоже не дешево, но не сотни миллионов.
видео или голосовое, без подписи
видео или голосовое, без подписи
видео или голосовое, без подписи
видео или голосовое, без подписи
видео или голосовое, без подписи
▶️ Герман Греф заявил, что «Сбер» один делает свою LLM. Президент и председатель правления «Сбербанка» Герман Греф сегодня выступил на заседании Совфеда. Выступил, как говорится, на все. Одно только заявление, что «Яндекс» качает «китайца» в сравнении с ними чего стоит. Разобрали весь доклад главы «Сбера», чтобы подсветить основные моменты, опуская букет от робота в адрес Валентины Матвиенко, ведь как сказала глава Совфеда: «Любовь должна оставаться за человеком». 🟢 У России сегодня остался только один разработчик полноценной фундаментальной модели. По словам Грефа, Яндекс сегодня дообучает Qwen и его это «не радует». Оценка отставания России – год от США, полгода от Китая. Сегодня у нас в стране осталась полностью разрабатываемая российской компанией только одна фундаментальная модель, это «Сбер». Компания «Яндекс» сегодня дообучает Qwen. В основе лежит китайская модель. И, конечно, нас это нисколько не радует, что мы одни, потому что мы за конкуренцию... но лучше было бы, если было у нас 5-6 игроков. 🟢 Причина отставания не в квалификации инженеров, а в нехватке вычислительных ресурсов. Герман Греф показал, сколько стоит кластер из 100 тыс. NVIDIA B200. Минимальный порог для конкурентоспособной модели, стоящий 1-2 трлн руб. на строительство или свыше 2 трлн на трехлетнюю аренду, тогда как у Google – свыше двух млн процессоров, у Microsoft – миллион. Мы примерно на год отстаем от американцев, мы примерно на полгода отстаём от китайцев. И здесь проблема заключается только в одном, не в качестве наших инженерных кадров, а в объеме того ресурса для обучения моделей. 🟢 Россия не готова к киберугрозам. В качестве примера он привел Mythos Anthropic, которая обнаружила более 1,5 млн уязвимостей в системах Apple, Google, Android, и, по данным СМИ, была использована для взлома Агентства национальной безопасности США: Как только появится квантовый компьютинг... мы понимаем, что все традиционные системы киберзащиты моментально будут вскрыты. 🟢 Герман Греф с удивлением заявил, что пришлось сокращать инженеров – впервые в его практике: Мы в Сбере в прошлом году сократили 20% инженеров впервые за все наше существование... Такого не было никогда, всегда это был самый дефицитный ресурс. Ранее... действовало такое правило «two pizza team». То есть размер команды должен был помещаться в возможность накормить эту команду двумя пиццами... То сегодня вся команда – это один человек и искусственный интеллект. 🟢 Система образования абсолютна не готова. Греф предупреждает о риске деградации когнитивных способностей детей, если школа не изменит подход к домашним заданиям и проверке знаний в условиях, когда «за детей» работу выполняет ИИ: Одна из самых главных задач, которая должна быть государством решена, это изменение системы образования. Сегодняшняя наша система образования абсолютно не готова к массовому приходу искусственного интеллекта. 🟢 80% открытий и пять миллионов статей за 2025 год, которые некому читать: Если мы говорим о соответствующем темпе развития генеративного искусственного интеллекта... на научную сферу, таких статей будет примерно 5 миллионов. Соответственно, встаёт вопрос, кто в состоянии прочесть такое количество научных статей... прочесть это сможет только искусственный интеллект. ☎️ Телекоммуналка в Telegram | в MAX
Греф выступил в Совфеде на все темы сразу. Про Яндекс с Qwen — а что плохого? Дообучать чужую модель вместо 2 трлн на свой кластер — прагматика. Про сокращение 20% инженеров и «команда = один человек и ИИ» — когда один человек с ИИ заменяет команду, качество решений падает. ИИ не задаст неудобный вопрос. А вот с инфраструктурой - на все сто согласен. Мы может быть и учили гигантские модели, будь у нас триллион на кластер 🐱 Пока учим маленькие и тоже поверх китайцев.
Character.AI заходит на рынок микродрам ИИ-сервисы наконец поняли, что на своих технологиях можно зарабатывать самим, а не только помогать сторонним компаниям. Платформа для создания ИИ-аватаров и общения с ними Character.AI запускает c.ai Series – сервис с собственными вертикальными мини-сериалами. У решения, правда, есть уникальное отличие от других вертикальных стримингов: здесь пользователь сможет общаться с персонажами сериала и влиять на сюжет. Рынок коротких драм уже доказал свою доходность. В 2025 году приложения с вертикальными мини-сериалами заработали около 3 миллиардов долларов – на 115% больше, чем годом ранее. В Китае, где этот формат и зародился, рынок уже превысил 11 ярдов.Сейчас сервисы микродрам активно внедряют ИИ, чтобы быстрее и дешевле выпускать контент. Но теперь ИИ сам заходит на их территорию и пытается заработать на этом формате. Первые сериалы для c.ai Series будет делать внутренняя студия, но в будущем Character.AI хочет превратить свои наработки в инструменты для авторов, чтобы пользователи могли выпускать сериалы с собственными персонажами. Компания также тестирует функцию под названием c.ai FM для создания аудиосериалов и c.ai Reads для написания книг. Так компания пытается объединить TikTok, ReelShort и ИИ-чат в одном приложении – и монетизировать то, на чем другие сервисы уже зарабатывают с помощью нейросетей.
ИИ реально ближе всего к микродраммам. Но я бы конечно это называл микро сериалами, или вертикальными сериалами. К ним сразу заниженные требования по качеству, больше на эмоции и динамичный монтаж. А ИИ сейчас отрезки по 15 секунд выдают и иногда сложно склеить.
По поводу дизайна презентаций. Часть 1. Я себе настроил Open Design. Без правильного контекста агент выдаёт «среднее по больнице» — фиолетовый градиент, скруглённые карточки, иконки-эмодзи. Open Design — сервис, который генерирует презентации силами AI. Сам он не рисует — собирает контекст, отдаёт агенту, тот выдаёт HTML. Преза может быть интерактивная, а может быть pdf/pptx на выходе. Контекст пустой — кошмар. Контекст заполненный — презентация в стиле Stripe или швейцарского плаката. Три файла нужно понимать. Не кодить, но знать что делают. DESIGN.md — визуальная система бренда. Цвета, шрифты, отступы, тени — с точными значениями и объяснением, почему именно так. Спецификация от Google Labs, апрель 2026. В OD встроено 153 готовых дизайн-системы — Stripe, Apple, Linear, Notion. Каждая с файлом токенов, готовыми компонентами и переводами (включая русский). Можно взять готовую, можно сгенерировать из адреса своего сайта. SKILL.md — унифицированный формат для описания повторяемой задачи. Спецификация от Anthropic (agentskills.io), работает в Claude Code, Claude.ai, Agent SDK и других агентах. В контексте презентаций скилл определяет форму: какой это дек — швейцарский с 16-колоночной сеткой и 22 зафиксированными раскладками, в стиле Keynote, или свободный холст. Скилл говорит агенту «вот раскладки, не выдумывай свои». В OD 11 скиллов для презентаций. Brand.md — бренд-контекст. Три слоя: стратегия (позиционирование), голос (как бренд говорит, какие слова не использует), визуал (цвета, шрифты). Если нужен не только внешний вид, а ещё тон и позиционирование — это сюда. Стандарт на thebrand.md. В OD есть стандартный способ сгенерировать Brand.md: даёте адрес сайта, OD скрапит его, извлекает бренд и разворачивает полную систему — с токенами, компонентами, логотипами и шрифтами. Я использую Hermes Agent как движок для генерации, но OD работает и с Claude Code, Codex, и другими. Что не очевидно, но важно. Craft. В OD есть папка craft/ — 14 файлов с универсальными правилами дизайна. Типографика, цвет, доступность. И anti-ai-slop.md — семь смертных грехов AI-генерации. Индиго как акцент? Блок. Фиолетово-синий градиент? Блок. Эмодзи как иконки? Блок. Скилл подключает нужные craft-файлы автоматически. Плагины. Плагин — это упаковка: манифест + SKILL.md + файлы раскладок + форма для пользователя + ссылки на craft. Если скилл говорит «что делать», плагин говорит «в каком контексте и с какими входами». В OD 443 плагина: дизайн-системы, видео-шаблоны, шаблоны изображений, примеры готовых артефактов. Создать свой — продвинутый уровень. История из практики. Сделал пример плагина: 6 файлов раскладок + SKILL.md с «можно/нельзя» + палитра Klein Blue. Первый блин комом — последний слайд был отцентрирован, остальные прижаты влево. Композиция сломалась. Починил: переписал раскладку последнего слайда, чтобы повторял структуру первого, и добавил в SKILL.md правило «все слайды прижаты влево, центрирование не используется». Заработало. Мораль: агент не видит дизайн глазами. Он читает файлы и следует правилам. Оставили серую зону — агент заполнит её «по умолчанию», и будет криво. Источники: https://getdesign.md/ https://thebrand.md/ https://github.com/google-labs-code/design.md —||— В следующем посте — как сделать свой плагин по шаблону, чтобы бренд-дизайнер мог задать раскладки, палитру и правила, а агент не сбивался. На живом примере, с кривым слайдом и тем, как это починить.
Часто спрашивают, а какой компьютер собрать локально, чтобы работать с нейронками. Или, еще лучше, как клод код локально сделать. Нашел неплохое видео с обзором на момент начала июля 2026. https://youtu.be/K6_Jf3C64Kc?is=RMU0Ur5KajvzW1Cx Это вы читаете, значит и как YouTube посмотреть найдете. TL;DR; Надо от задачи идти. Полностью локальный персональный ассистент уровня GPT-5.6, Claude Fable 5 невозможен. Но мелкие автоматизации сделать можно. Но проще токены купить, ей богу, если вы не в закрытом контуре.
Прекратите вайбпрезить! Был на прошлой неделе на ИИ-конфе. Сейчас подразгребаю презентации и понял, что у меня уже сразу отвращение, если вижу презу, сделанную с минимальными настройками клода. Ну там целый отдельный продукт есть — Claude Design. Если вы продаёте себя как эксперты в ИИ — ну потратьте время, грамотно настройте работу с дизайн-инструментами. Вы представляете, какое количество однотипных през сейчас видят люди, которые взаимодействуют с партнёрами и поставщиками? Покажите, что вы хоть немного старались. Просто промта «сделай в фирменных цветах компании Х» — недостаточно. Вам дали супер производительность, используйте её. А лучше наймите дизайнера, который с этими инструментами x10 делает, но если что всегда руками дотянет. Сделаю следующим постом: как работать с DESIGN.MD файлами, скилами и как настроить OpenDesign — если вы, как и я, не любите клод. Подписаться не забываем)
Ой! Не тот чат. Опасность держать агента рядом с другими чатами в мессенджерах. Я тут в воскресенье сидел на своём бранче выходного дня в Ritmo во флигеле усадьбы Бобринских и захотел исполнить трюк как в рилсе из запрещённой сети. Открыл агента в телеграмме и написал «Сделай мне B2B SaaS на 1 млн долларов». Шутка. Просто дал какую-то фигню на исполнение. Агент пошёл работать. А я поотвечал на сообщения в тг, положил телефон на стол. Потом меня осенила гениальная идея — и сразу написал агенту. Но оказалось, что чат был не агентский, а живого человека, который сразу это прочитал. А там было из разряда «Сделай мне … и не забудь про … и быстро. Включай свои навыки». Ну я удалил сразу и извинился, что не тот чат. Но в целом, наверное, могу так случайно написать кому-нибудь, с кем так не разговаривают. В мессенджерах теперь вежливо общаюсь с агентами. P.S. Но если вы не знали — писать «Спасибо» и «Пожалуйста» агентам не надо. Вы просто электричество на токены тратите. Хотя это сейчас часто вырезают ещё до передачи в LLM на уровне харнеса.
А вот коннектор к Hermes в Max: https://github.com/temga/max-hermes-plugin Просто попросите своего агента его настроить. Но домен, юр.лицо/самозанятость понадобиться