tgindex
Ринат Шакиров | Промпты для Midjourney | ChatGPT |

Ринат Шакиров | Промпты для Midjourney | ChatGPT |

Статистика

Главные ИИ-новости, авторские промпты для Nano Banana / Seedance 2 / Midjourney / ChatGPT, обзор лучших ИИ-сервисов. Реклама, консультации — @shakirov_ai РКН: https://clck.ru/3FPZJV

Последний пост
12:03
Последнее чтение
14:14
Постов за неделю
48
Всего постов
149
Тип
открытый
Язык
русский
Категория
Технологии
В каталоге с
12 авг.
Подписчики
41 985
+54 за 3 дн.
Сутки
0
0,00%
Неделя
 
Месяц
 
Просмотров на пост
2 184
40 постов
Вовлечённость
5,2%
к подписчикам
Постов в день
6,9
всего 149
Упоминаний
15
каналов
Охват размещения
по 10 постам
1/24сутки в ленте
2 840
1/48двое суток
3 298
1/72трое суток
3 557

Медиана по постам, которые мы застали свежими и померили через сутки.

Посты

  • Tencent показала WorldClaw, ИИ систему, которая по одному текстовому запросу собирает полноценный открытый 3D-мир По получившейся сцене можно свободно перемещаться, а сам мир состоит из обычных редактируемых 3D-объектов с геометрией, текстурами и материалами. WorldClaw работает поэтапно. Сначала ИИ разбивает запрос на регионы, рельеф, объекты и их расположение. Затем строит общий ландшафт и постепенно заполняет его деталями, сохраняя структуру всей сцены. Отдельные участки система может прорабатывать сильнее, создавая для них текстурированные 3D-меши и автоматически размещая их на рельефе. После этого дополнительные агенты дорабатывают внешний вид объектов, поверхность и их взаимодействие с окружением. В итоге на выходе получается не красивая иллюзия 3D, а сцена из отдельных ассетов, которую можно открывать, редактировать и дальше использовать в игровых и 3D-пайплайнах. Проект уже опубликован Tencent в открытом доступе. dailyprompts.ru

  • Pika выпустила сразу четыре аудиомодели и собрала их в одном API Pika Audio теперь умеет генерировать музыку, речь, звуковые эффекты и автоматически делать саундтрек под готовое видео. Все четыре модели доступны через единый API. Pika Music создает музыку по текстовому описанию, словам песни, музыкальному референсу и образцу голоса. Стоимость начинается от $0.015 за минуту. Pika SFX генерирует отдельные звуки по обычному текстовому запросу. Например шум дождя, шаги, взрыв или звук двигателя. Цена составляет $0.0002 за секунду. Pika Speech превращает текст в речь и поддерживает быстрое клонирование голоса. Стоимость составляет $0.01 за минуту. Pika Soundtrack принимает готовое видео и создает синхронизированную с ним звуковую дорожку. Стоимость составляет $0.005 за секунду видео. По данным Pika, SFX до 20 раз экономичнее альтернатив, Music примерно в 10 раз дешевле сопоставимых моделей, а Speech до 9 раз экономичнее ElevenLabs v3. Soundtrack при этом примерно в 2 раза экономичнее Hunyuan Foley, одной из немногих моделей с похожим преобразованием видео в аудио. В итоге Pika постепенно собирает полный набор для производства роликов. Видео, речь, музыка и звуки теперь можно генерировать через одну платформу. dailyprompts.ru

  • DeepSeek также выпустил собственный опенсорс каркас для ИИ агентов DeepSeek Harness v0.1 вышел в Developer Preview и сразу опубликован под лицензией MIT. Проект построен поверх метафреймворка Cordis и следует одной идее. Внутри буквально всё является плагином. Модель, инструменты, память сессии, файловая система, песочница, агентный цикл и даже интерфейс можно заменять независимо друг от друга через конфигурацию. То есть разработчику не нужно переписывать ядро, чтобы собрать собственную версию агента. Есть готовые профили для веб-интерфейса и запуска без сервера. Веб-версия поднимается одной командой через npm. DeepSeek отдельно предупреждает, что это ранняя версия и совместимость между обновлениями пока может ломаться. Репозиторий появился сегодня и уже набрал почти 15 тысяч звезд на GitHub. Код написан преимущественно на TypeScript. dailyprompts.ru

  • Превращаем себя в персонажа комиксов в Omni Create a 10-second vertical cinematic video, 9:16, ultra-realistic premium live-action. A person faces the camera in a modern indoor room with warm natural ambient lighting. Their fingertips can physically manipulate the boundary between photorealistic reality and a black-and-white manga universe. There is NO physical object between the hands. The opening exists only because of finger positions. ## CORE VISUAL LAW The fingertips control a dynamic portal in real time. Everything OUTSIDE the hand-defined shape remains photorealistic live-action. Everything INSIDE becomes a perfectly aligned black-and-white manga version of the same face, body, and room. The manga layer stays spatially locked to the real scene beneath it. The boundary follows the fingertips precisely and continuously. --- ## 0–2s — THE SLIT Medium close-up, frontal view. The person looks into camera and quickly raises both hands. Thumbs and index fingers create an extremely thin horizontal slit across the eyes. The instant the fingertips align, only the space between them transforms into manga. Only the eyes inside the slit become illustrated. Forehead, nose, mouth, hands, body, and room remain photorealistic. The fingers move slightly up and down. The manga strip follows perfectly like a movable scanner revealing another dimension. --- ## 2–4s — SHAPE MORPHING The hands pull apart and the slit smoothly expands into a rectangular portal, revealing more of the illustrated face. Without releasing the gesture, individual fingertips move independently and continuously morph the portal: rectangle → trapezoid → sharp triangle. NO CUT. NO physical frame. NO floating screen. The boundary stretches and bends exactly with the fingertips. As the triangle shrinks, only one manga eye remains visible. The person slides the triangle across the face, transforming only the areas it passes over. --- ## 4–6s — IMPOSSIBLE GEOMETRY The person rotates both wrists in a fast, elegant motion. The triangle smoothly bends into a circular opening between the hands, with fingers naturally curving around its invisible boundary. Inside the circle, the face and room appear as detailed manga artwork. Move the circular window across: eye → nose → mouth → entire face. Reality instantly becomes manga inside the portal and returns to photorealism immediately after it passes. The person pulls the circle sideways, stretching it into an irregular organic shape like an elastic dimensional membrane. The manga universe stretches with correct perspective. --- ## 6–8s — REALITY TEAR The person grabs opposite sides of the portal and pulls outward. The manga opening rapidly grows beyond the face and expands toward all four screen edges. For a brief moment it consumes the entire frame. The WHOLE PERSON and ROOM become a detailed black-and-white manga universe: bold ink contours, cross-hatching, screentone shadows, graphic speed lines, dramatic hand-drawn perspective. The person's identity, exact position, and movement remain unchanged. --- ## 8–9s — BREAK THE COMIC WORLD Inside the full manga universe, the person looks into camera and pinches the air with thumb and index finger. A tiny photorealistic hole appears between the fingertips. They pull it apart. Real color and photographic texture break through as the manga world folds backward toward the edges like an elastic illustrated membrane. --- ## 9–10s — SNAP BACK TO REALITY The person snaps their fingers. The remaining manga universe instantly collapses toward the snapping fingertips: full screen → rectangle → triangle → tiny circle → glowing point → disappears. Everything becomes fully photorealistic again. The person stays still for the final beat and gives a subtle confident smile into camera. Вторая часть промпта в комментариях. dailyprompts.ru

  • MiniMax выложила Music 3 в открытый доступ MiniMax-Music3 это новая модель для генерации полноценных песен длительностью до пяти минут. На вход можно дать текст песни и описание звучания, а на выходе получить готовый трек с вокалом, инструментами и развитием аранжировки. Модель понимает структуру песни. Можно отдельно задать вступление, куплеты, припев, бридж, инструментальную часть и финал. Также описываются жанр, BPM, тональность, инструменты, характер вокала и то, как музыка должна меняться по ходу трека. Внутри используется связка из глобальной модели на 8 млрд параметров и локальной на 600 млн. Первая отвечает за общую структуру композиции на длинной дистанции, вторая за мелкие детали звука. Итог генерируется в стерео WAV с частотой 32 кГц. Модель можно запускать локально. В полном режиме ей нужно меньше 24 ГБ видеопамяти, а с выгрузкой части вычислений в оперативную память она запускается даже на GPU с 8 ГБ VRAM, хотя работать будет медленнее. Для запуска уже поддерживаются SGLang, Diffusers и ComfyUI. Код и веса опубликованы на Hugging Face. dailyprompts.ru

  • ChatGPT теперь может помнить, что вы делали на компьютере В десктопном приложении ChatGPT для Mac появилась функция Computer History. Она запоминает вашу активность в приложениях и на сайтах, а затем использует её как контекст в будущих разговорах. Например, можно вернуться после перерыва и спросить, над чем вы работали. ChatGPT сможет восстановить недавние задачи, найти нужный документ или продолжить работу без повторного объяснения всего контекста. Отдельно появилась временная шкала с историей работы. ChatGPT может замечать повторяющиеся действия и предлагать превратить их в готовый навык или автоматизацию. При этом функция не записывает экран, микрофон или системный звук. Она собирает события вроде кликов, ввода текста, переключения между приложениями и доступного macOS контекста. Временные данные хранятся на Mac до 48 часов. Можно отдельно исключать приложения и сайты, ставить сбор на паузу, удалять отдельные записи, последний час, день или всю историю. Computer History построена на базе экспериментального Chronicle, но систему полностью переработали. Она должна потреблять меньше токенов и получила больше настроек приватности. Функция выключена по умолчанию и подключается вручную в настройках ChatGPT для macOS. Сейчас её разворачивают для Pro, Business и Enterprise. dailyprompts.ru

  • 14 авг.1 74136

    видео или голосовое, без подписи

  • 14 авг.1 7471037

    Qwen3.8 теперь можно запускать у себя локально Alibaba открыла веса сразу двух моделей Qwen3.8. Главная новинка для локального запуска это Qwen3.8-27B с 27 миллиардами параметров. Модель мультимодальная, поэтому умеет работать не только с текстом, но и с изображениями. По заявлениям команды, она в целом превосходит Qwen3.7-Plus и особенно хорошо показывает себя в программировании и офисных задачах. Контекст составляет 262 тысячи токенов, но его можно расширить примерно до 1 миллиона токенов. При этом 27B остаётся достаточно компактным размером для локальной модели такого уровня. Веса опубликованы под Apache 2.0, поэтому модель можно свободно использовать в собственных продуктах и коммерческих проектах. Параллельно открыли веса огромной Qwen3.8-2.4T-A95B. Это модель уровня флагманского Qwen Max с 2,4 триллиона параметров, из которых одновременно активируется только часть. Получается довольно широкий диапазон. Qwen3.8-27B можно использовать как относительно компактную локальную модель, а 2.4T-A95B уже подходит для тяжёлых серверных агентов и инфраструктуры. Обе модели теперь доступны с открытыми весами. dailyprompts.ru

  • 14 авг.2 03760

    видео или голосовое, без подписи

  • 14 авг.2 06060

    видео или голосовое, без подписи

  • 14 авг.2 03060

    видео или голосовое, без подписи

  • 14 авг.1 8321761

    Эстетичные постеры в GPT Редакционный тревел-плакат «ЯПОНИЯ», подзаголовок «ПУТЕШЕСТВИЕ СКВОЗЬ ВЕЧНЫЕ ЧУДЕСА». Формат 3:4, эстетика luxury travel campaign. Фон — кремовая бумага с текстурой слоновой кости. Темно-синяя типографика, бордово-сливовые акценты, тонкие золотые детали, симметричная журнальная сетка. Вверху — огромное «ЯПОНИЯ» шрифтом с засечками в стиле high-fashion editorial, с каллиграфическими росчерками от крайних букв. Ниже — подзаголовок прописными без засечек. Орнамент: ветви сакуры, волновые мотивы, элементы японской гравюры в бордово-золотой гамме. По центру — минималистичная эмблема-Хиномару. Центр — большая непрерывная 3D-лента из струящейся кремовой бумаги (бесконечная петля) вертикально через весь плакат: загнутые края, объемная глубина, мягкие тени. Внутри — пять фотореалистичных панорамных сцен: Токио и наследие: пагода с красными деревянными деталями, сакура, сады, Skytree и небоскребы вдали, прохожие в кимоно, весенний свет. Традиционная Япония: квартал в духе Киото и Гиона, мощеные улочки, дома махия, бумажные фонари, сёдзи, чайные дома, фигуры в кимоно. Побережье: синее море, скалистые бухты, сосны, ворота тории у воды, вдали рыбацкая гавань, кинематографичный свет. Природа: багряная и золотая листва вокруг озера, Фудзи с отражением в воде, павильон, арочный мостик, каменные фонари. Современность: вечерний Токио, неон, мосты, отражения, синкансэн на эстакаде, холодное стекло и золотое сияние окон. Слева и справа — шесть чистых блоков с линейными иконками и коротким текстом: ИСТОРИЯ (от Хэйана и самураев до наших дней), КУЛЬТУРА (кимоно, чайная церемония, икэбана, каллиграфия, аниме, дизайн), ТУРИЗМ (храмы, онсэны, японские Альпы, острова), ЭКОНОМИКА (технологии, робототехника, промышленный дизайн), ГОСТЕПРИИМСТВО (omotenashi, сервис, кухня), ПРИРОДА (четыре сезона). Все сцены объединены единой цветокоррекцией и премиальной журнальной эстетикой — ощущение дорогого коллекционного издания. Избегать: визуального шума, поп-стилизации, карикатурности, градиентов, логотипов, водяных знаков. ❤ Своими результатами делитесь в чатике dailyprompts.ru

  • 14 авг.2 2842242

    Manus стал полностью бесплатным до 25 августа До 25 августа 2026 года по сингапурскому времени Manus не будет списывать кредиты за использование агентов. Бесплатно доступны Manus 1.6 и облегчённая версия Manus 1.6 Lite. Можно запускать задачи через любой из них без расхода кредитов. Есть только одно ограничение. В часы высокой нагрузки задачи бесплатных пользователей могут вставать в очередь. Владельцы тарифов Pro и Team получают приоритет. Акция проходит на фоне того, что Manus снова становится независимой компанией и отделяется от Meta. Части пользователей Manus придётся сохранить данные до 23 августа, после чего некоторые аккаунты пройдут процедуру удаления и восстановления. С 25 августа резервную копию можно будет загрузить обратно и продолжить работу. Если аккаунт не попал под изменения, ничего делать не нужно. dailyprompts.ru

  • 14 авг.2 3563090

    Сервис, который превращает часовое интервью в готовый текст с задачами за пару минут Делюсь с вами удобным сервисом для тех, у кого постоянно копятся подкасты, вебинары, интервью и длинные видео, которые проще прочитать, чем смотреть целиком. Whisper AI расшифровывает аудио и видео в текст без лимитов и поддерживает файлы длительностью больше 6 часов. Можно просто скинуть ссылку с YouTube, VK, Rutube, TikTok и еще десятка площадок. На выходе получаете текст с таймкодами и разбивкой по спикерам. Расшифровку можно сохранить в Docs, Word, PDF, TXT или Markdown, либо сразу разобрать через встроенные GPT и Claude. Из нового появилась поддержка MCP для GPT и Claude. То есть расшифровки и контекст из Whisper AI можно подключать напрямую к своим ИИ инструментам. Еще полезная штука для Telegram. Бота можно добавить в обычную беседу, после чего он будет расшифровывать голосовые сообщения и кружочки для всех участников. Работает даже для тех, у кого нет Telegram Premium. В итоге длинное интервью можно закинуть ссылкой, вечером прочитать краткое содержание, а нужные моменты уже отдельно разобрать через GPT или Claude. Для тех, кто много работает с аудио и видео, довольно удобная экономия времени.

  • 14 авг.2 4211427

    Z.ai выпустила GLM-5.3 Модель получила большой апгрейд именно в агентной работе и кодинге. Во внутреннем тесте Z.ai на реальных задачах программирования результат вырос примерно на 50% относительно GLM-5.2. В тесте на работу ИИ прямо внутри терминала результат вырос с 4.6 до 28.3. В задачах, где модель должна самостоятельно находить и исправлять ошибки в коде, показатель поднялся с 46.2 до 66.9. В тестах на полноценную работу с большими репозиториями и реальными программными проектами GLM-5.3 тоже заметно прибавила. Один из результатов вырос с 67.5 до 78.1, другой с 19.4 до 42.5. Отдельно сильно выросли способности в кибербезопасности. В тестах на поиск и эксплуатацию уязвимостей результат поднялся с 24.4% до 54.4%, а в другом наборе задач с 77.2% до 84.5%. Причем эти способности появились как побочный эффект обучения модели кодингу и работе с инструментами. Из-за этого Z.ai пока не публикует открытые веса и проводит дополнительную проверку безопасности. Сейчас GLM-5.3 уже доступна через API и Coding Plan. Открытые веса обещают выпустить через две недели после релиза. dailyprompts.ru

  • 14 авг.2 5763449

    Suno выпустила Studio 2 В Studio 2.0 появился MIDI. Можно подключить MIDI-клавиатуру, записывать и редактировать партии прямо на таймлайне, использовать встроенный синтезатор и даже подавать MIDI-клип как промпт для генерации нового аудио. Главное обновление это Chat Bar. Теперь с музыкальной студией можно буквально разговаривать. Просишь создать вокал или инструмент, собрать новый синтезатор, сделать собственный аудиоплагин или просто привести проект в порядок. Добавили продвинутое разделение треков на вокал, барабаны, бас и другие части. Причём загружать можно не только музыку из Suno, но и любые свои аудиофайлы. Появились нормальные аудиоэффекты, автоматизация параметров и экспорт мультитреков в качестве до 32 бит и 48 кГц. Свои эффекты и плагины тоже можно собирать через чат. На старте за их создание кредиты не списываются. По сути Suno постепенно уходит от схемы «написал промпт и получил песню». Теперь это уже полноценная студия, где ИИ генерирует материал, а человек получает контроль над нотами, дорожками, эффектами и сведением. Studio 2.0 уже доступна подписчикам Premier. dailyprompts.ru

  • 13 авг.2 99330

    видео или голосовое, без подписи

  • 13 авг.3 01630

    видео или голосовое, без подписи

  • 13 авг.3 01230

    видео или голосовое, без подписи

  • 13 авг.2 8111631

    Google выпустила Gemini 3.7 Flash всего через три недели после Gemini 3.6 Flash Новая версия заточена под кодинг и ИИ агентов, при этом на старте стоит в два раза дешевле первоначальной цены 3.6 Flash. В кодинге прирост получился заметным. FrontierCode 1.1 вырос с 34,4% до 43,6%, а DeepSWE v1.1 с 49% до 65,3%. В WebDev Arena новая модель набрала 1588 Elo против 1538 у прошлой версии. Google отдельно прокачала генерацию интерфейсов. Модель может получить скриншот, картинку или целую дизайн-систему и собрать по ним рабочий интерфейс, стараясь сохранить исходный стиль. В демонстрациях она за один запрос создает интерактивные лендинги и вместе с Nano Banana собирает полноценную 3D игру. С документами тоже большой скачок. На тесте GDP.pdf результат вырос с 22% до 34%, а на AutomationBench с 17% до 30,4%. Модель лучше справляется с многошаговыми задачами, использованием инструментов и реальными бизнес-процессами. Gemini 3.7 Flash уже стала основной моделью для агента Gemini Spark. Он может работать с Google Workspace, собирать файлы, писать письма и обновлять рабочие документы практически без постоянного контроля пользователя. До конца 2026 года цена составляет $0,75 за миллион входных токенов и $3,75 за миллион выходных. С 1 января 2027 года тариф вырастет до $1,50 и $7,50 соответственно. Видимо дела у Google с моделями совсем плохи, что хватает только на Flash модели. dailyprompts.ru

Ринат Шакиров | Промпты для Midjourney | ChatGPT | — tgindex