Силиконовый Мешок
СтатистикаКак заработать на Искусственном Интеллекте уже сегодня. Написать админу @artem_subbotin Чат канала: @prompt_chat
- Последний пост
- 11:18
- Последнее чтение
- 09:30
- Постов за неделю
- 14
- Всего постов
- 36
- Тип
- открытый
- Язык
- русский
- Категория
- Искусство
- В каталоге с
- 12 авг.
- 1/24сутки в ленте
- 11 000
- 1/48двое суток
- 12 912
- 1/72трое суток
- 13 926
Медиана по постам, которые мы застали свежими и померили через сутки.
Посты
Галя, у нас отмена! Ребят, решил по нашей старой доброй традиции проверить, как Gemini 3.7 Flash соберет мне DOOM с одного промпта. Нарамблил задачку, нажал «Отправить». Через десять секунд выплевывает код. Я сначала подумал, что Флешик глюканул. Открываю в браузере - это реально игра. Чет я немного шокео... Игрульку в комменты скину
13 августа вышла Gemini 3.7 Flash. Забавно, что с релиза прошлой Flash прошло всего три недели. Google, ты уверен, что не хочешь показать Gemini 3.5 Pro? Так-то мы ждем. Ну, пробежимся по основным бенчмаркам. DeepSWE вырос с 49 до 65.3, FrontierCode - с 34.4 до 43.6, AutomationBench почти удвоился (с 17 до 30.4). Google объясняет рывок «потрясающими алгоритмическими улучшениями» и заявляет о превосходстве над Sonnet 5 и GPT-5.6 Terra в рабочих задачах. Окей, понятно. Хотя есть и приятности. Пока DeepSeek поднимает тарифы, Google демпингует: $0.75 за миллион входных и $3.75 за миллион выходных токенов - вдвое дешевле, чем стоила 3.6 Flash на старте. Но скидка со сроком годности: с 1 января цена удваивается. Тот же трюк, что и у DeepSeek, только в другую сторону.
Прикол. Основатель запустил маленькое приложение за 2 дня, вышел на выручку +$4000/месяц, а сейчас поднимает раунд https://t.me/its_capitan/554
Одно из моих любимых увлечений - это ковыряться в алгоритмах социальных сетей. Конечно, чаще всего что-то интересное удается нащупать эмпирически, а не прочесть в документации создателей, хотя некоторые публикуют, но об этом дальше. И такие фишки я стараюсь эксплуатировать в продвижении своих медиаресурсов, иногда получается неплохо, а иногда и скверно. И сегодня я бы хотел рассказать про Твиттер, точнее Икс. Думаю, что многие из вас знают, что эти ребята опенсорснули алгоритмы ранжирования контента и пользователей внутри Твиттера, вот их репозиторий с весами и механикой скоринга: https://github.com/xai-org/x-algorithm И это просто кладезь полезной информации, которую можно использовать не только для продвижения в социальной сети Илона нашего Маска, но и для того, чтобы получить представление, как все работает у других. Например, у каждого действия пользователя есть определенный вес, влияющий на охваты: — Копирование ссылки на пост весит 20, реплай 5, лайк всего 0.5. Контент «перешлю коллегам» в 40 раз ценнее контента «лайкнул и забыл». — Реплай от взаимного фолловера весит 20 (буст введен в июле 2026). Сетка из 50-100 взаимных подписок с активными авторами ниши сейчас главный рычаг роста. — Одна жалоба стоит -234, то есть сжирает эффект 468 лайков. Мьют (-58.8) почти вдвое хуже блока (-31.2). — Твои реплаи и репосты вообще не показываются неподписчикам, виральность делают только оригинальные посты. Пост живет 48 часов, дальше жесткий фильтр. — Аккаунты до 1000 подписчиков получают принудительные «пробные показы» в районе 15-16-й позиции ленты, холодный старт реальнее, чем принято думать. — «Теневой бан» существует буквально в коде, отдельный набор правил дропает посты только в рекомендациях (спам, абьюз, NSFW-лейблы, включая детект аватара и баннера), подписчики при этом все видят. Свои лейблы можно проверить на x.com/i/under_the_hood. Для тех, кому лень копаться во всей этой директории, я сделал специальный MD-файл в закрепе к посту, который вы можете скормить агенту и поразгонять с ним, как вам применить у себя. Например, мои догадки, как работают алгоритмы Тредса, на 70-80% совпадают с тем, как реально функционирует Твиттер. Кстати, если вам интересны подобные посты, жахните 🔥 чтобы я знал.
Ох, как кучно Китайцы пошли. Сегодня зарелизили - GLM 5.3 База та же, что у 5.2, весь прирост Z.ai выжали чистым пост-трейнингом на длинных агентных задачах. И теперь заявляют сильнейшую открытую модель для кодинга. На Terminal-Bench 3.0 скачок с 4.6 до 28.3, лучше чем Kimi K3 (17.4) и даже Opus 4.8 (21.1), выше только Fable 5 и GPT-5.6. Плюс экономность, на их внутреннем бенче GLM обходит Opus 4.8, тратя в два с лишним раза меньше токенов на задачу. Самое интересное, у модели неожиданно прокачалась кибербезопасность. Лучший результат на CyberGym (84.5, впереди топов Anthropic и OpenAI), а в полевых тестах с безопасниками она нашла 2436 реальных уязвимостей в 269 опенсорс-проектах. Самый старый баг сидел в коде с 1981 года, в среднем дыры жили по 26 лет до обнаружения.
DeepSeek выкатил V4-Pro и открыл собственный агентский харнес. А под шумок впервые в своей истории поднял цены. Но, по порядку. V4-Pro - видно, что апдейт заточили под агентную работу. Регулируемая глубина размышлений (low для быстрых задач, max для сложных), контекст 1M токенов. Под капотом MoE на 1.6T параметров, веса открыты. По уровню уже подбирается к фронтирам, а местами и на равных: — На SWE-bench Verified у него 80.6, вровень с Opus 4.6 (80.8) и Gemini 3.1 Pro (80.6). — На LiveCodeBench 93.5, впереди и Gemini (91.7), и Claude (88.8). — Рейтинг Codeforces 3206, выше GPT-5.4 и уровень топ-30 людей мира. — На Terminal-Bench 67.9, здесь заметно впереди GPT-5.4 (75.1). — В общих рассуждениях чуть слабее Claude и Gemini, до абсолютного лидера (Fable 5 с ~95 на SWE-bench) не дотягивает. — Зато на кодинге паритет с топами при цене в 7 раз ниже, в этом весь замысел. DeepSeek Harness (dsh) - это опенсорсный конкурент Claude Code, но с веб-интерфейсом. Архитектура «все является плагином», где модель, инструменты, песочница и даже сам агентский цикл заменяются конфигом. Из коробки bash, терминалы, веб-поиск, MCP, скиллы, сабагенты. Самая забавная деталь, что Claude Code и Codex подключаются внутрь как сабагенты. Но есть небольшой нюанс. С 16 августа DeepSeek вводит тарифы, зависящие от пиковых часов использования, а это повышение от +50% до +1100% в зависимости от модели и типа токенов. Пиковые часы совпадают с рабочим днем Китая, в Европе это 3-6 утра и 8-12 дня. Вне пика вдвое дешевле. В общем эпоха «DeepSeek постоянно демпингует» закончилась. Дешевый ИИ теперь по расписанию. Ждем, когда в роутеры добавят функцию подбирать модели не только под задачу, но и под время использования. Харнес: github.com/deepseek-ai/deepseek-harness Цены: api-docs.deepseek.com/quick_start/pricing
Ничего не понятно, но очень интересно. Со вчерашнего дня на Реддите и в Твиттере стал вируситься проект - local.ai Как я понял, это бенчмарк-каталог локального ИИ от Exo Labs (команда, которая делает распределенный инференс на кластерах маков, RDMA через Thunderbolt 5). Все кинулись забирать там красивые и короткие ники, пока доступны - ну и я за всеми. Вы тоже зарегистрируйтесь, а потом разберемся, что из этого вырастет. Но команда за проектом стоит крутая, и домен дорогой.
Незаменимый сотрудник с золотой акцией Вчера был очень интересный стрим в Research Mastermind. Да, конечно, в первую очередь благодаря спикерам и их докладам, но есть небольшой нюанс. Точнее, инсайт, который я и аудитория словили ближе к середине. Два из трех выступающих рассказали, как завайбкодили решение внутри компании, где они работают. В обоих случаях получился продукт, который является основой в процессах всей организации, а они стали носителями знаний, как все функционирует. Сразу несколько комментаторов поздравили спикеров с тем, что те получили «золотую акцию», которая защитит от возможного сокращения. И подобные истории я все чаще и чаще слышу от участников ИИзнанки. Начинаются они с того, что сотрудник пытается оптимизировать свои процессы, вайбкодит какие-то штуки для себя. А потом оказывается, что и коллеги с удовольствием пользуются этими решениями. Через какое-то время на такого ИИ-амбассадора обращает внимание начальство, просит поделиться наработками. И вот уже он незаменимый сотрудник, подсадивший организацию на свои решения, и желанный гость на совете директоров, с радостью отвечающий на вопросы «А что бы нам еще такого автоматизировать, Николай?» У нас в сообществе даже родилась шутка, что свои ИИ-наработки нужно позиционировать не как рожденные в свободное от работы время, а как полезные сервисы «какой-то компании», с которой мы можем заключить контракт. Это к вопросу, что если работодатель докажет создание таких решений на рабочем месте, то просто выпишет премию за ноу-хау и заберет их в интеллектуальную собственность организации. Вот вам еще один способ поглубже устроиться в кресле работника месяца и хотя бы на время отодвинуть момент, когда ИИ вас заменит.
Ого, а тут, оказывается, вышел Grok 4.6 Бенчмарки закину в комментарии, но модель на уровне (немного недотягивает) Fable 5 и GPT 5.6 Sol. А главная ее фишка - это возможность максимально долго держать фокус на задачах и долгоживущие агенты. Можно уже тестировать: https://dslab.tech/ai/models/llm/grok-4.6
А мы начали, залетайте на стримчанский - https://youtube.com/live/KZhntCQFjYU?feature=share
Не забываем, что уже через 2 часа (в 19:00 GMT+3) начнется Research Mastermind. Также его можно смотреть в формате стрима на YouTube (зайдите прямо сейчас и нажмите «прислать уведомление»). Послушаем интересных спикеров, позадаем вопросы и подумаем, как их идеи применить у себя. А если вы хотите рассказать про свой продукт, идею или то, над чем работаете, Research Mastermind - отличная площадка. Да, вход туда только через ИИзнанку, но и бонусы отличные. Ваше выступление увидят подписчики «Силиконового Мешка», плюс стрим на YouTube-канале (в среднем 100-200 онлайн и за неделю несколько тысяч набегает). Получите доступ к классным комьюнити с активной аудиторией (доступ в Research Mastermind остаетесь навсегда). Можете безлимитно брать слоты со мной, чтобы обсуждать ваш проект или задачи. Ну и другие плюшки - по цене завтрака.
Даже если вы называете себя вайбкодером только в узком семейном кругу, чтобы окружающие не смеялись в лицо, но при этом активно используете ИИ-инструменты, вы все равно вайбкодер. Поэтому стесняться не нужно, а вот использовать кучу полезных инструментов очень даже нужно. И большинство из них платные. Да, когда это одна или парочка подписок за двадцать баксов, это не сильно бьет по бюджету, тем более если результат деятельности все окупает. Кстати, если не окупает, подумайте, может, ну ее нафиг. Но если вы решите серьезно погрузиться в эту историю, лучше посмотреть на открытые аналоги. Например, использовать n8n вместо Zapier, AppFlowy вместо Notion, Whisper вместо Otter, Twenty вместо HubSpot и так далее. Я собрал топ-10 бесплатных инструментов, которые легко заменят платные сервисы, а дополнительные 33 упаковал в удобный гайд. Пользуйтесь. 1. infisical - единое хранилище паролей, API-ключей и доступов: все зашифровано, каждое обращение записывается в журнал. Без него твой .env однажды утечет в публичный репозиторий вместе со счетом за API. https://github.com/Infisical/infisical 2. shadcn/improve - работа с кодом в две ступени: дорогая модель изучает кодовую базу и пишет план правок, дешевая выполняет его. Экономия на токенах. От автора shadcn/ui. https://github.com/shadcn/improve 3. trigger.dev - запуск фоновых задач и ИИ-агентов: длинные процессы работают без ограничений по времени и без оплаты за каждый запуск. https://github.com/triggerdotdev/trigger.dev 4. n8n - визуальная автоматизация: соединяешь сервисы в цепочки мышкой, плюс встроенные ИИ-агенты. Полностью заменяет Zapier/Make, работает на твоем сервере. https://github.com/n8n-io/n8n 5. pocketbase - весь бэкенд в одном файле: база данных, авторизация пользователей, обновления в реальном времени, хранение файлов. Замена Firebase для соло-проектов, без ежемесячного счета. https://github.com/pocketbase/pocketbase 6. coolify - панель деплоя приложений на твоем VPS, альтернатива Vercel/Heroku/Netlify. Устанавливается одним скриптом, из ограничений только мощность самого сервера. https://github.com/coollabsio/coolify 7. dify - конструктор ИИ-агентов и ботов, которые знают твои документы (RAG): собираешь мышкой, без кода. Вместо платных конструкторов за $500 в месяц. https://github.com/langgenius/dify 8. posthog - продуктовая аналитика: что делают пользователи, записи их сессий, A/B-тесты, включение новых функций выборочно для части аудитории. Заменяет Mixpanel и LaunchDarkly вместе взятые, работает на твоем сервере. https://github.com/PostHog/posthog 9. metabase - графики и дашборды по твоей базе данных без лицензии Looker/Tableau: подключаешь базу и в тот же день показываешь отчеты команде. https://github.com/metabase/metabase 10. zulip - командный чат, где каждое обсуждение - отдельная ветка. Работает на твоем сервере и заменяет платный Slack, когда команда перерастает бесплатный тариф. https://github.com/zulip/zulip
Скоро лето заканчивается, а мы никак не можем в ритм войти с нашим Research Mastermind! Надо это исправлять, поэтому завтра в среду 12 августа в 19:00 (GMT+3) у нас все по плану. Будет три интересных спикера с крутыми темами: Егор - Как я заменил Notion за $1,000 в месяц на собственную AI-платформу за $15 с нуля Покажу, как из идеи «давайте уйдем с Notion» за 3 недели собрал рабочую внутреннюю систему компании: корпоративная база знаний, пространство сотрудников, API, AI-агенты и PWA-приложение, которое ставится на компьютер и телефон без App Store и Google Play. Вся инфраструктура обходится примерно в $15 в месяц. Никита - Claude vs МойСклад (и любых других ERP) Связка дешевая в реализации, быстрая на подъем и понятная для коллег - особенно для малого и среднего бизнеса. Работники склада получили простой веб-интерфейс прямо с телефона, сервис проверки комплектности заказов исключил человеческий фактор, а прораб планирует производство в телефоне - документы в МойСклад создаются сами. Алексей - Снежный ком контекста: как мы остановили 90% утечки токенов в реальных AI-проектах Кажется, что токены уходят на «мышление» AI. На самом деле модель при каждом ответе перечитывает весь предыдущий разговор - контекст растет как снежный ком, и вы платите за его полный вес при каждом вопросе. Покажу, где утекает больше всего - с цифрами из реального production-проекта - и как это остановить без потери качества. Только об одном прошу: если зарегистрировались - приходите (мест ограниченное количество, не нужно занимать их из жадности). Вот ссылка на регистрацию: https://luma.com/oo1jdywv 👈 Если мест не хватило, записывайтесь в ожидание - постараюсь всех запустить. Ну а если не хватит - будет еще стрим на YouTube. Все. Жду завтра.
Забавно, как весь твиттер взбудоражился от новости, что Anthropic начал помечать невидимыми водяными знаками тексты, которые генерируют их модели. Не в метаданных, а прямо в тексте. Знак (водяной) не виден глазу, не меняет смысл и качество текста и переживает копипаст. Работает на уровне модели, поэтому помечается все, от API и приложения до Claude Code и доступа через облака Amazon, Google и Microsoft. А к сгенерированным файлам (.png, .svg, .jpg) теперь вкладывается криптоподпись по открытому стандарту C2PA (как я понял). Это все связано с комплаенсом. С 2 августа 2026 европейский AI Act требует делать ИИ-контент машинно-различимым. Поэтому маркируют пока только модели, запущенные после этой даты, а старые «в переходном периоде», то есть их тексты никто не помечает. Как вообще можно спрятать знак в словах? Anthropic деталей не раскрывает, но у Google похожая штука SynthID-Text уже два года работает в Gemini, так что механику можно подсмотреть там. Например, модель пишет «утром выпил кофе и ___ на работу» и выбирает между «поехал», «пошел» и «отправился». Секретный ключ вместе с несколькими предыдущими словами псевдослучайно делит словарь на «зеленые» и «красные» слова, и модель чуть чаще берет зеленые. Читатель видит обычный текст. А детектор с тем же ключом считает статистику. Если на тысячу слов зеленых 70% вместо ожидаемых 50%, текст писала модель. Поэтому в Anthropic и предупреждают, что детекция на небольших текстах срабатывать не будет, а вот ресечи, статьи или дипломные работы раскрасит как новогоднюю елку. Так что если они будут использовать что-то наподобие гугловского SynthID-Text, мы получим следующую историю: — Списка «слов-маркеров» не существует. Раскраска пересчитывается на каждом слове от контекста, найти знак глазами невозможно. — Короткие тексты и код почти не маркируются. Статистике нужен объем и свобода выбора между синонимами. — Знак появится, даже если Claude просто вычитал или перевел ваш собственный текст. Anthropic честно пишет, что watermark не доказывает авторство ИИ. — Проверить метку сможет только сам Anthropic. Детектор обещают «в будущей документации». В общем, все «хуманайзеры» и деслоп-промпты не работают. Они чистят стиль, а знак сидит в статистике выбора слов. Стереть его может только пересказ текста другой моделью. Ну или машина времени. Тексты моделей, вышедших до августа, не помечены до сих пор.
Вчера, 9 августа, браузер ChatGPT Atlas был закрыт. Вообще именно из-за OpenAI я решил, что лучше заберусь на забор и буду наблюдать, что происходит с рынком ИИ, в ожидании идеи, которая не будет выглядеть как еще одна потенциальная функция в интерфейсе ChatGPT. Собственно, так появился этот канал в начале 2023 года. Все еще помню тот ажиотаж и кучу раундов по привлечению инвестиций, когда каждый второй стартап в ИИ создавал проект формата «поговори со своим PDF-файлом». Загружаешь документ, и чат-бот отвечает на вопросы по нему. А уже через несколько месяцев эта функция появилась в ChatGPT, и у других крупных игроков со своими фронтир-моделями. Но на OpenAI можно смотреть и под другим углом. Эта компания не только запускает продукты, но и хоронит их. Есть даже сайт Killed by OpenAI (по образцу Killed by Google), где собраны неудачные продукты компании и их статусы. Одни похоронены, другие превратились в зомби. И вчера на этом кладбище прибавилось. Поэтому давайте придумывать что-то уникальное. То, что сложно забрать и быстро повторить.
Новый гайд в нашу серию «Для начинающих», на этот раз гайд про Агентов, Циклы и Графы Перевел статью про три уровня, которые важно освоить: Агент — вы даете цель вместо инструкции, и он идет к ней сам. Отличается от чата тремя вещами: инструменты, память, цикл Цикл — работа переделывается, пока не дотянет до планки. Ключевое: проверка должна уметь по-настоящему провалиться, иначе это не цикл, а Claude, который называет черновики готовыми. И обязательно жесткий предел попыток, иначе он будет тихо жечь деньги, буксуя на нерешаемой задаче Граф — независимые задачи идут параллельно и сходятся в один ответ. Внутри разбор ложных ребер (в любом вашем процессе найдется два-три шага, которые стоят в очереди без всякой причины) и правило, которое многие нарушают: агент, написавший результат, никогда не должен его проверять. Внутри 11 готовых промптов для копирования, схемы автора и код графов для Claude Code.
Давно не писал тут про ИИзнанку. С одной стороны, не хочется вносить смуту в эту уютную гавань ИИ-откровений, дабы не спугнуть устоявшийся вайб. А с другой, каждый новый участник приносит с собой что-то интересное: проекты, идеи, мнения, да хотя бы свое выступление в Research Mastermind. Это очень ценно. Поэтому напомню, что вы там получаете: — Главное - комьюнити из реально крутых профессионалов, большинство из которых не просто используют ИИ в своей жизни, но и зарабатывают на этом — Автоматическое попадание в Research Mastermind, где можно презентовать свой проект или тему, над которой работаете — Слоты со мной, чтобы созвониться и обсудить свои задачи. Как минимум помогу взглядом со стороны и полезными контактами — Цифры, форматы продвижения, находки в маркетинге, которые тут не выкладываю (все же тут мы про ИИ) — Доступ к нашему боту. Он анализирует общение внутри сообщества, поэтому не нужно постоянно там сидеть: можно попросить дайджест, о чем общались за неделю. А еще он подскажет контакты участников, которые работают с нужными вам задачами — Ну и конечно, скидки и специальные цены на все мероприятия, что проводит «Силиконовый мешок» Так что если вам не хватает понимания, как все работает под капотом, где там деньги, или волшебного пинка, заглядывайте за ИИзнанку.
Поставил себе в терминал Grok Build - это агент от xAI. Пользуюсь им прямо изнутри Claude Code. Открываю второе окно справа, и получается два агента в одном экране. Очень удобно, когда надо собрать контекст: скачать тред из твиттера, вытащить оттуда фото и видео, нарезать кадры, сложить в папку. Пока один пишет, второй таскает материал. Открытый код: github.com/xai-org/grok-build Документация: docs.x.ai/build/overview Перевел отличный гайд по нему, со всеми командами, примерами промптов и разбором, что он реально умеет.
Я, конечно, понимаю, что Google публичная компания и любые релизы влияют на стоимость акций. Но вам действительно пора выпустить Gemini 3.5 Pro. Напомню хронологию событий: — Объявлено в мае — Ожидается в июне — Переносят на июль — Gemini 3.6 Flash запущен первым — Gemini 4, по слухам, уже в обучении — Qwen продолжает выпускать новые модели — Grok 4.6 и 4.7 уже на подходе Парни, у меня подписка заканчивается, я был с вами до последнего… но могу соскочить.
Ох, как я помучился, создавая свою аватарку для сайта, которая будет следить за положением курсора. Пришлось переработать все инструкции, методики и, как всегда, изобрести свое. Но получилось. Так что в комментариях вас ждет MD-файл (skill) для реализации такого эффекта под себя. Скилл на русском, так что можно просто открыть и почитать