··• Серёжа печатает
СтатистикаХроникёр рынка. Product Owner в Skillaz, B2B/B2C, HRTech, Edtech, IT. Здесь коротко про продукт, найм, AI. Полная информация тут — https://popovs.tech/uplink Сотрудничество через Влада — https://t.me/vlad_0045 Попов Сергей Андреевич ИНН 780445359193
- Последний пост
- 14 авг.
- Последнее чтение
- 17:59
- Постов за неделю
- 7
- Всего постов
- 30
- Тип
- открытый
- Язык
- русский
- Категория
- Технологии (по похожим)
- В каталоге с
- 12 авг.
- 1/24сутки в ленте
- 433
- 1/48двое суток
- 496
- 1/72трое суток
- 535
Оценка по просмотрам недавних постов: пост набирает почти всё за первые сутки.
Посты
Рекорд автономности! В таком режиме Борис сделал с нуля сервис за 36 часов непрерывной работы. И сделал полную херню! Паххахаха Шучу, но оно просто на деплое развалилось, локально отлично всё, надо до шлифовать немного. Но от результата я в шоке.
Итак, за последние 2 месяца мы получили MiniMax M3 — открытая мультимодальная модель с контекстом 1 млн токенов. Ставка на код, computer use и автономных агентов. Microsoft MAI — сразу 7 моделей для reasoning, кода, изображений и голоса. Собственный модельный стек Microsoft вместо зависимости от OpenAI. Gemma 4 12B — текст, изображения и нативное аудио. Запускается локально на ноутбуке с 16 ГБ памяти. Nemotron 3 Ultra — открытая MoE-модель NVIDIA. Заявлена быстрее и дешевле классических больших моделей в длинных агентных задачах. GLM‑5.2 — кодовая модель с контекстом 1 млн токенов. Заявляет в 2,9 раза меньше вычислений на максимальном контексте. GPT‑5.6 — семейство Sol, Terra и Luna под разные цены и задачи. Sol заявлена сильнейшей моделью OpenAI для кода и агентов. Claude Sonnet 5 — массовая модель для кода и tool use. Заявлена близкой к Opus 4.8, но дешевле. Claude Opus 5 — модель для сложных и длинных агентных задач. Почти уровень Fable 5 примерно за половину её цены. Kimi K3 — 2,8 трлн параметров, зрение и контекст 1 млн токенов. Открытая альтернатива топовым закрытым моделям. Gemini 3.6 Flash — быстрая модель для кода и мультимодальных задач. Главный аргумент — баланс качества, скорости и цены. Qwen3.8‑Max — новый флагман Alibaba с текстом, изображениями, видео и контекстом 1 млн токенов. Заявлен сильнейшим Qwen для кода и агентов. Meta Muse — семейство моделей для reasoning, кода и computer use. Muse Glimmer можно запускать локально примерно на 20 ГБ памяти. Grok 4.6 — модель для длинных агентов и визуальных задач. xAI заявляет уровень GPT‑5.6 Sol по сводному тесту Artificial Analysis. DeepSeek V4‑Pro — агентная модель с expert mode и настройкой глубины reasoning. Заявлена стабильнее предыдущей версии в длинных задачах. GLM‑5.3 — свежая кодовая и cyber-модель Z.ai. Компания заявляет рост на 50% относительно GLM‑5.2, но открытые веса пока придержала ради проверки безопасности.
Да остановитесь блин
Очень много новых релизов. Настолько много, что они все смешались. Поэтому вместа разбора релизов — картинка, которая коротко описывает рынок ИИ.
Делаю агента, который будет помогать клиентам работать с системой. Пришло время финальной полировки. Говорю — сделай мне маскота, который максимальный и дружелюбный. И который выглядит так, что он готов помочь клиенту, но при этом он предупреждает иногда об опасных действиях. ChatGPT — ни слова больше.
Кстати да, Клод за процесс выше не шарит, пока что, он умеет только между сессиями передавать инфо, но создавать надо руками.
Субсессионный режим. Короче. Лёша (который не заводит канал) подсказал мне интересную штуку, на которую я не обратил внимание, хотя пользовался. Недавно Codex выпустил обновление, которое позволяет создавать из одной сессии (чата) новый чат внутри проекта. Во-первых, это удобно. Не надо руками переносить сессии с контекстом, а можно просто написать — продолжи в новой сесии, когда хочешь скинуть контекст. Но гораздо лучше — возможность организовать самый настоящий мультисессионный режим с оркестратором. Это не субагентный режим, потому что в субагенте он вызывает всё внутри себя и пишет, и ревьюит с учётом контекста, и это хорошо. Но там также есть лимиты на количество этих субагентов. В субсессионном режиме у тебя есть центральная сессия. Это по сути главный чат, в котором ты делаешь план. Например, у тебя уже была написана спека, и ты её раскладываешь на план прямо в планмоде и получаешь большой план. А дальше ты ему отдаёшь задачу из нескольких частей: 1. На каждый этап создавать новую сессию с подходящей или конкретной моделью. А он умеет именно брать разные модели и усилия. То есть это экономия токенов. 2. Он не только умеет их создавать. Он умеет с ними работать, то есть мониторить, проверять и писать. 3. Просим его следить за сессией, чтобы она не отклонялась от плана, не занималась оверинжинирингом, и просим подгонять это всё. 4. А после окончания сессии, чтобы основная сессия отревьюила это, передала правки или отправила план дальше в новую сессию. И мы для этой основной сессии задаём все правила, ограничения, ставим её в целевой режим, и он по сути работает за вас. Например, вы пишете ему: Ты — сова, эффективный менеджер. Твоя задача — реализовать план. На каждый этап или задачи создавай новую сессию в подходящей модели и усилии. Следи за каждой сессией, чтобы агент не отходил от плана, не создавал лишнего, не зацикливался на мелочах. Если видишь такое — корректируй его. По окончанию — делай ревью на качество и план, и либо создавай новую задачу, либо отдавай правки. Будь мудрым и подгоняй агентов, чтобы они работали максимально быстро. Борис в таком режиме в данный момент решает задачу 19 часов. И нет, это не бесконечный луп, это именно длинная последовательная внимательная работа. Конечно, такое можно и нужно не для всего использовать. Но я лично перестал вызывать субагентов почти. Я теперь прошу отдать в новую сессию на ревью и так далее. А дальше ещё сильнее.Смотрите. Мы оборачиваем это в скилл, который всё это делает, и говорим ему, что самые важные части мы отдаём в клод. Он вызывает локальный клод, передаёт ему задачу и анализирует ответ. Это скилл, который клод для кодекса. И всё. Как Лёша говорит — я что, животное, чтобы руками следить за агентами? Скилл — https://github.com/tsergeytovarov/codex-subsession-mode
Дал image2 ребёнку. Дамы и господа — ягода кряква!
Интересные новости https://www.cnews.ru/news/line/2026-08-06_gptunnel_obsuzhdaet_partnerstvo это кстати очень хороший пример того, как может конкуренция на локальном рынке поменяться
без подписи
Закончили первый AI-интенсив и собрали обратную связь. Мы взяли 22 человека! До конца дошли 10, проект сделали 6 человек. За месяц. Ребята воткнули нам 8 из 10, что неплохо. Что делали? Один участник развивал промышленное ПО для управления автоматом расстановки компонентов на печатные платы: камеры, OpenCV, микросервисная архитектура, калибровки, планировщик движений и веб-интерфейс оператора. Другой сделал мод-виджет Яндекс Музыки для «Мира Танков»: авторизация, своя музыка, радио «Моя волна», управление треками и громкостью. Ещё один участник сделал сервис сравнения смет из СТО для владельцев б/у автомобилей: Telegram-бот, сайт, история визитов и объяснение работ по автомобилю. Что оказалось самым важным? Самое важное, что случилось со всеми, — не прототипы. Главное — понимание, что агентская разработка — это не промпт. Один из отзывов хорошо это формулирует: «Курс оказался крайне полезным! Через этот курс удалось получить опыт кураторов, понять, что я делал не так с агентами, узнать о подходах и инструментах агентской разработки». И ещё важнее: «Главное — сдвинуть парадигму отношения к агентам с «ИИ ничерта не может сделать по моему промпту» в «ИИ круто помогает выявлять требования к проекту и находить детали, о которых я даже не думал». Следующие потоки будут. Будет более жёсткая структура по неделям, контрольные точки, микрозадания. Главный для меня: люди начали смотреть на агентов не как на магическую кнопку написать код, а как на рабочий инструмент для превращения идеи в систему.
https://t.me/ivan_plastun_channel/24 Хорошая мысль, кстати. Причём это частая ошибка руководителя и команды в целом. Психологически нам легко, когда уютно. Мы можем не обращать внимание на то, что мы застоялись, в тот момент, когда нам кажется, что вокруг всё круто. Именно поэтому надо стараться выходить из зоны комфорта и стараться трезво оценивать ситуацию и результаты. А также челенджить самих себя и команду. Ну и самому двигаться постоянно тоже надо и расширять кругозор. Кстати, неприятный, но необходимый вопрос, который переодически нужно себе задавать — меня в такие герои случайно не записали?
Сделал вам мем
Недавно проходил Yandex AI Studio Series — это серия образовательных лекций по ИИ. Там было много про инфру AI Studio, очевидно, но было и очень много теоретической информации, кторая максимально универсальна. Я смотрел и делал конспекты. А сейчас собрал всё в одно место с расшифровками, скринами презентаций. Вышло довольно комапактно, но полезно. Пользуйтесь https://popovs.tech/blog/yandex-ai-studio-series
Борис ночью пофиксил образ на brew, теперь его можно ставить и обновлять одной командой. И я добавил поддержку OpenCode, по просьбе чата. Теперь он считает и его тоже. https://github.com/tsergeytovarov/ai-stats
Наблюдение. ChatGPT неплохо раскладывает таро и нотальную карту.
Короче, вот это реально тема. Я прям вчера тестировал много, и оно работает. Сильно быстрее и экономнее, чем до этого. Тут сошлось пару факторов. 1. Переход исключительно на риск-тест. То есть он покрывает тестами не все 100% строк кода, а только там, где есть риски. 2. В конце той недели OpenAI сами пофиксили страсть к оверинженирингу и прожорливость. Как итог — за 2 дня почти неприрывной работы по 3 проектам 30% недельного лимита, на той неделе то же самое было почти в 2 раза больше. Ну и самое главное — пропали вот эти сессии на час по простой задаче. При этом обычный Superpowers даже новой версии, который это фиксил, мне не помог, я его докручивал.
А ещё сеттинги я тоже обновил и починил. Это которые про базове настройки. Зачем? Агенты совсем стали умными, и все прошлые штуки загоняют их в бесконечные циклы, слишком много тестов и ревью. Я вычистил это и на уровне глобальных настроек и на уровне того, как оно работает с superpowers. у меня стало прям заметно шустрее https://github.com/tsergeytovarov/ai-settings
у меня кстати день обновлений) в Burn приехало обновление, которое теперь все лимиты показывает в риалтайме ну и там много мелких улучшений, по скорости, производительности и вот это всё.
Короче я вчера ездил проводить два воркшопа по ИИ для ребят. Вывода 3. 1. Как всегда сложнее всего нащупать стартовый средний уровень, что у всех начало быстро получаться что-то делать. 2. Смотреть как у ребят начинает что-то получаться за полтора часа — бесценно. 3. Я слишком стар для того, чтобы вести два воркшопа в один день. Вывод три самый важный я думаю)