ivan zakutni
описание
Авторский канал про инженерию умных систем. SDD, AI/Human collaboration, инженерное мышление. Связь: @m0n0x41d
572
подписчиков
Охват к подписчикам
117,0%
ERR
Реакции к просмотрам
3,44%
460 на 20 постов
Пересылки к просмотрам
1,67%
223
Постов в день
0,3
всего 21
Где отзываются чаще
доля реакций к просмотрам- 13 авг.Лучший harness — это вы и ваши AI-агенты harness – еще одно новояз словечко которое полностью вошло в ментальность и звучит из каждого утюга. Первоклассный зонтичный термин с эталонным фан аутом – вот говорит кто-то harness, и черт его знает что там – набор скиллов? Мега AGENTS.md? RFC? Кастомный Pi? Или другой OpenCode на стероидах? MCP сервер? Все вместе? Каждый раз как в первый раз в первый класс)) Приглашаю вас со мной сделать zoom-out за чашкой кофе и вспомнить арку про Augmented Intelligence в свежем письме. Прошло уже больше года с той заметки, и imho – в этом мета-моменте не поменялось вообще ничего, хотя AI и стал намного умнее. Почитал сам – дай почитать другому :)6,84%
- 6 июл.Я первый раз попробовал v0.dev и лучше бы не пробовал. Название, вообще, очень точное – на выходе у меня получился именно v0 фронтенд, настолько кривой, что отвратительный! с ним ничего нельзя сделать кроме как выкинуть к чертовой слопобабушке! Возможно... v0 работает хорошо/лучше с react. Ну мб, но зачем мне реакт? Мне надо vue. Возможно, подумаете вы, я скормил ему плохой промпт? Но нет, я скормил ему specs из haft которые, на минуточку, формировались почти полторы недели, плюс DESIGN.md и PRODUCT.md выведенные из этих самых specs с помощью impeccable Да, я редко пишу про прикладные штуки. Но сейчас я все таки пишу, потому что impaccable это мощь! Сила! Класс! Срочно пробуйте! В сетапе где у вас есть уже отличные спеки, объясняющие что вы строите (ждите, 8.2.0 haft скоро будет, и я все расскажу, что оно и как и какие спеки вам помогает писать. Да, это байт на лайки), и хороший агент который умеет генерировать изображения и ходить в браузер, смотреть и мучать что он там наделал... получится хорошо. В моем случае "хороший агент", это codex, в частности – codex app. Я не знаю насколько хороша интеграция с браузером в codex cli, но апп прямо из коробки хорошо молотит с playwright. Вообще какое-то время я уже почти не пользуюсь cli агентами как основной средой, все headless и one-shot комманды. Но об этом тоже в другой раз))) Итак, ваша формула успеха в agentic фронтенде: 0) крутой агент и крутое окружение (читай Codex App, вам там и терминал, и worktrees, и браузер, и ничего не тормозит давно), impeccable, и shadcn (для vue или реакта, если любите пожирнее). Ставити все это в своей проект и сражаетесь. 1) Думаю что можно начать с голого поля, и собирать design и product "спеки" прямо с impeccable, но я рекомендую подойти серьезнее)) 2) Все! Сверху можно добавить для ускорения и мега красоты сниппеты с каких нубудь сайтов вроде vue-bits (для реакта такого добра еще больше), ибо с shadcn не всегда вывозит с первого раза. Impeccable умеет полировать, оптимизировать и ускорять, там вообще отличный пласт фронтенд мудрости упакован, так что с последних сайтов всякие тяжелые анимации оно успешно переписывает чтобы работало на утюгах. Ставь: огонек – если не понял почему я топлю за Codex App и хочешь пояснений хотдог – если имеешь претензии по поводу отсутствия haft 8.2.0 в релизах желтый морда с вопросом – если я пишу в блог слишком редко, а надо чаще.6,79%
- 10 авг.да, кстати, там наконец-то вышел Haft v9. точнее он уже v9.0.2)) Дока тут. В течении какого то времени в доке еще добавится что то вроде work/cool-books для самых маленьких. Но вы можете это не ждать, ставь да пользуйся блин) История с v9 была примерно такая: Прямо перед моим закрытым стримом в AI подлодке несколько недель назад в FPF произошла куча изменений. А до этих изменений я параллельно городил в Haft костыли для pattern retrieval, и вот раз и Анатолий Игоревич Левенчук взял и сделал этот условный базовый retrieval уже внутри самого FPF. Одновременно оказалось, что извлечение карточек можно имплементировать проще, без псевдо-умных роутеров, которые якобы знают FPF лучше самого FPF)))) Туда же добавляется тот факто, что за последние полтора месяца прошло пять семинаров по FPF. Из них стало понятно много новых ходов, как улучшить Haft – в частности с самых первых семинаров пришел сильный ход на улучшение именно как проектнрй памяти Теперь Haft стремится помнить не только отдельные решения и заметки, но держит связанный граф проекта: сущности, проблемы, варианты, наши решения, spec sections, evidence, код и отношения между ними. Это нужно чтобы агент мог зайти через вопрос, файл или символ из кода и поднять нужный кусок этого графа)))) Помогает понять, какие решения рядом, чем они были обоснованы, какие спеки относятся к коду и даже может отловаить если оно подпротухло! В итоге в v9.0.0 появились: – source-native FPF Query: concern retrieval, exact lookup и inspect прямо по запеченному в релиз FPF-Spec.md (с этого дня оставание от FPF будет меньше и релизить будем чаще!) – typed project memory с entities, aliases, relations, provenance и bounded neighborhood вокруг предмета работы (та самая проектная память, но ее надо тестить, welcome!) – fused graph памяти о проекте, коде и reasoning-артефактах; – улучшил онбординг и spec sections. Target System и Software System спеки это на самом деле тоже новая фича, в 8 версии они были жутко недоделанные, но сейчас кажется можно пользоваться! В старый или новый проект заходите через скиллы h-onboard / h-spec и haft сам должен проести вас по системному моделированию) – Haft толстоват в плане интерфейса – в нем 12 независимых скиллов и 12 MCP тулов, но совсем нет никаких обязательных, детерминированных последовательностей как это было когда то дваным давно. На самом деле почти для любого вопроса можно использовать просто зонтичный скилл – h-reason. Если проблема ещё не сформулирована – h-frame. Если есть конкретный сбой и непонятна причина – h-diagnose. Но все скиллы теперь ваш агент может вызывать сам, он разберется)))) короче говоря, я думаю что порог вхождения в haft стал все таки много меньше! При этом Haft стал потоньше на лишние штуки, полностью выпилены экспериментальные haft run, haft harness (Open-Sleigh и весь Elixir/OTP/BEAM runtime – ничего из этого не надо, полное комодити. Хост агенты прекрасно вызывают суб-агентов и они так же хорошо сами используют haft скилы и тулы). Haft больше не пытается (и не будет пытаться) быть ещё одним агентом рядом с вашим основным. Пусть Codex, Claude Code или еще кто нибудь выполняет работу! Задача Haft – помнить, почему эта работа вообще делается, что было решено раньше, где это живёт в коде и на каких уликах оно держится. *** Я не удивлюсь если там есть баги, ибо я с haft имею ноль шекелей, делалось там дофига, тестить там тоже дофига, Тем не менее догфуддинг и еще N больших и средних проектов новая версия пережила, в том числе greenfield, поэтому релиз больше откладывать смысла нет. В случае нахождения любых ошибок, пожеланий и предложений, вы знаете куда они идти – принимаются в порядке записи по талонам в github issue. Всем добра ☺️6,67%
- 13 июл.Привет! В ответ на реакции к посту выше поясняю свою позицию за Codex App 😈 TL;DR: я сфокусировал работу в Codex App, потому что для меня он оказался лучшей – да и вообще наиболее цельной – средой агентской разработки. Я меньше отвлекаюсь/переключаю контекст, лучше контролирую параллельную работу и, что особенно важно, я снова стал гораздо чаще читать (и писать) код, тесты и диффы. А GPT-модели начиная с 5.5 оказались для меня намного более лучшими инженерными друзьями, чем опус и сказочка. С месяц назад я выбирал на чем остаться Claude vs ChatGPT (200$). Выбор был сделан в пользу второго. В том числе потому, что FPF последних версий уже не влезает в Claude Desktop. Кстати, история с Fable случилась буквально в последние дни моей активной подписки на Claude, бгг. Скажу так – я по CC я не скучаю вообще, вот ни чуточки) Codex App стал сейчас прям хорош. Работает шустро, GPT-модели не так прожорливы на токены, а компакт контекста просто великолепный! В нём удобно читать код, комментировать диффы и открывать файлы во внешнем редакторе (у меня это Zed.) это особенно актуально, потому что сложность моих последних проектов такая, что вообще не читать код, тесты и диффы абсолютно непозволительно. ремоут сессии были последней фичей что держала меня в CC – я прям много работаю с телефона. я не знаю что тут еще добавиь, разве этого мало? Worktrees в один клик? сommit-and-push и address comments в гитхабе в пару кликов? Пет, который не навязчиво привлекает внимание, когда оно требуется? (open peon в CC меня задрочил до нервного тика) Терминал под рукой? Пока писал этот пост, увидел, что ещё и просмотр PR'ов привезли в сайдбар) По отдельности всё это кажется набором мелких фич, но в том то и прикол, что вместе они убирают огромный слой ручной и полуручной диспетчерезации, как бы не было удобненько в tmux вкладках, но в единой среде с хорошим интерфейсом работать приятнее и проще. Я долго был под чарами Антропик, но теперь они похоже совсем развеялись. Антропиковские модели хороши. Особенно хороши они в прозе) Мне не нужна проза! с прозой мне нравится разбираться самому!!! Мне нужен peer engineer и удобная среда, в которой я могу думать, пока плюю в потолок, и в которой мне не приходится переключаться по вкладкам как амфетаминовая белка, и тратить столь много человеческой оперативки (которой так мало) на удержание в голове всего этого безобразия Мне нужна среда в которой можно не терять активные треды и быстро понимать статус каждой активной работы. Мне нужна среда, в которой релизы не ломают базовый функционал (че там как дела с глитчами сс?), а приносят новые полезные фичи! вот Codex App всё это даёт. И ещё кучу приятных вещей: быстрые скриншоты экрана, которые сразу влетают в активный тред, интеграцию с playwright из коробки и браузер с аннотациями, чтобы при разработке фронтендов лучше тягать агента за уши))) Claude Code многое из этого нормально не даёт, а чего-то из этого в нём вообще не будет в виду ограничений среды. Конечно, это совсем разные продукты. Я не утверждаю, что GUI в принципе лучше терминала. Но для управления несколькими долгоживущими агентскими задачами CLI лично для меня перестал быть самым удобным и эффективным интерфейсом. Еще мне нравится OpenAI не стремится запирать пользователей внутри одного интерфейса. Лимиты кодекса всё ещё можно использовать через разные другие инструменты – OpenCode, Zed, name your thing – да хоть в собственных не коммерческих ИИ-приложухах, смотришь как авторизация в codex cli работает и делаешь так же))) Сколько такая политика проживёт – посмотрим, но прямо сейчас это топ. В конце концов, все сейчас говорят про harness, и вот harness это не про то насколько эффектно агент генерирует код, и не только про автономную молотилку goal десятки часов, но еще и про то, насколько хорошо _человек_ может управлять несколькими потоками работы и при этом сам оставаться внутри инженерного процесса. И вот это, имхо, Codex App сейчас делает лучше всех остальных тулов. Ставь огонь если Codex App топ, и желтый морда с вопросом, если не понимаешь зачем читать код.6,38%
- 7 авг.без подписи5,73%
- 17 мар.Если вы вдруг послушали вчерашний подкаст и побежали пробовать quint-code – остановитесь! Потому что переписывание квинткода пошло куда быстрее и лучше, чем я думал. Версия 5 (которая сейчас в dev ветке – намек поняли?) переделана в плане интерфейса более чем полностью! Фрикций меньше, easy-mode есть, онбординг проще! Раньше квинт код затащить в brownfield было сложнее, а теперь... А теперь только пальцем покажи! По поводу фрейма – если раньше QC был ADI focused, то теперь тут на первом месте ProblemOps – у вас все идет от проблем! Сначала вы ее фреймите, потом углубляетесь в нее. Или не углубляетесь, квинткод сам скажет – "эээ, бро, ну это совсем trivial, давай, может, сразу пофиксим и запишем артефакт decision?" И таки пофиксит! И запишет! То есть "автодокументация" из старого квинта все еще остается. И довелась до ума фишка с устареванием артефактов – тут будет RefreshOps! Мне очень нравится, что получается. Я уже во всю использую nightly сборку и для догфудинга, и для рабочих проектов. Я думаю, что на этой неделе 5 версия выкатится в main официально 🙂 А дальше – больше! У меня уже есть наполеоновские планы куда делать ходы чтобы "штука" была более FPF complient. И все это с более человеческим UX, который вас не карает. Никаких фашиствующих стейт машин. да, все еще придется разобраться в этом интерфейсе – что там за команда, в каком порядке и примерно для чего их вызывать надо... но это много проще, и даже если не разобраться, базовый /q-reason теперь умет в "основной" FPF. В общем огонь!5,45%
- 30 июл.5 вещей, которые я хотел бы осознать раньше на пути из эникейщика в инженера Читайте весь текст => тут <= 1. Проблема, которая кажется технической, часто находится в договорённостях между людьми 2. Архитектуру нельзя выбирать лишь потому, что она стильная-модная или интеллектуально привлекательная 3. Коллекция фреймворков не заменяет развитого мышления 4. Сильные специалисты не компенсируют плохо спроектированную коллективную работу 5. Я слишком поздно научился проверять, существует ли вообще задача, которую собрались решать *** Перешли коллеге или другу, которому это будет полезно 🙂4,96%
- 18 мар.Добрый вечер, я – диспетчер пятой версии Quint Code 🎉 Кто-то ждал этого так долго, что уже перестал ждать. Кто-то (я) не ждал этого вообще и похоронил Quint Code в мыслях и сердце своем уже как месяц-другой (я во всю уже собирался делать standalone cli agent – но зачем?), пользовался FPF-Spec.md + Чатик, и мечтал об "умном агенте инженере но так чтобы и мозги не делал мне, и по FPF умел когда надо..." В общем есть много чего почитать: • Обновленный лендинг -> https://quint.codes/ • Длиннопост на русском который я обещал на стриме у Родиона • Длиннопост на английском там же или на SubStack ПОДПИШИСЬ 💗 TL;DR – оно стало лучше; Оно стало тем чем должно было быть с самого начала. И есть куда расти! Пока я обновлял лендинг, свой сайт и дописывал письмо – уже почти готова 5.1.0 🤣 – но все подробности читайте по ссылкам выше! С вас – поделиться с другом, я ведь не только для себя QC делаю, чем больше будет фидбека тем лучше оно станет. Впрочем идея standalone режима не мертва 🤫4,10%
- 16 мар.Ну вот и прошел наш стрим! Как мне кажется вышло вполне не плохо! Мы отошли в некоторой степени (примерно на половину) от моего плана, но все равно получилось здорово! Отдельное спасибо Анатолию Игоревичу за поддержку в чате! Про FPF и системное мышление очень тяжело говорить, особенно когда ты далеко от хотя бы какой то квалификации в последнем 🙏 Для всех кто слушал подкаст, вот обещанная "методичка", а на самом деле минимальная напоминалка об FPF и шаги с которых вы можете начать прямо сегодня. На днях я дополнительно напишу пост, проговорю все что хотел по плану стрима, плюс планы на сам quint-code – почему я его воскрешаю и как думаю его развивать! *** Подписывайтесь на Канал Родиона AI-Driven Development Забирайте FPF Simple Skill Пробуйте Quint Code Оригинал FPF Спецификации Анатолия Левенчука Больше ссылок, напоминалки и примеры промптов в прикрепленном маркдауне. stay tuned как говорится, и спасибо за ваше внимание 💖3,83%
- 6 авг.без подписи3,59%
- 29 мар.Что происходит в репозитории квинткода? Снаружи выглядит как тишина, было несколько мелких релизов с добавлением C/C++ spec coverage, мелкие и средние багфиксы. В dev ветке тоже тихо, но это на remote origin))) В локальном репозитории происходит жуть. Где-то на ~80% готов standalone agent. ЧТОООО? что это значит? MCP-plugin костыли – press F? Нет. Ядро quint-code достаточно чистое, оно выживает – мне почти ничего не мешает строить агента вокруг него. Но standalone агент – это вообще другой класс инструмента. TL;DR: MCP-plugin – это попытка вставить FPF-инструменты в чужой reasoning loop. Standalone agent – это попытка выстроить FPF reasoning loop с собственными инструментами. *** Фундаментальная проблема MCP-плагин режима: хост-агент (Claude Code, Cursor, кто угодно) контролирует reasoning loop. Мы можем напихать ему инструменты через MCP или скиллы, но не можем НОРМАЛЬНО контролировать, когда и в каком порядке он их вызывает. Мы, конечно, можем продолжать работать с дистиллятом-промптом типа "сначала сформулируй проблему, потом исследуй варианты, потом реши", но это не структурное решение, никакого контроля за работой нет. А ведь так хочется рабочий цикл (а точнее лемнискату), где между фазами будет нормальный hand-off задач, артефактов, сигналы не будут теряться. И вот новый агент отдаёт контроль над reasoning loop естественным образом мне (а я вам). Тотальный context engineering – я контролирую что, когда и сколько попадает в контекст LLM. Собираю системный промпт на каждой фазе. Сделал нормальный repo-map через tree-sitter (я вообще не уверен, что Claude Code тащит его под собой, потому что мой агент УЖЕ лучше ориентируется в больших репозиториях, чем Claude Code. Это, конечно, субъективное ощущение – моё и Claude Code. Когда я последнему принёс отчёт о проблеме от нового агента, Claude Code сказал "ого, солидно, я это всё упустил". Да, догфудинг нового агента уже начинается), а значит decision records после имплементации будут не просто про файлы знать, а уже на уровне строк/сущностей в коде. Потом появится overseer процесс в том или ином виде, который будет по шине агенту "бить по рукам", если он потенциально начнёт ломать "установленные инварианты". Туда же потом приедет LSP. Компакт, и всё-всё-всё остальное прочее тоже пишем сами. Я не заявляю, что Борис и Ко что-то делают не так, просто цели другие, что ли. Ну и так далее по списку. *** Этот мой агент, конечно, целиком successor библиотек charmbracelet – всё у них хорошо (кроме нехватки функциональных возможностей crush 🤣), поэтому интерфейс обещает быть приятным. Разумеется, я планирую "саксессировать" и на их catwalk – репозитории провайдеров и моделей, поэтому новый агент будет поддерживать всё, что поддерживается и там. И да, к сожалению, Anthropic всё-таки встал в позу "не юзайте auth токен от Pro/Max подписки". Я до конца не решил, что с этим делать. Возможно, появится какой-то плагин/сайдкар/прокси в опенсорсе (как у opencode), который позволит использовать, возможно, нет. Одно хорошо – поза OpenAI/Codex в этом вопросе – одобрительная, так что догфудинг уже происходит на 5.4 из codex подписки)) quint-code будет переименован, ибо "Не путайте с языком спецификаций" мне надоело. Но об этом в другой раз. upd. Ну да, ядро то же остается, артефакты в базу пишутся – значит mcp живой, значит будет оно дружить со всеми вашими другими агентами если пожелаете)))3,32%
- 20 мар.🚀 quint-code 5.1.0 Мы строили строили и наконец! Что там внутри: Codebase Awareness – квинткод теперь видит ваш проект не как набор файлов, а как структуру модулей. Go, TypeScript, Python, Rust – парсит импорты, строит граф зависимостей, показывает какие модули покрыты решениями, а какие нэт. Может быть полезным. Вы же хотите себе доку для каждого модуля?))) Spec Coverage блин! Когда код под решением меняется – drift detection поднимает флаг в /q-status. Когда модуль A меняется и от него зависит модуль B – вам тоже об этом должн квинткод сказать. Cross-Project Recall – решения теперь живут не в репе, а в вашей домашней директории. Фреймите (/q-frame) проблему в проекте B – и вам (вашему агенту, ну в общем) с высокой вероятностью всплывает похожее решение из проекта A, которое вы приняли какое-то время назад. Еще и с пометкой насколько контекст релевантен))) Зачаточный Decision Integrity – перед записью решения агент теперь запускает adversarial check, я знаю что модели сами себя критикуют плохо, да еще с тем же контекстом, но это лучше чем ничего (этому есть куда расти в будущем). Note-Decision Dedup – если агент попробуе записать заметку которая дублирует существующее решение то MCP даст по рукам, поймает и скажет "бро, тут эт, уже есть dec-003, может не надо?" Ну и дока, к новой версии и еще лучше! И там больше деталей, читайте. Например там про то что quint-code еще и проблем-таск-трекер...) Миграция с 5.0: quint-code init в каждом проекте. Данные сохранятся, база сама переедет в ~/.quint-code/. Подробности там же в доке. Что дальше? НУ вообще надо делать нормальный Team mode. Центральный сервер, один бинарь, PostgreSQL или SQLite на выбор, мысли такие. Архитектура уже заложена. Но это уже следующая и длиннющая серия. ⭐ github.com/m0n0x41d/quint-code2,71%