melikhov.dev
СтатистикаФронтенд, фронт-бек и около. Всё, что в голову пришло. нейрорак за нейроруку нейрогреку нейрослоп
- Последний пост
- 6 авг.
- Последнее чтение
- 12:18
- Постов за неделю
- 0
- Всего постов
- 21
- Тип
- открытый
- Язык
- русский
- Категория
- Технологии (по похожим)
- В каталоге с
- 12 авг.
- 1/24сутки в ленте
- 3 504
- 1/48двое суток
- 4 015
- 1/72трое суток
- 4 330
Оценка по просмотрам недавних постов: пост набирает почти всё за первые сутки.
Посты
Как же хорошо перечитывается сейчас «Трилогия Муравейника» Гибсона (она же Sprawl trilogy). Хотя, конечно, по моему мнению прямо перечитывать стоит только Нейроманта и рассказы(тот же «Сожжение Хром»), а «Мона Лиза Овердрайв» и «Граф Ноль» достаточно скучны и вторичны. Но не настолько плохи, как вторая и третья «Матрицы», определённое удовольствие принести могут. Где-то в Apple тоже это ощутили и бросились снимать экранизацию. Наконец-то мы увидим как выглядит небо над портом цвета экрана телевизора, настроенного на мёртвый канал. Это я к чему — в невыносимо неоднозначное время вы живём.
github показал очередную полезную штуку — Stacked pull requests. Даже жалко, что как обычно в последнее время у Гитхаба эта штука почти неработает. Прямо как новая страница All pull requests. Как пошутили в чате @webstandards_ru: гитхаб живёт в балансе. У него плохо работают новые штуки, но зато старые тоже работают плохо. При этом штука нужная. Я в своих AI PR тоже пришёл к необходимости дробить их на множество мелких, чтобы у ревьюверов не вытекали глаза вместе с мозгом. Но тут начинаются вопросы оркестрации этого добра. Надо каждый кусочек вручную вливать в main и дальше ребейзить всех потомков по цепочке. И ревьюверу как-то подсказать, что вот она, цепочка пиаров. А тут вроде бы из коробки всё есть. Здорово! Но не работает. Проверили на нескольких репозиториях — мёрдж стека зависает. И ничего не происходит. Отдельный минус, что менеджерить это добро надо через gh, выходить из привычной среды обитания. Но тут ладно, агент справится сам. Но хорошо, что понимают, что ревью изменилось. Будем ждать, пока стабилизируют.
Замечательный тул от Umputun который позволяет совсем не вылазить из консоли https://github.com/umputun/revdiff Ответ на вопрос «а как вы у себя там в консоли диффы смотрите-то?»
Как дотерпеть до вечера? Fable мне недоступен, так хоть Sol пощупаю (надеюсь).
Как дотерпеть до вечера? Fable мне недоступен, так хоть Sol пощупаю (надеюсь).
Браузерный AI-агент в Datalens В #ГриненкоПро №16 поговорили с Андреем Мелиховым, разработчиком Яндекс Облака и автором @melikhov_dev о его опыте создания AI-агента прямо в браузере: как он вызывает тулы, строит чарты, работает с данными, проверяет себя через eval harness и почему нельзя просто так взять и прикрутить LLM в продакшне. https://www.youtube.com/watch?v=chiexp7ncfg В выпуске: — почему готовых фреймворков не хватает; — как устроены AI-агенты в браузере; — SSE-стриминг, BFF, tool calling и agent loop; — проблемы разных моделей и инференсов; — evals, LLM-as-a-judge и железный пользователь; — доверие к числам в BI и проверяемые чарты; — заменит ли GenBI аналитиков; — MCP, серверные агенты и будущие API; — как Claude Code, Codex, OpenCode и другие coding agents меняют разработку; — почему AI ускоряет разработчика в 3–5 раз, но задач становится только больше; — безопасность и корпоративные ограничения; — AI вне работы: ремонт, ресёрч, медицина, презентации, NotebookLM и новостной бот Андрея; — bus factor, spec-driven development и контекст для агентов. Искренне рекомендую канал Андрея @melikhov_dev как минимум всем фронтендерам, сам читаю его давным-давно. Приходите обсудить выпуск в чат сообщества — @grinenko_pro. И, конечно, не забудьте подписаться на канал на YouTube — я уже монтирую совершенно огненный выпуск с настоящим AI-продактом! @devspotting
А поделитесь кто как организовал у себя команду агентов с разными ролями для ресёрча? Вот нужен был мне на днях глубокий ресёрч, я сделал баш-скрипт, который поделил роли для claude code -p и codex exec и по очереди они спорили а третий судья c pi на glm-5.2 решал в каждом раунде кто победил. Свою задачу я решил, но как-то это кустарно. Хочется чего-то более надёжного и постоянного. И явно я не один такой.
Замечательный тул от Umputun который позволяет совсем не вылазить из консоли https://github.com/umputun/revdiff Ответ на вопрос «а как вы у себя там в консоли диффы смотрите-то?»
С трудом выдерживаю поток новостей. Решил (как и многие сейчас наверное) автоматизировать дайджесты. OpenClaw тащить не хотелось, навайбкодил простые скрипты на Питоне — работает. Поднял VPS (2 vCPU, 4 GB RAM): - Telethon парсит телеграм каналы - feedparser…
Может быть нейронки пока нас и не замят — вон Хашимото пишет как плохо ему оптимизировал всё AI (там посыл, что человек глубоко погружённый в предметную область всё же сделает сложную задачу лучше). Но есть другая проблема — они заменяют пользователям сервисы и софт, которые мы пилим. Как человек, делающий BI я уже вижу вопросы — а зачем мне ваш DataLens, если я могу взять кликхаус и дать клод клоду задачку наверстать дэшей. Пупупу... А мы так гордились, что у нас низкий порог входа, но вот появился порог входа ещё ниже. И вот тут большая и сложная продуктовая задача, как дать такую добавленную ценность своему продукту, чтобы она перекрыла вот это кастомное решение под себя. Безопасность, гарантированное качество, воспроизводимость — ну в общем всё то, что нет так интересно человеку, которому просто нужен дэш, но очень важно и интересно бизнесу. Как только вас больше чем один пользователь в продукте, вот тут и начинаются интересные вопросы, которые, к счастью, пока так запросто нейронкой не порешать. Т.е. мне кажется SaaS для бизнеса пока может жить более менее спокойно. И чем крупнее бизнес — тем дольше ничего не будет угрожать классической разработке. А вот всё маленькое, тут гораздо сложнее. Нужно прямо сидеть и глубоко думать над сложно воспроизводимыми фичами. Например, в нашем агенте можно строить графики и делать выводы по датасету. Казалось бы та же история — натрави клод на кликхаус напрямую. Но вот только с клода пользователь получит SQL запрос (возможно нечитаемый) + визуализацию. Которые ему будет проверить в каких-то случаях непросто. Потому мы предлагаем вариант, где наш агент строит чарт через абстракцию, которая позволяет зайти в чарт в интерактивном режиме и проверить/уточнить все фильтры. И быть уверенным в полученных данных. Можно такое сделать в клоде? Можно. Но можно ли такое сделать быстро, дёшево и надёжно — вот тут уже нет. Но отдельный больной вопрос от пользователей — «так дайте просто богатый API, а я на него навешу уже клод, не нужны мне ваши интерфейсы, нужен только бэк». Ох, теснят фронтендеров, теснят 🙂
Насколько мне не зашли попытки подключаться из IDE к агентам через ACP (Agent Client Protocol), настолько же понравилось простое в лоб решение с Terminal Threads в Zed. Родилось оно, подозреваю, из желания хоть как-то спасти ситуацию после того, как Антропики буквально закопали ACP своим запретом так использовать подписку. Ну посмотрим, что ещё смогут прорастить туда зедовцы кроме нотификаций, и какую свинью в ответ снова подложат Антропики. Потому что хочется сращивать в своих пайплайнах разные модели. У меня сейчас счастливо трудятся вместе gpt-5.5 и опус. И разрешение на использование подписок только в проприетарных клиентах это флоу ломает. Пусть хотя бы тогда зед сам оркестрирует это, запуская в одном табе кодекс, во втором клод код. Нехороший движ этот с окукливанием моделей вокруг собственных харнесов. Неприятный.
К товарищам прилетел вопрос от пользователя — а почему ваша документация AI-недоступна? А почему? Потому что там React без SSR. Вот так-то, снова привет. Несмотря на то, что краулеры уже начились парсить CSR почти без вопросов, и мы привыкли так жить, но…
Сегодня долго спорили с Ромой, нужно ли (и можно ли) ревьювить тысячи строк кода, вылетающих из нейронки. Я однозначно пока за ревью. За декомпозицию задач, чтобы не было тех самых тысяч строк кода. За доскональное вычитывание того, что именно там сделано. Да, это требует времени, но время у нас появилось. Мы больше не набиваем код руками, не перебираем десятки файлов чтобы собрать отсутствующий контекст. И можем потратить это время на построение архитектуры и ревью. Но есть конечно и обратная сторона, связанная с когнитивной перегрузкой и Рома хорошо про неё написал. Но что делать-то? Ревью это не только про качество, но и про передачу знаний о кодовой базе. И отдав его на откуп тем же нейронкам мы рискуем совсем оторваться от понимания происходящего внутри продукта. А это, в свою очередь, усложнит разработку новых решений. И мы рискуем попасть в ту историю, как у мейнтейнера zed в разработке DeltaDB too much agentic coding led to code that smelled correct, but fell apart as soon as you started to build on it. I still edit the code manually to ensure the narrative is clear, to keep my mental model of the problem up to date, and to ensure that the code actually does what it purports to do https://zed.dev/blog/not-building-ai-for-the-money#concern-2-ai-code-is-worthless
С началом мая решил потренировать голову и поменять (в который раз) инструменты разработки. Сменил Ghostty на Kitty — при всём уважении к Митчеллу Хашимото Ghostty всё же сырой продукт. Но красивый. В замену к Claude Code поставил Pi, благо токены я жгу по ценам API и нет никаких вопросов со стороны Антропика. Привыкаю к дикой скорости и необузданному характеру этого харнесса, над которым нужно ещё свой слой изоляции навернуть. С другой стороны — ну а можем ли мы доверять встроенному сэндбоксингу любого харнесса? Так что пакуем в контейнеры/виртуалки и не даём ходить куда не надо. Большой плюс Pi, Opencode и других универсальных харнессов — возможность сидеть в разных LLM. Обычно у меня параллельно открыт проект в Opus/Sonnet в одном табе и gpt 5.5 во втором. Одна модель пишет код, вторая его критикует. Каких-то мегапайплайнов тут не выстраивал, просто делаю скиллы и дёргаю руками. Токенов у меня не много, не разгуляешься отдавать на откуп всё LLM. Скиллы тоже, кстати, пришлось подправить. Изначально написанные под CC они не такие уж универсальные оказались. Потому что чихать хотел Антропик на свой же agentskills.io. Стандарты для слабаков. Снова заехал в Zed. Долго боролся с его дурацкой привычкой выкачивать бинарники из интернета на удалённой машине. Да, нашлась настройка "ssh_connections": [ { // by default Zed will download the server binary from the internet on the remote. // When this is true, it'll be downloaded to your laptop and uploaded over SSH. // This is useful when your remote server has restricted internet access. "upload_binary_over_ssh": true, } ] Так какого лешего вы считаете, что по умолчанию в контейнере будет интернет (да ещё и не умеете в IPv6) ? Пытался подружиться с ACP в Zed, но никак мне не заходит. Банально жалко место на экране тратить, проще скакнуть в консоль, сделать там и в Zed поглядывать уже диффы. Ну и напоследок инсайты — Яндекс активно заезжает на TSGo в дев-среде (прод пока на обычном tsc конечно). Потому что обычный TS уже не справляется в условиях огромных монореп. Пора! Тут включу бабу Ягу и скажу, что мне не очень нравится, что лечат симптомы, а не болезнь — нужно уходить на Project References, а не заливать железом и горутинами, которые тоже не бесконечны (а уж в словиях macFUSE и подавно, хе-хе). Но это дорого, конечно.
Пока читал «Проект “Аве Мария”» Энди Вейера, никак не мог отделаться от мысли, что держу в руках производственный роман в стиле той же «Цели» Голдратта или хайповавшего во времена расцвета девопс-культуры «Проекта “Феникс”». Стиль: задача — объяснение — решение. Кстати, забавный факт: в случае «Феникса» не только названия похожи, но и именно так назывался проект SETI по поиску внеземных цивилизаций. Старички помнят SETI по SETI@home — когда мы отдавали машинное время личных компьютеров не на майнинг крипты, а на анализ радиосигналов. Возвращаясь к «Аве Марии»: книга увлекательная, но мне сложно назвать это художественной литературой. Скорее научпоп в обёртке производственного романа, где бодрый, весёлый Мэри Сью решает проблемы любой сложности с помощью НАУКИ. Не страдает ни герой, ни читатель, ни писатель. «Марсианин» как-то оставил больше послевкусия. upd всю книгу не мог отбросить мысль, какого чёрта на корабле не было приличной нейросетки. С их-то бесконечной энергией. Для романа из 2021 большой просчёт!
К товарищам прилетел вопрос от пользователя — а почему ваша документация AI-недоступна? А почему? Потому что там React без SSR. Вот так-то, снова привет. Несмотря на то, что краулеры уже начились парсить CSR почти без вопросов, и мы привыкли так жить, но тут SSR наносит ответный удар откуда не ждали. Хочешь, чтобы можно было эффективно кормить агента твоим контекстом — будь добр, научись отдавать всё без JS. Нет, конечно всегда можно запустить хедлесс хром, но это как-то максимально глупо (если мы говорим про документацию, а не богатый UI).
А вчера я удалил папку .roo из проекта. И мемори банки удалил.
И всё таки этим вашим бямкам не хватает простой советкой инженерой смекалочки. Если задача решает в лоб — они её решат. Если не решается, то будет придуман адовый воркэраунд (который скорее всего не будет работать). Вот три часа бился Опус у меня и так и не смог обойти проблемы Дипсика. А простой кондовый уникальный для этой задачи костыль — смог. Так что, господа инженеры-костылестроители, расслабляемся. Мы всё ещё достойны.
Выложил статью по мотивам декабрьского Субботника, расписал почему и как у нас в команде фронтендеры занимаются AI-агентами. Получилось несколько э... корпоративно, что ли. Но я не могу, когда вижу Хабр — хочется побыстрее сделать дело, пройти редактуру и уйти. В общем не лучшее моё творение, но вы заглядывайте, если тема близка. https://habr.com/ru/companies/yandex/articles/1022804/
Звучит это как-то так. Не бог весть что, конечно, но сойдёт послушать, пока гуляю с коляской. Может и оторву потом. Время такое, надо жечь токены и смеяться экспериментировать.