DEKSDEN notes
СтатистикаМои заметки на разные темы, уровень - "для продолжающих") Vibe Coding -> AI SWE, AI Coding Tools, Agents: Claude Code, Codex, news, links Чат (!!!): https://t.me/+B1fB3sZbaVthMDhi (с) 2025-2026, @deksden
- Последний пост
- 19:06
- Последнее чтение
- 21:45
- Постов за неделю
- 27
- Всего постов
- 63
- Тип
- открытый
- Язык
- русский
- Категория
- Новости и СМИ
- В каталоге с
- 12 авг.
- 1/24сутки в ленте
- 1 060
- 1/48двое суток
- 1 214
- 1/72трое суток
- 1 310
Оценка по просмотрам недавних постов: пост набирает почти всё за первые сутки.
Посты
⚪️ Акция SuperGrok на 50% дешевле 2 месяца Кому надо супергрок за $15 в месяц попробовать? 🔗 URL с акцией такой: https://grok.com/supergrok/targeted-offer/email-supergrok-50-off-2mo Пользуйтесь кому надо! я взял попробовать, к слову @deksden_notes
⚪️ Гибридные рельсовые флоу Поделюсь небольшим подходом, как строю свои флоу. Можно назвать их гибридными: детерминированные операции сочетаются с агентным флоу. Это всё работает для "рельсовых" флоу, когда у вас ясная последовательность действий, как код, с этапами, переходями чёткими между этапами. Траектории заранее обозначены - те самые "рельсы". Подход: для флоу делаем вспомогательное cli. У меня вот есть dd-flow cli. Оно для каждого флоу ведёт учёт запусков (я называю их RUN). Запуск флоу состоит из прохождения некоего алогритам из набора шагов. Через cli регистрируется начало шага и завершение, вот так примерно: dd-flow stage start <...много опций> Конечно cli делает ещё кучу вспомогательных вещей, но сейчасне об этом. 👉 Какую фишку придумал. В начале и конце стадии я выношу детерминированные операции. Агент инструктирван первым делом приступив к стадии вызвать cli команду регистрации стадии, и для завершения работы тоже вызвать cli команду. ▶️ Детерминированная регистрация стадии внутри cli на самом деле делает кучу детерминирвоанных шагов, необходимых агенту на этой стадии: например, читает текущий cwd, состояние git, сведения о этапе на котором работаем, сведения о команде cli которой надо будет завершать этап, ... При этом cli возвращает результат этих операций в виде результата команды. Например, в конце стадии вызывается cli команда с json в качестве аргумента, а в json всякие сведения о прошедшей стадии. cli на основании этого json делает md по шаблону, и html отчёт с этими данными генерирует для дашборда, раскладывая это все в нужные папочки. ▶️ Как я список этих детерминированных команд для cli получил? изначально стадия была полностью агентная, и агент, выполняя инструкции, делал определённые действия в начале каждой стадии. Я анализировал сессии агента, и все операции которые агент делал каждый раз, переносил в cli. ❓ В чем профит? Резкое ускорение флоу. Выполнение команд, сбор информации, выяснение точного формата вызова cli, - все это потребляет токены (не самое важное) и занимает значительное время. /Особенно если агент сталкивается с какой то проблемой, типа, неправильный формат данных где то, который не проходит валидацию. Сокращение времени которое я достигал на более-менее содержательных этапах - например, с 35 минут до 6-7 минут. Расход токенов - соответственно. Падения качества не происходит, содержательно вся работа выполняется аналогично (проверял). 👉 Резюме: cli наше всё. Что можно сделать детерминированно - делаем. Даже чтение отдельных документов. Это окупается. @deksden_notes
Кодите с AI на нескольких аккаунтах и устали упираться в лимиты? Знакомая боль: посреди важной задачи кончаются 5-часовые или недельные квоты, а переключение между рабочими и личными аккаунтами в Codex или Antigravity превращается в квест с перелогинами, потерей контекста и ручной проверкой «где сколько осталось». Для этого я написал и выложил в Open Source KeySwitcher - нативную утилиту для строки меню macOS. 💡 Чем KeySwitcher круче существующих решений и скриптов: 1. Не просто свитчер, а живой монитор квот в Menu Bar: Вам больше не нужно лезть в веб-панели. Прямо в строке меню в реальном времени видны проценты остатка и таймеры сброса (сброс через 45 мин) отдельно для Codex, Gemini и Claude / GPT. 2. Переключение без потери контекста: При смене аккаунта в Codex приложение не просто перезапускается, а автоматически открывает ваш активный тред, а в Google Antigravity синхронизирует авторизацию одновременно и для CLI (Keychain), и для IDE (SQLite). 3. Два главных AI-инструмента в одном окне: Поддержка и OpenAI Codex, и Google Antigravity в едином компактном дашборде без лишних вкладок и перегруженного интерфейса. 4. Нативный Swift, а не Electron-комбайн: Чистый AppKit + SwiftUI и стандартный системный Python macOS. Весит считанные мегабайты, запускается мгновенно, не жрёт память и не требует node_modules, pip или venv. 5. 100% локально и безопасно: Никаких промежуточных серверов или прокси. Токены лежат строго в вашем системном macOS Keychain. Для стримов и созвонов есть встроенная маскировка email в один клик. --- 📦 GitHub: https://github.com/uginy/keySwitcher 🚀 Скачать готовый .app (macOS 13+): https://github.com/uginy/keySwitcher/releases #opensource #macos #ai #developer #tools
⚪️ Qwen 3.8-27B Все читали, все знают что выпустили, и веса открыты - но не могу не сказать. Квен и был для мелких моделек СОТА, но текущие доработки делают его типа маленьким Опусом 4.6 на вашем собственном оборудовании. Это невероятно. Для реальных задач своего класса - это просто потрясающе. Да, мы наши заводы софта на нем не построим, но для работы в самолёте в ноуте он легко потянет. Для многих бизнес-задач вполне себе подходящая модель. В общем, выражаю респект квенам и спасибо что не бросают опенсорс. (ц) это не новость, это респект @deksden_notes
⚪️ Z.ai GLM 5.3 А вот и причина ресета от заек - новая GLM! Рост по всем бенчам заметный, превосходит или на уровне Кими К3, что очень здорово. Отдельно омтечают киберсек способности - что довольно важно в эпоху "мы отправили ваш запрос в опус 4.8". ▶️ С учётом того, что модель осталась не самых огромных размеров, 743b, есть шансы что она будет шустрой - у некоторых провайдеров как минимум. ▶️ Ещё один сабж в копилку тестирования. Уже доступна в кодингпланах и Zcode. В апи и открытом доступе будет позднее - как проведут "тестирвоание безопасности", что бы это ни значило. (ц) большие новости @deksden_notes
⚪️ GLM Reset Ребята тоже подхватывают тренд на ресеты! Наблюдаем рождение какого то подхода. Сначала установить лимит, потом его рандомно сбрасывать. Вроде бы радует, но что то тут меня смущает! @deksden_notes
Пока все сравнивают модели по SWE-bench и обсуждают, у кого лимит закончился быстрее, я решил посмотреть на вайб-кодинг с другой стороны. Допустим, агент уже написал код, потратил токены, запустил инструменты и объяснил, почему выбрал именно такое решение. А что от всей этой работы останется через месяц? Оказывается, у каждого CLI-харнесса свой ответ: - один пишет аккуратный JSONL, который можно открыть обычным tail - другой складывает историю в SQLite - третий сохраняет reasoning открытым текстом - четвертый шифрует его, но хотя бы оставляет summary - пятый записывает токены, но не деньги - шестой вообще не ставит версию формата, поэтому сторонние парсеры узнают об изменениях уже после поломки Так появился Session-Bench: я сравнил форматы сессий десяти CLI-агентов по 19 критериям. https://jazzyalex.github.io/agent-sessions/bench/
⚪️ Deepseek Harness Ну вот у нас теперь и упряжка от дипсиков. Надо ставить и тестить! Когда ж на все время.. Назвали упряжку незамысловато - Упряжка. Не Deepseek Build или Deepseek Code)) Написано на TS. Использует свой фреймворк - каноническая практика велосипедостроения, все как у людей. Но форсится одна идея: все - плагин. Models, tools, skills, sessions, sandboxes, filesystems, loops, orchestration, and UI. Немного напоминает pi, но даже радикальнее в чем то. Это заинтересовало. 🔗 гитхаб : https://github.com/deepseek-ai/deepseek-harness от коммьюнити уже есть быстро скрученные на коленке: 🔗 desktop : https://github.com/salathleizhang/deepseek-harness-desktop 🔗 Awesome каталог плагинов : https://github.com/awesome-dsh-plugin/awesome-dsh-plugin Это было быстро)) В общем, небезинтересно, как и все от DeepSeek. Отдельный респект за #opensource @deksden_notes
⚪️ Grok Reset Маск тоже сбросил лимиты - он в теме! Кому дадут красную кнопку то? Илон, нам нужен тибо-грок @deksden_notes
⚪️ Gpt 5.6 Sol Ultrafast на Церебрах Ну - чего они издеваются то? )) 750tps мы посмотрим на видео, как это.. Но потрогать нельзя, и я боюсь думать сколько это будет стоить в подписках! Сказал "привет" и лимит кончился. Зато ответило мигом. 🔗 У церебров анонс: https://x.com/cerebras/status/2087948820906950719 @deksden_notes
⚪️ Google Flash 3.7 Ну - бенчи вы и так посмотрите, скажу своё мнение. ▶️ Во первых: чего это на флеши всех прорвало? То DS 4 flash 0731 хайпует, отличная получилась модель, даже вышедший позже DS 4 pro 0813 по перфомансу её не особо перекрывает. Да, цены подняли в итоге - но они остались все равно очень и очень доступными. То клозедовская Луна собирает внимание после дропа цены на 80% - все распробовали что модель то весьма неплохая! Нет, не замена Сола, но тянет свои задачи! Muse опять же - скорее туда же, судя по ценам. И вот теперь - флеш от гугла. Ещё и со нижением цены в 2 раза, что не может не радовать! Мультимедийно гугл очень востребован, бенчи подросли - будет пользоваться спросом. Куплю на пару аккаунтов, пожалуй, подписку на год) Факап с 3.5 про несколько компенсирован. ▶️ Во вторых: интересен прогресс именно в мелких моделях. То ли научились пытать их током, то ли для мелкого объёма таки происходит гроканье - но перфоманс именно мелких моделей в последнее время радует и удивляет. Мне кажется, что имеющееся у топовых лаб количество компьюта в трейне сейчас позволяет им делать очень качественные мелкие модельки, довольно агентные и с отличной скоростью. Да, у моделей класса флеш нету той эрудиции или соображалки - но они берут скоростью, агентностью, натасканностью на конкретные задачи (кодинг?). 👉 Что буду проверять и на чем режутся модельки этого класса: на внимательности (следовании инструкциям), на работе с большим контекстом (насколько фатальна деградация после заполнения контекста на 30-50%), насколько они тупые (что будет при попадании в нестандартную ситуацию (хождение кругами, тупняки или более-менее вывозит). В целом, в интересное время живём! @deksden_notes
⚪️ Codex Reset Интрига не сложилась: пока ни продажи ресетов, ни прочих экзотических вариантов нету. Просто глобальный ресет всех платных планов! У меня уже докатилось до части аккаунтов —— upd 1️⃣ : мои Team аккаунты так и не обновились - только плюсы) Вот зачем надо держать смешанный пул! Такое раньше тоде бывало. Ну ок - будут разные даты зато ресетов! тоже удобно @deksden_notes
⚡️ Код горит, дедлайны горят, а Ян Гримм опять придумал «революционную метавселенную»? Я знаю, как сильно вам не хватает хаоса из офиса Mythic Quest. Поэтому ловите готовый набор ИИ-скиллов с психологическими портретами любимых героев. Теперь в вашей командной разработке официально есть всё: Ян Гримм — сгенерирует безумное видение без оглядки на логику. Поппи — устроит истерику из-за кривого кода. Брэд — молча монетизит ваши баги. А Джо просто выполнит приказ. Забирайте, настраивайте агентов и превращайте унылый рефакторинг в симулятор корпоративного выживания! ❤️🎮 https://github.com/ABIvan-Tech/mythic_quest_skills #opensource #skills
⚪️ Grok Manual Reset Грок, оказывается, не только с СС умеет фичи передирать! Молодцы, не брезгают и клозедами, несмотря на все обстоятельства. Неужели у них хватит духу склонировать кодекс апп? Было бы неплохо. Особенно в opensource )) Ну, ладно, чего я размечтался Пока всем пользователям Супер Грока дали ручной ресет, протухнет через месяц. Как работает X.ai мне определённо нравится @deksden_notes
⚪️ DeepSeek v4 Pro 0813 А вот и новый чекпоинт DS4Pro! Предыдущий релиз свежего чекпоинта DS4 Flash 0731 всех удивил отличным качеством работы. Бенчи нынешнего про тоже выглядят весьма празднично: немного выше или на уровне Опуса 4.8. Это отлично для модели которая стоит $0.435 / $0.87, что более чем на порядок меньше текущего фронтира, и даже более чем в 5 раз меньше свежего "доступного" грока 4.6. Надо будет обязательно тестить как себя будет вести модель в реальных своих эвалах, но оптимизм по её поводу - значительный! Опенсорс крут @deksden_notes
⚪️ Grok 4.6 Ну вот! стоит отвлечься на эфир, тут моделей уже насыпят.. У Маска наступило 7 августа, и вышел новый грок. Что можно сказать по материалам, представленным на релизе? Бенчи оч неплохие, на уровне фронтира. Видимо, похуже агентность (deepswe/tb3 немного пониже). Модель быстрая, и не дорогая - $2/$6. Акция: в Grok Build лимиты на неделю х2 поставили! Время тестить Новая модель доступна в курсоре, grok build, grok bot и api. Ну - будем сравнивать с ещё одним сегодняшним дебютантом, DS4Pro —— Upd 1️⃣ : контекст 500к - странно. Обычно все предпочитают 1М нынче, хотя и опасаются с ним работать (деградацию на большом контексте ещё никто до конца не победил) @deksden_notes
#иное Комьюнити-эфир 12 августа. Живая дискуссия про AI coding Без докладов и презентаций -> просто собираемся и обсуждаем, как сейчас реально работаем с AI-разработкой 🎙 Максим Ключников -> техлид и автор канала Этихлид, много экспериментирует с AI в разработке и инженерных процессах https://t.me/etechlead 🎙 Денис Киселёв -> AI SOLO founder, автор канала про AI-разработку, агентов и инженерные инструменты https://t.me/deksden_notes 🎙 Артем Летюшев -> Tech PM в Twinby и гильдмастер AI Engineers Guild https://t.me/junior_pm Поговорим про свежие модели и tokens per task, спеки, архитектуру, ADR и AI SDLC. Дальше как пойдёт Ссылка на событие https://luma.com/lwm1coqr 📍 Google Meet: https://meet.google.com/bzz-aeoo-vio 🗓 12 августа, среда 🕖 19:00–20:00 мск
⚪️ Codex Reset завтра? Вот как такое понимать? Если завтра, то включаем fast. Если нет - попадаем на 4 скучных дня)) Вот и гадаем. Я склоняюсь что нас ждёт ресет. Но уже немного утомляет неопределённость. Начните их продавать, наконец! @deksden_notes
⚪️ Grok 4.6 и Bot на SuperGrok Тут Илон пояснил за сабж 1) Grok 4.6 "позже на этой неделе" 2) Grok Bot будет расширен на другие тиры как пофиксят начальные проблемки - но сроков нету @deksden_notes
⚪️ Codex app теперь под Linux (preview) Не прошло и несколько лет, как построенный на мультиплатформенном электроне Кодекс апп наконец то смогли запустить на линухах! Ура Конечно, можно и ранее было юзать неофициальные репаки - но сейчас можно юзать официальные. Поддерживаются: • Ubuntu 24.04 LTS and 26.04 LTS • Debian 13 • Fedora 43 and 44 @deksden_notes