Vibe Coding: OpenCode, Claude Code, Codex, Cursor, Kilo
СтатистикаПишу про полностью автоматическую отгрузку Вайб Кода, свежие апдейты, промпты и тесты ИИ-инструментов.
- Последний пост
- 08:33
- Последнее чтение
- 18:42
- Постов за неделю
- 48
- Всего постов
- 62
- Тип
- открытый
- Язык
- русский
- В каталоге с
- 12 авг.
- 1/24сутки в ленте
- 423
- 1/48двое суток
- 484
- 1/72трое суток
- 522
Оценка по просмотрам недавних постов: пост набирает почти всё за первые сутки.
Посты
Ребята, ребята, а кто вообще пользуется Kilo Auto Free? Как вам это бесплатное ИИ кодирование?
Изменения цен на DeepSeek Если в кратце, то увеличили цены и добавили пиковое время: Key Changes: • New pricing effective 16:00 UTC, August 16, 2026 • Peak hours: 01:00-04:00 & 06:00-10:00 UTC (all other hours are off-peak) • Peak rates are 2x off-peak rates • Cache hit prices are increasing dramatically V4-Flash Changes (Old → New Off-Peak/Peak): • Input (cache hit): $0.0028 → $0.007/$0.014 (+150%/+400%) • Input (cache miss): $0.14 → $0.22/$0.44 (+57%/+214%) • Output: $0.28 → $0.66/$1.32 (+136%/+371%) V4-Pro Changes (Old → New Off-Peak/Peak): • Input (cache hit): $0.003625 → $0.022/$0.044 (+507%/+1,114%) • Input (cache miss): $0.435 → $0.66/$1.32 (+52%/+203%)
Ну вот и все, ГитХаб
Ребята, я очень не советую использовать bypass permissions on
Бывало такое, что 5 часовой лимит на Антропик закончился, а токенов на ollama еще вагон? А у вас 20 воркеров запущено, и надо теперь каждый переключать на другую модель\провайдера. Предлагаю вашему вниманию мою новую утилиту Сode Helper Умеет: • Создавать шоткаты для быстрого запуска кастомного провайдера. • Заменять провайдер и модель прямо во время работы Claude Code (и Codex) прямо на живую. Скажу честно, утилита была вдохновлена zai-coding-helper (вот только я ее переписал уж больно радикально под безголовый приоритет) Установка: pip install codehelper Утилита конечно еще кривая косая и сырая... но планирую ее дорабатывать, добавлять новые экзотические и странные функции. https://github.com/axisrow/code-helper - MIT
OpenCode начал блокировать BigPickle из РФ Теперь под ВПН работает, а без ВПН нет.
Новый deepseek-v4-pro-high-20260813 набрал 1584 elo на arena.ai Это всего на 3 elo больше, чем у DeepSeek V4 Flash и на 1 elo меньше, чем GLM-5.2 У DeepSeek оно постоянно так. Вот и думайте сами решайте сами, нужны вам эти три лишние ело иле нет. Любопытно, что цена DeepSeek V4 Flash выросла с $0.28 до $1.32. Вот как оно это так? GLM-5.3 ждем, интрига, сча 1700 elo наберет — первое место. https://arena.ai/leaderboard/code/webdev
Чем маленькие модели отличаются от больших моделей? Давно мучает вопрос, Opus - Sonnet - Haiku или Sol - Luna - Terra что выбирать для решения задачи? По своему опыту заметил, что чем модель дешевле (и меньше) тем она делает более "небрежно" что ли. Как это было год назад, запускаешь Sonnet 4.0 какой-нибудь, он такой фигак фигак и за 5 минут все сделал. Начинаешь проверять, по факту оказывается, что сам текст задания был сделан только на 30-40%, а агент уже сообщил, что сделано все. И вот за этой малышней типа GPT-5.4-mini или GPT-5.6 Luna я замечаю аналогичное поведение. И тем выше шансы, что где-то по середине задачи агент остановится и заявит, что все, надо выносить в фоллоу ап, задача мол слишком объемная и не доделает. Большие модели типа Opus 5 и GPT-5.6 Sol они наоборот склонны к оверинжинирину. Они ходят кругами, очень долго все перепроверяют, жгут миллионы токенов... но ... зато все работает. Только переплата за результат, если вы запускаете их на простые задания будет существенной. Как же быть? Сильно зависит от вашего опыта в вайб кодировании. Когда-то в 2023 году, промпт "Напиши змейку на Pygame" был сложной задачей, потому что, модель постоянно забывала какие-то импорты написать, и код просто не запускался. И с каждым годом эта граница сложности она все сдвигается и сдвигается, то что в прошлом году казалось сложным, сегодня реализуется одним промтом, ну и тенденция в следующем году должна быть аналогичная. Тем не менее, имеет смысл: 1. Если это типовая и аналогичная задача, которая уже решалась ранее - смело запускайте малые дешевые модели типа luna-medium 2. Если вы вообще не знаете как это делать - запускайте большую модель Opus 5 делать ресерч, а после нарезайте задачу на малые этапы и пусть мелкие модели делают, а большая модель за ними потом может перепроверить, что все сделано 100% полностью. 3. Возможны и другие сценарии использования, особенно если вы работает с большим количеством похожих унифицированных задач (но тут вопрос, зачем для этого LLM), тем не менее я допускаю, что у всех задачи разные. Не бойтесь экспериментировать, запускайте по 2 разных модели на решение одной задачи и сравнивайте кто лучше справился. Потеря времени 1 час, а экономия на токенах может быть вечной.
Новая функци в АО — Переключение из Codex CLI на Claude CLI Как это прекрасно! А ваш Desktop App так может? https://github.com/Untrivial-ai/agent-orchestrator
Вышел Qwen3.8-27B и он нагибает всех! Даже Opus4.6 Max Ладно, шучу, Opus 4.6 он нагибает только в SWE бенче, который вообще считается уже не валидным и устаревшим. Но за попытку похвально. Но вот Muse Glimmer он реально разбивает в пух и прах при аналогичном размере. ollama run qwen3.8 https://ollama.com/library/qwen3.8
Посчитал, во сколько мне обошлась игра для нового видео 🤯 Делал игру агентами 4,5 суток. Потом собрал всю статистику из логов и посмотрел на расход. Вышло 13,6 млрд токенов за 65 744 запроса к API. Средний запрос у меня весил 181 тысячу токенов, а ответ на него - меньше тысячи. То есть 98% расхода это перечитывание одного и того же по кругу. Дальше посчитал, сколько бы такой объём стоил по прайсу разных моделей: - GPT-5.6 Sol - $8 672; - Claude Opus 5 - $8 582; - Kimi K3 - $5 014; - GLM - $3 585; - DeepSeek V4 Pro - $503. DeepSeek дешевле в 17 раз, но это по стоимости API. Я плачу не за API, а подписку - Claude Max 20x, $200 в месяц (потребовалась более дорогая подписка для нового видео). Проект съел 85% недельного лимита за 4,5 дня. Одна неделя такой подписки стоит $50, значит игра обошлась мне примерно в $32. $32 вместо $8 582. Разница в 268 раз. И вот тут самое интересное. Даже DeepSeek по API выходит в 15 раз дороже, чем Claude по подписке. Получается так: - если платишь по API, надо брать китайцев, они дешевле в разы; - если платишь подписки, надо брать Anthropic или OpenAI, они дешевле в сотни раз. Сегодня-завтра выйдет ролик, там покажу весь процесс целиком.
Ребята, а у кого агенты уже работают 24/7?
Отключился ccstatusline и я увидел какой Claude Code приходит куцый и голый из коробки И это было отвратительно. Я голову сломал, что же произошло, я задолбил Opus и Fable вопросами. И вот в чем причина: 1. Когда claude впервые запускается в папке, он создаёт для неё запись в ~/.claude.json → projects["<path>"]. Поле hasTrustDialogAccepted при создании — false существует с 2.1.51. 2. В true оно переводится ровно одним способом: вы явно нажимаете «Yes» в trust-диалоге («Do you trust the files in this folder?»), который обычно показывается при первом входе в папку. 3. До 2.1.232 для git-репо, вложенного в уже доверенный каталог (~/Projects), диалог просто не показывался — trust наследовался от родителя. Поэтому запись создавалась и навсегда оставалась с дефолтным false, но всё работало как доверенное. 4. В 2.1.232 в changelog прямым текстом — «Fixed nested git repositories inheriting trust from a parent directory; each repository now requires its own trust confirmation». Убрали наследованные доверия только для git-репозиториев, папка осталась со своим false (по умолчанию), и статуслайн молча отключился. Старые сессии на 2.1.227–231 в других папках продолжали наследовать — отсюда «везде работает, тут нет». Еще раз в 2х словах: Т.е. в середине июня, я установил доверие корневой папке ~/Projects и диалог где можно было выбрать доверие Yes перестал появляться. А новое обновление 2.1.232 тихо убрало это обновление только для гит-репозиториев. В новых репо скорее всего будет спрашивать, но не факт (не тестировал). По-хорошему после этого изменения claude должен был заново показать trust-диалог при входе в такую папку — «теперь этому репо нужно своё подтверждение». Иначе, сессия стартует молча, флаг остаётся false, статуслайн и прочие trust-gated вещи тихо отваливаются без единого сообщения. То есть у пользователя нет ни диалога, ни индикации — только «что-то пропало». Ну че делать, я быстренько скрипт написал и заменил все false на true. https://github.com/anthropics/claude-code/issues/86824
без подписи
Посмотрите! Какую игрую в змейку создал GLM-5.3 Ребят, я наверное зажрался, ожидал большего! Промпт: Создайте Nokia 3310 с пиксельным экраном, игрой Змейка, составлением SMS и визуализатором классического рингтона. В Zcode: • Запускает свой какой-то встроенный бразуер. • При том что вижена у него нет На этот тест ушло 4% 5-ти часового лимита. Но я запускал как раз в этом удвоенном окне с 14 до 19 по Пекину
ZHIPU AI выпустили GLM-5.3 На Terminal‑Bench 3.0 результат вырос с 4,6% до 28,3%, на DeepSWE — с 46,2% до 66,9%. На Terminal‑Bench 3.0 GLM-5.3 набрала 28,3% против 17,4% у Kimi K3 и 21,1% у Opus 4.8. Fable 5 получила 33,7%, GPT-5.6 Sol — 34,6%. Но самая интрига — это цена! Потому что цена еще не объявлена! Веса обещают открыть через две недели, после дополнительной проверки безопасности. https://z.ai/blog/glm-5.3
Computer History в ChatGPT Что же показали нам OpenAI в четвергушном обновлении? Перевели все на русский язык! «История компьютера» — это функция, доступная по желанию в настольном приложении ChatGPT для macOS, которая преобразует активность в различных приложениях и на веб-сайтах в воспоминания и хронологию, которые могут использовать ChatGPT и Codex. Выберите, какие приложения и веб-сайты будут участвовать в сборе данных, приостановите сбор, а также просмотрите или удалите свою историю в любое время. Я вот все жду, когда они наконец-то доступ к Time Machine сделают, т.к. им персональных данных постоянно не хватает. https://learn.chatgpt.com/docs/changelog?type=codex-app
Приложение ChatGPT (Codex) App теперь на Linux Знаю, ребята, вы этого ждали: Ubuntu cd ~/Downloads sudo apt install ./chatgpt_amd64.deb Fedora cd ~/Downloads sudo dnf install ./chatgpt.x86_64.rpm Включите автоматические обновления в разделе «Настройки» > «Импорт» , чтобы поддерживать синхронизацию импортированных работ. Codex CLI также может импортировать поддерживаемые настройки и последние чаты из Claude Code и Cursor с помощью /import. https://learn.chatgpt.com/docs/linux/linux-app
По 1С хочу порекомендовать канал моего друга Петра @yellow_ai_vibe
Кстати, свежий 1С бенч Чем меня такие бенчи привлекают, то что мало обучающих примеров (тем более на русском языке) и вот тут-то так сказать хорошо выявляется умение модели действительно программировать, а не следовать обучающим данным. https://vibecoding1c.ru/bench