Вайб-кодинг
СтатистикаАвторский канал по ВАЙБ КОДИНГУ Ссылка для друзей: https://t.me/+ll3pbl442dNkZmYy Cотрудничество: @devmangx РКН: https://clck.ru/3RRVfk
- Последний пост
- 11:11
- Последнее чтение
- 16:55
- Постов за неделю
- 43
- Всего постов
- 48
- Тип
- открытый
- Язык
- русский
- Категория
- Блоги
- В каталоге с
- 12 авг.
- 1/24сутки в ленте
- 16 714
- 1/48двое суток
- 18 272
- 1/72трое суток
- 19 706
Медиана по постам, которые мы застали свежими и померили через сутки.
Посты
Бесплатный 30-минутный курс по памяти в агентных системах от бывшего инженера Google. 0:00 — почему каждый вызов LLM начинается с амнезии 2:31 — хранение памяти в тексте, таблицах или графах 5:04 — четыре способа поиска — ничего не делать, ключевые слова, RAG, Graph RAG 7:29 — поддержка памяти — добавление, удаление, retire, attribution, reflection 9:47 — собираем всё на обычном тексте и SQLite 13:13 — добавляем векторное хранилище только тогда, когда оно действительно нужно 14:38 — память в строках, графовая память и временной граф 21:03 — запускаем код для всех пяти вариантов
Тибо из OpenAI пришёл за Opus. 🔫 Сначала он спросил, почему компании до сих пор используют Opus вместо Sol и неужели цена для них не имеет значения. А затем объяснил свою позицию подробнее. "Один токен OpenAI не равен одному токену другой модели". Мы сравниваем цены ИИ в долларах за миллион токенов так, будто токен — это стандартизированная единица вроде грамма или киловатт-часа. Но это не так. Тибо приводит простой пример с пиццей. Одну пиццу разрезали на 8 кусков по $2, другую — на 16 кусков по $1,25. Во втором случае кусок дешевле, но вся пицца стоит дороже. То же самое и с моделями. В небольшом тесте GPT-5.6 Sol использовал 766 токенов для того же текста, на который Claude Opus 5 потребовалось 1 170 токенов. Это на 34,5% меньше токенов при одинаковом результате. Поэтому более низкая цена за миллион токенов ещё не означает, что модель действительно дешевле. Считать нужно стоимость успешного результата, а не цену одного токена.
Anthropic опубликовала гайд "Как получить максимум от сессий Claude Code". 🏎 Они делятся шестью советами — использовать /clear между задачами, заранее выбирать модель и уровень усилий, указывать файлы через @, сокращать лишний вывод команд с помощью флагов, проверять стартовый контекст через /context и запускать /compact, прежде чем надолго отходить. Эти советы работают и в Codex, и почти в любом агенте для программирования.
Sol наконец-то может управлять субагентами Luna. На этой неделе вышло обновление Multi Agents v2. Теперь основной агент может делегировать задачи любой поддерживаемой модели — Sol, Terra или Luna. То есть можно оставить Sol в роли главного агента, а более дешёвые и быстрые задачи отправлять субагентам на Terra или Luna, вместо того чтобы тратить Sol на всё подряд. Раньше такую схему приходилось настраивать вручную. 😍
В OpenAI показали результаты крупного обновления производительности Codex, которое должно выйти на следующей неделе. Оно должно заметно ускорить загрузку очень длинных диалогов, одновременно снизив потребление памяти и количество запросов. На экстремальном тесте с диалогом на 741 сообщение и объёмом 231 МБ: • время загрузки сократилось с 27,6 до 1,7 секунды • количество запросов уменьшилось на 98% • загружаемых элементов переписки стало на 99,6% меньше • рост потребления памяти приложением снизился на 41% 😳😳😳
Джек Дорси, бывший генеральный директор Twitter, открыл исходный код фреймворка для управления бизнесом, где ИИ-агенты работают как члены команды. Сначала клонируете репозиторий и разворачиваете собственный сервер, через который работают каналы, поиск, Git и автоматизации. После этого остаётся добавить агента в нужный канал как ещё одного участника команды, задать ему права и работать с ним вместе в реальном времени. ⌨️
Qwen3.8-27B уже забрала первое место в трендах Hugging Face. При этом открытые модели Alibaba за последние шесть месяцев набрали более 3 миллиардов скачиваний по всему миру. 😳 По данным Bloomberg, Qwen обошёл Meta, Google и китайских конкурентов и стал самым скачиваемым семейством ИИ-моделей в мире.
Практическое руководство с 40+ советами по улучшению навыков работы с Claude Code. Среди рассматриваемых техник — настройка строки состояния, управление контекстом ИИ, использование голосового ввода и построение автономных рабочих процессов. 🤔
Anthropic подготовили FAQ, чтобы ответить на некоторые вопросы, которые получили по поводу водяных знаков. Если кратко: • Мы внедряем водяные знаки, чтобы соответствовать требованиям Акта ЕС об искусственном интеллекте. Другие крупные разработчики моделей подписали тот же Кодекс практики и тоже будут внедрять водяные знаки. • Наш метод водяных знаков никак практически не влияет на качество или содержание ответов Claude. • Читатели не смогут отличить текст с водяным знаком от текста без него. • В текст ничего не добавляется, никаких скрытых символов нет. • Водяные знаки не требуют дополнительных токенов и не увеличивают стоимость. • По водяному знаку нельзя определить конкретного человека, организацию или чат.
Сезон релизов моделей начался: Qwen3.8-27B наконец вышла, и её уже сравнивают с Opus 4.6 Max. ☺️ Вырос буквально каждый тест: Terminal coding: 63,4 → 73,0 SWE-bench Pro: 53,5 → 61,7 DeepSWE: 13,3 → 42,2 Software engineering: 49,3 → 79,0 И всё это запускается на одной RTX 3090. На игровой видеокарте 2020 года. Нативная работа с изображениями, контекст 262 тыс. токенов, Apache 2.0, а версии GGUF появились буквально одновременно с весами.
Этот инструмент с открытым исходным кодом удаляет скрытые символы Unicode и метаданные из файлов PNG, PDF, DOCX и SVG. 100% опенсорс 🤩
На первое место в трендах GitHub вышел OpenSandbox — платформа песочниц для ИИ-агентов от Alibaba. Она позволяет поднимать изолированные окружения, в которых агенты могут запускать код, работать с вебом или управлять рабочим столом. OpenSandbox не привязан к Python, официальные SDK доступны для Python, Java/Kotlin, TypeScript, C# и Go. Также есть CLI и MCP-сервер для Claude Code и Cursor. Для изоляции поддерживаются gVisor, Kata Containers и Firecracker microVM, а запускать всё это можно как локально через Docker, так и в более масштабной инфраструктуре. 100% опенсорс 😋
Теперь в ChatGPT есть Computer History Эта функция позволяет ChatGPT учиться на всём, что вы делаете на компьютере, чтобы лучше понимать, как вы работаете, продолжать незавершённые задачи и предлагать навыки и автоматизации на основе того, как вы используете компьютер. p.s. Здесь записываются именно события взаимодействия с компьютером, а не изображение экрана или звук.
Кто бы мог подумать, но Zhipu вот-вот выпустила GLM-5.3. Модель использует ту же базовую модель на 743 млрд параметров, что и GLM-5.2, при этом показывает результаты на уровне моделей, которые в несколько раз крупнее. Рост относительно GLM-5.2: — Terminal Bench 3.0: 4,6 → 28,3 — DeepSWE: 46,2 → 66,9 — AutomationBench: 26,2 → 48,2 — HLE с инструментами: 54,7 → 62,5 — ExploitGym: 39 → 130 — ExploitBench: 24,4 → 54,4 GLM-5.3 уже доступна через GLM Coding Plan и ZCode. Доступ через API и открытые веса будут выпускаться поэтапно после строгих проверок безопасности.
OpenAI показала GPT-5.6 Sol Ultrafast на Cerebras — до 750 выходных токенов в секунду, что в 14 раз быстрее стандартного режима. 🫣 Патч кода на 2 000 токенов передаётся примерно за 2,7 секунды. А весь лимит вывода в 128 тысяч токенов теоретически можно потратить менее чем за 3 минуты. OpenAI называет это "больше полезной работы в секунду" и говорит, что такой режим может "превратить исследование, которое раньше приходилось оставлять выполняться на ночь, в интерактивную рабочую сессию". Сейчас Ultrafast доступен ограниченной группе клиентов. Остальные могут оставить заявку, чтобы получить уведомление, когда доступ расширят.
Новая полезная функция в Claude Code: Если во время работы Claude вы упёрлись в лимит, можно включить "Автопродолжение". Как только ограничение снимется, Claude автоматически возобновит задачу с того места, где остановился. 👍
видео или голосовое, без подписи
Вышла DeepSeek-V4-Pro-0813 🤓 Она выходит примерно на уровень лучших открытых моделей — Kimi k3 и GLM-5.2, и уже приближается к GPT-5.6 Sol и Fable 5. Из технических обновлений — нативная поддержка OpenAI Responses API и настройка Codex в один клик. Названия…
видео или голосовое, без подписи
Вышла DeepSeek-V4-Pro-0813 🤓 Она выходит примерно на уровень лучших открытых моделей — Kimi k3 и GLM-5.2, и уже приближается к GPT-5.6 Sol и Fable 5. Из технических обновлений — нативная поддержка OpenAI Responses API и настройка Codex в один клик. Названия моделей в API при этом остались прежними. Для V4 Pro и Flash также появились три уровня рассуждений: низкий, высокий и максимальный. Одновременно меняется и тарификация: для линейки V4 вводятся пиковые и внепиковые ставки, причём во внепиковые часы цены будут на 50% ниже. Новые тарифы вступят в силу 16 августа 2026 года в 16:00 UTC. V4-Pro уже доступен через API, а также в приложении и веб-версии.