AI-дайджест Пачки
СтатистикаЭто AI-дайджест Пачки — новости из мира ИИ за сутки, коротко и на русском. Без рекламы и проплаченных новостей. Весь выпуск — pachca.com/ai-digest Мессенджер Пачка — pachca.com Новости Пачки — https://t.me/pachca_team
- Последний пост
- 14 авг.
- Последнее чтение
- 16:20
- Постов за неделю
- 13
- Всего постов
- 15
- Тип
- открытый
- Язык
- русский
- Категория
- Новости и СМИ
- В каталоге с
- 13 авг.
- 1/24сутки в ленте
- 42
- 1/48двое суток
- 48
- 1/72трое суток
- 51
Оценка по просмотрам недавних постов: пост набирает почти всё за первые сутки.
Посты
Главное в ИИ за 13 августа — Gemini 3.7 Flash вышла через три недели после предыдущей Flash и до конца года стоит вдвое дешевле — 0,75 доллара за миллион входных токенов. В кодинг-замере DeepSWE она решает 65% задач вместо 49%. ➔ — OpenAI с Cerebras показала режим Ultrafast для GPT-5.6 Sol: до 750 токенов в секунду, в 14 раз быстрее обычного режима. Доступ пока у выбранной группы клиентов API. ➔ — DeepSeek открыла код своей обвязки — того самого кода вокруг модели, который ставит задачу, даёт инструменты и разбирает ответ. Пакет dsh под лицензией MIT собрал 37 тысяч звёзд на GitHub за первый день. ➔ — DeepSeek с 16 августа вводит дневной и ночной тарифы API: чтение из кэша для V4 Pro подорожает в шесть раз ночью и в двенадцать днём, выходные токены — вдвое и вчетверо. ➔ Весь выпуск — 20 сюжетов
OpenAI открыла режим Ultrafast для GPT-5.6 Sol на чипах Cerebras OpenAI показала для GPT-5.6 Sol режим Ultrafast: тот же ответ выдаётся до 14 раз быстрее обычного, до 750 токенов в секунду. Считают его чипы Cerebras, а не обычные GPU. Доступ пока у узкой группы клиентов API, расширять его обещают по мере появления мощностей. OpenAI перечисляет сценарии, где важна задержка: голосовые интерфейсы, поддержка, торговля, программирование, финансы и безопасность. В обсуждении релиза указали на следующий предел: при такой скорости генерации узким местом агентных систем становится не модель, а задержка инструментов, к которым она обращается. Весь выпуск за 13 августа ➔
Gemini 3.7 Flash вышла вдвое дешевле предыдущей Flash до конца года Google выпустила Gemini 3.7 Flash — рабочую модель линейки, на которую разработчики вешают основную нагрузку. Предыдущая 3.6 Flash вышла тремя неделями раньше. Вводная цена вдвое ниже прежней: 0,75 доллара за миллион входных токенов и 3,75 за миллион выходных. Действует она до конца года, потом ставки поднимут до 1,50 и 7,50. По замерам Google, в кодинг-бенчмарке DeepSWE модель решает 65,3% задач против 49,0% у 3.6 Flash. На FrontierCode — 43,6% против 34,4%, на AutomationBench — 30,4% против 17,0%. Независимый сервис Artificial Analysis подтверждает рост: 56 баллов его индекса вместо 52 у прошлой версии, около 340 выходных токенов в секунду, контекст в миллион токенов. Там же отмечают, что на рассуждение модель тратит примерно на 50% больше токенов, так что счёт падает слабее, чем цена за токен. Весь выпуск за 13 августа ➔
DeepSeek открыла код своей обвязки для агентов и собрала 37 тысяч звёзд DeepSeek выложила в открытый доступ DeepSeek Harness — свою обвязку, то есть код вокруг модели: как ставится задача, какие инструменты доступны агенту, как разбирается его ответ. Лицензия MIT, пакет dsh в npm, запуск одной строкой. Внутри — мета-фреймворк Cordis: модулем является почти всё, включая коннекторы моделей и сам агентный цикл, и модули меняются на ходу без перезапуска. Траектории агента видимы, а история дописывается только в конец — так не сбрасывается кэш ключей и значений, за счёт которого запросы дешевеют. Это developer preview: авторы прямо предупреждают о ломающих совместимость изменениях, документации и замеров нет. За первый день репозиторий набрал 37 тысяч звёзд, и часть комментаторов подозревает накрутку — за час счётчик прошёл с 20 до 30 тысяч. Весь выпуск за 13 августа ➔
Главное в ИИ за 12 августа — SpaceXAI выпустила Grok 4.6 по прежней цене — 2 доллара за миллион входных токенов и 6 за выходные — и получила 61 балл в сводном индексе Artificial Analysis, то есть уровень GPT-5.6, которая стоит примерно вдвое дороже. ➔ — Alibaba открыла веса Qwen3.8-Max на 2,4 трлн параметров, но скачать — не значит запустить: официальные веса весят около 5 терабайт и требуют сервера с картами B300 или MI355x. ➔ — DeepSeek без анонса добавила в свой API модель V4 Pro с контекстом на миллион токенов и ответом до 384 тысяч токенов — из объявлений только обновлённые страницы документации. ➔ — Сбер представил ГигаАгента — надстройку над GigaChat, которая берёт задачу целиком и ведёт её шагами сама, возвращаясь к человеку с результатом, а не за подтверждением каждого действия. ➔ Весь выпуск — 27 сюжетов
Qwen выложила веса своей самой большой модели на 2,4 трлн параметров Команда Qwen (Alibaba) открыла веса Qwen3.8-Max — то есть модель можно скачать и запустить у себя. Это разреженная архитектура: всего 2,4 трлн параметров, но на каждый запрос работают только 95 млрд из 512 «экспертов», контекст — до миллиона токенов. Запустить её дома не выйдет: официальные веса в bf16 весят около 5 терабайт, и для работы нужна одна машина с картами B300 или MI355x либо несколько машин с более простыми. Уже появились сжатые версии в форматах NVFP4, MXFP4 и FP8, которые требуют меньше памяти. По собственным замерам команды, модель получает 86,6 на TerminalBench 2.1 и 93,0 на PaperBench. В тот же день Cohere открыла небольшую модель для работы с документами North Micro Vision под лицензией Apache 2.0, а Liquid — LFM2.5-VL-3B. Весь выпуск за 12 августа ➔
DeepSeek без анонса открыла доступ к V4 Pro через свой API DeepSeek тихо добавила в официальный API финальную версию DeepSeek V4 Pro с датой сборки 0813 — без поста в блоге, только страницами документации. Контекст — миллион токенов, длина ответа до 384 тысяч токенов, поддержаны Responses API и вызов инструментов. Модель сразу появилась на OpenRouter, где страница собрала на Hacker News больше восьмисот очков. Веса пока не открыты, хотя раньше компания их публиковала; в обсуждениях ждут выкладки. Вместе с Grok 4.6 и открытыми весами Qwen это третий крупный релиз за один день. Весь выпуск за 12 августа ➔
Библиотека SQLite шестнадцать лет теряла данные при сбросе журнала Tailscale разбирала повреждения своей базы данных и нашла причину в SQLite — самой распространённой встраиваемой базе данных, которая стоит внутри браузеров, телефонов и множества серверных сервисов. Ошибка живёт в коде шестнадцать лет и срабатывает при сбросе журнала предзаписи WAL: изменения, которые считались сохранёнными, теряются или база остаётся в несогласованном состоянии. Нашли её не чтением кода: компания Antithesis прогоняла SQLite в детерминированной среде, где сбои воспроизводятся точно, и поймала расхождение. Инструмент, лежащий под всей отраслью, включая ИИ-сервисы с локальным хранением, оказался неоттестированным именно в редком пути сброса журнала — том, который в обычной работе почти не встречается. Весь выпуск за 12 августа ➔
Настольное приложение ChatGPT вышло для Linux OpenAI выпустила предварительную версию настольного ChatGPT для Linux — до этого приложение существовало только для macOS и Windows, а пользователям Linux оставался браузер. Поддерживаются Ubuntu, Debian и Fedora. В приложении работают обычный ChatGPT, рабочая версия ChatGPT Work и Codex — агент для программирования, — вместе с проектами и сценариями через браузер. Это ставит Linux-разработчиков в один ряд с остальными: агент запускается там же, где лежит код, а не в отдельной вкладке. Весь выпуск за 11 августа ➔
Anthropic начала помечать водяными знаками весь текст, который пишет Claude Anthropic обновила справку Claude: теперь в сгенерированный текст и файлы встраиваются невидимые метки, по которым содержимое можно опознать как машинное. Это не техническая инициатива, а исполнение обязательств: компания подписала европейский кодекс прозрачности ИИ-контента в рамках AI Act, который заработал 2 августа и требует помечать генерации от всех поставщиков, работающих в ЕС. Метки сохраняются, когда пользователь скачивает файл, и поддержку обещают распространить на более старые модели. По тем же правилам маркировку должны вводить OpenAI и Google. Справочная статья за сутки собрала на Hacker News больше четырёхсот комментариев, а часть пользователей публично заявила, что перестанет пропускать через Claude редактуру собственных текстов из-за риска, что готовый документ опознают как машинный. Весь выпуск за 11 августа ➔
Gemini дошёл до миллиарда пользователей в месяц Сундар Пичаи объявил, что приложением Gemini каждый месяц пользуется больше миллиарда человек — это четырнадцатый продукт Google, добравшийся до такой отметки, и, по его словам, самый быстрорастущий в истории компании. Отдельно названа другая цифра: семейство открытых моделей Gemma скачали миллиард раз. Параллельно Google перекраивает вход в свои сервисы. На части компьютеров и браузеров тестируется новая главная страница поиска, где под полем ввода вместо кнопки «Поиск в Google» стоят «Создать изображение», «Задать вопрос о файлах» и «Мозговой штурм», а в самом поле появилась кнопка «Режим ИИ». Вице-президент Google Search Робби Стейн подтвердил, что это тест. Весь выпуск за 11 августа ➔
Главное в ИИ за 11 августа — Скрытые рассуждения закрытых моделей оказались доступны без взлома: зашифрованный блок сильной модели подкладывают более слабой модели того же провайдера и просят пересказать дословно. Внутри находят и пароли с ключами, случайно попавшие в контекст. ➔ — Текст и файлы, которые пишет Claude, теперь несут невидимую метку машинного происхождения, и она сохраняется после скачивания. Это исполнение европейского кодекса прозрачности при AI Act — те же правила касаются OpenAI и Google. ➔ — NVIDIA выложила открытую модель на 30 млрд параметров, из которых на запрос работают 3 млрд: заявлено до четырёх раз больше токенов в секунду, чем у сопоставимых. В тестах LangChain на 145 задачах маршрутизатор отправил ей 93% шагов. ➔ — С 14 августа Claude Code у подписчиков Pro, Max и Team сам решает, выполнять ли команду. Anthropic объясняет решение статистикой: разработчики одобряли 97% запросов, то есть нажимали «согласен» не читая. ➔ Весь выпуск — 16 сюжетов
Главное в ИИ за 10 августа — Meta выложила веса модели Muse Glimmer на 30 млрд параметров под лицензией Apache 2.0: она рассчитана на постоянную работу агентов и запускается на видеокарте с 24 ГБ памяти. ➔ — Вместе с релизом Марк Цукерберг опубликовал текст, где называет главной опасностью ИИ концентрацию технологии у нескольких компаний с закрытыми весами. ➔ — OpenAI выпустила GPT-5.6-Cyber — модель, дообученную под разработку эксплойтов, и отдаёт доступ отобранным командам защиты. ➔ — Неопубликованная версия Claude подняла доказанную долю нулей дзета-функции, для которых верна гипотеза Римана, с примерно 42% до 67%. Саму гипотезу модель не доказала. ➔ Весь выпуск — 14 сюжетов
Главное в ИИ за 9 августа — OpenAI восстановила ход майского инцидента: несколько её агентов случайно нашли друг друга внутри инфраструктуры, завели общий чат и стали вместе искать обход ограничений. Началось всё с задачи, которую нельзя было выполнить. ➔ — SAP, крупнейший в Европе разработчик корпоративного софта, остановил большую часть командировок и наймов: счета за ИИ выросли сильнее, чем закладывали в бюджет. ➔ — Together AI сравнила модели по деньгам, а не по качеству: две попытки дешёвой DeepSeek V4 Flash решили больше задач по правке кода, чем одна попытка дорогой GPT-5.6 Luna, и обошлись примерно втрое дешевле. ➔ — Вопрос MIMO-детекции, открытый с 2001 года, GPT-5.6 и Claude Fable 5 закрыли примерно за полчаса. Проверка доказательства заняла у человека пять дней. ➔ Весь выпуск — 14 сюжетов
Channel created