эйай ньюз
СтатистикаКультурно освещаю самые и не самые важные новости из мира AI, и облагораживаю их своим авторитетным профессиональным мнением. Ex-Staff Research Scientist в Meta Generative AI. Сейчас CEO&Founder AI стартапа в Швейцарии. Aвтор: @asanakoy PR: @ssnowysnow
- Последний пост
- 14 авг.
- Последнее чтение
- 09:04
- Постов за неделю
- 13
- Всего постов
- 55
- Тип
- открытый
- Язык
- русский
- Категория
- Бизнес
- В каталоге с
- 12 авг.
- 1/24сутки в ленте
- 17 543
- 1/48двое суток
- 18 419
- 1/72трое суток
- 19 865
Медиана по постам, которые мы застали свежими и померили через сутки.
Посты
видео или голосовое, без подписи
Qwen 3.8 27B релизнулся На этой неделе у любителей локальных моделей праздник. Сначала Muse Glimmer, сейчас Qwen 3.8 27B, плюс релизы моделей побольше. Веса @ai_newz
SpaceX завершили поглощение Cursor Акционеры Cursor получили $60 миллиардов акциями SpaceX. Как думаете, во что Маск переименует Cursor, если XCode и Codex уже заняты? @ai_newz
видео или голосовое, без подписи
Встречайте — GLM 5.3 Прирост по сравнению с 5.2 был достигнут иключительно масштабированием RL, причём упор был на RL на реальный задачах, вроде оптимизации тренировки модели. Внезапно такой подход дал очень хороший буст в кибербезопасности — компания заявляет что их модели смогли найти 2.5к уязвимостей с момента релиза GLM 5.2, причём самой старой уязвимости 45 лет. Весов пока что нет, обещают через две недели. Блогпост @ai_newz
Вышла Gemini 3.7 Flash По бенчам Flash выросла выше Sonnet 5. На модель временно скинули цену, на этот раз в два раза, до $0.75/$3.75. Такая цена будет актуальна до конца 2026, после чего её опять поднимут. Использование токенов снова выросло, на тестах Artificial Analysis у модели уходит на 50% больше токенов. @ai_newz
видео или голосовое, без подписи
DeepSeek выпустили собственный харнес и V4 Pro из превью Основная фишка DeepSeek Harness — экстремальная модульность. Практически всё является модулем с возможностью хот релоада, динамически можно поменять и коннекторы моделей и сам агентный луп. О том как это работает выпустили детальнейший пейпер. Вместе с этим выпустили V4 Pro из превью, традиционно выпустив веса под лицензией MIT. Ну и ещё компания, как и обещала, поднимает цены с 16 августа. Инпут токены будут теперь дороже в 1.5x, аутпут более чем в 2x. Кроме этого в пиковые часы цена будет ещё удваиваться. Веса V4 Pro 0813 DeepSeek Harness @ai_newz
Веса Qwen 3.8 Max вышли в открытый доступ Это модель на 2.4 триллиона параметров, с 95B активных. Официальные веса распространяются в bf16 и весят 5 терабайт, но уже есть нормальные NVFP4 и MXFP4 версии. Для запуска нужна одна нода с B300/MI355x или несколько нод с картами попроще. На визуальных VLM задачах по личному опыту, она тащит вроде бы даже лучше чем закрытые фронтир модели. Китайцы - вперед! SGLang Cookbook vLLM recipe Веса @ai_newz
SpaceXAI выпустили Grok 4.6 Существенный прирост, при той же цене в $2/$6 за миллион токенов. 1.5T претрейн от Grok 4.5 дообучили и поверх него закинули заметно лучший посттрейн. По случаю запуска в Grok Build и Cursor удвоили лимиты на эту модель на неделю. Ну а через несколько недель обещают Grok 4.7 на 2 триллиона параметров, со значительным приростом поверх 4.6. @ai_newz
12 недель до Demo Day в Y Combinator, и ноль лидов в пайплайне. У фаундеров Humoniq из батча YC S25 был крутой продукт и была одна важная дата в календаре. Между ними всего 12 недель, и заполнить их нужно было не слайдами и теорией про будущие продажи, а реальными демо-звонками, LOI и подписанными контрактами. На Demo Day в YC смотрят не на идею и грандиозные планы, а на настоящий трекшн и живой пайплайн компаний которым нужен твой продукт. Ситуация знакомая почти каждому B2B / IT / SaaS-стартапу: продукт есть, а стабильного канала продаж нет. Фаундеры Humoniq пришли к Мише. До этого Миша руководил командой продажников в лондонском офисе WP Engine (SaaS-единорог на чьих серверах крутится 10%+ сайтов планеты), а сейчас строит Go-to-Market для стартапов Y Combinator: 5 успешных кейсов с YC-командами и десятки других кейсов по всему миру. За 12 недель, с нуля сделали 50%+ open rate, 10%+ reply rate, 60+ квалифицированных демо, 15+ сделок в пайплайне и впоследствии 3 закрытых enterprise-контракта с Delta Airlines, American Express, Expedia! Полный разбор того, что конкретно было сделано можно глянуть вот здесь, у Миши в канале. Там он регулярно разбирает реально рабочие фреймворки лидгена в 2026 году: founder-led, signal-based, creative storytelling, AI-автоматизации и свои другие кейсы из YC. Канал будет полезен фаундерам и командам которые строят проекты в B2B / IT / SaaS / Web3. К тому же прямо сейчас Миша ищет одного фаундера, чтобы в лайв-формате построить ему лидген с нуля. Отбор стартует уже в сентябре! Заценить подход и кейсы Миши можно тут: 👉 Про B2B аутрич из Долины #промо
Нейродайджест за неделю (#126) LLM - Muse Code и Spark 1.2 — Meta выкатили своего агента и новую модель. За счет разрешения обучаться на данных пользователя цена снижена до $0,1/$0,2 за миллион токенов. - Qwen 3.8-Max — Alibaba выпустила мультимодальную модель на 2.4T параметров (95B активных). Отлично справляется с визуальными agentic задачами и автономным кодингом, стоит $2/$6. Обещают выпустить веса уже на этой неделе. - Первая модель SSI — По слухам, стартап Ильи Суцкевера планирует релиз первой модели уже в августе, не дожидаясь заявленного сверхинтеллекта. Генеративные модели - Lift4D — Фреймворк для 4D-реконструкции динамических объектов и их текстур из обычного видео с камеры. - Grok Video 1.5 — xAI выкатила минорное обновление своего видеогенератора. - FLUX 3 Video — Видеомодель от BFL вышла в API (до 20 сек со звуком и липсинком). Появился черновой режим (Draft Mode), базовая цена от $0.17 за секунду в 720p. - SeedRealtime — ByteDance представила нативную full-duplex модель. Ассистент непрерывно смотрит видеопоток, слушает и может инициировать диалог без задержек. - Wan 3.0 — Alibaba запустила публичную бету. Модель генерирует видео до 30 секунд в 1080p, позволяя смешивать текст, фото, видео и аудио для точного переноса внешности и стиля. - Wan Animate 2 — Альтернатива pose-control для motion transfer по видео-референсу без скелетов. Выложили веса и ноды для ComfyUI. - Grok Imagine Image 2.0 — xAI сильно прокачали генератор картинок: добавили Magic Wand, точное редактирование областей, удаление фона и мультиреференс до 5 изображений. Прочее - Gemini Robotics 2 — Google DeepMind обновили VLA-модель: теперь она управляет всем телом гуманоида (включая мелкую моторику), координирует рой роботов и имеет on-device версию для быстрой адаптации. - Перестановки в Google — Демис Хассабис покинул пост CEO DeepMind (перешел на роль Chair и Chief Scientist Alphabet), а Джефф Дин ушел из компании после 27 лет работы делать стартап Discovery Loop. > Читать дайджест #125 #дайджест @ai_newz
Meta выпустила Muse Glimmer и пообещала открыть веса Muse Spark 1.2 Muse Glimmer это 30B мультимодальная модель, которая обходит по бенчам и Qwen 3.6 27B и Gemma 4 31B. Это первый заметный открытый LLM релиз от Meta с апреля 2025 года, ну а в такой весовой категории, модели компании не выпускались аж с Code Llama 34B в августе 2023. Архитектурно это dense модель с относительно большим perception encoder. Главный очевидный минус — длина контекста всего 131к, что меньше чем у конкурентов. Вместе с моделью выпустили официальные квантизации, так что модель влезает в 24 гигабайта VRAM. Вышла и официальная драфт модель, благодаря этому Muse Glimmer запускается на одной 5090 на скорости в 230 токенов в секунду. Веса модели Официальные квантизации @ai_newz
Meta выпустила собственного агента — Muse Code Вместе с этим релизнулась Muse Spark 1.2. Заявляют что новая модель с официальным харнесом лучше Grok 4.5, но не дотягивает до Opus 5. Самое интересное тут — новая ценовая политика. Теперь, если вы позволите Meta тренировать модели на ваших данных, то модель отдают совсем за бесценок — $0,1/$0,2 за миллион токенов, против обычной цены в $1,25/$4,25. Это делает её дешевле DeepSeek V4 Flash, у которой в официальном API и так схожие условия, даже до уже анонсированного повышения цен. Но лучше не ведитесь на такую халяву, если вы разрабатываете что-то стоящее, и особенно если строите стартап. Для пет-проектов и опен-сорса ок, но не более. @ai_newz
Lift4D — 4D-реконструкция динамических объектов по одному видео Фреймворк восстанавливает полную 360° геометрию, текстуры и нежёсткие деформации движущихся объектов по обычному видео с камеры, достраивая даже невидимые ракурсы. Зачем лично мне такая турбофича пока непонятно, но выглядит очень интересно, на Project Page можно самому покрутить руками. Project Page arXiv Код @ai_newz
Нейродайджест за неделю (#125) LLM - Веса Kimi K3 — Moonshot выложили веса крупнейшей открытой модели на 2.8T параметров (104B активных). Для локального запуска потребуется система с 2 ТБ памяти. - Снижение цен на GPT 5.6 — OpenAI уронили цены: Luna подешевела в 5 раз ($0.2/$1.2), Terra — на 20%. Для флагмана Sol запустили Fast-режим (в 2.5 раза быстрее за 2x прайс). - DeepSeek V4 Flash — Свежая версия 0731 в API обходит GLM 5.2 и совместима с Codex, оставаясь дешевле Luna и по токенам и в пересчете на таск. Релиз V4 Pro ждут в начале августа. - Astra от OpenAI — Новая мультиагентная модель доказала 10 открытых математических задач при помощи Lean, потратив менее $2000 на токены по расценкам Sol. Генеративные модели - Seedance 2.5 — Генератор видео от ByteDance научился делать ролики до 180 секунд, получил интеграцию с Blender и точечное редактирование, но стал самым дорогим на рынке ($6 за 30 сек). > Читать дайджест #124 #дайджест @ai_newz
Модель Astra от OpenAI решила десять сложных открытых математических задач Большинство из этих задач оставались недоказанными в течении десятков лет. Новая мультиагентная модель Astra смогла доказать их и формализировать доказательства при помощи Lean. Эту модель на этой неделе Сэм Альтман представил в Вашингтоне, это будет первая модель которая пройдёт через новый процесс государственного одобрения на релиз. Самое впечатляющее — на решение всех десяти задач суммарно ушло токенов меньше чем на $2000, по расценкам Sol. OpenAI пытались решить и другие сложные задачи, пока что безуспешно, но потенциал масштабирования здесь огромный. Блогпост Lean код доказательств @ai_newz
Seedance 2.5 Модель для генерации видео получила мощный апдейт с упором на контроль и длинные форматы. Как и обещали, теперь она умеет генерировать цельные 30-секундные ролики с консистентным продолжением до 180 секунд в бета-режиме. На вход можно подать до 50 референсов. Большой упор сделали на профессиональные пайплайны с оптимизацией под работу с гринскрином и 3D-болванками из Blender (Dreamina даже плагин свой завезли), чтобы точно задать пространственную структуру, траектории объектов и движение камеры. Добавили точечное редактирование, как в Gemini Omni, еще одна Nano Banana для видео. Ранее анонсировали (нативные) 4K, но пока что релизнули только 480p/720p генерацию, 4K доступен только для Seedance 2.0. В среднем Seedance 2.5 стоит в 1.5 раза дороже своего предшественника, что делает модель самой дорогой на рынке. Те цена одного 30-ти секундного ролика в 720p это 6 долларов. Модель уже доступна на платформах Jimeng AI, Doubao Pro и Dreamina, а скоро появится и через API BytePlus ModelArk, так что ждем на всех агрегаторах. Project Page Dreamina @ai_newz
DeepSeek обновили V4 Flash в API Новая V4-Flash-0731 по бенчам обгоняет GLM 5.2 и V4 Pro Preview. Это всё ещё модель на 284B параметров, с 13B активных. Модель использует примерно такое же количество токенов что и прошлая версия, судя по тестам Artificial Analysis. Это делает модель в разы дешевле на таск чем GPT 5.6 Luna, даже с учётом новых цен, но Luna в разы быстрее решает задачи и использует меньше токенов. Новая модель работает через Responses API и полностью совместима с Codex. Ещё DeepSeek обещают релизнуть собственного агента в скором времени. Веса пока что не релизнули. Модель доступна только в API, в чате пока что до сих пор старая версия. Апдейт на V4 Pro обещают выпустить в первых числах августа. @ai_newz
OpenAI сбросили цены на GPT 5.6 Luna теперь дешевле в пять раз, всего $0.2/$1.2 за миллион токенов, против $1/$6 на релизе. Цену Terra сбросили на 20%, до $2/$12 за миллион токенов. Понижение цен касается не только API, но и квоты в Codex/ChatGPT Work. Sol не получил понижения цены, но для него выпустили Fast режим, который в 2.5x быстрее по 2x цене, но про дату релиза Sol запущенного на железе Cerebras OpenAI всё ещё молчат. @ai_newz