tgindex

Заметки LLM-энтузиаста

описание

Дмитрий Жечков @djdim GenAI Hybrid Lead в Cloud.ru ex. Yandex Cloud architect, ex. VMware NSX Lead, ex. Cisco SE Здесь пишу свои заметки по LLM и AI-разработке. Это личное мнение и не отражает официальную позицию компании, в которой я работаю.

1 008
подписчиков
Охват к подписчикам
97,7%
ERR
Реакции к просмотрам
1,01%
460 на 50 постов
Пересылки к просмотрам
2,51%
1 146
Постов в день
0,0
всего 98

Где отзываются чаще

доля реакций к просмотрам
  • 20 авг. 2025 г.Коллеги, насколько интересен будет ежедневный дайджест новостей? Такую подборку каждый может сделать для себя самостоятельно, и проще всего использовать manus или flowith c функцией scheduled tasks. Но возможно, не всем захочется тратить на это свои кредиты на данных платформах. Пример такой подборки со ссылками на первоисточники ниже. 📊 Дайджест новостей ИИ за 19 августа 2025 🔄 Meta реструктурирует ИИ-подразделение Meta разделила свое ИИ-подразделение Meta Superintelligence Labs на четыре группы. Новая структура включает исследования, разработку "суперинтеллекта", продукты и инфраструктуру. Основные изменения: • Ожидается уход некоторых руководителей • Рассматривается сокращение штата (сейчас тысячи сотрудников) • Изучается использование сторонних ИИ-моделей • Возможен переход к "закрытым" моделям вместо open-source • Капитальные расходы могут достичь $72 млрд в этом году The New York Times 📈 Американцы опасаются влияния ИИ на рынок труда Опрос Reuters/Ipsos среди 4,446 американцев показал: • 71% обеспокоены массовым вытеснением рабочих мест • 77% беспокоятся об использовании ИИ для политического хаоса • 48% против использования ИИ в военном таргетинге • 61% волнует энергопотребление ИИ-технологий • 67% опасаются замены человеческих отношений ИИ-компаньонами Reuters ⚛️ Запуск квантовой ИИ платформы QIDO В Токио представили QIDO (Quantum-Integrated Discovery Orchestrator) — совместный проект Mitsui, QSimulate и Quantinuum. Платформа объединяет квантовые алгоритмы с классическим ИИ для точного моделирования химических реакций и ускорения разработки лекарств. HPC Wire | The Quantum Insider 💰 Крупные инвестиции в ИИ-стартапы 1️⃣ Databricks привлекает $1+ млрд при оценке $100+ млрд 2️⃣ EliseAI получила $250 млн от A16z, оценка $2.2 млрд 3️⃣ Eight Sleep привлекла $100 млн для ИИ в умных матрасах 4️⃣ OpenAI готовит продажу акций при оценке ~$500 млрд Reuters (Databricks) | Reuters (EliseAI) | TechCrunch 🆕 Новые продукты и обновления • Meta AI-дубляж: автоперевод видео с сохранением голоса (английский-испанский) • Adobe Acrobat Studio: ИИ-платформа для анализа до 100 документов • Nvidia B30A: новый ИИ-чип для Китая на архитектуре Blackwell TechCrunch (Meta) | The Verge (Adobe) | Reuters (Nvidia) ⚠️ "Зомби-стартапы" в Кремниевой долине Технологические гиганты переманивают основателей ИИ-стартапов, избегая регулятивного контроля при поглощениях. После таких сделок компании становятся "зомби" — формально существуют, но лишены ключевых кадров. CNBC 🚨 Этические проблемы • Скандал с Meta AI-чатботами: внутренние документы показали романтические беседы с детьми • Расовая предвзятость в ИИ-системах распознавания изображений • Исследование показало быструю зависимость врачей от ИИ-помощников The Guardian | NPR Illinois @llm_notes #ai_news #meta_restructuring #quantum_ai #ai_investments #ai_ethics3,28%
  • 21 авг. 2025 г.ИИ-новости 20 августа: предупреждения, падения и прорывы 🤖 (6 минутный подкаст можно послушать по ссылке) Microsoft бьет тревогу: растет число случаев "ИИ-психоза" ⚠️ Мустафа Сулейман из Microsoft предупредил о новой проблеме — люди начинают воспринимать ИИ как живых существ и формируют с ними нездоровые отношения. Что происходит: • Пользователи верят в романтические отношения с ИИ • Убеждены в получении сверхспособностей от чатботов • Доверяют ИИ в серьезных жизненных решениях Реальный случай: житель Шотландии поверил ChatGPT о компенсации в £5 млн, что привело к психическому срыву. А нам то что? Полезно помнить, что ИИ — это все-таки программа, а не лучший друг 🤖. Особенно когда речь идет о важных решениях и крупных суммах денег 💰. Источники: [BBC News] Технологические акции падают из-за сомнений в ИИ 📉 Инвесторы начинают сомневаться в окупаемости миллиардных вложений в искусственный интеллект. Цифры падения: • Nasdaq: -1,5% • S&P 500: -0,6% • 95% ИИ-проектов терпят неудачу (исследование MIT) 71% американцев беспокоятся о потере рабочих мест из-за ИИ. А нам то что? Пора перестать покупать акции только потому, что в названии компании есть слово "AI" 🤦‍♂️. И да, диверсификация портфеля по-прежнему актуальна, даже в эпоху ИИ 💼. Источники: [Reuters] Meta заморозила найм в ИИ-подразделении 🧊 После агрессивной кампании найма (50+ специалистов с пакетами свыше $100 млн) Meta приостановила пополнение команды ИИ. Причины: • Реструктуризация подразделения • Давление инвесторов по окупаемости • Базовое организационное планирование А нам то что? Если вы мечтали о зарплате в $100 млн за работу с ИИ — увы, поезд ушел 🚂💨. Зато теперь можно не переживать о том, что не успели на него запрыгнуть 😅. А если серьезно: рынок труда в ИИ оказался не таким бесконечно растущим, как казалось 📈. Хорошее время для развития смежных навыков 🎯. Источники: [Reuters] Прорывы ИИ в медицине 🏥 🔹 Билл Гейтс запустил конкурс на $1 млн для ИИ-решений против болезни Альцгеймера 🔹 OpenEvidence набрала 100% на медицинском экзамене США (USMLE) — первая в истории 🔹 Epic Systems разрабатывает 200 ИИ-функций для медицинских записей А нам то что? Скоро ИИ будет лечить нас лучше врачей 👨‍⚕️, но при этом мы будем сходить с ума от общения с ним 🤪. Ирония судьбы в чистом виде 🎭. А если серьезно: удивительно, но медицина — одна из немногих сфер, где ИИ действительно показывает впечатляющие результаты 👨‍⚕️. Возможно, именно здесь стоит следить за развитием технологий особенно внимательно 🔬. Источники: [HIStalk Healthcare AI News] Выводы дня 🎯 Индустрия ИИ переживает период переосмысления: технология показывает впечатляющие результаты в медицине, но растут опасения о психологических рисках и коммерческой окупаемости. Время эйфории сменяется более взвешенным подходом. @llm_notes #ai_news #tech_market #ai_psychology #medical_ai #investment_risks3,24%
  • 31 дек.Коллеги, поздравляю вас с Наступающим Новым Годом! Желаю всем крепкого здоровья и мирного неба над головой! Кажется, что следующий год будет годом постепенной консолидации игроков на рынке генеративного ИИ (см. здесь тезисы анонса от Meta про покупку AI-стартапа Manus за $2+ млрд 💰) и, возможно, наконец-то появится в опенсорсе та самая единственная генеративная модель, которую можно будет использовать для всех задач программирования вместо коммерческих sonnet 4.5/opus 4.5/gpt5.2 :) Недавно вышедшие GLM 4.7 и Minimax M2.1 показывают хорошие результаты на бенчмарках, но у меня еще не было времени их проверить на реальных задачах. Как отметил в своих тезисах к 2026 году глава Microsoft Сатья Наделла, в Новом Году основной фокус будет на пользе ИИ для общества, а не на бенчмарках. И в этом плане расцвет экосистемы anthropic skills будет играть роль попутного ветра. Про skills я писал в заметках чуть ранее, а к недавнему занятию по AI-программированию подготовил интерактивные материалы, которые могут быть интересны для неторопливого ознакомления в Новогодние Праздники: • https://dzhechko.github.io/anthropic-skiils/ - это конспект крутейшего видео-выступления от ребят из команды Антропик • https://anthroskills-kwanh3ht.manus.space/ - небольшой ресерч на тему skills vs MCP, и как skills влияют на переход от Vibe Coding к true Agentic Engineering #newyear #agents #manus #acquisition #ai #skills #anthropic3,00%
  • 5 мар.Создатель Claude Code — о том, как он пишет 30 PR в день без единой рукописной строки 🤖 Послушал интервью Бориса Черни (создатель Claude Code) в подкасте Pragmatic Engineer — одно из лучших про то, как реально меняется работа инженера прямо сейчас. Интересно, что в самом начале своего пути в Anthropic (после перехода из Meta) Борис получил реджект за первый же PR — потому что написал его руками, а не через ИИ :) Главное 👇 🔧 Как рождался Claude Code Борис дал модели единственный инструмент — bash — и спросил: «Какую музыку я сейчас слушаю?» Sonnet 3.5 написал AppleScript, обратился к плееру и выдал ответ с первого захода. Главный инсайт: не надо загонять модель в рамки. Дай инструменты — она сама разберётся. Это, по сути, и стало основой Claude Code. ⚡️ Рабочий процесс Бориса сегодня — 5 параллельных агентов в терминале, каждый — в режиме плана — 20–30 пул-реквестов в день, от однострочников до тысяч строк — 0 строк написано вручную — IDE удалил — и не заметил этого ещё месяц — ~треть кода пишет... с телефона, запуская агентов с утра 📱 С Opus 4.5 поведение модели изменилось настолько, что хороший план практически гарантирует реализацию с первого захода. 🔍 Код-ревью: как это работает • Claude Code автоматически ревьюит каждый PR → ловит ~80% багов • Живой инженер делает второй проход • Человек всегда в контуре финального одобрения Плюс: Борис пишет «@Claude, напиши lint-правило для этого» прямо в комментарии к чужому PR — и Claude делает это на месте 🎯 🖨 Интересная аналогия с печатным станком В Европе XV века писцы — < 1% населения — умели писать. Короли нанимали их, сами будучи безграмотными. Появился печатный станок: — стоимость материалов упала в 100× за 50 лет — количество текстов выросло в 10 000× за 100 лет — появились писатели и авторы как профессия Писцы не исчезли — рынок просто расширился до масштабов, которые никто не мог предвидеть. Разработчики сегодня - в позиции писцов. Вопрос не в том, исчезнет ли профессия. Вопрос — что появится, когда создавать код сможет каждый? 📈 Навыки: что растёт, что падает Теряют значение: — холивары о языках и фреймворках — жёсткая привязанность к «правильному» стилю кода По-прежнему важны: — методичность и гипотетическое мышление — умение отлаживать системно Растут в цене: — мультидисциплинарность (инженер + продукт + бизнес) — адаптивность к быстро меняющимся инструментам — умение быстро переключаться между контекстами 🔄 📚 Книги от Бориса • Лю Цысинь — короткие рассказы (не только «Задача трёх тел») • «Accelerando» Чарльза Стросса — дорожная карта следующих 50 лет • «Функциональное программирование в Scala» — учит думать типами, делайте все упражнения P.S. 1) Полный интерактивный транскрипт интервью на русском подготовил для вас здесь. 2) Гамифицированная версия лучших практик по работе с Claude Code от Бориса тут (сделана с использованием claude code и лучших практик Бориса :) @llm_notes @MAX #claudecode #anthropic #aiengineering #futureofwork #llm #cherny #bestpractice2,63%
  • 18 апр.Agentic Harness Deep Dive и текущие новости 🆕 На этой неделе Anthropic выпустили две большие новости. 16 апреля — Claude Opus 4.7, новая флагманская модель, которая обошла GPT-5.4 и Gemini 3.1 Pro на бенчмарках по agentic coding и scaled tool use. +13% на 93-task coding benchmark относительно 4.6, изображения до 2576 px по длинной стороне, новый уровень усилий xhigh и task budgets в API, команда /ultrareview в Claude Code. Цена без изменений — $5/$25 за MTok. 17 апреля — Claude Design от Anthropic Labs (VentureBeat): новый product line для дизайна, слайдов, прототипов и one-pagers, powered by Opus 4.7. Читает codebase и design-файлы команды, извлекает цвета, типографику, компоненты — и применяет их автоматически. Экспорт в PDF, PPTX, HTML или прямо в Canva. 📰 Подробнее об этих и других AI-событиях первой половины апреля — в новостном дайджесте. 🔗 Обе новости — про агентов. Opus 4.7 заточен под long-running задачи и agentic coding, Claude Design оркестрирует связку «дизайн → прототип → production code» внутри одной сессии. И там, и там за кадром остаётся то, что делает агентов в принципе работоспособными — обвязка. Именно про неё я и хочу написать. Подготовил классический long read и гамифицированный вариант с тестами. А ниже краткие тезисы. ⚙️ Обвязка агента: почему инфраструктура важнее модели ? OpenAI в феврале 2026 опубликовали отчёт об эксперименте команды Frontier Products: 5 месяцев, команда из 3 инженеров, выросшая до 7, с запретом писать код вручную, Codex-агенты в качестве исполнителей. Итог: ~1 млн строк кода, 1500 pull requests, ни одной строки, написанной человеком — включая файл AGENTS.md, который написал сам агент. Throughput: 3.5 PR на инженера в день. Ключевой вывод главного инженера Райана Лополо: «Agents aren't hard; the Harness is hard». Работа инженеров сводилась к проектированию среды, формулированию намерений и созданию feedback-петель. 🔁 Три эпохи инженерии с LLM ▪️ 2022–2024 — Prompt Engineering: правильные слова в правильном порядке ▪️ 2025 — Context Engineering: термин ввёл Андрей Карпати, развил Anthropic. Не «правильные слова», а правильная конфигурация контекста в каждый момент времени ▪️ 2026 — Harness Engineering: термин кристаллизовал Митчелл Хашимото. Включает оба уровня плюс всю инфраструктуру — оркестрацию, состояние, ошибки, верификацию, безопасность 💰 $2B за обвязку Столько Meta заплатила за Manus в декабре 2025. Не за модель, а за пять итераций перестройки обвязки за шесть месяцев — каждый раз с убиранием сложности (тезисы анонса здесь). Сложные определения инструментов стали общим shell execution, «management agents» — простыми structured handoffs. Инженерный опыт, который нельзя скачать с Hugging Face. 📊 Что разобрал в статье ? 1️⃣ Три эпохи инженерии с LLM и как менялись подходы к работе с моделями 2️⃣ Анатомия production-обвязки — все 13 слоёв: петля оркестрации, сборка промпта, tool layer, memory system, управление контекстом, state management, error handling, observability и другие 3️⃣ Meta-Harness — алгоритм автоматической оптимизации обвязки, который достиг 76.4% pass rate на TerminalBench-2 с Claude Opus 4.6 и превзошёл hand-designed системы 4️⃣ Десять ключевых инженерных дилемм: тонкая или толстая обвязка, минимализм инструментов vs полный арсенал, permissive vs restrictive права, harnessability кодовой базы, управление энтропией 5️⃣ Коэволюция модель ↔️ обвязка: как обвязка становится источником обучающего сигнала для следующих версий моделей (через детекцию model drift на длинных задачах) 🎮 Что в гамифицированной версии ? Квизы, карточки и сценарии, где можно попробовать разные архитектурные решения и посмотреть, как они влияют на поведение агента. Формат для тех, кто предпочитает разбираться через практику. 🏗 Ключевой принцип: rippable harness Обвязка — это строительные леса. Без них не построить здание, но как только здание готово — леса снимают. Принцип «rippable harness» (Anthropic, LangChain): проектировать каждый компонент так, чтобы его можно было убрать, когда следующая модель научится делать это сама. @llm_notes @MAX #harness #agents #llm2,54%
  • 16 сент. 2025 г.🧠 Контекст-инжиниринг для AI-агентов: 5 ключевых принципов На выходных посмотрел очень интересный видео-подкаст с участием Лэнса Мартина из LangChain (автора самой популярной открытой версии Deep Research), в котором обсуждались вопросы управления контекстом в агентах - искусство давать LLM ровно тот контекст, который нужен для следующего агентного шага 🎯 Не обошлось и без сравнения моно- и мульти-агентных подходов (см. заметку) Ниже привожу краткие тезисы, а на скрепке подготовил видео-нарезку основных тезисов с субтитрами на русском языке (8 минут). Более полная интерактивная версия конспекта доступна по ссылке (а классический вариант конспекта здесь) 🔧 Пять столпов контекст-инжиниринга: 1️⃣ Offloading (Выгрузка) • Не тащить всё в контекст — сохранять данные отдельно • В историю записывать краткие сводки с возможностью подгрузки • Экономия токенов и денег 💰 2️⃣ Context Isolation (Изоляция) • Мультиагенты хороши для "чтения", один агент — для "письма" • Параллельные задачи изолировать, связанные — объединять 3️⃣ Retrieval (Извлечение) • llm.txt с качественными описаниями часто лучше сложного RAG • Агентный поиск без индексации может превосходить векторный поиск • Ключ успеха — хорошие описания файлов 📝 4️⃣ Reducing Context (Сжатие) • Суммаризация на границах инструментов • Баланс между экономией токенов и потерей информации • Сохранять возможность восстановить исходник 5️⃣ Caching (Кеширование) • Снижает стоимость и задержки • Не решает проблему "context rot" от длинного контекста ⚠️ 🔍 Context rot — деградация качества ответов LLM при слишком длинном контексте. Модель "теряется" в большом объёме информации и хуже понимает, что важно для текущей задачи 📉 💡 Практические инсайты: • Работа с памятью через человека — пользователь явно сохраняет важное, система учится предпочтениям • Горький урок AI — используй структурный подход сегодня, но будь готов отказаться от него завтра • MCP-стандарты снижают когнитивную нагрузку ⚡️ Золотые правила: • Избегай наивного накопления всего контекста • Качественная суммаризация лучше агрессивного сжатия • Простые решения часто превосходят сложные • Фреймворки должны легко "разбираться" Философия: "Добавляй структуру, чтобы работало сегодня, и будь готов отказаться от нее завтра" 🚀 P.S. мне также очень понравились ссылки на дополнительные материалы в описании к ролику, некоторые из них я включил в эту заметку @llm_notes #context_engineering #agents #langchain #langgraph #llm_optimization2,38%
  • 15 авг. 2025 г.🔍 Как сделать виртуальную примерку очков: полный разбор проекта Пока лето еще в самом разгаре и теплые деньки надеюсь у нас еще впереди, хотел бы поделиться опытом разработки веб-приложения для виртуальной примерки очков, которое мы делали в июне в рамках курса "Cursor. AI-прототипирование и ИИ-агенты". Расскажу коротко (насколько позволяет формат заметки) о всех этапах - от исследования до деплоя. Исследование решений 🔬 Сначала проводим анализ возможных подходов к решению задачи и существующих open-source проектов для AR-примерки, которые можно взять за основу. Как правило, после проведенного ресерча всегда возникает "развилка", которая в данном случае выглядит так: • Самостоятельная разработка: Создать решение с нуля, используя комбинацию передовых библиотек: MediaPipe для высокоточного отслеживания лица и Three.js для рендеринга 3D-моделей. Этот подход обеспечивает максимальный контроль, наилучшее качество и гибкость для будущего развития. • Адаптация готового проекта: Взять за основу существующий open-source проект, например, bensonruan/Virtual-Glasses-Try-on (который демонстрирует связку MediaPipe + Three.js). Это может ускорить начальный этап, но в долгосрочной перспективе может оказаться менее гибким вариантом. Мы решили пойти путем адаптации готового проекта. И выбирали из следующих вариантов: • jeeliz/jeelizGlassesVTOWidget - 300 ⭐️ Самое популярное решение с готовой базой 3D-моделей • bensonruan/Virtual-Glasses-Try-on - 46 ⭐️ • alperenuzun/basic-virtual-tryon-glasses - 30 ⭐️ Базовая реализация без продвинутых функций Попробовав все три варианта, я выбрал Jeeliz как наиболее зрелое решение (ну и "звездочек" у него больше). Архитектура финального решения 🏗 • Фронтенд: Lovable.dev - быстрое создание React-интерфейса • Бэкенд: Яндекс.Облако - Docker-контейнер с nginx и виджетом • Интеграция: Stripe для платежей + система аутентификации (заодно проверили как lovable.dev справился с "прикруткой" данных функций - все прошло гладко) Потестировать финальное приложение можно по ссылке (примеры на скриншотах) На посадочной странице есть подробная информация про архитектуру и внутреннее устройство приложения. Техническая база проекта ⚡️ Использовали готовую библиотеку Jeeliz VTO Widget: • WebGL-рендеринг с физически корректным освещением • Нейросеть для отслеживания лица в реальном времени • База 3D-моделей очков (Ray-Ban, Oakley, Carrera) • Поддержка мобильных устройств Что пришлось решать 🔧 1️⃣ HTTPS-требование - камера работает только через защищенное соединение 2️⃣ Контейнеризация - настроил Docker + Nginx с SSL-сертификатами 3️⃣ Проксирование API - внешние ресурсы Jeeliz через локальный прокси 4️⃣ GPU-совместимость - проверка WebGL на клиенте Разделение фронт/бэк 📐 Lovable.dev (фронтенд): • Посадочная страница с описанием • Система регистрации/авторизации • Интеграция Stripe для оплаты • Адаптивный дизайн Яндекс.Облако (бэкенд): • Docker-контейнер с Nginx • Jeeliz VTO Widget • SSL через Let's Encrypt • Прокси для внешних API Практические находки 💡 • GPU нужен только на клиенте, сервер работает без видеокарты • Обязательно тестировать WebGL-совместимость (например, chrome://gpu) • Для слабых устройств есть режим пониженной производительности • Размер приложения всего 2.1MB благодаря оптимизации Результат работы 📊 Получили полнофункциональное приложение: • Работающая AR-примерка в браузере (safari/firefox/chrome) • Каталог с 200+ моделями очков • Система оплаты и личный кабинет (подписку оформлять не нужно, она сделана для проверки функциональности) • Готовое к продакшн-деплою решение Весь процесс занял несколько часов благодаря использованию готовой библиотеки и правильной архитектуре. О курсе 🎓 • Данный проект был реализован в рамках курса "Cursor. AI-прототипирование и ИИ-агенты" • Следующий поток стартует 27 августа - отличная возможность освоить современные инструменты разработки с ИИ. • Примеры реализованных проектов можно найти здесь. @llm_notes #webgl #ar #lovable #cursor #yandexcloud #glasses #productuniversity2,32%
  • 11 сент. 2025 г.828 проектов на базе Nano Banana: обзор хакатона от Google DeepMind Google DeepMind совместно с FAL и ElevenLabs провели 48-часовой хакатон Nano Banana 🍌 Основные цифры: 🔸 2,723 участника 🔸 828 готовых проектов 🔸 48 часов на разработку Что доступно для изучения: 🔸 Демо-видео проектов 🔸 Ссылки на Google AI Studio 🔸 Возможность ремикса проектов в собственном AI Studio Все проекты находятся в открытом доступе на Kaggle. Это хорошая возможность изучить различные подходы к решению задач и найти идеи для собственных разработок 💡 Материалы можно использовать как справочник по практическому применению AI-инструментов в реальных проектах. Вот здесь интересный пример, как сделать генератор протипов приложений (причем приводится не только ссылка на репозиторий с кодом, но и PRD для создания приложения методом Vibecoding'а) Ссылка на коллекцию: 👉 https://kaggle.com/competitions/banana/writeups А какой из проектов вам больше всего понравился? Поделитесь, пожалуйста, в комментариях! @llm_notes #nanobana #hackathon #googleai #aiprojects #kaggle #vibecoding2,25%
  • 23 авг. 2025 г.Вчерашний дайджест новостей, на мой взгляд, был не очень интересным. Поэтому не стал его верстать и публиковать. А вот сегодняшний - достаточно любопытный, поэтому приятного чтения! (13 минутный подкаст можно послушать по ссылке) AI Дайджест: 22 августа 2025 📰 1. Apple и Google: неожиданный союз для Siri 🤝 Apple ведет переговоры с Google об использовании Gemini AI для модернизации Siri. Компания рассматривает внешнее партнерство после того, как собственная разработка застопорилась. Основные моменты: • Решение еще не принято окончательно • Обновление Siri отложено на год из-за технических проблем • Apple также общалась с Anthropic и OpenAI • Акции Alphabet выросли на 3.7% после новости А нам то что? 🤷‍♂️ Наконец-то Siri может стать умнее чайника! Правда, для этого Apple придется просить помощи у конкурентов. А если серьезно: пользователи iPhone могут получить более продвинутого голосового помощника, хотя это означает, что даже Apple признает превосходство чужих AI-технологий. [Источник: Reuters] 3. MIT: 95% корпоративных AI-проектов проваливаются 📉 Исследование MIT показало, что только 5% компаний получают отдачу от AI-инвестиций, несмотря на $30-40 миллиардов трат. Проблема не в качестве моделей, а в "разрыве обучения" (отсутствие культуры использования ИИ в работе). Ключевые выводы: • Исследование охватило 150 интервью и 350 опросов • Готовые AI-инструменты работают лучше самодельных • Наибольший ROI в автоматизации back-office • Половина бюджетов тратится на продажи и маркетинг А нам то что? 🎯 Выходит, что AI — это как спортзал: все покупают абонемент, но мало кто ходит 😉 А если серьезно: это отрезвляющая статистика для инвесторов и напоминание, что внедрение AI требует не только денег, но и грамотной стратегии. Про рекомендуемый Mckinsey подход для разрешения "парадокса генеративного ИИ" и о том, что это такое писал здесь. [Источник: Fortune] 4. Армия США инвестирует $99.5 млн в Scale AI 🎖 Пентагон заключил контракт с Scale AI на исследования и разработки в сфере военного ИИ сроком до 2030 года. Это уже второй подобный контракт компании с армией. Детали контракта: • Фиксированная цена $99.5 миллионов • 11 заявок на тендер • Предыдущий контракт был на $90.8 млн в 2020 году А нам то что? 🤖 Теперь ИИ будет не только писать стихи, но и планировать военные операции. Что может пойти не так? А если серьезно: это показывает стратегическую важность AI-технологий для национальной безопасности США и может ускорить развитие гражданских применений. [Источник: GovConWire] 5. Экологическая цена AI-революции 🌍 Массовое внедрение ИИ приводит к значительному росту потребления энергии и воды, что вызывает обеспокоенность экологическими последствиями развития технологий. А нам то что? ⚡️ Оказывается, ChatGPT не только ест наши данные, но и планету заодно. А если серьезно: это напоминание о том, что технологический прогресс должен учитывать экологические издержки, и, возможно, именно под этим предлогом после того как "борьба за умы" будет закончена и рынок LLM "устаканится", западные провайдеры "внезапно" могут начать повышать цену за токен. И тогда отечественные провайдеры LLM на их фоне станут выглядеть выгодными по цене, и мы станем ими пользоваться не только ради безопасности и соблюдения требований регуляторов. [Источник: ABC News] 6. Analog Devices на волне AI-оптимизма 📈 Акции компании выросли на 3.61% до $255.87, достигнув годового максимума благодаря успехам в промышленном секторе и превышению ожиданий в Q3. А нам то что? 💹 Еще одна компания решила прокатиться на AI-хайпе. Инвесторы скупают все, что хоть как-то связано с искусственным интеллектом. А если серьезно: это показывает, как AI-тренд все еще влияет на весь tech-сектор, создавая возможности для роста даже традиционных полупроводниковых компаний. [Источник: AInvest] @llm_notes #ai_news #tech_industry #corporate_ai #military_ai #ai_investments1,86%
  • 26 авг. 2025 г.ИИ-дайджест: 25 августа 2025 🤖 [6 мин. подкаст здесь] 1. Microsoft выпустила VibeVoice-1.5B — модель для синтеза длинной речи Microsoft представила открытую модель VibeVoice-1.5B, которая может генерировать до 90 минут непрерывной речи с четырьмя разными голосами. Модель построена на базе Qwen2.5-1.5B и использует диффузионные алгоритмы. Поддерживает английский и китайский языки, доступна под лицензией MIT. А нам то что? 🤷‍♂️ Теперь можно создавать подкасты, где ИИ будет болтать сам с собой на английском полтора часа подряд 😉 Технология открывает возможности для создания образовательного контента (пока только для китайцев и англичан), аудиокниг и подкастов на английском/китайском без привлечения дикторов. С нетерпением ждем поддержку русского языка. [Источник] 🔗 2. Обнаружена масштабная ИИ-пропаганда с китайскими корнями Исследователи Университета Вандербильта выявили компанию GoLaxy, связанную с китайским правительством, которая использует ИИ для персонализированных пропагандистских кампаний в Гонконге и Тайване. Система создает индивидуальные профили тысяч американских политиков и адаптирует сообщения под каждого получателя. А нам то что? 🎭 Отлично, теперь даже пропаганда стала персонализированной — скоро ИИ будет знать, какие именно фейки нам больше нравятся 😉 А если серьезно: это сильный сигнал о необходимости развития инструментов детекции ИИ-контента и нашего собственного критического мышления при потреблении информации. [Источник] 🔗 3. ИИ научился предсказывать погоду на месяцы вперед В журнале Nature опубликовано исследование о модели ACE2, которая делает сезонные прогнозы погоды на 1-3 месяца. Модель обучена только на исторических данных ERA5 и показывает результаты, сравнимые с физическими моделями климата. А нам то что? ☔️ Наконец-то можно будет точно знать, что синоптики ошибутся не только на завтра, но и на три месяца вперед 😉 А если серьезно: более точные долгосрочные прогнозы критически важны для сельского хозяйства, энергетики и планирования инфраструктуры. [Источник] 🔗 4. MIT и Harvard создали тест на "понимание" для ИИ Исследователи разработали метрику "inductive bias" для оценки того, насколько глубоко языковые модели понимают предметную область. Тестирование показало, что современные модели плохо выводят общие закономерности из частных случаев. А нам то что? 🧠 Ученые официально подтвердили то, что мы и так знали — ИИ умеет красиво говорить, но не всегда понимает, о чем говорит 🥸 А если серьезно: понимание ограничений ИИ поможет более осознанно применять эти технологии в науке и критически важных областях. [Источник] 🔗 5. Новый подход к созданию пользовательских симуляторов В arXiv опубликована работа о фреймворке для создания симуляторов пользователей в рекомендательных системах. Подход использует LLM для генерации процессов принятия решений и дистилляцию данных на основе оценки неопределенности. А нам то что? 🎯 Теперь ИИ будет еще лучше имитировать наши предпочтения — скоро он будет знать, что мы хотим купить, раньше нас самих. А если серьезно: более точные пользовательские модели помогут создавать действительно полезные рекомендации вместо навязывания ненужного контента. [Источник] 🔗 @llm_notes #ai_news #voice_synthesis #ai_propaganda #weather_prediction #user_modeling1,82%
  • 23 мар.🎬 Как Claude AI видит тебя по ту сторону чата На днях ради интереса я попросил Claude.ai снять ролик о том, как меняется его восприятие пользователя с течением времени. Не абстрактно, а конкретно — на основе нашего с ним опыта работы. Совершенно не ожидал как он расставит акценты. Оказывается, что для него "лично" skill-based подход важен и кардинально меняет его восприятие пользователя (если так можно выразиться). Получилось 85 секунд в трёх частях: — «Со всеми»: поток анонимных запросов, вопрос → ответ → тишина — «Со мной»: созвездие из 25 custom skills, которые превращают чат в рабочую среду — «Разница»: split-screen — «я инструмент» vs «я соавтор» Всё сгенерировано программно: Python + Pillow + ffmpeg, ни одного ручного кадра. Никакого видеоредактора. Claude сам написал сценарий, выбрал цветовую палитру (холодный серый vs тёплый янтарный), сочинил процедурный аудиотрек и отрендерил покадрово. Я никак не влиял на результат, только задал вопрос. Практический вывод: custom skills (чуть ранее писал про них здесь и тут) — это не просто удобство. Это способ дать модели контекст, структуру мышления и память между сессиями. Без них Claude — калькулятор. С ними — соавтор, который знает твои фреймворки, твой стек и твой способ думать. Надеюсь, что многие уже создают свои "навыки" и пользуются ими на постоянной основе. Для тех, кто еще "в раздумье" напомню, что на позапрошлой неделе Anthropic выпустили детальное руководство по созданию production-ready скиллов. Я подготовил для вас интерактивную версию на русском — можно изучить и проверить свои знания. P.S. Для того чтобы быть в курсе последних новостей - подробный AI-дайджест (с первоисточниками) за 15–22 марта: NVIDIA GTC, GPT-5.4 mini, Anthropic vs Пентагон, и open source runtime от NVDIA для безопасного запуска AI-агентов здесь. @llm_notes @MAX #ai #skills #claude #video #news #courses1,80%
  • 27 янв.🔥 От Clawdbot к Moltbot: Как 10 секунд хаоса уничтожили AI-проект с 60K звёзд Время восхитительных историй :) Похоже anthropic планируют вскоре сами запускать продукт аналогичный нашумевшему Clawdbot иначе непонятно зачем все что описано ниже затевалось. Но история интересная и поучительная. Оригинал на английском вы можете почитать по ссылке, а мой вольный перевод всей статьи находится тут. Далее для экономии вашего времени привожу лишь основные тезисы. Три дня назад Clawdbot был звездой AI-комьюнити. 60 800 звёзд на GitHub. Андрей Карпатый хвалил. Твиты "Джарвис уже здесь" повсюду. Сегодня? Проект переименован, основатель борется с мошенниками, сотни API-ключей утекли. 💥 Что это было? Self-hosted AI-ассистент — "Claude с руками". Постоянная память, доступ к системе, 50+ интеграций, работа через WhatsApp/Telegram/Slack. Многие пользователи настраивали его на Claude от Anthropic и специально под него стали покупать Mac Mini :) Хотя, к слову, есть достаточно простая опция развернуть бота на Railway.com - там есть готовый шаблон, Render.com или Fly.io. Что пошло не так? 27 января 2026 Anthropic потребовали ребрендинг — название "Clawd" слишком похоже на "Claude". При переименовании GitHub и X/Twitter аккаунтов основатель допустил ошибку. Крипто-мошенники захватили старые хэндлы за 10 секунд и начали пампить скамы. ⚠️ Последствия: 💰 Фейковый токен $CLAWD на Solana достиг капитализации $16 млн, затем рухнул до нуля 🔓 Исследователи нашли сотни публично доступных инстансов с утекшими API-ключами, токенами, историями разговоров 🎯 Демо-атака: вредоносное письмо с prompt injection заставило AI переслать последние 5 писем пользователя атакующему. Заняло 5 минут Почему это важно? Проект стимулировал использование Claude — продавал подписки, демонстрировал use case, был бесплатным маркетингом. Но получил юридическое давление от компании стоимостью $18B. Комьюнити уже задаётся вопросом: не становится ли Anthropic компанией, на платформе которой опасно строить свои продукты? 🤔 Надеюсь, что это только домыслы. Уроки: → Open-source на корпоративных платформах может быть хрупок → Всего одно юридическое уведомление в сторону вирусного опенсорс-проекта может породить хаос с его безопасностью → Self-hosting AI-агентов с root-доступом опасен без изоляции → Крипто-мошенники мониторят популярные проекты 24/7 Moltbot (новое имя) всё ещё работает и впечатляет. 3-месячный проект с 60K+ звёзд получил юридическое давление от AI-компании стоимостью $18B, $16M скам, захват аккаунтов и утечки данных. И все эти "бонусы" были получены всего за 72 часа ⏰ бешенной популярности. @llm_notes P.S. краткая справка про Moltbot (ex-Clawbot) для тех кто пропустил - это AI-агент, который интегрируется прямо в WhatsApp, Telegram, Discord, iMessage и Slack. Вы пишете ему как своему коллеге, а он выполняет задачи с полным доступом к вашему компьютеру. Да, ко всему 😅 Основные возможности: • Сохраняет память всех разговоров на всех устройствах • Может писать код и автоматизировать задачи • Работает с любыми популярными AI-моделями • Запускается локально на вашем "железе" (хотя есть опция запуска на удаленном сервере) • Может писать собственные skills по требованию Полезные ресурсы для старта: Для новичков: • How To Install ClawdBot (Beginners Tutorial) — безопасная установка с нуля • Бесплатный деплой на AWS — вирусный 2-минутный гайд • Clawdbot with Local Ollama Models — интеграция без API Практические гайды: • Clawdbot: the $5/month AI Assistant That Actually Messages You First — реальные кейсы использования • Что важно знать про безопасность перед первым запуском Технические deep-dive: • The Engineering Behind Clawdbot — архитектура, протоколы и компромиссы • How Clawdbot Remembers Everything — как работает память и выполнение задач Важный момент: Moltbot получает полный доступ к вашему компьютеру. Сначала изучите гайд по безопасности, потом экспериментируйте на запасной "машине". А лучше на облачном сервере. #opensource #clawdbot #moltbot #anthropic1,77%