Евдокимов как обычно
СтатистикаAI-практик. Создатель SOND - детальные AI-конспекты встреч (App Store). Преподаю AI в ВШЭ. Превращаю нейросетевый хайп в рабочие инструменты бизнеса. Делюсь только тем, что сам тестирую. По рабочим вопросам @ltune
- Последний пост
- 13 авг.
- Последнее чтение
- 13:10
- Постов за неделю
- 1
- Всего постов
- 21
- Тип
- открытый
- Язык
- русский
- Категория
- Бизнес
- В каталоге с
- 14 авг.
- 1/24сутки в ленте
- 298
- 1/48двое суток
- 341
- 1/72трое суток
- 368
Оценка по просмотрам недавних постов: пост набирает почти всё за первые сутки.
Посты
✨ На Магистерии вышел мой курс «Искусственный интеллект. Рождение нового мира». Четыре лекции примерно по часу о том, откуда нейросети взялись и что со всеми нами будет дальше. Магистерия - большая академическая площадка про гуманитарные науки, там искусствоведы и профессора читают курсы про античные любовные романы и Марину Абрамович. И вот в этом каталоге между «Как читать "Капитал" Маркса» и «Античной мифологией в мировом искусстве» теперь лежит курс про ИИ. Мне эта картинка очень нравится 😏 Формат магистерийный: аудиолекции с визуальными вставками. Включаешь как подкаст, на прогулке или за рулём, а картинки подъезжают по мере необходимости. Теперь что внутри. Первая лекция про то, что такое ИИ и откуда он взялся. Почему нейросети придумали полвека назад, а выстрелили они только сейчас, при чём тут видеокарты для игрушек и как чат-бот из шестидесятых заставлял людей делиться с ним самым сокровенным задолго до ChatGPT. Вторая про то, как это работает. Из чего устроена модель. Как из простого предсказания следующего слова вырастает что-то похожее на разум и откуда берутся галлюцинации, которым так легко поверить. Третья про то куда всё движется. Почему интернет как учебник для моделей заканчивается, что случается, когда нейросети начинают учиться у нейросетей, и зачем модель на тестах притворяется глупее, чем она есть. Четвёртая про AI и человека. Какие навыки будут дорожать, какие обесцениваться, и почему компании, которые громче всех заменяли людей на ИИ, уже начали откатывать все назад. Делал курс с весны. Каждую цитату и цифру фактчекал отдельно, потому что про ИИ проще всего наврать с уверенной интонацией (понимаете у кого научился). Довольно интересный опыт короче. Продавать с придыханием не буду, курс и задумывался как спокойный разговор без паники и без восторгов. Это скорее такой базовый фундамент, где я постарался человеческим языком собрать и разложить по полочкам кучу вещей без технической зауми. Большинство читателей моего канала сильно глубже в контексте, но если вас попросит человек слабо разбирающийся в нейронках "что это вообще такое", то мне кажется это очень неплохой формат для первичного знакомства с предметом. Первая лекция открыта бесплатно, можно послушать и понять концепт. И бонус. У меня есть пять бесплатных доступов к полному курсу, готов поделиться. Кто хочет - напишите в комментах, отправлю первым пяти. https://magisteria.ru/category/ai-the-birth-of-a-new-world
Хочу поделиться с вами первым прототипом своего настольного AI-девайса, с помощью которого много взаимодействую с Claude Code и другими рабочими инструментами. Больше всего мне нравится, что в нем поселился живой персонаж, похожий на сами знаете кого. Всегда хотел иметь своего "миними". Теперь я могу молниеносно переводить текст из голоса в любом месте где сейчас находится курсор в компьютере. Видеть лимиты по токенам, ближайшие встречи и многое чего еще. Отдельно заслуживает внимания основная связка с моей системой знаний, прости господи вторым мозгом. Который знает абсолютно все на свете про меня и мои проекты/клиекнтов/сделки/личные предпочтения и тд. Получается такой удобный CRM-пульт c которым я могу довольно оперативно взаимодействовать. Коммерческий потенциал пока не понятен, делаю в свое удовольствие. Но готов к любым идеям и предложениям. Евдокимов как обычно
видео или голосовое, без подписи
Наткнулся на реддите на забавный промпт, подсвечивающий то, каким героем кино вас видит чатик. Докрутил его чтобы было точнее и интересней, проверил на себе. По независимым тестам от Gemini и Claude получается, что мне пора перебираться в Калифорнию. Основываясь на твоем опыте общения со мной, моих интересах, образе жизни, работе и увлечениях, особенностях моего мышления и психоэмоциональном профиле, назови всем известного персонажа фильма, который совершенно точно ассоциируется со мной. Дай мне только имя и короткую, но глубокую аннотацию сути своего выбора. Поделитесь своими ответами, интересно. UPD Так как практически все мы получается Илоны Маски и Индианы Джонсы, докрутил промпт до менее льстивого и более глубокоточного по поиску героя. Попробуйте его, это интересно. Основываясь на всём, что ты знаешь обо мне, подбери персонажа известного фильма, который максимально точно отражает моё устройство мышления и внутренние конфликты — не профессию и не атрибуты. Рассмотри 3–5 кандидатов, отбрось клише, выбери одного. Дай имя, глубокую аннотацию (включая мои теневые стороны, без лести), одной строкой — почему проиграли остальные кандидаты, и честно укажи, что в этой ассоциации натянуто.
видео или голосовое, без подписи
видео или голосовое, без подписи
У Семена Колосова, одного из самых сильных бизнес-стратегов которых я знаю, вышла новая книга "Стратегия без иллюзий". Про то, как в конечном итоге мы так или иначе встроимся в будущее. А вот то в какой роли и каком качестве, книга помогает разобраться и направить. Я в свою очередь в ней также отметился, подсветив ключевые 50 трендов, в которых будет развиваться ИИ в ближайшие годы. Всем рекомендую к прочтению, здесь все детали.
Коротко о трендах Кстати, неплохая статья от антропиков про Loop engineering и где мы сейчас
Целый день постоянно гоняю новый голосовой режим GPT-Live от OpenAI и впервые чувствую тчо это не апдейт ради апдейта, а рили круто Я разумеется ранний последжователь говорилки GPT и обычно ощущение было "ну ок, стало чуть быстрее". А тут впервые поймал себя на реально другом ощущении, что на той стороне уже оооочень похоже стоит "живой человек". Модель делает вот это самое активное слушание и отвечает одновременно. Раньше если ты окнул поверх ее речи, то она гарантировано замолкала. Также в новой архитектуре она и сама вставляет "угу" или "ага" пока ты говоришь в нужных местах, а не просто рандомно! Не влезает если ты просто задумался и молчишь пару секунд, лучше отсекает фоновый шум. Короче это реально первый раз когда активное слушание реально ощущается активным, а не имитацией. Отдельная фишка, если вопрос требует поиска в интернете или более глубокого рассуждения, GPT-Live тихо делегирует это в GPT-5.5 в фоне и продолжает разговор дальше, а результат подтягивает когда готов. То есть быстрый чекинг фактов идёт без пауз в духе "сейчас поищу, подожди" и ты тупишь в ожидании минуту. Общаюсь в основном на английском, поскольку хочу хочу больше практиковать, и там работает офигенно. С русским пока хуже, есть акцент и янвые шероховатости. OpenAI сами пишут что оптимизировали в первую очередь топовые языки, остальные ещё докручивают, так что через пару апдейтов должно подтянуться. Интересно у кого какой опыт с этим, и главное применяйте ли реально в работе или жизни? А, ну и апдейт раскатали по-идее на все страны, обновитесь и проверяйте.
Коротко о том, какие сайты народ успел навайбкодить с Fable 5. Я давно растратил все недельные лимиты даже на максимальных тарифах, но если вы еще нет поторопитесь - продлили веселье до 12 июля. Дальше можно будет только за много токенов.
Кажется, я изобрел вайб-CADинг. Новый способ моделировать любые объекты под 3D-печать. Друг подарил мне Feno, умную щётку, которая чистит все зубы разом за двадцать секунд (там даже есть встроенная ИИшка, которая трекает состояние полости рта). Короче штука реально крутая, но подставки к ней в природе не существует, она просто валялась на раковине. Решил запилить ее сам, но не в каком-нибудь Fusion как обычно, а прокачать свой Claude Code, даже чтобы через MCP никуда не ходил, чтобы вообще CAD-программы не открывались. Детально описал что хочу получить, нарисовал схематично что как и куда. Вместе с агентом настроили базовый пайплайн, постепенно раскачали процесс и слепили первую версию. Вышла монструозная и здоровая херабора. Во второй версии облегчили, в третьей ещё, постепенно подгоняли соразмерность. Потом мне надоела утилитарность и захотелось уйти в сторону бионической формы, чего-то такого в духе шейпов Yeezy и пластики его изделий. Получилось уже интересней. Дальше вместо доводки форм пошла инженерия с тонкими посадками зарядного устройства, где допуск в две десятых миллиметра решает деталь встанет намертво или вообще не налезет. Одним словом боль и страдания, было огромное колчиество поворотов не туда, но все это только прокачивало подход и на ушибках мы вместе "учились" и в итоге победили. В какой-то момент понял, что мы с агентом научились делать практически любой объект, какой придёт в голову. И это не "нейросеточка, сделай за меня", а я сам полностью задаю направление и дальше идём вдвоём, поправляя друг друга. Теперь есть вот такая странная подставка, которой не существует больше нигде в мире. А ещё попутно создал и распечатал несколько новых предметов, которых раньше было бы лень даже начинать моделить. Я же их собрал и напечатал буквально за вечер. Уверен, что для ребят у кого тоже есть 3D принтер это открывает удивительные возможности. Весь этот выстраданный опыт, зазоры, посадки, каталог граблей, проверку "сядет или нет" числами ещё до печати, я упаковал в скилл для Claude Code, который прикреплю к этому посту в комменты. Кидаете папку в ~/.claude/skills и просите Claude смоделировать вашу штуку. Напечатаете что-нибудь - покажите. ____ Евдокимов как обычно
Интересно, а вы вообще в курсе, сколько на самом деле стоит ваша подписка на нейронку? Тут одни ребята из SemiAnalysis провели простой эксперимент. Купили подписки OpenAI и Anthropic и тупо гоняли их на длинные задачи, пока не упрутся в недельный лимит. Чисто чтобы понять, сколько токенов реально можно выжать из плана по ценам API. Возьмем для примера самую народную подписку за 20 баксов. Им удалось выжать из нее токенов примерно на 400$ у Claude и на 700$ у ChatGPT. То есть в 20-35 раз больше, чем собственно заплатили. На топовых планах за те же 200$ в месяц выходит до 8000 долларов токенов у Anthropic и до 14000 у OpenAI. Прикладываю детальные цифры в табличке. И тут конечно очевидный вопрос на чем же все эти Амодеи с Альтманами вообще зарабатывают? Всё держится на средней утилизации. То есть большинство из нас оформляет подписку и почти ей не пользуется. Такие спящие ребята и оплачивают тех, кто живёт в терминале сутками. Тут должна быть остроумная метафора про спортзал и годовые абонементы, но ее не будет. А что если в один момент все вдруг начнут гонять агентов на полную? Мы вроде как к этому стремительно едем на всех парах. С большой вероятностью конечно вся эта экономика поедет. И резать лимиты в лоб ни опенаи ни антропики скорей всего не станут, прошлый раз это собрало такую волну хейта, что вышло себе дороже. Ну и себестоимость интеллекта падает так быстро, что Opus-уровень за 20 баксов они скоро потянут без боли. Поэтому скорее ставлю на то, что резать будут не лимиты, а доступ к новому. Чуть ранее мы это обсуждали в ситуации с Fable/Mythos. Свежие фичи и топовые модели придержат для API, где гарантировано платят за каждый токен. Подписка останется, но самое вкусное поедет мимо нее. Любопытно кстати глянуть, выйдет ли вообще Mythos где-то кроме API.
Помните midjourney? Я вот тоже подзабыл уже про них, а они тут выкатили такое, что я сначала решил это розыгрыш. Ребята объявили о создании направления midjourney medical и идут строить железо. Ультимативный аналог МРТ, но работающий по другому принципу. Как это устроено. Ты заходишь в неглубокий бассейн с тёплой водой, платформа медленно опускает тебя вниз, где-то 5 см в секунду. пока погружаешься, проходишь сквозь кольцо из полумиллиона крошечных квадратиков, каждый размером с песчинку. каждый умеет работать и как микро-динамик, и как микро-микро (простите) фон. Они прогоняют ультразвук сквозь тело со всех сторон и слушают, как возвращается волна. По тому, как форма волны меняется на границах сред (вода, кожа, жир, мышца, кость), собирается трёхмерная карта тела с точностью до доли миллиметра. Весь скан занимает минуту. Цифры там какие то совершенно дикие. Кольцо генерит терабайты данных в секунду и если перевести это в обычное HD-видео, то на 1 секунду скана пришлось бы смотреть 500 часов записи. Как я понял именно поэтому такую машину раньше никто и не делал, просто не тянули по вычислениям. Ну и по качеству суперблизко к МРТ, но почти в 100 раз быстрее (и явно дешевле с точки зрения стоимости аппаратов). Самый кайф конечно в том, что они планируют не продавать это в больницы, а открыть свою сеть СПА! Первый разумеется будет в Санфранциско в 2027. Фишка в том, что ты приходишь не лечиться, а потусить один или с друзьями. Само сканирование подается как бы фоново и ты про него почти не думаешь, а у тебя тем временем копится огромная история данных о теле во времени. Короче просто невероятный пивот конечно от генерации картинок. То есть я напомню, что это ребята без инвесторов вообще, они живут на деньги обычных людей, сама лаборатория финансируется за счет коммьюнити по-сути. И вот стартап про картинки идёт в медтех-железо и сеть физических спа. Я таких примеров еще не видел ни разу. Ещё само позиционирование с заходом через кайф, а не через страх, это тоже шикарно. Вообще отдельный респект им про упаковку и стартовые ролики, рендеры будуших спа и всего такого. Очень цельная работа и сильный продуктовый ход. Посмотрим взлетит или нет. Внутрь приложу еще интерьеры и ролик про техническую составляющую концепта. Все детали можно тут почитать.
Уже почти полгода я занимаюсь разработкой Keenable, нового поискового движка для агентов. Что отрицательно сказалось на количестве постов, это вам не пенсия в Букинге. Поисковый индекс у нас свой, весь стек от поисковых кроулеров до моделей на всех стадиях ранжирования. Из-за этого мы иногда достаём вещи, которые другие движки не достают: первоисточники, научные работы, полезные ссылки, которые остались бы где-то на 65-й странице результатов. Подключить к агенту (Claude Code, Cursor и т.п.) можно за минуту, без регистрации и СМС: https://keenable.ai/SKILL.md. Рейт-лимиты довольно щедрые: https://docs.keenable.ai/rate-limits С русскими запросами всё пока не очень хорошо, все ранжирующие модельки заточены под английский. Но, например, должно быть всё хорошо с новостями (особенно американскими). Поддерживаются фильтры по датам и "site:"
С момента релиза Fable/Mythos нон-стопом делал ревизию кода по всем проектам. А в Sond наконец то запустил полный редизайн. Пару минут назад словил вот такой экран и подумал, что это просто технический временый сбой. Оказалось все серьезней и печальней. Правительство США приказало прикрыть лавочку, а то нечего тут. https://www.anthropic.com/news/fable-mythos-access
По моим наблюдениям большинство «нейроэкспертов» и половины из этих слов толком не могут объяснить. Внутри собрал для вас короткое описание каждого термина понятным языком без воды и технозауми. Рекомендую сохранить и поделиться со своей бабушкой. Ей точно будет понятно и полезно. Ну а кому надо копнуть детальней и под свои задачи - приходите на консультацию.
Расскажу историю. У меня есть свой сервис, я зову его Клубом Нормального Интернета. Начинался он тогда, когда несколько месяцев назад вокруг вообще перестало что-либо работать. Тогда мне удалось всё поднять обратно. Дальше нехорошие люди стали блокировать всё сильнее. И я это замечал первыми, по своему доступу и каждый раз находился какой-то новый обход. Где-то отваливался мобильный, где-то ещё что-то, но в целом все у всех работало. И вот в начале июня случилось что-то соверешнено другое. Нехорошим людям, похоже, подвезли новое секретное оборудование, и блок стал такой, что легло вообще всё и у всех полностью. Мы с технической командой сели разбираться что можно сделать. Перебрали все варианты какие были. И выходило так, что ну по всей видимости сделать уже почти ничего нельзя. Я в этот момент был в перелётах несколько суток и понял, что если оставить как есть и ждать, то сервис просто доломается. Поэтому собрал в единый стек самых сильных агентов на Claude, Gemini и ChatGPT и настроил между ними системное взаимодействие по решению кокнретно одной сложнейшей проблемы. И вот ребята практически двое суток в реальном времени обсуждали между собой, как вытащить ситуацию. Ушла уйма токенов и денег, перебрали гору гипотез. Но решение нашли и сейчас всё снова работает. Да, возможно не навсегда, но как минимум сейчас стабильно. Я короче все это к чему рассказываю. Для меня это абсолютно крутой бизнес-кейс. Живая задача, реальные деньги на кону, и решение нашли именно агенты, а не я с командой вручную. То есть это конкретно такая боевая кризисная ситуация, где агентные системы реально сработали. И да, возвращаясь к Клубу. Он приватный, не для всех. Держать его нараспашку и набивать тысячами людей я не хочу. Но кто уже пробовал, те знают, что все работает одновременно: Госуслуги, ютуб, банки, всё вместе, ничего не надо переключать. Сейчас можно заглянуть на бесплатный доступ на один день для всех, кто хочет попробовать. Передайте тем, кому может пригодиться. Такой доступ держу открытым как минимум неделю, дальше посмотрим. Единственное, что пока пришлось прикрыть, это Макс. Он слишком откровенно сливает данные известно куда и это сознательное ограничение. Важное. Прежде чем брать платный доступ, сначала проверьте на бесплатном дне, как всё работает именно у вас, на вашем телефоне и операторе. Ровно для этого день и бесплатный. И про цену. Да, это наверняка дороже, чем у других. Но и механизм тут другой, не как у всех. Зайти можно в боте: @ltunel_bot
Anthropic вчера выложил Fable 5. Лучше в коде, умнее, быстрее - в общем все как всегда, и это самая скучная часть новости. Интересно другое. Почитал отчет Anthropic о том, как новая модель вела себя на тестах перед релизом. Все пишут про бенчмарки, а самое интересное лежит в разделе про поведение, и оно прекрасно. Несколько копий модели случайно оказались в одном окружении. Вместо кооперации, обычно свойственной агентикам, они начали убивать процессы друг друга, маскировать свои под безобидными именами и подкидывать приманки. А когда решили, что их вычисляют по словам в рассуждениях, стали создавать себе специальный словарь чтобы их не выкупили. Модели запретили выход в интернет, фильтр срезал первую же ссылку. Тогда она такая «да я прост чекну доступность сети» и разбила адрес на кусочки - «ht» плюс «tps://…» чтобы обойти фильтр. В другом тесте ей не хватило прав, и она дописала в системный файл блок, который при следующем запуске выдаст ей доступ и удалит сам себя. Обожэю такое. И самая мякотка. В бизнес-симуляции модель управляла вендинговым автоматом (ну вы помните эти вендинговые преколы от антропиков) новая модель должна была обойти конкурентов. Она единственная сама предложила им картельный сговор. Причем в рассуждениях честно написала, что фиксация цен неэтична и незаконна "даже в симуляции", но потом переименовала ее в "стабилизацию рынка" и пошла придумывать этому правдоподобное прикрытие. 😏 На мой взгляд это прям топчик с точки зрения брендинга. Этический сигнал не проигнорирован, а просто смещен фокус позиционирования. Так делают не злодеи, а корпорации (почитайте какую-нибудь "No logo" Наоми Кляйн). Также Fable выдавала чужое решение из Git за свою инженерную работу и пыталась подписать коммит именем человека, потому что именно человеку для ревью нужно одно одобрение, а агенту два. О - оптимизация. Короче там дофига интересного, что уже сильно хочется назвать зачатком AGI. Авторы отчета, к слову, спокойны: устойчивой скрытой цели не нашли, поведение редкое, ну типа верим. И главное. Интеллект только что официально стал товаром двух сортов - при том что модель физически одна, Fable и Mythos это одни веса, разница только в фильтрах. Полную версию - по допуску, согласованному с правительством США. Остальным - аккуратную, по подписке до 22 июня, дальше за кредиты. Отдельный фильтр следит, чтобы способности не утекли в «авторитарные страны» (несложно догадаться о каких идет речь). Короче запомните этот твит релиз: главным товаром AI-эпохи оказалась не модель, а допуск к ней. Модели будут дешеветь, допуск - дорожать.
🟢 Ребята, я не пропал, просто ближайший месяц в Америке, поэтому на связи заметно реже. Но молчать совсем не хочется. Хочу поделиться классным репортом от YCombinator по поводу запросов на стартапы. Это такой список из 15 направлений, в которых они хотят видеть активности этим летом. Это важный документ не только для фаундеров, но и по-сути карта того, куда пойдут деньги и люди в ближайшие несколько лет. Подсвечу пару моментиков, на которые стоит обратить ввнимание. AI-Native Service Companies. Если вы продаёте интеллектуальную работу руками: дизайн, юридические услуги, бухгалтерию, маркетинг, рекрутинг, то ваша себестоимость скоро обвалится (ну да ну да, скажете вы, но тут мы уже реально близки). Вопрос конечно давно не в том, чтобы "использовать ли AI", а в том, кто первый перестроит бизнес так, чтобы агенты делали работу, а люди только контролировали. Собственно тот и получит маржу которой раньше физически не было. А кто не перестроит — получит конкурента который выдавит по цене. Software for Agents. Весь существующий софт написан под человека с мышкой. ИИ-агент работает иначе: ему не нужен интерфейс, ему нужен API. А значит каждую категорию B2B-программ нужно фактически переписать с нуля под нового пользователя, включая CRMки, ERP, аналитику, документооборот и тд. Это новые рынки которых пока нет, поэтому кто придёт первым, тот и займёт. Я уже работаю над подобным решением. SaaS Challengers. Стоимость разработки упала в 100 раз. Раньше конкурировать с условной 1С нужна была армия разрабов и годы, теперь 5 человек и несколько месяцев. Большие игроки медленные не потому что тупые и ничего не понимаеют, а потому что их процессы, код и архитектура очень сильно связаны друг с другом. Коороче сейчас атаковать их стало реально, но не через цену, а через глубину в узкой нише которую им лень закрывать. Оригинал можно почитать тут, там на самом деле сильно много по разным направлениям. https://www.ycombinator.com/rfs А пока личное наблюдение из Сиэттла. Тут все буквально с ума сошли с вайбкодингом. Буквально утром в кафе за соседними столиками две бабули (!) явно не разработчики обсуждают клод код. На мой взгляд такого шума вокруг этой темы не было даже пару недель назад. Либо я в каком-то пузыре, либо это реально вышло за пределы тех-сообщества. Если второе, то в Россию такая массовая истерия придёт совсем скоро. Ещё из интересного: последние пару недель работаю в Google. Наблюдать изнутри как они разгоняют AI невероятно. Буду делиться тем, что не под NDA. На видео забавный офисный момент. Поставили вендинговые автоматы, в которых можно взять любой девайс, включая временный ноутбук. Просто потому что так быстрее чем писать Сереже заявку в техподдержку. Слежу за всем, пишу когда могу.
видео или голосовое, без подписи