tgindex
ChillHouse

By Alexey Moiseenkov about startups, AI, ML and consumer product building. Opinions are my own. Only about tech.

Последний пост
14 авг.
Последнее чтение
10:09
Постов за неделю
2
Всего постов
21
Тип
открытый
Язык
русский
Категория
Бизнес
В каталоге с
12 авг.
Подписчики
6 259
+127 за 4 дн.
Сутки
+11
+0,18%
Неделя
 
Месяц
 
Просмотров на пост
5 524
21 постов
Вовлечённость
88,3%
к подписчикам
Постов в день
0,3
всего 21
Упоминаний
12
каналов
Охват размещения
оценка
1/24сутки в ленте
2 626
1/48двое суток
3 009
1/72трое суток
3 245

Оценка по просмотрам недавних постов: пост набирает почти всё за первые сутки.

Посты

  • 14 авг.1 9953017

    Первая большая жертва биг лабов и китайских моделей. Mistral. По факту их стратегия: мы построим для местных госов и прочих дата центр и станем ака SAP/Palantir консультировать и внедрять. А модели свои, ну если надо можете взять, вот API.

  • 12 авг.3 928168164

    Короче rage bait пост. Про бизнес, предпринимателей, венчур и «взрослую индустрию tech». TLDR: венчуру в его текущем виде конец, будут только большие раунды, предприниматели прошлого цикла (а-ля инстаграм кофаундеры) потеряли свою ценность, их опыт не нужен. А теперь по порядку. Мы находимся у порога технологического цикла. Входного порога конечно. AI такая штука которая срезает все «среднее», «ну такое» и прочее ниже этого по качеству. Технология меняет местами в приоритете две важных вещи. Возможность сделать и возможность проверить. Раньше самым большим порогом входа было: собрать команду, найти денег чтобы им платить, мотивировать и так далее. Поток людей в индустрию рос. Было много гипотез, но чтобы их проверить нужно было время и ресурсы. Гипотезы были очень простые. О давай продавать это или отмечать фотки на карте, отмечать клиентов в табличке и трекать прогресс. Все было открыто (интернет меньше регулировался). Поэтому предприниматели славились своими софт скилами. Не так важно было знать проблему и ее решать, важно было найти людей и итерировать. Это ценилось превыше всего. Сегодня я вижу картинку по-другому. Порог до проверки гипотезы упал до нельзя. Простые вещи проверить можно на коленке. Посмотрите на вайбкодинг подделки. И тут оказалось, что решение проблемы в RL стоит сотни миллионов, а твой новый SaaS две выручки дай бог. И для меня поменялось местами следующее. Раньше важно найти с кем и засетапить. Теперь важно очень точно понимать что делать, и желательно формулировать конкретно. И это пресловутое знание в век AI компаний оказалось очень техническим и очень сложным. Залетели первые компании типа perplexity & Harvey. А дальше читая описание компаний поднимающих 200м сразу даже не понятно. И это не потому что они делают чушь (клоуны ахахах), а потому что не понимаешь в чем вообще суть проблемы ими решаемой. Следом за кризисом у предпринимателей будет кризис аллокации капитала. Ведь теперь нужно разбираться «на что» давать бабки, а не кому давать бабки. Что очень ломает мир инвесторов. И софт скилы отходят на второй план, ведь собрать команду под четкую проблему и зная что внутри легче, чем под «Тиндер для собак». А значит нужны инвесторы которые шарят. А таких будет мало, ибо им легче сделать свою компанию. Все эти вещи можно заметить уже сейчас: топ рисерч челы уходят из гугла, в инвест фондах меняются лица, потому что прошлые лидеры просто не понимают что происходит. Тупо банально не вдупляют в смысл происходящего. Такая стадия во многих индустриях. Там где венчура то и нет. Где стало сильно меньше высокорисковых идей с потенциалом. Потому что идеи стали сложные слишком. Это нас ждет и в tech. И да я бы не инвестировал бабки в трек рекорд прошлых лет, а лучше бы студентам норм профессора по ml закинул. Такие дела. Вторую часть может тоже напишу. Но предрекаю огромное количество «великих предпринимателей» у которыхт в эпоху AI ничего не выйдет. Совсем.

  • 3 авг.4 38713657

    Наблюдения последних недель. 1/ есть два лагеря о том, как достичь AGI - это у нас rsi (recursive self improvement) и world models. Первый представляют Anthropic & OpenAI. Второй Google DeepMind. И из-за того что лидер дипмайнда не верит в то, что опенаи получается надо и то и другое делать и поэтому так все медленно. Короче корпоративное опоздание. Но чья ставка сыграет не ясно никому. 2/ в Китай возвращаются те, кто работают в топ местах в сша. Основная идея: они верят что смогут так же как в свое время сша осуществить «китайскую мечту», а именно получить мультипликаторы к оценке их компаний в разы больше. Другими словами нас ждет китайское господство в аи. Я бы сказал, что это более чем вероятно. Учитывая количество усилий и веры. И супер талантов. 3/ в математике назревает кризис. Многие PhD будут мягко говоря обесценены. И я считаю произойдет в целом большая реструктуризация мира наука. Ибо аи сможет буквально открывать и решать 50% текущих задач. И все еще «совсем новых» смыслов пока не видать. И я думаю, что проблема с поиском нового такая же как проблема с написанием резонирующего текста. Потому что в теории относительности важна не сколько теория, сколько идея. Дальше так сказать можно добежать уже как-то. 4/ найм это ад. Рядовой рисерчер в Anthropic (и других топ лабах) получает 10м+ за 4 года. Жизнь боль. 5/ многие компании с трудом осознали, что масштабирование зависит от их возможности тренировать свои модели. Harvey, Cursor (не смогли и сдались чтобы делать в другом месте) и другие 6/ оказалось квантовые вычисления очень быстро развиваются и там много всего интересного особенно в области квантовых нейросетей (лолкек), писать про это? Какие у вас новости?

  • 2 авг.3 731259

    Давно, не делал. Когда-то в канале было, в начале времен. Вообщем AMA или ask me anything (спроси что угодно). Закидывайте в комментах. Постараюсь по возможности ответить. Воскресное.

  • 27 июл.5 2829939

    По теме нетворка. В целом все просто. Если с вами не хотят говорить значит вы делаете что-то, что другому человеку не интересно. Объяснять, убеждать, обижаться просто бесполезно. В долине это легко и быстро заметить. Да и в целом это нормально. Второй способ находить людей - иметь трек рекорд, про который людям интересно узнать (оттуда корпоративная работа в хорошей компании является прекрасным стартом). Все блин. Других способов нет. Теплые интро не работают, если вы делаете «что никому не интересно» или нет трек рекорда. Признаться конечно себе сложно в этом.

  • 21 июл.6 15210453

    У меня есть такой противоречивый довод один. Вообщем про предпринимателей и бизнес. Практически каждый «эксперт» последние десять лет продавал: насмотренность, софт скилы, кругозор и прочую муть. И всегда говорилось «мол не обязательно прям знать вот детали, главное умение видеть куда бежать». Так вот аи мне кажется темку то поменяет. Невозможно теперь и в будущем будет знать куда бежать, если ты прям не супер глубоко в теме. Прям очень сильно понимание важно. Ибо все остальное коммодизируется через аишку. Тут конечно скажут мол останется много всего, где невербальная составляющая много значит. Ну и пусть. Я лишь про tech. Посмотрите на качество вайб кодинг продуктов от «именитых» фаундеров. Им дали в руки лучшие инструменты. И что мы видим? В большой степени это все никому не надо. Потому что их сила была в «умении управлять командами», продажах и прочем. Но не в качестве решения/продукта. А чтобы сделать качество нужно шарить знатно. Теперь школьник который шарит быстрее продаст потому что его решение лучше и дешевле. И это можно будет доказать и показать. Ибо инструменты теперь у всех одни. Другими словами легкость производства сильно обесценит очень большую категорию «бизнесменов прошлого» и они не смогут адаптироваться. Так как учиться новому крайне тяжело особенно в такой быстрой индустрии. Prove me wrong.

  • 20 июл.5 0577649

    Тут вышли Kimi k3 и вот сейчас выходит новый Qwen 3.8 max, который тоже будет ака «fable class model». В интернетах будет туча отзывов, мол смотрите модель умеет все что умеют большие лабы. Попробуем чуть чуть под другим углом посмотреть. Так как релизы очень важные, но смысл иной. За долгие годы мы увидели, что китайцы догоняют западные модели. В основном скупают трейсы и данные «типа дистиллят». Надо понимать что дистилляция сама по себе это не тупо копировать, это для rl как бы холодный старт решает. Поэтому это важно конечно «воровать» данные, но не решает сильно. Далее ребята очень хороши в архитектуре и обучении на старых видяхах и кластерах. Это круто. Плюс open source (тут директор по политике OpenAI, он кстати реально политик, началь писать в тви и обосрался знатно, я такого бреда от такого ранга людей не видел в интернете давно, как будто чел в интернете вообще не сидел ни разу, а пишет что в инете с детства, почитайте сами ибо это интересно). Но важно понимать, что основной эффект этих релизов это публичная информация о том, что многие задачи можно довести до очень высокого уровня и качества просто сделав хороший rl. См frontend arena. Там Kimi k3 рвет всех и вся включая sol & fable. То есть не обязательно брать архидорогую новую топ модель и платить тонну денег, если тебе нужно только решать определенный тип задач. Другими слова стартапы как thinking machines & engram.ai ровно это и делают. Типа приходи дорогой энтерпрайз и мы все для вас сделаем. И теперь это поняли все бизнесы в мире. Здоровая конкуренция наконец-то! Такие дела.

  • 9 июл.12,6 тыс11183

    Ну что ж, вот и наш первый релиз на архив. we achieve a 4.37-fold speedup over autoregressive decoding, and outperform a highly optimized DFlash baseline by 24.7% Это спекулятивный декодинг. SOTA(ну на qwen3.6 точно). Бьем все, что есть известного в паблике (ну dflash). Супер важная тема для быстрого инференса на устройстве, особенно когда понимаешь задачу. GitHub HF Поддержка в нашем инференс движке скоро доедет

  • 7 июл.4 9172893

    У кофаундера thinking machines Lilian Weng всегда интересные посты. На этот раз про то как делать харнесы или обвязки/среду для работы моделей для решения определенных задач. Я бы сказал, что очень важный пункт, который очень часто отсутствует у «на коленке» харнесов это вот такая штука: The design should be deliberately simple and generic to enable generalization, likely with reference to existing software engineering practices to benefit from prertaining knowlege. Ну и мой take что мы будем редизайнить современные OS вокруг вечно работающего в фоне AI (то есть инференс должен как бы крутиться вечно в фоне).

  • 2 июл.8 475121133

    Заметки с полей. Мы используем кодинг агентов для всяких задач. Но именно end2end для экспериментов, поглядеть что к чему (там переписать тестовый апп с электрона на rust и тому подобное). Так вот у меня сложилось впечатление, что fable от Anthropic это первая модель, которую надо уже думать куда натравлять. Иначе это оооочень дорого. То есть просто для себя повайбить эта штука не подходит. И мы приходим к простой мысли. Чтобы понимать куда ее направлять нужен человек, который знает и умеет. И у меня четко в голове складывается картинка и почему в лабы нанимают тоннами. Как никогда в индустрии спрос на хард скиллы вырос жестко. Спрос на понимание, навыки, интуицию очень высокий. Ибо остальное закроет модель если надо. Но если нет навыков и понимания сгорит тонна денег. Мы увидим множество внедрений, которые провалятся не потому что модель не эффективна, а потому что human in the loop не смог. И если раньше на такой вывод требовались годы, испытательные сроки, то теперь можно понять за месяц и все.

  • 1 июл.4 8311619

    О, fable возвращают

  • 28 июн.5 5623563

    Свежий тренд в долине. Вдруг (интересно почему же) многие осознали, что затраты на токены антропика и опенаи слишком высокие и может можно как-то уменьшить. И у гениальных людей появилась идея заделать тонну стартапов по посттрейну сеток на данных компании итд. Подняли 200м даже (конечно напишут красиво обо всем и вся что будет там как продукт). В целом идея неплохая для Энтерпрайза. При наличии хорошей команды можно повторить на любом рынке или около того. Интересно вообще ведет себя рынок перед AIs IPO.

  • 27 июн.5 3282634

    Помните спрашивали про децентрализованный инференс и все такое. Так сказать пища для размышления: - вот так выглядит нормальный стек, как думаете реально заставить игроков поставить так сказать? - в чем принципиальное отличие от обычной клауд инфры с OSs моделями? (OpenRouter?) - ах да инференс сам по себе должен идти вместе с другими тоннами фичей - если модели мелкие что их может хостить обычный чувак, то это значит их можно запускать локально, а значит бесплатно - ну и да, кто блин обеспечивает SLA, поддержку, да что угодно важное для бизнеса? Правильно - никто. И давайте никогда не пользоваться тем, где есть слово «утилити токен», нас же жизнь чему-то научила. Но наверное поиграться кому-то может интересно.

  • 26 июн.4 9799546

    Айяйяй

  • 24 июн.8 39811089

    Немного наблюдений. Про «поиск работы». Регулярно натыкаюсь на русскоязычные посты ака «я крутой, но такие дела, ищу работу». Попробую со стороны нанимающего высказать свои пять копеек: - если кто-то очень крутой, прям безумно вау и все вот такие метафоры в комментах «ты вау», то какого извините хрена ищешь работу? Должны быть причины и если есть неконтролируемые обстоятельства именно с них я бы начал - все эти странные чисто наши присказки: моя суперсила, лучше всего я умею видеть «прибыль/системность/собирать смыслы и превращать их в релизы И так далее» это про что? Никогда не понимал все эти абстрактные описания. Представьте что футболист своему агенту говорит «я вижу философию команды и умею понять как собрать волю в кулак и играть». Так блин все такие. Дайте что-то, что можно пощупать - первое я сделаю это пойду возьму референсы, если позиция выше линейной, а в описании ровно про это и тогда мне все ваши «поиски смыслов и умение собрать системы» пофигу - бывает по-разному в жизни, но всетаки необходимо свою крутость привести к измеримому руслу либо через референсы либо через метрики - исключите свои вайбкодинг поделки пожалуйста, они показывают ваше полное не понимание рынка чаще чем наоборот И я ни разу от кого-то на рынке сша, где типа конкуренция похлеще не видел постов в стиле «я супер крут, но дайте денег ищу работу». У меня в голове как-то эти две вещи плохо сходятся. И наверное поэтому так тут не делают. Edited: на позиции выше линейной. Мои рекомендации, после просмотра тонны резюме и чтения постов и реального поиска людей к себе: - пишите честно что делали и сделали, не украшайте, если ваша позиция не линейная - фокус конечно же на том что важно в отклике - уберите все суперсилы, нытье, ситуацию в жизни и долгую историю, это отбивает желание говорить (мы ведь незнакомы) - показать желание важнее всего - укажите кто вас может порекомендовать

  • 23 июн.3 7706

    видео или голосовое, без подписи

  • 18 июн.5 023277

    Было много работы. Но тут и новостей прикатило: - забанили fable от антропика, там какая-то муть если честно и политика - купили интерком за 3.6 ярда - купили cursor окончательно за акции на 60 ярдов (получается самая дорогая покупка стартапа? Хотя пофиг) А тем временем хорошая картинка про органические запуски без маркетинга и залива и трафлом

  • 8 июн.5 97317355

    Btw релизнули свой первый результат в рисерче. Выкатили первые квантизованные версии моделей Qwen 3.5. За счет совместной оптимизации квантизации и движка инференса нам удалось заметно обойти Unsloth/llama.cpp и MLX по ключевому компромиссу «качество vs скорость». На устройствах Apple от iPhone до мощных Mac модели выдают на 40–60% больше токенов в секунду без потери качества. Пост hf collection

  • 7 июн.4 7388917

    Заметил такую штуку за «успешными инвесторами и предпринимателями». Очень часто пишут советы мол: не цепляйся за ошибки слишком долго, умей проходить их или не пытайся реализовать сто идей сразу, вкладывайся в что-то одно и держи фокус. Ну вы поняли, вот эти стандартные рельсы. И следом обычно я созваниваюсь с этим человеком, у которого один из последних постов именно такой и спрашиваю че как дела. И он делает сто идей сразу, ему пофиг на людей, главное идея и так далее. Или другими словами полностью противоречит тому, что сам пишет и другим советует. Встречали?

  • 4 июн.5 3202149

    На заметку пользователям Claude. Но вообще очень взвешенная статья вышла. Крайне не похоже, что Дарио ее смотрел. Without that judgment, Claude is a capable assistant, but not a system that could drive AI progress on its own. It is genuinely unclear whether today’s training methods and architectures could unlock that capacity.