Big Ledovsky | AI изнутри
СтатистикаАлександр Ледовский Head of AI @ Listee, ex: Avito, Сбер, ШАД @aledovsky
- Последний пост
- 22:11
- Последнее чтение
- 12:23
- Постов за неделю
- 3
- Всего постов
- 23
- Тип
- открытый
- Язык
- русский
- Категория
- Карьера
- В каталоге с
- 12 авг.
- 1/24сутки в ленте
- 612
- 1/48двое суток
- 701
- 1/72трое суток
- 756
Оценка по просмотрам недавних постов: пост набирает почти всё за первые сутки.
Посты
Мнение про свежий гайд Claude Code Как клодовод со стажем, могу вставить несколько копеек 😎 Выбор модели и уровня усилий Абсолютно нереально этим управлять. Модели так часто меняются, даже в стеке антропика. Невозможно успевать вырабатывать интуицию, поставить фейбл или опус или соннет. Я тупо пользуюсь fable. Уменьшение контекста и сабагенты Ральф луп и контекст задачи в маркдаун файле - все еще лучшее решение на мой взгляд. Управлять сабагентами сложно, потому что они включаются непредсказуемо. Теоретически можно аккуратно прописать правила когда и как их запускать в Claude.md, но я до этого не дошел. Сабагенты - это автоматический способ экономии контекста. Ральф луп - это ручной, но достаточно хорошо управляемый. Совет запускать компактизацию когда уходишь от компьютера странный. Это требует огромной ментальной энергии, а в агентах наоборот хочешь ее экономить. Да и не доверяю я компактизации. Не понятно насколько она ухудшает качество контекста. Совет тегать файлы через @ в моем случае работает плохо, потому что я читаю файлы из разных мест и работаю с несколькими репозиториям сразу. Про часовое кеширование А вот на этом хочу акцентировать внимание. Часовое кеширование - это самый важный геймченджер антропика. Это причина, почему если просто включить API на Гермесе через OpenRouter агенты становятся золотыми. Я плохо понимаю, как работает подписка кодекса. Но в обычных API у других провайдеров нет нормального предсказуемого способа кеширования. Обычно они говорят, что кешируют, но как и на сколько - не гарантируют. Обычно кешируют на несколько минут и часто мы отвечаем агенту с большим лагом. В подписке Claude часовое кеширование включено по умолчанию и именно это позволяет укладываться в лимиты на больших задачах. https://claude.com/blog/maximizing-the-value-of-your-claude-code-sessions
Channel photo updated
Что я думаю про Conductor Conductor - это приложение для оркестрации агентов, которое я периодически видел в разных ютубах. Это что-то среднее между UI Claude Code и Codex и полноценной IDE типа курсора. IDE вайбкодера короче 🤪 Основа рабочего процесса состоит из двух элементов. Традиционные сессии с агентами. И код ревью того, что наделал агент. Conductor сам не ходит в модели, как курсор, а подключается к уже установленным Claude, Codex итд. Я посидел на нем над одним личным проектом. Тул прикольный, подойдет для неинженеров. Для инженеров скорее нерабочий. Что понравилось Conductor форсит свой подход к работе. Проект обязательно должен быть git репозиторием, подключенным к гитхабу или другой платформе с механизмом PR. Каждая новая задача агенту создается в виде workspace - 1 или более сессия с агентом + git worktree, который мерджится исключительно через PR. Что не понравилось В рабочих проектах вы не хотите плодить PR-ы на каждое изменение агента. Почему не поддерживаются локальные ветки и мерджи - я не понимаю. Вторая проблема - там нет полноценной поддержки синтаксиса - go to definition итд. Без этого раскапывать километры вайбкода очень больно. Третья проблема - нельзя делать фичу сразу в нескольких репозиториях. А в ds это постоянно (сервис + рисерч репозиторий) Итого Интересный инструмент, но моя перемотанная скотчем фабрика задачи решает лучше 😎
⚡Могу рассказать где я работаю Один из самых частых вопросов, которые я получал - как мы называемся Ну, наконец-то можно перестать ходить на конференции с шильдиком NDA! 😄 https://www.spot.uz/ru/2026/08/04/listee/
видео или голосовое, без подписи
видео или голосовое, без подписи
видео или голосовое, без подписи
Правда жизни про поиск После того, как на конференции вы вдохновились очередным докладом про супер-пупер нейронку для поиска, может сложиться впечатление, что поиск - уже решенная задача Вот вам простой пример, что это не так 😄 Запрос: "гермомешок 50л". Можете посмотреть как с ним справляются крупные ecom площадки. Ozon, Avito, Amazon, Ebay. Все выдают гермомешки неправильных размеров (Авито кстати меньше всех!) С числовыми параметрами справляется Lamoda, потому что у них относительно узкая область и есть разбор запроса и преобразование его в фильтры. Но на большом ассортименте это очень тяжело поддерживать. Короче есть еще чем позаниматься в поиске 😎
Какое-то время сидел на Opus 5 как на основной модели в Claude Code. Понял, что страдаю 🦶 Агент тратит много времени на простые задачи, выдает полотна ненужной информации и прочее. В итоге, на сложных проектах переключился на Fable, на простых вернулся на Opus 4.8 (если не знаете как - /model claude-opus-4-8) Пошел смотреть что пишут другие, у других людей 🫁 тоже много негатива раз два Тем временем Boris Cherny в свежем выступлении на YC рассказал, что под каждую новую модель они на самом деле почти полностью переделывают систем промпт Claude Code. Не факт, что Opus 5 правда настолько плох, думаю его допилят за счет систем промпта и он будет лучше ощущаться. У меня такое уже было, кажется, на Opus 4.6. Сперва страдал, а потом стало ничего 👌
Marimo побеждает Streamlit в нашей команде К моему удивлению. Потому что сам я два раза пробовал пересесть на Marimo, и оба раза не выдерживал из-за неудобного UI Вообще, marimo - это современная альтернатива jupyter ноутбукам. Еще у него есть режим публикации, который позволяет делать хорошие интерфейсы, по функционалу примерно как стримлит. Т.е. на нем можно сделать смотрелку предсказаний, или тестовый интерфейс для модели, или интерактивный дашборд. Причем ребята говорят, что де-факто не работают в UI marimo и все делают через агента. Мне лично работая с агентами больше нравится комбинация python-скрипты + streamlit. Но мб нужно еще раз попробовать.
2-го августа будет конфа UrbanML. Собираюсь сам и могу порекомендовать вам. — 18 докладов по RecSys, NLP, антифроду и агентным системам, выступления специалистов из MTS Web Services, ВТБ, «Звук», Wildberries, Альфа-Банка и других компаний. После основной части — спортивные активности (мастер-класс по баскетболу, настольный теннис и ИИ-шахматы) нетворкинг и афтепати. Вход бесплатный, но нужна регистрация (на площадку необходимо взять с собой паспорт или права): ссылка 📅 2 августа, 11:00–21:00 (первый доклад в 12:00) 📍 Москва, офлайн
Про Wispr Flow Вот уже какое-то время пользуюсь Wispr Flow. Это приложение, которое ставится на Mac и на iPhone и распознаёт голос. Идея этого приложения в том, что оно добавляет ваш контекст 🧠 Не очень понимаю, как это работает, но по идее оно должно видеть, где вы пишете, что вы пишете, какие используете слова и использовать их при распознавании. Спойлер, все не совсем так Я слышал про Wispr Flow и про его аналог Aqua в нескольких каналах и лично от нескольких людей, и все очень хвалили. В итоге мои впечатления смешаны 🙄 Сперва был восторг, что теперь можно всё вводить голосом. Потом я немного попользовался и столкнулся с реальностью, что все не так гладко. По итогу Wispr Flow - это офигенный инструмент для общения с агентами, потому что все грехи распознавания агент принимает легко. Но если мы говорим про написание сообщений или написание документов, то тут всё сильно сложнее. Несмотря на то, что говорят, что Wispr Flow смотрит контекст, специфичные слова он не распознает. Получается довольно много ошибок и без редактирования такой текст отправлять нельзя 🩸 Вообще я сомневаюсь, что Wispr Flow проходится ллм-кой по выходу движка распознавания речи, как я думал вначале. Потому что мы делаем похожую историю у себя в приложении и таких ошибок не происходит. Но по итогу все равно прикольно. Главная киллер 🔫 фича Wispr Flow: как удобно он интегрировал интерфейс, особенно в маке, где распознавание работает в любом приложении по нажатию кнопки. Последняя мысль: что навык голосового ввода нужно развивать, как и навык использования LLM 😎 PS. Если будете пробовать, можете взять мою рефералку
Бенчмарки - это как собеседования Есть люди, которые их замечательно проходят, а потом нифига не работают 🙂 Посмотрим что будет с Kimi K3 PS. Если что, заявка очень серьезная. На данный момент открытые модели идут во втором эшелоне и заметно отстают
видео или голосовое, без подписи
видео или голосовое, без подписи
видео или голосовое, без подписи
видео или голосовое, без подписи
видео или голосовое, без подписи
Традиционно пишу в этом блоге про походы. В этом году пошел на сплав с Силой Территории. Очень хорошая компания. И главное у нее классное комьюнити тех, кто с ними ходит. Нетворк хороший короче 🙂 На самом деле для меня день дейоффа и три дня в байдарке - все что нужно для счастья. Прошли в районе Ржева по Волге, немного, километров 50. Ну, много и не нужно. Читайте также Прошлогодний байдарочный поход в Киргизии
Вот такую писюльку получил 5 минут назад. Нахуй Хабр. Не пишите туда, не читайте его. Датасет я не закрою, пока они не соизволят написать нормальное письмо. После этого сделаю приватным, если кому-то будет нужен - пишите в личку. А лучше скачайте сейчас.