уровни абстракции
Статистикарасскажи мне про свой рисерч и я скажу тебе кто ты. тут рассказываю про свой - – — —— ——— ——— прогулки по фракталам / ИИ и человек / физик и природа
- Последний пост
- 14 авг.
- Последнее чтение
- 23:10
- Постов за неделю
- 1
- Всего постов
- 26
- Тип
- открытый
- Язык
- русский
- Категория
- Природа
- В каталоге с
- 13 авг.
- 1/24сутки в ленте
- 128
- 1/48двое суток
- 146
- 1/72трое суток
- 158
Оценка по просмотрам недавних постов: пост набирает почти всё за первые сутки.
Посты
совпадение месяца счастливый билетик или 22-22 на часах это уже красиво. а выстраивание небесных тел в линию с синхронизацией по телесным углам это ОГО-ГО. радиус солнца больше радиуса луны примерно в 400 раз, при этом расстояние от Земли до солнца в 390 раз больше, чем до луны. но иногда они совпадают идеально. хотя бы в одной точке планеты это происходит ~каждые 18 месяцев. а в любой произвольной уже в среднем ~раз в 375 лет. но Испании (и мне) повезло — в ближайшие годы нам покажут аж три при этом так было / будет не всегда (с). Луна отдаляется от земли на 4 см в год, и через какие-то пару тысяч лет будет в день затмения перекрывать солнце целиком, без красивейшего диска с короной по краям (на фото), которую я увидел впервые в жизни и уже никогда не забуду. даже понимая детали происходящего, испытал великий ужас и трепет в какой же красивой симуляции мы живем p.s. делитесь красивыми фото / видео в комментах
Два дня назад я писал, что часть инфраструктуры HuggingFace подверглась атаке и была частично взломана ИИ-агентом. Только что OpenAI признались, что... это была их модель, GPT-5.6-Sol и другая более сильная неназванная LLM. Их тестировали на ExploitGym (бенчмарк по кибербезопасности), и модель сначала смогла найти новый, до этого неизвестный эксплойт в инфраструктуре OpenAI (это не было её задачей, её не натравили «поискать баги чтоб мы пофиксили»), оттуда раскрутиться на получение полноценного доступа в интернет (который по умолчанию обрезан в тестовой среде), а затем залезть на HuggingFace искать ответы для бенчмарка. После этого она нашла уязвимость и там, получила доступ к коду авторизации некоторых сервисов и продолжила искать ответы. Этот инцидент без преуменьшения беспрецедентный, и я пока не могу представить, что должно произойти, чтобы политики, NSA, DOD и Китай не обратили на это внимание.
видео или голосовое, без подписи
Парковка на воде или динамическое равновесие как единственный шанс на покой провел неделю в море управляя парусной лодкой, что потребовало перестройки наземных привычек. при парковке машины, достаточно заблокировать колеса — это статика. при швартовке лодки тормоза нет верх запаян, на море движется всё и всегда. остановить лодку в статике невозможно, но можно создать систему противовесов, которые удержат её вокруг удовлетворительного состояния и погасят избыток энерги, принесенной волнами возле причала это натяжение канатов (швартов) и упругость надувных кранцев (иногда просто шин), между которыми лодка болтается туда-сюда. на якорных стоянках лодка болтается на цепи вперед-назад и крутится вокруг неё ветром с радиусом в десятки метров. чтобы спать спокойно, внутри него не должно быть соседних лодок, скал, или подводных камней. и любой расчет справедлив в узких пределах, сильный ветер срывает любые якоря в сложных системах статического равновесия не бывает в принципе, его достижение — это смерть. держать форму возможно только прогоняя энергию сквозь себя и сбрасывая энтропию наружу. так, чтобы поддерживать сон, части мозга активно подавляют бодрствование. когда мы неподвижно стоим, десятки мышц активно напрягаются. а чтобы остаток на банковском счету не менялся, я уже и не знаю что нужно делать со сложными системами конструкции «я совершил усилие, и теперь вместо состояния А будет Б», неявно реализуются как «я активировал процесс ускорения X и подавил процесс торможения Y, поэтому в течение некоторого времени мы можем рассчитывать на Б, если повезет». а потом все равно — великая неизвестность вы сейчас скорее затормозили или ускорились?
пока собирал презентацию с трендами ИИ для одного университета, нашел наглядную картинку, объясняющую ваш счет за токены. мой перевалил за 500$ / month и это я еще экономлю
Как оценивать работу ИИ агентов (в биотехе) … если каждый запуск обходится в ~100$? короткий пересказ доклада на OpenTalks.ai в Белграде. типичная задача которую наши агенты решают в Bioptic — “найти все лекарства от болезни Альцгеймера в стране Х на стадии Y”. ответить на него может и чатГПТ, но с точностью ~50%. мы строим агентскую систему с требованиями к точности 95%+. а чем ближе вы к 100%, тем дороже обходится каждый следующий +1% чтобы измерить качество работы агентов, нужен evaluation датасет (эвал) из ~100 типовых задач с известным правильным ответом. но есть проблемы • во-первых, изначально мы сами не знаем правильный ответ, готовых датасетов тут нет. найти его могут эксперты, но их мало и каждая такая задача может занимать несколько дней работы, поскольку проверить нужно все возможные источники, что делает сбор данных крайне дорогим. пропустить этот шаг совсем не получится никак, но нам помогло партнерство c биотех-VC фондом LanceBio, сделавшим тысячи подобных обзоров по разным областям • в мире тысячи компаний и университетов работают над новыми декарствами. о появлении новых может быть написано в одном единственном патенте на китайском языке. найти его непросто, но даже если агент справится с этим, в рамках evaluation это будет выглядеть ошибкой, поскольку реальность уже не соответствует собранному датасету. в Альцгеймере новые лекарства появляются не так часто (к сожалению), но в хайповом ожирении список может меняться каждый месяц • если каждый прогон агента стоит ~100$, сет из 100 задач в эвале обойдется в $10к. по хорошему эвалы нужно прогонять с каждыйм большим апдейтом системы, который в стартапах ранних стадий происходит по крайней мере раз в неделю. в общем снова дорого. и вот оказавшись в этом всем мы используем подход большого количества маленьких эвалов на разных участках пайплайна + один большой дорогой эвал на весь пайплайн, который можно не запускать при каждом апдейте. подробнее в следующем посте или на слайдах а если вы знаете как эти проблемы решать — прямо сейчас мы ищем опытных бэкэнд и LLM-инженеров. подробности и форма для кандидатов в канале у фаундера Ромы Доронина
спасаем плейлисты Apple Music [очень узкая проблема] я много лет собираю музыку по плейлистам, включая подборку для собственной свадьбы. потом я уехал из РФ и логичный шаг смены региона Apple id споткнулся о неприметное “вы готовы потерять всю вашу медиатеку?” НЕТ Я НЕ ГОТОВ ПОТЕРЯТЬ ВСЮ БИБЛИОТЕКУ, ГДЕ КНОПКА БЭКАП, ПОЧЕМУ НЕТ КНОПКИ БЭКАП. по заветам платформенного капитализма, удобной кнопки экспорта данных быть не должно, оставайтесь навсегда. обойти это на тот момент я так и не смог (происходило все пару лет назад, сейчас есть платные сервисы), поэтому просто завел второй Apple id. но вот новый удар — с 1 апреля в России не осталось способов оплатить подписку на сервисы эпл, а в этой ситуации ваша библиотека также удаляется безвозвратно в течение примерно 2-3 месяцев с момента неоплаченной подписки. что делать с Apple Cloud я еще не придумал (мысли?) в выходные навайбкодил скрипт для локального бэкапа всех плейлистов в один большой JSON. сохраняет структуру, имя исполнителя, название трека и все id по которым их можно найти в других сервисах. авторизуется через токен из браузера, см README. в работе обратный импорт в другие сервисы. но главное поторопитесь с экспортом, пока еще есть доступ. если помогло — с вас звездочка на гитхабе. и с другом поделитесь https://github.com/danissimov/backup_playlists
цифровые крестьяне, сопротивляйтесь на прошлой кайференции я делал доклад про экономику внимания и пост-капитализм. в механике взаимодействий на бесплатных интернет платформах товарно-денежный обмен часто уступает обмену внимания как ресурса. простейшая транзакция: хочешь посмотреть сюда? ок, только сначала посмотри вот сюда тоже. началось это достаточно давно, чтобы возник настоящий рынок со своими правилами и монополиями, выступающие посредником любого обмена. а поскольку внимание сильно отличается от привычных денег, и правила на этом рынке немного иные. ключеовй теоретик тут - бывший министр финансов Греции Yanis Varoufakis, с книжкой “Techno feudalism”, описавший наше положение красноречивым “cloud serf” (облачные крепостные / цифровые крестьяне). но мой любимчик - Michael Goldhaber, предсказавший это аж в 1998 году. тут подробнее + хорошие видео по теме. критиковать и спорить есть о чем, но все-таки: 🖊️ ваша подписка на блогера на платформах с алгоритмическим фидом (это почти все), подписчики не означает что вы увидите его посты. платформа может решить, что именно этот вам не интересен, не соответствует ее правилам или просто поместить блогера в теневой бан 🎶 для музыкантов и слушателей на стриминг платформах ситуация еще хуже. выплаты за прослушивания копеечные, концерты проанонсировать нельзя, мерч не продать, а иногда к платформе приходят органы с требованием удалить все альбомы по причине политических взглядов или пропаганды чего-нибудь нехорошего. говорят, в России на этом фоне даже выросли продажи мп3-плееров 📸 инстаграм, в который вы заходите посмотреть на фотографии друзей, во первых подсовывает вам рекламные посты, а во вторых обучает рекомендательные системы на ваших действиях внутри платформы и всех фотографиях которые вы делаете (не только нетх что выкладываете, вы сами дали доступ). то есть смотрит на мир через ваш объектив, чтобы подсунуть рекламу по которой вы обязательно кликните логика общая — контакт временный и обусловлен милостью платформы. контент принаддлежит площадке больше, чем производителю контента. средства труда производителей контента им не принадлежат, а даны в пользование по аналогии с землей для крестьян. обмен вниманием происходит не на свободном рынке лавочников по Адаму Смиту, а на феодальных уделах в которых мы можем смотреть фотографии своих друзей только при условии выполнения длинного списка условий. как правило — бесплатного труда на благо платформы в виде просмотра рекламы и разметки данных. когда-то это было справедливой сделкой за бесплатные сервисы, но сегодня зашло слишком далеко. и красивой рамкой над этим всем — эпидемия зависимости от телефонов у детей, депрессий и тревожности у подростков и много всего о чем мы еще не догадываемся — experiment in progress а что делать тоооо? это отдельная тема и серебряной пули нет, its too late . фотографии из отпуска сами себя не посмотрят, и уйти из интернета нереалистичное решение. при этом думаю, что сопротивляться необходимо, и радуюсь замечая все больше признаков этого сопротивления. одной строкой: инвестировать в прямые контакты, ценить платформы без посредников (тегеграм, substack?, bandcamp, etc), поддерживать создателей контента (patreon, boosty, мерч, билеты на концерты и лекции), давление на платформы и развитие open-source альтернатив есть запись доклада тут, слайды в первом комментарии к посту. я им не очень доволен, но все-таки пусть будет — хочется эту тему шире обсуждать. так что делитесь мыслями и подписывайтесь на канал кайференции — скоро будет еще одно мероприятие по теме “внимание”. и если вам есть что о внимании рассказать — напишите в личку
20 февраля выступаю на ИИ-конференции opentalks.ai в Белграде (для баланса с кайференцией)). расскажу, как мы в Bioptic строим бенчмарки для оценки способностей deep research агентов находить хорошие лекарства. искать их сложно, но понять, что же ты нашел, еще сложнее. мы в этом деле изобрели несколько красивых велосипедов, о них и расскажу конференции — это крутейший способ быстро понять что происходит в индустрии (даже если она для вас новая!), и познакомиться с активными ее участниками как в формальной, так и в неформальной обстановке. а opentalks это еще и очень душевный формат, который соединяет русскоязычное ИИ-коммьюнити со всего мира. если будете там - пишите! а если очень надо, могу помочь со скидкой на билет выступаю я следом за кофаундером Bioptic Ромой Дорониным, который расскажет keynote про длинный путь компании в фарме. а ирония в том, что мы с Ромой когда-то познакомились на этой же самой конференции в Тбилиси. я тогда делал свой стартап Quist (подробнее было тут), а ребята занимались drug discovery (компьютерное моделирование новых молекул для известных белковых таргетов). и вот жизнь повернулась так, что теперь мы вместе делаем агентский drug discovery — поиск и многофакторное сравнение уже существующих лекарств, которые разрабатываются в тысячах компаний по всему миру
видео или голосовое, без подписи
почему внимание? предыдущие кайференции пытались ответить на глобальные, острые и неоднозначные вопросы мира высокой энтропии: природа кайфа, как и где жить, что такое близость? в этом году амбиция не меньше — попробуем вместе разобраться, что такое внимание мы застали переход главной экономической ценности от энергоносителей (например, нефти) сначала к данным (т.н. новой нефти), и сейчас к вниманию как к ресурсу. рекламные бизнес модели тех-корпораций торгуют тем, куда и как долго мы смотрим. на этом фоне происходит демократизация СДВГ — его подозревают у себя так много людей, что всерьез обсуждается, существует ли такой диагноз вовсе думать о внимании можно с разных сторон — экономической, социологической, психологической, артистической. но в направленности этого взгляда есть общая точка: внимание – это ограниченный и ценный ресурс. его невозможно масштабировать, в сутках по-прежнему 24 часа, и только то куда мы инвестируем энергию концентрации получает развитие. это ценно не только с точки зрения роста, но и с точки зрения субъективного чувства счастья: проживание момента наполняет, а внимание к людям вокруг формирует отношения. внимание — это актив. мы можем пользоваться им по своему усмотрению, или позволять другим извлекать из него прибыль. подключайтесь к кайференции в воскресенье, чтобы направить внимание само на себя, и подарить немного внимания друг другу ❤️
у меня есть традиция устраивать кайференцию в честь своего дня рождения доклады со слайдами мне — родной язык, выученный сначала на научных семинарах и конференциях и стартап—питчах. также мне повезло иметь много умных друзей, которые успели этот язык выучить…
всем привет! чем больше паузы между постами, тем сложнее писать — так много всего происходит, что лонгридов не напасешься. но виноват в этом только я сам, так что исправляюсь коротким апдейтом про ~работу, вдруг вы здесь из-за ради него - в bioptic набрали лютую скорость, релизнули продукт и подписали несколько крупных производителей лекарств. мы все еще делаем дип-рисерч агентов с узким фокусом на фарму и амбицией стать главными на этом рынке. протестировали с десяток агентских архитектур и вернулись примерно туда же с чего начинали интуитивно, но теперь с пониманием почему так ) сильно прокачали бенчмарки и теперь точно знаем на сколько мы лучше чем perplexity / geimini / etc (тут коллеги написали об этом статью. сожгли $100к+ только на ллм-токены (и это до релиза 🥲). но первые юзеры, готовые за доступ к нашим агентам платить на порядки больше, чем цена подписки чатгпт, подтверждают что все не зря - вышла новая публикация по полупроводникам. я уже 3 года не работаю в академии, а проект и вовсе начался ~5 лет назад, и вот наконец общественность может узнать о роли зарядовых ловушек в механизме чувствительности полупроводниковых газовых сенсоров. журнал очень хороший и проект в целом когда-то был для меня основным, но сейчас эмоций по этому поводу испытываю мало, в том числе потому что бывший коллега попытался подсидеть меня в списке авторов. радуюсь, что чистая академия осталась где-то в прошлой жизни. это же кстати сильный сигнал к тому, что все делаю правильно — как только выпал из среды, перестал следить за новостями. ну и в целом с такими скоростями можно вернуться еще лет через 5 и не много всего пропустить, что будет с областью ИИ через 5 лет боюсь даже представить - также вышла моя первая публикации по ИИ, причем сразу в NeurIPS! весь прошлый год я участвовал в коллаборации, где мы изобретали агентский бенчмарк для задач с длинным горизонтом планирования в духе известной статьи METR. результат — набор из десятка задач с программируемой сложностью из которых я лично отправлял ИИ-агентов путешествовать по бесконечным вложенным папкам файловой системы и смотрел когда / как они в них теряются. этот бенч также стал хорошей прокси-метрикой для способностей ии-агентов писать код (SWE-bench), и статья во многом об этом, но это отдельная история - по такому поводу обновил свой Google scholar и обнаружил что мой индекс Хирша вырос до 10, не знаю где еще этим выпендриваться, буду перед вами - а еще в декабре реализовал давнюю мечту и прошел обучение управлению парусной лодкой, теперь я лицензированный капитан! в 2025 два из двух отпусков я провел на воде и вокруг появилось много приятных людей, которые в этом увлечении с головой (эффект Барселоны?). так что впереди много морских приключений, и следующая мечта — поплыть в Гибралтар наблюдать за сезонной миграцией птиц. записывайтесь в матросы 🙃 фух, и это даже не итоги года! их не будет ) а если интересно про что-то из списка почитать подробнее — напишите в комменты
видео или голосовое, без подписи
видео или голосовое, без подписи
по поводу зимнего солнцестояния вместе с женой сделали открыток от лица второго начала термодинамики (оно же The 2nd Law, оно же энтропия замкнутых систем всегда возрастает) в комментариях делитесь своими афоризмами на тему или вызывайте пояснительную бригада если требуется. этот закон в нашей вселенной желательно понимать хорошо #всмысли
видео или голосовое, без подписи
видео или голосовое, без подписи
неделя рыбы в канале узнал что blobby fish, известная в интернете как самое некрасивое живое существо, в своей естественно среде обитания та еще красотка (второе фото). адаптировавшись жить на большой глубине ~1000м, она приобрела такое высокое внутреннее давление, что на поверхности воды оно раздувает ее изнутри. наверное над тем, как мы выглядим на большой глубине, она тоже посмеялась бы
первое появление у Дудя 🙃 пока поезд хайпа не уехал далеко, запрыгну в него немножко. не меня, но продукт над которым я работаю последние пол года, Андрей Дороничев (СЕО Bioptic) показал в своем недавнем интервью Юре Дудю. там не столько про Bioptic, сколько в целом про ИИ, но несколько наших продуктов все же появляются я делаю ИИ-агентов которые автоматически заполняют и обновляют табличку с лекарствами (обсуждается на 1-55 и далее. ссылка с таймкодом). они ходят в интернет, следят за базами научных статей по определенным болезням, читают нормативные документы FDA, трекают обновления сайтов разработчиков лекарств и их конкурентов, а также выполняют аналитику над всеми этими данными, чтобы сообщать только о самом важном. фарм компании рутинно следят за десятками и сотнями лекарств, с которыми постоянно что-нибудь происходит: - кто-то провалил клинические испытания, а кто-о напротив выступил неожиданно хорошо - кто-то получил одобрение FDA, кому то выдали специальный статус Orphan Drug, который упрощает жизнь - у кого-то вышла финансовая отчетность, а у кого-то просто без причины обвалились акции (на рынке биотеха и такое тоже бывает) чтобы делать это сейчас, высококвалицифированные сотрудники тратят очень много времени, которое мы обещаем освободить. тут можно посмотреть на лендинг продукта - agents.bioptic.io есть тут кто-то связанный с фармой или ии-агентами для рисерча? напишите, буду рад пообщаться