tsymba❤️
Статистикаеще один личный блог с уклоном в машинное обучение etsymba.com
- Последний пост
- 13:20
- Последнее чтение
- 14 авг.
- Постов за неделю
- 22
- Всего постов
- 42
- Тип
- открытый
- Язык
- русский
- Категория
- Образование
- В каталоге с
- 13 авг.
- 1/24сутки в ленте
- 158
- 1/48двое суток
- 181
- 1/72трое суток
- 195
Оценка по просмотрам недавних постов: пост набирает почти всё за первые сутки.
Посты
Подписчик в комментариях указал на важную проблему популярных алгоритмов оценки внутренней размерности облака точек, за что ему большое спасибо! Выяснилось, что при большой истинной размерности облака они дают систематически заниженную оценку этой размерности. При чем чем больше настоящая размерность, тем сильнее занижается оценка. Я решила проверить это и навайбкодила ноутбук, в котором генерируются облака точек, равномерно заполняющие n-мерные шары: https://colab.research.google.com/drive/1kIRin8sBBNQDFvruXWITU3i5kL7x7Zww?usp=sharing Краткие результаты: - При размерности такого шара 10 и количестве точек 2000, три алгоритма оценки размерности (PHD, TwoNN и MLE) дают что-то между 8.5 и 9, то есть занижают незначительно. А вот при размерности 100, PHD уже даёт оценку в 64, а TwoNN и MLE и вовсе около 50, то есть оценка занижена в целых два раза (см. рис. 1). - Увеличение количества точек в шаре может помочь подтянуть оценку к истинной, но, похоже, что для этого увеличивать их количество нужно экспоненциально с ростом размерности. Интересные выводы, и вообще даже странно, что раньше я не знала о таком явлении. Или знала, но забыла? 😅 Честно говоря, мозг от вайбкодинга уже совсем потек, так что ничего не могу сказать с уверенностью 😅 В любом случае, надеюсь, что эта инфа будет полезна всем, кто интересуется внутренней размерностью и т.д. P S В случае любых ошибок в ноутбуке - все претензии к Клоду 😍 #эксперимент #наука
этим подписчиком был Альберт Эйнштейн пожалуйста, не используйте методы для ID, они не работают, как и оценка неопределенности с дропаутом ❤
Ну и вдогонку график с выкидыванием тасков. Я и DJ (Tao Dajiang) — главные спонсоры медалей этого года (я по бронзе, он по остальным) 😁
Fun fact: nug/get из того поста занял(а? о? get?) второе абсолютное место на IOAI. Алғаааа! 🔥
P.S. I<3U Я специально взял обратный билет✈️ на день позже и получил наконец один день, когда ничего не нужно было срочно делать (не считая трехчасового утреннего дебрифа ISC). И Астана мне в целом очень понравилась, могу рекомендовать (планировал посетить ее еще раз в этом году на АИСТ, но увы). Успел сгонять на массаж, просто поездить по городу, поесть казахской кухни, наконец нормально поесть грузинской от Новикова и даже поздно вечером заскочить в караоке. После нескольких дней, проведённых в мыле, это ощущалось почти как отдельный отпуск, жалко только, что его было мало. А потом произошёл идеальный эпилог всей поездки: на обратном рейсе я каким-то образом случайно оказался в бизнес-классе и встретил там настоящего Меладзе. Фотографий не будет — верьте на слово, но выглядит он офигенно. Буквально на следующий день меня ждал лейоффный Амазон и дедлайны по отбору статей на АИСТ. Скоро предстоит верстка отобранных статей, снова этот ваш Amazon, куча митингов по организации IOAI 2027, и прочая прочая -- на том свете выспимся. Но это того стоит. Всем причастным спасибо🫶, надеюсь, увидимся в Сингапуре ❤️
🤖AI Track В этом году мы открыли специальный трек для агентов. Организовывать его было очень сложно, начали мы поздно, и у нас было очень мало ресурсов на это (по факту, 95% всей работы делал один человек). Несмотря ни на что, трек состоялся🚀: у нас было 10+ команд-участников (компании, университетские лабы), и мы в данный момент перепроверяем результаты и execution traces, потому что организовать такое же защищенное окружение, как и в обычном контесте очень сложно. Агентов и детей сравнивать нельзя -- у нас было много этических споров на эту тему -- но в целом агенты справились очень даже неплохо. С удовольствием поделюсь более полным отчетом по готовности. Слава роботам! 🤖🦾
без подписи
Лично моя задача фигурировала под шестым нумером. Я внимательно следил за тем, как ее решают школьники, и реально клевых решений, которые уловили основные сложности, было штук 4-5 -- остальные играли с параметрами бейзлайна. Ее я придумал в конце 2025 -- начале 2026 года, и у меня осталось фото первого эскиза -- держите:
На это повлияло много факторов 🧩: бейзлайны, метрики, техники тестирования, описания задач (которые еще надо перевести на родной язык участников!), общий настрой комитета по выбору задач с уклоном в исследовательские. Усугублялось это тем, что у некоторых задач были трюки, которые не должны были сильно влиять на оценку в нормальном сеттинге, но в ситуации жестких задач давали преимущество, позволяющее наскрести на неплохой результат. И в целом это было совершенно некруто по отношению к участникам не из самого верхнего хвоста распределения. С другой стороны, я буду продолжать настаивать, что постановки задач были очень интересными и необычными, ведь мы старались делать задачи, которые начинаются не с решения. И участники, и лидеры команд подходили к нам и обсуждали это и после перевода, и после контеста, и на апелляциях. Там были и маленькие трюки, и компоненты, рассчитанные на широкое понимание области. И если смотреть именно на верхушку результатов🏆, то отбор всё-таки сработал. Все получили одинаковые данные, одинаковые вычислительные ресурсы, одинаковое время и одинаковые задачи — и лучшие результаты получили те, кто смог лучше всего разобраться в совершенно незнакомой ситуации; страны с наилучшей подготовкой остались в топе. Nevertheless, lesson learned🫡, мы серьезно обсуждаем эту проблему в комитете и точно не допустим такого снова.
без подписи
Колмогоровская сложность, aftermath Со сложностью, как оказалось, мы реально переборщили. Если сравнивать с IMO и IOI олимпиадами за все года (и с прошлой IOAI тоже) -- это была натуральная мясорубка 🥩🔥 У большого количества участников были нули или очень низкие баллы по отдельным задачам; даже участник, занявший абсолютное первое место, получил почти нулевой результат по одной из задач.
Не могу не упомянуть и домашние задачи: 🌙🎧 [Operation Night Watch] Дан аудиоклассификатор для 16 типов звуков. Нужно добавить 13 новых классов, сохранив качество на старых и не переобучая основной энкодер. 🤖📦 [Robot Delivery Academy] Робот должен забирать и доставлять посылки на картах 8×8. Нужно обучить его поведению по ограниченному набору демонстраций и обобщить на новые карты. 🐘❓ [The Analytical Language of John Wilkins] Нужно определить загаданное животное из ~1400 вариантов, задавая до 15 вопросов «да/нет» и выбирая вопросы так, чтобы максимально быстро сузить поиск.
Задачи Задачи есть на гитхабе, кратко тут: 🎧 [Find the order] Диалоги на английском разбиты на отдельные .wav-файлы — по одному на каждую реплику — и перемешаны. Нужно восстановить исходный порядок реплик. 🤖 [Robot Chasing] Шесть роботов находятся в мирах-сетках 6×6, и каждому дана инструкция на естественном языке. Нужно предсказать, какое поведение она описывает. 🥔 [Potato] Игра в угадывание слов: нужно найти загаданное слово не более чем за 30 ходов, получая только попарные сравнения вида «какое из двух слов семантически ближе». 🕵️ [Double Agent Dilemma] ResNet18 и ViT-Tiny классифицируют одни и те же изображения со 100% точностью. Нужно найти и использовать различия в поведении двух архитектур. 👻 [Ghost of the Machine] В архив книг незаметно подмешали фрагменты, изменённые машиной. Нужно обнаружить границы LLM-сгенерированного текста. 🌀 [IOAI Field] Логотип IOAI представлен как пространственная функция двух переменных (со скрытыми параметрами) и дан обфусцированный генератор для этой функции. Нужно обучить суррогатную функцию, приближающую генератор.
Контест и голуби В прошлом году контестной системой был китайский Bohrium, сыскавший нежную любовь участников❤️🔥 В этом году соревнование переехало на Яндекс.Контест, у которого были свои особенности: например, Jupyter Notebook и страница с условием задачи (markdown!) существовали отдельно. После работы над решением нужно было его закоммитить, вернуться на страницу задачи и отдельно отправить, что может звучать как мелочь, но во время многочасового соревнования такие вещи начинают иметь значение — и я вполне могу представить, что не всем участникам этот workflow понравился. Зато появилась нормальная онлайн-система вопросов от участников к жюри, и это была пушка🔥, особенно во второй день, когда была моя задача, и я внимательно следил за происходящим. Второй раунд, пожалуй, прошёл наиболее гладко из всех раундов за три года существования IOAI, и отвечать на порой каверзные (=ломающие решения) вопросы, а порой на мольбы в стиле "EXCEEDED TIME LIMITE PLEASE GIVE MORE TIME LIMITE" было довольно весело и ненапряжно. Также рядом всегда были ребята из самого Я.Контеста, которые все оперативно чинили и очень помогали. В следующем году система будет другая. Это решаем не мы, это решает HSC каждый год 🤷
Собственно, в этом и состоял режим олимпиады для большей части жюри🫠: на комик-кон, этно-день Казахстана, вечеринку обмена напитками со всего света, командный контест с роботами и другие активности в целом почти не оставалось времени. Тусовок было сильно меньше, и часто надо было либо что-то чинить, либо идти спать. Единственными мероприятиями, на которые мы попали в полном объеме, были открытие и закрытие олимпиады. И если последнее было несколько хаотичным, то первое было мощным -- там был президент Казахстана🇰🇿 (первый президент, которого я видел в своей жизни -- но мне намекнули, что в Сингапуре🇸🇬 тоже будет), Кайфу Ли с отличной речью про будущее ИИ🤖 и кожаных мешков🥩, невероятно прекрасная реклама, которая справедливо насмехается над немецкой🇩🇪 банковской системой, а также внезапно Дуров анонсировал раздачу телеграмовских NFT на 100K$+ победителям (порой несовершеннолетним детям из разных стран с нередко запрещающими такое законами)
жалкая пародия на неповторимый оригинал
В этом году, несмотря на то, что нас было больше, мы намного более тесно работали с локальным комитетом: они помогали нам с портированием и тестированием задач, а мы работали в, собственно, контестном зале во время контеста. Например, в какой-то из дней я специально встал пораньше для того, чтобы провести инструктаж волонтерам, и бонусом мне выпала честь открыть контест на месте 🎬 Также мы не смогли попасть ни на один нормальный General Assembly митинг -- где принимаются общие решения и, например, происходят выборы в International Board -- так что мы только успели затизерить намечающиеся изменения в структуре ISC и совершенно не успели обсудить это на общем уровне.
прошлогодняя нетленка
Смена места жительства Изначально IOAI 2026 должна была пройти в Абу-Даби 🇦🇪, но из-за событий в регионе планы пришлось менять, и в итоге олимпиаду перенесли в Астану🇰🇿. Причём перенесли довольно поздно: вместо примерно года на подготовку у локальной команды (HSC + Organizers) оказалось около четырёх месяцев. Мне кажется, что это очень важный контекст для того, что происходило в целом. Были организационные накладки и другие нестройные моменты, но я очень рад, что это все в целом состоялось, и состоялось хорошо. Казахская команда проделала совершенно безумный объем работы: от поиска GPU🖥💨 и платформы до общей организации ивентов. И хотя какие-то вещи иногда приходилось делать в последние моменты, в итоге 400+ участников приехали, два основных раунда прошли, результаты были посчитаны, а медали вручены🏅 Одним из побочных эффектов всего этого действия было то, что граница между ISC и HSC была довольно размытой🤝 В прошлом году ISC-шная часть жюри из семи человек занималась, собственно, научной частью: перепроверкой задач и условий, ответом на вопросы участников (в прошлом году были бумажные бланки для жалоб во время контеста), разбором споров и апелляциями.
Недавно закончился IOAI 2026, и он довольно сильно отличался от прошлогоднего в Китае. Ниже расскажу свою версию событий: в этом году, как и в прошлом, я был в ISC и жюри олимпиады [телеграф]