tgindex

Machine Learning Research

955
подписчиков
Охват к подписчикам
56,8%
ERR
Реакции к просмотрам
0,53%
59 на 21 постов
Пересылки к просмотрам
2,78%
309
Постов в день
0,0
всего 21

Где отзываются чаще

доля реакций к просмотрам
  • 18 янв.Когда-то давно, во времена учебы в ШАДе, нам читали интенсив по основам архитектуры GPU и разработки на CUDA. Обещали рассказать, как устроены видеокарты и почему они эффективны для машинного обучения. Я тогда дальше model.to('cuda:0') в этом вопросе ничего не знал, поэтому с интересом записался. Лекции читали разработчики из Nvidia. Да, это было такое время, когда у компании был Московский офис и они периодически нанимали DL-инженеров, а иногда и стажеров (марафон технических раундов и глубоких вопросов на понимание, чтобы побороться за 2 стажерские позиции). Курс, по моему мнению, получился ужасным. Материал стремительно усложнялся без какой-либо оглядки на аудиторию и тот факт, что ко второй лекции половина слушателей уже отвалилась. Я потерял суть происходящего уже минуте на 20-30 первой лекции, в момент когда термины вида SM, warp schedulers, cuda cores заполняли каждый слайд, а повествование превратилось во внутренний митап для инженеров Nvidia. Худо-бедно интенсив я закрыл, решая задачи методом проб и ошибок. От курса в голове не осталось почти ничего. Разве что боязнь копаться в деталях работы с GPU. Позже, уже в 2022-2023 году, модели перестали влазить в память одной ГПУ и нужно было учиться паралелить, оценивать эффективность инфраструктуры в поисках ответа на вопрос: а почему все так медленно? are we compute bound or communication bound? Снова я столкнулся с GPU акселераторами лицом к лицу. Документации от Nvidia было не очень много, так что неподготовленному читателю входить было не просто. Но дело двигалось тем же путем проб и ошибок и общением с коллегами по работе. А хороших гайдов на понимание все еще не было. Мне кажется их и сейчас не очень много. ( Как и специалистов в этой области. Performance Engineer крайне актуальная роль в области DL на ближайшие годы) Недавно наткнулся на "книгу" от ребят из DeepMind, они проделали невероятную методологическую работу. И выпустили онлайн-учебник How to Scale Your Model. Центральный предмет книги о том, как учить трансформеры на больших кластерах, арифметику моделей (откуда набегает так много гигабайтов памяти, чтобы сделать один forward pass) и что такое TPU/GPU. К каждой главе идет еще набор квизов, чтобы посчитать что-нибудь руками. Крайне Рекомендую! https://jax-ml.github.io/scaling-book/1,43%
  • 14 нояб.На этой неделе ребята из команды YandexGPT совместно c ШАДом (Школа анализа данных) провели интенсив по работе с LLM, где были затронуты вопросы обучения, инференса, и коммуникаций. Материал довольно подробный и интересный, но требует определенной базы для вхождения. В общем, рекомендую к просмотру всем интересующимся и желающим освежить знания. Лекция 1: https://youtube.com/live/JMUWSdSD1Uk Лекция 2: https://youtube.com/live/IAeAKcdMtsw Лекция 3: https://youtube.com/live/BYiFv5PoMBw Лекция 3.1: https://youtube.com/live/-52RgKQENl0 Лекция 4: https://youtube.com/live/VXI41kyQTPs Лекция 5: https://youtube.com/live/AHMJICS2JQ0 Лекция 5.1: https://www.youtube.com/live/3v43mnx31OQ1,40%
  • 1 нояб.HuggingFace релизнули замечательную свежую книгу про обучение LLM 200+ страниц, 7 больших глав. Содержание примерно следующее: – Архитектуры, их особенности и оптимизация гиперпараметров – Работа с данными – Предобучение и какие в нем есть подводные камни – Пост-трейнинг: все современные подходы и как их применять – Инфраструктура, как ее правильно строить и оптимизировать По сути, это готовое хардовое пособие по тому, как с нуля обучить и захостить LLM. Написано все на довольно простом английском и читается легко + есть куча схем и примеров. В общем, выглядит годно. huggingface.co/spaces/HuggingFaceTB/smol-training-playbook1,28%
  • 22 июн. 2025 г.Нашел потрясный курс по RAG. Здесь 22 урока по имплементации различных RAG-техник: от самого базового на эмбеддингах, до RAG-а на графе и добучения с помощью Reinforcement Learning. Что самое приятное: все пишется с нуля на Python. Обычно все клепают RAG-и так: берем готовый фреймворк (LangChain и тд), смотрим туториал "how implement rag", берем готовые модули оттуда. Для быстрых прототипов это ок вариант, но так нормально не разобраться, как что работает. Только разобравшись, как это все пишется с нуля, сможете потом делать надежные LLM-системы. И на любом фреймворке. Вы как знаете, а я пошел повторять.0,99%
  • 13 окт. 2025 г.О, новый релиз от Андрея Карпаты Это один из самых безумных репозиториев, которые я когда-либо писал Сразу ссылка: github.com/karpathy/nanochat nanochat – это что-то типа продолжения легендарного nanoGPT. Но если nanoGPT – это, по сути, только предобучение, то здесь у нас полностью готовый конвейер для обучения и инференса целого мини-клона ChatGPT. В лучших традициях кода Карпаты – совсем немного строк (всего 8к) и минимальное количество зависимостей. Вы просто открываете проект на любом облачном GPU-сервере, запускаете один скрипт, и уже через 4 часа можете общаться с LLM-кой в собственном ChatGPT. В пересчете на аренду GPU это будет стоить примерно 100 долларов. Если готовы потратить больше, то можно масштабировать и получать лучшие результаты. Моя цель – собрать весь «сильный базовый» стек в один связный, минималистичный, читаемый и максимально форкаемый репозиторий. nanochat станет итоговым проектом LLM101n <мы об этом курсе писали тут>. Думаю, у него также есть потенциал стать исследовательским инструментом или бенчмарком, подобным ранее существовавшему nanoGPT. Технические детали о том, что просходит внутри проекта, можно почитать здесь. Огонь же?0,82%
  • 25 июн. 2025 г.Вау: Google выпустили опенсорсного агента Gemini CLI для использования ИИ прямо из терминала Из командной строки можно будет пользоваться всеми возможностями Gemini 2.5 Pro: поиск в Интернете, обработка любых файлов, автоматизация рабочих процессов (типа отправки PR), написание кода и прочее и прочее. Контекст – 1 миллион токенов, так что вместится большинство даже самых больших проектов. При желании можно прикрутить любой MCP. Например, генерировать прямо из терминала картинки или видео, привязать Notion/Jira или что-то еще. Ну и самое главное – это лимиты. Абсолютно бесплатно доступно 60 запросов в минуту и 1000 в день. Приятно 🍯 github.com/google-gemini/gemini-cli0,62%
  • 24 июн. 2025 г.Число постов в канале упало не просто так (о, великий султан, на то была тысяча причин). И основная — нам с ребятами очень хотелось систематизировать наработки по мультиагентным системам (мы строим их уже полтора года) и поделиться этими знаниями с миром. Мы запустили курс по ИИ-агентам, не супер большой, но, надеюсь, достаточно емкий. Я расскажу (и покажу) базу — токенизация, LLM, SFT, PEFT, локальный инференс + RAG и как оценивать его качество. Диана — как строят мультиагентные системы, какие есть паттерны проектирования и библиотеки. Макс — про инференс в проде + разберет CoPilot, соберет с вами из кусочков свой копайлот, а затем его сломает через prompt injection. // Макс фанат autogen (а если нет -- он вас разубедит в своем классном канале) Финальным аккордом Дима углубится в MCP и соберет несколько кейсов повзрослее. // Дима юзает qwen-agent Надеюсь, мы смогли поймать баланс между обзорным курсом на 5 живых вебинаров, базой, практикой и способностью студента на выходе не просто собрать очередной прототип, а выстроить систему, которая в каждой точке оценивается и понятно как ее развивать, масштабировать, делать точнее. Если вдруг кто захочет поучиться — есть промокод, datarascals0,61%
  • 21 июн. 2025 г.🤖Курс по Трансформерам и LLM - NEW EDITION Обновили материалы курса по Трансформерам и LLM. Повились новые материалы про диалоговые и мультимодальные модели, а также самые последние LLM, включая DeepSeek. @mashkka_ds #llm #трансформеры #полезныематериалы0,53%
  • 28 мая 2025 г.Стенфордский курс по внутреннему устройству LLM CS336, Language Modeling from Scratch, показывает, как сделать полноценную LLM с нуля: от сбора и очистки датасета до тренировки, профайлинга и развёртывания модели. Все конспекты, ноутбуки и код сразу публикуют в открытой репе, так что можно повторять эксперименты дома хоть на одной-двух карточках или в колабе. Курс сделан с большим упором на практику — в качестве пяти домашних заданий предлагают имплементировать сначала чистый Transformer с нуля, затем кастомный FlashAttention 2 на Triton, распределённую тренировку, разобраться со scaling laws, фильтрацей датасета и применением RL в LLM. Требования — уверенный Python и PyTorch. Лекции на ютубе Материалы к лекциям Сайт курса @ai_newz0,51%
  • 21 нояб.Институт AIRI презентовал Maestro на AIJ 🔖 Maestro — фреймворк для создания интеллектуальных ИИ-агентов, которые мыслят и работают как настоящие эксперты. Он строит цепочки рассуждений на основе реальных кейсов и разбивает сложные задачи на мини-агентов, каждый из которых отвечает за свой навык. Платформа обеспечивает полный технологический стандарт: от авторизации и хранения контекста до оркестрации агентов и модерации контента с защитой от jailbreak-атак. Maestro подходит для критически важных сфер, где важна точность и безопасность. Качество подтверждено тестами и реальным внедрением в СберЗдоровье, СберМедИИ и ЦРТ Сбера. Страница фреймворка | Forbes0,48%
  • 6 июн. 2025 г.Какую модель применять в NLP? Написал гайд по выбору модели, который сильно упростит вам жизнь. Не только про LLM, но и про другие модели нейронных сетей. Пользуйтесь, делитесь с друзьями, задавайте вопросы в комментариях. Все вопросы разберем.0,46%
  • 6 июл. 2025 г.Всем привет! Представляем вашему внимаю первый выпуск подкаста "Капитанский мостик", он посвящен важным новостям прошедшей недели; ведущие - Валентин Малых и Дмитрий Колодезев; видео тут: VK Video YouTube Присылайте новости для обсуждения в канал "Дата-капитаны" в mattermost (авторизируйтесь через ODS.ai)0,45%