Научный опенсорс
СтатистикаКанал сообщества ITMO OpenSource, посвященного созданию и использованию наукоёмких open-source проектов, в том числе в области AI/ML. Чат: https://t.me/itmo_opensource По всем вопросам - @nicl_nno
- Последний пост
- 5 авг.
- Последнее чтение
- 14:49
- Постов за неделю
- 0
- Всего постов
- 28
- Тип
- открытый
- Язык
- русский
- В каталоге с
- 12 авг.
- 1/24сутки в ленте
- 365
- 1/48двое суток
- 418
- 1/72трое суток
- 451
Оценка по просмотрам недавних постов: пост набирает почти всё за первые сутки.
Посты
Коллеги из Sber AI Lab опубликовали новый открытый репозиторий https://github.com/sb-ai-lab/SIRIN (Semantic Inconsistency Recognition and Inspection Nexus) - инструмент для поиска смысловых ошибок в ответах языковых моделей. Что умеет SIRIN: - Проверяет соответствие ответа исходному контексту на уровне токенов, последовательностей и отдельных утверждений. - Поддерживает детекцию галлюцинаций и оценку answerability - достаточности данных для ответа. - Объединяет несколько классов детекторов: llm-as-a-judge, uncertainty, probing с использованием метамоделей. - Позволяет сравнивать и комбинировать разные методы детекции - работает как инструмент для исследований и разработки. Ссылки: 🔗GitHub 🔗GitVerse 🔗Демо на Hugging Face 🔗Статья на arxiv Поддержать традационно можно звездочками.
#зоопарк_одобряет #конференции Вернее, не конференция, а интересный (и бесплатный) вебинар от girafe.ai "Рабочее окружение ML-инженера: делегируем рутину ИИ-агентам" Почему интересно: хотя бы по той причине, что у girafe.ai есть совместная онлайн-мага с МФТИ, что, на наш взгляд, уже знак качества (Физтех очень разборчив в выборе таких партнеров) Темы: • организация удобного рабочего окружения ML-инженера с нуля • настройка безопасного состояния удалённого сервера для любых нужд • автоматизация всех рутинных процессов агентами • формирование скиллов агентов для однокнопочного воспроизводства операций • кастомизация под свои вкусы и нужды Когда: 5 августа (среда), в 19:00 (МСК) Спикер: Владислав Гончаренко - основатель girafe.ai и автор курса MLOps онлайн-магистратуры MSAI (girafe.ai × МФТИ) Язык русский, участие, повторяем, бесплатное, но нужна предварительная регистрация - вот тут
Анонсируют такой вот вебинар из цикла опенсорс-курсов по ИИ от МФТИ:
Тематически близкая конференция про качество кода продлила дедлайн до 17 августа: https://www.iccq.ru/2026.html Публикации в IEEE Xplore/Scopus, локация - уютный декабрьский Новосибирск.
видео или голосовое, без подписи
🤖 Интересная дискуссия развернулась по поводу open-weights моделей – после того, как стало известно об инициативах в правительстве США по запрету использования китайских моделей в американских компаниях. Дженсен Хуанг (CEO NVIDIA) – с еще семью десятками ИТ- и ИИ-лидерами – написал открытое письмо, в котором заявил, что open source – это, вообще-то, замечательно, да и open-weight тоже, так что не надо, пожалуйста, ничего и нигде запрещать. 🔹В этой связи хорошо вспомнить, что open source – это практически никогда не про благотворительность. Все самые большие проекты – они про деньги, просто не деньги за сам код. — Большая часть контрибьюторов в ядро Linux и спонсоров Linux Foundation – это компании и их сотрудники. Intel вкладывается в Linux, потому что это помогает продавать больше серверов. — Facebook (организация ужасная и запрещенная, потому что ужасная) вложился в PyTorch, чтобы Google со своим TensorFlow не монополизировал нейронки и все не сидели на их облаках. — На карточках NVIDIA, конечно же, гоняется огромное количество open-weights ИИ-моделей – тут коммерческий ущерб от их запрета пошел бы на миллиарды. Да, на тех же карточках можно гонять и американские модели, но перестройка существующих бизнес-процессов была бы катастрофической. — Perplexity и другие подписавшиеся тоже хотят использовать в своих продуктах open-weights: не все хотят переплачивать за дорогой ChatGPT, так как в этом случае конкурентоспособность сервисов радикально снизится. 🔹Почему же Anthropic отказалась подписывать это все? Скорее всего, у них самый независимый стек технологий, где open-weights используется немного, и проблемы зажравшейся NVIDIA и компаний, которые делают более дешевые, но не такие хорошие продукты, им на руку. Ну а про кибербез и репрессии китайского народа в их заявлении – для того, чтобы эгоизм не выглядывал. 🔹Есть и более позитивная сторона open source: иногда ребята открывают проекты, потому что хотят, чтобы технологии развивались в целом, и чтобы кадры росли, и чтобы экономика двигалась вперед. А где деньги заработать – это уже потом придумаем. Или не придумаем, но карму точно заработаем🌟 Так, Т-шники на TurboML выкатили пару очень прикольных релизов – T-Search и Perseus. T-Search – агентный фреймворк для многошагового поиска на английском и русском языках. Многошаговый поиск нужен, чтобы агент сначала понял контекст из всего поверхностно найденного, а потом постепенно улучшал запросы. Получилось очень круто с точки зрения сотношения полноты найденного и потраченных ресурсов. Допиленный Qwen работает на одной карточке. Всем страдающим от невозможности закупить мощностей, но страждущим сделать агентный поиск – крайне рекомендую. А штука с романтичным названием Perseus – это фреймворк для построения рекомендательной системы на потоке данных о человеке без каких-либо специальных обработок этих самых данных. То есть если у вас есть поток данных, вы хотите что-то рекомендовать человеку, и вам при этом не хочется учиться на кафедре РЭСИК два года, можно просто поставить Персея – он сам разберется и все порекомендует.
Hugging Face и alphaXiv объявили соревнование по воспроизведению результатов научных статей с ICML 2026 - тема, на которую периодически пишем. Из каждой статьи выделено несколько claims, корректность которых и нужно проверить. Цель проекта – создать публичную…
Moonshot AI выпустила Kimi K3 на Hugging Face: Это первая модель с открытыми весами в классе ~3T. Благодаря MoE на каждый токен активируются лишь 104B параметров (16 экспертов из 896). По заявлению разработчиков, K3 создана для длинных агентных задач: работы с большими репозиториями, использования терминала, исследований, оптимизации GPU-ядер, компиляторов и других многошаговых инженерных сценариев. Что внутри: - контекст 1 048 576 токенов - нативная мультимодальность (для текста и изображений и видео) - 93 слоя: 69 KDA + 24 Gated MLA - веса MXFP4 + активации MXFP8 - заявлено ~2,5× более эффективное масштабирование по сравнению с Kimi K2. Веса модели: https://huggingface.co/moonshotai/Kimi-K3 Техрепорт: https://github.com/MoonshotAI/Kimi-K3/blob/main/k3_tech_report.pdf Но в плане открытости есть нюанс - веса выложены под лицензией Kimi K3 License, ограничивающей коммерческое использование после определенного порога выручки.
RAGU - на HuggingFace! Сегодня мы выложили на HuggingFace препринт про открытый GraphRAG-фреймворк RAGU. RAGU - это модульный GraphRAG-движок, который превращает сырой текст в граф знаний: извлекает сущности и связи, строит и чистит граф, а затем ищет ответы через локальные, глобальные или гибридные стратегии. Этот проект сейчас разрабатывается совместно Лабораторией прикладных цифровых технологий НГУ (Иван Бондаренко) и Лабораторией автоматизированного мульти-агентного ИИ ИТМО (Николай Никитин). В разработке активно участвуют студенты обоих университетов. В комплект фреймворка входит также новая компактная модель Meno-Lite-0.1 на 7B параметров (первое место на SemEval-2026 Task 8 MTRAG). В препринте, (сейчас он на рецензии на одной из A*-конференций), мы показали, что для построения качественного графа знаний не обязательно задействовать большие модели: наш 7B-экстрактор показывает результат лучше, чем Qwen2.5-32B на построении графов. Также, фреймворк недавно ставил одним из победителей конкурса Yandex Open Source. Если говорить о конкретных цифрах: RAGU достает до 84% релевантного контекста в медицинских бенчмарках (у конкурентов ≤76%). Мы обходим HippoRAG 2 на креативных задачах (59.0 против 56.9). При этом стоимость обработки — $0.001 за документ в сравнии с $0.10 у API-решений. Как пользоваться RAGU: Ставится одной командой pip install graph_ragu, работает на обычной потребительской видеокарте. Код открыт (MIT), веса — Apache 2.0. Как поддержать: Если разработка заинтересовала, то ее можно поддержать в Daily Papers на Huggingface, поставив upvote тут: https://huggingface.co/papers/2607.11683 Также, будет рады звездочкам на репозиторий: https://github.com/RaguTeam/RAGU Если есть вопросы - пишите в комментариях или в Issues на GitHub. P.S. Если хотите посмотреть, как всё работает: - 2 минуты: базовая настройка и первый запуск - 11 минут: глубокое погружение в конфигурации пайплайна
Hugging Face и alphaXiv объявили соревнование по воспроизведению результатов научных статей с ICML 2026 - тема, на которую периодически пишем. Из каждой статьи выделено несколько claims, корректность которых и нужно проверить. Цель проекта – создать публичную базу проверок научных работ, чтобы сделать их более прозрачными и воспроизводимыми. За участие организаторы предлагают GPU-кредиты на каждую статью (но их быстро разбирают) + отдельные призы от OpenResearch. Дедлайн - 2 августа. P.S. Спс каналу Навука и моя жизнб за информирование, а то как-то мимо прошло)
Объявлены репозитории-победители очередного опенсорс-конкурса KaiCode: 1) raprogramm/yew-nav-link 6★ - Вьетнам - Perfect $2048 А navigation-link library for the Yew framework in Rust with automatic active-state detection, demonstrated perfect software development practices: clean and idiomatic code, requirements captured as formal specifications and architecture decision records, strict static analysis (clippy, CodeQL, Scorecard, zizmor), mutation, fuzz, and property testing with enforced 95% coverage, an mdBook documentation site, semantic-versioned releases with a maintained changelog, protected branching, and exemplary REUSE-compliant licensing. Source files are small, meticulously documented, and every file carries SPDX headers. 2) ahoo-wang/wow 296★ - Китай - Excellent $1024 А reactive CQRS and Event-Sourcing microservice framework built on Domain-Driven Design, written in Kotlin, showed us an excellent codebase: clean, modular DDD/CQRS design, genuine multi-reviewer code review, Testcontainers-backed integration testing, enforced coverage thresholds and detekt static analysis, a bilingual documentation site, and a long history of semantic-versioned releases on Maven Central. However, issue labeling is inconsistent across recent tickets. 3) choplogic/chop-logic-components 5★ - Сербия - Awesome $512 A library of reusable React components and hooks written in TypeScript, showed us awesome coding practices: conventions enforced by Biome, Prettier, commitlint, and Husky git hooks, mutation testing with Stryker on top of Codecov-tracked coverage, a Storybook gallery published as a documentation site, and semantic-versioned releases to npm with a maintained changelog. However, pull requests are self-merged by the sole author without review, and licensing stops at a single MIT file, with no SPDX headers in the sources Всего принимало участие 153 проекта. От нас тоже подавали, но не вышло. Подача на следующий конкурс уже открыта.
Сбер выкатил новые опенсорс-модели - теперь со звуком: 1) Новая GigaChat Audio. Audio-native LLM на базе GigaAM Multilingual и GigaChat3.1-10B-A1.8B. Поддерживает multi-turn диалог, классификацию аудио, перевод и распознавание речи, и temporal grounding (локализацию событий во времени), описание интервала аудио и суммаризацию с временными метками. В комплекте идет датасет TimeGround-1M — для обучения LLM привязке событий ко времени. 📖 arXiv 🤗 ai-sage/GigaChat3.1-Audio-10B-A1.8B 🤗 ai-sage/TimeGround-1M 2) Обновление GigaAM Multilingual. Расширение модели распознавания речи на казахский, киргизский, узбекский и английский. 📖 arXiv 🤗 ai-sage/GigaAM-Multilingual 👩💻 salute-developers/GigaAM
И снова рубрика "рассказываем о научно-опенсорсных успехах коллективов ИТМО". Сегодня - про AI4Physics. Андрей Богданов из Нового физтеха ИТМО совместно с Харбинским инженерными университетом: (1) разработали ИИ-модель MetaDiT для автоматического проектирования сверхтонкой оптики. (2) опубликовали статью "MetaDiT: Enabling Fine-grained Constraints in High-degree-of Freedom Metasurface Design" на А*-конференции AAAI 2026. (3) выложили открытый код; (4) на днях выпустили пресс релиз. Правда, для полноценной открытости кода в репозитории не хватает лицензии) Попробуем его обработать Осой, чтобы исправить это и поискать что ещё можно улучшить. Статья: https://ojs.aaai.org/index.php/AAAI/article/view/37025 Код: https://github.com/JessePrince/metadit СМИ: https://tass.ru/nauka/27872435
Сегодня - рубрика "рассказываем о научно-опенсорсных успехах коллективов ИТМО": У коллег из Industrial AI Research Lab Института ИИ ИТМО вышла новая статья на демо-треке A*-конференции ACL 2026: SlideGuard: AI-Driven Evaluation of Graduate Student Presentation Materials SlideGuard - это агентная система, анализирующая презентации на основе множества критериев с поддержкой фильтрации и категоризации по типам слайдов. Её уже внедрили на ФТИИ ИТМО (наравне с нашим инструментом OSA - про его применение для ВКР cм. тут) Код SlideGuard - полностью открыт: https://github.com/Industrial-AI-Research-Lab/SlideGuard
Вчера посетили церемонию вручения премии Generation AI Awards: В номинации "За вклад в развитие GenAI-сообщества" победила платформа бенчмаркинга LLM Arena. Мы вошли в шорт-лист финалистов, но до первого места не хватило. Также можно посмотреть интересные проекты в других номинациях. Например, мне понравился стартап НейроДВС (AI-система диагностики двигателей транспорта с использованием LLM+RAG). Какое-то разнообразие среди повышения видимости брендов и автоматизации продаж) P.S. Коллег из AI Talent Hub ИТМО можно поздравить с победой в соседней номинации.
Коллеги из МосХаб анонсируют митап «День открытого кода», который пройдет 30 июня в Москве. Обещают обсуждение связанных с открытым кодом вопросов в формате интеративной дискуссии: В МосХаб.Сколково соберутся разработчики, продуктовые и ИТ-команды, стартапы и профильные медиа, чтобы обсудить последние тренды отрасли в России, завести полезные знакомства и наметить совместные проекты. На митапе участники узнают, как столица видит развитие опенсорс, какие результаты уже есть и почему открытый код стал важной частью городской цифровой стратегии. Подробности - на сайте. Кто выступит: - Владимир Нелюб — директор по науке и ИИ «Группы Астра», управляющий партнёр ASTRA AI, д.т.н., профессор - Андрей Иванов — директор по развитию бизнеса Swordfish Security - Анна Романова — управляющий партнёр AG Legal - Алексей Анисимов — заместитель руководителя ДИТ Москвы - Роман Аляутдин — директор по разработке ОС Аврора - Руслан Ахтямов — основатель Napoleon IT и НИИСТРОМ Алексей Анисимов кстати уже участвовал в нашей опенсорс-дискуссии на РИФ 2025.
Объявлен новый опенсорс-конкурс: «Код логики» от «Института логики». Кто может участвовать: физические лица - разработчики свободного ПО. Что нужно сделать: предоставить значимый вклад в существующий Open-Source-проект, опубликованный в публичном репозитории под свободной лицензией. Вклад может быть сделан в свой или сторонний проект. Призовой фонд: 3 призовых места, максимальное количество победителей — до 6 человек. Победитель получит 1 000 000 рублей. Сроки: заявки принимаются до 15 августа 2026 года на сайте института. Награждение победителей состоится 2–4 октября на XXII ежегодной конференции разработчиков свободных программ (писали про неё недавно как раз). Организатор конкурса - АНО «Институт логики», финансовую поддержку обеспечивает «Базальт СПО» и частные спонсоры. Подробности - на сайте (конкретные критерии оценивания и проч. - в Положении).
Традиционный анонс: XXII конференция разработчиков свободного ПО (OSSDEVCONF) состоится в октябре 2026 года в Переславле-Залесском. Дедлайн для заявления докладов - 6 сентября. От нашего сообщества уже дважды были выступления (2024, 2025), надеюсь продолжим традицию. Подробности - на сайте конференции https://www.basealt.ru/22dev-conf
В GitVerse сообщают, что развернули актуальное зеркало PyPI: https://t.me/gitversenews/912 Всячески надеюсь, что с доступом к оригинальному PyPI из наших сетей никогда не будет никаких проблем, но недавно были случаи перебоев - так что для внутренних серверов может и пригодится. Также представлены зеркала Docker Hub, Maven Central и NPM. P.S. Ещё есть аналогичное зеркало от Яндекса.
Коллеги из AIRI выложили в открытый доступ модель OCC-RAG. Описание дают такое: Она обучена отвечать на вопросы по внешним источникам, связывать факты из нескольких независимых частей текста, опираться только на предоставленный контекст и отказываться предоставлять ответ, если данных в источнике не хватает. Благодаря компактному размеру модель обрабатывает запросы в 1,5–2 раза быстрее решений на базе больших языковых моделей, тратя при этом на генерацию ответа в среднем в 1,5 раза меньше токенов. Ссылки: Технический репорт | GitHub | GitVerse | HuggingFace | Forbes Подробности реализации от Ивана Оселедца закинул в наш чат. Кстати, на HF статью можно поддержать апвоутом - сейчас она уже в Paper of the Day.