tgindex
Научный опенсорс

Научный опенсорс

Статистика

Канал сообщества ITMO OpenSource, посвященного созданию и использованию наукоёмких open-source проектов, в том числе в области AI/ML. Чат: https://t.me/itmo_opensource По всем вопросам - @nicl_nno

Последний пост
5 авг.
Последнее чтение
14:49
Постов за неделю
0
Всего постов
28
Тип
открытый
Язык
русский
В каталоге с
12 авг.
Подписчики
952
0 за 4 дн.
Сутки
0
0,00%
Неделя
 
Месяц
 
Просмотров на пост
731
28 постов
Вовлечённость
76,8%
к подписчикам
Постов в день
0,0
всего 28
Упоминаний
4
каналов
Охват размещения
оценка
1/24сутки в ленте
365
1/48двое суток
418
1/72трое суток
451

Оценка по просмотрам недавних постов: пост набирает почти всё за первые сутки.

Посты

  • 5 авг.4401213

    Коллеги из Sber AI Lab опубликовали новый открытый репозиторий https://github.com/sb-ai-lab/SIRIN (Semantic Inconsistency Recognition and Inspection Nexus) - инструмент для поиска смысловых ошибок в ответах языковых моделей. Что умеет SIRIN: - Проверяет соответствие ответа исходному контексту на уровне токенов, последовательностей и отдельных утверждений. - Поддерживает детекцию галлюцинаций и оценку answerability - достаточности данных для ответа. - Объединяет несколько классов детекторов: llm-as-a-judge, uncertainty, probing с использованием метамоделей. - Позволяет сравнивать и комбинировать разные методы детекции - работает как инструмент для исследований и разработки. Ссылки: 🔗GitHub 🔗GitVerse 🔗Демо на Hugging Face 🔗Статья на arxiv Поддержать традационно можно звездочками.

  • #зоопарк_одобряет #конференции Вернее, не конференция, а интересный (и бесплатный) вебинар от girafe.ai "Рабочее окружение ML-инженера: делегируем рутину ИИ-агентам" Почему интересно: хотя бы по той причине, что у girafe.ai есть совместная онлайн-мага с МФТИ, что, на наш взгляд, уже знак качества (Физтех очень разборчив в выборе таких партнеров) Темы: • организация удобного рабочего окружения ML-инженера с нуля • настройка безопасного состояния удалённого сервера для любых нужд • автоматизация всех рутинных процессов агентами • формирование скиллов агентов для однокнопочного воспроизводства операций • кастомизация под свои вкусы и нужды Когда: 5 августа (среда), в 19:00 (МСК) Спикер: Владислав Гончаренко - основатель girafe.ai и автор курса MLOps онлайн-магистратуры MSAI (girafe.ai × МФТИ) Язык русский, участие, повторяем, бесплатное, но нужна предварительная регистрация - вот тут

  • Анонсируют такой вот вебинар из цикла опенсорс-курсов по ИИ от МФТИ:

  • Тематически близкая конференция про качество кода продлила дедлайн до 17 августа: https://www.iccq.ru/2026.html Публикации в IEEE Xplore/Scopus, локация - уютный декабрьский Новосибирск.

  • видео или голосовое, без подписи

  • 29 июл.30744из tech_shpilman

    🤖 Интересная дискуссия развернулась по поводу open-weights моделей – после того, как стало известно об инициативах в правительстве США по запрету использования китайских моделей в американских компаниях. Дженсен Хуанг (CEO NVIDIA) – с еще семью десятками ИТ- и ИИ-лидерами – написал открытое письмо, в котором заявил, что open source – это, вообще-то, замечательно, да и open-weight тоже, так что не надо, пожалуйста, ничего и нигде запрещать. 🔹В этой связи хорошо вспомнить, что open source – это практически никогда не про благотворительность. Все самые большие проекты – они про деньги, просто не деньги за сам код. — Большая часть контрибьюторов в ядро Linux и спонсоров Linux Foundation – это компании и их сотрудники. Intel вкладывается в Linux, потому что это помогает продавать больше серверов. — Facebook (организация ужасная и запрещенная, потому что ужасная) вложился в PyTorch, чтобы Google со своим TensorFlow не монополизировал нейронки и все не сидели на их облаках. — На карточках NVIDIA, конечно же, гоняется огромное количество open-weights ИИ-моделей – тут коммерческий ущерб от их запрета пошел бы на миллиарды. Да, на тех же карточках можно гонять и американские модели, но перестройка существующих бизнес-процессов была бы катастрофической. — Perplexity и другие подписавшиеся тоже хотят использовать в своих продуктах open-weights: не все хотят переплачивать за дорогой ChatGPT, так как в этом случае конкурентоспособность сервисов радикально снизится. 🔹Почему же Anthropic отказалась подписывать это все? Скорее всего, у них самый независимый стек технологий, где open-weights используется немного, и проблемы зажравшейся NVIDIA и компаний, которые делают более дешевые, но не такие хорошие продукты, им на руку. Ну а про кибербез и репрессии китайского народа в их заявлении – для того, чтобы эгоизм не выглядывал. 🔹Есть и более позитивная сторона open source: иногда ребята открывают проекты, потому что хотят, чтобы технологии развивались в целом, и чтобы кадры росли, и чтобы экономика двигалась вперед. А где деньги заработать – это уже потом придумаем. Или не придумаем, но карму точно заработаем🌟 Так, Т-шники на TurboML выкатили пару очень прикольных релизов – T-Search и Perseus. T-Search – агентный фреймворк для многошагового поиска на английском и русском языках. Многошаговый поиск нужен, чтобы агент сначала понял контекст из всего поверхностно найденного, а потом постепенно улучшал запросы. Получилось очень круто с точки зрения сотношения полноты найденного и потраченных ресурсов. Допиленный Qwen работает на одной карточке. Всем страдающим от невозможности закупить мощностей, но страждущим сделать агентный поиск – крайне рекомендую. А штука с романтичным названием Perseus – это фреймворк для построения рекомендательной системы на потоке данных о человеке без каких-либо специальных обработок этих самых данных. То есть если у вас есть поток данных, вы хотите что-то рекомендовать человеку, и вам при этом не хочется учиться на кафедре РЭСИК два года, можно просто поставить Персея – он сам разберется и все порекомендует.

  • Hugging Face и alphaXiv объявили соревнование по воспроизведению результатов научных статей с ICML 2026 - тема, на которую периодически пишем. Из каждой статьи выделено несколько claims, корректность которых и нужно проверить. Цель проекта – создать публичную…

  • Moonshot AI выпустила Kimi K3 на Hugging Face: Это первая модель с открытыми весами в классе ~3T. Благодаря MoE на каждый токен активируются лишь 104B параметров (16 экспертов из 896). По заявлению разработчиков, K3 создана для длинных агентных задач: работы с большими репозиториями, использования терминала, исследований, оптимизации GPU-ядер, компиляторов и других многошаговых инженерных сценариев. Что внутри: - контекст 1 048 576 токенов - нативная мультимодальность (для текста и изображений и видео) - 93 слоя: 69 KDA + 24 Gated MLA - веса MXFP4 + активации MXFP8 - заявлено ~2,5× более эффективное масштабирование по сравнению с Kimi K2. Веса модели: https://huggingface.co/moonshotai/Kimi-K3 Техрепорт: https://github.com/MoonshotAI/Kimi-K3/blob/main/k3_tech_report.pdf Но в плане открытости есть нюанс - веса выложены под лицензией Kimi K3 License, ограничивающей коммерческое использование после определенного порога выручки.

  • 20 июл.1 1861440

    RAGU - на HuggingFace! Сегодня мы выложили на HuggingFace препринт про открытый GraphRAG-фреймворк RAGU. RAGU - это модульный GraphRAG-движок, который превращает сырой текст в граф знаний: извлекает сущности и связи, строит и чистит граф, а затем ищет ответы через локальные, глобальные или гибридные стратегии. Этот проект сейчас разрабатывается совместно Лабораторией прикладных цифровых технологий НГУ (Иван Бондаренко) и Лабораторией автоматизированного мульти-агентного ИИ ИТМО (Николай Никитин). В разработке активно участвуют студенты обоих университетов. В комплект фреймворка входит также новая компактная модель Meno-Lite-0.1 на 7B параметров (первое место на SemEval-2026 Task 8 MTRAG). В препринте, (сейчас он на рецензии на одной из A*-конференций), мы показали, что для построения качественного графа знаний не обязательно задействовать большие модели: наш 7B-экстрактор показывает результат лучше, чем Qwen2.5-32B на построении графов. Также, фреймворк недавно ставил одним из победителей конкурса Yandex Open Source. Если говорить о конкретных цифрах: RAGU достает до 84% релевантного контекста в медицинских бенчмарках (у конкурентов ≤76%). Мы обходим HippoRAG 2 на креативных задачах (59.0 против 56.9). При этом стоимость обработки — $0.001 за документ в сравнии с $0.10 у API-решений. Как пользоваться RAGU: Ставится одной командой pip install graph_ragu, работает на обычной потребительской видеокарте. Код открыт (MIT), веса — Apache 2.0. Как поддержать: Если разработка заинтересовала, то ее можно поддержать в Daily Papers на Huggingface, поставив upvote тут: https://huggingface.co/papers/2607.11683 Также, будет рады звездочкам на репозиторий: https://github.com/RaguTeam/RAGU Если есть вопросы - пишите в комментариях или в Issues на GitHub. P.S. Если хотите посмотреть, как всё работает: - 2 минуты: базовая настройка и первый запуск - 11 минут: глубокое погружение в конфигурации пайплайна

  • 18 июл.1 6901118

    Hugging Face и alphaXiv объявили соревнование по воспроизведению результатов научных статей с ICML 2026 - тема, на которую периодически пишем. Из каждой статьи выделено несколько claims, корректность которых и нужно проверить. Цель проекта – создать публичную базу проверок научных работ, чтобы сделать их более прозрачными и воспроизводимыми. За участие организаторы предлагают GPU-кредиты на каждую статью (но их быстро разбирают) + отдельные призы от OpenResearch. Дедлайн - 2 августа. P.S. Спс каналу Навука и моя жизнб за информирование, а то как-то мимо прошло)

  • Объявлены репозитории-победители очередного опенсорс-конкурса KaiCode: 1) raprogramm/yew-nav-link 6★ - Вьетнам - Perfect $2048 А navigation-link library for the Yew framework in Rust with automatic active-state detection, demonstrated perfect software development practices: clean and idiomatic code, requirements captured as formal specifications and architecture decision records, strict static analysis (clippy, CodeQL, Scorecard, zizmor), mutation, fuzz, and property testing with enforced 95% coverage, an mdBook documentation site, semantic-versioned releases with a maintained changelog, protected branching, and exemplary REUSE-compliant licensing. Source files are small, meticulously documented, and every file carries SPDX headers. 2) ahoo-wang/wow 296★ - Китай - Excellent $1024 А reactive CQRS and Event-Sourcing microservice framework built on Domain-Driven Design, written in Kotlin, showed us an excellent codebase: clean, modular DDD/CQRS design, genuine multi-reviewer code review, Testcontainers-backed integration testing, enforced coverage thresholds and detekt static analysis, a bilingual documentation site, and a long history of semantic-versioned releases on Maven Central. However, issue labeling is inconsistent across recent tickets.  3) choplogic/chop-logic-components 5★ - Сербия - Awesome $512 A library of reusable React components and hooks written in TypeScript, showed us awesome coding practices: conventions enforced by Biome, Prettier, commitlint, and Husky git hooks, mutation testing with Stryker on top of Codecov-tracked coverage, a Storybook gallery published as a documentation site, and semantic-versioned releases to npm with a maintained changelog. However, pull requests are self-merged by the sole author without review, and licensing stops at a single MIT file, with no SPDX headers in the sources Всего принимало участие 153 проекта. От нас тоже подавали, но не вышло. Подача на следующий конкурс уже открыта.

  • Сбер выкатил новые опенсорс-модели - теперь со звуком: 1) Новая GigaChat Audio. Audio-native LLM на базе GigaAM Multilingual и GigaChat3.1-10B-A1.8B. Поддерживает multi-turn диалог, классификацию аудио, перевод и распознавание речи, и temporal grounding (локализацию событий во времени), описание интервала аудио и суммаризацию с временными метками. В комплекте идет датасет TimeGround-1M — для обучения LLM привязке событий ко времени. 📖 arXiv 🤗 ai-sage/GigaChat3.1-Audio-10B-A1.8B 🤗 ai-sage/TimeGround-1M 2) Обновление GigaAM Multilingual. Расширение модели распознавания речи на казахский, киргизский, узбекский и английский. 📖 arXiv 🤗 ai-sage/GigaAM-Multilingual 👩‍💻 salute-developers/GigaAM

  • 3 июл.892127

    И снова рубрика "рассказываем о научно-опенсорсных успехах коллективов ИТМО". Сегодня - про AI4Physics. Андрей Богданов из Нового физтеха ИТМО совместно с Харбинским инженерными университетом: (1) разработали ИИ-модель MetaDiT для автоматического проектирования сверхтонкой оптики. (2) опубликовали статью "MetaDiT: Enabling Fine-grained Constraints in High-degree-of Freedom Metasurface Design" на А*-конференции AAAI 2026. (3) выложили открытый код; (4) на днях выпустили пресс релиз. Правда, для полноценной открытости кода в репозитории не хватает лицензии) Попробуем его обработать Осой, чтобы исправить это и поискать что ещё можно улучшить. Статья: https://ojs.aaai.org/index.php/AAAI/article/view/37025 Код: https://github.com/JessePrince/metadit СМИ: https://tass.ru/nauka/27872435

  • 27 июн.7931013

    Сегодня - рубрика "рассказываем о научно-опенсорсных успехах коллективов ИТМО": У коллег из Industrial AI Research Lab Института ИИ ИТМО вышла новая статья на демо-треке A*-конференции ACL 2026: SlideGuard: AI-Driven Evaluation of Graduate Student Presentation Materials SlideGuard - это агентная система, анализирующая презентации на основе множества критериев с поддержкой фильтрации и категоризации по типам слайдов. Её уже внедрили на ФТИИ ИТМО (наравне с нашим инструментом OSA - про его применение для ВКР cм. тут) Код SlideGuard - полностью открыт: https://github.com/Industrial-AI-Research-Lab/SlideGuard

  • Вчера посетили церемонию вручения премии Generation AI Awards: В номинации "За вклад в развитие GenAI-сообщества" победила платформа бенчмаркинга LLM Arena. Мы вошли в шорт-лист финалистов, но до первого места не хватило. Также можно посмотреть интересные проекты в других номинациях. Например, мне понравился стартап НейроДВС (AI-система диагностики двигателей транспорта с использованием LLM+RAG). Какое-то разнообразие среди повышения видимости брендов и автоматизации продаж) P.S. Коллег из AI Talent Hub ИТМО можно поздравить с победой в соседней номинации.

  • Коллеги из МосХаб анонсируют митап «День открытого кода», который пройдет 30 июня в Москве. Обещают обсуждение связанных с открытым кодом вопросов в формате интеративной дискуссии: В МосХаб.Сколково соберутся разработчики, продуктовые и ИТ-команды, стартапы и профильные медиа, чтобы обсудить последние тренды отрасли в России, завести полезные знакомства и наметить совместные проекты.  На митапе участники узнают, как столица видит развитие опенсорс, какие результаты уже есть и почему открытый код стал важной частью городской цифровой стратегии. Подробности - на сайте. Кто выступит: - Владимир Нелюб — директор по науке и ИИ «Группы Астра», управляющий партнёр ASTRA AI, д.т.н., профессор - Андрей Иванов — директор по развитию бизнеса Swordfish Security - Анна Романова — управляющий партнёр AG Legal - Алексей Анисимов — заместитель руководителя ДИТ Москвы - Роман Аляутдин — директор по разработке ОС Аврора - Руслан Ахтямов — основатель Napoleon IT и НИИСТРОМ Алексей Анисимов кстати уже участвовал в нашей опенсорс-дискуссии на РИФ 2025.

  • Объявлен новый опенсорс-конкурс: «Код логики» от «Института логики». Кто может участвовать: физические лица - разработчики свободного ПО. Что нужно сделать: предоставить значимый вклад в существующий Open-Source-проект, опубликованный в публичном репозитории под свободной лицензией. Вклад может быть сделан в свой или сторонний проект. Призовой фонд: 3 призовых места, максимальное количество победителей — до 6 человек. Победитель получит 1 000 000 рублей. Сроки: заявки принимаются до 15 августа 2026 года на сайте института. Награждение победителей состоится 2–4 октября на XXII ежегодной конференции разработчиков свободных программ (писали про неё недавно как раз). Организатор конкурса - АНО «Институт логики», финансовую поддержку обеспечивает «Базальт СПО» и частные спонсоры. Подробности - на сайте (конкретные критерии оценивания и проч. - в Положении).

  • Традиционный анонс: XXII конференция разработчиков свободного ПО (OSSDEVCONF) состоится в октябре 2026 года в Переславле-Залесском. Дедлайн для заявления докладов - 6 сентября. От нашего сообщества уже дважды были выступления (2024, 2025), надеюсь продолжим традицию. Подробности - на сайте конференции https://www.basealt.ru/22dev-conf

  • 8 июн.9001410

    В GitVerse сообщают, что развернули актуальное зеркало PyPI: https://t.me/gitversenews/912 Всячески надеюсь, что с доступом к оригинальному PyPI из наших сетей никогда не будет никаких проблем, но недавно были случаи перебоев - так что для внутренних серверов может и пригодится. Также представлены зеркала Docker Hub, Maven Central и NPM. P.S. Ещё есть аналогичное зеркало от Яндекса.

  • 3 июн.1 1981525

    Коллеги из AIRI выложили в открытый доступ модель OCC-RAG. Описание дают такое: Она обучена отвечать на вопросы по внешним источникам, связывать факты из нескольких независимых частей текста, опираться только на предоставленный контекст и отказываться предоставлять ответ, если данных в источнике не хватает. Благодаря компактному размеру модель обрабатывает запросы в 1,5–2 раза быстрее решений на базе больших языковых моделей, тратя при этом на генерацию ответа в среднем в 1,5 раза меньше токенов. Ссылки: Технический репорт | GitHub | GitVerse | HuggingFace | Forbes Подробности реализации от Ивана Оселедца закинул в наш чат. Кстати, на HF статью можно поддержать апвоутом - сейчас она уже в Paper of the Day.

Научный опенсорс — tgindex