Градиент обреченный
Статистикаlingtra.in habr.com/ru/users/averkij/ hfday.ru
- Последний пост
- 08:43
- Последнее чтение
- 09:04
- Постов за неделю
- 15
- Всего постов
- 33
- Тип
- открытый
- Язык
- русский
- Категория
- Технологии (по похожим)
- В каталоге с
- 12 авг.
- 1/24сутки в ленте
- 1 693
- 1/48двое суток
- 1 940
- 1/72трое суток
- 2 092
Оценка по просмотрам недавних постов: пост набирает почти всё за первые сутки.
Посты
Тыкаю GLM. От поиска уязвимостей, по крайней мере, не отказывается.
GLM 5.3 Zhipu вчера выпустили новую модель. Что интересно, после всех предыдущих инцидентов сделали упор на кибербезе: GLM-5.3 did not simply become better at identifying isolated flaws: it began to reason across multiple stages of exploitation, forming coherent plans for complete exploitation chains. Пишут, что на внутренних бенчах она на 50% процентов лучше GLM 5.2, с точки зрения команды, которая модель обучала, это прям очень круто. Само собой, она послабее Fable и Sol, но safety фильтров в ней должно быть меньше, к тому же веса скоро выложат в открытый доступ. В OpenRouter пока нет, есть в официальном Code Plan, так что качаем родной харнесс, пробуем.
Знаю, что открытые модели сейчас пытаются разворачивать локально в некоторых больших компаниях и что в основном это проходит не очень успешно. Как я понимаю, ML-спецы на местах ставят небольшие модели и дают разработчикам, не объясняя толком что это, чтобы те разуверились в этом подходе и продолжали писать код руками. Друзья, не надо так, помогите коллегам, разверните что-то на 2T+ параметров, если есть возможность, настройте, проверьте и объясните как пользоваться. А то среди знакомых довольно много программистов, в том числе получше меня, которые всё ещё не в теме, а на работе им дают что-то странное. //писал пост про новый дипсик и отвлёкся
видео или голосовое, без подписи
видео или голосовое, без подписи
видео или голосовое, без подписи
видео или голосовое, без подписи
Заглянул на ML Recap от Яндекса, старый добрый митап, много приятных лиц, клевые доклады. Великолепный доклад был про табличный ML, узнали про него даже слишком много. Крутой доклад про инференс, спикер был хорош. Будет время, посмотрите, как выложат. 👉 Upd. https://runtime.strm.yandex.ru/player/episode/vple3pp35tg4cd7nefds
🔺 SuperMinor Сделал ещё один небольшой SFT датасет-заготовку для малоресурсных языков России. Пару лет назад делал портал для разметки, на котором были пользовательские промпты для чат-моделей типа "Когда родился XXX?" (есть много таких шаблонных промптов), "Выпиши пять основных пунктов, о которых идет речь в тексте:", "Переработай данный текст в креативный маркетинговый материал из 5-6 предложений" и т.д. Специально делал много синонимичных промптов в разных стилях для их разнообразия. Многое тогда перевели носители, часть оставалась. Делалось это всё для генерации синтетических SFT инструкций, например, берёте заготовку типа "«XXX» рус телендә нисек әйтергә?", подставляете слово на башкирском и ответ на русском. Делаете так N инструкций, кидаете в обучение. Таких промптов-заготовок в датасете 124 штуки. Сейчас провалидировал и доперевел остатки Fable'ом. Пометки про перевод есть в отдельных колонках. Всего 16 языков: русский, аварский, алтайский, башкирский, белорусский, даргинский, казахский, коми, марийский (луговой), осетинский (дигорский), осетинский (иронский), татарский, удмуртский, хакасский, чувашский, якутский. 👉 https://huggingface.co/datasets/averoo/sumi //всем, кто в свое время помогал переводить, спасибо!
Меня часто спрашивают, как я всё успеваю
видео или голосовое, без подписи
🌸Релизим Muse Glimmer 30B 🌸 Впервые за долгое время, наконец-то релизим большой командой новую открытую LLM от Meta Superintelligence Labs. Веса под Apache 2.0! 🌸Что это за модель: — 30B dense модель, дистиллированная версия Muse Spark для локального инференса на 1 GPU — юз-кейсы: OpenClaw, MCP, и агентные тулзы — общие способности (ризонинг, знания, кодинг) тоже на высоком уровне для модели такого размера. — очень быстрый инференс: 233 токена/сек на 5090 благодаря DFlash spec decoding — по ключевым способностям — агентные воркфлоу, swe bench, ризонинг — лучше Qwen 3.6 и Gemma 4 31B — есть мультимодальный инпут (картинки и видео) — больше 100 языков в претрейне — контекст 131к токенов — есть perception encoder (1.8B) в дополнение к модели Пожалуйста, скачивайте, пользуйтесь, — и ждите тех репорт и доки! На неделе постараемся выпустить инференс у партнёров и доки по деплою на llama.cpp, ExecuTorch, MLX. 🟣Блогпост https://research.meta.ai/blog/introducing-muse-glimmer-open-agentic-model 🟣 Веса https://huggingface.co/meta-models/Muse-Glimmer-30B 🟣Доки: (пока что такие же как у Muse Spark) https://dev.meta.ai/docs/cookbook
Старый добрый советский arXiv Все знают про arxiv.org — крупнейший репозиторий с препринтами по разным темам. Люди (и не только) пишут туда каждый день сотнями, нас особенно интересуют ML'ные статьи. Делал как-то, кстати, hfday.ru — пет-проект с обзором лучших статей за день/месяц по темам, можете посмотреть. Хостится всё на github, запускается через их actions пайплайн, код открыт. Недавно появился sovietrxiv.org. Некий энтузиаст с ником seconds_0 в твиттере уже распарсил, перевел и выложил 18k+ старых советских научных статей (!). Везде есть ссылки на оригиналы (типа такого), в основном это mathnet.ru и киберленинка. Он же делает chinarxiv.org, то же самое, только с оригинальными китайскими статьями, там их уже 23k+ штук. В спонсорах указаны OpenAI и Revival Fund. Тема хорошая, качаем, добавляем в претрейны. Надо только проверять по качеству парсинга (формулы и т.д.), в СССР почему-то набирали статьи не сразу в LaTeX'е.
Эксперимент Хочу ощутить боль непонимания, про которую вы пишете, и заодно освежить язык. Попробую всю неделю общаться с клод-кодом на немецком. Как раз остались финальные доработки перед релизом Библиоточки, так что посмотрим насколько сдвинется релиз. …
Наткнулся на страничку одного разработчика с парой прикольных поделок. Можно делать рабочие QR коды с зашитыми в них чб картинками. Работает через коррекцию ошибок — когда QR'у необходим один цвет, а стоит другой, то частично меняются соседние цвета, чтобы сохранить нужный оттенок (кажущийся нам оттенок серого в квадратике 3 на 3 пикселя, код на JS). Сама идея не новая. 👉 https://www.andrewt.net/dithered-qr-codes/wtf/ 👉 Upd. из комментов — модель для генерации читаемых qr ридерами картинок QR Code Monster 👉 Upd 2. QR в анимированной гифке
Друзья, сражаемся тут на турнире маленького шлема. Пока выигрываем! Пользуюсь админресурсом, проголосуйте, плиз, за команду Андрей Рублев. https://t.me/vtennise_live/12882 Upd. Андрей Рублев выиграл турнир, голосовалку тоже. Всем спасибо!
И только deepseek ломает другие конторы молча 👉 Вот тут можно отслеживать эту "гонку" — https://www.felonybench.com/
видео или голосовое, без подписи
видео или голосовое, без подписи
видео или голосовое, без подписи