tgindex
Vikhr models
@vikhrlabsрусский

official newsfeed, owner, admin and founder - alex nikolich - @alexwortega chat: @vikhrmodels

Последний пост
17 июн.
Последнее чтение
08:50
Постов за неделю
0
Всего постов
21
Тип
открытый
Язык
русский
В каталоге с
13 авг.
Подписчики
2 601
+4 за 3 дн.
Сутки
+1
+0,04%
Неделя
 
Месяц
 
Просмотров на пост
5 115
21 постов
Вовлечённость
196,7%
к подписчикам
Постов в день
0,0
всего 21
Упоминаний
2
каналов
Охват размещения
оценка
1/24сутки в ленте
1/48двое суток
1/72трое суток

Оценка по просмотрам недавних постов: пост набирает почти всё за первые сутки.

Посты

  • 17 июн.1 3147263из lovedeathtransformers

    SIQ-1-35B Короче я обучил qwen35b a3 с PPO и я первый раз в жизни увидел чтобы PPO докидывало нормально(reward был верифицируемый) Эта штука на karpathy autoresearch для parametr golf лучше чем glm5.2 и qwen350b и генерит идеи похожие на опус А еще она на bullshit бенч лучше чем NEX и gpt5.5 Модель + gguf: https://huggingface.co/AlexWortega/SIQ-1-35B Демо чтобы гонять на zero gpu и радоваться: https://huggingface.co/spaces/AlexWortega/hermes-agent-zerogpu

  • 11 июн.2 0101711из ruadaptnaya

    31-я международная конференция по компьютерной лингвистике и интеллектуальным технологиям «Диалог»  (https://dialogue-conf.org/) 24-26 июня 2026 года   Приглашаем прийти послушать доклады и принять участие в обсуждении достижений больших языковых моделей и современной лингвистики   Приглашенные доклады: Колмогорова  Анастасия Владимировна д-р филол.наук, профессор, профессор департамента филологии Школы гуманитарных наук и искусств НИУ ВШЭ СПб, академический руководитель магистерской программы «Языковые технологии в бизнесе и образовании», руководитель научной лаборатории языковой конвергенции  «Визуальные языковые модели в задаче описания картин»   Украинский Руслан Владимирович, руководитель проекта Исследования и инновации Производственного управления компании «Гарант»  «От модели к агенту: как генеративный ИИ меняет работу с правовой информацией и разработку справочных правовых систем»   Подобряев Александр Владимирович, phd, доцент школы лингвистики, ВШЭ «Семантические компетенции больших языковых моделей»   Регистрация до 23 июня 2026 года   МЕСТО ПРОВЕДЕНИЯ 2-й гуманитарный корпус, факультет ВМК, Ленинские горы, 1, стр. 52, северный вход, 2 этаж

  • 25 мая3 341289

    Бета релиз Borealis 5b - 4b qwen + whisper + сделали плагин для vllm + теперь оно работает с инструкциям и может решать задачи qa, cls, summarize, json mode Это тестовый релиз, не финальный, я хочу собрать что не работает и как вы пользуетесь Модель…

  • 30 мар.7 342378282

    Вихри как проект был осонован мной глядя на тотальную неспоснобность команд в россии сделать нормальную ллмку для людей, в момент когда я начинал эту движуху у меня была только довольно жирная зарплата, навык и несколько гпу. Это вообще не планировалось как что то большое, выложить пару удачных моделей и все. Потом я решил еще повливать своих денег, набрать побольше реклам в LDT и подистилить gpt4, потом я захотел еще поигратся с аудио и мы стали делать SALT и Borealis. В это время Серега удачно переделал бенчи на русский и сделал отличную Vikhr Nemo 12b, ru arena hard. [тут мы довольно удачно залетели на воркшоп EMNLP, спасибо нашему научному консультанту/руководителю] Мы планировали скейлится и поднимать денег, брать комерческие заказы, но реальность российского рынка примерно такая: если у вас нет горы денег от материнской компании - вы не выживаете. Строить client oriented продукты на основе сколько то сложных технологий - ну маловероятно А еще нам прилетатает ACL претензия от Сбера за авторством (Сергей Марков, Алена Феногенова ...) что МЕРA мы меряем неверно и в целом обманываем всех клеймя SOTA. Ну хз, считаешь как тебе удобно, получаешь SOTA, нормально? Нормально на мой взгляд В целом крайне забавно смотреть как трестся столь большое начальство, статью мы отозвали по итогу тк не хотелось подставлять нашего научного консультанта, а я начал заниматся более важными для себя вещами чем русский опенсурс. По состоянию на март 2026 я могу сказать что пациент скорее мертв, бигтехи не тянут конкуренцию не с китайем не с америкой (простите я не хочу сравнивать мистралем), а проект не будет обновлятся по крайней мере централизовано. За все время было потрачено ~70к долларов моих личных денег, а несколько ребят получившие опыт на Вихрях довольно успешно устроились на работу. К слову мы не получили не копейки от рутуба, газпрома, ингостраха и нескольких других компаний использующих наши модели. К слову да, мы прекращаем(уже как год прикратили активно) разрабатывать что либо *Мера и гигачат это довольно разные люди **наблюдать за тем как трясет сберовцев в коментах - отдельный вид удовольствия

  • 22 дек.7 1335479

    Для чего вы используете audio llm типа qwen audio, voxtral? Используете ли?

  • 20 дек.5 0512113

    Для чего вы используете audio llm типа qwen audio, voxtral? Используете ли?

  • 25 нояб.5 7982919

    🔥МЫ ПРЕДСТАВЛЯЕМ КРУПНЕЙШИЙ OPEN-SOURCE AI В ЕВРОПЕ 🔥 Мы стремимся не замыкаться в «закрытой» технологии, а строить открытую платформу для всей страны, поэтому мы публикуем веса наших моделей Что появилось в открытом доступе ↓ 🔷 GigaChat Ultra Preview Самая…

  • 24 нояб.4 626279из llm_arena

    🔫 GenCode Mini Gallery Bench LLM Arena совместно с Сергеем Курбановым (руководитель направления RnD в компании MWS) рады представить новый бенчмарк. 📈 LLM стремительно эволюционируют и выходят на уровень AGENT-поведения, где модели решают задачи от анализа данных до полноценной разработки. На этом фоне особенно интересно посмотреть на то, как модели в режиме реального времени справляются даже с такими, на первый взгляд, простыми задачами вёрстки. GenCode Mini Bench не содержит выводов — только чистый эксперимент и результат работы моделей. Да, это не совсем привычный бенчмарк, но надеемся, что вам понравится его формат. Кроме того, там подключена форма обратной связи, где вы можете прислать собственные промпты, а мы каждые 2 недели будем обновлять его содержимое. Генерации обновляются каждые 6 часов, поэтому заглядываете периодически, чтобы посмотреть на результаты различных моделей. ❗️ Модели, используемые для генераций доступны по API на VSELLM ♾ Вкладка с бенчмарком доступна на https://llmarena.ru/ или напрямую по ссылке https://clocks.llmarena.ru/. 📸 Ждем вашего мнения и обратной связи.

  • 23 нояб.3 130916из gigadev_channel

    🤖 Хотите больше информации про наши последние релизы? 10 декабря на «Салют, Гига!» мы подробно расскажем, что сделали за этот год в командах GigaChat, Kandinsky и GigaData (платформы для управления данными, аналитики и поиска в контексте ИИ-моделей и сервисов). От архитектур и метрик до подходов, решений и планов на будущее. Будут доклады от инженеров, разборы под капотом, постерная сессия с командами и возможность задать любые технические вопросы тем, кто эти модели создаёт. Мы делаем формат максимально полезным для тех, кто работает с ML, данными, исследовательскими пайплайнами или инфраструктурой. Присоединяйтесь офлайн или онлайн, участие бесплатное. ➡️Вот ссылка на регистрацию. Будем рады видеть всех 10 декабря.

  • 20 нояб.3 22086151из official_gigachat

    🔥МЫ ПРЕДСТАВЛЯЕМ КРУПНЕЙШИЙ OPEN-SOURCE AI В ЕВРОПЕ 🔥 Мы стремимся не замыкаться в «закрытой» технологии, а строить открытую платформу для всей страны, поэтому мы публикуем веса наших моделей Что появилось в открытом доступе ↓ 🔷 GigaChat Ultra Preview Самая мощная модель Сбера. Лучше DeepSeek V3.1 и GigaChat Max 2 в русскоязычных задачах. Подходит для бизнеса, аналитики, разработки и дообучения на ваших данных ➡ GitHub | HuggingFace |GitVerse GigaAM-v3 Пять моделей, которые превращают голос в текст с пунктуацией, понимают акценты, спонтанную речь и даже музыкальные запросы. Подойдут для голосовых ассистентов, контакт-центров, аналитики звонков ➡ GitHub | HuggingFace | GitVerse 🔷 GigaChat Lightning Лёгкая, компактная и быстрая. Конкурирует с Qwen3-4B, по скорости сравнима с Qwen3-1.7B, но намного умнее и больше по параметрам ➡ GitHub | HuggingFace |GitVerse 🔷 Kandinsky 5.0 Создание фото и видео по тексту. Внутри: • Image Lite — делает изображения в HD, отлично понимает русский язык и культурный контекст • Video Pro — создаёт до 10 секунд реалистичного HD-видео. Конкурирует с топовыми мировыми моделями • Video Lite — облегчённая версия для домашней видеокарты (от 12 ГБ) ➡️ GitHub | GitVerse | Hugging Face | Технический репорт 🔷 K-VAE 1.0 Ускорение генеративного AI. Это технологии, которые «упаковывают» картинки и видео в скрытое пространство, чтобы модели работали быстрее и требовали меньше ресурсов. Лучшие среди открытых аналогов ➡️ GitHub|Hugging Face Код и веса этих всех моделей теперь доступны всем пользователям по лицензии MIT, в том числе для использования в коммерческих целях

  • 9 нояб.13,1 тыс5440

    https://sites.google.com/view/mathnlp2025 даже не плохо

  • 27 окт.4 4105561из AvitoLive

    🚀 Технологическая платформа Авито открывает доступ к собственным ИИ-моделям, в разработку которых компания вложила около полумиллиарда рублей A-Vibe и A-Vision – это первые российские открытые модели с глубокой оптимизацией под русский язык, специально обученные для e-commerce. Разработчики, стартапы, бизнес и исследователи получат готовые инструменты для анализа документов, автоматизации контента и создания ИИ-ассистентов. Модели позволят сократить затраты ресурсов до 50% по сравнению с другими открытыми нейросетями. Модели умеют вызывать внешние инструменты (function calling), что позволяет создавать автономные системы и агенты. A-Vibe заняла первое место среди лёгких нейросетей в популярных открытых тестах: по пониманию русского языка, работе с кодом и решению сложных задач. Нейросети доступны бесплатно по лицензии Apache 2.0 для любого использования. 🎯 Где можно применять: — Бизнес: автоматизация контента, анализ документов, создание клиентских ассистентов — Разработка: дообучение под конкретные задачи на собственной инфраструктуре — Образование: инструмент для обучения и исследований — Наука: изучение мультимодальных технологий 🎁 Бонус для комьюнити: Команда Авито также перевела на русский язык 4 международных открытых набора задач для тестирования нейросетей – теперь все российские разработчики смогут использовать их для проверки своих больших языковых моделей. Модели доступны на Hugging Face с подробной документацией и примерами использования! 🔗

  • 21 окт.3 7506296из krists

    RuQualBench 🐸 Я сделал бенчмарк для оценки качества русского языка в LLM. Подробности: - Набор из 100 (по умолчанию)/250/500 вопросов по general chat/creative writing доменам. - LLM as a Judge, но с четкими критериями разметки ответов. - Упор на типичные для LLM ошибки на русском (перепутанные рода, "китайщина", выдуманные слова). - Всё под открытой лицензией! Анализ результатов: - Лучшими моделями всё еще остаются закрытые (в частности, Sonnet 4.5, Gemini, GPT-4o). Но некоторые открытые очень близки. - GPT-5 ужасна. Я думал, что она лучше. - Из открытых моделей Gemma-3-27b-it и Vistral-24B оказались вне конкуренции. - Ruadapt значительно уменьшает количество ошибок относительно Qwen. - Qwen3 и GPT-oss очень плохи. Даже хуже, чем я ожидал. - Qwen3-Next лучше, чем Qwen3. Похоже, туда долили русского языка. - У DeepSeek V3 мало ошибок, но актуальная V3.2-Exp почти в 2 раза хуже. Лидерборд, код и данные

  • 20 окт.3 5024671из evilfreelancer

    Давно мечтал разобраться с тем как конвертировать в GGUF без потерь в качестве, чтобы оного добиться необходимо использовать калибровочный датасет, но как подружить датасет, GGUF и инструменты квантизации для меня было неведомо. Поэтому решил изучить тему сам и рассказать вам в моей новенькой публикации "GGUF: квантизация с калибровкой (imatrix)" на Хабр. UPD. На примере модельки ai-sage/GigaChat-20B-A3B-instruct #habr #gguf

  • 20 окт.3 641128

    Поздравляю причастных!

  • ⚪️ White Circle Всем привет, мы делаем лучшую AI safety платформу, чтобы модельки не делали rm -rf без вашего ведома Про нас: - Подняли 💸 $10m 💸, инвесторы — топы OpenAI, Anthropic, Deepmind, Mistral, HuggingFace, etc - Команда из 10 человек с офисом в самом центре Парижа - Обрабатываем десятки миллионов API запросов в месяц - 🍴 80-150к USD Вакансии: 1. FullStack Engineer Typescript, React, Nextjs, Nodejs, Tailwind, GraphQL, ClickHouse 2. AI Engineer MoE, multimodality (audio / images), Megatron, distributed training, Triton 3. AI Engineer Redteaming, agents, rlhf - если у вас нет опыта на mle, но есть опыт swe и построения всякого промптового - позиция для вас 📨 CV → https://forms.gle/XysjrjHgxiRicGsb6

  • 16 окт. 2025 г.3 1901329из gigadev_channel

    📆GigaChat Audio Day Nizhniy 🚀В начале октября ездили командой речевых технологий в Нижний Новгород с митапом. Поделились нашими разработками, познакомились с интересными ребятами и очень продуктивно провели время в столице закатов. ➡️Записи докладов уже доступны VK | YouTube 🔘Как мы сделали production ASR для новых языков на 10 часах данных (Андрей Кузьменко) 🔘Распознавание речи по спикерам в SaluteSpeech: от моделей и алгоритмов до production-оптимизаций (Никита Ноев и Михаил Кузьмин) 🔘Быстрые команды (Юлия Кокорина и Максим Сурков) 🔘GigaChat Audio: как мы добавили поддержку суммаризации видео длительностью 3 часа в мультимодальной LLM (Григорий Фёдоров) Смотрите, ставьте лайки, приходите на наши будущие мероприятия: следующее пройдёт в Москве уже в декабре — stay tuned.

  • 29 сент. 2025 г.15,6 тыс66151

    Vistral-24B-Instruct Vistral - это наша новая флагманская унимодальная LLM представляющая из себя улучшенную версию Mistral-Small-3.2-24B-Instruct-2506 командой VikhrModels, адаптированную преимущественно для русского и английского языков. Удалён визуальный энкодер, убрана мультимодальность. Сохранена стандартная архитектура MistralForCausalLM без изменений в базовой структуре модели. 🔗 Карточка модели: https://huggingface.co/Vikhrmodels/Vistral-24B-Instruct 🔗 GGUF: https://huggingface.co/Vikhrmodels/Vistral-24B-Instruct-GGUF ⚖️ Лицензия: apache-2.0 Сайт: https://vikhr.org Донаты: Здесь 👥 Авторы: @LakoMoorDev @nlpwanderer

  • видео или голосовое, без подписи

  • видео или голосовое, без подписи

Vikhr models — tgindex