LakoMoor
СтатистикаЧто-то на непонятном Для связи: @lvlinfinite Оущитпостинг: https://t.me/+fihOK0UNpSg3ZjIy
- Последний пост
- 13 авг.
- Последнее чтение
- 20:36
- Постов за неделю
- 2
- Всего постов
- 23
- Тип
- открытый
- Язык
- русский
- В каталоге с
- 12 авг.
- 1/24сутки в ленте
- 75
- 1/48двое суток
- 85
- 1/72трое суток
- 92
Оценка по просмотрам недавних постов: пост набирает почти всё за первые сутки.
Посты
видео или голосовое, без подписи
видео или голосовое, без подписи
Пересобрал через Codex популярный плагин Ears: Bass Boost, EQ Any Audio!, который был удален из магазина плагинов (и не работает в новых версиях браузеров на chromium) Поменял дизайн и немного логику. Выложил в опенсурс. https://github.com/LakoMoor/lakotone-eq-chrome
видео или голосовое, без подписи
Хмм... неужели скоро релиз?
Хмм... неужели скоро релиз?
видео или голосовое, без подписи
видео или голосовое, без подписи
Кто хочет, залетайте в мой щит постинг. Буду постить там всякую фигню https://t.me/+fihOK0UNpSg3ZjIy
Don't wanna know Don't need to know You got champagne problems Half-way and one step forward Past the points of no return Marilyn Manson
Шутки шутками, смех смехом, но все веселье заканчивается когда веса на скакалке попадаются. Это значит что у вас вся GPU ферма от OOM умрет послезавтра
Интересно, трейн на тесте ? Пишут что обходит опус (не верю) https://huggingface.co/collections/Qwen/qwen-agentworld
Смотрим все вместе ночью под пледиком, перед сном 👀 https://youtu.be/jbK80BswgBg?si=eOj0XrHQ7a39Bra4
Возьми телефооон детка
видео или голосовое, без подписи
Тут модель релизнулась. Нужно пробовать. https://huggingface.co/AlexWortega/SIQ-1-35B Демо
🌸Без Claude: подборка OSS агентных и кодинг-моделей 🌸 #nlp #про_nlp В последнее время буквально каждую неделю был большой OSS релиз, и все примерно на одну тему: разворачиваем кодинг и агентные модели без Anthropic/OpenAI. 🌸Cohere North mini 🔥 Хорошая модель с сильными способностями к кодингу, можно инференсить FP8 на одной H100, инференс оптимизирован. Пока что (на этой неделе) гордое звание европейской SOTA для моделей такого же размера. Qwen 3.6 лучше по основным метрикам, но экспортный контроль их не всем разрешает. MoE 30B-A3B, лицензия Apache 2.0 🟣https://cohere.com/blog/north-mini-code 🌸Poolside Laguna XS.2 Конкурент Cohere North mini, модель так же хороша на кодинг-бенчмарках. Разница в метриках в пределах погрешности. MoE 33B-A3B, Apache 2.0 🟣https://huggingface.co/poolside/Laguna-XS.2 🟣https://poolside.ai/blog/introducing-laguna-xs2-m1 🌸Семейство Gemma 4 Diffusion Gemma — Мультимодальная модель с дискретным диффузионным декодированием вместо авторегрессивного, что дает значительный прирост скорости инференса. MoE 26B-A4B, Apache 2.0. 🟣https://huggingface.co/google/diffusiongemma-26B-A4B-it 🟣https://blog.google/innovation-and-ai/technology/developers-tools/diffusion-gemma-faster-text-generation/ Gemma 4 — Основная модель семейства с сильными общими способностями, выходит в двух вариантах (MoE 26B-A4B и Dense 31B). Хороший баланс качества и размера — Dense 31B влезает на одну GPU. MoE 26B-A4B, Dense 31B 🟣https://huggingface.co/google/gemma-4-31B-it Function Gemma — версия для tool calling: структурированный вывод вызовов функций, парсинг аргументов, поддержка параллельных и вложенных вызовов. MoE 26B-A4B, Apache 2.0 🟣https://blog.google/innovation-and-ai/technology/developers-tools/functiongemma/ 🌸Qwen 3.6 Фокус на агентном кодинге: лучше работает с фронтендом, рассуждает на уровне репозитория, умеет сохранять thinking-контекст между сообщениями. MoE 35B-A3B и Dense 27B, мультимодальная (vision), Apache 2.0. 🟣https://huggingface.co/Qwen/Qwen3.6-35B-A3B 🌸Mellum 12B Самая маленькая модель из списка, заточенная под кодинг: code generation, editing, debugging, tool use и агентные сценарии. MoE 12B (2.5B активных), 128K контекст, есть Instruct и Thinking варианты, Apache 2.0 — можно крутить на одной потребительской GPU. 🟣https://huggingface.co/blog/JetBrains/mellum2-launch 🌸Kimi K 2.6 Флагман Moonshot AI: MoE ~1T (32B активных), 262K контекст. Ключевая фича — Agent Swarm: модель сама декомпозирует задачу на до 300 параллельных суб-агентов. SWE-bench Pro 58.6%, Terminal-Bench 66.7%. Modified MIT. 🟣https://huggingface.co/moonshotai/Kimi-K2.6 🌸DeepSeek 4 Pro Самая крупная OSS модель: MoE 1.6T (49B активных), контекст 1M токенов, MIT. Лидер на кодинг-бенчмарках (SWE-bench Verified 80.6%, LiveCodeBench 93.5%, Codeforces рейтинг 3206). Только текст. 🟣https://ollama.com/library/deepseek-v4-pro 🌸GLM 5 MoE 745B (44B активных), 202K контекст. Мультимодальная, хороша на кодинге и агентных задачах (AutoGLM). Лицензия MIT. 🟣https://z.ai/blog/glm-5 🌸Minimax M2.5 Упор на RL в сотнях тысяч реальных окружений — кодинг, поиск, tool calling, офисные задачи. SWE-bench Verified 80.2%, основной конкурент Qwen для кодинга. 🟣https://ollama.com/library/minimax-m2.5 🌸IBM Granite 4.1 Семейство enterprise-моделей для кодинга и RAG от IBM. Фокус на лицензионную чистоту данных и trustworthiness. Мне понравился техрепорт про стадии пре- и мидтренинга. Apache 2.0. 🟣https://huggingface.co/blog/ibm-granite/granite-4-1 🌸Mistral family Magistral — reasoning-модель, обучена чистым RL, мультиязычная, прозрачный chain-of-thought. Small 24B (open-source) и Medium (closed). Devstral — кодинг-модель для агентных задач, оптимизирована для Vibe CLI. Codestral — специализированная модель для code generation, 80+ языков. 🟣https://mistral.ai/news/mistral-small-4/ 🌸Community Finetunes: Файнтюны на Qwen3.6 и Gemma 4 с "uncensored" мышлением — для тех, кому нужна модель без ограничений на генерацию. 🟣Qwen 3.6 🟣Gemma 4
Получасовое выступление
QClaw-4B — это языковая модель, дообученная для агентных задач и работы с инструментами в рамках OpenClaw-совместимых фреймворков. Основана на Qwen3.5-4B. Несмотря на компактный размер, модель достигает результатов уровня значительно более крупных моделей…
Полетели все работать на антропик. Они нуждаются в работниках, которые будут фуррирп модель обучать