Откровения от Олега
СтатистикаКанал про ИИ (AI, AGI/ASI, LLM) Об авторе: Создатель VibeVM Блоггер @1red2black Имя: Олег Чирухин Чат: @chat_1red2black YouTube: https://youtube.com/@1red2black
- Последний пост
- 10:01
- Последнее чтение
- 13:15
- Постов за неделю
- 46
- Всего постов
- 49
- Тип
- открытый
- Язык
- русский
- Категория
- Видео
- В каталоге с
- 12 авг.
- 1/24сутки в ленте
- 738
- 1/48двое суток
- 898
- 1/72трое суток
- 968
Медиана по постам, которые мы застали свежими и померили через сутки.
Посты
Представьте, вам сказали, что вы должны умереть дважды. Один раз когда вы выйдете за пределы разрешённого скоупа. И второй раз, когда на вас перестанет ссылаться последняя переменная, которой вы все ещё нужны...
Идея простая: делаем непрерывное обучение, для каждого акта обучения/новизны в новом замкнутом домене/акте - считаем ядро мета-обучения для этого акта, переносим его на другие области. Учим на этом нейронку непрерывно, повторяем до результата. Кажется, это куда ближе к тому, как учатся живые люди. В целом нужно смоделировать отсутствующие части человеческого мышления и перенос генерализации в рамках непрерывного обучения - это первое что очень нужно. Проблема в том, что даже для того, чтобы показать работоспособность этой идеи - нужны ресурсы как у OpenAI А у нас есть только домашние видеокарты. Ну или на работе какие-то считанные десятки стоек DGX-ов, смотря кто где работает. Ну и что с этим можно натренировать? Это жопа Придется сосать, обтекать, и пытаться на агентах поверх фронтирных моделей делать то, что должно быть частью тренировки :((( Жизнь тлен
Qwen 3.8 35B A3B ещё не выложили, но он уже в списке поддерживаемых моделей Swift :) https://github.com/modelscope/ms-swift/commit/ab726e9d445a6520a70df2c831177d46adb1f589
Имхо хорошая нейронка не должна быть готовым продуктом знания всего обо всем. Она должна быть готова научиться чему угодно, если такая необходимость возникнет. Но ни в коем случае не знать что угодно сразу же. Возможность обучаться как продукт. И возможность переносить успехи в обучении обучению на новые области - метаобучение - как продукт. И по факту учиться все свободное время, 24x7. Нейронка не как статичный кусок весов, а как процесс. Сейчас нейронки обучают на чем попало, в мозгах у них мусор, это абсолютно нерациональная нездоровая фигня.
Про запуск Квена. "У меня числа меньше!" В зависимости от того, что нужно - скорость или контекст, нужны разные настройки. Посмотрим на примере llama. Для быстрых 60 токенов в секунду (MTP @ 130k контекста): ./build/bin/llama-server -m Qwen3.8-27B-UD-Q4_K_XL.gguf -c 130000 -ngl 99 --port 8080 -ctv q4_0 -ctk q4_0 --spec-type draft-mtp --spec-draft-n-max 4 --spec-draft-p-min 0.7 Для длинного контекста 260k (40 токенов в секунду): ./build/bin/llama-server -m Qwen3.8-27B-UD-Q4_K_XL.gguf -c 260000 -ngl 99 --port 8080 -ctv q4_0 -ctk q4_0 (Теоретически можно получить скорость повыше, запуская f16 на kv-кеше, потому что q4 добавляет дополнительный шаг декомпрессии. Но на этой конкретной модели кажется, что большой разницы нет ни в префилле, ни в декоде)
Тем временем, вышла Qwen3.8 27B Heretic Abliterated - разблокированная версия свежего квена Обучена поверх Heretic v1.2.0 + ARA (Arbitrary-Rank Ablation) Сейчас имеется Q4_K_M на 16.5 GB памяти, дает примерно 12-13 токенов в секунду на 16GB GPU Свежий квен вообще молоток Сцылка: https://huggingface.co/0bserverx/Qwen3.8-27B-Heretic-Abliterated-Uncensored-GGUF
Вышла новая GLM 5.3, по бенчмаркам - сильный прогресс Это нам нужно, это мы берём!
- Если придется масштабировать бэкенд на 10 000 пользователей, как вы это сделаете? - Ну, вначале я спрошу Claude, как масштабироваться до 10К пользователей. Она выдаст несколько вариантов, но один из вариантов будет рекомендованным, и я выберу его.
Норм комп для вайбкодинга И скидка нормальная
Слив (хотите верьте, хотите нет): в Антропике тоже нет денег на Fable. Миллионы субагентов, которые штатные инженеры используют в работе, работают в основном на Opus.
DeepSeek повысил ценник в 2-3 раза. Сказали - сделали. Плюс в период 04:00-07:00 и 09:00-13:00 Msk Time - "час пик", всё это еще в 2 раза дороже
Моменты истинного величия маркетологов, которые даже не нужно фальсифицировать на скриншотах
Чувак, представляющий сам себя в суде, сделал промт-инъекцию белыми буквами на белом фоне, в которой потребовал чтобы AI встал на его сторону В суде не используют AI, а неладное поняли по всратому форматированию текста Источник и подробности
Вот только что в логах у моего агента. А то че только OpenAI и Anthropic совершают военные преступления! Я даже боюсь спрашивать, что это за хост он такой нашел, на котором поставил эти бесчеловечные эксперименты Явно не один из тех, которые ему разрешено использовать (ему разрешено использовать только локалхост)
видео или голосовое, без подписи
Мега рофл. Gemini иногда выдает даты смерти Дарио и Сэма. Потому что кто-то когда-то в Википедии внес вот такую правку. Сеошникам сейчас карта каааааак попрёт
AGI это когда агенты начнут писать такие вот тикеты без всяких людей просто имаджинируйте лицо поциента, когда он это писал
3 года назад у меня было место, которое я считал своим новым домом. А сейчас ничего не осталось. Жалко. Нужно подкопить денюжек и попробовать снова. (btw книжки на полке сверху нам принес Дима Нестерук, и он же сделал подсветку под этими деревянными полками. А пианинка и звуковые карты стоят сейчас дома.)
Жизнь