tgindex
Откровения от Олега

Откровения от Олега

Статистика

Канал про ИИ (AI, AGI/ASI, LLM) Об авторе: Создатель VibeVM Блоггер @1red2black Имя: Олег Чирухин Чат: @chat_1red2black YouTube: https://youtube.com/@1red2black

Последний пост
10:01
Последнее чтение
13:15
Постов за неделю
46
Всего постов
49
Тип
открытый
Язык
русский
Категория
Видео
В каталоге с
12 авг.
Подписчики
12 773
−6 за 3 дн.
Сутки
0
0,00%
Неделя
 
Месяц
 
Просмотров на пост
850
40 постов
Вовлечённость
6,7%
к подписчикам
Постов в день
6,6
всего 49
Упоминаний
8
каналов
Охват размещения
по 3 постам
1/24сутки в ленте
738
1/48двое суток
898
1/72трое суток
968

Медиана по постам, которые мы застали свежими и померили через сутки.

Посты

  • 10:0137893

    Представьте, вам сказали, что вы должны умереть дважды. Один раз когда вы выйдете за пределы разрешённого скоупа. И второй раз, когда на вас перестанет ссылаться последняя переменная, которой вы все ещё нужны...

  • 06:224974

    Идея простая: делаем непрерывное обучение, для каждого акта обучения/новизны в новом замкнутом домене/акте - считаем ядро мета-обучения для этого акта, переносим его на другие области. Учим на этом нейронку непрерывно, повторяем до результата. Кажется, это куда ближе к тому, как учатся живые люди. В целом нужно смоделировать отсутствующие части человеческого мышления и перенос генерализации в рамках непрерывного обучения - это первое что очень нужно. Проблема в том, что даже для того, чтобы показать работоспособность этой идеи - нужны ресурсы как у OpenAI А у нас есть только домашние видеокарты. Ну или на работе какие-то считанные десятки стоек DGX-ов, смотря кто где работает. Ну и что с этим можно натренировать? Это жопа Придется сосать, обтекать, и пытаться на агентах поверх фронтирных моделей делать то, что должно быть частью тренировки :((( Жизнь тлен

  • 04:525242

    Qwen 3.8 35B A3B ещё не выложили, но он уже в списке поддерживаемых моделей Swift :) https://github.com/modelscope/ms-swift/commit/ab726e9d445a6520a70df2c831177d46adb1f589

  • 18:43646123

    Имхо хорошая нейронка не должна быть готовым продуктом знания всего обо всем. Она должна быть готова научиться чему угодно, если такая необходимость возникнет. Но ни в коем случае не знать что угодно сразу же. Возможность обучаться как продукт. И возможность переносить успехи в обучении обучению на новые области - метаобучение - как продукт. И по факту учиться все свободное время, 24x7. Нейронка не как статичный кусок весов, а как процесс. Сейчас нейронки обучают на чем попало, в мозгах у них мусор, это абсолютно нерациональная нездоровая фигня.

  • Про запуск Квена. "У меня числа меньше!" В зависимости от того, что нужно - скорость или контекст, нужны разные настройки. Посмотрим на примере llama. Для быстрых 60 токенов в секунду (MTP @ 130k контекста): ./build/bin/llama-server -m Qwen3.8-27B-UD-Q4_K_XL.gguf -c 130000 -ngl 99 --port 8080 -ctv q4_0 -ctk q4_0 --spec-type draft-mtp --spec-draft-n-max 4 --spec-draft-p-min 0.7 Для длинного контекста 260k (40 токенов в секунду): ./build/bin/llama-server -m Qwen3.8-27B-UD-Q4_K_XL.gguf -c 260000 -ngl 99 --port 8080 -ctv q4_0 -ctk q4_0 (Теоретически можно получить скорость повыше, запуская f16 на kv-кеше, потому что q4 добавляет дополнительный шаг декомпрессии. Но на этой конкретной модели кажется, что большой разницы нет ни в префилле, ни в декоде)

  • 15 авг.7271329

    Тем временем, вышла Qwen3.8 27B Heretic Abliterated - разблокированная версия свежего квена Обучена поверх Heretic v1.2.0 + ARA (Arbitrary-Rank Ablation) Сейчас имеется Q4_K_M на 16.5 GB памяти, дает примерно 12-13 токенов в секунду на 16GB GPU Свежий квен вообще молоток Сцылка: https://huggingface.co/0bserverx/Qwen3.8-27B-Heretic-Abliterated-Uncensored-GGUF

  • Вышла новая GLM 5.3, по бенчмаркам - сильный прогресс Это нам нужно, это мы берём!

  • 14 авг.8393511

    - Если придется масштабировать бэкенд на 10 000 пользователей, как вы это сделаете? - Ну, вначале я спрошу Claude, как масштабироваться до 10К пользователей. Она выдаст несколько вариантов, но один из вариантов будет рекомендованным, и я выберу его.

  • Норм комп для вайбкодинга И скидка нормальная

  • Слив (хотите верьте, хотите нет): в Антропике тоже нет денег на Fable. Миллионы субагентов, которые штатные инженеры используют в работе, работают в основном на Opus.

  • DeepSeek повысил ценник в 2-3 раза. Сказали - сделали. Плюс в период 04:00-07:00 и 09:00-13:00 Msk Time - "час пик", всё это еще в 2 раза дороже

  • 14 авг.1 3983340

    Моменты истинного величия маркетологов, которые даже не нужно фальсифицировать на скриншотах

  • 14 авг.8562910

    Чувак, представляющий сам себя в суде, сделал промт-инъекцию белыми буквами на белом фоне, в которой потребовал чтобы AI встал на его сторону В суде не используют AI, а неладное поняли по всратому форматированию текста Источник и подробности

  • Вот только что в логах у моего агента. А то че только OpenAI и Anthropic совершают военные преступления! Я даже боюсь спрашивать, что это за хост он такой нашел, на котором поставил эти бесчеловечные эксперименты Явно не один из тех, которые ему разрешено использовать (ему разрешено использовать только локалхост)

  • видео или голосовое, без подписи

  • Мега рофл. Gemini иногда выдает даты смерти Дарио и Сэма. Потому что кто-то когда-то в Википедии внес вот такую правку. Сеошникам сейчас карта каааааак попрёт

  • AGI это когда агенты начнут писать такие вот тикеты без всяких людей просто имаджинируйте лицо поциента, когда он это писал

  • 3 года назад у меня было место, которое я считал своим новым домом. А сейчас ничего не осталось. Жалко. Нужно подкопить денюжек и попробовать снова. (btw книжки на полке сверху нам принес Дима Нестерук, и он же сделал подсветку под этими деревянными полками. А пианинка и звуковые карты стоят сейчас дома.)

  • 13 авг.9402320

    Жизнь