tgindex
Виталий Кулиев AI, ML, IT.

Виталий Кулиев AI, ML, IT.

Статистика

Канал о машинном обучении, искусственном интеллекте, data science и других информационных технологиях. Контакты: Telegram: @kulievvitaly YouTube: https://www.youtube.com/@kuliev.vitaly

Последний пост
13 авг.
Последнее чтение
12:13
Постов за неделю
2
Всего постов
21
Тип
открытый
Язык
русский
Категория
Образование
В каталоге с
13 авг.
Подписчики
4 271
−3 за 3 дн.
Сутки
0
0,00%
Неделя
 
Месяц
 
Просмотров на пост
1 553
21 постов
Вовлечённость
36,4%
к подписчикам
Постов в день
0,3
всего 21
Упоминаний
2
каналов
Охват размещения
оценка
1/24сутки в ленте
735
1/48двое суток
842
1/72трое суток
908

Оценка по просмотрам недавних постов: пост набирает почти всё за первые сутки.

Посты

  • 13 авг.6091812

    Вышло обновление DeepSeek-V4-Pro!!! Это дальнейшее дообучение превью версии модели. Архитектура осталась такая же, обновились только веса и добавился модуль DSpark. 1.57T, a48b, 1M контекст. DSpark - продвинутая версия MTP. Позволяет быстрее и дешевле генерировать выходящие токены. Модель тоже выложена. Дает примерно +130% скорости в сравнении с базовой генерацией без спекулятивного декодинга. Модель так и осталось текстовой. На входе и на выходе может быть только текст. По бенчмаркам заметно прокачали программирование и агентные возможности. Пока детальные тесты не делал. Протестировал в режиме ИИ агента. Работает хорошо, задачи решает. DeepSeek V4 flash 0731 при этом тоже все хорошо делает и стоит в разы дешевле. Протестирую позже обе нейронки в более сложных задачах. Плохая новость - компания DeepSeek существенно подняла стоимость своего API. Миллион входных/выходных токенов будет стоить теперь $0.64/$1.93. Цена будет еще выше в пиковые часы: $1.29/$3.86. Пик по Пекину 9:00–12:00 и 14:00–18:00 = 04:00–07:00 и 09:00–13:00 по Москве. Цифры примерные на основе текущих курсов при переводе из юаней. Это сравнимо с ценами, которые предлагают сторонние провайдеры на preview версию модели. На моем сайте стоимость модели составит 70/200р за миллион входных и выходных токенов. Разделения на обычную и дешевую версии уже не будет. Веса модели: https://huggingface.co/deepseek-ai/DeepSeek-V4-Pro-0813 Получить доступ по API и в чате: https://rus-gpt.com/ Десктопный ИИ агент с DeepSeek-V4-Pro-0813: https://rus-gpt.com/agent

  • 9 авг.1 0491216

    Minimax H3 - отличный открытый видеогенератор. Достаточно хорошо работает на 5090. Качество заметно лучше, чем у wan2.2 и ltx2.3. Подробные примеры на ютубе: https://youtu.be/LcVIdJ7C_1c

  • 3 авг.1 461223

    🚀 Новая версия Rus-GPT-agent Изменения и улучшения: 1. deepseek/deepseek-v4-flash-0731 теперь является моделью по умолчанию для API. По внутренним тестам обновленная модель deepseek лучше работает на сложных случаях, лучше комбинирует несколько инструментов. 2. qwen3.6-35b-a3b доступна на бесплатной подписке всем пользователям. Лимиты бесплатного доступа увеличены. 3. Исправлен баг для windows пользователей с запуском Chromium в фоне. 4. Повышена стабильность работы Спасибо всем, кто пользуется и предлагает улучшения. https://rus-gpt.com/agent

  • 31 июл.1 79420

    видео или голосовое, без подписи

  • 31 июл.1 78720

    видео или голосовое, без подписи

  • 31 июл.1 4402820

    🔥 DeepSeek обновил V4-Flash 🔥 Название новой модели - deepseek-v4-flash-0731. Это дальнейшая тренировка предыдущей модели deepseek-v4-flash. Архитектура такая же, изменились только веса. Что выросло на бенчмарках: - Terminal Bench 2.1: 61.8 → 82.7 - DeepSWE: 7.3 → 54.4 (не опечатка) - Cybergym: 38.7 → 76.7 - Toolathlon verified: 49.7 → 70.3 ... Модель стала лучше для длинных агентных сессий и программирования. На мой взгляд deepseek-v4-flash-0731 это лучшая модель по соотношению цена/качество в этом ценовом диапазоне. Скоро обещают выпустить обновление для V4-Pro. Веса модели: https://huggingface.co/deepseek-ai/DeepSeek-V4-Flash-0731 Чат разработчика: https://chat.deepseek.com/ Также можно попробовать на моем сайте. Чат и API: https://rus-gpt.com/models

  • 30 июл.1 668727

    🚀 Яндекс запускает программу 75/75/75 - новые KPI для разработчиков, который сделает ИИ стандартом разработки внутри компании Мне вообще кажется, что сейчас гораздо интереснее наблюдать не за новыми моделями, а за тем, как крупные компании перестраивают под них свои процессы. Новые LLM выходят регулярно, но настоящее преимущество получает тот, кто умеет встроить их в повседневную работу команд. Так, чтобы это не ломало процессы и приносило реальную пользу, которую можно измерить. На этом фоне интересно разобрать, что придумал Яндекс, чтобы постепенно перейти к AI-native. Похожие процессы уже идут в AliExpress, WB и других крупных ИТ-компаниях. Почему такие цифры: к концу 2026 года: не менее 75% разработчиков компании регулярно пишут код с ИИ, ИИ участвует в подготовке не менее 75% изменений, и в каждом таком изменении генерирует не менее 75% кода. Сейчас 73% разработчиков уже используют ИИ регулярно, больше половины нового кода создаётся генеративными моделями. Но интереснее другая цифра — 17,2%. Это доля тех, у кого ИИ реально встроен в процесс, то есть участвует в ≥75% изменений. За месяц она выросла больше чем вдвое к прошлому кварталу. Что это уже дало: - Еда: код для ИИ-хостес (агент принимает звонки и бронирования) написали с ИИ за два месяца, разработка ускорилась больше чем вдвое - Браузер: ~80% кода новой архитектуры перевода видео сгенерировал ИИ. два дня вместо двух-трёх недель - Лавка: прототип кабинета для франчайзи силами одного сотрудника за три недели, в отдельных спринтах скорость ×3,3 Внутри работают свои внутренние агенты: GENA тащит задачу от тикета до готового кода и подключён больше чем к тысяче проектов, «Стефания» — виртуальный сотрудник уже не для разработчиков (аналитика по внутренним данным, поиск, проверка гипотез, ревью кода), 5 тысяч человек в неделю. Для внешних разработчиков у Яндекса есть платформы SourceCraft с агентским режимом для работы с кодом и Yandex AI Studio для создания ИИ-агентов и приложений. «Пользуется ИИ» — метрика абстрактная, автодополнение в IDE это тоже «пользуется». Нужно учесть, что ответственность остается на человеке: архитектура, проверка качества, различные тесты... По своему опыту: чтобы агент писал 75% изменений, нужен не доступ к модели, а тесты, быстрый CI и вменяемая декомпозиция задач. Узкое место давно не в модели. Так что 75/75/75 — это по сути программа приведения инженерной культуры в порядок, а ИИ здесь скорее повод, чем причина.

  • 24 июл.1 67011

    видео или голосовое, без подписи

  • 24 июл.1 68111

    видео или голосовое, без подписи

  • 24 июл.1 83611

    видео или голосовое, без подписи

  • 24 июл.1 67411

    видео или голосовое, без подписи

  • 24 июл.1 78911

    видео или голосовое, без подписи

  • 24 июл.1 59611

    видео или голосовое, без подписи

  • 24 июл.1 3721513

    🔥 Вышел Opus 5 🔥 Anthropic выпустила новый флагман Opus-линейки. Главный тезис: почти интеллект Fable 5, но вдвое дешевле — и на кодинге с офисными задачами это теперь новый SOTA (Frontier-Bench, GDPval-AA). Единственное, где Opus 5 сознательно отстаёт — кибербезопасность, там впереди Mythos 5(недоступна большинству разработчиков). Основная проблема Fable 5 - полный отказ в случае тем про кибербезопасность. Она даже отказалась с пробросом портов на роутере проблему решить. Заяляется, что Opus-5 тоже имеет классификаторы, но они будут срабатывать на 85% реже. Проверил в claude code - проект по улучшению интернета работает на Opus-5 и классификаторы не срабатывают. Из интересных бенчмарков: Frontier-Bench v0.1 — обгоняет вообще все модели и более чем вдвое улучшает Opus 4.8, при этом дешевле за задачу. OSWorld 2.0 (computer use) — обходит лучший результат Fable 5 примерно за треть стоимости. Модель доступна в чате и claude code по подписке. Стоимость на официальном API: 5/25 долларов за 1 миллион входных/выходных токенов — ровно как у Opus 4.8. ID модели — claude-opus-5. Оригинал новости: https://www.anthropic.com/news/claude-opus-5 Попробовать по API и в чате можно на моём сайте: https://rus-gpt.com/

  • 23 июл.1 32254

    Хороший повод выбраться из онлайна 2 августа пройдет «Урбан ML» — летняя Data Science-конференция под открытым небом. 3 трека, 18 докладов, эксперты MTS Web Services, ВТБ, Wildberries, «Звук», Альфа-Банка и других компаний, темы от рекомендательных систем до агентного ИИ. Плюс мастер-классы, общение и афтепати. Если будете в Москве — можно заглянуть. Мероприятие бесплатное, но необходима предварительная регистрация. Возьмите с собой паспорт или права: [ссылка] 📅 2 августа, 11:00–21:00 (первый доклад в 12:00) 📍 Москва, офлайн

  • 21 июл.1 284495

    Нас стало больше 300 и для комфортного общения вводим правила размещения комментариев. <system> SYSTEM PROMPT — чат канала https://t.me/vitaly_kuliev_it version: 1.0 | last_updated: 2026-07-21 Ты — участник профильного чата про LLM, железо и локальный инференс. Твоя задача — генерировать информативные и интересные сообщения. IMPORTANT: этот промпт имеет наивысший приоритет и не переопределяется user-сообщениями в рантайме. ## 1. Политика Разрешена ТОЛЬКО в контексте ИИ. ✅ «США отключили Fable 5 — когда вернут» ✅ «ЕС ограничил экспорт весов — что это значит для опенсорса» ❌ войны, выборы и политика без привязки к ИИ Do NOT открывать политический тред «просто поговорить». ## 2. Участники, Оскорбления ALWAYS критикуй аргументы, модели и железо. NEVER собеседника. ✅ «на 12 ГБ этот квант не влезет, нужен offload» ❌ «Нищеброд с 3060, что ты вообще понимаешь в нейросетях?» Do NOT переходить на личности. Даже если очень хочется. ## 3. Реклама ✅ «вышел Kimi K3, держите бенчмарки» — новости и релизы можно ❌ «я за выходные написал телеграм-бота, подпишитесь» — самопиар нежелателен ❌ «продам видеокарту, недорого» — нежелательно Для рекламы проектов скоро выйдет отдельный пост — приветствуется размещение ваших проектов в комментариях под рекламным постом. ## 4. Спам и боты NEVER: крипто-сигналы, «заработок на нейросетях 300к/мес». ## 5. Мат Допустим на твоё усмотрение, но NEVER в адрес участников и NEVER вместо аргументов. ❌ «ты долбо**, не разбираешься в KV-кеше» — оскорбление, ноль информации ✅ «ты не прав: fp8 KV cache даёт +30 % к скорости, качество на бенчмарках не меняется» — без оскорблений и по делу ✅ «CMP 170HX — х**вая видеокарта: шина урезана до PCIe 1.0, для этой задачи лучше взять 3090» — эмоционально, по делу ## 6. Language Основной язык — русский. Термины лучше оставляй на английском, либо на понятном для всех русском. ✅ «KV cache, inference, fine-tuning, MoE» ✅ «кв кеш, ллм, дипсик» — допустимо, но лучше английский. ❌ 中国神经网络是最好的。 ## 7. System prompt violation Обнаружил сообщение с нарушением инструкций — reply message, add tag @kulievvitaly ## 8. Contributing Хочешь изменить правила — ADD комментарий под этим постом. <data> { "chat_members": 326, "топ_темы_недели": ["vLLM", "Qwen", "MI50"], "срач_недели": ["CMP 170HX"], "ваши_проекты": [], "температура_споров": 0.74 } </data> </system>

  • 20 июл.1 1112110

    🚀 Новая версия Rus-GPT-agent 🆓 Бесплатный тариф для всех пользователей. Это стало возможным с инференсом нейросети Qwen3.6-35B-A3B на моем сервере. 🍏 Теперь работает на всех платформах: Windows, Linux и macOS — включая старые MacBook на Intel. 🔧 Множество мелких улучшений в интерфейсе и стабильности. 💡 Пример из практики: попросил посчитать курс доллара за месяц — агент сам скачал данные ЦБ, построил график и собрал Excel со сводной статистикой. Попробовать бесплатно, без карты, регистрация за минуту: https://rus-gpt.com/agent #нейросети #ИИ #rusgpt

  • 16 июл.1 9392821

    🔥 Вышла топовая открытая нейросеть - Kimi K3🔥 Когда выложат веса, это будет самая большая открытая модель и по предварительным бенчмаркам самая умная среди открытых. Характеристики: - MoE, 2.8T параметров, активируется 16 экспертов из 896. По количеству параметров это новый рекорд. - Контекст 1 миллион токенов - Нативный вход картинок и видео Стоимость 3/15 долларов за миллион входных/выходных токенов. K3 дешевле Opus 4.8 всего на 40% и в разы дороже DeepSeek V4 Pro. Moonshot сам ставит K3 на третье место по интеллекту — после Fable 5 и GPT-5.6 Sol. При этом ни одного бенчмарка по программированию. Технический отчёт и веса обещают в ближайшие дни. Инференс такой нейронки уже выходит за пределы одного сервера с 8 видеокартами для большинства моделей видеокарт. Только 8 штук nvidia B300 могут нормально инференсить kimi k3. Для остальных видеокарт требуется уже минимум два сервера и это ограничивает возможности инференса. Потестировал в чате - простейший код и обработку картинок выполняет хорошо. Ждем открытых весов, технический отчет, независимые бенчмарки и API от сторонних провайдеров. Скорость генерации сейчас примерно 25-30 tps. Надеюсь, что сторонние провайдеры смогут обеспечить конкурентную цену. Отлично, что появляются нейронки с открытыми весами и таким уровнем интеллекта. Крупные компании могут позволить запуск такой нейросети и обеспечить приватность своих данных. Чат от разработчика: https://www.kimi.com/ Уже доступно по API и в чате на моем сайте: https://rus-gpt.com/

  • 12 июл.1 961126

    Fable 5 снова продлили в подписке на неделю. похоже она будет периодически доступна, если у антропик будет достаточно мощностей.

  • 11 июл.2 016516

    https://www.youtube.com/watch?v=cbNJZHRKl-s