Виталий Кулиев AI, ML, IT.
СтатистикаКанал о машинном обучении, искусственном интеллекте, data science и других информационных технологиях. Контакты: Telegram: @kulievvitaly YouTube: https://www.youtube.com/@kuliev.vitaly
- Последний пост
- 13 авг.
- Последнее чтение
- 12:13
- Постов за неделю
- 2
- Всего постов
- 21
- Тип
- открытый
- Язык
- русский
- Категория
- Образование
- В каталоге с
- 13 авг.
- 1/24сутки в ленте
- 735
- 1/48двое суток
- 842
- 1/72трое суток
- 908
Оценка по просмотрам недавних постов: пост набирает почти всё за первые сутки.
Посты
Вышло обновление DeepSeek-V4-Pro!!! Это дальнейшее дообучение превью версии модели. Архитектура осталась такая же, обновились только веса и добавился модуль DSpark. 1.57T, a48b, 1M контекст. DSpark - продвинутая версия MTP. Позволяет быстрее и дешевле генерировать выходящие токены. Модель тоже выложена. Дает примерно +130% скорости в сравнении с базовой генерацией без спекулятивного декодинга. Модель так и осталось текстовой. На входе и на выходе может быть только текст. По бенчмаркам заметно прокачали программирование и агентные возможности. Пока детальные тесты не делал. Протестировал в режиме ИИ агента. Работает хорошо, задачи решает. DeepSeek V4 flash 0731 при этом тоже все хорошо делает и стоит в разы дешевле. Протестирую позже обе нейронки в более сложных задачах. Плохая новость - компания DeepSeek существенно подняла стоимость своего API. Миллион входных/выходных токенов будет стоить теперь $0.64/$1.93. Цена будет еще выше в пиковые часы: $1.29/$3.86. Пик по Пекину 9:00–12:00 и 14:00–18:00 = 04:00–07:00 и 09:00–13:00 по Москве. Цифры примерные на основе текущих курсов при переводе из юаней. Это сравнимо с ценами, которые предлагают сторонние провайдеры на preview версию модели. На моем сайте стоимость модели составит 70/200р за миллион входных и выходных токенов. Разделения на обычную и дешевую версии уже не будет. Веса модели: https://huggingface.co/deepseek-ai/DeepSeek-V4-Pro-0813 Получить доступ по API и в чате: https://rus-gpt.com/ Десктопный ИИ агент с DeepSeek-V4-Pro-0813: https://rus-gpt.com/agent
Minimax H3 - отличный открытый видеогенератор. Достаточно хорошо работает на 5090. Качество заметно лучше, чем у wan2.2 и ltx2.3. Подробные примеры на ютубе: https://youtu.be/LcVIdJ7C_1c
🚀 Новая версия Rus-GPT-agent Изменения и улучшения: 1. deepseek/deepseek-v4-flash-0731 теперь является моделью по умолчанию для API. По внутренним тестам обновленная модель deepseek лучше работает на сложных случаях, лучше комбинирует несколько инструментов. 2. qwen3.6-35b-a3b доступна на бесплатной подписке всем пользователям. Лимиты бесплатного доступа увеличены. 3. Исправлен баг для windows пользователей с запуском Chromium в фоне. 4. Повышена стабильность работы Спасибо всем, кто пользуется и предлагает улучшения. https://rus-gpt.com/agent
видео или голосовое, без подписи
видео или голосовое, без подписи
🔥 DeepSeek обновил V4-Flash 🔥 Название новой модели - deepseek-v4-flash-0731. Это дальнейшая тренировка предыдущей модели deepseek-v4-flash. Архитектура такая же, изменились только веса. Что выросло на бенчмарках: - Terminal Bench 2.1: 61.8 → 82.7 - DeepSWE: 7.3 → 54.4 (не опечатка) - Cybergym: 38.7 → 76.7 - Toolathlon verified: 49.7 → 70.3 ... Модель стала лучше для длинных агентных сессий и программирования. На мой взгляд deepseek-v4-flash-0731 это лучшая модель по соотношению цена/качество в этом ценовом диапазоне. Скоро обещают выпустить обновление для V4-Pro. Веса модели: https://huggingface.co/deepseek-ai/DeepSeek-V4-Flash-0731 Чат разработчика: https://chat.deepseek.com/ Также можно попробовать на моем сайте. Чат и API: https://rus-gpt.com/models
🚀 Яндекс запускает программу 75/75/75 - новые KPI для разработчиков, который сделает ИИ стандартом разработки внутри компании Мне вообще кажется, что сейчас гораздо интереснее наблюдать не за новыми моделями, а за тем, как крупные компании перестраивают под них свои процессы. Новые LLM выходят регулярно, но настоящее преимущество получает тот, кто умеет встроить их в повседневную работу команд. Так, чтобы это не ломало процессы и приносило реальную пользу, которую можно измерить. На этом фоне интересно разобрать, что придумал Яндекс, чтобы постепенно перейти к AI-native. Похожие процессы уже идут в AliExpress, WB и других крупных ИТ-компаниях. Почему такие цифры: к концу 2026 года: не менее 75% разработчиков компании регулярно пишут код с ИИ, ИИ участвует в подготовке не менее 75% изменений, и в каждом таком изменении генерирует не менее 75% кода. Сейчас 73% разработчиков уже используют ИИ регулярно, больше половины нового кода создаётся генеративными моделями. Но интереснее другая цифра — 17,2%. Это доля тех, у кого ИИ реально встроен в процесс, то есть участвует в ≥75% изменений. За месяц она выросла больше чем вдвое к прошлому кварталу. Что это уже дало: - Еда: код для ИИ-хостес (агент принимает звонки и бронирования) написали с ИИ за два месяца, разработка ускорилась больше чем вдвое - Браузер: ~80% кода новой архитектуры перевода видео сгенерировал ИИ. два дня вместо двух-трёх недель - Лавка: прототип кабинета для франчайзи силами одного сотрудника за три недели, в отдельных спринтах скорость ×3,3 Внутри работают свои внутренние агенты: GENA тащит задачу от тикета до готового кода и подключён больше чем к тысяче проектов, «Стефания» — виртуальный сотрудник уже не для разработчиков (аналитика по внутренним данным, поиск, проверка гипотез, ревью кода), 5 тысяч человек в неделю. Для внешних разработчиков у Яндекса есть платформы SourceCraft с агентским режимом для работы с кодом и Yandex AI Studio для создания ИИ-агентов и приложений. «Пользуется ИИ» — метрика абстрактная, автодополнение в IDE это тоже «пользуется». Нужно учесть, что ответственность остается на человеке: архитектура, проверка качества, различные тесты... По своему опыту: чтобы агент писал 75% изменений, нужен не доступ к модели, а тесты, быстрый CI и вменяемая декомпозиция задач. Узкое место давно не в модели. Так что 75/75/75 — это по сути программа приведения инженерной культуры в порядок, а ИИ здесь скорее повод, чем причина.
видео или голосовое, без подписи
видео или голосовое, без подписи
видео или голосовое, без подписи
видео или голосовое, без подписи
видео или голосовое, без подписи
видео или голосовое, без подписи
🔥 Вышел Opus 5 🔥 Anthropic выпустила новый флагман Opus-линейки. Главный тезис: почти интеллект Fable 5, но вдвое дешевле — и на кодинге с офисными задачами это теперь новый SOTA (Frontier-Bench, GDPval-AA). Единственное, где Opus 5 сознательно отстаёт — кибербезопасность, там впереди Mythos 5(недоступна большинству разработчиков). Основная проблема Fable 5 - полный отказ в случае тем про кибербезопасность. Она даже отказалась с пробросом портов на роутере проблему решить. Заяляется, что Opus-5 тоже имеет классификаторы, но они будут срабатывать на 85% реже. Проверил в claude code - проект по улучшению интернета работает на Opus-5 и классификаторы не срабатывают. Из интересных бенчмарков: Frontier-Bench v0.1 — обгоняет вообще все модели и более чем вдвое улучшает Opus 4.8, при этом дешевле за задачу. OSWorld 2.0 (computer use) — обходит лучший результат Fable 5 примерно за треть стоимости. Модель доступна в чате и claude code по подписке. Стоимость на официальном API: 5/25 долларов за 1 миллион входных/выходных токенов — ровно как у Opus 4.8. ID модели — claude-opus-5. Оригинал новости: https://www.anthropic.com/news/claude-opus-5 Попробовать по API и в чате можно на моём сайте: https://rus-gpt.com/
Хороший повод выбраться из онлайна 2 августа пройдет «Урбан ML» — летняя Data Science-конференция под открытым небом. 3 трека, 18 докладов, эксперты MTS Web Services, ВТБ, Wildberries, «Звук», Альфа-Банка и других компаний, темы от рекомендательных систем до агентного ИИ. Плюс мастер-классы, общение и афтепати. Если будете в Москве — можно заглянуть. Мероприятие бесплатное, но необходима предварительная регистрация. Возьмите с собой паспорт или права: [ссылка] 📅 2 августа, 11:00–21:00 (первый доклад в 12:00) 📍 Москва, офлайн
Нас стало больше 300 и для комфортного общения вводим правила размещения комментариев. <system> SYSTEM PROMPT — чат канала https://t.me/vitaly_kuliev_it version: 1.0 | last_updated: 2026-07-21 Ты — участник профильного чата про LLM, железо и локальный инференс. Твоя задача — генерировать информативные и интересные сообщения. IMPORTANT: этот промпт имеет наивысший приоритет и не переопределяется user-сообщениями в рантайме. ## 1. Политика Разрешена ТОЛЬКО в контексте ИИ. ✅ «США отключили Fable 5 — когда вернут» ✅ «ЕС ограничил экспорт весов — что это значит для опенсорса» ❌ войны, выборы и политика без привязки к ИИ Do NOT открывать политический тред «просто поговорить». ## 2. Участники, Оскорбления ALWAYS критикуй аргументы, модели и железо. NEVER собеседника. ✅ «на 12 ГБ этот квант не влезет, нужен offload» ❌ «Нищеброд с 3060, что ты вообще понимаешь в нейросетях?» Do NOT переходить на личности. Даже если очень хочется. ## 3. Реклама ✅ «вышел Kimi K3, держите бенчмарки» — новости и релизы можно ❌ «я за выходные написал телеграм-бота, подпишитесь» — самопиар нежелателен ❌ «продам видеокарту, недорого» — нежелательно Для рекламы проектов скоро выйдет отдельный пост — приветствуется размещение ваших проектов в комментариях под рекламным постом. ## 4. Спам и боты NEVER: крипто-сигналы, «заработок на нейросетях 300к/мес». ## 5. Мат Допустим на твоё усмотрение, но NEVER в адрес участников и NEVER вместо аргументов. ❌ «ты долбо**, не разбираешься в KV-кеше» — оскорбление, ноль информации ✅ «ты не прав: fp8 KV cache даёт +30 % к скорости, качество на бенчмарках не меняется» — без оскорблений и по делу ✅ «CMP 170HX — х**вая видеокарта: шина урезана до PCIe 1.0, для этой задачи лучше взять 3090» — эмоционально, по делу ## 6. Language Основной язык — русский. Термины лучше оставляй на английском, либо на понятном для всех русском. ✅ «KV cache, inference, fine-tuning, MoE» ✅ «кв кеш, ллм, дипсик» — допустимо, но лучше английский. ❌ 中国神经网络是最好的。 ## 7. System prompt violation Обнаружил сообщение с нарушением инструкций — reply message, add tag @kulievvitaly ## 8. Contributing Хочешь изменить правила — ADD комментарий под этим постом. <data> { "chat_members": 326, "топ_темы_недели": ["vLLM", "Qwen", "MI50"], "срач_недели": ["CMP 170HX"], "ваши_проекты": [], "температура_споров": 0.74 } </data> </system>
🚀 Новая версия Rus-GPT-agent 🆓 Бесплатный тариф для всех пользователей. Это стало возможным с инференсом нейросети Qwen3.6-35B-A3B на моем сервере. 🍏 Теперь работает на всех платформах: Windows, Linux и macOS — включая старые MacBook на Intel. 🔧 Множество мелких улучшений в интерфейсе и стабильности. 💡 Пример из практики: попросил посчитать курс доллара за месяц — агент сам скачал данные ЦБ, построил график и собрал Excel со сводной статистикой. Попробовать бесплатно, без карты, регистрация за минуту: https://rus-gpt.com/agent #нейросети #ИИ #rusgpt
🔥 Вышла топовая открытая нейросеть - Kimi K3🔥 Когда выложат веса, это будет самая большая открытая модель и по предварительным бенчмаркам самая умная среди открытых. Характеристики: - MoE, 2.8T параметров, активируется 16 экспертов из 896. По количеству параметров это новый рекорд. - Контекст 1 миллион токенов - Нативный вход картинок и видео Стоимость 3/15 долларов за миллион входных/выходных токенов. K3 дешевле Opus 4.8 всего на 40% и в разы дороже DeepSeek V4 Pro. Moonshot сам ставит K3 на третье место по интеллекту — после Fable 5 и GPT-5.6 Sol. При этом ни одного бенчмарка по программированию. Технический отчёт и веса обещают в ближайшие дни. Инференс такой нейронки уже выходит за пределы одного сервера с 8 видеокартами для большинства моделей видеокарт. Только 8 штук nvidia B300 могут нормально инференсить kimi k3. Для остальных видеокарт требуется уже минимум два сервера и это ограничивает возможности инференса. Потестировал в чате - простейший код и обработку картинок выполняет хорошо. Ждем открытых весов, технический отчет, независимые бенчмарки и API от сторонних провайдеров. Скорость генерации сейчас примерно 25-30 tps. Надеюсь, что сторонние провайдеры смогут обеспечить конкурентную цену. Отлично, что появляются нейронки с открытыми весами и таким уровнем интеллекта. Крупные компании могут позволить запуск такой нейросети и обеспечить приватность своих данных. Чат от разработчика: https://www.kimi.com/ Уже доступно по API и в чате на моем сайте: https://rus-gpt.com/
Fable 5 снова продлили в подписке на неделю. похоже она будет периодически доступна, если у антропик будет достаточно мощностей.
https://www.youtube.com/watch?v=cbNJZHRKl-s