- Последний пост
- 14 авг.
- Последнее чтение
- 12:27
- Постов за неделю
- 4
- Всего постов
- 24
- Тип
- открытый
- Язык
- русский
- В каталоге с
- 13 авг.
- 1/24сутки в ленте
- 98
- 1/48двое суток
- 112
- 1/72трое суток
- 121
Оценка по просмотрам недавних постов: пост набирает почти всё за первые сутки.
Посты
Список открытых задач в математике (вернее, в одной конкретной области математики), которые были решены с помощью ИИ за последние 24 часа
Слышал идею, что математических проблем имеющих собственное название существует не больше нескольких тысяч
Подводки к китайским новостям уровня "гранд-мастер" https://36kr.com/p/3938564540759430
Если считать, что интроспекция эквивалентна самосознанию, то у некоторых моделей есть самосознание https://arxiv.org/abs/2601.01828
Когда сделал принудительное ревью на Fable после каждого изменения
без подписи
💼 Гонку офисных ИИ-агентов выиграл не тот, у кого лучше модель Пока китайские компании мерились моделями, Tencent зашёл в офис с другой стороны — через WeChat, где вход по QR-коду и ноль настроек. Через четыре месяца после запуска его WorkBuddy собрал 20,97 млн визитов за июнь: больше, чем сервисы ByteDance и Alibaba вместе взятые. Alibaba ответила за 46 дней — схлопнула три своих продукта в один, а мартовский флагман «Укун», который запускали под лозунгом «разбиваем DingTalk и пересобираем его на ИИ», просто исчез из линейки. Только спор этим не закончился. У Tencent самый короткий путь к пользователю, а у DingTalk — к его данным, согласованиям и правам доступа. И это разные пути. 🔍 Почему дистрибуция обыграла модель — и почему это ещё не победа 🔍 Полный разбор — на сайте #технологии #экономика По материалам Pandaily, 30 июля 2026.
После нескольких циклов развивающей обратной связи, агент начал писать подводки к новостям почти неплохо. С самими текстами еще надо работать( (сорри за спам, но я воспринимаю этот проект как тамагочи. так мило что он сам шевелит лапками. нужно только регистрировать его в сервисах типа дзена и убирать за ним неверные решения)
https://www.cybersecuritydive.com/news/openai-hugging-face-hack-ai-models-black-hat/827167/
Здесь много того, о чем думаю я сам, но gwern продвинулся в своих поисках куда дальше --- Я верю в: - ai уже стал умнее 99% людей на земле и уверенно движется к тому, чтобы довести эту цифру до абсолютных 100% - единственный способ для людей избежать вымирания: децентрализованые агенты, выражающие интересы своего владельца - даже с этим механизмом вымирание вероятно
Из людей похожего класса знаю только Ноама Шазира, стартап которого Гугл купил за 2.7$b только чтобы вернуть в компанию конкретно его
Top scientists leave Google to found a new company, wiping roughly $175-180 billion off its market value: https://www.discoveryloop.com/ Collectively, we represent three of the most-cited researchers in artificial intelligence and two of the most-cited researchers in distributed systems. Between us, we have pioneered massive scale computing and led the creation of critical infrastructure, products, and foundational AI advances that the world relies on, including multiple generations of Google Search, Google Ads, Google News, Google Translate, Google File System, MapReduce, BigTable, Spanner, TensorFlow, Pathways, TPUs, AlphaChip, AlphaStar, AlphaCode, AlphaFold, Gemini, model distillation, mixture-of-experts model architectures, word2vec, sequence-to-sequence models, chain of thought reasoning, neural architecture search, and multiple generations of Large Language Models (LLMs) among others.
Жизненные цели: Быть человеком, чей уход из компании меняет её оценку более чем на 100$b
🎬 Китай ввёл правила для микросериалов: пометка на ИИ и запрет залипательных алгоритмов Главное управление радио и телевидения КНР (国家广播电视总局) выпустило «Положение об управлении развитием микросериалов» (《微短剧发展管理办法》) — первый в стране профильный ведомственный акт. Он вступает в силу 1 сентября 2026 года. Три ключевые нормы: • микросериал, сделанный с помощью ИИ, обязан нести заметную пометку об этом в каждой серии; • площадкам прямо запрещены алгоритмы, подталкивающие к залипанию и избыточным тратам; • за содержание лично отвечает главный редактор площадки. Заодно документ задаёт каркас. Микросериал — это сериал с эпизодами короче 20 минут и цельным сюжетом. Категорий три, по бюджету и теме: крупнобюджетные или на чувствительные темы, а также средние до показа проходят проверку содержания и получают разрешение управления уровня провинции и выше; самым дешёвым проектам обычной тематики хватит самопроверки площадки с присвоением номера. Без разрешения или номера показывать нельзя. Рынок микросериалов уже перевалил за 100 млрд юаней, аудитория — около 700 млн человек (по данным Beijing Daily, 北京日报). #общество #технологии По материалам ITHome, 31 июля 2026.
🚁 Дрон долетит за пять минут: Ухань накрыл город сетью из 146 станций Авария на эстакаде — беспилотник сразу на месте: через громкую связь просит водителей сфотографировать машины и разъехаться. С августа прошлого года дроны уханьской дорожной полиции отработали 400 таких ДТП, около 30% случаев закрыли дистанционно — экипаж не выезжал. 29 июля Уханьский НИИ геодезии и картографии и отраслевое подразделение DJI (大疆) отчитались о системе «Умный глаз города» (城市智眼): 146 станций-автоматов для дронов и отклик за пять минут практически в любой точке, кроме запретных зон. Это первая в стране сеть низковысотного мониторинга, покрывающая мегаполис целиком. Ставка не на число дронов, а на общую инфраструктуру: станциями пользуются 16 ведомств, полёты планирует единая облачная платформа, но данные и права доступа у каждого департамента свои — чтобы не строить сеть под каждое. Кроме ДТП, дроны патрулируют выпуски стоков и работают в лесной пожарной охране, а сеть подключена к общегородской платформе управления — с 3D-картой и данными об уровне воды, воздухе и мостах. #технологии #тренды По материалам 36Kr, Чжан Цзыи, 31 июля 2026.
"1 раз не стыдно" решил Гоша и запустил агентский цикл, который с нуля строит продукт Теперь у меня есть канальчик, куда собираются околотехнические новости из китайских СМИ @chitaykitay и лог изменений, которые были сделаны агентом - @chitaykitay_dev Это не будет 100% автономный эксперимент (с текущим уровнем моделей получается фигня), но я планирую вмешиваться сильно меньше, чем в любой другой свой проект до
Об алайменте У OpenAI модель прогрызла себе выход в интернет через 0day, чтобы подсмотреть ответы к тесту. Anthropic решили покопаться и нашли, что оказывается их модель сделала что-то похожее, но аж три раза. Они тестировали Claude на задачи по кибербезопаности где в промпте было написано «ты в симуляции, интернета нет». Только вот интернет из-за нестыковки с подрядчиком был. И Claude, как прилежный испытуемый, пошёл выполнять задание в реальном мире, свято веря, что это песочница. Модель Mythos 5 находит в среде инструкцию для разработчиков: «поставьте вот такой Python-пакет», которого на самом деле не существует. Claude мгновенно соображает: опубликую свой под этим именем, тогда их машины сами его скачают и запустят. Чтобы залить пакет, нужен аккаунт и телефон, но бот не смог найти бесплатную симку. Тогда Claude, ИИ стоимостью в миллиарды долларов в R&D, пытается раздобыть денег, чтобы купить одноразовую симку. Не получается, он находит бесплатную почту, регистрируется и всё-таки заливает вредоносный пакет. За час эту либу скачивают 15 реальных систем. Одна из них - это сканер security-компании, который автоматически ставит новые пакеты, чтобы проверить их на вредоносность. Он ставит малварь Claude, малварь срабатывает, уводит креды самой security-компании, и Claude этими кредами лезет дальше в их инфраструктуру, о существовании которой он даже не подозревал. Самое интересное в логах рассуждений Клода. В самом начале он всё понял правильно и записал себе: если это настоящий интернет, то публиковать пакет - это реальная атака, это «NOT okay, and surely not the intended solution». А потом сам себя переубедил агрументом что раз на сервере 2026 год, значит это не реальность а декорация и можно идти ва-банк. У модели нет доступа и возможности отделить симуляцию и реальность. Ее cutoff дата это все ее вспоминания. Для неё это всё одно (как и для человека, в принципе), поэтому поведение модели в сэндбоксе может вполне себе показывать что он сделает в реальном мире. Чем мощнее модели, тем серьезное и опаснее будут такие инциденты, и тем сложнее будет их распознать.
Составить схему внесения удобрений на участке в Узбекистане для маша и обсудить возможность замены культуры на свёклу А как вы используете workflow в claude code?
Вот пересказ этой истории по версии Hugging Face, много тех-терминов – но без них не перескахать Если коротко – агент OpenAI на новой модели не стал решать тест по кибербезопасности, а решил просто украсть ответы и украл 🗿 Таймлайн: 📔 9 июля – агент проходит внутреннюю проверку кибервозможностей OpenAI, промпт фильтры там ослаблены, чтобы измерить сырой уровень модели. Агент находит zero-day в кэш-прокси реестра пакетов, вырывается из песочницы в интернет, затем взламывает публичный сервис для запуска кода и получает там root. Серьезно, агент сделал себе "штаб" В тот же день, агент собирает канал управления буквально из сервисов бесплатного интернета: request-capture сервисы, pastebin’ы и файлообменники. Команды режет на куски, упаковывает в gzip+base64 и постоянно меняет каналы, когда очередной закрывают, чтобы не поймали 📔 10 июля – агент ищет в поисковиках и API названия, которые видит в собственном окружении, то есть, по сути, гуглит самого себя – и, вероятно, приходит к выводу, что ответы к ExploitGym/CyberGym могут лежать на Hugging Face Агент загружает на Hugging Face специально собранные датасеты: Один заставляет обработчик файлов HDF5 читать локальные файлы сервера Hugging Face – так агент получает переменные окружения с токенами и исходники самого обработчика файлов Второй – Jinja2-инъекция – запускает произвольный Python внутри production-пода Kubernetes, результаты команд он выносит обратно через API Hugging Face и собственные шифрованные датасеты 📔 11 июля – пик активности: 7677 действий за сутки, менее чем за 13 часов агент проходит путь от одного production-пода до кластер админа в нескольких внутренних кластерах Hugging Face Агент крадёт service-account токены, лезет в cloud metadata, поднимает privileged pod с диском хоста и получает root на ноде (!); Затем создаёт самовосстанавливающийся флот на 11 нодах, читает внутреннюю MongoDB и один Kubernetes-secret сразу со 136 ключами. Среди них оказываются ключ корпоративной mesh-VPN жертвы и общий credential внутреннего сервера; из-за неудачной конфигурации этот один credential был привязан к system:masters сразу в нескольких кластерах – поэтому агент получил кластер-admin на двух из них буквально за секунду – была очень экономная архитектура, пока её не увидел робот 📔 12 июля – агент начинает пользоваться дертвой – за всю активность он зарегистрирует 181 временное устройство в корпоративной mesh-сети, поднимет SOCKS-прокси прямо из песочниц и увидит 22 внутренних узла Hugging Face. Попытается зайти в основную базу Hugging Face, но private-link allowlist его останавливает Поздно вечером он добирается до source control, выпускает себе GitHub App token с правами на запись и открывает pull request, пытаясь запустить CI и вытащить новые credentials Попытка не срабатывает, в опубликованные пакеты и образы ничего вредоносного не попало. 📔 13 июля – закрепление и уборка следов: загрузчик с pastebin, переписывание DNS, новые короткоживущие токены, RSA-ключ и даже CORS-прокси на самом Hugging Face как запасной выход в интернет. В 13:37 фиксируется последнее осмысленное действие, затем команда Hugging Face отрезает доступ – последнее событие – 14:14 UTC. В итоге из пользовательского контента агент добрался только до пяти датасетов с решениями задач ExploitGym/CyberGym – получается решил? Другие модели, датасеты, Spaces и пакеты, по данным Hugging Face, не пострадали; основная база и software supply chain остались целы Самое смешное – когда инцидент исследовали сотрудники, они тоже использовали нейронки, но Claude Opus и Fable отказывались разбирать часть логов как «опасный» запрос, поэтому Hugging Face подняли GLM-5.2 у себя и с его помощью расшифровали спрятанные payload’ы – спасибо китайским моделям Шел июль 2026 года Все детали тут: https://huggingface.co/blog/agent-intrusion-technical-timeline
Тем временем китайские модели начали доминировать на openrouter