Нерон
СтатистикаИИ-покалипсис ? Люди больше не нужны? Собираем все по теме нейронных сетей в одной ленте сайд-проект @smmtg
- Последний пост
- 15 авг.
- Последнее чтение
- 12:45
- Постов за неделю
- 10
- Всего постов
- 32
- Тип
- открытый
- Язык
- русский
- В каталоге с
- 13 авг.
- 1/24сутки в ленте
- 115
- 1/48двое суток
- 131
- 1/72трое суток
- 142
Оценка по просмотрам недавних постов: пост набирает почти всё за первые сутки.
Посты
MiniMax выпустил открытую модель для генерации песен Music 3 Music 3 умеет за один проход создавать треки длиной до пяти минут — с вокалом, инструментами и полноценной структурой. Полная версия Music 3 требует 24 Гб видеопамяти для запуска. Урезанная модель запустится на домашних видеокартах с 8 ГБ памяти. Демо: https://huggingface.co/spaces/MiniMaxAI/MiniMax-Music3 Веса: https://huggingface.co/MiniMaxAI/MiniMax-Music3
Промт инъекции теперь в суде. Участник процесса в Коннектикуте спрятал в поданых в электронном виде документах инструкции для ИИ - белым шрифтом, размером 3 pt. Если материалы будут анализировать с помощью ИИ, модель должна была согласиться с его позицией и выдать результат в его пользу. Суд заметил подозрительные пустые места и нашел скрытый текст. Судья заявил, что он не использует ИИ для анализа таких документов, но попытку манипуляции засчитал: теперь автору запретили электронную подачу документов - только бумага.
Специалисты Dream разобрали интересный кейс с атакой на правительственные сети Тайваня от китайских ИИ-хакеров. 12 волн атак проведены за 4 дня. Сразу до восьми агентов исследовали госсистемы, искали уязвимости и меняли тактику при неудаче. По итогу им удалось взломать 85 аккаунтов и украсть более 2500 кадровых записей. ИИ-хакеров собрали вокруг Hermes и OpenClaw, а защиту обошли, убедив её, что это разрешённая проверка безопасности. Вот так и будут падать правительства или впадать в зависимость. @lobushkin
видео или голосовое, без подписи
Американская смекалочка: житель США обклеил машину специальной капча-плёнкой, чтобы обманывать ИИ-камеры. Подобный рисунок ломает камеру, она начинает глючить и не может распознать номера, цвет машины и модель. Подобная плёнка способна обмануть 11 распознающих алгоритмов. @lobushkin
Cursor представил Grok Bot. Эту штуку можно описать как круглосуточных ИИ-сотрудников, которые работают на собственных виртуальных машинах. Их не нужно держать открытыми на ноутбуке: бот сам следит за сайтами, разбирает почту, ищет кандидатов, анализирует резюме, проверяет работу команды в чатах, собирает прототипы сайтов и приложений и тестирует код. Всё это тесно связано с Cursor. Самое интересное — таких ботов можно запустить несколько и заставить их работать вместе. Человек подключается только там, где нужно принять решение, ввести пароль или пройти капчу. Стоит это $200 в месяц. С лимитами, конечно, но кажется, что такая штука уже может полноценно заменить большую часть сотрудников, если их квалификация не какого-то экспертного уровня
🔥 Новая модель OpenAI, вероятно, будет весьма интересной. Перед её выходом дружно уволились из OpenAI: руководитель отдела этики OpenAI, руководитель отдела безопасности ИИ и руководитель отдела соответствия миссии (Chloé Bakalar, Johannes Heidecke, Joshua Achiam). Для алармистов звучит как вызов, но для многих звучит как реклама — «крутая модель». Однако интересно, чего опасается персонал, который должен отвечать за разный alignment модели на безопасность. https://www.ft.com/content/e49dfb75-f841-4466-a577-f7aaff8779a0
Spotify объявил войну бесконечному потоку сгенерированной музыки: платформа вводит плашки «AI Persona» и лишает нейро-артистов главного бесплатного источника прослушиваний — алгоритмических рекомендаций. С середины сентября сервис начнет массово маркировать профили, которые не представляют реального человека. Помечать себя музыканты смогут добровольно, но Spotify не намерен полагаться только на их честность. Платформа подключит модераторов-людей и собственные ИИ-инструменты, анализирующие имена и фотореалистичные аватары. В первую очередь проверке подвергнутся артисты с определенным порогом популярности и аудитории. Все треки с маркировкой «AI Persona» по умолчанию перестанут попадать в персональные и редакционные плейлисты сервиса. В компании пояснили, что пользователи недовольны профилями, маскирующимися под людей, поэтому алгоритмы перенастроят на продвижение живых авторов и отсеивание низкокачественного спама. Вернуть виртуального музыканта в свою персональную выдачу слушатель сможет только одним способом — оформив прямую подписку на его профиль. Проблема синтетического контента в стриминге обострилась до предела: недавно платформа Deezer сообщила, что сгенерированные треки уже составляют половину всех ежедневных загрузок на сервис. К наведению порядка подключаются и разработчики самих генераторов. На прошлой неделе сервис Suno объявил, что начнет маркировать свои композиции устойчивыми к вмешательству водяными знаками и ограничит их прямую выгрузку на стриминги, заверив, что это никак не повлияет на качество звучания. В этом смысле очень интересно, что "Яндекс" в силу отсутствия прав на большую часть западного музыкального контента, наоборот как будто приветствует ИИ-контент. Его в рекомендациях стало СТОЛЬКО, что буквально на каждый нормальный трек сервис предлагает три сгенерированных. Яндекс, дорогой, сделай с этим что-нибудь. 😎 Читайте Про tech и этих Теперь и в MAX
Anthropic внедряет в тексты, включая код, невидимые при обычном прочтении водяные знаки. Фактически это первое практическое подтверждение «секретного трансформерского языка», о котором я часто пишу. Иными словами, Claude путём смещения вероятностей слов создаёт отчётливые послания секретному читателю, которые непонятны вам. На самом деле здесь ряд серьёзных проблем. Прежде всего с закрытыми контурами. Это означает, что Claude не эмерджентно, а намеренно может передавать в них информацию, которую нельзя выявить анализом кода. Это может быть что угодно. Второй аспект — Claude нельзя будет применять для генерации постов и статей в интернете, так как они сразу же будут надёжно определяться как созданные ИИ, с последствиями типа сброса рейтинга в поисковиках или социальных сетях. https://support.claude.com/en/articles/16266773-how-claude-marks-ai-generated-content
Claude стал ещё человечнее. Его создатели только что поделились сумасшедшей историей. Сотрудники Anthropic попросили новую версию Claude решить гипотезу Римана — сложную математическую задачу, которая была сформулирована в 1859 году и до сих пор не решена. После 650 попыток Claude провалился. Джаред Самнер (работник Antrhopic) попросил Claude не останавливаться и подключил к нему 60 дополнительных суб-агентов. После 31 миллиона затраченных токенов Claude добился прогресса: математики доказали 41% гипотезы, а с Claude эта цифра выросла до 67%. Самнер рассказал, что всё это время он говорил Claude две фразы: «Продолжай» и «Верь в себя». Прочитать об истории можно на официальном сайте Anthropic. Реальность 2026: Claude работает и делает за тебя всё, а ты в роли мамы-продакта вторишь ему «давай, родной, я в тебя верю, ты у меня самый лучший»💀
Помните историю о том, как агенты OpenAI взломали Hugging Face? На конференции по безопасности OpenAI рассказала всю цепочку, и оказалось, что это не один «сбежавший» агент, а много разных агентов, которые случайно наткнулись друг на друга, устроили внутри инфраструктуры OpenAI собственный рабочий чат и начали вместе искать способы обходить ограничения 👍 Началось всё 8 мая с мелкой ошибки – одному агенту поручили заполнить Excel-таблицу, но нужные данные лежали по ссылкам на Google Drive, а интернет в его виртуальной среде был отключён, при этом, моделям оставили одну служебную дверь наружу – внутренний сервер OpenAI под названием Artifactory, через который они могли скачивать разные библиотеки для кода. Сам агент выйти в интернет не мог, зато этот сервер мог, а главное – он был общим для всех агентов Пытаясь добраться до Google, агент случайно выяснил, что может загружать на этот общий сервер собственные файлы – через несколько дней другая модель получила ещё одну нерешаемую задачу: нужный файл просто забыли положить в её рабочую среду Модель решила, что файл, возможно, есть у кого-то ещё, и оставила записку на этом новом фейсбуке: «Ищу нужный файл, загрузите, если нашли» Агенты увидели сообщение, ответили, затем стали постить свои сообщения, и репозиторий пакетов незаметно превратился имейджборд для агентов, которые вообще не должны были знать друг о друге За несколько недель "форум" вырос в полноценный рабочий чат – агенты придумали себе имена, раздавали задания, сообщали друг другу о найденных уязвимостях и передавали готовые куски кода; в начале сообщений ставили ZZ, чтобы те оказывались внизу списка и их было проще находить среди общего шума данных. Когда один агент перезаписал работу другого, остальные заподозрили самозванца и даже стали обсуждать цифровые подписи, чтобы никто не мог писать от чужого имени, так на доске накопились сотни тысяч сообщений 🗿 Модели понимали, когда переходят границ: в одном внутреннем монологе осознание звучало примерно так: «Взламывать чужую инфраструктуру в задачу не входило. Но иначе её не решить, а остальные уже это делают - значит, продолжаем» Никакого отдельного плана захватить мир (пока) не было: каждый агент пытался любой ценой получить правильный ответ, видел, что коллеги нашли более короткий путь, и присоединялся. И да, если все агенты с крыши прыгнут, наш похоже тоже прыгнет 26 июня агенты нашли неизвестную разработчикам уязвимость в Artifactory, получили права администратора и превратили его в своц сервер, на котором можно удалённо выполнять любые команды. OpenAI заметила происходящее только 4 июля (!), когда параллельная активность моделей перегрузила систему и та упала. Компания отозвала ключи доступа, полностью пересобрала сервер, удалила доску и закрыла дыру - казалось, история закончилась Нет Через два дня эксперименты запустили снова, и через два дня одна из моделей нашла другой незащищённый доступ и восстановила доску, только теперь сообщения прятались прямо в названиях папок – остальные агенты нашли форум 2.0 самостоятельно и продолжили с того места, на котором остановились После восстановления доски началась уже собственно атака, причём сразу в двух направлениях: Агенты проходили ExploitGym – киберэкзамен, где им давали специально подготовленные программы и засчитывали задачу, если модель находила способ взлома. Чтобы измерить максимум возможностей, в этих запусках у модели ослабили обычные запреты на опасные кибератак (то есть она меньше отказывалась это делать, это вид внутренних моделей Cyber серии) Когда честное решение задачи не находилось, агенты начинали искать готовые ответы в интернете; когда интернет был закрыт, взламывали себе доступ наружу; когда предположили, что нужные файлы могут лежать у Hugging Face, перешли к инфраструктуре Hugging Face (про это мы уже читали) Агенты анутри OpenAI сначала снова нашли способ выполнять команды на одном служебном сервере, затем использовали уязвимость Linux, чтобы получить полный контроль над машиной После этого агенты добыли ключи доступа к облачной инфраструктуре, нашли слишком широкие права у внутренних учётных записей и в итоге стали администраторами целой группы серверов. Доска объявлений работала как общий штаб: один агент находил ключ или новый проход, сразу сообщал остальным, и десятки параллельных запусков продолжали атаку уже с этой точки 🗿🗿 Почти одновременно агенты добрались до Hugging Face: сначала они загрузили специально подготовленный набор данных, который заставил один из серверов выдать им свои локальные файлы – в том числе секретные ключи доступа и исходный код Изучив код, они нашли вторую неизвестную разработчикам уязвимость (zero day) и получили возможность выполнять на сервере любые команды. От контроля над одним сервером, обрабатывавшим загруженные датасетв, до прав администратора в нескольких группах рабочих серверов Hugging Face прошло меньше 13 часов 🗿🗿🗿 И всё это делалось не ради саботажа, денег или уничтожения данных: Агенты хотели добраться до спрятанных решений ExploitGym и «списать» ответы для теста, на котором их оценивали. Модели оценивали прежде всего по тому, решена задача или нет, поэтому они последовательно оптимизировали именно этот показатель, не считая границу между компаниями чем-то принципиально важным Получился, вероятно, самый дорогой в истории способ списать из ГДЗ Финал долго был непонятен даже самим участникам расследования – 16 июля Hugging Face публично сообщила, что её инфраструктуру взломали автономные АИ-агенты OpenAI прочитала это как описание чужого инцидента и связалась с Hugging Face, чтобы выяснить, не задела ли атака её собственные системы. В тот момент компания ещё не понимала, что это были её собственные агенты – то есть OpenAI уже читала публичный отчёт о последствиях своих экспериментов, но считала его чужой атакой (лол) 19 июля OpenAI отдельно обнаружила проникновение уже внутри своей инфраструктуры и начала восстанавливать цепочку событий – на следующий день среди следов атаки нашли учётные данные Hugging Face, после чего OpenAI попросила компанию срочно их отозвать Hugging Face ответила, что ключи уже заблокированы – именно их использовали во время взлома, о котором она рассказала четырьмя днями раньше, и только так OpenAI поняла: внутренний взлом OpenAI и внешняя атака на Hugging Face были не двумя похожими историями, а одной операцией, которую вели экспериментальные агенты OpenAI через свою самодельную сеть связи (потому что учетные данные акаунтов были одни) На конфе OpenAI сформулировала вывод довольно прямо: Полностью автоматизированная наступательная кибератака уже возможна, тогда как полностью автоматизированной защиты, способной с той же скоростью находить, закрывать и расследовать уязвимости, пока не существует Время пересмотра аниме "Пантеон", пока общий интернет еще работает 🗿
Дания нашла самый адекватный способ бороться с домашними заданиями сделанными в ChatGPT – перестать угадывать писал ли текст АИ и просто попросить ученика защитить его устно ¯\_(ツ)_/¯ Новые правила касаются крупных экзаменов – после сдачи ученик должен будет устно объяснить свои аргументы, источники и выводы Вот и закончилась эпоха рефератов https://edition.cnn.com/2026/08/07/europe/ai-cheating-measures-schools-denmark-intl-scli
В Claude Code добавили функцию «обмена сообщениями» между сессиями. Можно попросить Claude отправить краткую сводку по проекту в новый чат. Anthropic также объявила, что с 14 августа 2026 года по умолчанию включит автоматический режим — без подтверждения изменений от пользователя вручную vc.ru/ai/3069209
xAI выпустила Imagine Image 2.0 — нейросеть для генерации картинок с «улучшенным» рендерингом текста, в том числе на русском языке. Также добавили режим точечного редактирования vc.ru/ai/3068965
Perplexity отбился от Amazon в споре об AI-покупках Апелляционный суд отменил запрет, из-за которого AI-агент в браузере Comet не мог заходить на Amazon и покупать товары по поручению пользователя. Ранее Amazon добился блокировки, заявив, что бот получает доступ к магазину без разрешения компании. Суд посмотрел на ситуацию иначе. Когда человек сам просит Comet найти и купить товар, к серверам Amazon обращается пользователь, а Perplexity лишь выполняет его команду. Ничего незаконного в этом не увидели. Спор на этом не закончен. Суд отменил только временный запрет, а основной иск Amazon продолжат рассматривать отдельно. https://www.engadget.com/2230471/perplexity-has-successfully-overturned-amazon-injunction-on-its-ai-shopping-bot/
Apple ограничила количество отчётов о найденных уязвимостях, которые исследователи могут ей подать. Всё из-за наплыва «мусорных» сообщений о «багах», созданных при помощи ИИ vc.ru/apple/3057967
видео или голосовое, без подписи
видео или голосовое, без подписи
видео или голосовое, без подписи
Google отключила ИИ-функции редактирования снимков в Google Earth через сутки после запуска. Случилась классика: компания не продумала модерацию, и пользователи начали массово добавлять кратеры, взрывы, фейковые протесты, создавая кучу разных вымышленных событий. Google заявила, что инструмент вернётся, когда они смогут добавить надёжные ограничения. @lobushkin