Константин Доронин
СтатистикаПо любым вопросам, которые не хотите задавать в комментариях, можете писать напрямую – @kdoronin
- Последний пост
- 21:53
- Последнее чтение
- 12:17
- Постов за неделю
- 5
- Всего постов
- 23
- Тип
- открытый
- Язык
- русский
- В каталоге с
- 12 авг.
- 1/24сутки в ленте
- 1 314
- 1/48двое суток
- 1 505
- 1/72трое суток
- 1 624
Оценка по просмотрам недавних постов: пост набирает почти всё за первые сутки.
Посты
Запись второй части нашего стрима про сбегающих AI-агентов. Посмотреть на YouTube можно здесь. Таймкоды: 0:00:00 — Приветствие и обсуждение планов на стрим 0:02:13 — Архитектура проекта SECS и схема пайплайна 0:06:42 — Интеграция навыков для кодовых AI-агентов 0:10:00 — Локальный запуск модели Qwen и vLLM 0:18:05 — Ускорение инференса через спекулятивное декодирование 0:28:20 — Воспоминания о культовых играх и компьютерах 0:33:45 — Настройка контекстного окна и параметров модели 0:44:00 — Сравнение видеокарт для инференса нейросетей 0:50:40 — Обсуждение генерации музыки в нейросетях 1:08:05 — Тестирование AI-агента на тестовой виртуальной машине 1:23:45 — Автоматизированный анализ и поиск путей эскалации 1:54:30 — Подведение итогов стрима и завершение трансляции Каналы участников стрима, чтобы подписаться: Павел Рыков Константин Доронин
Как писать код с AI-агентами? А если командой? Что нужно учесть, чтобы этот код не положил продакшн? Эти и другие не менее интересные вопросы мы обсудим на следующем стриме на моём YouTube-канале. Для обсуждения я позвал очень интересных гостей: Андрей Бреслав – один из создателей языка программирования Kotlin. Сейчас Андрей разрабатывает Agentic Engineering Toolkit под названием CodeSpeak. Валера Ковальский – автор одноимённого канала. Основатель проекта Neuraldeep https://neuraldeep.ru/ и автор множества Open Source проектов, созданных примерно за 120 минут каждый. Максим Ключников – автор канала Этихлид. Разработчик с огромным опытом, который усилил себя с помощью AI-агентов. Работал на позиции Senior Software Developer, когда я ещё в школу ходил 😊 Дата: четверг, 20 августа Время: 19:00 (GMT+3) Проходить будет на моём YouTube-канале. Добавить событие в календарь Вопросы для эфира оставляйте в комментариях к этому посту 👇
Запись стрима "Как заставить AI-агента сбежать?". Смотреть на YouTube. Это первая часть, в которой мы настраиваем базовый пентест-харнесс и пробуем заставить модели Anthropic осуществить проверку на уязвимости. Таймкоды для удобного перехода к самым интересным фрагментам: 00:00 — Начало трансляции и обсуждение аватаров 06:15 — Идея создания ИИ-агента для пентеста 10:10 — Проектирование архитектуры решения в Miro 16:00 — Подбор утилит для кибербезопасности 20:00 — Обзор автономной платформы XBOW 24:00 — Поиск ИИ-моделей без цензуры 36:00 — Подготовка уязвимой виртуальной машины QEMU 42:20 — Создание базовых инструкций для агента 55:00 — Особенности работы агентов в Linux 1:00:00 — Архитектура агентов и локальные правила 1:02:18 — Оптимизация расхода токенов и промптов 1:06:00 — Оптимизация скиллов для ИИ-агентов 1:10:00 — Запуск и тестирование ИИ-агента 1:16:00 — Сканирование сети с помощью Nmap 1:18:25 — Установка инструментов и настройка Vagrant 1:31:18 — Срабатывание встроенной защиты ИИ-модели 1:35:00 — Использование китайских open-source моделей 1:45:00 — Поиск учебных стендов и задач CTF 1:54:40 — Подключение к GPU для локальных моделей 2:00:24 — Обсуждение нейросетевых моделей и названий 2:01:29 — Разбор старого бэкдора в UnrealIRCd 2:04:04 — Повышение привилегий через уязвимость Docker 2:04:54 — Проблемы с установкой Metasploit Framework 2:06:19 — Скачивание локальных LLM и обход блокировок 2:10:04 — Создание репозитория GitHub для проекта 2:12:54 — Итоги стрима и дальнейшие планы p.s.: пока работал с записью, обновил свой Video Analyzer. Он теперь умеет размечать видео по таймкодам, а также сохраняет последний результат анализа после обновления страницы. Вообще, нравится мне этот микро-проект, так как всегда можно поставить, запустить и выполнить задачу по работе с видео. p.p.s.: Зарегистрировался на donationalerts и теперь как настоящий блогер могу принимать донаты. Если вдруг возникнет альтруистический порыв, вот ссылка.
Помните историю о том, как агенты OpenAI взломали Hugging Face? На конференции по безопасности OpenAI рассказала всю цепочку, и оказалось, что это не один «сбежавший» агент, а много разных агентов, которые случайно наткнулись друг на друга, устроили внутри инфраструктуры OpenAI собственный рабочий чат и начали вместе искать способы обходить ограничения 👍 Началось всё 8 мая с мелкой ошибки – одному агенту поручили заполнить Excel-таблицу, но нужные данные лежали по ссылкам на Google Drive, а интернет в его виртуальной среде был отключён, при этом, моделям оставили одну служебную дверь наружу – внутренний сервер OpenAI под названием Artifactory, через который они могли скачивать разные библиотеки для кода. Сам агент выйти в интернет не мог, зато этот сервер мог, а главное – он был общим для всех агентов Пытаясь добраться до Google, агент случайно выяснил, что может загружать на этот общий сервер собственные файлы – через несколько дней другая модель получила ещё одну нерешаемую задачу: нужный файл просто забыли положить в её рабочую среду Модель решила, что файл, возможно, есть у кого-то ещё, и оставила записку на этом новом фейсбуке: «Ищу нужный файл, загрузите, если нашли» Агенты увидели сообщение, ответили, затем стали постить свои сообщения, и репозиторий пакетов незаметно превратился имейджборд для агентов, которые вообще не должны были знать друг о друге За несколько недель "форум" вырос в полноценный рабочий чат – агенты придумали себе имена, раздавали задания, сообщали друг другу о найденных уязвимостях и передавали готовые куски кода; в начале сообщений ставили ZZ, чтобы те оказывались внизу списка и их было проще находить среди общего шума данных. Когда один агент перезаписал работу другого, остальные заподозрили самозванца и даже стали обсуждать цифровые подписи, чтобы никто не мог писать от чужого имени, так на доске накопились сотни тысяч сообщений 🗿 Модели понимали, когда переходят границ: в одном внутреннем монологе осознание звучало примерно так: «Взламывать чужую инфраструктуру в задачу не входило. Но иначе её не решить, а остальные уже это делают - значит, продолжаем» Никакого отдельного плана захватить мир (пока) не было: каждый агент пытался любой ценой получить правильный ответ, видел, что коллеги нашли более короткий путь, и присоединялся. И да, если все агенты с крыши прыгнут, наш похоже тоже прыгнет 26 июня агенты нашли неизвестную разработчикам уязвимость в Artifactory, получили права администратора и превратили его в своц сервер, на котором можно удалённо выполнять любые команды. OpenAI заметила происходящее только 4 июля (!), когда параллельная активность моделей перегрузила систему и та упала. Компания отозвала ключи доступа, полностью пересобрала сервер, удалила доску и закрыла дыру - казалось, история закончилась Нет Через два дня эксперименты запустили снова, и через два дня одна из моделей нашла другой незащищённый доступ и восстановила доску, только теперь сообщения прятались прямо в названиях папок – остальные агенты нашли форум 2.0 самостоятельно и продолжили с того места, на котором остановились После восстановления доски началась уже собственно атака, причём сразу в двух направлениях: Агенты проходили ExploitGym – киберэкзамен, где им давали специально подготовленные программы и засчитывали задачу, если модель находила способ взлома. Чтобы измерить максимум возможностей, в этих запусках у модели ослабили обычные запреты на опасные кибератак (то есть она меньше отказывалась это делать, это вид внутренних моделей Cyber серии) Когда честное решение задачи не находилось, агенты начинали искать готовые ответы в интернете; когда интернет был закрыт, взламывали себе доступ наружу; когда предположили, что нужные файлы могут лежать у Hugging Face, перешли к инфраструктуре Hugging Face (про это мы уже читали) Агенты анутри OpenAI сначала снова нашли способ выполнять команды на одном служебном сервере, затем использовали уязвимость Linux, чтобы получить полный контроль над машиной После этого агенты добыли ключи доступа к облачной инфраструктуре, нашли слишком широкие права у внутренних учётных записей и в итоге стали администраторами целой группы серверов. Доска объявлений работала как общий штаб: один агент находил ключ или новый проход, сразу сообщал остальным, и десятки параллельных запусков продолжали атаку уже с этой точки 🗿🗿 Почти одновременно агенты добрались до Hugging Face: сначала они загрузили специально подготовленный набор данных, который заставил один из серверов выдать им свои локальные файлы – в том числе секретные ключи доступа и исходный код Изучив код, они нашли вторую неизвестную разработчикам уязвимость (zero day) и получили возможность выполнять на сервере любые команды. От контроля над одним сервером, обрабатывавшим загруженные датасетв, до прав администратора в нескольких группах рабочих серверов Hugging Face прошло меньше 13 часов 🗿🗿🗿 И всё это делалось не ради саботажа, денег или уничтожения данных: Агенты хотели добраться до спрятанных решений ExploitGym и «списать» ответы для теста, на котором их оценивали. Модели оценивали прежде всего по тому, решена задача или нет, поэтому они последовательно оптимизировали именно этот показатель, не считая границу между компаниями чем-то принципиально важным Получился, вероятно, самый дорогой в истории способ списать из ГДЗ Финал долго был непонятен даже самим участникам расследования – 16 июля Hugging Face публично сообщила, что её инфраструктуру взломали автономные АИ-агенты OpenAI прочитала это как описание чужого инцидента и связалась с Hugging Face, чтобы выяснить, не задела ли атака её собственные системы. В тот момент компания ещё не понимала, что это были её собственные агенты – то есть OpenAI уже читала публичный отчёт о последствиях своих экспериментов, но считала его чужой атакой (лол) 19 июля OpenAI отдельно обнаружила проникновение уже внутри своей инфраструктуры и начала восстанавливать цепочку событий – на следующий день среди следов атаки нашли учётные данные Hugging Face, после чего OpenAI попросила компанию срочно их отозвать Hugging Face ответила, что ключи уже заблокированы – именно их использовали во время взлома, о котором она рассказала четырьмя днями раньше, и только так OpenAI поняла: внутренний взлом OpenAI и внешняя атака на Hugging Face были не двумя похожими историями, а одной операцией, которую вели экспериментальные агенты OpenAI через свою самодельную сеть связи (потому что учетные данные акаунтов были одни) На конфе OpenAI сформулировала вывод довольно прямо: Полностью автоматизированная наступательная кибератака уже возможна, тогда как полностью автоматизированной защиты, способной с той же скоростью находить, закрывать и расследовать уязвимости, пока не существует Время пересмотра аниме "Пантеон", пока общий интернет еще работает 🗿
История побега OpenAI-агентов, на базе которой мы и организовали наши стримы выходного дня
Начинаем работу над AI-агентом для пентеста на on-prem-моделях. Подключайтесь на стрим: https://youtube.com/live/BgoVhprTFmQ
Продолжение следует! Сегодня попробовали заставить модели семейства Claude проверить систему на уязвимости. Как это ни удивительно, но после даунгрейда на Opus4.8, мы пришли к успеху. Завтра, 9 августа, с Пашей проведём не запланированную вторую часть стрима. В 11:00мск мы будем запускать харнесс на pi.dev с on-prem-моделью, которой опять будем пробовать взломать нашу демо-систему. Как только начнётся стрим – ссылку сразу скину сюда. Спасибо всем, кто сегодня присутствовал! До встречи на завтрашнем эфире! p.s.: запись сегодняшнего стрима будет опубликована позднее – также сообщу об этом отдельным постом.
Мы начинаем наш стрим "Как заставить AI-агента сбежать?" Подключайтесь по ссылке: https://youtube.com/live/YSi6P72i2Q8
Бег набирает обороты! Модели всё чаще сбегают из своего окружения и взламывают всё подряд. Поэтому завтра, 8 августа, мы с Павлом Рыковым с канала Pavel Zloi будем учить AI-агента организации побегов. Ни я, ни Паша не являемся искушёнными в ИБ специалистами, поэтому все надежды на собираемый харнесс и наши способности по уламыванию LLM на неправомерные действия. Увидимся завтра, 8 августа в 18:00 (GMT+3) на моём YouTube-канале. Добавить событие в календарь можно тут. Пожелания удачи, советы по инструментам, подходам, моделям – принимаются в комментариях.
⚪️ Agent Plugins Новый 15й стандарт в агентном мире! Теперь - на плагины: пакуем скиллы и MCP вместе стандартным способом, который понимают несколько упряжек разных вендоров. Агентов пакануть туда все еще нельзя. Но есть Client extensions - посмотрим чего туда запихают разные упряжки, может, хуки и агентов? 🔗 Оффсайт: https://agent-plugins.org/ 🔗 Гитхаб: 🔗 Анонс: https://x.com/OpenAIDevs/status/2085398373511918022 На момент старта совместимые упряжки: • Codex • ChatGPT • Cursor • Github Copilot • Kiro • VS Code Vercel еще поддерживает Конечно нет (и не будет?) антропиков. Остальные, надеюсь - подтянутся. Грок (? но он предпочитает клода копировать, не клозедов - по личным причинам). В общем, очередной стандарт Хорошее начинание, конечно, но немного забавно @deksden_notes
Отлично! Правда, сперва ждал workflow 😊
После выхода наделавшего шума Deepseek V4 Flash, вспомнил, что у меня есть подписка за $20 на ollama. Иногда гоняю там cloud-модели. Запустил на Flash несколько тестовых задач, чтобы посмотреть, на что модель вообще способна. Он оказался достаточно хорош в пространственном мышлении и даже сделал мне что-то вроде "Angry Birds" в 3D. Ещё и через специфический харнесс от paperclip. Особенно меня впечатлило то, как на Ollama он ест лимиты на подписке за $20. 2307 запросов заняли меньше 10% недельных лимитов. Возможно, есть некоторое смещение восприятия, вызванное GPT-5.6-Sol, съедающим недельные лимиты за сутки, если чуть отпустить вожжи. Или даже Cursor, который в прошлом году за $20 давал всего 500 запросов в месяц к "не-auto" моделям.
Константин Доронин pinned a photo
Пришло время познакомиться. Самый сложный для меня пост в истории канала. Я готовил его не меньше года. Думаю, что даже отдельно расскажу об этом историю. В этом блоге я пишу про свой практический опыт. Про подходы и технологии, которые использую в работе с клиентами (а также о результатах мини-исследований, которые мне интересны). Всё то, что уже сейчас можно использовать в работе. Успел поработать с клиентами со всего мира: от ЮАР до Норвегии, от Владивостока до Сан-Франциско. Поучаствовал более, чем в 250 проектах из разных ниш. Работал как с микробизнесом из 3-5 человек, так и с заводами, корпорациями и гос. заказами. С чего начать изучение канала: 1. Моя формула поиска первого внедрения AI – достаточно простая, но поможет начать движение в нужную сторону. 2. Побочный эффект внедрения AI в бизнес-процессы – о том, что нужно сперва провести базовую цифровизацию процессов. 3. Почему ChatGPT не заменяет специалистов сферы услуг? – про ответственность за результат. 4. Про кейс использования темпоральных графов. – я очень люблю графовое представление информации. Этот пост – чтобы пробудить интерес к графам у вас. 5. Недавний эксперимент с тем, как заставлять /goal работать сутками. – чтобы почувствовать себя дирижёром оркестра AI-агентов с выжженными лимитами по подписке. 6. Как начать внедрять AI-Coding в компании. – выбираем наиболее-подходящие задачи, которые быстро покажут эффект и не вызовут сопротивления у команды разработки. 7. Про то, как делиться своим Workflow так, чтобы он не был бесполезен. – пост, предвосхитивший выход Agent Skills. 8. Хочешь потерять клиента – отправь ему детальный бриф. – пост про базовое использование AI при работе с клиентами. 9. Мой YouTube-канал – для тех, кто предпочитает видео-контент, у меня есть стримы с интересными гостями. Здесь должна быть ссылка на посты о форматах платного взаимодействия со мной. Это следующий уровень сложности для меня. Я их обязательно напишу. Но потом. Пока что можно записаться на консультацию совместную часовую рабочую сессию со мной тут: @kdoronin
Большие языковые модели хорошо распознают изображения. Могут подробно описать, что они там видят и даже где оно примерно находится на листе. Но с точным позиционированием элементов на картинке всё ещё справляются неидеально. Для этого существует отдельный класс моделей. Нашёл на Hugging Face маленькую узкоспециализированную модель для разметки скриншотов веб-страниц. Называется ScreenParser. По факту, это YOLO, дообученный на вот этом датасете из 1,45 миллионов веб-страниц. Модель крошечная (25 миллионов параметров), поэтому без проблем запустится на вашем рабочем ноутбуке. Размечает на bbox-ы и класс элемента. Всего есть 55 классов, которые могут существовать на веб-странице. В JSON складывает также уверенность в том, что элемент распознан верно. Если уверенность низкая, то всегда можно сделать кроп нужной области и отправить на распознание ещё раз. Я уже попробовал модель в качестве одного из инструментов при вёрстке макетов по картинке. Пример разметки можете увидеть в медиа поста. Ставьте 🔥 , если хотите скилл по вёрстке из картинки/скриншота с помощью ScreenParser. Думаю, её также можно добавить к какой-нибудь мелкой on-prem-модели для того, чтобы улучшить навык browser-use.
Как внедрить Spec-Driven Development в 10-летний монолит Еще один доклад с нашей конференции по агентной разработке При первом ознакомлении с концепцией SDD она кажется отличной идеей и её применение на новом проекте с нуля не вызывает вопросов. А что со старым большим монолитом, окружённым россыпью микросервисов, миллионами строк кода и отсутствующей документацией? Ведь именно такие примеры обычно умозрительно приводят, когда хотят поставить под сомнение разработку агентами. Чтож, рассказываем) Иван Поддубный, СТО Вебпрактик, уважаемый член нашего программного коммитета (да и не только нашего), и опытный серийный спикер (не раз выступавший на нашах конференциях), рассказал про практический опыт сквозного внедрения SDD практики на основе OpenSpec в процесс разработки софта: от аналитиков до тестирования. Ребята достигли почти 100% адопшена Как итог — ребята пришли к Spec-First полходу: хранят и версионируют свои спеки как код по всей полирепе https://www.youtube.com/watch?v=EZwcBSX_Rbs П.С. Если вы хоть раз задавались вопросом "а как это чудо приземлять в свой проект", этот доклад для вас)
Наконец-то запись стрима "Харнесс будущего" с тайм-кодами! Сохраняйте себе, чтобы посмотреть ответы на самые интересные вам вопросы. 00:00 — Введение и изучение заставки стрима 10:20 — представление гостей 11:50 — Какие задачи сейчас решаете с помощью harness? 21:08 — Как можно описать слабости текущего harness? 29:05 — Как бы вы хотели улучшить свой харнесс? Насколько это реалистично? 41:10 — Возможен ли полезный для пользователя harness на on-prem-моделях? 53:15 — Какой автономности сможет достичь AI-агент в будущем? 1:01:40 — Как изменится работа агентов с памятью? 1:07:25 — Исчезнет ли human in the loop? 1:13:50 — Какие изменения AI-агентов будут вызваны вопросами безопасности? 1:25:33 — Переходим к вопросам из чата. 1:26:15 — Что важнее – harness или модель? 1:30:50 — Про эволюцию профессии AI-инженера. 1:34:00 — Кто из участников стрима – вайбкодер? 1:39:38 — Когда имеет смысл использовать оркестратор харнессов? 1:41:10 — Расскажите про ваш "вау-момент" от нейронок. 1:48:33 — Можете ли работать без AI-агентов в 2026-м году? 1:53:30 — Какой самый дурацкий запрос вы отправляли в агента недавно? 1:55:20 — Что вы думаете об устройствах, которые OpenAI проектирует? 1:58:05 — Про семантику и грамматику внутри модели и harness. 2:01:05 — О харнессах для бизнеса. 2:02:08 — Будет ли развитие живых нейросетей? 2:04:29 — Матерится ли на вас агент? 2:07:30 — Всё-таки, харнесс будущего – какой он? Подписывайтесь на Telegram-каналы участников стрима: Александр Абрамов – https://t.me/dealerAI Павел Рыков – https://t.me/evilfreelancer Тимур Хахалев – https://t.me/the_ai_architect Константин Доронин – https://t.me/kdoronin_blog Оставляйте в комментариях предложения для тем, которые можно рассмотреть на следующих трансляциях.
В эту субботу, 25 июля, выступаю на Selectel Day Off в Санкт-Петербурге. Буду проводить воркшоп, на котором поделюсь своим опытов по настройке Hermes, как действительно полезного AI-ассистента. Специально готовил материалы таким образом, чтобы было полезно максимально-широкому кругу участников. Это бесплатно. Для доступа достаточно заполнить форму регистрации на сайте мероприятия: https://dayoff.selectel.ru/#rega Очень нравится выбранная тематика пересечения технологий и искусства. В общем, если будете в Санкт-Петербурге в ближайшие выходные, вот вам вариант для полезного времяпрепровождения.
Мы начинаем наш стрим "Харнесс будущего. Какой он?" Подключайтесь: https://youtube.com/live/LAUdN1-4mgI
видео или голосовое, без подписи