Культура Надёжности
описание
Авторский канал о надёжности @SlavaKudryashov
Лучшие посты
за три месяца- Знаете, что такое Harness? - Нет. - Дословный перевод – сбруя. На самом деле это и есть сбруя, только не для лошади, а для ИИ-агентов. Так понятнее? - Да… но… что такое сбруя? Harness состоит из двух компонентов: 1. Платформа – базовый инструмент для агентной разработки. Примеры: Claude Code, OpenAI Codex, OpenCode, Cursor... Он дает технические возможности для работы с кодом; 2. Правила и настройки – то, что делает платформу «умной» именно для компании: стандарты написания кода; архитектурные ограничения; автоматические проверки (требований надежности); механизмы исправления ошибок прямо в процессе генерации. Основной принцип в том, что инфраструктура выстраивает «рамки» для ИИ‑агента: - Перед работой система загружает в модель все нужные правила и контекст проекта - В процессе специальные механизмы сразу блокируют ошибки и заставляют ИИ исправлять их - После генерации код проходит автоматическую проверку: тесты, сборку, сканирование безопасности. Пока проверка не пройдена, код не попадает в проект Без такой системы контроля: - в коде накапливается больше ошибок, чем при ручной разработке; - разработчики тратят на проверку ИИ‑кода больше времени, чем на написание его с нуля; - доверие к ИИ падает, и команды возвращаются к ручному ревью: теряется весь выигрыш в скорости. Оригинал: For Agentic SDLC, the AI Coding Harness Matters More Than the Coding Model (Gartner, March 2026) - К 2028 году компании с грамотно настроенным harness будут иметь на 60% меньше дефектов после запуска продукта - Правильная инфраструктура повышает успешность генерации кода с 53,8% до 81,8% - Разница между топовыми моделями ИИ при этом невелика - всего 1–3%. @Simple_Reliability
В психологии есть принцип принятия решений - Pre-Mortem Когда вы собираетесь что-то сделать — запустить проект, нанять сотрудника, подписать контракт, — вместо вопроса «что может пойти не так?» скажите себе: «прошло полгода, все провалилось, что случилось?». Этот прием анализа решений придумал психолог Гэри Кляйн. Он заметил: если описать провал как уже свершившийся факт, человек оценивает свои планы объективнее. В ИТ мы чаще всего пользуемся другим принципом - Post-Mortem. Для чего он нужен, кажется, все понятно, а отказаться от него мы сможем только когда у нас не будет инцидентов… т.е. примерно никогда. А что если перенять и переиспользовать Pre-Mortem для смещения влево оценки надежности при новых внедрениях… Берлинский разработчик Амин Боргеи создал на основе этой техники готовый скилл Premortem для Claude. Он собирает контекст из чатов и файлов, реконструирует сценарии провала, поручает сгенерированным «следователям» проанализировать каждый из них и выдает чеклист на 3–5 пунктов — что надо было проверить до запуска ссылка @Simple_Reliability
Сообщество инженеров сопровождения Сбера продолжает агентизировать города 📆13 августа Сбер собирает OPS, DevOps и SRE-инженеров Самары в необычном формате и только офлайн. 🏦Сбер курсирует по Волге на двух теплоходах, где в формате барных стендапов и дискуссий инженеры обсудят, что умеют агенты в OPS, а что пока нет, как в Сбере строят надёжность, как реагируют на инциденты, куда ведёт агентизация и что с этим делать. 13 августа, 18:30 Самара, Теплоходы "Вояж" и "Спутник" ➡️Регистрация тут Количество очных мест ограничено
10 open-source сканеров безопасности агентских навыков Хочу поделиться ссылкой на статью с таким заголовком и еще парой ссылок по теме: - В январском исследование SkillScan говорится, что среди 31 132 общедоступных навыков agent skills удалось выявило 26,1% потенциально опасных, и 5,2% заведомо опасных навыка. - В конце июля организовался Open Secure AI Alliance (см. пресс-релиз в блоге Nvidia) В общем, сканируйте ваши, а тем более чужие навыки. Мало ли что