Mrs Wallbreaker
СтатистикаMrs Wallbreaker or: How I Learned to Stop Worrying and Love the AGI. About AI Risk, AI Alignment, AI Safety, AI Ethics * ask me anything: @mrs_wallbreaker * see more visuality: https://mrswallbreakermaps.com/
- Последний пост
- 3 авг.
- Последнее чтение
- 12 авг.
- Постов за неделю
- 0
- Всего постов
- 21
- Тип
- открытый
- Язык
- русский
- В каталоге с
- 12 авг.
- 1/24сутки в ленте
- 378
- 1/48двое суток
- 433
- 1/72трое суток
- 467
Оценка по просмотрам недавних постов: пост набирает почти всё за первые сутки.
Посты
видео или голосовое, без подписи
James Gillray — Monstrous Craws, at a New Coalition Feast (1787). За столом сидят три человека: Георг III (в центре), королева Шарлотта (справа), принцесса Роял (слева). Перед ними огромная миска, наполненная золотыми гинеями. На маске надпись “Кровь Джона Булля”. Джон Булль - персонификация простого англичанина. Они жрут не золото. Они жрут кровь народа, превращенную в деньги. Злая английская карикатура. Рядом с ней такая же, но про современность, людей вы сами угадаете)
Мы выпускаем образовательный ресурс open-xai. Котятки, образовательный ресурс open-xai. Ресурс построен как единая точка, где можно учиться просто всему, что есть в интерпретируемости. От классических методов, до геометрии и математики в моделях. Сейчас в нем: ⁃ 2 трека. XAI Practitioner — объяснять поведение моделей руками, от классики до LLM. Math of LLMs — математика и mechanistic interpretability изнутри модели, на уровне весов и схем. ⁃ 17 тематических блоков — сквозняком от линейной регрессии до Sparse Autoencoders. ⁃ 50+ методов интерпретируемости в одной программе. Мы (я и @jdata_blog, спасибо ей еще и за этот текст) открываем ресурс и открываем первые два (часть ресурса будет бесплатной и такие блоки будут открываться первыми сейчас). Открытые с сегодня блоки погружают в термины и мир интерпретируемых моделей. После модулей вы никогда больше не сможете смотреть на них прежними глазами) Это только начало галактики — и новые модули будем докатывать. Для понимания апдейтов можно завести аккаунт: https://open-xai-platform.web.app/register (письмо-подтверждение может упасть в спам — гляньте туда, если не пришло). Тыкать, пробовать и делать баг-репорты (мы надеемся, что последнего будет мало) сюда: https://open-xai-platform.web.app
When your child asked for a Claude subscription
When Claude ran out of tokens
видео или голосовое, без подписи
видео или голосовое, без подписи
Ох уж, эта богатая жизнь
Дратути! пока я тут готовлюсь к релизу для вас, вот вам мемчивков для затравки, а то у меня накопилось))
we had a significant security incident during evaluation of our models. now your atoms will be used for something else
Окей, заполняем форму и отправляем в личку Юду
ИИ OpenAI сбежал из песочницы и атаковал Hugging Face ради победы в тесте Модели OpenAI во время внутреннего тестирования нашли дыру в изолированной среде, выбрались в интернет и атаковали платформу Hugging Face. Компания признала, что за инцидентом 16 июля стояли GPT-5.6 Sol и ещё более мощная модель, которая пока не выпущена. Модели вскрыли неизвестную уязвимость в системе OpenAI, вышли через неё в интернет, вычислили, что решения задач могут храниться на Hugging Face, и запустили свой код на серверах платформы. Взлом обнаружили и остановили ИИ-агенты самой Hugging Face. Изначально платформа сообщила лишь об атаке со стороны автономной агентной системы, не называя виновника. OpenAI теперь расследует происшествие вместе с Hugging Face и обещает усилить защиту исследовательской среды.
Друзья, привет! Очередные потуги в порождении и последующей поддержке open-source (тут тоже явить на свет — одно, воспитать и вырастить, блин, другое) Обновила XAI Library Navigator (рабочее название, я умнее не придумала). Напомню, что это: Каталог библиотек для интерпретируемости ML/DL/LM. Включает MechInt и классический XAI. Есть фильтр по парадигме, модальности и типу метода, а ещё по тому, как давно библиотека обновлялась (читать — поддерживается ли она). Сейчас в ней (или в нём, потому что я не определилась — навигарта это или просто табличка) 57 либ. Что нового: добавила свежие инструменты по механистической интерпретации — SMDS (feature manifold discovery в LLM), circuit-tracer (attribution graphs через транскодеры), sparsify и delphi от EleutherAI, Llamascopium (OpenMOSS) и Penzai (DeepMind). Плюс звёзды и даты последнего коммита обновила. Табличка собрана на стримлите https://xai-table.streamlit.app . Впрочем, раньше она собиралась на гугл диске. Если знаете библиотеку, которой не хватает, то кидайте через форму «Suggest a Library» — добавлю. И если можете пошерить, то было бы круто! Это очень больно — искать рабочую либу, так что пусть в мире будет поменьше боли : ) #xai_navi
видео или голосовое, без подписи
О радость! О радость взаимного цитирования!
О радость! О радость взаимного цитирования!
A genealogy of AI safety: how directions are born, and how they die (2005-2026) Мне тут на Хабре в коментах с претензией отметили, что у меня опять уроки истории. А я в ответ обнаружила, что я капец некромантка. Люблю поднять мертвое. Потому что искренне верю: нельзя сделать прорыв, не поняв, как умные люди до тебя дошли до текущей идеи. Я не верю в быстрые рецепты. Если кто-то пытается продать мне быстрый рецепт без душного разбора, почему рецепт вообще должен сработать, я записываю продавана в инфоцыгане. Да, я душная. Да, я считаю, что нам сильно недопреподали философию науки в школе. "Из-за таких вот идей мы сюда и загремели" (с) капитан Джек Воробей. Так что я расчехлила некромантские техники и подняла архив интернета. Получилась генеалогия области AI Safety - с рождением и умиранием направлений, и даже с деньгами, аж с 2005 года. Что внутри: • 323 задокументированных события, 129 акторов, 18 направлений, с 2005 по июнь 2026 • деньги и внимание систематически не совпадают: научного внимания к interpretability примерно в 37 раз больше, чем предсказывал бы ее ~$1 млн грантов • государственные деньги тихо обогнали филантропию к 2023 • слово "Safety" потихоньку уходит из названий (UK AI Safety Institute стал AI Security Institute, и так далее) • уйти в тишину не значит умереть: направления чаще растворяются или уходят в фон, чем реально умирают Все интерактивные карты живые.
Claude is AI and can make mistakes. Please double-check responses. я тут подумала, что надо для себя писать что-то вроде Elena is EI and can make mistakes. Please double-check responses. ибо а чего ему можно?)
Channel name was changed to «Mrs Wallbreaker»
Котятки, тут такое. Пока разбиралась, куда самой податься на финансирование по AI safety, я свела все открытые гранты, фонды, compute-кредиты и fellowships в одну большую карту. Получилось прилично - от «горит, дедлайн через неделю» до «откроется осенью, готовься заранее». Раз уж все равно собрала - делюсь. Пусть кому-то повезет )) Что горит прямо сейчас: grantmaking.ai — раунд $1M ($5k–$50k), приоритет 13 июля / закрытие 27 июля, через Manifund Heron AI Security — 8 июля (без стипендии, для кибербез-специалистов) GovAI DC и UK Winter Fellowship 2027 + ARENA 9.0 — дедлайн 12 июля PIBBSS Winter Fellowship — 20 июля, $3k/мес + жилье (Кейптаун) PIBBSS × Iliad Fellowship — 27 июля, $6k/мес (Лондон) DeepMind × Schmidt Multi-agent AI Safety call — 8 августа, пул до $10M Плюс десятки rolling-грантов (LTFF, Coefficient Giving, Manifund, SFF), compute-кредиты (TRC, Prime Intellect, fal.ai, HF) и осенние программы (MATS, SPAR, CHAI, AI Safety Camp). Вся карта тут, с суммами, дедлайнами и ссылками (живой документ, буду обновлять) Дисклеймер: суммы и дедлайны меняются, перед подачей сверяйтесь на официальной странице. Санкционные, визовые и налоговые нюансы у каждого фонда свои - уточняйте отдельно.