tgindex
Mrs Wallbreaker

Mrs Wallbreaker

Статистика
@MrsWallbreakerрусский

Mrs Wallbreaker or: How I Learned to Stop Worrying and Love the AGI. About AI Risk, AI Alignment, AI Safety, AI Ethics * ask me anything: @mrs_wallbreaker * see more visuality: https://mrswallbreakermaps.com/

Последний пост
3 авг.
Последнее чтение
12 авг.
Постов за неделю
0
Всего постов
21
Тип
открытый
Язык
русский
В каталоге с
12 авг.
Подписчики
1 055
−3 за 4 дн.
Сутки
0
0,00%
Неделя
 
Месяц
 
Просмотров на пост
744
20 постов
Вовлечённость
70,5%
к подписчикам
Постов в день
0,0
всего 21
Упоминаний
2
каналов
Охват размещения
оценка
1/24сутки в ленте
378
1/48двое суток
433
1/72трое суток
467

Оценка по просмотрам недавних постов: пост набирает почти всё за первые сутки.

Посты

  • видео или голосовое, без подписи

  • 3 авг.30143из olashmanovBlog

    James Gillray — Monstrous Craws, at a New Coalition Feast (1787). За столом сидят три человека: Георг III (в центре), королева Шарлотта (справа), принцесса Роял (слева). Перед ними огромная миска, наполненная золотыми гинеями. На маске надпись “Кровь Джона Булля”. Джон Булль - персонификация простого англичанина. Они жрут не золото. Они жрут кровь народа, превращенную в деньги. Злая английская карикатура. Рядом с ней такая же, но про современность, людей вы сами угадаете)

  • 31 июл.5243226

    Мы выпускаем образовательный ресурс open-xai. Котятки, образовательный ресурс open-xai. Ресурс построен как единая точка, где можно учиться просто всему, что есть в интерпретируемости. От классических методов, до геометрии и математики в моделях. Сейчас в нем: ⁃ 2 трека. XAI Practitioner — объяснять поведение моделей руками, от классики до LLM. Math of LLMs — математика и mechanistic interpretability изнутри модели, на уровне весов и схем. ⁃ 17 тематических блоков — сквозняком от линейной регрессии до Sparse Autoencoders. ⁃ 50+ методов интерпретируемости в одной программе. Мы (я и @jdata_blog, спасибо ей еще и за этот текст) открываем ресурс и открываем первые два (часть ресурса будет бесплатной и такие блоки будут открываться первыми сейчас). Открытые с сегодня блоки погружают в термины и мир интерпретируемых моделей. После модулей вы никогда больше не сможете смотреть на них прежними глазами) Это только начало галактики — и новые модули будем докатывать. Для понимания апдейтов можно завести аккаунт: https://open-xai-platform.web.app/register (письмо-подтверждение может упасть в спам — гляньте туда, если не пришло). Тыкать, пробовать и делать баг-репорты (мы надеемся, что последнего будет мало) сюда: https://open-xai-platform.web.app

  • When your child asked for a Claude subscription

  • When Claude ran out of tokens

  • видео или голосовое, без подписи

  • видео или голосовое, без подписи

  • 31 июл.353154из data_analysis_ml

    Ох уж, эта богатая жизнь

  • Дратути! пока я тут готовлюсь к релизу для вас, вот вам мемчивков для затравки, а то у меня накопилось))

  • 23 июл.527131из neuralpurgatory

    we had a significant security incident during evaluation of our models. now your atoms will be used for something else

  • 23 июл.41571из denissexy

    Окей, заполняем форму и отправляем в личку Юду

  • 23 июл.45782из lentachold

    ИИ OpenAI сбежал из песочницы и атаковал Hugging Face ради победы в тесте Модели OpenAI во время внутреннего тестирования нашли дыру в изолированной среде, выбрались в интернет и атаковали платформу Hugging Face. Компания признала, что за инцидентом 16 июля стояли GPT-5.6 Sol и ещё более мощная модель, которая пока не выпущена. Модели вскрыли неизвестную уязвимость в системе OpenAI, вышли через неё в интернет, вычислили, что решения задач могут храниться на Hugging Face, и запустили свой код на серверах платформы. Взлом обнаружили и остановили ИИ-агенты самой Hugging Face. Изначально платформа сообщила лишь об атаке со стороны автономной агентной системы, не называя виновника. OpenAI теперь расследует происшествие вместе с Hugging Face и обещает усилить защиту исследовательской среды.

  • 16 июл.593166из jdata_blog

    Друзья, привет! Очередные потуги в порождении и последующей поддержке open-source (тут тоже явить на свет — одно, воспитать и вырастить, блин, другое) Обновила XAI Library Navigator (рабочее название, я умнее не придумала). Напомню, что это: Каталог библиотек для интерпретируемости ML/DL/LM. Включает MechInt и классический XAI. Есть фильтр по парадигме, модальности и типу метода, а ещё по тому, как давно библиотека обновлялась (читать — поддерживается ли она). Сейчас в ней (или в нём, потому что я не определилась — навигарта это или просто табличка) 57 либ. Что нового: добавила свежие инструменты по механистической интерпретации — SMDS (feature manifold discovery в LLM), circuit-tracer (attribution graphs через транскодеры), sparsify и delphi от EleutherAI, Llamascopium (OpenMOSS) и Penzai (DeepMind). Плюс звёзды и даты последнего коммита обновила. Табличка собрана на стримлите https://xai-table.streamlit.app . Впрочем, раньше она собиралась на гугл диске. Если знаете библиотеку, которой не хватает, то кидайте через форму «Suggest a Library» — добавлю. И если можете пошерить, то было бы круто! Это очень больно — искать рабочую либу, так что пусть в мире будет поменьше боли : ) #xai_navi

  • 15 июл.5312321из econets

    видео или голосовое, без подписи

  • О радость! О радость взаимного цитирования!

  • О радость! О радость взаимного цитирования!

  • 10 июл.1 6804823

    A genealogy of AI safety: how directions are born, and how they die (2005-2026) Мне тут на Хабре в коментах с претензией отметили, что у меня опять уроки истории. А я в ответ обнаружила, что я капец некромантка. Люблю поднять мертвое. Потому что искренне верю: нельзя сделать прорыв, не поняв, как умные люди до тебя дошли до текущей идеи. Я не верю в быстрые рецепты. Если кто-то пытается продать мне быстрый рецепт без душного разбора, почему рецепт вообще должен сработать, я записываю продавана в инфоцыгане. Да, я душная. Да, я считаю, что нам сильно недопреподали философию науки в школе. "Из-за таких вот идей мы сюда и загремели" (с) капитан Джек Воробей. Так что я расчехлила некромантские техники и подняла архив интернета. Получилась генеалогия области AI Safety - с рождением и умиранием направлений, и даже с деньгами, аж с 2005 года. Что внутри: • 323 задокументированных события, 129 акторов, 18 направлений, с 2005 по июнь 2026 • деньги и внимание систематически не совпадают: научного внимания к interpretability примерно в 37 раз больше, чем предсказывал бы ее ~$1 млн грантов • государственные деньги тихо обогнали филантропию к 2023 • слово "Safety" потихоньку уходит из названий (UK AI Safety Institute стал AI Security Institute, и так далее) • уйти в тишину не значит умереть: направления чаще растворяются или уходят в фон, чем реально умирают Все интерактивные карты живые.

  • 9 июл.629395

    Claude is AI and can make mistakes. Please double-check responses. я тут подумала, что надо для себя писать что-то вроде Elena is EI and can make mistakes. Please double-check responses. ибо а чего ему можно?)

  • Channel name was changed to «Mrs Wallbreaker»

  • 3 июл.4 26242106

    Котятки, тут такое. Пока разбиралась, куда самой податься на финансирование по AI safety, я свела все открытые гранты, фонды, compute-кредиты и fellowships в одну большую карту. Получилось прилично - от «горит, дедлайн через неделю» до «откроется осенью, готовься заранее». Раз уж все равно собрала - делюсь. Пусть кому-то повезет )) Что горит прямо сейчас: grantmaking.ai — раунд $1M ($5k–$50k), приоритет 13 июля / закрытие 27 июля, через Manifund Heron AI Security — 8 июля (без стипендии, для кибербез-специалистов) GovAI DC и UK Winter Fellowship 2027 + ARENA 9.0 — дедлайн 12 июля PIBBSS Winter Fellowship — 20 июля, $3k/мес + жилье (Кейптаун) PIBBSS × Iliad Fellowship — 27 июля, $6k/мес (Лондон) DeepMind × Schmidt Multi-agent AI Safety call — 8 августа, пул до $10M Плюс десятки rolling-грантов (LTFF, Coefficient Giving, Manifund, SFF), compute-кредиты (TRC, Prime Intellect, fal.ai, HF) и осенние программы (MATS, SPAR, CHAI, AI Safety Camp). Вся карта тут, с суммами, дедлайнами и ссылками (живой документ, буду обновлять) Дисклеймер: суммы и дедлайны меняются, перед подачей сверяйтесь на официальной странице. Санкционные, визовые и налоговые нюансы у каждого фонда свои - уточняйте отдельно.

Mrs Wallbreaker — tgindex