tgindex
Метод серого ящика

Метод серого ящика

Статистика

Привет! Кто сказал, что гуманитарий не может быть айтишником? Это канал помощи историкам по сбору материалов. Меня зовут Миша Маклаков, я играл с технологиями и победил. Пиши мне за помощью @mikhailmclakov Vivat academia!

Последний пост
3 авг.
Последнее чтение
19:38
Постов за неделю
0
Всего постов
20
Тип
открытый
Язык
русский
Категория
Технологии
В каталоге с
12 авг.
Подписчики
90
0 за 4 дн.
Сутки
0
0,00%
Неделя
 
Месяц
 
Просмотров на пост
184
20 постов
Вовлечённость
204,4%
к подписчикам
Постов в день
0,0
всего 20
Упоминаний
1
каналов
Охват размещения
оценка
1/24сутки в ленте
47
1/48двое суток
53
1/72трое суток
58

Оценка по просмотрам недавних постов: пост набирает почти всё за первые сутки.

Посты

  • Гиковская сторона меня приходит в восторг от таких размышлений/новостей/кейсов, а какая-то другая сторона вспоминает человеческий "намордник". Вообще, это звукоизолирующая маска для голоса, но выглядит крипово

  • Как использовать ИИ в истории? Сделал небольшое исследование об исторических подходах в LLM-моделях на русском языке. Специально использовал простейший промтп без дополнительных указаний, потому что было интересно, что модель будет делать сама по себе. Скину презу, когда-нибудь напишу нормальный текст. Пока краткие выводы такие: 1. LLM-модель не создаёт новые историографические положения без дополнительного указания, действует скорее, нарративно. Здорово обобщает источник, но не знает контекст событий. 2. Не умеет в цитирование. 3. В STS-подходе "любит" Латура и Каллон, Сьюзан Ли Стар и Шейлу Джаcанофф; В гендерных исследованиях - Дороти Нортон Рэй Коннелл, Джон Скотт, Сандра Хардинг, Лилиан Садер, Мэрилин Янг  В исследованиях памяти - А. Ассман, П. Нора, Хальбвакс (прям по учебнику); В экологической истории больше миксует, но можно определить следы Уорстера, Забелина, Кросби и Вернадского Попробовал ещё несколько подходов, они в презентации.

  • 1 мая194112

    Изобретаю велосипед Созвонились с дружбаном пару дней назад, а он мне говорит: "Диссер дописываю..., мне бы все статьи о взаимодействии человека и природы из газеты "Наука в Сибири". Вопросов нет. Милая иишка, напиши нам код, который с помощью поиска по словам раскидает массив данных по трём кластерам. Для поиска нужны слова: "природ", "эколог", "окружающ", "охрана природы", "загрязн", "атмосфер", "лесопарк", "озелен". Результат: около 11 тысяч статей. Начинаем отсматривать, результат не устраивает, потому что большинство статей содержит одно слово "природа", а на самом деле о ядерной физике, ect. И будь это количественный анализ - дело шло бы по-другому. Спустя пару часов тыкания мы набрели на метод "score-карты", в котором за определённые искомые комбинации статье назначается условно +балл, а за упоминания ненужной информации -балл. В финале массив ранжируется по рейтингу. Дорогие подписчики, не изобрели ли мы велосипед? И, может, есть более совершенные способы работы?

  • видео или голосовое, без подписи

  • +1
    30 мар.22041из americanbookz

    «Студентам рассказывают о недостатках “мыслящих машин”» Автор: Дж. Гетце. "Лос-Анджелес Таймс" 10 ноября 1962 г. с. 6. В газетной статье 63-летней давности рассказывается о выступлении главы факультета физических наук Чикагского университета Д-ра Абрахама Альберта на 4-й ежегодной молодежной конференции. Статья примечательна тем, что автор упоминает понятие ИИ ("artificial intellect"). Причем, Альберт раскритиковал "искусственный интеллект" новейших на тот момент компьютеров, делающих только лишь то, что человек приказывает сделать. Известный алгебраист, родители которого эмигрировали из Российской империи, сообщил учащимся, что, несмотря на высокую скорость обработки данных и значительные объемы запоминаемой информации, вычислительные машины лишены самостоятельного мышления. На фото: скан газетной статьи и компьютеры установленные в Национальном управлении по аэронавтике и исследованию космического пространства США (NASA) в начале 1960-х гг. https://catalog.archives.gov/id/278195

  • 27 марта выступаю на конференции в ИТМО. Приходите, подключаетесь, буду рефлексировать о роли историка в эпоху искусственного интеллекта

  • Рубрика полезное Недавно встретил на просторах GitHubа репозиторий Agency agents, в котором умельцы собрали разные промпты для ии. В самом низу есть материалы полезные нашему брату: промпты для историков и антропологов. Кто хотел поиграться или сделать что-то более внятное - велком Я подумал об историческом промпте краем мозга: в инструкции в основном указания, связанные с валидацией и верификацией источника, что хорошо увязывается с мыслью о демаркации исторической науки. Однако ничего нет про нарратив, хочется рассказывать истории. Мы ж историки)

  • 27 марта выступаю на конференции в ИТМО. Приходите, подключаетесь, буду рефлексировать о роли историка в эпоху искусственного интеллекта

  • К разговору о локальных LLM Для поиска и анализа больших источниковых корпусов не хватит никаких платных моделей. В комментах в недавнем посте считал, что "Правда" занимает примерно 2,7 млн знаков, что в токенах больше 5 млн. Нашёл классный сайт, который показывает какую языковую модель может потянуть ваше устройство локально. Сначала зашёл с телефона, мне написали, что ничего не потянет. Жоль.

  • 16 мар.15741из chronsilva

    Как нам подсказывает изучение "большой науки", она действительно становится "большой" лишь тогда, когда любые исследования встроены в сети коммуникации с коллегами. Самый очевидный формат такой коммуникации - конференции. Наши герои знали в этом толк и проводили множество симпозиумов в научных городах. Взять хотя бы конгресс по математике в Новосибирском Академгородке 1963 года. Не отставая от наших героев, авторы канала также решили провести крупный конгресс историков науки. Мы приглашаем всех желающих присоединиться к конференции "Наукограду и миру: глокальность большой науки", которая состоится 5-7 июня 2026 в НИУ ВШЭ Санкт-Петербург. Рамка глокальности нам кажется весьма подходящей для разговора о большой науке, ее глобальных тенденциях и особенностях. Мы хотели бы обсудить в рамках конференции социалистическую и постсоциалистическую науку, ее пространственное измерение, политэкономию и социальную историю. Заявки принимаются до 27 апреля по адресу trakov@hse.ru Более подробную информацию можно найти по ссылке а также в информационном письме, которое прикрепляем в комментарии к этому посту. На фото: фрагмент барельефа "Становление Человека Разумного" Э. Неизвестного, размещенного в МИЭТ в Зеленограде

  • видео или голосовое, без подписи

  • Случилось то, что обсуждали в комментах выше: у меня кончились токены, осталось только на Composer 1.5 и GPT-5.4. Посмотрим, что сделали в плане текстов они. Конечно, важно нормально прописывать промпт, что у меня не очень получилось. Давайте посмотрим. Мини-статьи в файлах, промпт закину в комменты. Наверное, там слишком много уделено внимания историографии, что мне кажется важным в исследовательской работе. От этого тексты получились "странные". Что думаете? А, ну и сноски хромают, но я не прописывал гостовский формат в требованиях. PS: если у меня когда-нибудь выйдет статья про новогодние поздравления, знайте, я сошёл с ума писал сам

  • ИИ уже умеет делать исследования в социальных науках лучше, чем большинство профессоров Давно ничего не писал сюда. Мнение по поводу заголовка: очень может быть. Видел пост социолога Александра Кустова о роли ИИ в социальных науках. Ребята из Эффекта Матфея его тоже обсуждали. Эпоха неуклюжего чатагпт с его "Ты. Очень. Умный. Хочешь я сделаю краткую выжимку твоих тезисов" прошла. Давайте поставим эксперимент. У меня есть "Правда" (и "Труд" за 2 копейки") за 1955 - 1991, пусть будет послесталинский СССР. Да, не хватает 1954 года, но мы не диссертацию пишем. Однако всё же ограничимся 1985 чисто для приличия. Что изучаем? Всегда были интересны новогодние поздравления. Вытащим их с помощью моего метода, дополнительно в промпте пропишем, что интересна риторика руководителей государства. В темпе вальса создаём единицы наблюдения. В качестве подхода возьмём что-нибудь из Юрчака, на вкус нейросети, он тоже есть в моей базе. Наверное, нужна какая-то историография по риторике, праздникам и поздравлениям. Кину в комменты, что нашлось быстрым гуглением. Дальше используем несколько ИИ-моделей для написания 10000 знаков аналитики. В списке будет: Composer 1.5, Sonnet 4.6, GPT-5.4, Gemini 3 Pro. Летс гоу, май френдс!

  • 1. Расширение для работы с Яндекс Архивом. Удобно, одной кнопкой можно скачать страницу архива. Расширение понимает, где в структуре веб-страницы картинка и работает с ней. А там же ещё есть текст, что самое интересное. Если приложить некоторое количество собственных усилий и сил искусственного интеллекта, то парсер легко меняется с загрузки картинки на загрузку текста. 2. Расширение tampermonkey, которое способно запускать скрипты локально в браузере. Лучше всего работает в мозиле или хроме. Я прикреплю скрипт для примера. Чтобы установить и работать: • Установите расширение в браузер, включите его. • Найдите цель. • Попросите любую ии доработать мой скрипт под ваши задачи. Сейчас он настроен на автоматическую загрузку одной газеты. • Откройте ваш скрипт через браузер, tampermonkey должен сам предложить его установить. • Проверьте, что скрипт включен, обновите страницу, внизу справа должно появиться окно с задачей. • Вы великолепны

  • Парсинг, парсинг... Как создать собственную источниковую базу, сохранив целые издания на диск? Большинство государственных онлайн-хранилищ источников в России считают, что автоматическая загрузка больших массивов с их сайтов не является законной, так как библиотеки созданы для "просмотра, цитирования и ограниченного скачивания материалов". Время от времени я обнаруживаю, что это не только утверждение, но ещё и действие, например, в газеты подвязаны к динамическому URL. Что на практике означает постоянное обновление страницы, ну а дальше блокировка, потому что таким занимаются только боты. Однако один мой сингапурский друг рассказал мне о паре инструментов, которые способны облегчить жизнь, которые я покажу в посте ниже.

  • видео или голосовое, без подписи

  • видео или голосовое, без подписи

  • +2

    А робот сочинит симфонию Никакой код или ии-шка не приедут в Иркутск. И не смогут пойти по архивам. Поэтому тут мы)

  • Когда технологии не помогают Задумали мы с товарищами лет пару назад статью про советское озеленение. Достали спутниковые изображения. Кстати, вы знали, что с американских спутников сделаны отличного качества снимки советских городов? Разметили это добро, присвоили индексы. А дальше возник вопрос: что считать? Нашли чудом телефонную книгу за 1974 год по Новосибирску. Дальше всего ничего, работы на пару суток, если не вылезать из ноутбука. Нужно: 1) сделать список всех улиц по Академгородку; 2) найти жителей по адресам на этих улицах; 3) по имеющимся открытым источникам установить социальный статус жителей Академгородка. В общем, решаемо. Только глаза выпадут. Окей. Как было в хорошем меме: текнолоджия! С первым пунктом - понятно, делается лапками. Однако сидеть и искать по всем улицам (они не собраны вместе, список идёт по фамилиям) - такое не подходит. Вот примерно на этом моменте текнолоджия подвела. На скриншоте покажу, как выглядит оцифрованный телефонный справочник. Печаль-беда.

  • Что я делаю? Вчера ко мне обратилась подписчица с просьбой проанализировать «Русский фольклор: материалы и исследования» - многотомный сборник статей по разным направлениям фольклористики. Она искала публикации об экспедициях в Пинежский район Архангельской области за всё время. Я провёл подготовку источника и запустил программу. Пару часов ушло на парсинг сборника, десять минут на анализ. Потом скинул готовый pdf-файл с цитатами и ссылками. Если хотите попробовать такой метод на своих источниках и сэкономить часы на рутинной разметке — напишите в личку слово «ЕН». Расскажу, как это можно применить именно к вашим материалам, и предложу пробный мини‑пакет из 5–10 единиц. Без обязательств, просто для теста метода)

Метод серого ящика — tgindex