tgindex
Цифровой гуманитарий | Кружок КФУ

Цифровой гуманитарий | Кружок КФУ

Статистика
@digitalhumankfuрусский

Digital Humanities для всех - все, что связано с работой профильного кружка Казанского университета

Последний пост
16 июн.
Последнее чтение
18:45
Постов за неделю
0
Всего постов
22
Тип
открытый
Язык
русский
В каталоге с
14 авг.
Подписчики
107
0 за 2 дн.
Сутки
0
0,00%
Неделя
 
Месяц
 
Просмотров на пост
77
22 постов
Вовлечённость
72,0%
к подписчикам
Постов в день
0,0
всего 22
Упоминаний
0
каналов
Охват размещения
оценка
1/24сутки в ленте
1/48двое суток
1/72трое суток

Оценка по просмотрам недавних постов: пост набирает почти всё за первые сутки.

Посты

  • 16 июн.4033из dhcloud

    Опубликован Русский стилеметрический датасет. Это собрание готовых наборов текстов для исследований и учебных занятий. Датасет позволяет ученым и педагогам не тратить время и силы на подбор текстов для тестирования своих методик или для подготовки к работе над темой стилеметрии в классе. Все включенные в датасет тексты находятся в общественном достоянии и распределены по подкорпусам, ориентированным на специфические задачи: ↪️ Художественная проза по периодам (XVIII, XIX – первая/вторая половина, рубеж XIX–XX вв.) ↪️ Тексты по полу, возрасту и поколению авторов ↪️ Публицистика и научные тексты (история, богословие, психофизиология, философия) ↪️ Жанровая классификация ↪️ Литературные и идеологические направления (романтизм vs реализм, западники vs славянофилы) ↪️ Стих и проза (включая стихотворные размеры) ↪️ Речь персонажей (из прозы и драматургии) ↪️ Сгенерированные тексты (LSTM и GPT) (всего 25 подкорпусов) Объем датасета: 322 документа, ~16 млн слов, 94 автора. Тексты оптимизированы для работы в stylo, что не ограничивает в работе с другими инструментами. Формат файлов: plain text, кодировка UTF-8. Схема именования: автор_название.txt, что позволяет пакету stylo автоматически выделять одним цветом тексты, принадлежащие одному классу (например, одному автору). Каждый подкорпус содержит сопроводительный файл README.md с описанием кодировки названий и указанием источников, а также файл corpus.tsv с метаданными в машиночитаемой форме. Для проверки консистентности данных и отсутствия дубликатов в состав включен набор автоматических тестов (tests/). DOI: 10.5281/zenodo.20701309

  • 13 июн.47из schonenrede

    👍 Друзья, моя книга Электронная лира. Как и зачем искусственный интеллект пишет стихи? официально вышла и доступна для покупки на сайте издательства. С этой недели она разойдется и по некоторым оффлайн-площадкам. 📖 В центре настоящего издания — явление компьютерной поэзии, описанное во всех деталях и своеобразии. Для этого в исследовании вводятся неформальные определения искусственного интеллекта, поэтического творчества, понимания и смысла, предлагаются критерии сходства текстовой генерации и стихотворных произведений. Экскурс в историю машинной поэзии XX века сопровождается культурологическим комментарием, поясняющим ее социальные и художественные контексты, сходства и различия с творчеством душевнобольных, с игрой в шахматы. Автор монографии объясняет принципы работы современных нейросетей, их возможности в копировании поэтической формы, отношения между порожденными ими произведениями и такими понятиями, как литературная пародия и косплей. Особое внимание уделяется ответам на часто задаваемые вопросы о замене в будущем поэта-человека поэтом-машиной, об авторских правах на компьютерные произведения и др. Для привлечения внимания прикладываю картинку с обложкой, перерисованной под книгу о Гарри Поттере. 👍 Расскажите, пожалуйста, об этой книге всем, кто про нее еще не знает. Вместе преодолеем спираль молчания!

  • 11 июн.47из euspb

    Данные не даны: как источники становятся «данными» в гуманитарных проектах 🌻 В новом выпуске подкаста Александра Митюкова (хранитель музейных предметов и научный сотрудник Государственного музея-заповедника «Царское Село», DH-исследовательница и преподавательница цифровых методов в Школе искусств и культурного наследия ЕУСПб) и Полина Колозариди (исследовательница интернета и цифровых технологий на стыке STS и цифровой гуманитаристики, директор DH-центра ИТМО, старший научный сотрудник STS-центра ЕУСПб) обсуждают, как материалы и источники превращаются в «данные» и на каких основаниях строятся классификации, категории и каноны, которые затем начинают направлять исследовательский взгляд Говорим о рисках нерефлексивной датафикации, почему данные не существуют сами по себе, можно ли вообще говорить об «объективных данных» и где проходит граница между ИИ как инструментом и ИИ как со-исследователем Подкаст создан Центром практической философии "Стасис" и Лабораторией "Искусство и искусственный интеллект" ЕУСПБ 🎬 Слушать подкаст

  • 4 июн.592из dhcloud

    Выпущен язык разметки стихов: VML (неофициальное название: "веймелка") https://github.com/nevmenandr/VML Язык предназначен для структурированного представления стихотворных текстов в процессе их подготовки для последующего компьютерного анализа. Он спроектирован как минималистичный и дружественный к гуманитариям: Синтаксис стремится к ненавязчивости: теги по возможности короткие, а разметка не загромождает поэтический текст, сохраняя его удобочитаемость для человека. Обязательные теги сведены к двум (<a>, <&>), остальные опциональны. Большинство тегов одинарные, то есть в отличие от языков на основе XML не требуют закрывающей пары. Пример минимально валидного VML-документа: <a> Мацуо Басё <&> «Осень уже пришла!» — Шепнул мне на ухо ветер, Подкравшись к постели моей. Основная цель VML — обеспечить однозначное разграничение функционально различных частей стихотворного текста при его цифровой фиксации. В отличие от универсальных языков разметки (HTML, XML, Markdown) или форматов простого текста, VML фокусируется на специфических элементах поэтического произведения, значимых для формального и квантитативного анализа.

  • 🙂 «Не Берроузом единым…» – уже в сети! Делимся новой записью научно-методического семинара «Цифровая среда» ИЦГИ СФУ с докладом Антона Афанасьева, Рината Бакирова и Владимира Бочкарева (КФУ) об альтернативных инструментах стилометрии. Смотрим выпуск и расширяем привычный исследовательский арсенал: 🔜 YouTube 🔜 VK Видео 🔜 RuTube #цифроваясреда #инструменты #стилометрия #людиdh

  • 26 мая471из dhcloud

    📢 Вышел новый номер «Цифровых гуманитарных исследований» (2026 №1)! 🧙 Еще глубже погружаемся в мир DH — от поэзии Вознесенского до уличного искусства в метавселенных и искусственного интеллекта в науке. 🔍 Что внутри: 📌 ИССЛЕДОВАНИЯ 🧙 Дарья Тюрякова-Матвеева проанализировала 1678 произведений Андрея Вознесенского с помощью NER, LLM и сетевого анализа. Кого поэт упоминал чаще всего? Пастернака, Пушкина, Маяковского… и самого себя. 🧙 Мария Акимова и Полина Кныш — о том, переезжает ли аура стрит-арта в цифру: от архивов RAAN до метавселенных Spatial. Бетон и бит, оригинал и копия. 🧙 Мария Богданович — обзор провенанс-исследований в библиотеках Германии: MARC, T-PRO, CIDOC-CRM и как цифра помогает искать «следы» книг. 🧙 Василий Глущенко — как в 1990–2000‑х герменевтика античного текста превратилась из «книги на экране» в «универсум в базе данных» (TEI, EpiDoc, Homer Multitext). 📌 ХРОНИКА 🧙 Мария Романюк — острый репортаж с семинара «Гуманитарное знание + Алгоритмическая рациональность = ?!.» (ИИ в DH: текстогенерация, распознавание рукописей, 3D-реконструкции). 📌 IN MEMORIAM 🧙 Андрей Володин — об Александре Борисовиче Антопольском (1943–2026), пионере отечественной информатики, создателе справочных систем по DH. 📌 РЕЦЕНЗИИ 🧙 Андрей Володин — на книгу Юлии Юмашевой «Источниковедение информационной эпохи». 🧙 Полина Колозариди — на книгу Лейфа Визерби «Language Machines: Cultural AI and the End of Remainder Humanism». 🧙 Борис Орехов — на книгу Марка Марино «Critical Code Studies».

  • 14 мая511из DHRIsfu

    20 мая ждем вас на очередном заседании научного семинара «Цифровая среда». У нас в гостях – исследователи из Казанского федерального университета Антон Афанасьев, Ринат Бакиров и Владимир Бочкарев с докладом «Не Берроузом единым: альтернативные инструменты стилометрии». Стилометрия помогает находить стилистические сходства между текстами и определять особенности авторского письма. Метод Дельты Джона Берроуза считается классическим инструментом, но сегодня исследователи все чаще обращаются и к другим подходам. В докладе речь пойдет о том, как разные метрики работают в задачах стилометрического анализа. Авторы сравнят традиционные методы с менее распространенными решениями – в частности, коэффициентом ранговой корреляции Спирмена и дивергенцией Йенсена-Шеннона. Обсудим и поспорим о том, какие инструменты могут оказаться особенно перспективными для стилометрии. 🕓 20 мая в 15:00 (Москва) / 19:00 (Красноярск) 🔜 Зарегистрироваться на семинар

  • 20 апр.692из dhcloud

    Вышла статья, с помощью количественных методов подтверждающая авторство М. М. Бахтина для текстов, которые ранее считались спорными. Авторы, Б. В. Орехов и А. Г. Василенко, применили широко распространенный в Digital Humanities метод Delta Берроуза для вычисления межтекстового расстояния книг «Фрейдизм. Критический очерк» (1927), «Марксизм и философия языка. Основные проблемы социологического метода в науке о языке» (1929), подписанных при публикации В. Н. Волошиновым и «Формальный метод в литературоведении» (1928), подписанной П. Н. Медведевым. Результаты исследования приводят к однозначному выводу о том, что все эти труды принадлежат перу М. М. Бахтина. Но этим общим выводом статья не ограничивается. За время дискуссии, которая длилась несколько десятков лет и приобрела название «бахтинского вопроса», несколько раз высказывалась точка зрения, что количественные методы для решения этой проблемы не применимы, поскольку круг Бахтина представлял собой интеллектуальное сообщество тесно взаимодействующих между собой участников, обменивающихся идеями и приходящими в итоге к очень похожим стилистическим установкам. Авторы статьи на материале Московской фонологической школы, Женевской лингвистической школы, ОПОЯЗа и Йенского романтизма опровергают это утверждение, показывая, что даже авторы, входящие в такого рода кружки, сохраняют стилистическую индивидуальность, вполне различимую для количественных методов. Ссылки: Орехов Б. В., Василенко А. Г. Количественная атрибуция и «бахтинский круг»: проблема авторства в интеллектуальных сообществах // Новый филологический вестник. 2026. № 1. С. 40–55. https://nevmenandr.github.io/portfolio/assets/pdf/bakhtin_delta.pdf

  • 11 апр.802из sysblok

    Как живут книжные клубы онлайн: от дискуссий в зуме до геймификации 📚💻 Дочитанная книга редко заканчивается вместе с последней страницей. Обычно хочется продолжения — обсудить, поспорить, сверить свои впечатления с чужими. Раньше для этого нужно было попасть на встречу офлайн-клуба. Теперь достаточно открыть Telegram или VK. Цифровые книжные клубы устроены иначе, чем привычные «собрались раз в месяц и поговорили». Обсуждение здесь растягивается во времени: кто-то пишет сразу по ходу чтения, кто-то — через несколько дней, и разговор не обрывается, а постепенно нарастает. В этом смысле чтение становится процессом, а не событием. Исследователи называют это digital social reading — социальное чтение в цифровой среде, где интерпретации не исчезают, а накапливаются и переплетаются. При этом формат может быть очень разным. Где-то все собираются синхронно в зуме и обсуждают книгу «вживую» — почти как раньше, только через экран. Где-то диалог полностью асинхронный: чат, комментарии, голосовые, к которым можно вернуться в любой момент. Есть клубы с подпиской и четкой организацией — с модерацией, приглашенными спикерами и даже геймификацией. А есть некоммерческие сообщества, которые держатся на чистом энтузиазме. При всей разнице форм у клубов есть общее: они возвращают чтению социальное измерение, которого многим не хватает в одиночном «скроллинге текста». Как именно устроены сетевые книжные клубы на примере 55 сообществ в Telegram и VK, какие форматы в них доминируют и какие бывают неожиданные гибриды (от коллективного чтения вслух до «геймифицированных» книжных экосистем) — читайте в полной версии статьи. Подготовлено в соавторстве с DH-центром ИТМО. 🤖 «Системный Блокъ» @sysblok

  • 29 мар.771из sysblok

    Как пользоваться NotebookLM от Google Подготовиться к экзамену, изучить новую тему, создать базу знаний… Если вам становится не по себе от этого списка — открывайте гайд «Системного Блока», где мы рассказываем про NotebookLM — ИИ-инструмент, который поможет вам в решении рабочих, учебных и исследовательских задач. Еще один блокнот — или нечто большее? Google описывает NotebookLM как «ИИ-помощник в исследованиях». Как начать им пользоваться? Для каждого нового проекта нужно создать блокнот, в который загружаются статьи, отчеты, заметки, видео. Теперь вы можете задавать вопросы к этим материалам, и все ответы будут генерироваться на их основе. Основное взаимодействие происходит через чат, как и в других ИИ-ассистентах. NotebookLM работает на языковых моделях Google — Gemini Pro и Gemini Pro Flash. В основе лежит RAG-архитектура (Retrieval-Augmented Generation) — технология, которая сначала извлекает релевантные фрагменты из ваших документов, а затем генерирует ответ на их основе. Подробнее о RAG мы рассказывали в глоссарии. Дополнительные функции NotebookLM • генерация подкастов по вашим материалам • создание mind maps (интеллект-карт) • формирование карточек для запоминания • сохранение важных ответов в виде заметок, которые можно объединять Поддерживаемые форматы NotebookLM работает с PDF, Google Docs, презентациями, аудио-, видео- и текстовыми файлами, веб-ссылками (включая транскрипты видео с YouTube). Кому это будет полезно NotebookLM пригодится всем, кто работает с большими объёмами информации: • исследователям и аспирантам для анализа научной литературы • преподавателям для подготовки учебных материалов и курсов • студентам для работы с лекциями и подготовки к экзаменам • журналистам для обработки интервью, документов и справочных материалов • информационным работникам • аналитикам, консультантам, всем, кто ежедневно работает с документами В гайде мы даем пошаговую инструкцию для эффективной работы NotebookLM и разбираем задачу поиска информации в исследовательской литературе. 🤖 «Системный Блокъ» @sysblok

  • видео или голосовое, без подписи

  • видео или голосовое, без подписи

  • видео или голосовое, без подписи

  • видео или голосовое, без подписи

  • видео или голосовое, без подписи

  • видео или голосовое, без подписи

  • 26 мар.944из digital_optimist

    🚩🚩20 марта 2026 года в Институте международных отношений, истории и востоковедения КФУ случилось то, чего мы так долго ждали. Первая всероссийская научно-практическая конференция «Цифровая гуманитаристика: соединяя традиции и технологии» собрала более 100 участников из 4 стран, 23 городов и 37 научных и образовательных организаций 🚩🚩 Пленарное заседание открылось видеообращением Константина Могилевского, заместителя министра высшего образования и науки РФ, сопредседателя Российского исторического общества. После приветственных слов и.о. заведующего кафедрой регионоведения и цифровой гуманитаристики КФУ Марата Галиуллина и заведующей отделом научно-методической работы Национального музея РТ Маргариты Сафиуллиной начались пленарные доклады: 📍Андрей Володин (МГУ, СФУ) задал тон докладом «DH ≡ Data Humanities: о роли данных в цифровых гуманитарных исследованиях» 📍Елена Баранова и Василиса Еремина (БФУ) показали, как архивное дело превращается в интерактивную картотеку на примере веб-ресурса «Кавалеры медали «За взятие Кенигсберга» – Калининградцы»» 📍Борис Орехов (ИРЛИ РАН) погрузил нас в концепцию Distant Reading Франко Моретти, связав её с идеями русского формализма 📍Альбина Имамутдинова («Академия ТОП Казань») поделилась опытом подготовки IT-лидеров на стыке технологий и гуманитарного знания 📍Луиза Каримова (КФУ) затронула тему цифрового разрыва в историческом образовании Работа конференции проходила в четырех секциях: «Проблемное поле цифровой гуманитаристики», «Методы и инструменты цифровой гуманитаристики», «Проблемы цифровой грамотности гуманитариев», «Публичные и краудсорсинговые проекты в области цифровой гуманитаристики». И вот конференция завершилась, но работа только начинается, ведь по результатам будет издан электронный сборник материалов (РИНЦ) 🐸 А вы были на конференции? Или следили за трансляцией? А может, не попали, но очень хотели бы в следующий раз? 👾 Выступал(а) — в таком случае будем рады впечатлениям в комментариях 🐹 Слушал(а)— тогда пишите, какой доклад запомнился больше всего 💀 Следил(а) онлайн — ну и как вам конференция? ❤️ Хочу принять участие в следующем году — будем ждать ваших заявок И главный вопрос: чего не хватило в программе? Давайте обсуждать, ведь это только начало 😎 Фото тут 📷 #Бесплатный_кофе@digital_optimist

  • 25 мар.672из problems_with_poetics

    Дорогие друзья и подруги! ⭐️ Мы официально анонсируем круглый стол «По(с)ле акторно-сетевой теории: бардак в гуманитарных науках» 🗓 Круглый стол пройдет в эту субботу, 28 марта, с 11:00 до 19:00, в 228 ауд. (7к. РГГУ) ❗️ Если вы не из РГГУ и хотите прийти в качестве гостя/присоединиться дистанционно, вы можете написать в личные сообщения организаторке @fantalinha до 27 марта До встречи на мероприятии! ❤️ Подписывайтесь на наши соцсети

  • 12 мар.981из rantiquity

    На днях набрела на несколько любопытных статей (2023-2025 г.), в которых описывается феномен "деградации контекста" (context rot). Смысл такой: если вы отдали кучу денег за возможность скармливать LLM кучу токенов, то ваши деньги, скорее всего, ушли на ветер. Почему? Во-первых, информация из середины длинного контекста усваивается значительно хуже, чем из начала или конца. Во-вторых, даже если модель смогла извлечь релевантную информацию, способность ее обработать тем ниже, чем больше "окно". Наконец, если релевантная информация сильно "разбавлена" (потеряна как иголка в стоге сена), то модели с трудом выделяют ее из общей массы, и качество ответа падает. О том, что с этим делать гуманитарию, который разучился читать, мы с @curiousonya скоро расскажем, stay tuned 💅 Свой вариант в комментариях? #llm

  • видео или голосовое, без подписи

Цифровой гуманитарий | Кружок КФУ — tgindex