DH CLOUD
описание
Делаем то, что считаем нужным, не теряя того, что считаем ценным
851
подписчиков
Охват к подписчикам
119,7%
ERR
Реакции к просмотрам
0,88%
211 на 25 постов
Пересылки к просмотрам
1,57%
376
Постов в день
0,0
всего 25
Где отзываются чаще
доля реакций к просмотрам- 26 июл.Муза с перфокартами: читаем главу из новой книги Бориса Орехова Генеративная поэзия появилась задолго до ChatGPT. Более того, идея машины, которая сама пишет стихи, возникла за столетия до компьютеров. Ее можно встретить не только в фантастических произведениях, но и в научных и философских сочинениях. С разрешения автора мы публикуем на сайте главу из новой книги филолога Бориса Орехова «Электронная лира», а здесь — собрали пять самых любопытных фактов из нее. Машину для сочинения стихов высмеял Джонатан Свифт еще в XVIII веке В «Путешествиях Гулливера» Джонатан Свифт описал устройство, которое случайным образом переставляло слова и позволяло любому человеку «писать книги по философии, поэзии и праву». Это была сатира, но принцип оказался удивительно похож на то, как позже работали первые генераторы текста. В XIX веке существовал механический «поэт» В 1845 году англичанин Джон Кларк представил устройство «Эврика», которое составляло латинские гекзаметры со скоростью одна строка в минуту. Современники признали машину грамматически безупречной, но практически бесполезной — разве что для развлечения школьников. Первые «компьютерные стихи» были газетной шуткой В 1956 году американский журнал опубликовал юмористический рассказ о вымышленной машине, сочиняющей стихи. В СССР попал вольный перевод этого текста без пояснений. Пионеры отечественной кибернетики приняли его за настоящий эксперимент и много лет цитировали как пример машинной поэзии, хотя компьютеры тогда еще стихов не писали. Первым настоящим компьютерным поэтом стал немецкий математик В 1959 году Тео Лутц загрузил в компьютер словарь, составленный по роману Кафки «Замок», и заставил программу случайным образом строить предложения. Получались строки вроде: «Не каждый взгляд близок. Ни одна деревня не запоздала. Замок свободен, и каждый крестьянин далек». Лутца интересовала не поэзия сама по себе, а возможность показать, что компьютер способен работать не только с числами. У истоков компьютерной поэзии стояли европейские художники Румыно-французский художник Брайон Гайсин, итальянец Нанни Балестрини и немец Руль Гунзенхаузер использовали компьютер как соавтора еще в начале 1960-х. Их программы либо случайно переставляли слова и фразы, либо заполняли грамматические шаблоны словами из заранее подготовленного словаря. Именно эти два подхода стали основой большинства ранних генераторов стихов. Компьютеры начали писать стихи не потому, что научились понимать язык, а потому, что научились комбинировать слова по правилам. До современных нейросетей оставались десятилетия, но многие идеи, лежащие в основе генерации текста, появились именно тогда. Полный текст главы из книги «Электронная лира» и стихи, сочиненные компьютером, уже на сайте. Время чтения: 12 минут 🤖 «Системный Блокъ» @sysblok2,68%
- 17 июл.⚠️ ОСТОРОЖНО: ЗАКОН ОБ ИИ 👍 Новый выпуск — о юридическом событии года, которое касается всех. Обсуждаем закон об искусственном интеллекте с доктором юридических наук, руководителем проекта «Сохраненная культура» Виктором Борисовичем Наумовым. Закон принят, но всё ли в нём так хорошо? ⚡️ Законопроект Минцифры — о поддержке технологий. Но поддержка эта адресована всего нескольким игрокам. ⚡️ Определение ИИ через «превосходство над человеком» — философски и юридически сомнительно. ⚡️ Маркировка контента, право на отказ и обжалование решений ИИ — исчезли из финальной версии. Это проблема. Смотреть: На 📺 Ютубе, в 🌍 ВК Видео, на 🗣 Рутубе, в 🌐 Дзене. 0:00 Приветствие и знакомство с гостем 0:20 Можно ли менять жизненные принципы? (начало ответа гостя) 1:36 Почему закон лучше, чем его отсутствие? 2:53 Целеполагание в законах и качество нормативных актов 4:05 Как давно в мире начали регулировать ИИ? 5:04 Указ президента 2019 года и концепция 2020 года 6:09 Гонка за ИИ в России: две линии разработки 7:43 Конкуренция двух моделей регулирования 9:00 Какие сферы регулируются, а какие выведены 9:38 Декларации в законе: ритуал или реальная сила? 11:03 «Орнаментальные конструкции» и нормы прямого действия 12:14 Определение ИИ в книге vs определение в законе 13:59 Имитация когнитивных способностей человека 15:06 Почему определение в законе Минцифры узкое и ошибочное 16:30 Технологии vs развитие человека 17:47 Определение через превосходство над человеком 18:33 Почему сравнение машин с человеком — философская ошибка 19:35 Трансгуманизм и противоречие с духовно-нравственными ценностями 20:50 Испуг или долгоиграющие идеи? 21:54 Опасность закладки трансгуманистических идей на уровне закона 23:26 Примут ли закон быстро ради «флага»? 24:00 Два закона: поддержка технологий и безопасное использование 25:06 Категория «информационная система» как альтернатива 26:02 Разногласия на согласительных встречах 27:17 Модерн, трансгуманизм и исторический контекст 28:32 Требования к обучению: только на территории России 29:33 Кому выгоден закон? Поддержка узкого круга гигантов 31:13 Российские компании не входят в мировой топ-10 32:33 Цифровой феодализм и закрытие технологий в мире 34:01 Кому выгоднее — нескольким феодалам или всей стране? 35:10 Нужен ли государственный искусственный интеллект? 36:35 Атомный проект как пример мобилизации 38:15 Можно ли проверить, на каких данных обучалась модель? 39:37 Национальная и суверенная модели — для двух компаний 41:04 Как проверять трансграничные данные? 42:05 Регулировать не технологии, а безопасное использование 43:30 Чувствительные сферы: соцсфера, госуправление, обслуживание 44:51 Как стать доверенной системой 46:14 Серая зона для органов власти 47:04 Филологический взгляд: ошибки нумерации в законе 48:01 Как часто встречаются юридико-технические ошибки? 49:27 Может ли ИИ помогать находить ошибки в законах? 50:39 Маркировка контента: проблема различия 51:33 Почему обязанность маркировать контент исчезла 52:41 Отсутствие маркировки подрывает творчество 54:06 Идентификация системы: робот должен представляться 55:00 Право на отказ от использования ИИ 56:19 Право обжаловать решения ИИ человеку 57:37 Запрет на использование ИИ при написании законов 59:07 Люди пишут и читают всё меньше 1:00:35 Внутренняя цензура больших языковых моделей 1:02:05 Требования к достоверности данных и результатов 1:03:38 Интеллектуальная собственность и обучение нейросетей 1:06:04 Скандал со сканированием букинистических книг 1:07:30 Ответственность: отсылка к общему законодательству 1:09:17 Как быть с плагиатом? 1:10:25 Можно ли маркировать текст? 1:11:50 Самоцензура моделей и традиционные ценности 1:12:55 Что делать? Закон примут, но его могут переписать 1:13:56 Два закона вместо одного — плохо ли это? 1:15:47 Финальная маркировка: никакая часть подкаста не создана с помощью ИИ #видео2,62%
- 30 мар.В рамках конференции Актуальные правила гуманитарных наук состоялась панель, посвященная журналу 🧙 «Цифровые гуманитарные исследования». Видеозапись разговора, в котором приняли участие главный редактор Борис Орехов и члены редколлегии Полина Колозариди и Андрей Володин, доступна по ссылке: https://vkvideo.ru/video-171987344_456239100 Кроме того, в открытом доступе есть демонстрировавшаяся на панели презентация с итогами деятельности журнала за два прошедших года. Призываем вас делиться информацией о журнале со всеми заинтересованными коллегами, читать статьи (они интересные!) и, конечно, участвовать в его работе — текстами, помощью с рецензированием материалов.2,08%
- 20 нояб. 2024 г.без подписи2,01%
- 9 авг. 2024 г.Интересная дискуссия состоялась на конгрессе DH-2024 на тему «Анализ текста: инструменты и инфраструктура в 2024 году и после». Были представлены следующие инструменты: – Voyant Tools (разработчики приглашают исследователей текстов в Voyant Consortium) – LEAF-Writer semantic text editor – Dynamic Table of Contexts – Lexos – WordCruncher и инфраструктура – магазин приложений от DARIAH – Social Sciences & Humanities Open Marketplace После презентации прошло бурное обсуждение: как повлияет на анализ текстов внедрение машинного обучения? Как пользоваться веб-приложениями, если данных гигабайты? Когда нужно переходить с устаревших инструментов на новые? И главный вопрос: инструмент анализа текста — это специальный интерфейс взаимодействия с данными или самостоятельный набор методов или, быть может, просто черный ящик? На графике, полученном с помощью онлайн-сервиса Voyant Tools, мы видим частотные слова из названий выступлений на конференции DH-2024. #dhконференции #adho #DH2024 #анализтекста #dhинструменты1,71%
- 13 июн.«Электронная лира»: Ваш гид по миру, где нейросети пишут стихи Вышла первая в России книга, которая серьезно и увлекательно отвечает на вопрос, что происходит, когда примитивная железяка (или, если хотите, сложный алгоритм) пытается создавать лирику. 💡 Для гуманитариев: Не стоит бояться. И не нужно думать, что нейростихи — это та же комбинаторика, что и 50 лет назад. Книга филолога и специалиста по цифровым методам демистифицирует ИИ. Вы узнаете, почему компьютерный верлибр долгое время был невозможен в России, как нейросети «косплеят» стиль Пастернака и почему тест Тьюринга в поэзии — это скучно и бесполезно. Книга предлагает не угадывать «человек или машина?», а научиться нейрочтению — видеть в генеративных текстах ключ к пониманию того, как вообще устроена поэзия: от гекзаметра до зауми. 💻 Для программистов: Отложите скучные статьи о точности и функции потерь. Это разговор о том, что вы делаете, на языке гуманитарной науки (и это гораздо интереснее, чем кажется!). Вы проследите эволюцию от «Стихоплюя» и «Кибер-Пушкина» до трансформеров внутри ChatGPT, поймете, почему LSTM выучивают морфемы раньше, чем слова, и как параметр «температура» превращает нейросеть из графомана в авангардиста. А главное — увидите, что ваш код способен не только генерировать тексты, но и ставить глубокие философские вопросы о природе творчества и авторства. О чем еще эта книга: 📚 Почему рифма и ритм — не главное (и что тогда главное?). 📚 Как стихи ИИ оказались неотличимы от бреда душевнобольного и почему это нормально. 📚 Зачем вообще нужна поэзия, если она не приносит пользы (ответ Карла Маркса, Макса Вебера и ChatGPT). 📚 И главное: заменит ли нейросеть живого поэта? Спойлер: нет, но может стать соавтором. Это не технический мануал и не учебник по стиховедению. Это интеллектуальный детектив, в котором нет преступлений, зато есть расследование: феномен машинной поэзии оказывается ветвью истории культуры, попутно заставляя нас по-новому взглянуть на стихи, которые мы читаем и, возможно, пишем сами. 🔥 Для кого: Для всех, кому интересна «магия», скрытая за строчками кода и поэтическими строками. От студентов-филологов до ML-инженеров с гуманитарным любопытством. 📖 Купить и изучить: Книга уже в продаже. Забрать свой экземпляр «Электронной лиры» можно на сайте издательства P.S. Автор обещает: почти никакой линейной регрессии, зато много разговоров о центоне, пародии и воображаемой поэзии.1,70%
- 1 июн.Центр современной культуры «Целинный» (Алматы) приглашает на стажировку в проект DOCUMENTATION. DOCUMENTATION — это цифровая база данных о современном искусстве Центральной Азии. Миссия проекта — сохранение и изучение данных об искусстве с 1985 г. с целью восстановления культурной памяти региона и формирования его идентичности. Сегодня в процессе оцифровки, атрибуции и описания находятся digital, фото- и видеоработы Шай-Зии, Елены и Виктора Воробьевых, арт-группы Kyzyl Tractor и ЦСИ Фонда Сорос. Присылайте резюме на почту documentation@tselinny.org с темой «Стажировка в DOCUMENTATION», если вам интересны: • исследования в области современной культуры и искусства • особенности создания и хранения цифровых коллекций • атрибуция и описание художественных работ. Будет здорово, если у вас есть: • гуманитарное образование • знание английского языка • опыт проведения исследований (научных, академических), создания и ведения проектов в сфере культуры/искусства. Текст взят из инстаграм-канала Целинного.1,69%
- 4 июн.Выпущен язык разметки стихов: VML (неофициальное название: "веймелка") https://github.com/nevmenandr/VML Язык предназначен для структурированного представления стихотворных текстов в процессе их подготовки для последующего компьютерного анализа. Он спроектирован как минималистичный и дружественный к гуманитариям: Синтаксис стремится к ненавязчивости: теги по возможности короткие, а разметка не загромождает поэтический текст, сохраняя его удобочитаемость для человека. Обязательные теги сведены к двум (<a>, <&>), остальные опциональны. Большинство тегов одинарные, то есть в отличие от языков на основе XML не требуют закрывающей пары. Пример минимально валидного VML-документа: <a> Мацуо Басё <&> «Осень уже пришла!» — Шепнул мне на ухо ветер, Подкравшись к постели моей. Основная цель VML — обеспечить однозначное разграничение функционально различных частей стихотворного текста при его цифровой фиксации. В отличие от универсальных языков разметки (HTML, XML, Markdown) или форматов простого текста, VML фокусируется на специфических элементах поэтического произведения, значимых для формального и квантитативного анализа.1,60%
- 21 апр.🙂 О новых направлениях исследований и инструментах для работы с историческими картами За последние десятилетия масштабная цифровизация исторических источников – архивами, библиотеками, музеями и международными исследовательскими консорциумами – радикально изменила поле гуманитарных исследований. Цифровая доступность материалов не только упростила доступ к источникам, но и повлияла на сами исследовательские вопросы. Сегодня ученые все чаще работают с большими массивами данных, используя подходы distant reading/distant viewing, thick mapping/deep mapping. Цифровой поворот привел к пространственному: карты, планы и другие картографические источники стали доступнее, а инструменты ГИС – привычной частью исследовательской практики. С их помощью можно визуализировать данные, анализировать пространственные закономерности, сопоставлять источники и реконструировать исторические среды. Материал Open Maps – вводный обзор, предназначенный для широкой научной аудитории, интересующейся тем, как меняются подходы исследователей-гуманитариев к работе с картами. Рассматриваются, в частности: • инструменты автоматического анализа карт, такие как MapReader, позволяющий разбивать карты на фрагменты и обучать модели для распознавания объектов • подходы к извлечению данных из карт с помощью нейросетей практики векторизации и послойной работы с данными в ГИС • интеграция разнородных данных (адресных книг, кадастров, атласов) и их привязка • инициативы, связанные с реконструкцией прошлого. Иллюстрация: Аннотированная карта южного побережья Индии (ок. 1752–1757) (Национальный архив Нидерландов) 🔜 Читать1,48%
- 20 апр.Вышла статья, с помощью количественных методов подтверждающая авторство М. М. Бахтина для текстов, которые ранее считались спорными. Авторы, Б. В. Орехов и А. Г. Василенко, применили широко распространенный в Digital Humanities метод Delta Берроуза для вычисления межтекстового расстояния книг «Фрейдизм. Критический очерк» (1927), «Марксизм и философия языка. Основные проблемы социологического метода в науке о языке» (1929), подписанных при публикации В. Н. Волошиновым и «Формальный метод в литературоведении» (1928), подписанной П. Н. Медведевым. Результаты исследования приводят к однозначному выводу о том, что все эти труды принадлежат перу М. М. Бахтина. Но этим общим выводом статья не ограничивается. За время дискуссии, которая длилась несколько десятков лет и приобрела название «бахтинского вопроса», несколько раз высказывалась точка зрения, что количественные методы для решения этой проблемы не применимы, поскольку круг Бахтина представлял собой интеллектуальное сообщество тесно взаимодействующих между собой участников, обменивающихся идеями и приходящими в итоге к очень похожим стилистическим установкам. Авторы статьи на материале Московской фонологической школы, Женевской лингвистической школы, ОПОЯЗа и Йенского романтизма опровергают это утверждение, показывая, что даже авторы, входящие в такого рода кружки, сохраняют стилистическую индивидуальность, вполне различимую для количественных методов. Ссылки: Орехов Б. В., Василенко А. Г. Количественная атрибуция и «бахтинский круг»: проблема авторства в интеллектуальных сообществах // Новый филологический вестник. 2026. № 1. С. 40–55. https://nevmenandr.github.io/portfolio/assets/pdf/bakhtin_delta.pdf1,24%
- 16 апр.Digital Humanities Awards и номинации «Системного Блока» 🏆 Цифровые гуманитарные проекты имеют свой небольшой и полуофициальный «Оскар» — это премия DH Awards, вручаемая с 2012 года. В этот раз в ней восемь номинаций: от большой и, пожалуй, главной Best DH Resource (лучший цифровой гуманитарный ресурс) до Best Use of DH for Fun («самое прикольное» использование цифровых гуманитарных методов). Основная цель премии — популяризировать цифровые методы в гуманитарных науках и показать, насколько разными могут быть проекты в этой сфере, поскольку награды не зависят ни от языка, ни от географии, ни от темы проекта. В прошлом году победителями DH Awards стали наши спецпроекты «Классное чтение» и «Digital Humanities, или Цифровые методы в гуманитарных науках: точка входа». В этом году «Системный Блокъ» снова номинирован. 🎉 Номинации СБъ «Системный Блокъ» участвует с четырьмя материалами в двух номинациях. В номинации DH Short Publication (короткая публикация про DH) выдвинуты статьи Марии Подрядчиковой «Под капотом у языкового корпуса: как нейросети и NLP-библиотеки используются в НКРЯ» и Дмитрия Пронина «Скриптор умер, да здравствует автор! — есть ли место человеческому тексту в эпоху больших языковых моделей?». В номинации DH Training Materials (обучающие материалы по DH) — рубрика о визуализации данных и статья «Как скачать весь Telegram: автоматизация выгрузки каналов с помощью Python» (в эпоху блокировок тема стала только актуальнее!). 👉👈 Просьба Если вам нравятся наши статьи и блоги, пожалуйста, проголосуйте за них до 17 апреля. Победители премии определяются простым голосованием. Спасибо, что читаете и поддерживаете ❤️ 🤖 «Системный Блокъ» @sysblok1,14%
- 8 апр.Гранты на мобильность для участия в мероприятиях 📅 Срок проведения мероприятий: 1 августа – 31 декабря 2026 📌 Дедлайн подачи заявок: 15 мая 2026 Max Weber Network Eastern Europe и его филиалы предлагают гранты для участия в конференциях, воркшопах и коллоквиумах. Программа предназначена для учёных гуманитарных и социальных наук (аспиранты, постдоки, опытные исследователи) из постсоветских стран (кроме России и Беларуси), а также для учёных в exile, у которых нет позиции или долгосрочного гранта в университетах Германии, Европы или других стран. Финансирование включает проезд и проживание. Детали и подача заявок1,04%