Südosteuropäische Rundschau
СтатистикаСовершенно субъективные заметки, записи и наблюдения обо всём, на что падает взор в регионе, где проходит моя настоящая жизнь. Обратная связь: @alles_gute
- Последний пост
- 9 июл.
- Последнее чтение
- 08:41
- Постов за неделю
- 0
- Всего постов
- 23
- Тип
- открытый
- Язык
- русский
- В каталоге с
- 15 авг.
- 1/24сутки в ленте
- —
- 1/48двое суток
- —
- 1/72трое суток
- —
Оценка по просмотрам недавних постов: пост набирает почти всё за первые сутки.
Посты
Из серии "Жалко править". ИИ-транскрипт интервью: "Когда я езжу по порту на ЛГБТ🏳️🌈 тоже там очень много украинцев работает" Что же там на самом деле? "Когда я езжу по порту на LKW-шке [то есть на грузовике, произнесено как "на элкавэшке" — от немецкого LKW/ Lastkraftwagen 'грузовой автомобиль' - SR], тоже там очень много украинцев работает" #ot_ulybki_v_nebe_raduga_prosjnotsja #delmenhorst
Тем временем наше поле несколько расширилось и захватило Дельменхорст, город среднего размера (81.000 человек) на реке Дельме между Бременом и Ольденбургом. Интересует нас, как функционирует в этом городе многоязычие. Даже несмотря на то, что Германия в 2026 в принципе очень многоязычная страна, в Дельменхорсте довольно интересное распределение языков. Мы, в частности, много работали с переселенцами из Болгарии, о чем как-нибудь в другой раз, а не так давно глава нашего минипроекта Ярон Матрас провел интервью аж с арамейским епископом Дельменхорста — в этом городе самая большая в Германии арамейская община (переселенцы из Турции и Сирии). А вот неожиданная балканская оговорка из вчерашнего интервью со слушательницей вечерних курсов немецкого языка, где мы преподаем. Слушательница из Украины, рассказывает про Leihfirmen, т.е. про фирмы-посредники по временному трудоустройству, через которые можно найти низкоквалифицированную работу без знания немецкого языка. N. (21:37) Нет, ты к ним обращаешься, озвучиваешь свои желания и возможности. (21:43) И они тебе подыскивают работу. (21:47) Но они из этого шо-то имеют с двух сторон. (21:51) Ну в смысле с двух сторон, наверное, я так думаю. (21:54) Работодатели должны им вот эти, что ищут, как они, янычары или как их там. MM (21:59) Эйчары. N. (22:00) Эйчары вот эти, может что-то там им какой-то процент (22:04) И пока они работают, какой-то процент идет в эту фирму. Конечно, это оговорка, но какой мощный альтернативно-исторический образ она вызывает: янычары ищут работу для украинцев в Священной Римской Империи. #delmenhorst
В этой диалектной расшифровке символ 😊 означает, что информант смеётся 😄. В первый раз видим использование эмодзи в научной диалектологической публикации 📚🗣 — нам нравится 👍😄 Без шуток, на самом деле — кажется, это сильно упрощает цифровую обработку транскрипта, т.к. благодаря эмодзи можно отказаться от метакомментариев в тексте, которые иначе приходится размечать специальными тэгами типа ((LAUGH)) и еще потом прописывать в коде, что всё, что в двойных скобках — это тэги, а не звучащая диалектная речь. Источник: Миљана Чопа. 2022. Дистрибуција дугоузлазног акцента у говору Ћуприје." In: Српски дијалектолошки зборник. Расправе и грађа 69. С. 281–309.
У албанских коллег какой-то прорыв с цифровизацией. Так, Албанская академия наук запустила электронный портал со своими журналами (доступны также архивы номеров, хотя только за последние годы): https://journals-akad.gov.al/
Албанцы запустили большой электронный словарь албанского языка на 125.000 слов: https://fjalori.online/ Как мы понимаем, он заменил Fjalori Shkenca (адрес больше недоступен). Что ж, спасибо большое, будем теперь пользоваться!
Искусственный интеллект развивается настолько быстро, что еще на днях коллега опрашивал людей на фейсбуке в поисках подходящего македонского эквивалента для термина prompt,а уже сегодня выложил сборник промптов для обработки текстов на македонском языке: https://pelister.org/promptovi/index.html Может быть, кому-нибудь пригодится. Кстати, промпт на македонский в итоге так и перевели как "промпт". #мои_AI
На днях оказалось, что чатжпт отлично справляется с переводом македонских диалектных текстов (в нормализованной орфографии) на русский язык. Это упрощает жизнь и экономит многие часы работы, особенно если диалектный текст в документе с xml-разметкой, например в EXMARaLDA. Дано на входе: фонетическая диалектная транскрипция. Я прогоняю ее через не очень сложный скрипт в R, который переводит фонетическую запись в условно фонологическую (на основе стандартного языка). Вручную проверяю, что получилось. Выгружаю tsv-файл с фонологической записью и отдаю ChatGPT 5.2 на перевод. Думает он, правда, долго - восьмиминутные файлы обрабатываются 20-30 минут. Затем чат предоставляет для скачивания переведенный tsv-файл, который я другим скриптом записываю в слой с русским переводом. Проверяю вручную, уточняю сложные места, убираю глюки, исправляю. И вуаля — с этим уже может работать диалектолог более широкого профиля, не владеющий этим конкретным диалектом. #мои_AI
Очень много интересных книжных новинок, за всем и не уследишь. Но вот эту книгу хочется отметить особо, ведь она про овечек и отгонное скотоводство, пусть и не совсем в нашем регионе. #закладки https://www.cambridge.org/core/books/archaeology-of-pastoralism-mobility-and-society/F68921F83756F1E1ABA6E180A3410F27
Топонимический справочник по административно-территориальным единицам и географическим наименованиям Балканского полуострова в Османской империи (1514-1550). Скачивайте, оно пригодится в самый неожиданный момент. #закладки #да_не_в_этом_смысле https://www.devletarsivleri.gov.tr/varliklar/dosyalar/eskisiteden/yayinlar/elektronik-yayinlar/Rumeli_eyaleti.pdf
Оказывается, пособие Марьяна Марковича по македонской диалектологии доступно онлайн. Конечно, у таких пособий есть ряд ограничений; записи текстов являются хорошей иллюстрацией, но поскольку их читает диктор, это в любом случае некоторое приближение. Однако это полезно, чтобы составить себе базовое представление о том, как выглядят диалекты македонского диалектного комплекса. Не пропустите теоретическое описание под катом "Целиот текст", это отличный конспект, систематизирующий основные изоглоссы и диалектные зоны.
без подписи
PS: Чем-то это напоминает то старое видео (июнь 2025 — для AI это, наверное, как несколько геологических эпох назад). Мечтает ли искусственный интеллект об электроовцах? #мои_ai
Искусственный интеллект богат на галлюцинации. Мы пытались сделать автоматическую транскрипцию македонской диалектной записи (Трпейца). Увы, с македонским (тем более диалектным) Whisper (мы используем Turboscribe на его основе) не справляется вообще — но, кажется, пытается передать нам послание. "Зачем вы носите рыб? Зачем несете себя, мама? Мы жить хотим, сынок. Мы хотим жить, мы хотим жить, мы хотим жить, мы хотим жить, мы хотим жить, мы хотим жить, мы хотим жить, мы хотим жить, мы хотим жить, мы хотим жить, мы хотим жить..." #мои_ai
Теперь официально: Корпус славянских диалектов Албании полностью запущен: около 600 000 словоформ с морфологической аннотацией и возможностью прослушивания. Многие, возможно, уже видели бета-версию. Справочно: Корпус представляет собой собрание наших аудиозаписей славянской речи в Албании с 2010 года, с морфологической разметкой, которая позволяет находить словоформы по их лингвистическим характеристикам. Таким образом можно наблюдать над вариацией в языке и связывать ее с социолингвистическим профилем говорящих. В обновленной версии мы отредактировали под сотню тысяч разборов, значительно ограничили омонимию, привели в порядок обозначения языков. Мы надеемся, что этот корпус послужит на пользу славистам, балканистам, специалистам в области языковых контактов, а также говорящим на славянских диалектах Албании. Конечно, какие-то вещи нам придется подкручивать и дальше (лучшее — враг хорошего), так что если что-нибудь будет всплывать — пишите. https://slav-dial-alb.uni-oldenburg.de/index_ru.html
Уровень неграмотности в Югославии, 1961 год. Кажется, эта карта могла бы очень точно предсказать судьбу югославских республик в годы распада, поэтому #ялюблюкарты PS Самый низкий уровень - Словения, самый высокий - Босния, Косово и юг Сербии в целом.
Понятно, что в эпоху искусственного интеллекта любая новая информация такого рода вызывает сомнения в подлинности, и всё же идея интересная. Гимн США в византийской церковной версии (отсюда).
А еще есть, оказывается, вот такая книжка про османских вампиров: Salim Fikret Kırgi. Osmanlı Vampirleri. Söylenceler, Etkileşimler, Tepkiler. Доступна также на английском, правда, мы нашли только киндл-версию. Будем изучать! #домашнее_чтение
Лингвистический квиз: За какое такое имя хватали овцу в Преспе? Ovča'rite i mo'ldzet, ti'e, i po'tstrigvet za da mo'že da i mo'ldze da i fa'tva za, za {{i'me}}. "Пастухи их доят, они их стригут, чтобы когда они их доят, можно было ухватиться за {{i'me}}" [Gor06]. За неимением под рукой фотографии преспанской овцы, вот фото овцы нижнесаксонской (Бокхорн, Фризия, на побережье залива Ядебузен). Основная цель этих овечек — утаптывать своими копытцами прибрежные дамбы, чтобы море не размыло их и не затопило Фризию. Ответ: Ну а i'me в данном контексте — это всего лишь "вымя" (<ы> и <и> совпали, протетическое <в> выпало). Так имя и вымя стали омонимами в Преспе.
Главная балканистическая новинка этого года — а возможно, даже и всего нашего мерзкого десятилетия — это долгожданная монография Виктора Фридмана и Брайана Джозефа: Friedman, Victor A., and Brian D. Joseph. The Balkan Languages. Cambridge: Cambridge University Press, 2025. "Долго" здесь относится к тридцати годам, которые понадобились авторам (в 1993 году, когда ВФ и БД задумали этот проект, ольденбургской редакции еще и в помине не было, а главному редактору канала было девять лет и он не знал ни одного балканского языка). Все мы уже несколько лет цитируем рукописи этой книги — возможно, в несколько разных версиях. И вот наконец-то "forthcoming" превратилось в "2025". Бумажная книга стоит $195.00, так что ни в чём себе — зато в электронном виде она доступна для скачивания с сайта издательства, поскольку Open Access. Радуемся как за собственную монографию🥳🎉🍻 ("Часто смотрите", заботливо сообщает нам гугль. Да ну, не может быть😅)
Тем временем вышел том расширенных тезисов немецкой делегации к Международному съезду славистов. Среди прочего, там замечена и могучая кучка (частично) ольденбургских славистов. Языковой контакт, смешанная речь, языковые биографии — всё как мы любим: Тетяна Кузнєцова. Суржик: від «мовного покруча» до мови «своїх», або як змінилося ставлення до українсько-російського змішаного мовлення після 24.02.2022 Yevheniia Lytvyshko, Jan Patrick Zeller. Language Biographies of Surzhyk Speakers: Linguistic Experiences during Education Maxim Makartsev. The morphosyntax of two Shtokavian migrant dialects in Albania on the path towards Balkanization Олеся Палінська. Посесивні конструкції в українсько-російському змішаному мовленні («суржику»)