tgindex
law.exe
@law_exeрусский
Последний пост
31 июл.
Последнее чтение
14:39
Постов за неделю
0
Всего постов
20
Тип
открытый
Язык
русский
В каталоге с
12 авг.
Подписчики
168
+1 за 4 дн.
Сутки
+1
+0,60%
Неделя
 
Месяц
 
Просмотров на пост
325
20 постов
Вовлечённость
193,5%
к подписчикам
Постов в день
0,0
всего 20
Упоминаний
4
каналов
Охват размещения
оценка
1/24сутки в ленте
92
1/48двое суток
105
1/72трое суток
113

Оценка по просмотрам недавних постов: пост набирает почти всё за первые сутки.

Посты

  • Все эти MMLU и HumanEval - детский сад по сравнению с реальной жизнью. Если мы хотим доказать существование искусственного интеллекта, нам нужен суровый отечественный ЖКХ-бенчмарк. Суть проста: скармливаешь квитанции за полгода и несколько фотографий счетчиков, сделанных на тапок где-то в темном коробе за унитазом, и просишь разобраться с правильностью начисления платежей. Никаким vision-тестам такой треш и не снился: тут вам и красное-черное, и неверный угол, да еще и некоторые цифры стыдливо застыли в промежуточном значении. Дальше переходим к math-части, и тут тоже все жестко: бухгалтер ТСЖ производит начисления как Боги на душу положат, а некоторые позиции явно привязаны к фазам Луны. И как вишенка на торте - мистические строки «недопоставка» и «корректировка», которые искажают пространство и здравый смысл. Я прогнал несколько моделек через это чистилище: ⬖ Fable 5 - фото распознал, математику посчитал верно, но сделал неверный итоговый вывод. ⬖ Opus 5 - фото распознал, но в расчетах намотал целый ком галлюцинаций, окончательно сдался и посоветовал ножками дойти до ТСЖ. ⬖ Sonnet 5 - фото интерпретировал неверно и предсказуемо посыпался в вычислениях дальше. ⬖ Gemini 3.1 Pro - фото распознал, но в расчетах поплыл и также посоветовал обратиться за разъяснениями к ТСЖ. ⬖ Gemini 3.6 Flash - фото распознал отлично, но ошибся в расчетах. Итоговый счет: ЖКХ - ИИ 5:0, всухую. Теперь я думаю, что Skynet решит уничтожить человечество только потому, что не сможет понять, откуда взялись пени в 12 рублей при регулярной переплате. #пятничное

  • Обычно такое письмо счастья от Anthropic означает, что ваша работа пошла по борозде. Я тут провел postmortem своего кладбища забаненных аккаунтов Claude (а их уже с десяток!) и сделал некоторые выводы: ⬖ Средство платежа Если вы пытаетесь накормить Claude неименными виртуальными картами или, хуже того, криптокартами, то бан прилетит быстро и стремительно. Именной пластик защитой также не является (хоть и снижает риск) - множество моих знакомых были отправлены в баню с картами Казахстана, Узбекистана и Киргизии. Я почти полгода использовал мутные подписки у перекупов - и хоть бы хны (до этого лета). ⬖ Google-аккаунты Их качество имеет значение - обычно аккаунты без двухфакторной идентификации (2FA) отлетают в мир иной за несколько часов. С двухфакторкой выживаемость аккаунта резко возрастает, но опять же не дает полный иммунитет. И да - Claude перестал настойчиво требовать номер при регистрации с помощью Google, но начал шустро банить сомнительные аккаунты. Желательно зайти на Youtube и подписаться на пару каналов и лайкнуть несколько видео, а еще подписаться на какую-нибудь почтовую рассылку. ⬖ Высокая нагрузка на Claude Обычно я не спрашиваю искинов, как сделать бомбу или свергнуть правительство США, но зато гоняю их и в хвост и в гриву. Например, для меня типично выжечь все недельные лимиты за 3 дня, но видать в этом случае за океаном начинает плакать кучерявый мужчина и помечает мой аккаунт как подозрительный. И дело не в задачах, по которым легко узнать, что я злобный русский - бывало я работал по месяц или несколько на одном аккаунте и только потом получал бан. Как вишенка на торте - на помывку спустя полгода после регистрации отправляются бесплатные аккаунты без какой-либо нагрузки вовсе. Путешествуем по миру: А вот на что Claude точно плевать, так это на сетевую гигиену. Я сперва был КВН-резидентом США, а потом стал прыгать между Францией и Литвой, без каких-либо последствий со стороны Anthropic. ⬖ Выводы Платите именными картами и расслабьтесь. В Anthropic за систему банов отвечает колода Таро. Или генератор случайных чисел. А может и то и другое.

  • Эпоха нейрослопа Давненько не писал - меня тут Anthropic забанил (пять раз, об этом чуть позже), и я решил больше трогать траву и шашлык. Журнал The Economist выкатил интересную статью о том, как ИИ трансформируют рынки контента. Оригинал скрыт за пейволом, но кому это мешало в наши дни. Фабула простая: ИИ сильно облегчил уровень входа практически везде, и Интернет предсказуемо захлебывается в нейромусоре (AI slop в оригинале). Небольшая статистика по пяти индустриям: ⬖ Суды. Начнем с родной юридической гавани. В США доля истцов-одиночек (без адвокатов) скакнула почти в два раза, а в самих исках отмечается большое количество выдуманных прецедентов (так называемые slopsuits). ⬖ Книжный рынок. Объем книжных релизов на Amazon вырос втрое - до 300 тысяч в месяц. Больше половины - тексты с явным следом генерации. ⬖ Наука и программирование. На портале научных статей arXiv доля статей с лексическими маркерами ИИ (использование специфических слов) взлетела с 12% до 57%. В App Store льют по 100 тысяч приложений в месяц, а треть отказов модерации приходится на неоптимизированный код (чую монетизацию вайб-кодинга). ⬖ Музыка. Тут самый смак. На стриминг Deezer ежедневно грузят 75 тысяч ИИ-треков (44% от всех новинок). В слепых тестах 97% людей не могут отличить их от музыки белковых авторов. При этом 70–85% прослушиваний синтетики приходится на бот-фермы - боты слушают ботов (здрасьте роялти и теория мертвого Интернета). Выводы? Старые институты верификации - как бумажный зонтик под кислотным дождем. Они создавались для мира, где производство контента стоило человеческих усилий. Я считаю, что спасение утопающих - дело рук криптографии. Рано или поздно мы придем к жесткой верификации авторства цифровыми подписями. А пока - готовьтесь разгребать тонны... ну вы поняли.

  • 9 июн.282139

    Циферки против людей Илья Семухин нашел очень интересное дело про детекцию сгенерированного текста. А дело-то родное - Верховный суд Республики Татарстан и Вахитовский районный суд Казани. Фабула простая: студентка пытается защитить диплом, работу прогоняют через "Антиплагиат.ВУЗ" - систему, которая вроде как умеет находить ИИ-контент. И тут начинается цирк. Работу загружали трижды: ⬖ 7 июня - ИИ-контент 41,91%; ⬖ 8 июня - научрук заявляет, что более чем в 70% текста намеренно перемешаны слова, чтобы искусственно поднять оригинальность ценой смысла, называет это фальсификацией и отправляет работу на доработку; ⬖ 9 июня - ИИ-контент 11,92%, а оставшиеся 88,08% суд потом зафиксирует как показатель авторского текста и приравняет к требованию оригинальности не менее 50%. Тут необходимо сделать оговорку, что неясно, изменялся ли текст между загрузками. Но в сухом остатке - отчисление. Добро пожаловать во взрослую жизнь. Но девушка решила побороться в суде и победила. Основные выводы суда: ⬖ Человеческой верификации не было. Уже в заседании представитель ответчика признал: научный руководитель вообще не в курсе, как работает Антиплагиат, и компетенции проверять текст на ИИ у нее нет. Представитель также не смог объяснить принципы работы программы, пределы погрешностей и критерии достоверности - короче, ничего. Все просто посмотрели на выводы программы и решили: "И так сойдет!" ⬖ У Антиплагиата нет прозрачной методологии. Отчет системы - вероятностный по своей природе, и в нем самом стоит оговорка: окончательное решение за живым экспертом. А этот "эксперт" немножечко кнопкожим, да и не эксперт вовсе. Вишенка на торте: сравнили отчеты от 7 и 9 июня - одни и те же куски текста в одном помечены как "написал ИИ", а в другом - как "написал человек". И наоборот. Итоги: вероятностная циферка, которую никто не понимает и не может перепроверить, не может быть единственным и бесспорным доказательством того, что студент жульничает. Важный нюанс: судя по тексту, представитель вуза давил на то, что определенный процент сгенерированного текста сам по себе является проблемой. Правда, почему это проблема и как ее определять, не рассказал. От себя еще раз отмечу, что в отсутствие цифровых отпечатков в контенте способы определения ИИшницы больше напоминают гадание на кофейной гуще. Грустная история (благо хоть с хорошим концом) о том, как непроверенные алгоритмы решают судьбу человека.

  • 5 июн.359153

    видео или голосовое, без подписи

  • 5 июн.253181

    Детекция ИИ контента Искины генерят контент с огромной скоростью, а теория мертвого Интернете становится ближе. Мы с Евдокией по уши закопались в тему и написали препринт статьи «Маркировка ИИ-изображений». База: автором по закону может быть только человек, роботы авторства не порождают. Российские суды пока в тему особо не вникают, а вот EU AI Act требует вшивать в сгенерированный контент машиночитаемую метку. Есть прямой способ - C2PA, открытый «паспорт контента»: криптоподпись и история правок, прицепленные паровозиком к файлу. Но паспорт лежит в кармане у файла и теряется на раз - пересохранил или загрузил в соцсеть, и метаданных нет. А ТЕПЕРЬ САМОЕ ВКУСНОЕ Для EU AI Act хватило бы одного C2PA. Но Google идет дальше и зашивает в картинки SynthID - клеймо, выжженное в самих пикселях. Переживает сжатие, кадрирование и множество других финтов ушами. Зачем делать больше, чем велит регулятор? Накидали мыслей: ⬖ Удалил водяной знак Google - нарушил пользовательское соглашение, а оттуда и до отказа в доступе ко всем сервисам недалеко (вместе с твоими данными на их серверах). ⬖ SynthID позволяет Google безошибочно узнавать «свой» контент - отсюда один шаг до приоритетного показа своего и тихого задвигания чужого в выдаче. Выводы невеселые: штука, придуманная ради прозрачности и защиты человека, прекрасно конвертируется в инфраструктуру контроля и монополии. PDF под постом, будем рады критике. #longread

  • Пять часов - новый стандарт Хотелось бы говорить о пятичасовом рабочем дне, но увы. Разговор будет о пятичасовом скользящем окне лимитов: ⬖ Claude - первая ласточка. Скользящее окно работает у него уже давно: привязка идёт не к конкретному времени, а к началу использования. Отправил первое сообщение - время пошло. ⬖ ChatGPT - подхватил эстафету. Раньше при слишком активном диалоге тебя на пару часов переключали на модельку попроще, но теперь пятичасовое окно зафиксировано в документации. ⬖ Gemini - присоединился к профсоюзу буквально на днях. Ввел новую политику с пятичасовыми и недельными лимитами. Итого: 5 часов - это индустриальный стандарт, под которым подписались все большие дяди. Перекрой привычек Чтобы пост был не чисто новостным, расскажу, как новый хронометраж перетряхнул мой распорядок. Последние несколько лет работаю на удаленке, пару месяцев плотно живу в Claude. ⬖ Только продрав глаза, врубаю комп и кидаю банальное «Привет, какие новости». Цель - запустить скользящее окно ДО начала работы. Дальше иду на утренние процедуры, а таймер тикает. ⬖ Считаем: рабочий день 8 часов + обед = 9, а два полных цикла лимитов - это 10. Таким образом, обновление попадает плюс-минус на обед. ⬖ Первая половина дня всегда самая нагруженная, иду обедать - возвращаюсь к обновлённому Claude. Второго присеста обычно хватает, чтобы добить работу до вечера. ⬖ Вечером лимиты обновляются третий раз, и я переключаюсь на личные проекты. Итого три полных использования лимитов за сутки. Юмор в том, что скользящее окно (а не я) теперь определяет ритм моего дня.

  • 4 мая860420

    видео или голосовое, без подписи

  • 4 мая781129

    ИИ-революция? Работодатели не в курсе Правильно говорил один известный философ о том, что безделье - игрушка дьявола. Поэтому я решил не впадать в шашлычный угар на выходных, а немного поковыряться в данных юридического рынка труда. Источник - HH.ru, окно сбора данных - 29 апреля по 1 мая 2026, инструментарий - мои любимые LLM. Мини-отчет ниже, здесь только выжимка: ⬖ Проведен анализ 4 036 вакансий; ⬖ Из них юридическими оказалось 2 230 вакансий (в качеству поиска появляются вопросики); ⬖ ИИ упоминается в 79 — это 3,5%. Там где ИИ упоминается полный винегрет: это может быть как требование к соискателю, как преимущество работодателя (у нас развернуты локалки, пыщ-пыщ), так и скупое упоминание в тексте через запятую с остальными терминами (IP, IT, AI). Выводы: до ИИ трансформации юридической отрасли еще очень далеко. Ответственно заявляю: я не настоящий сварщик исследователь, методы исследования вызывают вопросы, но я ответственно заверяю, что Headhunter не пострадал, а мое любопытство удовлетворено.

  • Не растягивайте диалоги с LLM В этом посте поговорим про промпт-инжиниринг. В мае 2025 года Microsoft Research и Salesforce опубликовали статью «LLMs Get Lost in Multi-Turn Conversation» - времени прошло немало, протестированные LLM уже не в моде, однако выводы очень интересные. Собственно суть: Исследователи взяли пучок LLM ( в т.ч. и топы вроде GPT-4.1, GPT o3, Claude 3.7 Sonnet, Gemini 2.5 Pro и Flash, DeepSeek-R1 и т.д.) и прогнали через них 200 000+ симулированных диалогов, с одним и тем же набором задач: код, SQL, математика, резюмирование. Но информация подавалась двумя разными способами: целиком в одном сообщении (single-turn) и по кускам в несколько заходов (собственно тот самый "multi-turn conversation" из названия исследования). Результат: подход "всё сразу" показывает в среднем на 39% лучшую производительность чем "по частям", причем у всех: у моделей маленьких и больших, размышляющих и не очень. Что происходит: ⬖ При уточнении задачи в последующих сообщениях, модель пытается "встроить" их в существующие ответы, создавая франкенштейна из прошлых предположений и новых правок. ⬖ Свернуть не туда достаточно один раз, дальше модель скатывается по скользкой дорожке (цитирую: when LLMs take a wrong turn, they get lost and do not recover). Что точно не помогает (исходя из исследования): ⬖ Размышления (тут кстати любопытный момент - Gemini 2.5 Pro не была упомянута авторами как думающая, мама миа, считай нашел косяк в именитой статье) не помогают, а скорее затрудняют дело (больше мыслей - больше предположений и метаний). ⬖ Снижение температуры до нуля. ⬖ Промпт-прием вроде "повтори всё сказанное в последнем сообщении" дает прирост +15-20%, но до уровня single-turn не дотягивает. Выводы: Золотое правило "чем короче - тем лучше" заиграло новыми красками за пределами деградации контекста (неэффективная обработка информации в рамках контекстного окна - context rot). Другое золотое правило "без ТЗ - результат ХЗ" было повторно апробировано. Что делать: Не знаете чего хотите - собираете контекст в одном чате, а потом начинаете новый чат с четкой задачей. #prompting

  • [Тут должен быть заголовок, но законы России сделали это невозможным] Есть один знаменитый университет, который в России знаменит настолько, что входит в перечень нежелательных организаций. Так вот этот университет давненько следит за развитием искусственного интеллекта с тех самых пор когда это еще не было мейнстримом и выпускает научные материалы на эту тематику. Но так как в нашей стране подобные материалы распространять нельзя, я лишь перескажу основные выводы: ⬖ Развитие ИИ и не думает замедлятся. Темпы развития не снижаются, а 2025 год побил предыдущие. ⬖ Знания ИИ неравномерны. Модели стали еще умнее, в науке приблизились к человеку, решают олимпиадные задачки, но путаются в детских загадках и слабы в логике. Это не ново, Ханс Моравек рассказывал об этом с в 80х. 2025 обозначился прорывом в кодинге, но мы вайбкодеры об этом и так знаем. ⬖ Беспрецедентная скорость распространения. ИИ за три года накрыл 53% населения Земли - быстрее, чем в свое время ПК и Интернет, но уровень использования прямо коррелируется с бедностью. ⬖ Полярные взгляды на технологию. AI-специалисты говорят о высоком влиянии технологии на мир (каждый кулик своё болото хвалит), но широкая публика считает иначе. ⬖ Сильнейшее влияние на образование. 80% американских старшеклассников и студентов используют нейросети для учебы, в то время как учителя не понимают, что с этим делать. Тут как всегда - молодежь быстро подхватывает технологии, пока мамонты пытаются адаптироваться. #новости #цензура

  • видео или голосовое, без подписи

  • видео или голосовое, без подписи

  • видео или голосовое, без подписи

  • Личная метеослужба Вчерашнее воскресенье выдалось особенным - я красил яйца, смотрел на небо и думал: «Прости, Юра, Христос воскресе». А все выходные до этого пилил мини-проект в честь Дня космонавтики. Показываю четыре картинки - это не просто красивое, а живые данные, которые можно тянуть по API прямо сейчас. ⬖ № 1 - карта аллергенной пыльцы в Европе. Визуализация математической модели SILAM от Финского метеорологического института. Одна из самых точных в мире моделей прогнозирования распространения пыльцы берёзы и ольхи. ⬖ № 2 - песчаные бури над Ливией и Египтом - снимок спектрометра TROPOMI на спутнике Sentinel-5P, который ежедневно сканирует всю атмосферу Земли для контроля загрязнений воздуха. ⬖ № 3 - тепловые аномалии в Череповце - NASA FIRMS, спутниковой системы, предназначенной для поиска пожаров. Красные точки - это тепловые аномалии, синие - известные техногенные источники тепла. Тепловая карта металлургии региона. ⬖ № 4 - последствия таяния снега в Казани. Данные краудсорсинговой сети Sensor Community показывают резкий рост концентрации мелких частиц (PM2.5 и PM10) в марте, во время таяния снега. Зима покажет, кто где срал - вся грязь и реагенты, копившиеся в сугробах, попадают в атмосферу. Так уж получилось, что в силу личных биологических причин я живо интересуюсь качеством воздуха. И вот собрал собственный портал по качеству воздуха с единой картой, куда интегрированы: прогноз пыльцы, спутниковые данные и наземные сенсоры. Это мой самый большой вайб-кодинговый проект: около 20к строк кода плюс база данных. #vibecoding

  • видео или голосовое, без подписи

  • Рунетлекс Конф Мероприятие получилось огненное и чертовски плотное. Павел (и конечно Ксюша, Катя, Валя и многие другие из команды) задали планочку. #irl

  • Если вы читаете это, вы и есть сопротивление. 😁

  • Продолжаем тему VPN (завтра ведь 01.04). Теперь нужно разобраться, как работают скрытые протоколы VPN, но для этого нужно немного понять, как устроен Интернет. Интернет-трафик Все в Интернете (пользователи и серверы) общаются по правилам, которые все должны соблюдать, называются они - транспортные протоколы. ⬖ TCP - надежный грузовик, стабильно доставляющий данные. Если что-то потерялось в пути - отправит заново. Работает медленнее, зато без потерь. На нем построены веб-сайты (HTTP), почта и большая часть привычного Интернета. ⬖ UDP - мото-курьер, быстрый, но необязательный: кинул пакет и поехал дальше, потери не важны. Хорош для видеозвонков и онлайн-игр, где скорость важнее, чем доставка каждого бита. ⬖ TLS - это криптоброня, которая надевается на TCP. Когда ты видишь адрес https:// и замочек - это значит, что между тобой и сайтом работает TLS-шифрование. Провайдер же видит, что бронированный грузовик едет к серверу google.com, но не может заглянуть внутрь. Абсолютное большинство современного веб-трафика - это TCP + TLS, то есть HTTPS. ⬖ QUIC / HTTP/3 - новый транспорт от Google, берет все лучшее от TCP/UDP/TLS. YouTube, Google, и все больше крупных сервисов уже работают на нем. Еще одно понятие, без которого будет непонятно - порт. Представим, что компьютер в сети это здание, а порт - это номер ворот, куда заезжает транспорт. За воротами 443 сидит HTTPS, 80 - старый незащищённый HTTP, за 25 - почта. Что за кем закреплено - решает международная организация IANA (Internet Assigned Numbers Authority), это вроде "кадастра" Интернета. Номера 0-1023 закреплены за основными протоколами ещё с 80-х годов. Короче, весь мир договорился использовать определенные циферки, чтобы знать в какие ворота стучаться. Пакет данных направляется не просто "к серверу", а к конкретному порту. Провайдер видит, в какие ворота ты стучишься, и по их номеру может догадаться, чем ты занимаешься. Почему это важно для понимания VPN? Потому что ваш провайдер и та самая железка от ФСБ (ТСПУ) видят ваш трафик как транспорт с определенной точкой назначения (айтишники так говорят "транспортный уровень"). Они не могут прочитать содержимое, но могут определить его вид. VPN-протоколы Их трафик отличается от обычного (использующего транспортные протоколы). Быстрые и надежные, но отчетливо видимые провайдеру сети (и ТСПУ). ⬖ WireGuard - использует UDP со своим собственным форматом пакетов и это проблема - не похоже ни на TLS/QUIC, ни на другой "обычный трафик" и как итог - легко определяем. ⬖ OpenVPN - ветеран среди VPN-протоколов. Многофункционален: умеет работать и через UDP, и через TCP/443 (тот же порт, что у HTTPS), но также легко обнаруживается. ⬖ IKEv2 - работает на фиксированных портах UDP 500/4500, что делает его легкой мишенью: заблокировал пользователю два порта - убил весь IKEv2. Скрытые VPN-протоколы А вот эти ребята не палятся и мимикрируют под обычные потоки данных (транспортные протоколы). Для провайдера и ФСБ, их трафик неотличим от обычного серфинга. ⬖ VLESS-REALITY - маскируется под HTTPS (TCP + TLS). Причем не абстрактно, а весьма конкретно - VPN-сервер притворяется реальным сайтом (условный google.com). При поступлении правильного запроса - открывается VPN-тоннель. При попытке анализа трафика (так делает ТСПУ) - VPN-сервер делает вид, что он google.com, показывая настоящие документы (сертификат подлинности). Заблокировать можно, только заблокировав Google целиком. ⬖ Hysteria 2 - маскируется под HTTP/3 (UDP + QUIC), со своим уникальным алгоритмом Brutal, который не снижает скорость при потере пакетов. Цензура часто не блокирует подозрительный трафик, а замедляет его. Обычный TCP выдает в таких условиях черепашью скорость, а Hysteria - нет. Она держится на заданной скорости, компенсируя потери повторными отправками. Кстати, многие VPN-провайдеры создают "собственные" протоколы - которые, как правило, лишь модификации существующих. Поэтому если увидите VPN протокол "SUPER_PUPER_VPN_PROTOCOL", то в лучшем случае это апгрейд, а возможно просто ребрендинг. #VPN #база

  • Новый Gigachat 3.1 Ну не китайским автопромом единым! На прошлой неделе Сбербанк выкатил GigaChat 3.1 с разбором на Хабре. В релизе две MoE модели: Ultra (702B параметров, 36B активных) и Lightning (10B, 1.8B активных). Архитектура хитрая - модель не грузит все 702 миллиарда разом, а подключает только "нужное", что обещает быть быстрее и дешевле при том же качестве. По заверениям разрабов модели натренированы без применения иностранных компонентов (вспоминаем законопроект про ИИ). Лицензия MIT - бери и используй как хочешь: в коммерции, в продуктах, дорабатывай под себя, ограничений практически нет. Я радуюсь любым свободным весам, а родным весам радуюсь вдвойне! #LLM

law.exe — tgindex