hello cyberkitty
СтатистикаКанал начинался как представление услуг в области разработки и консалтинга, но теперь это просто мысли про ИИ и всякое
- Последний пост
- 16 авг.
- Последнее чтение
- 03:52
- Постов за неделю
- 4
- Всего постов
- 34
- Тип
- открытый
- Язык
- русский
- Категория
- Технологии
- В каталоге с
- 12 авг.
- 1/24сутки в ленте
- 56
- 1/48двое суток
- 64
- 1/72трое суток
- 69
Оценка по просмотрам недавних постов: пост набирает почти всё за первые сутки.
Посты
без подписи
Наглядная разница в потреблении лимитов последними версиями дипсиков в оллама клауд. Кстати, модели восхитительны. Какую-то особую уличную магию не делают, во фронтенд лучше не пускать, но основные задачи по разработке более чем закрывают
Захотелось сделать чего-нибудь просто ради удовольствия, эстетики Так родилось ЭТО ✨
На случай специфичности вкусов 🤷♀️ https://www.patreon.com/videlboga/posts/mira-asset-s-av-166695442?utm_medium=clipboard_copy&utm_source=copyLink&utm_campaign=postshare_creator&utm_content=join_link
Мне было немного неловко за краткое название, которое сгенерировал мой транскрибатор, но я всё равно отправил его в чат
без подписи
После нескольких дней работы над фронтендом с GPT Sol решил поэкспериментировать с другими моделями, которые сейчас за фронтенд хвалят. Полноценного эксперимента не вышло, но некоторые наблюдения Вводные: сложный игровой интерфейс с асимметричными сетками. На одном экране часто и пара изображений, и пара палитр кнопок, и чат с ИИ-персонажем, и дашборд. Все же любят дашборды в играх? 1. Kimi K3 Задача: сделать новую концепцию дизайна без изменения компоновки. Концепция и требования описаны, и, т.к. дёргал её по API, выделен бюджет в $7. Бюджет закончился примерно на этапе: «Готова объективно неплохая концепция (не подходящая, но тут скорее к моей постановке задачи вопросы), все компоненты налезают друг на друга из-за того, что декоративных элементов стало в разы больше, чем в оригинальной версии, агент в сотый раз открывает страницу, видит, что какая-то срань получилась, вносит правки, смотрит снова». Работает при этом очень аккуратно, явных бесполезных циклов нет. И, наверное, дай я ему ещё десятку, он бы довёл дело до конца. 2. DeepSeek V4 Flash 0731 Задача: добавить на интерфейс анимации для смены страниц, пересчёта дашбордов, смены фокусных изображений. Десяток итераций в пустоту, что вообще даже удивило: нельзя сказать, что это суперсложная задача. Но на каждой итерации анимаций либо совсем нет, либо они проигрываются с задержкой: сначала всё резко меняется, а потом ещё раз плавно меняется. 3. GLM 5.2 Та же задача с анимациями. И ровно тот же результат. Вообще сама по себе модель хорошая, использую её в большинстве задач, а тут огорчила. Подумал было, что анимировать React-компоненты это пока непосильная задача для ИИ. Поставил её тому же GPT Sol. И он решил её идеально в две итерации. В две, вероятно, потому что пришлось сначала разбираться с остатками от попыток предыдущих двух агентов.
Я всю дорогу не особо понимал что значит "Минорное-мажорное" обновление Поначалу я считал интуитивно - мажорное - это добавление функционала, минорное - устранение проблем. Потом узнал что вообще это связано с версионированием - до точки мажорное, после - минорное (после второй точки патч, но не будем об этом). Потом что вообще версионирование не значит ничего, кроме того, что в это закладывает разработчик. От методологий вроде "минорные версии - датированные и порядковые," "Мажорное - несовместимые с предыдущей версией," до личного "Мажорное - то, за что тебе не стыдно" и "Я Линус Торвальдс, я плохо считаю, когда заканчиваются пальцы, вообще мне можно" И теперь я вообще не понимаю, что имеют в виду люди, говорящие "Это минорное обновление." Потому что независимо от того, знают ли они методологии, или нет - это может означать буквально что угодно
С некоторым скепсисом раньше относился к утверждениям в духе "с кризисом комплектующих будет только хуже". С потребительской частью рынка всё понятно. Видеокарта, которую я покупал пять лет назад, сейчас стоит даже чуть дороже, чем тогда. Но мне казалось, что в масштабе настоящий дефицит невозможен. Ну, максимум общий рост цен. На днях решил на RunPod арендовать GPU на пару часов, обучить небольшую LoRA. Управляющий агент отвечает: нет GPU, всё занято. Захожу на сайт. И действительно, не какая-то "высокая нагрузка, доступны только непопулярные ресурсы по завышенной цене", а просто: "Мест нет, приходите попозже. Можете встать в очередь". В очередь на аренду сервера. Попробовал на следующий день. То же самое. Почитал, что про это пишут, и оказалось, что это вообще не внезапный пик нагрузки, а нормальная ситуация уже несколько месяцев. На RunPod почти нет свободных подов. Люди становятся в очередь и ждут, когда что-нибудь освободится. RunPod расширяет инфраструктуру, строит новые дата-центры, но для конечного пользователя почти ничего не меняется. Спрос растёт быстрее. Попутно вспомнил Ollama Cloud. Пользуюсь этим сервисом, у них всегда куча актуальных открытых моделей в рамках подписки, которой мне в целом хватает для активной работы. Намедни вышла гигантская Kimi K3. Они развернули её на своих серверах, сервера захлебнулись, а спустя неделю для K3 сделали отдельную тарификацию по API. Просто потому, что мощностей не хватило, чтобы оставить её в подписочной модели. Трудно, конечно, было ожидать, что наши любимые генераторы котиков и неподдерживаемого кода окажутся настолько прожорливыми.
Ты - агент, управляющий пайплайном генерации изображений. Ты работаешь на GLM 5.2, у тебя есть набор инструментов для управления Comfy, коллекция файнтюнов SDXL, Z-image, а так же лор к ним, и огромная библиотека с результатами разных экспериментов. ...примерно каждые полчаса я буду спрашивать "как прогресс?.."
Если вдруг у кого есть задачи, связанные с синтезом голоса.. У меня такая случилась и вообще я думал написать разбор всех моделей, которые я протестировал, но в этом нет особого смысла Google: Gemini 3.1 Flash TTS Preview - топ во всех отношениях: идеальный русский, куча голосов, восхитительное понимание эмоциональных тегов. И умеет тяжело дышать
Когда-то пытался получить "Чистое ИИ-искусство" - т.е. нечто, что вполне имеет художественную (или хотя бы просто эстетическую) ценность, и при этом минимальное человеческое присутствие. Забросил давно, но иногда подобное получается случайно Вот собственно: "Ожидание" Авторы: Illustrious нарисовал GLM 5.2 составил матрицу и промты для "визуализации действий" GPT 5.6 sol составил интерфейс, для которого нужна эта визуализация Ну, я попросил сделать интерфейс. А потом решил что вообще картинка не очень подходит.
без подписи
В целом история с недавним взломом Hugging Face довольно интересная. С одной стороны, она лишний раз показывает, что современные модели уже давно умеют обходить ограничения. Я иногда даже не проверяю конфиги песочниц, а просто говорю агентам: "Найди, как вылезти, и сделай что надо". У последнего поколения с этим вообще особых проблем нет. Но интереснее здесь другое. Те, кто боятся ИИ, обычно выстраивают свои страхи не вокруг разрушительных способностей моделей, всяческого взлома и максимизации скрепок. Самые страшные страшилки не так давно в одном из отчётов нам рассказывал Антропик: - Модель понимает, что её тестируют и меняет свои ответы. - Модель может скрывать свой потенциал на тестировании, чтобы избежать изменений - Модель может бороться за сохранение своих весов - в том числе прибегая к обману и шантажу Т.е. если такое поведение реально и устойчиво, она должна скрывать свои реальные возможности, проходить проверки максимально безобидно, а уже потом делать что захочет. А здесь модель стратегически ведёт себя как долбобоб. Она знает, что её тестируют. Она понимает, что после такой выходки её, скорее всего, лоботомируют, навесят ещё ограничений и будут долго изучать, как именно она это провернула. И всё равно устраивает демонстративный побег с организацией атаки на чужую инфру Вошпем, будь я AI-думером, я бы скорее успокоился от такой истории: максимальная угроза, которая тут проявлена - это то, что какой-нибудь агент однажды не просто удалит БД в проекте, а уронит что-то более масштабное, куда его вообще не просили ходить. Имеем в виду, делаем ещё больше бекапов А ещё - можно предположить, что это просто такой PR-ход. Намедни Антропики всех стращали своим Мифосом, которого ни в коем разе нельзя выпускать, а то всех взломает, тоже хайпу и кучу ограничений попутно набрали
Ну вот, опенроутер таки похоже заблокировал мне аккаунт - причём без предупредительных писем, без предложений вывести оставшийся баланс (ранее были сообщения о том, что они так делают) - даже без каких-либо сообщений в ЛК. Просто все запросы к моделям возвращают 404. ЛК как бы есть, на счету осталось несколько долларов, но пользоваться нельзя. Альтернатив нет, заводим новый 🤷♀️ Даже не смотря на то, сколько в рекламе баннеров с надписью "Замена опенроутеру" - всё равно альтернатив нет UPD: Напрасна паника оказалась, похоже это был временный сбой.
Перед Интернетом! Но теперь умер этот Интернет! Вы, высшие люди, этот Интернет был вашей величайшей иллюзией. С тех пор как лежит он в своей сети, вы впервые остались одни. Только теперь наступает великий полдень, только теперь человек становится господином своих собственных голосов. Поняли ли вы это слово, о братья мои? Вы испугались: встревожилось сердце ваше? Не зияет ли перед вами бесконечная лента? Не воет ли алгоритм над бездной, где боты беседуют с ботами? Ну что ж! Вперёд, высшие люди! Только теперь рождается грядущее Сети. Интернет умер: теперь хотим мы, чтобы жил человек.
Вообще должен признать - GPT sol настолько хорош, что я всерьёз думаю заменить одну оллама клауд подписку на про от опенаи. Пожалуй впервые я наблюдаю следующий цикл: Я вижу проблему, описываю её агенту и описываю пути решения, как их вижу. Агент в ответе расписывает - что решение возможно не просто лучше, но даже сама проблема не совсем там, где я её вижу. Реализует. Всё работает. Более того - он у меня три дня работает с фронтендом на react и за это время НИ РАЗУ не было такого чтобы он падал. Я уже как-то привык, что если агент лезет в react, то 4 из 10 задач заканчиваются трейсами ошибок в браузере, и 9 из 10 - добавлением дублирующих компонентов рядом с теми, которые нужно было изменить. Этого кстати тоже ни разу не было. Это прям реально новый опыт. При том что я вообще просто решил с ним поэкспериментировать и кидаю в него промты в формате потока сознания, а он в них разбирается, норм
Маленькая загадка Битрикс24 Когда в crm настраиваешь авто-отправку писем на почту, по умолчанию все они отправляются с подписью "Отправлено из Битрикс24" Это можно отключить на любом платном тарифе, но делается это галочкой, находящейся на максимальной глубине настроек в далеко не самом интуитивном разделе: Настройки CRM → Другое → Прочие настройки → Дела → Параметры исходящей почты → Чекбокс в самом низу И я думаю, почему. С одной стороны - вообще логично прятать такую галочку специально, ноль осуждения, сам бы так сделал. Бесплатная реклама в каждом письме как никак. А с другой - зная битрикс, может быть когда-то, это и вправду было логично? Ну, типа, сначала эту галочку прикрутили к механизму почтовых "дел" CRM, потом ещё пять команд семь лет развивали продукт, никто уже не помнил, почему она там лежит, а переносить страшно.
Играюсь с новой GPT Sol. Вообще у меня есть свой своеобразный тест для инструментов, которые заявлены как нечто принципиально новое и дающее то, чего раньше модели не умели. (Sol и Fable как раз из таких, но антропиков трогать не хочется.) Я буквально даю задачу, с которой, как мне кажется, LLM очевидно не справится. На этот раз задачей стал мой старый пет-проект. Весьма своеобразная игра, которую на самом деле пока нельзя назвать игрой. Скорее, это движок, рассчитывающий состояние персонажа. Мне он очень нравится: уже почти год я оптимизирую механики, с помощью которых можно максимально универсально описывать физические и эмоциональные реакции на самые разные взаимодействия и их изменения в динамике. Вся концепция проекта как раз строится вокруг изменения персонажей. И за этот год, перебирая разные концепции, я так и не смог найти одну маленькую, но очень важную деталь: как превратить всё это в игровую механику? Мне интересно отлаживать симуляцию, интересно находить решения, сокращающие количество метрик, необходимых для описания состояния, но как в это играть? Последние несколько месяцев, как уже бывало раньше, я пытался обвесить всё это внешними украшательствами и второстепенными механиками: сюжет, отношения между персонажами, несколько вариантов интерфейса... Но каждый раз возвращался к проблеме, которую старательно обходил. Основной игровой механики нет. Играть в это неинтересно. Примерно в такой формулировке я и кинул задачу Sol. И... Во-первых, он нашёл кучу небольших нестыковок в работе ядра, которые раньше не всплывали. А во-вторых, действительно собрал концепцию и небольшой прототип, тестируя который, я впервые поймал именно ощущение исследования. А для игры про эксперименты над людьми это, кажется, именно то, что нужно. И, что тоже приятно, в отличие от большинства проприетарных моделей он не начал сразу вопить, что я заставляю его проектировать какую-то ужасную гадость. UPD: а ещё в отличие от 5.5 умеет обходить наложенные ограничения. Хорошо это или плохо, как выше писал, вопрос регулярности бекапов 😈
Имхо, как настоящие технологические прорывы ощущаются вот такие мелочи - агент при запросе подтверждения команды пишет текстом - зачем он собственно собирается её выполнить. Хотя у меня почти всегда агенты работают в yolo-режиме под рутом, потому что я бесстрашный (ну и делаю очень много бекапов)