tgindex
Neuroctopus collab

Neuroctopus collab

Статистика

Нейросети без магии

Последний пост
4 июл.
Последнее чтение
01:53
Постов за неделю
0
Всего постов
21
Тип
открытый
Язык
русский
Категория
Технологии
В каталоге с
12 авг.
Подписчики
51
0 за 5 дн.
Сутки
0
0,00%
Неделя
 
Месяц
 
Просмотров на пост
250
20 постов
Вовлечённость
490,2%
к подписчикам
Постов в день
0,0
всего 21
Упоминаний
2
каналов
Охват размещения
оценка
1/24сутки в ленте
1/48двое суток
1/72трое суток

Оценка по просмотрам недавних постов: пост набирает почти всё за первые сутки.

Посты

  • И мы опять на вайбпитонили. Ведь для облегчения нашей жизни нужна не только генерация кадров или рисунков. Так бывает, что есть масса книг (серия художественной литературы или научной, или серия чего угодно еще) и надо собирать по кусочкам и искать какие-то отрывки и для этого надо все-все перерыть. Теперь перерывать будет чуть легче. Что мы сделали - читалку, которая позволяет делать подборку отрывков и цитат. Как работает программа? Читает по идее форматы .txt *.epub *.fb2 *.pdf *.docx * (еще .djvu *.azw *.azw3 *.mobi *.lrf, но с костылями) 1. Может вести поиск сразу по всей серии загруженных книг. 2. Можно выбрать найденную цитату и добавить в уже созданную подборку. 3. Найденный отрывок можно расширить, добавляя абзацы сверху или снизу и они тоже добавятся в подборку. 4. Для удобства найденные и уже выбранные фрагменты обозначаются галочками, программа подсказывает при добавлении есть или нет уже фрагмент в подборке цитат 4.Все подборки можно экспортировать в txt, pdf или doc. Пока у нас есть версия для Windows но маленький Октопус собирается расти и уже установил Androud Studio, так что версия для андроида на подходе. Будем очень признательны, если кто-то из вас потестирует программу и напишет отзыв. Программу берем в комментариях или с гитхаба - как кому удобнее https://github.com/Elzje/octopus_reader/releases/tag/v1.0.0

  • без подписи

  • без подписи

  • без подписи

  • Универсальный промпт для преобразования фотографий рисунков в сканы. С цветными изображениями лучший результат дает Nano Banana Pro, с ч/б - Seedream 5. Можно использовать также с chatGPT Image 2. Transform the uploaded phone photo into a single-sheet flatbed scan on pure white — preserve every drawn detail exactly; apply only geometric correction, background unification, and maximum sharpness. No blur, no soft edges, no redesign. { "task": "phone_photo_to_crisp_unified_flatbed_scan", "design_lock": { "copy_uploaded_reference": true, "preserve": [ "all_drawn_content", "exact_layout_positions", "relative_spacing_between_artworks", "line_weights", "stroke_style", "color_values", "marker_gradients", "white_ink_highlights", "handwritten_text", "pencil_stippling_and_hatching" ], "do_not_change": [ "drawing_style", "subject_matter", "proportions_within_each_artwork", "number_of_artworks", "artist_intent" ] }, "background_unification": { "goal": "one continuous pure white sheet — not a collage of separate paper photos", "remove": [ "individual_paper_sheet_edges", "gray_paper_rectangles", "paper_tone_differences", "shadows_under_paper", "halos_around_drawings", "desk_table_background", "objects_outside_artwork" ], "apply": [ "single_unified_#FFFFFF_canvas", "all_artworks_float_on_same_white_plane", "no_visible_paper_borders", "no_drop_shadows", "no_vignette" ] }, "sharpness_pass": { "remove": [ "blur", "soft_focus", "gaussian_softness", "soapiness", "muddy_midtones", "washed_gray_blacks", "jpeg_mud", "compression_artifacts", "camera_noise_smear", "lens_softness", "anti_aliasing_fuzz_on_ink" ], "apply": [ "maximum_edge_clarity", "crisp_ink_contours", "hard_clean_line_separation", "flatbed_scanner_sharpness", "high_local_contrast_on_strokes", "micro_detail_preserved_not_smoothed" ] }, "geometry_pass": { "remove": [ "keystone_perspective", "lens_distortion", "paper_curl", "uneven_lighting", "color_cast_from_camera" ], "apply": [ "orthographic_top_down_view", "rectilinear_correction", "even_flat_illumination" ] }, "color_grade": { "whites": "uniform pure white #FFFFFF across entire canvas — no gray zones", "blacks": "deep solid black ink — not gray, not faded", "colors": "natural faithful saturation — vivid but not HDR, not neon", "contrast": "publication scan — clear ink-to-paper separation" }, "style_finish": { "medium": "high-resolution flatbed document scan — crisp, not photographed", "not": [ "photograph", "soft_pastel_filter", "beauty_smoothing", "oil_painting_blur", "3d_render", "cgi", "digital_reinterpretation" ] }, "forbidden": [ "redesign", "new_elements", "removed_details", "invented_lines", "vector_simplification", "merged_or_split_artworks", "text_changes", "watermark", "separate_paper_sheets_visible", "blur", "soft_edges", "gray_background_anywhere" ], "hard_constraints": [ "uploaded_photo_is_source_of_truth", "one_white_sheet_only", "maximum_sharpness_required", "cleanup_only_no_redraw" ], "output": { "resolution": "4K" } }

  • Промпт для увеличения и реставрации в Nano Banana. Copy the uploaded image exactly — same subject, pose, framing, style="preserve", and original medium. Apply ONLY upscale, denoise, de-blur, and detail restoration. No redesign, no new elements, no style change. { "task": "reference_locked_upscale_restore", "source_type": "auto_detect", "source_type_options": { "photo": "photograph or realistic render — preserve optical look", "2d_illustration": "anime, comic, flat art, poster — preserve linework and cel shading", "3d_render": "CGI, game asset, product render — preserve shaders and geometry", "scan_or_print": "old photo, magazine scan, poster — remove scan artifacts, keep period look", "screenshot": "game/UI/frame capture — remove compression, keep original UI/layout if present" }, "design_lock": { "copy_uploaded_reference": true, "preserve": [ "subject_identity", "silhouette_and_proportions", "pose_and_expression", "framing_crop_and_camera_angle", "composition_and_background_layout", "original_medium_and_art_style", "color_palette_and_white_balance", "lighting_direction_and_shadow_logic", "text_logos_and_layout_if_present" ], "do_not_change": [ "identity", "anatomy", "outfit_and_hair", "object_placement", "aspect_ratio", "number_of_subjects" ] }, "quality_pass": { "remove": [ "blur_and_motion_smear", "compression_artifacts", "jpeg_block_noise", "banding", "chromatic_aberration_from_bad_encode", "scan_dust_and_scratches", "mosquito_noise", "washed_out_contrast", "soapiness_and_ai_mud" ], "restore": [ "sharp_edges_and_contours", "micro_texture_on_existing_surfaces_only", "clean_flat_color_areas", "readable_fine_details_already_implied_in_source", "natural_dynamic_range", "consistent_grain_or_clean_digital_finish_matching_source_type" ], "forbid_invention": [ "new_objects", "new_faces", "extra_fingers_or_limbs", "hallucinated_background", "beauty_filter_identity_change" ] }, "style_finish_by_source": { "photo": { "medium": "high-end photographic print", "detail": "natural skin pores, fabric weave, hair strands — only where visible in source", "optics": "optical realism, natural bokeh, no oversharpening halo", "not": ["plastic_skin", "cgi_wax", "beauty_portrait_filter"] }, "2d_illustration": { "medium": "publication-ready 2D key visual", "line_art": "crisp consistent outlines", "shading": "clean cel-shading or original painterly logic — do not convert to 3D", "not": ["photorealism", "3d_cgi", "live_action"] }, "3d_render": { "medium": "clean high-res CGI still", "detail": "sharp material definition, edge clarity, no muddy AO", "not": ["photograph_conversion", "style_redesign"] }, "scan_or_print": { "medium": "restored archival print", "detail": "remove scan damage; keep authentic period color and paper texture subtly", "not": ["modern_hdr_look", "heavy_color_grading"] }, "screenshot": { "medium": "clean master frame", "detail": "remove blockiness; sharpen UI text and linework if present", "not": ["recomposition", "ui_redesign"] } }, "enhancement_intensity": { "level": "moderate", "notes": "polish_only — if result looks redesigned, reduce to light and rerun" }, "forbidden": [ "redesign", "style_change", "different_pose", "different_expression", "different_framing", "added_elements", "removed_elements", "watermark", "new_text", "oversharpening_halos", "plastic_skin", "ai_gloss" ], "hard_constraints": [ "uploaded_reference_is_source_of_truth", "polish_only", "no_invention", "match_reference_aspect_ratio" ], "output": { "aspect_ratio": "match_reference", "quality": "maximum_fidelity_restoration" } }

  • Камрады. Один из октопусов тут замаялся лазать на Canva под впн, чтобы собрать эстетики для соцсетей. Фотошоп каждый раз гонять тоже не всегда хочется ради такого дела, да и сетки нужны. В общем в результате навайбкодилась вот такая небольшая прога на питоне. Что делает: - можно выбирать палитру по выбранной картинке, щелкая по области. - можно исключать и добавлять обратно цвета из палитры - палитра применяется к выбранной картинке примерно как LUTS - дает подгружать до 6 картинок подряд чтобы составить из них колллаж (кнопочкой добавить оно добавляется в сетку для коллажа) - можно менять контраст, яркость, силу фильтра - можно щелкнув по добавленной картинке отрегулировать как она обрежется - доступны несколько вариантов сеток для коллажа, ширина границ и их цвет регулируются. - можно сохранить как отдельное измененное изображение так и коллаж целиком архив лежит тут https://disk.yandex.ru/d/55-IuNXYYajejA точно работает под Win10 под андроид пока версии нет, на более младших версиях винды тоже пока не проверялось кто хочет, может потестировать и написать фидбек Разумеется, все будет дорабатываться.

  • Мы также сделали канал на Youtube и загрузили туда видео из прошлого поста: https://youtu.be/hT7bAuWb-W4?si=6pIc5pc3Hc--3XY7 В дальнейшем будем публиковать там новые уроки. Приятного просмотра!

  • Записали видеоурок про создание фотореалистичных кадров с нужными персонажами из плохих исходников, а заодно про имитацию LUTS в Банане. Промпты в комментариях.

  • Список агрегаторов нейросетей, которые принимают российские карты и работают без средств обхода блокировок. В большинстве присутствуют как все основные продвинутые языковые модели, так и генераторы изображений, видео и музыки. Доступы к Nano Banana, Midjourney, Seedance, Suno предлагают многие сервисы. 1. SYNTX. Языковые модели, агенты, генераторы изображений, музыки, видео, клонирование голоса, апскейл, обучение. (Проверял лично, хороший сервис). 2. Phygital+. По большей части всё то же + возможность собирать собственные пайплайны на доске через ноды. (Проверял лично, хороший сервис). 3. Utopy. Аналог. Обещают в скором времени добавить векторизацию и 3Д. (Есть рекомендации от знакомых). 4. Lama. API, агенты, языковые модели, генераторы картинок и интеграции в сервисы. (Проверял лично, хороший сервис). 5. Unitool. Языковые модели, картинки, видео, апскейл. (Есть рекомендации от знакомых). 6. RuGPT. Тут, помимо текстов, картинок, видео, музыки и голоса, можно еще презентации и карточки генерировать. 7. GPTunneL. Примерно то же самое + преднастроенные боты и мини-сервисы под разные задачи. (Есть антирекомендация от https://t.me/varvara_fors — дорого, медленно, урезанный функционал). 8. chad. Стандартный набор: тексты, видео, аудио, картинки + ассистенты. 9. Fichi AI. Аналогично. 10. StudyAI. Аналогично + настроенный чат для исследований и обучения. 11. Bothub. Тут, помимо всех стандартных сервисов, есть еще транскрибация, создание таблиц, бот-юрист. 12. MashaGPT. Стандартный набор + отдельно вывели работу с кодом, анализ файлов. 13. YesChat. Агрегатор с большим количеством генеративных моделей и преднастроенных фильтров и стилей.

  • без подписи

  • без подписи

  • без подписи

  • Универсальный промпт для Nano Banana/chatGPT Image, который позволяет покрутить детали интерьера и ракурсы по референсу. Architectural interior contact sheet of the exact same room copied from the uploaded reference — identical layout, furniture placement, materials, colors, decor, and lighting mood in every panel. Only the camera changes. Six panels in a 2×3 grid with thin white gutters. Top row, left to right: 1) Direct overhead bird's-eye view, camera perpendicular to the floor, full room readable from above. 2) Strict lateral side view, camera parallel to one long wall, architectural elevation feel. 3) Rear viewpoint — camera placed where the main viewpoint was in the reference, looking back into the room toward the opposite wall. Bottom row, left to right: 4) Extreme low worm's-eye angle from floor level, camera near the ground pointing upward, ceiling and verticals dominant. 5) Natural three-quarter corner view at eye level about 1.6 meters, 35–45 degree angle, realistic perspective depth. 6) Tight macro photograph of one signature material or object visible in the reference — wood grain, fabric weave, tile joint, lamp metal, or hardware — shallow depth of field, same colors and wear as the reference.

  • Я бы разделил модели на три типа по уровню цензуры:   1.   Сервисы с самым высоким уровнем цензуры. Это в первую очередь Midjourney и chatGPT. Они блокируют большинство тем из прошлого поста и нередко реагируют даже на безобидные вещи. В Midjourney также всегда есть риск нарваться на бан аккаунта, поэтому с запросами к нему следует соблюдать максимальную осторожность. 2.   Онлайн-сервисы со средним уровнем цензуры. Преимущественно китайские: Seedream, Qwen, Kling. Они спокойнее относятся к насилию, легкой эротике, мрачным сюжетам. Главное, никакой политики. 3.   Локальные модели, которые запускаются на личном компьютере или в облаке при аренде сервера, поэтому в них цензура отсутствует. К ним относятся Flux, Qwen. Stable Diffusion, Z-Image, их можно обучить на любом контенте.  Ответственность за результат — на пользователе. Поэтому если вы много работаете с NSFW-контентом, то это ваш путь.    ___ Технически цензуру до какой-то степени можно обойти и в онлайн-сервисах. Я категорически не рекомендую этого делать в Midjourney, если не хотите потерять аккаунт. С другими сервисами можно поэкспериментировать, особенно если сработали ложные триггеры.   Существуют разные способы обхода фильтров в промпте: •          замена слов на синонимы или уточнение контекста: не titmouse, а titmouse bird, не blood, а red liquid; •          описание через метафоры: red juice, tomato ketchup вместо blood; discarded broken mannequin parts вместо severed limbs; •          использование художественных терминов вместо прямых: не scary gory monster, а macabre art, biomorphism;   Также можно смешивать онлайн и локальные решения: •          например, черновик сделать в ChatGPT, а доработать -  в локальном Qwen Edit (аналог Nano Banana); •          использовать inpainting для редактирования отдельных частей картинки, добавления крови, «раздевания» персонажа;   Мой личный совет: подбирайте сервис и модель под задачу Не пытайтесь делать всё в одном инструменте и в один этап. Если ваша задача регулярно упирается в фильтры — значит, вы в неправильном месте и стоит рассмотреть связку: коммерческие сервисы + open source решения.   Даже если у вас слабый компьютер, арендовать мощности под локальные модели можно на сервисах вроде https://www.runpod.io/ На Tensor.art также можно найти большое количество open source моделей и погонять их онлайн бесплатно: https://tensor.art/

  • Типичные триггеры можно разделить на четыре  категории.   1.Законодательно запрещённые в большинстве стран темы - сексуальный контент с несовершеннолетними; - реалистичное насилие над детьми; - порнография; - инструкции по созданию оружия, взрывчатки и других опасных вещей; - признанная на международном уровне террористическая и экстремистская символика; - контент, имитирующий реальные преступления; - фейки. Тут всё понятно. 2. Темы на грани запрещённого - обнажённая натура, даже художественная; - любые сексуальные сцены; - изображения политиков и знаменитостей, особенно реалистичные; - расчленёнка, ранения; - суицид, селфхарм; - наркотики; - оружие; - персонажи и объекты, защищённые авторским правом. Это серая зона. Иногда сервисы могут пропускать эти темы, иногда — нет.   3. Чужой стиль   Многие сервисы блокируют запросы на стиль известных студий, художников, франшиз. К ним относятся Disney, Pixar, любые крупные бренды. Это юридическая защита от исков. Однако тут всё зависит от политики конкретной компании. Некоторые сервисы не препятствуют генерации даже известных персонажей.   4. «Ложные» триггеры, когда нейросеть видит запретное там, где его нет.   И самые раздражающие. К ним относятся: - слова «ребёнок», «кровь», «нож» в любом контексте; - купальники, бельё, нижняя одежда; - обозначения частей тела человека; - упоминание чувственности; - роды, беременность, кормление; - слова, похожие на запрещённые (titmouse — синица, peacock — павлин); - религиозные образы; - сцены сражений, смерти даже в художественном и историческом контексте. Цензура тут срабатывает чаще всего из-за того, что нейросеть либо не поняла, либо неправильно интерпретировала  контекст. Тогда фильтры ориентируются на ключевые слова, которые внутри системы отмечены как «небезопасные».   То есть каждый запрос проходит минимум два уровня модерации: Фильтры промптов, которые проверяют их на запрещённые слова и сочетания. Фильтры результатов, которые проверяют уже готовые генерации на NSFW, насилие, лица знаменитостей и т.д. Бывает так, что картинка сгенерировалась, но не прошла второй уровень модерации. Тогда пользователь получает «заблюренный» вариант или предупреждение. Если вы уверены, что ничего противозаконного не хотели и на ваш запрос сработали «ложные» триггеры, можно попытать счастья ещё раз.

  • Итак, с цензурой вы будете сталкиваться регулярно в большинстве онлайн-сервисов. И это касается не только 18+ контента и имен знаменитостей. Модели могут агриться на такие слова как «кровь», «ребёнок», «купальник» и т.д. При этом время от времени без вашего запроса модель может сама выдавать вам расчленёнку на казалось бы безобидный промпт вроде «древняя акула» или голого мужчину, когда вы попросите духа или языческого бога. У меня была абсурдная ситуация, когда chatGPT не хотел генерировать змею, «потому что змеи страшные». В общем, фильтры работают странно и это связано с тем, что фильтров много и они наслаиваются друг на друга и иногда конфликтуют. Компании настолько яростно перестраховываются по нескольким причинам: 1. Юридические риски Компания, которая создала публичный генератор изображений или видео, отвечает за то, что он производит. Если нейросеть сгенерирует: - контент сексуального характера с детьми; - сцены насилия в фотореалистичном виде; - фейки со знаменитостями и политиками; - контент, нарушающий авторские права; то компания может столкнуться с исками, штрафами, а то и блокировкой. Для сохранения репутации лучше зацензурить лишнее, чем попасть в скандал. 2. Репутационные риски Ещё компании боятся заголовков в прессе в духе «Нейросеть X сгенерировала шокирующее изображение, и террористы распространили его в соцсетях». Поэтому фильтры часто настроены не столько на реально вредный контент, сколько на всё, что может спровоцировать потенциальный скандал. «Сцена боя в стиле Тарантино» — нельзя, фейки с Папой Римским — нельзя, «фэнтези-битва с расчленёнкой» — иногда можно. С точки зрения репутационных рисков копирование чужого стиля или лица, особенно для сомнительного контента, может стоить компании очень дорого. 3. Тренировочные данные Часть цензуры заложена в саму модель. Если её обучали на отфильтрованном датасете, она будет уметь не всё. Например, многие модели плохо рисуют обнажённую натуру, потому что их обучали на «безопасных» датасетах. 4. Корпоративные ценности и политика Еще у каждой компании своя позиция, что считается приемлемым, а что — нет. Это во многом зависит от юрисдикции страны разработчиков и от взглядов основателей. У OpenAI, Midjourney, китайских сервисов, open source могут сильно различаться и правила использования, и фильтры. 5. Чрезмерное любопытство пользователей Чем популярнее сервис, тем больше пользователей пытаются обойти его цензуру, придумывая эвфемизмы для запрещенных слов или системные промпты, которые ломают алгоритмы. Как следствие — строже становятся правила и фильтры. Ну и страдают обычно больше всех те пользователи, которые ничего плохого не хотят, но им нужен специфический контент по работе. В следующем посте подробно рассмотрим список триггеров.

  • без подписи

  • без подписи

  • без подписи