tgindex
Наедине с нейросетью

Наедине с нейросетью

Статистика

Стоицизм, нейросети, медитация и личные эксперименты. @Fessan

Последний пост
13 авг.
Последнее чтение
07:54
Постов за неделю
2
Всего постов
38
Тип
открытый
Язык
русский
Категория
Технологии
В каталоге с
13 авг.
Подписчики
409
0 за 3 дн.
Сутки
0
0,00%
Неделя
 
Месяц
 
Просмотров на пост
219
38 постов
Вовлечённость
53,5%
к подписчикам
Постов в день
0,3
всего 38
Упоминаний
1
каналов
Охват размещения
оценка
1/24сутки в ленте
75
1/48двое суток
85
1/72трое суток
92

Оценка по просмотрам недавних постов: пост набирает почти всё за первые сутки.

Посты

  • Утро Солнце И местный наблюдатель уже на посту😁

  • видео или голосовое, без подписи

  • В жизни может произойти что угодно. В том числе и ничего

  • Прогноз утром. Плюс 32, без дождя Мы поехали купаться 😂. Продолжение на видео А как ваши выходные?

  • Никогда не думал что термопаста может использоваться ... Разобрал вечером рабочий ноут, почистить решил Теперь жду утра, пока магазины откроются 😂

  • Когда ты менеджер в ИТ😅

  • Кхе кхе

  • Месяц я разбирался, почему у меня так быстро кончаются лимиты, выдвинул четыре версии, и три из них оказались враньём. Сначала думал, что виновато частое ревью. Настроил роли, а потом выяснилось, что они вообще не применялись, оба агента запускались мимо конфига. То есть я всё это время был уверен, что у меня работает схема, которой физически не было. Дальше перестал верить себе на слово. Вторая версия про перегруженный процесс подтвердилась хотя бы частично: семь этапов на любую правку, девять навыков, половина дублирует друг друга, и главный расход создаёт не работа с кодом, а обслуживание всего этого вокруг неё. Третья версия была про сабагентов, слишком уж удобно объяснять расход разветвлением. Посчитал за двое суток: сто пятьдесят шесть миллионов токенов. Пять процентов. Столько дали дочерние агенты, а всё остальное это несколько длинных сессий, которые на каждом обращении заново тащат за собой сотню тысяч контекста. Четвёртая версия была про частый компакт, и он тоже оказался ни при чём, компактов ноль за сессию. А ощущение частоты создавал хук с уведомлением на рабочем столе, двенадцать параллельных сессий, всплывашка от каждой, и я реагировал на попап. Зато там же нашлось настоящее. Семьдесят пять выводов команд за сессию, медиана меньше тысячи символов, то есть подавляющее большинство безобидны, но десять вызовов из семидесяти пяти дали две трети объёма, и выводы команд занимают примерно половину всего, что модель на себе тащит. Механика простая и от этого обидная: большой вывод переотправляется на каждом следующем ходу до конца сессии, и один cat на сорок тысяч символов в середине работы превращается в десять тысяч токенов, помноженных на всё, что будет после. Я месяц чинил не то и не тем, потому что цифры брал не свои. Сейчас тестирую новые настройки, живут они пару дней, и если цифры в логах подтвердятся, напишу отдельно, что именно помогло. Три версии из четырёх были убедительными и неверными, и ни одна не развалилась от того, что я про неё подумал ещё раз, каждую пришлось идти и мерить.

  • 19 июл.17543из aimastersme

    Материтесь ли вы на работе? Умный дядька Нассим Талеб в книге «Рискуя собственной шкурой» (та, что вышла после «Чёрных лебедей») формулирует: если человек говорит формальностями, весь такой вежливый, извиняется на каждом шагу - ему плевать на проект. Шкура не горит. А где ставки настоящие, там матерятся. Зайдите в кабину пилота: «уважаемый Вадим Сергеевич, мы падаем, поднимите, пожалуйста, руль» - ага, ну, конечно! Загляните в операционную, или к строителям, которым платят, чтобы кран ни на кого не упал. Именно поэтому я запилил скилл POHUY, а не ради шуточек - режим идиоматического русского мата для агентов. Агент перестаёт мямлить «the deployment failed because the environment variable...» а прямо докладывает: «деплой наебнулся...». Сегодня доделал v2: шкала состояний, словарь со сценами применения, evals. Работает как часы - экономит вам нервы, а не токены ==== Дальше по апдейтам IVA теперь обновляется плавненько. Пишете ей /update - она накатывает улучшения и сохраняет все ваши правки. Кастомизируйте её сколько хотите, обновления ничего не затирают. Заодно навёл красоту UX ==== И превью, про которое скоро будет отдельный пост: скилл MENTOR . Он читает историю ваших сессий в Claude Code и Codex и показывает, что не так в вашей работе с агентами: что строите, где теряете время, что чинить. Зачем я делаю MENTOR - в компаниях сейчас решают, кого увольнять из-за AI. Уволишь джунов - сеньоры разленятся. Уволишь сеньоров - некому учить джунов. Мне милее второй вариант: пусть сеньоры идут отдыхать, а учит нейронка с моим скиллом POHUY - один в один как сеньор. Сейчас готово процентов двадцать от задуманного Ментора, работаю дальше. ==== Теперь просьба У меня здесь 6000 подписчиков. Зайдите на GitHub. пожалуйста, - пройдите по ссылкам и поставьте звёзды. Если нет аккаунта - регистрация занимает два шага. Огоньки в телеграме греют, но другие люди находят мои проекты по звёздам на гитхабе. Мне нужна ваша поддержка. Поставьте звезду любому проекту, я вас очень прошу. Это важно. Спасибо @aimastersme

  • Давайте поможем звёздами на гитхабе

  • видео или голосовое, без подписи

  • видео или голосовое, без подписи

  • видео или голосовое, без подписи

  • Мемасики. Вот я сегодня опять встал в 5 утра. И у меня есть один вопрос - нафига?!

  • Роли настроил, маршрутизация работает,

  • 14 июл.2567из MichaelTkach94

    Я тут слежу немного за релизом 5.6, если кому интересно: - Модель sol оказалась очень прожорливой, ее в первый же день оптимизировали, поэтому если в конце недели попробовали и разочаровались, то можно пробовать снова - Ultra режим починили, у кого хорошая подписка, можно пробовать, больше не должен делать неадекватные планы - Ближайшие 1-2 дня сняты 5 часовые лимиты, есть только недельные и их обнулят скоро, так что можно тестировать и жечь лимиты - Контекстное окно сократили с 356 до 256, опять же ради оптимизации и возвращать вроде как не планируют - В целом ближайшие дни будет все меняться, модель оказалась сырой и не выдержала релиза. В таком виде как сейчас не на долго - Если не смотреть на все эти проблемы, то по всем метрикам линейка хорошая, точно стоит внимания

  • OpenAI выкатили 5.6, и вместо одной модели там теперь три - Sol, Terra и Luna. Флагман, середнячок и дешёвая быстрая. Разница в цене заметная, Sol стоит впятеро дороже Luna, и вокруг этой разницы построена главная для меня новинка релиза. В Codex завезли роли - можно расписать, какая модель какую задачу тянет. Сложный рефакторинг отдаёшь Sol, повседневную рутину - Terra, а переименовать переменную по всему проекту может и Luna, ей для этого хватает ума. Идея здравая - не жечь дорогой флагман на механику. OpenAI называет цифру в 54% экономии токенов на агентских задачах. Заодно отменили лимит пяти часов - правда, с пометкой «временно», так что радоваться я бы не спешил. Я начал гонять это на своих задачах. Пока - никакой разницы. Роли настроил, маршрутизация работает, токены вроде бы куда-то экономятся, но ни по скорости, ни по качеству, ни по ощущению от работы отличий от 5.5 я толком не вижу. Может, мои задачи слишком однородные, может, рано судить. Каждый релиз обещает перелом. В день анонса всё выглядит как новая эпоха, бенчмарки побиты, конкуренты повержены, а через две недели ты сидишь в том же терминале и делаешь ту же работу примерно с тем же результатом. Настоящую пользу инструмента видно не в день анонса, а тогда, когда он либо встроился в рутину, либо тихо из неё выпал. Продолжаю тестировать. Если роли действительно начнут экономить - напишу. Пока это выглядит как ещё один способ красиво разложить то, что и так работало.

  • Июнь в Томске был самым жарким с 1897 года

  • Вот вам чутка инфы из новостей Побежали тестировать! ГПТ work выглядит очень перспективно. Как и ГПТ 5.6 которая по бенчам не сильно хуже нашумевшей Fable 1. OpenAI выкатила GPT‑5.6: Luna, Terra, Sol Почему важно: новая флагманская линейка с тремя размерами моделей и разной ценой: Luna $1/$6, Terra $2.50/$15, Sol $5/$30 за 1M input/output tokens. Что это значит для тебя: если появится в обычном ChatGPT / model picker, стоит проверить не “самая умная ли”, а какая модель лучше под твои PM-задачи: документы, анализ, планирование, код. Ссылка: https://openai.com/index/gpt-5-6 2. ChatGPT Work: OpenAI двигает ChatGPT в сторону долгоживущего рабочего агента Почему важно: OpenAI описывает ChatGPT Work как агента, который может часами работать над задачей, действовать через приложения и файлы, доводить цель до результата. Что это значит для тебя: это потенциально ближе к “PM-ассистенту на проект”: собрать контекст, обновить документы, подготовить план, пройтись по файлам. Но стоит смотреть на приватность, разделение cloud/desktop и доступы. Ссылка: https://openai.com/index/chatgpt-for-your-most-ambitious-work

  • вся психология за 20 секунд

Наедине с нейросетью — tgindex