tgindex
Агенты ИИ | AGI_and_RL

Агенты ИИ | AGI_and_RL

Статистика

Про ии, RL и в целом @tokarev_i_v https://t.me/researchim

Последний пост
14 авг.
Последнее чтение
11:58
Постов за неделю
4
Всего постов
26
Тип
открытый
Язык
русский
Категория
Технологии (по похожим)
В каталоге с
12 авг.
Подписчики
6 120
+2 за 4 дн.
Сутки
−3
−0,05%
Неделя
 
Месяц
 
Просмотров на пост
3 241
25 постов
Вовлечённость
53,0%
к подписчикам
Постов в день
0,6
всего 26
Упоминаний
2
каналов
Охват размещения
оценка
1/24сутки в ленте
979
1/48двое суток
1 121
1/72трое суток
1 210

Оценка по просмотрам недавних постов: пост набирает почти всё за первые сутки.

Посты

  • завтра уже https://huggingface.co/Qwen/Qwen3.8-27B 🪳🪳🪳

  • 13 авг.1 0862229

    завтра уже https://huggingface.co/Qwen/Qwen3.8-27B 🪳🪳🪳

  • 13 авг.1 123614

    ля вот и DeepSeek-V4-Pro-0813 1.57T A48B https://huggingface.co/deepseek-ai/DeepSeek-V4-Pro-0813 гуфы тут будут https://huggingface.co/unsloth/DeepSeek-V4-Pro-0813-GGUF я даже хз что и сказать. ни дня без крутого релиза все еще ждем 27б квен

  • 12 авг.1 3281518

    А вот и Qwen 3.8 2.4T релизы крутые в последнее время конечно гуфы https://huggingface.co/unsloth/Qwen3.8-2.4T-A95B-GGUF самому негде запускать это ждем 27B модельку которую тоже обещали

  • 3 авг.2 2542688

    Обновил ресеч агента на квенах Это для тех кто хотел бы работать на своей тачке с локальными модельками теперь добавился режим с поиском инфы по разным источникам (научным типа архива и опеналекс) и по вебу с отчетом по результатам типа дипресеча - задаете ему тему например поиск статей, можно задать временные рамки, сколько источников в отчете должно быть и он будет искать https://github.com/researchim-ai/one-click-research-agent тут приложения https://github.com/researchim-ai/one-click-research-agent/releases/tag/v0.1.2 рекомендую все же qwen 3.6 35b использовать попробую заточить под 9b тоже, но посмотрим для поднятия searxng и работы поиска по вебу нужен докер все проекты делаются тут https://t.me/researchim

  • 31 июл.2 4721317

    кажется неплохой дроп от дипсиков - апдейт для v4 flash https://huggingface.co/deepseek-ai/DeepSeek-V4-Flash-0731 ggufы уже готовятся https://huggingface.co/unsloth/DeepSeek-V4-Flash-0731-GGUF

  • 30 июл.1 635188из boris_again

    Нужна ваша помощь! 👀👀👀 Мы, Steelman Labs, написали наш первый блог-пост: о том, что не так с computer use и как мы это решаем. А ещё выложили красивый демо-видос. https://x.com/SteelmanLabs/status/2082789336995528727?s=20 Большая просьба помочь хайпом в твиттере и лайком на HN https://news.ycombinator.com/item?id=49108542

  • 27 июл.2 6923334

    ну штош выложили веса Kimi K3 (2.8TA104b) - это который фейбл дома наверное самый важный релиз со времен квенов 3.5, правда совсем другой весовой категории муншоты легенды🥰 именно для таких релизов нужны OpenAI, Anthropic и все остальные жаль в 3090 не влезет https://www.kimi.com/blog/kimi-k3 https://github.com/MoonshotAI/Kimi-K3/blob/main/k3_tech_report.pdf веса https://huggingface.co/moonshotai/Kimi-K3

  • 19 июл.3 1131194

    про ризонинге и как уровень рассуждений контролировать и настраивать в ллм https://magazine.sebastianraschka.com/p/controlling-reasoning-effort-in-llms

  • 15 июл.3 4622979

    Чел показывает как потюнить ллмку рлем чтобы она тюнила маленькие ллмки рлем, прикольно https://github.com/Danau5tin/ai-trains-ai

  • 9 мая5 41947123

    Мои хорошие новый релизик полностью локального кодинг агента на квенах который ставится за одно нажатие https://github.com/researchim-ai/one-click-coding-agent https://github.com/researchim-ai/one-click-coding-agent/releases/tag/v0.1.3 Там Qwen 3.6 35B, 27B Qwen 3.5 35B, 9B Для скорости рекомендую кванты Q3_K_XL На 3090 35B бегает ловко с макс контекстом на 12 VRAM + 16 RAM виндовском ноутбуке 9B со 128к контекстом тоже вполне шурует ну и вообще в целом стал более-менее норм агент, мне даже нравится Все проекты делаются тут: https://t.me/researchim Если потестите агента и будут баги/предложения отписывайтесь сюда плиз ❤️

  • 25 апр.4 09417111из LakoMoorDev

    QClaw-4B — это языковая модель, дообученная для агентных задач и работы с инструментами в рамках OpenClaw-совместимых фреймворков. Основана на Qwen3.5-4B. Несмотря на компактный размер, модель достигает результатов уровня значительно более крупных моделей — на ClawBench набрала 84.8 / 100 (Pass Rate 73.5%), вплотную к Kimi K2.5 и GLM-4.5. На Ru-Arena-General — 80.7% winrate, SOTA в классе ≤4B. 🔗 Карточка модели: https://huggingface.co/LakoMoor/QClaw-4B 🔗 GGUF (llama.cpp / Ollama / LM Studio): https://huggingface.co/LakoMoor/QClaw-4B-GGUF ⚖️ Лицензия: apache-2.0 Отдельная благодарность @lovedeathtransformers за ресурсы под обучение и прогон бенчмарков

  • 17 апр.4 2521320

    ребятки опус 4.7 уже в курсоре доступен щас работает над переносом нашей тренинг студии дома https://github.com/researchim-ai/models-at-home на электрон. попробуем сделать отдельную аппку под разные платформы а весь бек будет в докере также крутиться там будет по сути отдельный проект для студии как прилы. а models-at-home пока так и будет оставаться браузерным со стримлитом. ну такие планы так что посмотрим как новый опус справится

  • 14 апр.3 0431413из sberlogabig

    🚀 Серия соревнований по МЛ ! С денежными и другими призами ! Кому интересен МЛ/RL или математика или пазлы или роботы. Приглашаем Вас принять участие в серии челленджей. Соревнование организуется совместно с учеными лаборатории интеллектуальных технологий робототехники МФТИ, (руководит проектом - Илья Осокин), которые поставили себе амбициозную цель создать робота, который побьет мировой рекорд по сборке Мегаминкса ! Узнать больше о робототехнической части проекта Вы можете в сообщении https://t.me/forodirchNEWS/3165 , хабре или в чате @starkitmega. Проект CayleyPy предлагает Вам принять участие в решении алгоритмической части задачи - создании алгоритмов - которые смогут получать наиболее короткие (близкие к оптимальным ) решения. Методы решения важны в широком круге проблем от математики до квантовых компьютеров, МЛ/РЛ и теории струн. Для этого мы организовали соревнования на платформе Каггл. Первый разыгрываемый приз - 10 000 рублей. Условия первого этапа очень простые. Есть три челленджа на Каггле Мегаминкс https://www.kaggle.com/competitions/cayley-py-megaminx/leaderboard Кубик Рубика 333 https://www.kaggle.com/competitions/cayleypy-ihes-cube Кубик Рубика 444 https://www.kaggle.com/competitions/cayley-py-444-cube Приз будет получен первым, кто достигнет ЛЮБУЮ из целей: 1 Или в конкурсе Мегаминкс - кто достигает скор 80 000 - и опубликует публичное решение 2 Или обогнать Томаса Рокицкого в конкурсах по кубику 333 или 444 (любом из них) и тоже опубликовать публичное решение. (Томас Рокицкий - легендарный специалист по вычислительным аспектам головоломок - именно его команда нашла "число Бога" кубика Рубика в 2010 году - подведя итог более 30 годам усилий большого количества специалистов). Подробное описание соревнований -- по ссылкам выше. Кратко: даны 1000 состояний пазлов и Вам надо предъявить их решения -- чем короче решение тем лучше (то есть чем меньше шагов/"мувов"). Score на лидерборде = сумма длин решений по всем пазлам. Соревнования полностью аналогичны соревнованию Каггл Санта 2023 -- можно навайбкодить изменения лучших решений оттуда. Также стоит взять наш подход CayleyPy и изменить в нем образующие на мегаминкс. Это сделали те, кто сейчас в топе. Дополнительную информацию, обсуждение и советы - см. чаты - @starkitmega @sberlogasci. Вводные лекции: четверг 19.00, пятница 20.00 (время по Москве). Дополнительным призом будет возможное участие в научных публикациях. Наши цели амбициозны - мы уже добились исключительных результатов, которые имеют приложение в МЛ, математике, теории струн, квантовых вычислениях и т.д. Публикации отмечены NIPS spotlight. Узнать больше Вы можете в наших статьях. Если у Вас есть несколько свободных часов в неделю, знание Питона или математики и Вам интересно принять участие - пишите @alexander_v_c - мы рады всем - начинающим и профи. Планируется серия челленджей и призов. Когда первый приз будет разыгран - мы объявим о втором этапе. ================ А также мы ищем Cпоносоров. Вы можете поддержать нас переведя на карту Илье Осокину 2202208362030505 Или напишите @alexander_v_c (Александр Червов) И кидайте нам, пожалуйста, звезды на гитхаб, Вы нам очень поможите: https://github.com/cayleypy/cayleypy ================ Выражаем благодарность компании RYBE - толстовки для айтишников: https://rybe.store https://t.me/rybe_store ================ Выражаем благодарность агентству BLASTIM за поддержку: ❤️ Наши курсы: agency.blastim.ru 🥨 Свежие вакансии в биотехе: blastim.ru 🤝 https://t.me/blastim

  • 11 апр.2 913263

    Кстати из небольших новостей я начал недавно пробовать стримить Не по иишке правда а больше по играм. Сделал рандом канальчик по игрушке в которой время провожу. Хотелось чисто попробовать и понять а что это вообще и есть ли смысл. Понял что смысл есть. Можно было это делать еще пару лет назад спокойно. Но как-то даже в голову не приходило стримерство, тк никаких других стримеров я не смотрю Возможно чутка попозже я буду пробовать выводить и этот канал тоже на твич и со стримами по иишке ну и вообще на разговорные темы, там досуг типа игрушки поиграть и еще чего хз. не знаю) Но пока так скажу - если вы в чем-то онлайновом время проводите и у вас есть желание с другими конектиться и общаться, то попробуйте. Не зайдет - ну и пофигу. А если понравится, то будете собирать аудиторию и близких по интересам людей)

  • 11 апр.3 0041763

    кстати у нас там обнова в локальном кодинговом агенте https://github.com/researchim-ai/one-click-coding-agent/releases/tag/v0.1.1 на самом деле оно должно быть v0.2 потому что там прям много чего добавлено. но ладно. вроде стало сильно удобнее https://…

  • 3 апр.3 1863413

    https://arxiv.org/abs/1312.5602

  • 19 мар.10,9 тыс21121

    прикольно дизайнить процессоры агентами Design Conductor: An agent autonomously builds a 1.5 GHz Linux-capable RISC-V CPU https://arxiv.org/abs/2603.08716 https://www.alphaxiv.org/ru/overview/2603.08716

  • 11 мар.4 2531844

    ребятки, новые квены 3.5 получились отличные. респект квенам отдельное спасибо OpenAI, Anthropic, Google за такие крутые модельки. эти компании со своими фронтирами для того и нужны чтобы были у нас крутые квены щас локально работаю с 35b и 9b в q4 - все…

  • 10 мар.3 7341976

    а вот это прикольное применение опенклав Most RL-for-LLM systems assume centralized, batch-mode training with pre-collected datasets. OpenClaw-RL takes a fundamentally different approach: it wraps your self-hosted model in OpenClaw as an OpenAI-compatible API, intercepts live multi-turn conversations, and continuously optimizes the policy in the background — all without interrupting your usage. https://github.com/Gen-Verse/OpenClaw-RL напомню что у нас есть штука для тех кто хотел бы сам тюнить модельки https://github.com/researchim-ai/models-at-home достаточно докера и можно тюнить ллмки небольшие у себя от претрена до грпо)

Агенты ИИ | AGI_and_RL — tgindex