tgindex
DRL Study Group

DRL Study Group

Статистика
@DRL_study_groupКнигиперсидский

گروه همخوانی کتاب و مقالات در زمینه یادگیری تقویتی و یادگیری تقویتی عمیق English branch: https://t.me/DRL_study_group_en آپارات: https://www.aparat.com/DeepRL_StudyGroup یوتوب: http://www.youtube.com/@DeepRL_StudyGroup

Последний пост
3 авг.
Последнее чтение
13 авг.
Постов за неделю
0
Всего постов
20
Тип
открытый
Язык
персидский
Категория
Книги
В каталоге с
13 авг.
Подписчики
675
мало замеров
Замеров пока мало
Сутки
0
0,00%
Неделя
 
Месяц
 
Просмотров на пост
994
20 постов
Вовлечённость
147,3%
к подписчикам
Постов в день
0,0
всего 20
Упоминаний
0
каналов
Охват размещения
оценка
1/24сутки в ленте
272
1/48двое суток
311
1/72трое суток
336

Оценка по просмотрам недавних постов: пост набирает почти всё за первые сутки.

Посты

  • دوستان سلام ، به علت اهمیت مباحث agentic ai و کاربرد گسترده ای که پیدا کرده، یک کانال و گروه جدا ساخته شده، که در صورت تمایل می تونید عضو بشید. قرار هست با یک سری از ویدئو های ضبط شده و هم چنین تعدادی وبینار به این مباحث بپردازیم. لینک کانال : https://t.me/AgentiicAI لینک گروه : https://t.me/+08yJG36SmCExNWU0

  • 21 февр.55538из pytorch_howsam

    به‌صورت کلی، فعالیت حرفه‌ای در دنیای LLM-ها را می‌توان به دو شاخه اصلی تقسیم کرد: LLM Research و LLM Engineering این دو شاخه اگرچه به‌شدت به هم وابسته‌اند، اما از نظر هدف، نوع کار، مهارت‌های لازم و حتی ذهنیتی که از فرد می‌خواهند، تفاوت‌های اساسی دارند. 1️⃣ شاخه LLM Research به شاخه‌ای از کار با مدل‌های زبانی بزرگ گفته می‌شود که تمرکز آن بر فهم عمیق سازوکار درونی مدل‌ها و توسعه روش‌های جدید برای بهبود آن‌هاست. نوع سوال‌هایی که یک LLM Researcher با آن‌ها درگیر است: - چرا ترنسفورمرها این‌قدر خوب جواب می‌دهند؟ - آیا معماری بهتری از ترنسفورمر وجود دارد؟ - چه ایده‌هایی در معماری DeepSeek یا GPT-OSS مطرح شده است؟ - چطور می‌توان مدل را با داده کمتر آموزش داد؟ 2️⃣ شاخه LLM Engineering شاخه‌ای از دنیای LLM-هاست که تمرکز آن بر ساخت سیستم‌ها، محصولات و راه‌حل‌های واقعی با استفاده از مدل‌های زبانی موجود/آماده است. در این مسیر، فرض بر این است که مدل‌های قدرتمند از قبل وجود دارند و مسئله اصلی این است که چطور آن‌ها را به‌درستی در یک نرم‌افزار یا سرویس به کار بگیریم تا برای کاربر نهایی مفید، قابل اعتماد و مقرون‌به‌صرفه باشند. نوع مسئله‌هایی که یک LLM Engineer با آن مواجه است: - ساخت چت‌بات سازمانی - طراحی سیستم RAG برای اسناد داخلی - اتصال LLM به دیتابیس و API - ساخت Agent هوشمند - کاهش هزینه inference این بخشی از پست زیر در سایت هوسم بود که به همه علاقه‌مندان یادگیری LLM-ها توصیه می‌کنم مطالعه کنن. چون میتونه کمکتون کنه تصمیم اشتباه نگیرید و زمان و هزینه یادگیری رو در مسیر درست صرف کنید. لینک پست: LLM Research یا LLM Engineering؟ راهنمای یادگیری مدل‌های زبانی بزرگ

  • 8 февр.58110из maktabkhooneh

    ❤️‍🩹وقتی شرایط سخت می‌شه، توجه به امید و ساختن مسیرهای بهتر اهمیت بیشتری پیدا می‌کنه. 💡ما در مکتب‌خونه باور داریم، یادگیری می‌تونه یکی از مؤثرترین راه‌ها برای عبور از چالش‌ها و ساختن مسیر بهتر باشه. 💯به همین دلیل، مجموعه‌ای از دوره‌ها رو به‌صورت رایگان در دسترس گذاشتیم؛ از مدیریت استرس و احساسات و تقویت تاب‌آوری ذهنی، تا مهارت‌های ارتباطی، تفکر انتقادی و حل مسئله. 🎯همچنین دوره‌های آموزشی برای کودکان و نوجوانان و در کنار اون‌ها چند دوره کاربردی و پرمخاطب در حوزه فناوری، هوش مصنوعی، مدیریت مالی شخصی و مهارت‌های شغلی ارائه شده. 🔄مهلت استفاده از این طرح تا ۲۴ بهمن‌ماه است. اگر فکر می‌کنید این آموزش‌ها برای بقیه هم مفیده، این پست رو باهاشون به اشتراک بگذارید. برای تهیه آموزش دلخواه‌تون بصورت رایگان، کافیه وارد لینک زیر بشید و با کد تخفیف hamdeli2 دوره رو تهیه کنید.👇 https://mktb.me/vm0y/ @maktabkhooneh | مکتب‌خونه

  • 20 дек.1 086337

    видео или голосовое, без подписи

  • سلام بچه‌ها ^-^ شب یلداتون پیشاپیش مبارک! من این کتابو خیلی فشرده میخوام تو دو هفته آینده بخونم و هدفم تقریبا هر روز یه فصل (یکم بیشتر / کمتر) کل کتاب ۱۲ فصله + مقدمه و هدف اینه که تو ۱۴ روز تموم بشه (یا مقدار زیادیش پیش بره) اگه دوست دارین کتابو با هم گروهی بخونیم و فرصتشو دارین(تاکید می‌کنم اگه فرصتشو دارین) به این آیدی (@Lily_of_the_Nile) پیام بدین که لینک گروه رو براتون بفرستم. (گروه صرفا برای پرسیدن سوال و پیشروی و ... حول مطالب کتابه. سعی‌میکنیم چند فصل یبار یه جلسه داشته باشیم تو گوگل میت(احتمالا حدود ۹ شب به وقت ایران).

  • 9 дек.585618из DeepRLCourse

    📣 Stanford Spring 2025 Deep Reinforcement Learning Course: 👩🏻‍🏫 Prof. Chelsea Finn 🔗 https://cs224r.stanford.edu 🎥 https://www.youtube.com/watch?v=EvHRQhMX7_w&list=PLoROMvodv4rPwxE0ONYRa_itZFdaKCylL

  • 15 нояб.1 000415

    NeurIPS 2025 Papers https://jalammar.github.io/assets/neurips_2025.html

  • سلام دوستان اگر جهت چاپ یک مقاله که ترکیب ML و RL هست، علاقه مند هستید، لطفا پیام بدید. با تشکر دکتر توتونچیان

  • سلام‌ بچه‌ها!😁 اگه کسی هست که آشنایی لازم و کافی با مفاهیم knowledge graph و graphRAG داره و فرصت داره و میتونه درحد یه کال کوتاه این مفاهیم رو به من توضیح بده(یکم‌فراتر از تعاریف اولیه مدنظرمه ) (🥲) این‌پایین‌ بگین. مرسی کلی❤️🙏

  • سلام‌ بچه‌ها!😁 اگه کسی هست که آشنایی لازم و کافی با مفاهیم knowledge graph و graphRAG داره و فرصت داره و میتونه درحد یه کال کوتاه این مفاهیم رو به من توضیح بده(یکم‌فراتر از تعاریف اولیه مدنظرمه ) (🥲) این‌پایین‌ بگین. مرسی کلی❤️🙏

  • این تاک ها لینک گوگل میت داره ؟

  • 🚀 Join Adam White’s Talk at Sharif University of Technology 🎙 Title: Empirical Practices in RL and How to Make Them Better? 👨‍🏫 Speaker: Adam White (Canada CIFAR AI Chair, Director of Amii, PI of the RLAI Lab, and Assistant Professor in Computing Science…

  • 🚀 Join Adam White’s Talk at Sharif University of Technology 🎙 Title: Empirical Practices in RL and How to Make Them Better? 👨‍🏫 Speaker: Adam White (Canada CIFAR AI Chair, Director of Amii, PI of the RLAI Lab, and Assistant Professor in Computing Science at the University of Alberta) 📅 Date: Friday (May 30, 2025) 🕗 Time: 8:30 PM Iran Time 💡 Sign Up Here: https://forms.gle/aF4SMB7bd8KZm4nw7 @DeepRLCourse

  • 24 мая 2025 г.7972из DeepRLCourse

    🚀 Join Pascal Poupart’s Talk at Sharif University of Technology 🎙 Title: Reinforcement Learning for Large Language Model Alignment and Inference (Abstract) 👨‍🏫 Speaker: Pascal Poupart (Professor at University of Waterloo and Canada CIFAR AI Chair at the Vector Institute) (Biography) 📅 Date: Thursday (May 29, 2025) 🕗 Time: 4:30 PM Iran Time 💡 Sign Up Here: https://forms.gle/MzdwseJdP3fhFPW78 @DeepRLCourse

  • 🚀 Join Jeff Clune’s Talk at Sharif University of Technology 🎙 Title: Open-Ended and AI-Generating Algorithms in the Era of Foundation Models 👨‍🏫 Speaker: Jeff Clune (University of British Columbia, Vector Institute, DeepMind) 📅 Date: Friday (May 2, 2025)…

  • 2 мая 2025 г.66812из DeepRLCourse

    🚀 Join Jeff Clune’s Talk at Sharif University of Technology 🎙 Title: Open-Ended and AI-Generating Algorithms in the Era of Foundation Models 👨‍🏫 Speaker: Jeff Clune (University of British Columbia, Vector Institute, DeepMind) 📅 Date: Friday (May 2, 2025) 🕗 Time: 8:00 PM Iran Time 💡 Sign Up Here: https://forms.gle/57sRPPLWMd9dcF8F9 @DeepRLCourse

  • https://youtu.be/zzXyPGEtseI?si=IBrLKaNRbcR77KGy

  • видео или голосовое, без подписи

  • the effect of reward scale on deep reinforcement learning algorithm performance

  • https://deepmind.google/discover/blog/preserving-outputs-precisely-while-adaptively-rescaling-targets/

DRL Study Group — tgindex