DRL Study Group
Статистикаگروه همخوانی کتاب و مقالات در زمینه یادگیری تقویتی و یادگیری تقویتی عمیق English branch: https://t.me/DRL_study_group_en آپارات: https://www.aparat.com/DeepRL_StudyGroup یوتوب: http://www.youtube.com/@DeepRL_StudyGroup
- Последний пост
- 3 авг.
- Последнее чтение
- 13 авг.
- Постов за неделю
- 0
- Всего постов
- 20
- Тип
- открытый
- Язык
- персидский
- Категория
- Книги
- В каталоге с
- 13 авг.
- 1/24сутки в ленте
- 272
- 1/48двое суток
- 311
- 1/72трое суток
- 336
Оценка по просмотрам недавних постов: пост набирает почти всё за первые сутки.
Посты
دوستان سلام ، به علت اهمیت مباحث agentic ai و کاربرد گسترده ای که پیدا کرده، یک کانال و گروه جدا ساخته شده، که در صورت تمایل می تونید عضو بشید. قرار هست با یک سری از ویدئو های ضبط شده و هم چنین تعدادی وبینار به این مباحث بپردازیم. لینک کانال : https://t.me/AgentiicAI لینک گروه : https://t.me/+08yJG36SmCExNWU0
بهصورت کلی، فعالیت حرفهای در دنیای LLM-ها را میتوان به دو شاخه اصلی تقسیم کرد: LLM Research و LLM Engineering این دو شاخه اگرچه بهشدت به هم وابستهاند، اما از نظر هدف، نوع کار، مهارتهای لازم و حتی ذهنیتی که از فرد میخواهند، تفاوتهای اساسی دارند. 1️⃣ شاخه LLM Research به شاخهای از کار با مدلهای زبانی بزرگ گفته میشود که تمرکز آن بر فهم عمیق سازوکار درونی مدلها و توسعه روشهای جدید برای بهبود آنهاست. نوع سوالهایی که یک LLM Researcher با آنها درگیر است: - چرا ترنسفورمرها اینقدر خوب جواب میدهند؟ - آیا معماری بهتری از ترنسفورمر وجود دارد؟ - چه ایدههایی در معماری DeepSeek یا GPT-OSS مطرح شده است؟ - چطور میتوان مدل را با داده کمتر آموزش داد؟ 2️⃣ شاخه LLM Engineering شاخهای از دنیای LLM-هاست که تمرکز آن بر ساخت سیستمها، محصولات و راهحلهای واقعی با استفاده از مدلهای زبانی موجود/آماده است. در این مسیر، فرض بر این است که مدلهای قدرتمند از قبل وجود دارند و مسئله اصلی این است که چطور آنها را بهدرستی در یک نرمافزار یا سرویس به کار بگیریم تا برای کاربر نهایی مفید، قابل اعتماد و مقرونبهصرفه باشند. نوع مسئلههایی که یک LLM Engineer با آن مواجه است: - ساخت چتبات سازمانی - طراحی سیستم RAG برای اسناد داخلی - اتصال LLM به دیتابیس و API - ساخت Agent هوشمند - کاهش هزینه inference این بخشی از پست زیر در سایت هوسم بود که به همه علاقهمندان یادگیری LLM-ها توصیه میکنم مطالعه کنن. چون میتونه کمکتون کنه تصمیم اشتباه نگیرید و زمان و هزینه یادگیری رو در مسیر درست صرف کنید. لینک پست: LLM Research یا LLM Engineering؟ راهنمای یادگیری مدلهای زبانی بزرگ
❤️🩹وقتی شرایط سخت میشه، توجه به امید و ساختن مسیرهای بهتر اهمیت بیشتری پیدا میکنه. 💡ما در مکتبخونه باور داریم، یادگیری میتونه یکی از مؤثرترین راهها برای عبور از چالشها و ساختن مسیر بهتر باشه. 💯به همین دلیل، مجموعهای از دورهها رو بهصورت رایگان در دسترس گذاشتیم؛ از مدیریت استرس و احساسات و تقویت تابآوری ذهنی، تا مهارتهای ارتباطی، تفکر انتقادی و حل مسئله. 🎯همچنین دورههای آموزشی برای کودکان و نوجوانان و در کنار اونها چند دوره کاربردی و پرمخاطب در حوزه فناوری، هوش مصنوعی، مدیریت مالی شخصی و مهارتهای شغلی ارائه شده. 🔄مهلت استفاده از این طرح تا ۲۴ بهمنماه است. اگر فکر میکنید این آموزشها برای بقیه هم مفیده، این پست رو باهاشون به اشتراک بگذارید. برای تهیه آموزش دلخواهتون بصورت رایگان، کافیه وارد لینک زیر بشید و با کد تخفیف hamdeli2 دوره رو تهیه کنید.👇 https://mktb.me/vm0y/ @maktabkhooneh | مکتبخونه
видео или голосовое, без подписи
سلام بچهها ^-^ شب یلداتون پیشاپیش مبارک! من این کتابو خیلی فشرده میخوام تو دو هفته آینده بخونم و هدفم تقریبا هر روز یه فصل (یکم بیشتر / کمتر) کل کتاب ۱۲ فصله + مقدمه و هدف اینه که تو ۱۴ روز تموم بشه (یا مقدار زیادیش پیش بره) اگه دوست دارین کتابو با هم گروهی بخونیم و فرصتشو دارین(تاکید میکنم اگه فرصتشو دارین) به این آیدی (@Lily_of_the_Nile) پیام بدین که لینک گروه رو براتون بفرستم. (گروه صرفا برای پرسیدن سوال و پیشروی و ... حول مطالب کتابه. سعیمیکنیم چند فصل یبار یه جلسه داشته باشیم تو گوگل میت(احتمالا حدود ۹ شب به وقت ایران).
📣 Stanford Spring 2025 Deep Reinforcement Learning Course: 👩🏻🏫 Prof. Chelsea Finn 🔗 https://cs224r.stanford.edu 🎥 https://www.youtube.com/watch?v=EvHRQhMX7_w&list=PLoROMvodv4rPwxE0ONYRa_itZFdaKCylL
NeurIPS 2025 Papers https://jalammar.github.io/assets/neurips_2025.html
سلام دوستان اگر جهت چاپ یک مقاله که ترکیب ML و RL هست، علاقه مند هستید، لطفا پیام بدید. با تشکر دکتر توتونچیان
سلام بچهها!😁 اگه کسی هست که آشنایی لازم و کافی با مفاهیم knowledge graph و graphRAG داره و فرصت داره و میتونه درحد یه کال کوتاه این مفاهیم رو به من توضیح بده(یکمفراتر از تعاریف اولیه مدنظرمه ) (🥲) اینپایین بگین. مرسی کلی❤️🙏
سلام بچهها!😁 اگه کسی هست که آشنایی لازم و کافی با مفاهیم knowledge graph و graphRAG داره و فرصت داره و میتونه درحد یه کال کوتاه این مفاهیم رو به من توضیح بده(یکمفراتر از تعاریف اولیه مدنظرمه ) (🥲) اینپایین بگین. مرسی کلی❤️🙏
این تاک ها لینک گوگل میت داره ؟
🚀 Join Adam White’s Talk at Sharif University of Technology 🎙 Title: Empirical Practices in RL and How to Make Them Better? 👨🏫 Speaker: Adam White (Canada CIFAR AI Chair, Director of Amii, PI of the RLAI Lab, and Assistant Professor in Computing Science…
🚀 Join Adam White’s Talk at Sharif University of Technology 🎙 Title: Empirical Practices in RL and How to Make Them Better? 👨🏫 Speaker: Adam White (Canada CIFAR AI Chair, Director of Amii, PI of the RLAI Lab, and Assistant Professor in Computing Science at the University of Alberta) 📅 Date: Friday (May 30, 2025) 🕗 Time: 8:30 PM Iran Time 💡 Sign Up Here: https://forms.gle/aF4SMB7bd8KZm4nw7 @DeepRLCourse
🚀 Join Pascal Poupart’s Talk at Sharif University of Technology 🎙 Title: Reinforcement Learning for Large Language Model Alignment and Inference (Abstract) 👨🏫 Speaker: Pascal Poupart (Professor at University of Waterloo and Canada CIFAR AI Chair at the Vector Institute) (Biography) 📅 Date: Thursday (May 29, 2025) 🕗 Time: 4:30 PM Iran Time 💡 Sign Up Here: https://forms.gle/MzdwseJdP3fhFPW78 @DeepRLCourse
🚀 Join Jeff Clune’s Talk at Sharif University of Technology 🎙 Title: Open-Ended and AI-Generating Algorithms in the Era of Foundation Models 👨🏫 Speaker: Jeff Clune (University of British Columbia, Vector Institute, DeepMind) 📅 Date: Friday (May 2, 2025)…
🚀 Join Jeff Clune’s Talk at Sharif University of Technology 🎙 Title: Open-Ended and AI-Generating Algorithms in the Era of Foundation Models 👨🏫 Speaker: Jeff Clune (University of British Columbia, Vector Institute, DeepMind) 📅 Date: Friday (May 2, 2025) 🕗 Time: 8:00 PM Iran Time 💡 Sign Up Here: https://forms.gle/57sRPPLWMd9dcF8F9 @DeepRLCourse
https://youtu.be/zzXyPGEtseI?si=IBrLKaNRbcR77KGy
видео или голосовое, без подписи
the effect of reward scale on deep reinforcement learning algorithm performance
https://deepmind.google/discover/blog/preserving-outputs-precisely-while-adaptively-rescaling-targets/