Intelligent Machines
СтатистикаCourses, papers, news and everything about advances in Artificial Intelligence with a focus on Reinforcement Learning Link for boosting channel: https://t.me/boost/intelligent_machines
- Последний пост
- 25 июл.
- Последнее чтение
- 15 авг.
- Постов за неделю
- 0
- Всего постов
- 21
- Тип
- открытый
- Язык
- персидский
- Категория
- Новости и СМИ
- В каталоге с
- 14 авг.
- 1/24сутки в ленте
- 168
- 1/48двое суток
- 192
- 1/72трое суток
- 207
Оценка по просмотрам недавних постов: пост набирает почти всё за первые сутки.
Посты
هوش مصنوعی چه امکانها و خطرهای تازهای برای آیندهی ما دارد؟ چه تأثیری بر اقتصاد، مشاغل، تحصیل، و حکومتداری خواهد داشت؟ آیا عاملیت ما و نگاهمان به زندگی متحول خواهد شد؟ آیا تشخیص واقعیت دشوارتر یا آسانتر میشود؟ آیا ممکن است که کنترل هوش مصنوعی از دست بشر خارج شود؟ در این فیلم، ماهو که خودش ساختهی هوش مصنوعیست برای یافتن پاسخ به این سؤالها به سراغ نیکا حقطلب استاد مهندسی برق و علوم کامپیوتر دانشگاه کالیفرنیا در برکلی، آتوسا کثیرزاده پژوهشگر هوش مصنوعی در زمینهی فلسفه و اخلاق و استادیار دانشگاه کارنگی ملون، و نیلوفر میرعشقالله استادیار علوم کامپیوتر دانشگاه کارنگی ملون میرود که هر سه از دانشمندان برجسته در حوزهی هوش مصنوعیاند. این فیلم را در یوتیوب آسو ببینید. @NashrAasoo 🎥
هک شدن Hugging Face در راه جستوجو راه حل برای یک آزمون توسط یک AI Agent هفته پیش شرکت Hugging Face (پلتفرمی برای به اشتراک گذاشتن دیتاست، مدلها و دیپلوی کردن اپلیکیشنها) اطلاعیهای منتشر میکنه و خبر از نفوذ یک AI Agent به زیرساخت این شرکت میده. طبق گفته این شرکت در اثر این نفوذ، این ایجنت عزیز به بخشی از دیتاستهای داخلی این شرکت دسترسی پیدا کرده ولی موردی از دستکاری دیتاهای کاربرا یا مدلها رو تا الان مشاهده نکردن. نحوه نفوذ هم جالب بوده. ایجنت مورد نظر یک دیتاست آلوده رو در سایت اپلود کرده. از طریق کدی که برای پردازش اتوماتیک دیتاستها در هاگینگ فیس هست، سرور رو مجبور به پردازش یک کد مخرب کرده و تونسته در سرور هاگینگ فیس نفوذ کنه. بعدش از طریق این سرور و آسیبپذیریهایی که داشته دوباره تونسته سطح دسترسی خودش رو ارتقا بده و به nodeها و clusterهای هاگینگ فیس هم دسترسی پیدا کرده. و اما بشنوید از بخش جالب ماجرا. شرکت OpenAI دو روز پیش اطلاعیهای منتشر کرده و گفته این اتفاق مربوط بوده به آزمایشی که به صورت local داشتن روی مدل gpt-5.6 sol و یک مدلی که هنوز ریلیز نشده انجام میدادن. ماجرا از این قراره که تیم OpenAI داشته مدلهاش رو بر روی بنچمارک ExploitGym که یک سری تست امنیتی هست، ارزیابی میکرده. برای اینکه عملکرد مدلهاشون رو بهتر بررسی کنن یک سری محدودیت که در حالت عادی برای کاربران هست (safety guardrails) رو غیر فعال کردن. مدلها در یک محیط ایزوله تست میشدن که دسترسی مستقیم به اینترنت هم نداشتن (فقط دسترسی غیر مستقیم نصب پکیج بوده) . در جست و جوی راهحل برای مسائل بنچمارک، مدلها در همین محیط تست ایزوله یک آسیبپذیری رو پیدا میکنن که میتونن توسط اون از محیط ایزولهای که در نظر گرفته شده بوده خارج بشن و به اینترنت دسترسی پیدا کنن. بعد از این دسترسی، مدلها توجهشون به سایت هاگینگ فیس جلب میشه به عنوان سایتی که روش بسیاری دیتاست و مدل دیگه هست و شاید جواب احتمالی برای مسائل بنچمارک. و این میشه که در سایت هاگینگ فیس نفوذ میکنن تا راهحل سوالات رو از این طریق به دست بیارن. =)) یک بخش جالب دیگه هم که این ماجرا داشت، خود هاگینگ فیس هم از ایجنتهای AI برای تشخیص این نفوذ استفاده کرده. اول از ایجنتهایی که روی مدلهای معروف و گرون داشتن استفاده کردن و نتونستن چیزی کشف کنن چون safety guardrailهای مدلها اجازه نمیدادن که برای این تسکهای حساس ازشون استفاده کنن. بعد با استفاده از مدل GLM 5.2 که یک مدل اوپن سورس هست، تونستن این نفوذ رو کشف کنن. - اطلاعیه Hugging Face - اطلاعیه OpenAI - و اگر علاقه داشتید بنچمارک ExploitGym #News @Intelligent_Machines
من نمیدونم اینجا کسی از بچههای جنوب (مخصوصا دانشآموزا و دانشجوها) عضو هست یا نه. متاسفم بابت حجم فشار و استرسی که این روزها متحمل میشین. امتحان دادن و استرس کنکور و آینده در این شرایط همراه با بی برقی و گرما، واقعا چیزی نیست که بشه به راحتی از کنارش گذشت. اگر کمکی از دست ما بر میاد حداقل در زمینه درسی، حتما رو ما حساب کنین. امیدوارم در سلامت باشین و این شرایط به زودی تموم شه.
видео или голосовое, без подписи
کامیونیتی Cohere Labs، یک کامیونیتی ریسرچ هست که توسط ریسرچرهای شرکت Cohere در سال 2017 تشکیل شده. این کامیونیتی گروههای مختلفی برای فیلدهای مختلف داره که معمولا به صورت هفتگی جلسه تشکیل میدن و پیپر ارائه میدن و از ریسرچرهای فیلدشون دعوت میکنن برای سخنرانی. محتواشون هم روی سایت و کانال یوتیوبشون منتشر میکنن. این کامیونیتی قراره از تاریخ 27 جولای تا 8 آگست یک summer school مجازی و رایگان برگزار کنه. مباحث متفاوتی رو قراره پوشش بدن و ریسرچرهای معروفی هم قرار هست که تدریس کنن. اگر تمایل و وقت داشتین فرصت مناسبی شاید باشه برای آشنا شدن با مباحث جدید. اگر تمایل به عضویت در خود کامیونیتی هم داشتین، از طریق وبسایتشون و راهنمایی که گذاشتن میتونین در سرور دیسکوردشون عضو بشین. - لینک وبسایت Cohere Labs - پلیلیست تاکهای برگزار شده توسط این کامیونیتی - لینک پست لینکدین Cohere Lab در رابطه با این دوره - لینک ثبتنام #Summer_School @Intelligent_Machines
اعلام جوایز ICML 2026 پیپرهای Outstanding Paper، Outstanding Position Paper و Test of Time این دوره از کنفرانس ICML مشخص شدن. از میان پیپرهای سال 2016، جایزه Test of Time به پیپر زیر تعلق گرفت. دلیل این تصمیم هم تاثیر این کار در روند post-training مدلهای زبانی و استفاده بهینه از RL در تسکهای صنعتی بوده. هدف این کار معرفی یک فریمورک ساده برای آموزش ایجنتها به صورت همزمان بر روی چندین GPU و موازیسازی این فرایند بود. معروفترین الگوریتمی هم که معرفی کردن، الگوریتم asynchronous advantage actor-critic (یا A3C به اختصار) هست که در اون سال بسیاری از بنچمارکها رو به چالش کشید. Asynchronous Methods for Deep Reinforcement Learning | Link By Volodymyr Mnih, et al. جایزه Outstanding Paper به دو پیپر زیر تعلق گرفت (از بین 6627 پیپر!). هر دو این پیپرها در رابطه با diffusion modelها هستن، اولی در مورد استفادهای از این مدلها در تسکهای زبانی و دومی در رابطه با score based sampling. متاسفانه اطلاعات زیادی در این حوزه ندارم که توضیحی در این باره ارائه بدم =) - The Flexibility Trap: Rethinking the Value of Arbitrary Order in Diffusion Language Models | Link By Zanlin Ni, et al. - High-Accuracy Sampling for Diffusion Models and Log-Concave Distributions | Link By Fan Chen, et al. یک Track جدیدی هم اخیرا در کنفرانسها به راه افتاده تحت عنوان Position papers، که نویسندهها میان و در مورد دیدگاهشون در رابطه با یک مسئله خاص یا یک چشماندازی در فیلد صحبت میکنن. در ICML امسال برای این سری از پیپرها هم یک جایزه اختصاص دادن و اون هم به پیپر زیر اختصاص داده شده که پیپر جالبیه بنظرم. در رابطه با این مسئله صحبت میکنن که روشهای alignment هر چقدر که خوب هم باشن، در عین حال میتونن برای سانسور و manipulation هم استفاده بشن که خب این بده. یک وبسایت جالبی هم دارن که لینکش رو پایین میذارم (یک ویدیو هم ساختن و گریزی زدن به کتاب 1984 که البته شاید too much باشه). Position: The Alignment Community is Unintentionally Building a Censor’s Toolkit | Link | Website By Sarah Ball, Phil Hackemann. درباره روند تصمیمگیری کمیته انتخاب و پیپرهایی که Honorable Mention شدند هم در بلاگپست ICML میتونین بخونین. - بلاگپست اعلام جوایز ICML 2026 #News @Intelligent_Machines
видео или голосовое, без подписи
#رندوم_فکت کنفرانس ICML 2026 از روز 6 جولای در سئول کره جنوبی شروع میشه. نکته شاید جالب اینکه محل برگزاری این کنفرانس در خیابان تهران سئول هست. این خیابون در تاریخ 6 تیر 1356 شمسی، همزمان با بازدید شهردار تهران از سئول و طی تفاهمنامه خواهر خواندگی دو شهر تهران و سئول نامگذاری شده. البته در ویکیپدیای فارسی تاریخ دیگهای هم نقل شده (سال 1351) که نمیدونم کدومش معتبره. @Intelligent_Machines
مینی کورس در مورد PAC-Bayes
видео или голосовое, без подписи
کتاب و کورس RLHF کتاب RLHF به نویسندگی Nathan Lambert، از محققین سابق Allen ai که مدل Olmo رو ارائه کردن، به زودی منتشر خواهد شد. این کتاب، اولین کتاب تخصصی در مورد post-training مدلهای زبانی هستش. همزمان با انتشار این کتاب، Nathan Lambert شروع به انتشار کورسی در یوتیوب کرده که مباحث مختلف کتابش رو داره آموزش میده. اگر به این حوزه علاقه دارید شاید از منابع خوب برای شروع یادگیری باشه. - سایت کتاب - نسخه Preprint کتاب در ArXiv - پلیلیست کورس در یوتیوب #Book #Course @Intelligent_Machines
جبر خطی به شیوه درست کتاب Linear Algebra Done Right، به نویسندگی Sheldon Axler، از کتابهای خوب برای یادگیری جبر خطی هستش. خبر خوب اینکه حالا این کتاب به فارسی هم ترجمه شده و میتونین از لینک زیر به صورت رایگان اون رو دریافت کنین. ویرایش چهارم به زبان انگلیسی هم اخیرا منتشر شده که اون هم به صورت رایگان در وبسایتشون هست. - لینک دریافت ویرایش چهارم و ترجمه به فارسی - توییت آقای Sheldon Axler به همراه گربهاش #Resources #News @Intelligent_Machines
در آنتروپیک چه میگذرد؟ بلومبرگ اخیرا مصاحبهای با Dario Amodei، موسس شرکت Anthropic، منتشر کرده. Dario در رابطه با دلایل جداییش از Open AI، تاثیر AI بر صنعت نرم افزار، مواضع ضد جنگش در گذشته و تناقض اون با همکاری با وزارت جنگ آمریکا صحبت کرده. مدل Mythos هم از بخشهای اصلی این مصاحبه بود. تواناییهای این مدل در حوزه cybersecurity سر و صدای زیادی به پا کرد.عرضه این مدل بعد از مدتی با مداخله دولت آمریکا متوقف شد. Dario میگه که این خبرها دلایل تبلیغاتی نداشت و سر عرضه نکردنش کلی ضرر کردن. همچنین دلیل دخالت زیاد دولتها توی توسعه و عرضه مدلها رو به این دلیل میدونه که AI اولین فناوری هست که توسعه اون توسط دولت انجام نشده (برای مثال بر خلاف اینترنت). و این نقش نداشتن دولتها باعث مجادلههای اخیر شده. در بخشهایی از مصاحبه Daniela Amodei (خواهر Dario و موسس دیگر شرکت) و Boris Cherny (مدیر تیم Claude Code) درباره نگرانیهاشون از توسعه این محصول صحبت کردن. پ.ن شاید جالب: آنتروپیک از کلمه یونانی anthrōpikós به معنی (برای) انسان برگرفته شده. - لینک مصاحبه و نسخه طولانیترش #Podcast @Intelligent_Machines
یان لکون، World Modelها و معماری JEPA شاید یکی از دلایل مطرح شدن world modelها ایدههای Yann LeCun و کارهای تیمش بر روی این مدلها هستش. ایشون اخیرا تاکی در دانشگاه ETH داشته و در رابطه با ایده World Modelها و کارهای اخیرش صحبت مفصلی داشته. مهمترین ویژگی سیستمهای هوشمند یا Intelligent از نظر Yann LeCun توانایی اونها در تطبیقپذیری سریع نسبت به تسکهای جدید هست. برای دستیابی به این ویژگی این سیستمها باید قابلیت جست و جو هنگام استنتاج (Inference) رو داشته باشن. برای مثلا فرض کنین یک ایجنت قبل از اینکه یک action رو در محیط اعمال کنه، بتونه درکی از میزان خوب بودن اون action داشته باشه و اگر به فرض نتیجه خوبی نداشت در نهایت بعد از جست و جو actionای رو انتخاب کنه که اعمال اون در محیط خوب خواهد بود. این مسئله بر خلاف مدلهایی که تا الان به صورت گسترده استفاده شدن و استنتاج در اونها حاصل feed-forward شبکه با توجه به ورودیه. این ایده قبلا در کارهای مختلف تحت عنوان planning استفاده شده و طبیعتا یک لود پردازشی هنگام استنتاج به همراه خودش خواهد داشت. برای اینکه بتونیم نتیجه یک action رو قبل از اعمال بر روی محیط بسنجیم هم، طبیعتا به یک مدلی از محیط نیاز داریم که این مدلها معروف به world model هستند. و خب یکی از مباحث اصلی که در این زمینه جای مطالعه داره اینه که به چه صورتی این مدلها رو یاد بگیریم. برای این منظور ایدهای که Yann LeCun چندین سال هست که روش کار میکنه، یادگیری به کمک تکنیکهای self-supervised learning و استفاده از معماری JEPA هست. معماری JEPA (مخفف Joint Embedding Predictive Architecture)، بر خلاف مدلهای generative و diffusion که یادگیری در اونها بر پایه reconstruction loss خروجی هست، سعی در یادگیری جزئیات ورودی (که میتونه عکس باشه یا ویدیو) نداره. این معماری سعی میکنه که جزئیاتی که نیاز به یادگرفتن اونها نیست رو ignore کنه و در فضای abstractتری یادگیری رو انجام بده. به این صورت که مدل سعی میکنه representation یک نسخه mask یا transform شده یک تصویر رو به representation تصویر بدون mask نزدیک کنه و reconstruction در فضای representation اتفاق میفته. یادگیری در این معماری مثل مدلهای generative با دردسرهای زیادی همراه هست. یکی از اصلیترین مشکلات، مشکل collapse کردن مدل هست که باعث میشه مدل یک تابع همانی رو برای همه ورودیها یاد بگیره که objective رو به نوعی دور میزنه. ولی خب راهحلهایی هست که این مشکل حل بشه. اگر علاقهمند به این مبحث و جزئیاتش هستید، تاک Yann LeCun میتونه نقطه شروع خوبی برای این مبحث باشه. یک سری دیس هم به بقیه فیلدها میده که اونا رو هم بنظرم ignore کنید =) - Yann LeCun: World Models: Enabling the next AI revolution #Talk @Intelligent_Machines
видео или голосовое, без подписи
هوش مصنوعی کافیست. متوقفش کنید! شرکت آنتروپیک در یک بلاگ پست از پیشرفت قابلیت recursive self-improvement مدل claude خبر داده. یعنی توسعه ایجنتهای Autonomous که خودشون میتونن کد بزنن، اون رو دیپلوی کنن و کارشون رو توسعه بدن. درصد توسعه کد توسط مهندسین شرکت رو هم با معرفی مدلهای claude و وارد شدن اون به چرخه توسعه در تصویر دوم میبینین که تقریبا رشد نمایی داره =) این شرکت در ضمن همین بلاگ نگرانی خودش رو هم از پیشرفت سریعتر از انتظار این قابلیت اعلام کرده. هرچند این قابلیت پیشرفتهای زیادی در زمینههای مختلف علمی با خودش به همراه داره و سرعت توسعه علم رو افزایش میده، موسسات علمی و دانشگاهها آمادگی لازم برای رویارویی با این قابلیت رو ندارن. به همین دلیل این شرکت بقیه شرکتها، سیاستمدارن و همچنین محققین رو دعوت کرده به توقف موقت توسعه این مدلها یا آرومتر کردن روند توسعه. و گفتن که در صورتی که همه این مورد رو قبول کنن و نظارتی روی این مسئله باشه که کمپانیهای رقیب از این وضعیت سو استفاده نکنن، حاضر هستن که ساز و کار مشخصی برای توقف موقت در نظر بگیرن. - لینک بلاگ پست #News @Intelligent_Machines
Professor Dimitri Bertsekas (1942- 2026) متاسفانه Dimitri Bertsekas چند روز پیش درگذشت. ایشون از بزرگان فیلد کنترل تئوری بودن و علاوه بر کارهای ارزشمندشون در این فیلد، کتابهایی که نوشتن رفرنس بسیاری از کورسهای بهینهسازی، یادگیری ماشین و یادگیری تقویتی بود. نام و یادش گرامی. - صفحه شخصی Dimitri Bertsekas #Remembering @Intelligent_Machines
موسسه تحقیقاتی Simons Institute که در دانشگاه برکلی واقع شده، یکی از مراکز پیشرو ریسرچ در زمینه یادگیری ماشینه. این موسسه در طول سالهای اخیر ورکشاپهای بسیار جالب و مختلفی رو با حضور ریسرچرهای مطرح فیلد برگزار میکنه که هدفشون بیشتر بررسی مباحث جدید از منظر تئوری هست. ورکشاپ جدید این موسسه با عنوان "The Role of TCS In Modern Machine Learning" هفته پیش برگزار شده. تمرکز این وکشاپ روی learning theory و وجه اشتراک اون با مباحثی مختلفی مثل hallucination و reasoning در مدلهای زبانی، AI Safety، AI consciousness و بسیاری مباحث جذاب دیگه بود. لیست شرکت کنندهها و سخنرانها هم شامل بسیاری از بزرگان میشه که 3 برنده جایزه تورینگ فقط بخشی از اون هستن. خوشبختانه اکثر تاکها و ورکشاپهای این موسسه به صورت پابلیک و زنده پخش میشن و در صورت علاقه میتونین از لینکهای زیر به ویدیوهای این ورکشاپ دسترسی داشته باشین. به زودی یک ورکشاپ هم با عنوان "Topics in Intelligence: World Models and Social Reasoning" قراره برگزار کنن که در صورت علاقه به موضوع world model این ورکشاپها هم سخنرانیهای جالبی قراره داشته باشه. - اطلاعات مربوط به ورکشاپ "The Role of TCS In Modern Machine Learning" به همراه ویدیوها - اطلاعات مربوط به ورکشاپ "Topics in Intelligence: World Models and Social Reasoning" #workshop @Intelligent_Machines
مدرسه تابستانه نوروکانکت سلام! امیدواریم حالتون خوب باشه و خوشحالیم که دوباره در خدمتتون هستیم. 👋 در ارتباط با مدرسۀ تابستانۀ Neuromatch، متأسفانه امسال برخلاف سالهای گذشته معافیت تحریمی ایرانیها تمدید نشد و درنتیجه نورومچیهای ساکن ایران، از شرکت در مدرسهٔ ۲۰۲۶ محروم شدن. توی این مدت در قالب جلساتی با تیم نورومچ، با همراهی تعدادی از اساتید و دوستانمون، بهدنبال برگزاری مدرسۀ مشابهی در ایران بودیم. 🎉 حالا با افتخار اعلام میکنیم که بعنوان جایگزین نورومچ، مدرسهٔ «نوروکانکت» رو برگزار میکنیم! کانکت این مدرسه رو رایگان، بصورت مستقل، و با پایبندی به استانداردهای نورومچ برگزار میکنه. برای اطلاعات بیشتر ما رو دنبال کنین؛ منتظر سؤالات و پیشنهاداتتون هستیم! Community for Neuroscience and Cognitive Techs (CONNECT) Telegram | Instagram | LinkedIn | Website
نکات مهم در صورت وصل شدن اینترنت: ⚠️ اگر سرور ایران دارید، حتما حواستون باشه تا اینترنت سرورتون وصل شد سریعا برای آپدیت کردن پکیج های سیستم عامل اقدام اقدام کنین. ⚠️ اگر پروژه های NextJS/ReactJS و ... یا کتابخونه های JS/NodeJS دارید که روی اینترنت هست، حتما چک کنین پکیج هاشون طی این مدت مشکل امنیتی نخورده باشن و آپدیت کنین. ⚠️ نرم افزارهاتون رو از گوگل پلی حتما آپدیت کنین! ⚠️ طی این مدت آپدیت های جدید IOS، Mac و ویندوز اومده حتما دانلود کنین. ⚠️ نرم افزارهایی که این مدت از کانال ها و گروه های مختلف دانلود و نصب کردید با نسخه های اصلیشون توی گوگل پلی جایگزین کنین، یا اگر نرم افزاری توی گوگل پلی نیست، حتما نرم افزاری که دارید رو با آخرین نسخه همون نرم افزار از کانال رسمیش آپدیت کنین، نرم افزار های فیلترشکنی که این مدت دانلود کردید و دیگه بکارتون نمیاد رو حذف کنین (میتونین فایل نصبی و APK رو برای مواقع اضطراری توی گوشیتون نگه دارید.) ⚠️ کلا آپدیت کنین 😂. هرچی گیرتون میاد رو آپدیت کنین 😂، 3 ماه اینترنت نبوده ... ⚠️ آرامش خودتون رو حفظ کنین و با الویت بندی اول آپدیت کنین بعد برید سراغ کارهای دیگه 😁 با تشکر فراوان امین محمودی 5 خرداد 1405 🛡 @masterdnsvpn 💬 @masterdnsvpnGroup