Enrolment options

LinkedIn Learning / Technology / Artificial Intelligence (AI) / Machine Learning Fundamentals

تسلط بر مدل‌های استدلال: الگوریتم‌ها، بهینه‌سازی و کاربردها (Mitalearn-463570)

درباره این دوره:

این دوره کاوشی جامع از مدل‌های استدلال مدرن ارائه می‌کند، با تمرکز بر نوآوری‌های الگوریتمی که مدل‌هایی مانند DeepSeek R1، OpenAI o1 و جایگزین‌های منبع باز آنها را تقویت می‌کنند. بر چهار رویکرد کلیدی برای ایجاد LLMهای استدلالی مسلط شوید: مقیاس بندی زمان استنتاج، یادگیری تقویتی خالص، SFT+RL و تقطیر دانش. از طریق مثال‌های عینی و غواصی عمیق فنی، نحوه پیاده‌سازی مقیاس‌بندی محاسباتی زمان آزمایش را بیاموزید، مکانیزم بهینه‌سازی خط مشی نسبی گروهی (GRPO) را درک کنید و خطوط لوله استنتاج کارآمدی را برای وظایف استدلال بسازید. در پایان دوره، شما باید هم دانش نظری و هم مهارت‌های عملی برای استفاده از این تکنیک‌های پیشرفته در برنامه‌های کاربردی خود داشته باشید، خواه با منابع در مقیاس سازمانی کار می‌کنید یا بودجه‌های محاسباتی محدودتری.
Guests cannot access this course. Please log in.