Enrolment options
LinkedIn Learning / Technology / Artificial Intelligence (AI) / Machine Learning Fundamentals
تسلط بر مدلهای استدلال: الگوریتمها، بهینهسازی و کاربردها (Mitalearn-463570)
درباره این دوره:
این دوره کاوشی جامع از مدلهای استدلال مدرن ارائه میکند، با تمرکز بر نوآوریهای الگوریتمی که مدلهایی مانند DeepSeek R1، OpenAI o1 و جایگزینهای منبع باز آنها را تقویت میکنند. بر چهار رویکرد کلیدی برای ایجاد LLMهای استدلالی مسلط شوید: مقیاس بندی زمان استنتاج، یادگیری تقویتی خالص، SFT+RL و تقطیر دانش. از طریق مثالهای عینی و غواصی عمیق فنی، نحوه پیادهسازی مقیاسبندی محاسباتی زمان آزمایش را بیاموزید، مکانیزم بهینهسازی خط مشی نسبی گروهی (GRPO) را درک کنید و خطوط لوله استنتاج کارآمدی را برای وظایف استدلال بسازید. در پایان دوره، شما باید هم دانش نظری و هم مهارتهای عملی برای استفاده از این تکنیکهای پیشرفته در برنامههای کاربردی خود داشته باشید، خواه با منابع در مقیاس سازمانی کار میکنید یا بودجههای محاسباتی محدودتری.
Guests cannot access this course. Please log in.