linkedin تسلط بر مدل‌های استدلال: الگوریتم‌ها، بهینه‌سازی و کاربردها (Mitalearn-463570)

  • مدت زمان: 1 ساعت 20 دقیقه
  • انتشار: 6 October 2025
  • مدرس: Nayan Saxena
  • سطح: مناسب همه
  • محتوا‌ها: 18
  • زیرنویس فارسی دارد
درباره این دوره:

این دوره کاوشی جامع از مدل‌های استدلال مدرن ارائه می‌کند، با تمرکز بر نوآوری‌های الگوریتمی که مدل‌هایی مانند DeepSeek R1، OpenAI o1 و جایگزین‌های منبع باز آنها را تقویت می‌کنند. بر چهار رویکرد کلیدی برای ایجاد LLMهای استدلالی مسلط شوید: مقیاس بندی زمان استنتاج، یادگیری تقویتی خالص، SFT+RL و تقطیر دانش. از طریق مثال‌های عینی و غواصی عمیق فنی، نحوه پیاده‌سازی مقیاس‌بندی محاسباتی زمان آزمایش را بیاموزید، مکانیزم بهینه‌سازی خط مشی نسبی گروهی (GRPO) را درک کنید و خطوط لوله استنتاج کارآمدی را برای وظایف استدلال بسازید. در پایان دوره، شما باید هم دانش نظری و هم مهارت‌های عملی برای استفاده از این تکنیک‌های پیشرفته در برنامه‌های کاربردی خود داشته باشید، خواه با منابع در مقیاس سازمانی کار می‌کنید یا بودجه‌های محاسباتی محدودتری.
  • Content

    • Mastering Reasoning Models: Algorithms, Optimization, and Applications

دوره‌های پیشنهادی