Udemy – RAG-LLM Evaluation & Test Automation for Beginners 2025-4
RAG-LLM Evaluation & Test Automation for Beginners، دوره آموزش ارزیابی RAG-LLM و خودکارسازی تست برای مبتدیان توسط آکادمی یودمی منتشر شده است. مدلهای زبانی بزرگ (LLMs) همه جا هستند. هر کسب وکاری در حال توسعه مدلهای RAG-LLM سفارشی مبتنی بر هوش مصنوعی برای بهبود خدمات مشتری است. اما مهندسان چگونه آنها را آزمایش میکنند؟ برخلاف تست نرمافزار سنتی، سیستمهای مبتنی بر هوش مصنوعی به روششناسی ویژهای برای ارزیابی نیاز دارند. این دوره از پایه شروع میشود و معماری نحوه عملکرد مدلهای زبانی بزرگ (LLMs) را در پشتصحنه توضیح میدهد. سپس به بررسی عمیق معیارهای ارزیابی LLM میپردازد. این دوره نحوه استفاده مؤثر از کتابخانه RAGAS برای ارزیابی معیارهای LLM از طریق مثالهای اسکریپتشده را نشان میدهد. این امکان را فراهم میکند که با استفاده از Pytest، امتیازات معیار را بررسی کرده و یک چارچوب خودکار برای ارزیابی و تست LLM طراحی کنید. در پایان دوره، قادر خواهید بود چارچوب ارزیابی RAGAS Pytest را برای اعتبارسنجی معیارهای RAG-LLM سفارشی ایجاد کنید. این دوره شامل ۷ معیار برتر است که معمولاً برای ارزیابی و تست مدلهای زبانی بزرگ به کار میروند. همین منطق را میتوان برای سایر ارزیابیهای معیار نیز اعمال کرد.
