نماذج الذكاء الاصطناعي
النماذج الكبيرة «تعلّم» النماذج الكبيرة: كيف يقلل تحديث المكافآت GRPO من تكاليف تدريب الاستدلال بالذكاء الاصطناعي ويرفع كفاءة تخصيص النماذج للمؤسسات
دراسة حديثة في Scientific Reports تقترح استخدام نموذج كبير لتوليد بيانات الاستدلال، وتعزيز قدرات الاستدلال لنموذج لغوي كبير آخر عبر تحديث آلية مكافآت GRPO، بتكلفة تدريب تبلغ حوالي 80 دولارًا فقط. يفسر هذا المقال من منظور صناعي تأثيره على كفاءة تدريب الذكاء الاصطناعي وتطبيقات المؤسسات.