- تاریخ ثبتنام
- 11/1/23
- ارسالیها
- 7,272
- پسندها
- 19,406
- امتیازها
- 69,773
- مدالها
- 33
- نویسنده موضوع
- مدیر
- #11
مکانیزم پیشخور
پس از اینکه سرهای توجه اطلاعات را بین بردارهای کلمه منتقل کردند، شبکهی پیشخور (Feed-Forward) درمورد هر بردار کلمه «فکر میکند» و سعی میکند کلمهی بعدی را پیشبینی کند. در این مرحله، هیچ اطلاعاتی بین کلمات ردوبدل نمیشود و لایهی پیشخور هر کلمه را بهصورت مجزا تجزیهوتحلیل میکند. بااینحال، این لایه بهتمامی اطلاعاتی که قبلاً توسط یک سر توجه کپی شده، دسترسی دارد.
تصویر زیر، ساختار لایه پیشخور را در بزرگترین نسخه GPT-3 نشان میدهد:

طرز کار لایه پیشخور در بزرگترین نسخه GPT-3
نورونها که در تصویر با دایرههای سبز و بنفش نمایش داده شدهاند، در واقع توابع ریاضی هستند که مجموع وزنی ورودی لایهها را محاسبه...
پس از اینکه سرهای توجه اطلاعات را بین بردارهای کلمه منتقل کردند، شبکهی پیشخور (Feed-Forward) درمورد هر بردار کلمه «فکر میکند» و سعی میکند کلمهی بعدی را پیشبینی کند. در این مرحله، هیچ اطلاعاتی بین کلمات ردوبدل نمیشود و لایهی پیشخور هر کلمه را بهصورت مجزا تجزیهوتحلیل میکند. بااینحال، این لایه بهتمامی اطلاعاتی که قبلاً توسط یک سر توجه کپی شده، دسترسی دارد.
تصویر زیر، ساختار لایه پیشخور را در بزرگترین نسخه GPT-3 نشان میدهد:

طرز کار لایه پیشخور در بزرگترین نسخه GPT-3
نورونها که در تصویر با دایرههای سبز و بنفش نمایش داده شدهاند، در واقع توابع ریاضی هستند که مجموع وزنی ورودی لایهها را محاسبه...
لطفا برای مشاهده کامل مطالب در انجمن ثبت نام کنید.