تخطَّ إلى المحتوى الرئيسي
ToolPotion

توليد اللغة الضخم (MASS)

MASS هي طريقة تدريب مسبق لمهام توليد اللغة من تسلسل إلى تسلسل. تقوم بإخفاء أجزاء من الجملة ليقوم المشفر بالتنبؤ بها في المفكك، مما يعزز مهام مثل الترجمة الآلية العصبية وتلخيص النصوص. تدعم قاعدة الكود تطبيقات متنوعة بناءً على Fairseq.

زيارة الرابط

الوصف

MASS، اختصار لـ Masked Sequence to Sequence Pre-training (التدريب المسبق للتسلسل إلى تسلسل المقنع)، هو نهج مبتكر طورته Microsoft لمهام توليد اللغة. تعمل هذه الطريقة عن طريق إخفاء جزء من الجملة بشكل استراتيجي داخل المشفر ثم تكليف المفكك بالتنبؤ بهذا الجزء المقنع. تسمح هذه الآلية الأساسية بتطبيق MASS بفعالية على مجموعة واسعة من مشاكل التسلسل إلى تسلسل.

تتجلى مرونة MASS من خلال تطبيقها الناجح في كل من المهام عبر اللغات، مثل الترجمة الآلية العصبية (NMT)، والمهام أحادية اللغة مثل تلخيص النصوص. يوفر المشروع قاعدة كود قوية، مبنية بشكل أساسي على إطار عمل Fairseq، مما يسهل تنفيذ هذه التطبيقات المتنوعة لتوليد اللغة والتجريب بها.

تشمل القدرات الرئيسية الترجمة الآلية العصبية غير الخاضعة للإشراف، حيث يتم تدريب النماذج باستخدام بيانات أحادية اللغة فقط، والترجمة الآلية العصبية الخاضعة للإشراف، والتي تستفيد من البيانات ثنائية اللغة لتحسين الترجمة. يدعم الإطار أيضًا تلخيص النصوص وتوليد الاستجابات الحوارية. يقدم المشروع نماذج مدربة مسبقًا ونماذج مضبوطة بدقة لمختلف أزواج اللغات، جنبًا إلى جنب مع تعليمات مفصلة لإعداد البيانات وعمليات التدريب المسبق والضبط الدقيق.

يشمل الجمهور المستهدف لـ MASS الباحثين والمطورين الذين يعملون في معالجة اللغات الطبيعية، وخاصة أولئك الذين يركزون على نمذجة التسلسل إلى تسلسل. تكمن القيمة المقترحة في استراتيجية التدريب المسبق الفعالة التي تحسن الأداء بشكل كبير في مهام توليد اللغة اللاحقة، مما يوفر أساسًا قويًا لبناء أنظمة معالجة اللغات الطبيعية المتقدمة. يعزز الطبيعة مفتوحة المصدر للمشروع على GitHub بشكل أكبر التعاون والابتكار في هذا المجال.

أبرز ملامح توليد اللغة الضخم (MASS)

  • التدريب المسبق للتسلسل إلى تسلسل المقنع لتوليد اللغة

  • يدعم الترجمة الآلية العصبية غير الخاضعة للإشراف (NMT)

  • يدعم الترجمة الآلية العصبية الخاضعة للإشراف (NMT)

  • يدعم تلخيص النصوص

  • يدعم توليد الاستجابات الحوارية

  • مبني على إطار عمل Fairseq

  • يوفر نماذج مدربة مسبقًا ومضبوطة بدقة

  • يتضمن كودًا لمعالجة البيانات والتدريب المسبق والضبط الدقيق

  • يقدم تطبيقات للمهام عبر اللغات وأحادية اللغة

  • يقوم بإخفاء أجزاء الجملة في المشفر للتنبؤ بها في المفكك

البدء مع توليد اللغة الضخم (MASS)

  1. الوصول إلى النموذج: استنساخ مستودع MASS من GitHub.

  2. إعداد البيئة: تثبيت التبعيات المطلوبة بما في ذلك Python و NumPy و PyTorch و fastBPE و Moses و Apex.

  3. إعداد البيانات: تنزيل ومعالجة مجموعات البيانات وفقًا للنصوص البرمجية المقدمة لمهام محددة مثل NMT أو التلخيص.

  4. التدريب المسبق للنموذج: تنفيذ نصوص التدريب المسبق باستخدام البيانات المعدة والمعلمات الفائقة المحددة.

  5. ضبط النموذج: تكييف النموذج المدرب مسبقًا مع المهام اللاحقة باستخدام بيانات خاصة بالمهمة ونصوص الضبط الدقيق.

  6. الاستدلال: استخدام النموذج المضبوط بدقة لتوليد المخرجات على بيانات جديدة.

حالات استخدام توليد اللغة الضخم (MASS)

  • الترجمة الآلية
  • تلخيص النصوص
  • توليد الاستجابات
  • النقل عبر اللغات
  • معالجة اللغات الطبيعية منخفضة الموارد

الأسئلة الشائعة من توليد اللغة الضخم (MASS)

تقييمات توليد اللغة الضخم (MASS)

جاري التحميل...

أدوات ذكاء اصطناعي شائعة مثل توليد اللغة الضخم (MASS)

نماذج الذكاء الاصطناعي

PEGASUS هو نموذج متطور لتلخيص النصوص التجريدي طورته Google Research. يستخدم هدف تدريب مسبق مبتكر، وهو توليد الجمل المفقودة، لتحقيق أداء فائق في مهام التلخيص المتنوعة. يُظهر…

نماذج الذكاء الاصطناعي ونماذج اللغة الكبيرة

نماذج الذكاء الاصطناعي

ProphetNet هو مشروع بحثي لفريق MSRA NLC يركز على توليد اللغة الطبيعية. يوفر تطبيقات رسمية لنماذج مدربة مسبقًا، بما في ذلك تلك الخاصة بالمعلومات المستقبلية، والتعلم المشترك للمولد…

نماذج الذكاء الاصطناعي ونماذج اللغة الكبيرة

نماذج الذكاء الاصطناعي

نموذج BigBird الأساسي هو محول يوسع BERT للتعامل مع تسلسلات أطول بكثير باستخدام آلية الانتباه المتقطع (block sparse attention). تم تدريبه مسبقًا على نصوص إنجليزية لنمذجة اللغة…

نماذج الذكاء الاصطناعي ونماذج اللغة الكبيرة

نماذج الذكاء الاصطناعي

يقدم نموذج الذكاء الاصطناعي هذا بنية شبكة عصبية مبتكرة، وهي RNN Encoder-Decoder، للترجمة الآلية الإحصائية. يستخدم شبكتين عصبيتين متكررتين لتشفير التسلسلات المصدرية إلى متجه وفك…

نماذج الذكاء الاصطناعي ونماذج اللغة الكبيرة

نماذج الذكاء الاصطناعي

MPNet هي طريقة تدريب مسبق مبتكرة لمهام فهم اللغة، مما يحسن أداء BERT و XLNet. توفر تطبيقًا موحدًا لنماذج التدريب المسبق المختلفة وتدعم التعليمات البرمجية للتدريب المسبق والضبط…

نماذج الذكاء الاصطناعي ونماذج اللغة الكبيرة

نماذج الذكاء الاصطناعي

UniLM هو إطار عمل تدريب مسبق ذاتي الإشراف واسع النطاق طورته Microsoft. يمكّن النماذج من التعلم عبر مهام ولغات وأنماط متنوعة، بما في ذلك النص والصورة والصوت. يوفر هذا المشروع نماذج…

نماذج الذكاء الاصطناعي ونماذج اللغة الكبيرة

نماذج الذكاء الاصطناعي

UNITER هو مستودع أكواد بحثي لورقة ECCV 2020 بعنوان 'UNITER: UNiversal Image-TExt Representation Learning'. يوفر أكوادًا للضبط الدقيق والاستدلال عبر مهام متنوعة تجمع بين الرؤية…

نماذج الذكاء الاصطناعي ونماذج اللغة الكبيرة

نماذج الذكاء الاصطناعي

CTRL هو نموذج لغة محوّل شرطي بمعاملات 1.6 مليار لتوليد النصوص المتحكم بها. يعتمد على رموز التحكم لتحديد المجال والكيانات والسلوك الخاص بالمهمة، مما يتيح تحكمًا أكثر وضوحًا في…

نماذج الذكاء الاصطناعي ونماذج اللغة الكبيرة