تخطَّ إلى المحتوى الرئيسي
ToolPotion

MT3: النسخ الموسيقى متعدد المهام ومتعدد المسارات

MT3 هو نموذج نسخ موسيقى آلي متعدد الآلات مبني على إطار عمل T5X. يتيح للمستخدمين نسخ الملفات الصوتية باستخدام نقاط فحص مدربة مسبقًا للبيانو أو الموسيقى متعددة الآلات. يوفر المشروع موارد للنسخ ويحدد خطوات لتدريب النموذج المحتمل.

زيارة الرابط

الوصف

MT3، اختصار لـ Multi-Task Multitrack Music Transcription (النسخ الموسيقي متعدد المهام ومتعدد المسارات)، هو نموذج ذكاء اصطناعي متقدم تم تطويره ضمن مشروع Magenta. يستفيد من إطار عمل T5X لأداء النسخ الموسيقي الآلي عبر آلات ومسارات متعددة. هذا المشروع ليس منتجًا مدعومًا رسميًا من Google ولكنه يقدم قدرات كبيرة لتحليل الموسيقى وإنشائها.

الوظيفة الأساسية لـ MT3 هي نسخ الملفات الصوتية، وتحويلها إلى تمثيل رمزي للموسيقى. يمكن للمستخدمين استخدام دفتر ملاحظات Colab المقدم لنسخ الصوت الخاص بهم. يأتي النموذج مع نقاط فحص مدربة مسبقًا، بما في ذلك واحدة موصوفة في ورقة بحثية من ISMIR 2021 لنسخ البيانو وأخرى من ورقة بحثية من ICLR 2022 لنسخ الآلات المتعددة.

بينما ينصب التركيز على النسخ، يتطرق المشروع أيضًا إلى تدريب النموذج. على الرغم من أنه ليس مدعومًا بسهولة للاستخدام الفوري، يمكن للمستخدمين المهتمين اتباع تعليمات تدريب T5X والإشارة إلى المهام المحددة في `tasks.py` لتدريب نماذج MT3 الخاصة بهم. يتضمن المستودع ملفات أساسية مثل `README.md` و `LICENSE` و `CONTRIBUTING.md`، والتي توفر الإرشادات والمعلومات للمستخدمين والمساهمين.

يتم استضافة مشروع MT3 على GitHub، مما يعزز بيئة تعاونية للتطوير والتحسين. تمت كتابته بشكل أساسي بلغة Python، مع جزء كبير أيضًا في Jupyter Notebooks، مما يعكس طبيعته البحثية والتطويرية. يهدف المشروع إلى تطوير مجال النسخ الموسيقي الآلي من خلال تقديم أداة قوية ومتعددة الاستخدامات للباحثين والموسيقيين على حد سواء.

الميزات الأساسية لـ MT3: النسخ الموسيقى متعدد المهام ومتعدد المسارات

  • نموذج نسخ موسيقى آلي متعدد الآلات

  • مبني على إطار عمل T5X

  • يدعم النسخ الموسيقي متعدد المسارات

  • يستخدم نقاط فحص مدربة مسبقًا

  • يتضمن دفتر ملاحظات Colab لنسخ الصوت

  • يقدم نقاط فحص لنسخ البيانو (ISMIR 2021)

  • يقدم نقاط فحص لنسخ الآلات المتعددة (ICLR 2022)

  • يوفر موارد لتدريب النموذج عبر تعليمات T5X

  • مشروع مفتوح المصدر مستضاف على GitHub

البدء مع MT3: النسخ الموسيقى متعدد المهام ومتعدد المسارات

  1. استنساخ: احصل على مستودع MT3 من GitHub.

  2. تثبيت: قم بإعداد التبعيات اللازمة لإطار عمل T5X.

  3. تكوين: قم بإعداد ملفات الصوت الخاصة بك وحدد نقطة فحص مدربة مسبقًا.

  4. تنفيذ: قم بتشغيل دفتر ملاحظات Colab المقدم لنسخ الصوت الخاص بك.

  5. تدريب (اختياري): اتبع تعليمات تدريب T5X وتعريفات المهام للتدريب المخصص للنموذج.

حالات استخدام MT3: النسخ الموسيقى متعدد المهام ومتعدد المسارات

  • الصوت إلى موسيقى رمزية
  • نسخ الآلات المتعددة
  • تحليل الموسيقى
  • البحث في الذكاء الاصطناعي الموسيقي
  • تدريب نماذج مخصصة

الأسئلة الشائعة من MT3: النسخ الموسيقى متعدد المهام ومتعدد المسارات

تقييمات MT3: النسخ الموسيقى متعدد المهام ومتعدد المسارات

جاري التحميل...

أدوات ذكاء اصطناعي شائعة مثل MT3: النسخ الموسيقى متعدد المهام ومتعدد المسارات

تطبيقات الذكاء الاصطناعي

AudioShake هي أداة مدعومة بالذكاء الاصطناعي مصممة لمحترفي الموسيقى. تسمح للمستخدمين بتحميل ملفات صوتية واستخراج مسارات فردية، بما في ذلك الغناء والباس والطبول. هذه الوظيفة ضرورية…

مميزةأدوات تحرير الصوت بالذكاء الاصطناعي

مستودعات GitHub للذكاء الاصطناعي

Audiocraft هي مكتبة PyTorch لتوليد ومعالجة الصوت بالتعلم العميق. تقدم نماذج متطورة مثل MusicGen لتوليد الموسيقى القابلة للتحكم و AudioGen للصوت من النص. تتضمن المكتبة أيضًا ضاغط…

مولّدات الموسيقى بالذكاء الاصطناعي

مستودعات GitHub للذكاء الاصطناعي

Whisper هو نموذج قوي للأغراض العامة للتعرف على الكلام طورته OpenAI. يتفوق في التعرف على الكلام متعدد اللغات، والترجمة، وتحديد اللغة. تم تدريبه على بيانات صوتية متنوعة، ويقدم…

مميزةنماذج الذكاء الاصطناعي ونماذج اللغة الكبيرة

يقدم Splitter.ai معالجة صوت متقدمة مدفوعة بالذكاء الاصطناعي، بما في ذلك فصل الأجزاء (stems) من الموسيقى. يستخدمه الملايين عالميًا، ويوفر خدمات مجانية ومدفوعة للمنتجين والفنانين…

أدوات تحرير الصوت بالذكاء الاصطناعي

تطبيقات الذكاء الاصطناعي

تقدم LANDR خدمة الماسترينغ الموسيقي المدعومة بالذكاء الاصطناعي، وتوزيع عالمي لأكثر من 150 منصة، ومكتبة واسعة من العينات المجانية الخالية من حقوق الملكية، وأكثر من 70 إضافة…

مميزةأدوات تحرير الصوت بالذكاء الاصطناعي

تطبيقات الذكاء الاصطناعي

Moises هو مجموعة أدوات إبداعية مدعومة بالذكاء الاصطناعي للموسيقيين، يقدم أدوات للممارسة والأداء والإنتاج الموسيقي. تشمل الميزات الرئيسية إزالة الغناء، وفصل المسارات الصوتية…

مميزةأدوات تحرير الصوت بالذكاء الاصطناعي

تطبيقات الذكاء الاصطناعي

يقدم SoundBoost.ai خدمة إتقان موسيقى احترافية مدعومة بالذكاء الاصطناعي عبر الإنترنت باستخدام الأوامر النصية ومراجع Spotify. احصل على إتقان جاهز للنشر بسرعة مع تشكيل صوت فريد موجه…

أدوات تحرير الصوت بالذكاء الاصطناعي

تطبيقات الذكاء الاصطناعي

يعزز NotePerformer 5 التشغيل الواقعي لبرامج Sibelius و Dorico و Finale. يثق به أكثر من 50,000 موسيقي، ويقدم صياغة موسيقية ذكية، ومكتبة صوتية أوركسترالية كاملة، وتثبيتًا بسيطًا.…

أدوات تحرير الصوت بالذكاء الاصطناعي