مايكروسوفت تطلق نماذج MAI جديدة للصور والصوت

أعلنت مايكروسوفت عن إطلاق نموذجين جديدين ضمن فريق الذكاء الاصطناعي الفائق لديها، هما MAI-Image-2.5-Pro لإنشاء وتحرير الصور وMAI-Voice-2-Flash للصوت، بهدف تحسين جودة وسرعة تجارب الذكاء الاصطناعي داخل منتجاتها.

تفاصيل الخبر

كشفت Microsoft AI Superintelligence Team عن إطلاق نموذجين جديدين من تطويرها الداخلي، في إطار خطتها لبناء نماذج ذكاء اصطناعي خاصة بها بدلًا من الاعتماد الكامل على نماذج خارجية.

ويأتي هذا الإطلاق ضمن استراتيجية مايكروسوفت لتطوير نماذج مدربة على بيانات مؤسسية موثوقة وقابلة للتتبع، مع تصميمها خصيصًا لتقديم تجارب أفضل لمستخدمي منتجات الشركة مثل Bing وPowerPoint وOneDrive وDynamics 365 وAzure.

وتشمل النماذج الجديدة:

  • MAI-Image-2.5-Pro: نموذج متقدم لإنشاء الصور وتحريرها، يركز على جودة التفاصيل، وفهم التعديلات باللغة الطبيعية، ودقة كتابة النصوص داخل الصور.
  • MAI-Voice-2-Flash: نموذج صوتي مصمم للسرعة والكفاءة، ويستهدف الاستخدامات التي تحتاج إلى استجابة فورية مثل مراكز الاتصال والوكلاء الصوتيين.

ومن أبرز مميزات MAI-Image-2.5-Pro:

  • يقدم أعلى جودة صور ضمن نماذج الصور الداخلية لمايكروسوفت حتى الآن.
  • يحسن قدرة الذكاء الاصطناعي على إنتاج نصوص دقيقة داخل الصور.
  • يدعم تعديل الصور باستخدام أوامر مكتوبة باللغة الطبيعية.
  • أصبح النموذج الأساسي في Bing Image Creator لإنشاء الصور وتحريرها.
  • يعمل داخل PowerPoint في مهام تحرير الصور، مع تقليل تكاليف استخدام وحدات معالجة الرسوميات بنسبة تصل إلى 84% مقارنة ببعض النماذج السابقة.
  • ساهم في تحسين تجربة تحرير الصور داخل OneDrive، حيث رفع معدلات الحفظ بنسبة 26% وخفض زمن الاستجابة بنسبة تقارب 25%.

أما نموذج MAI-Voice-2-Flash فيركز على تقديم تجربة صوتية أسرع وأكثر كفاءة، ومن أبرز قدراته:

  • يعمل بسرعة أكبر بمرتين مقارنة بنموذج MAI-Voice-2.
  • يقلل التكلفة بنسبة 32% مع الحفاظ على جودة الصوت الطبيعية.
  • يدعم المحادثات الصوتية واسعة النطاق في تطبيقات خدمة العملاء.
  • أصبح جزءًا من منصة Dynamics 365 Contact Center لتطوير وكلاء اتصال صوتيين.
  • يقلل تكاليف استخدام وحدات معالجة الرسوميات بنسبة تصل إلى 89% في بعض سيناريوهات مراكز الاتصال.
  • يتوفر عبر Azure Voice Live لبناء وكلاء صوتيين يعتمدون على التفاعل المباشر بين الكلام والكلام.

وأكدت مايكروسوفت أن تطوير هذه النماذج لا يهدف فقط إلى تحقيق نتائج قوية في الاختبارات، بل إلى تشغيلها فعليًا داخل منتجات يستخدمها ملايين الأشخاص يوميًا.

كما تعمل الشركة على تطوير نماذج متخصصة بالتعاون مع خبراء المجالات المختلفة، ومنها نموذج MAI-Transcribe-1.5 المستخدم في حلول الرعاية الصحية مثل Dragon Copilot، والذي يدعم 58 لغة ويساعد على تحسين دقة تحويل الكلام إلى نص في البيئات الطبية.

وترى مايكروسوفت أن بناء نماذج داخلية يمنحها قدرة أكبر على تحسين الأداء، التحكم في التكاليف، وتخصيص الذكاء الاصطناعي حسب احتياجات كل منتج.

الأهداف المستقبلية

تسعى مايكروسوفت من خلال نماذج MAI الجديدة إلى تحقيق مجموعة من الأهداف المستقبلية، منها:

  • تطوير عائلة متكاملة من نماذج الذكاء الاصطناعي الخاصة بالشركة.
  • تحسين جودة الصور والصوت داخل منتجات مايكروسوفت المختلفة.
  • توفير نماذج أكثر سرعة وكفاءة للشركات والمطورين.
  • تقليل الاعتماد على النماذج الخارجية في الخدمات الذكية.
  • بناء وكلاء ذكاء اصطناعي قادرين على التفاعل الطبيعي مع المستخدمين.
  • توسيع استخدام الذكاء الاصطناعي في مجالات مثل الصحة، خدمة العملاء، والإنتاجية.

يمثل إطلاق MAI-Image-2.5-Pro وMAI-Voice-2-Flash خطوة جديدة في سباق تطوير نماذج الذكاء الاصطناعي الداخلية بين الشركات التقنية الكبرى. ومن خلال دمج هذه النماذج داخل منتجاتها، تسعى مايكروسوفت إلى تقديم تجارب أكثر ذكاءً وسرعة وكفاءة لملايين المستخدمين حول العالم.

مقالات مشابهة