1

مایکروسافت با مدل جدید MAI-Image-2.6 بار دیگر جایگاه خود را در رقابت فشرده تولید تصاویر با هوش مصنوعی تقویت کرده است. این مدل در رتبه‌بندی Arena عملکردی بهتر از تقریباً تمام رقبای خود داشته و تنها GPT-Image-2 توانسته است جایگاهی بالاتر از آن به دست آورد. این موفقیت نشان می‌دهد مایکروسافت در مدت کوتاهی توانسته مدل‌های تولید تصویر داخلی خود را به سطحی برساند که مستقیماً با محصولات پیشرفته شرکت‌هایی مانند OpenAI و گوگل رقابت کنند.

مایکروسافت نخستین مدل تولید تصویر داخلی خود با نام MAI-Image-1 را در اکتبر 2025 معرفی کرد. این مدل در زمان عرضه در جمع 10 مدل برتر رتبه‌بندی Arena قرار گرفت و در جایگاه #9 قرار داشت. پس از آن، مایکروسافت با سرعت قابل‌توجهی نسل‌های جدید این خانواده را توسعه داد. MAI-Image-2 که در مارس 2026 معرفی شد، در زمان عرضه توانست به جایگاه #3 در رتبه‌بندی تولید تصویر Arena برسد و تنها پشت سر مدل‌های Google و OpenAI قرار گرفت.

اکنون MAI-Image-2.6 یک گام دیگر به جلو برداشته و در رتبه‌بندی جدید، تنها GPT-Image-2 را بالاتر از خود می‌بیند. Arena یک سیستم رتبه‌بندی مبتنی بر ترجیحات کاربران است که مدل‌های هوش مصنوعی را در رقابت‌های مستقیم با یکدیگر قرار می‌دهد. کاربران خروجی مدل‌ها را مقایسه می‌کنند و ترجیح آن‌ها در تعیین جایگاه مدل‌ها نقش دارد. به همین دلیل، رتبه‌بندی Arena الزاماً به معنای برتری مطلق یک مدل در تمام سناریوها نیست.

یک مدل ممکن است در تولید تصاویر واقع‌گرایانه عملکرد فوق‌العاده‌ای داشته باشد، درحالیکه مدل دیگری در تولید متن داخل تصویر یا ویرایش دقیق تصاویر بهتر عمل کند. بااین‌حال، قرارگرفتن MAI-Image-2.6 در رتبه‌ای نزدیک به صدر نشان می‌دهد این مدل از نظر کیفیت کلی خروجی، توانسته نظر کاربران را در مقایسه مستقیم با بسیاری از رقبای قدرتمند خود جلب کند. باوجود عملکرد قدرتمند MAI-Image-2.6، GPT-Image-2 همچنان جایگاه نخست را حفظ کرده است.

این موضوع نشان می‌دهد OpenAI هنوز یکی از اصلی‌ترین بازیگران بازار تولید تصویر با هوش مصنوعی محسوب می‌شود. GPT-Image-2 در ماه‌های اخیر در رتبه‌بندی‌های مختلف مرتبط با تولید و ویرایش تصویر عملکرد قدرتمندی داشته است و در برخی ارزیابی‌ها فاصله قابل‌توجهی با رقبا ایجاد کرده است. در نتیجه، قرارگرفتن مدل مایکروسافت در جایگاه دوم، حتی با وجود فاصله با صدر، یک دستاورد مهم برای تیم هوش مصنوعی این شرکت محسوب می‌شود.

مایکروسافت در توسعه مدل‌های MAI تلاش کرده است روی قابلیت‌هایی تمرکز کند که برای استفاده عملی از ابزارهای تولید تصویر اهمیت زیادی دارند. در نسل‌های قبلی، این شرکت به‌طور ویژه روی واقع‌گرایی تصاویر، نمایش دقیق متن داخل تصاویر و تولید صحنه‌های پیچیده تمرکز کرده بود. مایکروسافت اعلام کرده بود که در توسعه MAI-Image-2 از بازخورد عکاسان، طراحان و داستان‌پردازان تصویری استفاده کرده است.

در نسل MAI-Image-2.5 نیز تمرکز روی بهبود نمایش متن، تصاویر تجاری، تصویرسازی سبک‌دار و استدلال بصری ادامه پیدا کرد. این مدل نیز در رتبه‌بندی Arena به جایگاه سوم رسید. این روند نشان می‌دهد مایکروسافت در حال حرکت به سمت مدل‌هایی است که علاوه بر تولید تصاویر زیبا، بتوانند دستورهای پیچیده‌تر را نیز با دقت بیشتری اجرا کنند.