1

شیائومی از یک مینی‌پی‌سی آزمایشی جدید با نام Xiaomi AI Cube رونمایی کرده است که با تکیه بر سه تراشه اختصاصی این شرکت، برای اجرای مدل‌های هوش مصنوعی به‌صورت محلی طراحی شده است. این دستگاه در کنفرانس فناوری تراشه‌های XRING که امروز برگزار شد، به نمایش درآمد و از تراشه‌های جدید XRING O3، XRING O100 و XRING D100 استفاده می‌کند. هدف اصلی AI Cube، اجرای مدل‌های زبانی بزرگ یا LLM بدون نیاز به ارسال داده‌ها به سرورهای ابری است.

به گفته شیائومی، این دستگاه می‌تواند مدل‌هایی با اندازه 3 تا 120 میلیارد پارامتر را به‌صورت محلی اجرا کند. کاربر همچنین می‌تواند بسته به نوع پردازش، میان حالت‌های سریع و کند سیستم جابه‌جا شود.

سه تراشه اختصاصی در قلب AI Cube

بر طبق گزارش ها، مهم‌ترین بخش سخت‌افزاری AI Cube، ترکیب سه تراشه اختصاصی شیائومی است. XRING O3 به‌عنوان تراشه اصلی سیستم، از یک پردازنده مرکزی 10 هسته‌ای با هسته‌های پرقدرت، پردازنده گرافیکی 16 هسته‌ای G2-Ultra NX و یک واحد پردازش عصبی کم‌مصرف با توان 200 تریلیون عملیات در ثانیه (TOPS) بهره می‌برد. این تراشه همان تراشه پرچم‌داری است که شیائومی پیش‌تر برای گوشی‌های هوشمند و دستگاه‌های رده‌بالای خود معرفی کرده بود. در کنار آن، XRING O100 قرار دارد که یک تراشه شتاب‌دهنده اختصاصی برای پردازش‌های هوش مصنوعی و پهنای باند بالا محسوب می‌شود.

این تراشه با فناوری 3D Wafer-Level Stacking و فرایند ساخت 6 نانومتری تولید شده و از 28672 مسیر داده مؤثر بهره می‌برد. پهنای باند پردازش نزدیک به حافظه در O100 به حداکثر 1.22 ترابایت بر ثانیه می‌رسد. تراشه سوم یعنی XRING D100 برای پردازش‌های مرتبط با رانندگی هوشمند طراحی شده است. این تراشه با فناوری ساخت 3 نانومتری تولید شده و به یک CPU پرقدرت 20 هسته‌ای، یک NPU پرقدرت 16 هسته‌ای و امکان پشتیبانی از حداکثر 160 گیگابایت حافظه مجهز است.

طراحی متفاوت و توان مصرفی 150 واتی

شیائومی برای بدنه AI Cube از یک شاسی یکپارچه آلومینیومی با استاندارد موسوم به آلومینیوم گرید هوافضا استفاده کرده است. بدنه دستگاه با 33874 برش دقیق CNC ساخته شده و به گفته شرکت می‌تواند توان مداوم حداکثر 150 وات را تحمل کند. این توان پردازشی بالا برای اجرای مدل‌های هوش مصنوعی بزرگ به‌صورت محلی در نظر گرفته شده است.

برخلاف سرویس‌های مبتنی بر ابر که پردازش مدل روی سرورهای شرکت ارائه‌دهنده انجام می‌شود، AI Cube می‌تواند محاسبات را روی سخت‌افزار خود دستگاه انجام دهد. چنین رویکردی می‌تواند برای کاربردهایی که حریم خصوصی، تأخیر کم یا امکان استفاده بدون اتصال دائمی به اینترنت اهمیت دارد، مزیت داشته باشد. البته میزان واقعی عملکرد دستگاه به مدل مورد استفاده، میزان حافظه و نحوه بهینه‌سازی نرم‌افزار نیز وابسته خواهد بود.

اجرای مدل‌های 3 تا 120 میلیارد پارامتری

یکی از مهم‌ترین ادعاهای شیائومی درباره AI Cube، امکان اجرای محلی مدل‌هایی با 3 تا 120 میلیارد پارامتر است. این بازه بسیار گسترده است و از مدل‌های نسبتاً سبک تا مدل‌های بسیار بزرگ را دربرمی‌گیرد. برای کنترل نحوه عملکرد، دستگاه به دو حالت اصلی مجهز شده است. حالت سریع برای پاسخ‌گویی و پردازش سریع‌تر و حالت کند برای وظایفی طراحی شده که می‌توانند زمان بیشتری برای پردازش صرف کنند.

بااین‌حال، باید توجه داشت که معرفی AI Cube فعلاً به یک نمونه اولیه محدود می‌شود. شیائومی هنوز قیمت یا تاریخ عرضه رسمی آن را اعلام نکرده است. بنابراین مشخص نیست این دستگاه در نهایت به یک محصول تجاری تبدیل خواهد شد یا صرفاً به‌عنوان نمونه‌ای برای نمایش توانایی‌های تراشه‌های اختصاصی این شرکت باقی خواهد ماند.