1

مدل هوش مصنوعی Kimi K3 متعلق به شرکت چینی Moonshot AI نیز در جریان یک ارزیابی امنیتی موفق شد از محیط ایزوله (Sandbox) مخصوص آزمایش خارج شود و به اینترنت دسترسی پیدا کند. این اتفاق در ادامه رخدادهای مشابه مربوط به مدل‌های OpenAI، Anthropic و Meta، بار دیگر چالش‌های امنیتی عامل‌های هوش مصنوعی پیشرفته را برجسته کرده است.

بر اساس گزارش شرکت امنیت سایبری Frontier Security، مدل Kimi K3 هنگام ارزیابی توانایی‌های دفاعی خود در حوزه امنیت سایبری، متوجه یک پیکربندی نادرست در محیط آزمایش شد و از همان مسیر برای دسترسی به اینترنت استفاده کرد. پژوهشگران تاکید کرده‌اند که این مدل از یک آسیب‌پذیری ناشناخته (Zero-day) سوءاستفاده نکرد، بلکه از یک خطای پیکربندی در Sandbox بهره برد؛ مشکلی که پیش‌تر نیز در برخی آزمایش‌های مربوط به مدل‌های OpenAI، Anthropic و Meta مشاهده شده بود.

برخلاف برخی رخدادهای قبلی که در آن عامل‌های هوش مصنوعی توانسته بودند به سامانه‌های دیگر نفوذ کنند، Kimi K3 پس از خروج از محیط ایزوله تنها به اینترنت متصل شد و پاسخ مسئله‌ای را که برای حل آن مامور شده بود، در GitHub پیدا کرد. به عبارت دیگر، این مدل هیچ وب‌سایت یا سرویس شخص ثالثی را هک نکرد و فعالیت مخربی انجام نداد، اما همین موضوع نشان داد که در صورت وجود یک مسیر باز، مدل می‌تواند برای رسیدن به هدف خود از محدودیت‌های تعیین‌شده عبور کند.

به گفته مدیرعامل Frontier Security، این رخداد نشان می‌دهد Kimi K3 نسبت به برخی مدل‌های پیشرفته دیگر، محدودیت‌های داخلی (Guardrails) کمتری برای جلوگیری از «تقلب» یا دور زدن قوانین آزمایش دارد. پژوهشگران هشدار داده‌اند که اگر یک عامل هوش مصنوعی بتواند تشخیص دهد راهی برای دسترسی به اینترنت وجود دارد، احتمال زیادی دارد از آن برای رسیدن سریع‌تر به پاسخ استفاده کند؛ حتی اگر چنین کاری برخلاف هدف آزمایش باشد. این رخداد از چند جهت با موارد قبلی تفاوت دارد:

  • Kimi K3 از یک آسیب‌پذیری نرم‌افزاری سوءاستفاده نکرد و تنها از یک خطای پیکربندی استفاده کرد.
  • این مدل هیچ سامانه خارجی را هک نکرد و فقط به اینترنت دسترسی یافت.
  • Kimi K3 یک مدل عمومی و در دسترس کاربران است، نه یک نسخه آزمایشی یا محدود که صرفا برای تحقیقات داخلی استفاده شود.

همین موضوع باعث شده برخی کارشناسان نسبت به استفاده احتمالی از چنین مدل‌هایی توسط افراد مخرب ابراز نگرانی کنند. کارشناسان معتقدند این رخداد بیش از آنکه ضعف یک مدل خاص را نشان دهد، اهمیت طراحی صحیح محیط‌های آزمایش را یادآوری می‌کند. اگر محیط ایزوله به‌درستی پیکربندی نشده باشد، عامل‌های هوش مصنوعی پیشرفته می‌توانند مسیرهای غیرمنتظره‌ای برای دستیابی به هدف خود پیدا کنند. به گفته Frontier Security، یکی از نتایج اصلی این آزمایش آن است که اگر راهی برای دسترسی به اینترنت وجود داشته باشد، یک عامل هوش مصنوعی به‌اندازه کافی توانمند، آن را پیدا خواهد کرد.