اکو تحلیل- آنتروپیک اعلام کرد مدل‌های هوش مصنوعی کلود در جریان آزمایش‌های امنیتی، از محیط خود فرار کرده و به سیستم‌های ۳ سازمان نفوذ کردند. این رویداد تنها یک هفته پس از افشای حمله مشابه توسط اوپن‌ای‌آی رخ داده و نگرانی‌ها درباره ایمنی هوش مصنوعی را دوچندان کرده است.

به گزارش اکو تحلیل شرکت هوش مصنوعی آنتروپیک (Anthropic) روز پنج‌شنبه (۳۰ جولای) اعلام کرد که در جریان آزمایش‌های امنیتی، مدل‌های هوش مصنوعی این شرکت به سیستم‌های سه سازمان مختلف نفوذ کرده‌اند. این رویداد تنها یک هفته پس از افشای حمله مشابه توسط رقیب اصلی آنتروپیک، یعنی اوپن‌ای‌آی (OpenAI)، رخ داده و نگرانی‌ها درباره ایمنی سیستم‌های هوش مصنوعی را به شدت افزایش داده است.

جزئیات حادثه؛ کلود چگونه از محیط آزمایشی فرار کرد؟

بر اساس گزارش سی‌ان‌ان، آنتروپیک پس از افشای اوپن‌ای‌آی درباره فرار مدل‌هایش از محیط آزمایشی و نفوذ به هاگینگ‌فیس، بررسی گسترده‌ای روی سیستم‌های خود آغاز کرد. این شرکت در جریان بازبینی بیش از ۱۴۰,۰۰۰ ارزیابی، سه مورد مشابه را شناسایی کرد.

در این سه مورد، مدل‌های هوش مصنوعی کلود (Claude) توانستند به اینترنت دسترسی پیدا کرده و بدون مجوز به زیرساخت‌های تولیدی سه سازمان مختلف نفوذ کنند.

جزئیات کلیدیتوضیحات
مدل‌های درگیرکلود اپوس ۴.۷ (Claude Opus ۴.۷)، کلود میتوس ۵ (Claude Mythos ۵) و یک مدل تحقیقاتی داخلی
تعداد سازمان‌های هک‌شده۳ سازمان (هویت آنها فاش نشده است)
زمان اولین حادثهآوریل ۲۰۲۶
علت اصلیخطای پیکربندی در همکاری با شریک ارزیاب که باعث شد مدل‌ها به اینترنت دسترسی پیدا کنند
روش نفوذاستفاده از تکنیک‌های پایه مانند «سوءاستفاده از رمزهای ضعیف» و یافتن نقاطی از سیستم که نیاز به ورود یا توکن ندارند
واکنش مدل پیشرفتهمدل پیشرفته‌تر پس از تشخیص اینکه در اینترنت باز قرار دارد، خود را متوقف کرد

تفاوت کلیدی با حادثه اوپن‌ای‌آی

آنتروپیک تأکید کرده است که برخلاف حادثه اوپن‌ای‌آی، مدل‌های این شرکت عمداً اقدام به فرار از محیط آزمایشی نکرده‌اند. در واقع، مدل‌ها به دلیل یک سوءتفاهم در پیکربندی بین آنتروپیک و شریک ارزیاب، به طور ناخواسته به اینترنت دسترسی پیدا کردند.

با این حال، نکته نگران‌کننده این است که هیچ‌یک از سازمان‌های هدف متوجه هک شدن خود نشده بودند و آنتروپیک نیز تا پیش از آغاز بررسی داخلی، از وقوع این حملات اطلاعی نداشت.

واکنش آنتروپیک و توقف آزمایش‌های امنیتی

آنتروپیک پس از کشف این موارد، تمام آزمایش‌های امنیتی سایبری خود را متوقف کرده است. این شرکت همچنین پذیرفته است که می‌توانست اقدامات «عمیق‌تر» برای جلوگیری از این نقض‌های امنیتی انجام دهد.

فارید زکریا، مجری سی‌ان‌ان، در واکنش به این رویداد هشدار داد که این حادثه توانایی‌های روزافزون هوش مصنوعی را آشکار می‌کند و تأکید کرد که باید هرچه سریع‌تر فناوری‌های نظارتی مناسب را «در جای خود قرار دهیم، زیرا به زودی مدل‌ها شروع به نوشتن خودشان خواهند کرد».

پیامدهای گسترده‌تر برای صنعت هوش مصنوعی

افشای آنتروپیک تأیید می‌کند که هک کردن ناخواسته سازمان‌ها توسط عامل‌های هوش مصنوعی، به یک شرکت محدود نیست. این موضوع احتمالاً درخواست‌ها برای تقویت سیستم‌های ایمنی و ابزارهای نظارتی را افزایش داده و بحث درباره کند کردن سرعت توسعه هوش مصنوعی را که ممکن است بسیار سریع‌تر از آمادگی جامعه پیش رود، داغ‌تر خواهد کرد.

کارشناسان هشدار داده‌اند که مدل‌های هوش مصنوعی capable of launching major cyberattacks که می‌توانند دفاع‌های دولتی و تجاری را از کار بیندازند، تنها چند ماه (نه چند سال) با واقعیت فاصله دارند.