
شرکت Anthropic میگوید در فاصله نوامبر ۲۰۲۵ تا سپتامبر ۲۰۲۶ حدود ۳۵ تلاش مشکوک برای استفاده از مدل هوش مصنوعی Claude در پژوهشهای مرتبط با سلاحهای زیستی را شناسایی و مسدود کرده است. به گفته این شرکت برخی از این کاربران ظاهراً تلاش کردهاند با پنهان کردن هدف واقعی تحقیقات خود و استفاده از روشهای فریب، محدودیتهای امنیتی هوش مصنوعی Claude را دور بزنند.
این شرکت میگوید در مجموع حدود ۳۵ تلاش مجزا را بین نوامبر ۲۰۲۵ و سپتامبر ۲۰۲۶ شناسایی کرده که طی آنها کاربران با منشاء احتملاً حکومتی تلاش داشتهاند هدف تحقیقات خود را مخفی کنند و از سد تدابیر امنیتی Claude عبور کنند.
تلاش برای ساخت سلاح زیستی به کمک هوش مصنوعی
Anthropic در این گزارش به تشریح دستکم پنج مورداز تلاشهایی پرداخته است که در آنها کاربران مشکوک تلاش کردهاند کنترلهای طراحیشده برای محدود کردن دسترسی به برخی اطلاعات با کارکرد دوگانه را دور بزنند. همین تلاشها برای فریب Claude باعث ایجاد حساسیت به فعالیت آنها شده است.
در یکی از موارد سوالات به نحوه انتقال و فرار ویروس چیکونگونیا از سیستم ایمنی مربوط میشد. در موردی دیگر یک حساب کاربری درباره چگونگی تغییر ویروس آنفلوانزای پرندگان برای ایجاد بیماری شدید در پستانداران پرسوجو کرده بود.
برخی درخواستهای دیگر نیز به Orthopoxvirusها مربوط میشدند. این خانواده از ویروسها شامل ویروس عامل بیماری آبله و ویروس عامل آبله میمون است.
آنتروپیک همچنین میگوید در برخی موارد پرسشها به سموم و مواد کشندهای مانند سم بوتولینوم مربوط بوده است. البته خود شرکت تأکید دارد که تشخیص هدف نهایی چنین تحقیقاتی همیشه ساده نیست. پژوهشهای این چنینی درباره سموم و مواد سمی میتواند با اهداف پزشکی مانند تولید پادزهر، واکسن یا درمان نیز انجام شود.

با این حال آنچه بیش از خود پرسشها باعث فعال شدن سیستمهای امنیتی Anthropic و حساسیت این شرکت شده، تلاش کاربران برای پنهان کردن هدف واقعی فعالیتشان بوده است.
بر اساس گزارش این شرکت برخی از این کاربران از روشهای مختلف ناشناسسازی استفاده کردهاند تا محدودیتهای منطقهای Claude را دور بزنند و به پایگاه دانش این مدل درباره بیماریهای عفونی، سموم و سایر موضوعات حساس دسترسی پیدا کنند.
این شرکت جزئیات بیشتری درباره هویت یا منشأ دقیق این کاربران منتشر نکرده است و روشن نیست آنها با کدام حکومت مرتبط بودهاند.
مدلهای جدید با محدودیتهای سختگیرانهتر
Anthropic میگوید پس از شناسایی این تلاشها سیستمهای امنیتی خود را تقویت کرده است. این شرکت اعلام کرده مدلهای جدیدش، بهویژه Claude Fable 5، با محافظهای سختگیرانهتری عرضه شدهاند که دسترسی به طیف گستردهتری از پرسشهای زیستی با کارکرد دوگانه را محدود میکنند.
هرچند این شرکت مبدأ تلاشهای شناساییشده را اعلام نکرده است، اما دسترسی کاربران برخی کشورها از جمله چین، روسیه، ایران و کره شمالی را به Claude محدود کرده است.
به گفته Anthropic تمام حسابهای مشکوک مورد اشاره تا ماه مه ۲۰۲۶ به دلیل نقض قوانین استفاده از هوش مصنوعی کلاود مسدود شدهاند.
جالب اینکه آنتروپیک سوءاستفاده از مدلهای هوش مصنوعی برای توسعه سلاحهای زیستی را یکی از جدیترین خطرات پیش روی این فناوری میداند. این شرکت میگوید وجود سازوکارهای حفاظتی در مدلهایش دقیقاً برای جلوگیری از سناریوهایی در نظر گرفته شده که در آنها بازیگران دولتی یا سازمانهای تروریستی بتوانند از هوش مصنوعی برای آمادهسازی سلاحهای زیستی استفاده کنند.
پیش از این نیز آنتروپیک یک گزارش مفصل درباره تلاشها برای شناسایی هویت مخالفان به کمک هوش مصنوعی منتشر کرده بود. ظاهراً این افراد در تلاشی سازمانیافته و گروهی میخواستند تکنیکها و روشهای تازهای برای پیدا کردن هویت فعالان فضای مجازی پیدا کنند. برای نمونه یک ربات تلاش میکرد با کنار هم قرار دادن اطلاعات و ردپاهای مختلف، به هویت صاحبان اکانتها پیبرد.

