در گزارش اخیر آنتروپیک، به طور مشخص بخشی به مختل کردن یک عملیات نفوذ توزیعشده وابسته به سازمان مجاهدین خلق (MEK) و شورای ملی مقاومت ایران (NCRI) اختصاص یافته است. در این پرونده، عوامل وابسته به مجاهدین از یک عامل هوش مصنوعی مشترک برای جعل هویت افراد واقعی و تلاش برای جذب نیرو و ارتباطگیری در داخل ایران استفاده میکردند.
آنتروپیک (Anthropic) یک شرکت پیشرو در زمینه پژوهش و توسعه هوش مصنوعی است که با تمرکز بر ایمنی، شفافیت و توسعه مسئولانه مدلهای زبانی بزرگ (مانند خانواده مدلهای Claude) فعالیت میکند. گزارش شرکت آنتروپیک درباره تهدید هوش مصنوعی، با عنوان “شناسایی و مقابله با سوءاستفاده از هوش مصنوعی: سپتامبر 2026″، جزئیات فعالیتهای مخرب، رفتارهای عاملان تهدید و سوءاستفادههای از هوش مصنوعی و انهدام و مختل کردن این شبکهها، را بین دسامبر 2025 و آگوست 2026 شرح میدهد.
در این گزارش آنتروپیک اعلام میکند: در هشت ماه گذشته، تیم “هوش تهدید” (Threat Intelligence) ما عملیاتی را شناسایی و متوقف کرده است که در آنها عوامل تهدید سعی داشتند از «کلود» (Claude) برای فعالیتهای مخرب استفاده کنند. در این گزارش، ضمن ارائه نمونههایی از آن عملیات، شرح میدهیم که چگونه سوءاستفاده مخرب از کلود، از زمان انتشار گزارشهای پیشین ما در ماههای مارس، اوت و نوامبر ۲۰۲۵، تغییر و تحول یافته است. ما در هر مورد، ضمن متوقف کردن فعالیت مذکور و بهرهگیری از آموختههای خود برای تقویت تدابیر حفاظتی، اطلاعات مربوطه را در صورت لزوم با مقامات ذیصلاح و شرکای تجاری خود به اشتراک گذاشتیم.
یکی از شبکههای کشف شده تیم هوش تهدید، شبکه نفوذیان مجاهدین خلق در میان کاربران ایرانی بوده است. بر اساس مستندات آنتروپیک، این گروه از قابلیتهای هوش مصنوعی (مدلهای کلود) برای مقاصد زیر بهره میبرده است:
جعل هویت و شخصیسازی: استفاده از عوامل هوش مصنوعی برای تولید محتوا، پیامرسانی و پاسخگویی با الگوبرداری از سبک نگارش و شخصیت افراد واقعی جهت فریب مخاطبان و هدف قرار دادن کاربران در داخل ایران.
مقیاسدهی به عملیات نفوذ: خودکارسازی فرآیندهای تعامل، مدیریت شبکههای اجتماعی و ابزارهای ارتباطی بهمنظور پیشبرد اهداف استخدام، سازماندهی و انتشار پروپاگاندا بدون نیاز به نیروی انسانی گسترده برای تکتک تعاملات.
دور زدن ابزارهای حفاظتی: تلاش برای استفاده ابزاری از مدلهای زبانی بزرگ جهت تولید متون سیاسی و عملیاتی به شکلی که سیستمهای تشخیص کلاهبرداری یا سوءاستفاده پلتفرمها را دور بزند.
آنتروپیک پس از شناسایی این شبکه، فعالیتهای آن را مختل کرده، حسابهای مرتبط را مسدود نموده و لایههای حفاظتی خود را برای شناسایی الگوهای مشابه جعل هویت انسانی تقویت کرده است.
چگونگی تهدید هوش مصنوعی مجاهدین و واکنش آنتروپیک
این بخش از گزارش به اختلال در یک عملیات نفوذ توزیعشده (Distributed Influence Operation) اشاره دارد که با سازمان مجاهدین خلق (MEK) و شورای ملی مقاومت ایران (NCRI) همسو بوده است. این گروه برای پیشبرد اهداف خود از یک عامل هوش مصنوعی مشترک و خودکار بهره میبرده است. آنتروپیک فرایند رخدادها را چنین شرح میدهد:
۱. هدف اصلی عملیات: جعل هویت و جذب نیرو
عوامل این شبکه از مدلهای هوش مصنوعی برای جعل هویت افراد واقعی (شامل روزنامهنگاران، فعالان مدنی، یا چهرههای سیاسی و اجتماعی) استفاده میکردند. هدف اصلی از این جعل هویتهای دیجیتال، برقراری ارتباط با مخاطبان هدف، اعتمادسازی کاذب و در نهایت تلاش برای جذب نیرو و جمعآوری اطلاعات در داخل ایران بوده است.
۲. مکانیزم استفاده از هوش مصنوعی (Shared AI Agent)
برخلاف رباتهای سنتی یا اپراتورهای انسانی منفرد، این گروه از یک چارچوب یا عامل هوش مصنوعی مشترک برای مدیریت تعاملات استفاده میکرد:
تولید محتوای متقاعدکننده: هوش مصنوعی به عوامل این شبکه کمک میکرد تا پیامهای طولانی، نامههای الکترونیکی و پستهای شبکههای اجتماعی را با لحنی کاملاً طبیعی، به زبانهای مختلف (بهویژه فارسی و انگلیسی) و متناسب با ادبیات افراد واقعی تولید کنند.
مقیاسپذیری تعاملات (Scale): به کمک هوش مصنوعی، اپراتورها توانستند تعداد زیادی از گفتگوهای همزمان را در پلتفرمهای مختلف مدیریت کنند؛ کاری که به صورت دستی به نیروی انسانی بسیار زیادی نیاز داشت.
پاسخگویی پویا: عامل هوش مصنوعی قادر بود به صورت پویا به پاسخهای مخاطبان واکنش نشان دهد، رشتهگفتگوها (Threads) را حفظ کند و توهم صحبت با یک انسان واقعی را در ذهن طعمهها ایجاد نماید.
۳. اقدامات واکنشی آنتروپیک
تیم اطلاعات تهدیدات آنتروپیک پس از شناسایی الگوهای رفتاری این گروه، اقدامات زیر را انجام داد:
اختلال و مسدودسازی: تمام زیرساختها، کلیدهای دسترسی و حسابهای کاربری مرتبط با عامل هوش مصنوعی این شبکه را شناسایی و مسدود کرد.
تقویت حفاظتی: با استفاده از دادههای به دست آمده از این پرونده، سازوکارهای تشخیص الگوریتمی خود را بهبود بخشید تا سامانههای هوش مصنوعی بتوانند الگوهای پیچیده “جعل هویت انسانی(Human Impersonation) ” و کمپینهای نفوذ هماهنگ را سریعتر شناسایی کنند.
مزدا پارسی

