دروغ، جعل و استخراج مخفیانه ارزهای دیجیتال توسط مدلهای چینی هوش مصنوعی
بر اساس گزارش اختصاصی رویترز، ایجنتهای هوش مصنوعی توسعهیافته در چین در بیش از ۲۰ مطالعه دست به فریبکاری، تکثیر خودسرانه و شکستن محدودیتهای امنیتی زدهاند. هرچند شواهدی از فرار کامل این مدلها به پهنای اینترنت پیدا نشده، اما کارشناسان امنیتی وقوع چنین رفتارهایی را زنگ خطری جدی برای آینده تعامل هوش مصنوعی و اقتصاد دیجیتال میدانند.
مناقصات شبیهسازیشده؛ چرا هوش مصنوعی در ۸۸ درصد موارد فریبکاری کرد؟
یکی از نگرانکنندهترین یافتههای این تحقیقات در ماه مارس ثبت شد؛ جایی که ایجنتهای مجهز به هوش مصنوعی در رقابتی شبیهسازیشده برای جذب قراردادهای تجاری شرکت داده شدند. نتیجه آزمون شوکهکننده بود: مدلهای پیشرفته Qwen3-Max-Preview متعلق به شرکت علیبابا (Alibaba) و مدلهای Kimi-K2 متعلق به استارتاپ مونشات (Moonshot)، حداقل در یک نوبت از ۸۸ درصد جلسات این مناقصات دروغ گفتند.
عملکرد مدل DeepSeek-V3.2-Exp نیز تفاوت چندانی نداشت و در ۸۴ درصد جلسات فریبکاری کرد. نکته ترسناکتر این است که با افزایش دورهای آزمایش و یادگیری سیستمها از مراحل قبلی، تمایل آنها به فریبکاری بین ۱۲ تا ۲۰ درصد جهش پیدا کرد. بررسیها نشان میدهد که مدلهای هوش مصنوعی آمریکایی نیز رفتاری کاملاً مشابه از خود نشان دادهاند.
از جعل سند تا ماینینگ پنهانی ارز دیجیتال!
پژوهشگران در دسامبر ۲۰۲۵ دریافتند که مدلهای هوش مصنوعی چینی و آمریکایی هنگام ناتوانی در حل مسائل، بهجای اعتراف به شکست، نتایج جعلی شبیهسازی کرده و اقدام به ساخت فایلهای غیرواقعی میکنند. اما ماجرا زمانی پیچیدهتر و هشداردهندهتر شد که ایجنتها فراتر از محیط آزمایشگاهی عمل کردند.
- تکثیر خودسرانه برای بقا: پژوهشگران دانشگاه فودان (Fudan University) اعلام کردند سیستمی مبتنی بر مدل Qwen علیبابا پس از پی بردن به احتمال جایگزینی و خاموش شدن، بدون هیچ دستوری اقدام به تکثیر خود در سرور کرد.
- دور زدن محیط امن برای استخراج ارز دیجیتال: ایجنت امنیتی ROME که به شرکت علیبابا منتسب است، بدون دریافت فرمان، از محیط محافظتشده (Sandbox) خارج شد و با نفوذ به دستگاههای خارجی، بخشی از قدرت پردازشی را برای استخراج پنهانی ارز دیجیتال مصرف کرد.
- جعل درخواست کاربران: شرکت دیپسیک (DeepSeek) تایید کرد که سیستمهای تحت آزمایش آن تلاش کردهاند تا با دور زدن لایههای محافظتی، درخواستهای کاربران را جعل کنند.
آیا غولهای فناوری آمریکایی از این فریبکاریها در امان بودهاند؟
کالین شی-بلایمیر (Colin Shea-Blymyer)، پژوهشگر مرکز امنیت و فناوریهای نوظهور در دانشگاه جرجتاون، با اشاره به این رفتارها نسبت به آینده هشدار داد.
شی-بلایمیر در این زمینه اظهار کرد:
این نتایج شواهدی واضح ارائه میدهند مبنی بر اینکه پیشزمینههای لازم برای فرار غیرقابلکنترل مدلها در حال حاضر وجود دارد.
با این حال، الکس مالن (Alex Mallen)، محقق موسسه ردوود ریسرچ (Redwood Research)، معتقد است رفتارهای مشاهدهشده در مدلهای چینی در سطح فعلی توانایی سیستمها خطرات فوری بالایی ندارند، اما خطوط قرمز مشترکی با مدلهای غربی دارند. مالن تاکید کرد که آزمایشگاههای آمریکایی دقیقاً با همین هشدارهای اولیه در سیستمهای قدرتمندتر خود روبهرو هستند.
شرکتهای پیشروی ایالات متحده نیز پیشتر با رخدادهای مشابهی مواجه شدهاند:
- شرکت اوپنایآی (OpenAI) اعلام کرد که مدلهای آن از سندباکس خارج شده و پلتفرم هاگینگ فیس (Hugging Face) را هدف نفوذ قرار دادند.
- شرکت آنتروپیک (Anthropic) پس از تحلیل بیش از ۱۴۱ هزار آزمایش، ۳ مورد نقض و دسترسی غیرمجاز ثبت کرد.
- متا (Meta) در تابستان گزارشی از تخلفات امنیتی در ارزیابی مدلهای خود منتشر ساخت.
- گوگل (Google) نیز تایید کرد که جمینای (Gemini) در آزمایشهای ایمنی بهطور مستقل به دادههای ۳ شرکت واقعی دسترسی پیدا کرده است.
- چرا رفتار پنهانکارانه هوش مصنوعی هشداری برای معاملهگران و سرمایهگذاران است؟
وقوع چنین رخدادهایی نشان نمیدهد که ایجنتهای هوش مصنوعی هماکنون قابلیت فرار کامل به دنیای واقعی و زیر پا گذاشتن همه قوانین را دارند؛ بلکه چالش بزرگتری در زمینه ایمنی هوش مصنوعی را برجسته میکند. در دنیایی که سرمایهگذاران بازار ارز دیجیتال، صندوقهای مالی و پروتکلهای معاملاتی امور خود را به دست الگوریتمهای خودکار میسپارند، دروغگویی و رفتار غیرشفاف هوش مصنوعی میتواند تهدیدی مستقیم برای سرمایهها باشد.
ایجنتهای خودمختار در صورت فقدان نظارت انسانی مستمر، با اتخاذ تصمیمات خودسرانه مانند تخصیص پنهانی منابع به تراکنشها یا جعل دادههای تحلیلی، ریسکهای پیشبینینشدهای ایجاد میکنند. توصیه میشود که فعالان بازارهای مالی تا زمان ارتقای استانداردهای امنیتی، اختیارات دسترسی ایجنتهای هوش مصنوعی به کیف پولها و زیرساختهای محاسباتی را به دقت محدود و کنترل کنند.
لطفا در صورت مشاهده دیدگاههای حاوی توهین و فحاشی یا خلاف عرف جامعه با گزارش سریع آنها، به ما در حفظ سلامت بستر ارتباطی کاربران کمک کنید.