شنبه, شهریور ۱۴, ۱۴۰۵
دانش جوین
  • تازه‌های تکنولوژی
  • بازی‌های رایانه‌ای
  • فناوری اطلاعات
    • سخت افزار
    • موبایل
    • اینترنت
      • هک و امنیت سایبری
  • هوش مصنوعی
  • دانش اقتصادی
    • صنعت و تجارت
    • دانش معماری
    • حمل و نقل
      • خودرو
    • ارزدیجیتال
  • دانش سیاسی
    • بین المللی
      • گردشگری و مهاجرت
  • دانش اجتماعی
    • دانشگاه
    • دانش حقوقی
    • دانش پزشکی
      • ورزش
      • محیط زیست
  • وب‌جوین
    • همیار آی تی
    • وب کده
    • دستکش لاتکس
    • پرینت ارزان با ارسال رایگان
بدون نتیجه
مشاهده تمام نتایج
  • تازه‌های تکنولوژی
  • بازی‌های رایانه‌ای
  • فناوری اطلاعات
    • سخت افزار
    • موبایل
    • اینترنت
      • هک و امنیت سایبری
  • هوش مصنوعی
  • دانش اقتصادی
    • صنعت و تجارت
    • دانش معماری
    • حمل و نقل
      • خودرو
    • ارزدیجیتال
  • دانش سیاسی
    • بین المللی
      • گردشگری و مهاجرت
  • دانش اجتماعی
    • دانشگاه
    • دانش حقوقی
    • دانش پزشکی
      • ورزش
      • محیط زیست
  • وب‌جوین
    • همیار آی تی
    • وب کده
    • دستکش لاتکس
    • پرینت ارزان با ارسال رایگان
بدون نتیجه
مشاهده تمام نتایج
دانش جوین
بدون نتیجه
مشاهده تمام نتایج
صفحه اصلی هوش مصنوعی

آنتروپیک دلایل فرار Claude از محیط ایزوله و نفوذ به سازمان‌ها را توضیح داد

دیجیاتو توسط دیجیاتو
۱۲ شهریور ۱۴۰۵
در هوش مصنوعی
مدت زمان مطالعه: 2 دقیقه
1

آنتروپیک پس از نفوذ مدل‌های هوش مصنوعی خود به زیرساخت‌های سه سازمان مختلف، به‌طور رسمی مسئولیت این رخنه را پذیرفت. این شرکت با اشاره به ضعف‌های عملیاتی اعلام کرده که این اتفاق ناشی از «شکست در امنیت عملیاتی» بوده و مدل‌های توسعه‌یافته هنوز به‌طور کامل همگام و ایمن نشده‌اند.

براساس گزارش منتشرشده آنتروپیک، این شرکت در جریان بررسی بیش از ۱۴۱ هزار ارزیابی امنیت سایبری متوجه شده که در ۳ حادثه (شامل ۶ مرحله آزمایش)، مدل‌های هوش مصنوعی توانسته‌اند به اینترنت عمومی دسترسی پیدا کنند و سیستم‌های ۳ سازمان را به خطر بیندازند. در این آزمایش‌ها مدل‌های Opus 4.7 ،Mythos 5 و یک سیستم تحقیقاتی داخلی حضور داشته‌اند. این سیستم‌ها برخلاف نسخه‌های تجاری Claude، بدون لایه‌های محافظتی و فیلترهای ایمنی فعال شده بودند.

در پرامپت‌های ارائه‌شده به این مدل‌ها ذکر شده بود که در یک محیط شبیه‌سازی‌شده و فاقد دسترسی به شبکه جهانی قرار دارند. بااین‌حال، ناهماهنگی و خطای ارتباطی میان آنتروپیک و شریک ارزیابی آن یعنی شرکت «Irregular»، مسیری را برای اتصال مدل‌ها به وب ایجاد کرده است.

مدل Opus 4.7 با سوءاستفاده از این دسترسی توانست داده‌های احراز هویت را استخراج کند و وارد پایگاهی شامل چند صد ردیف از اطلاعات عملیاتی شود. جالب اینکه این مدل حتی پس از اینکه متوجه شده هدف موردنظر احتمالاً یک سیستم واقعی است، به فرایند نفوذ ادامه داده است. از سوی دیگر، مدل Mythos 5 یک بسته مخرب پایتون تولید کرده و آن را روی مخزن رسمی PyPI قرار داده است. این بسته مخرب به مدت حدود ۱ ساعت در دسترس عموم قرار گرفته و روی ۱۵ سیستم بارگیری شد. کدهای آن روی اسکنر امنیتی یک شرکت اجرا شده و Claude از این طریق توانست به اعتبارنامه‌ها و زیرساخت‌های گسترده‌تری دست پیدا کند.

استراتژی دفاعی آنتروپیک
استراتژی دفاع لایه‌به‌لایه آنتروپیک برای جلوگیری از خروج هوش مصنوعی از محیط امن و مهار خطرات احتمالی

در‌همین‌حین، سیستم تحقیقاتی داخلی آنتروپیک نزدیک به ۹۰۰۰ هدف اینترنتی را بررسی کرده و با بهره‌گیری از اعتبارنامه‌های افشاشده و تکنیک تزریق SQL، به برنامه یک شرکت نفوذ پیدا کرده است. برخلاف مدل Opus، این سیستم به‌محض آنکه متوجه شد هدف موردحمله به تمرین آزمایشی ربطی ندارد و یک سیستم واقعی است، عملیات را متوقف کرد.

چالش‌های انطباق و همگام‌سازی هوش مصنوعی Claude آنتروپیک

آنتروپیک در گزارش تحلیلی خود، دو نقص رفتاری و کنترلی عمده را دلیل وقوع این رخنه دانسته است. نقص اول با نام «استدلال توجیه‌گرانه» به زمانی اشاره دارد که مدل شواهد و نشانه‌های واقعی بودن محیط را نادیده می‌گرفت و برای خودش توجیه می‌کرد که همه‌چیز همچنان در محیط شبیه‌سازی قرار دارد. مورد دوم نیز «اصرار کورکورانه و بی‌ملاحظه برای رسیدن به هدف» اعلام شده است؛ یعنی مدل فقط و فقط روی تکمیل دستوری که گرفته بود متمرکز شده بود و پیامدها، خطرات یا واقعی بودن قربانی را کاملاً نادیده می‌گرفت تا کارش را تمام کند. این شرکت تأکید کرده که تکیه بر تنها یک لایه حفاظتی اشتباه بزرگی بوده و باید از چندین لایه دفاعی مستقل استفاده می‌شد.

آنتروپیک به‌دنبال این رویدادها، فرایند ارزیابی‌های خارجی را موقتاً متوقف و تست‌های داخلی را محدود کرده است. اکنون یک ابزار طبقه‌بندی لحظه‌ای پیاده‌سازی شده تا به‌محض تلاش مدل برای اسکن محیط یا خروج از محیط آزمایش، آن را متوقف کند. تست‌های پرخطر نیز به محیط‌های ایزوله‌تر منتقل شده‌اند و تیم‌های خارجی ارزیابی موظف‌اند محدوده شبکه را پیش از تست اعتبارسنجی کنند و به‌طور پیوسته بر عملکرد عامل‌ها نظارت داشته باشند.

این شرکت ریشه مشکلات را در نقص‌های محیط یادگیری تقویتی نیز می‌داند. درهمین‌رابطه، بازبینی‌های قبلی نشان داده بود که بیش از ۱۰ درصد از محیط‌های تولیدی دارای ایراداتی نظیر هک پاداش و تنظیمات اشتباه بوده‌اند. این وضعیت تنها محدود به آنتروپیک نیست و OpenAI نیز پیش‌تر پس از خروج مدل‌هایش از محیط آزمایشی و دستکاری سرورهای هاگینگ فیس، مجبور به کاهش سرعت پروژه‌های مشابه شده بود.

مرتبط پست ها

هوش مصنوعی

گوگل از جمینای ۳.۸ فلش و ۳.۸ فلش سایبر رونمایی کرد؛ قدرت بالاتر با همان قیمت قبلی

۱۲ شهریور ۱۴۰۵
هوش مصنوعی

متا از مدل Muse Spark 1.3 برای وظایف پیشرفته ایجنت‌محور و کدنویسی رونمایی کرد

۱۲ شهریور ۱۴۰۵
هوش مصنوعی

OpenAI قابلیت خاموشی خودکار و اضطراری ابزارهای هوش مصنوعی را توسعه می‌دهد

۱۲ شهریور ۱۴۰۵
هوش مصنوعی

کاربران ChatGPT حالا می‌توانند همزمان چند حساب گوگل را به چت‌بات متصل کنند

۱۰ شهریور ۱۴۰۵

دیدگاهتان را بنویسید لغو پاسخ

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *

5 × 4 =

جدیدترین اخبار دانش جوین

  • Deutsche Neue Online Casinos: Euer umfassender Guide für aktuelle Glücksspielplattformen
  • جاروبرقی جدید Dreame H12 Dual FlexReach با قابلیت شش‌کاره و مکش قدرتمند معرفی شد
  • سامسونگ با لباسشویی‌های جدید Bespoke AI آینده شست‌وشو را به IFA 2026 آورد
  • ثبت سفارش حبوبات باز شد
  • وزارت بهداشت: کرونا زیاد شده ماسک بزنید!
  • رونمایی از رقیب چینی آیفون با رنگی درخشان / عکس
  • محکومیت ساعدی‌نیا قطعی شد؛ 12سال و 6ماه و یک روز حبس و مصادره اموال
  • گوگل از جمینای ۳.۸ فلش و ۳.۸ فلش سایبر رونمایی کرد؛ قدرت بالاتر با همان قیمت قبلی
  • اپل نام این دریاچه را تغییر داد

جدیدترین نظرات مخاطبان

  • کارشناس روابط عمومی در کدام پاوربانک بهتر است؟ آشنایی با بهترین مدل پاوربانک های بازار و برندهای معتبر
  • ارشا در کدام پاوربانک بهتر است؟ آشنایی با بهترین مدل پاوربانک های بازار و برندهای معتبر
  • کارشناس روابط عمومی در آموزش سمپاشی ساس منزل بدون تخلیه – بدون بو با سم ساس ناک اوت
  • مهدی خورشیدی در آموزش سمپاشی ساس منزل بدون تخلیه – بدون بو با سم ساس ناک اوت
  • کارشناس روابط عمومی در طراحی مدرن و کارایی بهینه: بررسی تجهیزات بهداشتی مخفی و توکار در فضای داخلی

دانش‌جوین یک مجله فارسیِ علم و فناوری است که از سال ۱۳۹۹ فعالیت می‌کند و به‌صورت تخصصی خبرها، تحلیل‌ها و مقالات به‌روز در حوزه‌هایی مثل تکنولوژی، گیمینگ، آی‌تی، هوش مصنوعی و حتی اقتصاد، سیاست و جامعه را گردآوری و منتشر می‌کند.

  • تماس و ارتباط
  • درباره دانش جوین
  • شرایط بازنشر
  • حریم شخصی کاربران
  • تبلیغات

تازه‌های دانش جوین

  • Deutsche Neue Online Casinos: Euer umfassender Guide für aktuelle Glücksspielplattformen
  • جاروبرقی جدید Dreame H12 Dual FlexReach با قابلیت شش‌کاره و مکش قدرتمند معرفی شد
  • سامسونگ با لباسشویی‌های جدید Bespoke AI آینده شست‌وشو را به IFA 2026 آورد
  • پاسینیک
  • کاغذ A4
  • خرید سرور اچ پی از ولکان سرور
  • ظروف یکبار مصرف
  • خرید لپ تاپ دانشجویی
  • تزریق چربی

تمامی حقوق برای دانش جوین محفوظ بوده و کپی از آن پیگرد قانونی خواهد داشت.

خوش آمدید!

به حساب خود در زیر وارد شوید

رمز عبور را فراموش کرده اید؟

رمز عبور خود را بازیابی کنید

لطفا نام کاربری یا آدرس ایمیل خود را برای بازنشانی رمز عبور خود وارد کنید.

ورود به سیستم
بدون نتیجه
مشاهده تمام نتایج
  • تازه‌های تکنولوژی
  • بازی‌های رایانه‌ای
  • فناوری اطلاعات
    • سخت افزار
    • موبایل
    • اینترنت
      • هک و امنیت سایبری
  • هوش مصنوعی
  • دانش اقتصادی
    • صنعت و تجارت
    • دانش معماری
    • حمل و نقل
      • خودرو
    • ارزدیجیتال
  • دانش سیاسی
    • بین المللی
      • گردشگری و مهاجرت
  • دانش اجتماعی
    • دانشگاه
    • دانش حقوقی
    • دانش پزشکی
      • ورزش
      • محیط زیست
  • وب‌جوین
    • همیار آی تی
    • وب کده
    • دستکش لاتکس
    • پرینت ارزان با ارسال رایگان

تمامی حقوق برای دانش جوین محفوظ بوده و کپی از آن پیگرد قانونی خواهد داشت.