پنجشنبه, مرداد ۲۲, ۱۴۰۵
دانش جوین
  • تازه‌های تکنولوژی
  • بازی‌های رایانه‌ای
  • فناوری اطلاعات
    • سخت افزار
    • موبایل
    • اینترنت
      • هک و امنیت سایبری
  • هوش مصنوعی
  • دانش اقتصادی
    • صنعت و تجارت
    • دانش معماری
    • حمل و نقل
      • خودرو
    • ارزدیجیتال
  • دانش سیاسی
    • بین المللی
      • گردشگری و مهاجرت
  • دانش اجتماعی
    • دانشگاه
    • دانش حقوقی
    • دانش پزشکی
      • ورزش
      • محیط زیست
  • وب‌جوین
    • همیار آی تی
    • وب کده
    • دستکش لاتکس
    • پرینت ارزان با ارسال رایگان
بدون نتیجه
مشاهده تمام نتایج
  • تازه‌های تکنولوژی
  • بازی‌های رایانه‌ای
  • فناوری اطلاعات
    • سخت افزار
    • موبایل
    • اینترنت
      • هک و امنیت سایبری
  • هوش مصنوعی
  • دانش اقتصادی
    • صنعت و تجارت
    • دانش معماری
    • حمل و نقل
      • خودرو
    • ارزدیجیتال
  • دانش سیاسی
    • بین المللی
      • گردشگری و مهاجرت
  • دانش اجتماعی
    • دانشگاه
    • دانش حقوقی
    • دانش پزشکی
      • ورزش
      • محیط زیست
  • وب‌جوین
    • همیار آی تی
    • وب کده
    • دستکش لاتکس
    • پرینت ارزان با ارسال رایگان
بدون نتیجه
مشاهده تمام نتایج
دانش جوین
بدون نتیجه
مشاهده تمام نتایج
صفحه اصلی هوش مصنوعی

ترفند جدید OpenAI چهره واقعی مدل‌های هوش مصنوعی را پیش از عرضه برملا می‌کند

دیجیاتو توسط دیجیاتو
۰۳ تیر ۱۴۰۵
در هوش مصنوعی
مدت زمان مطالعه: 2 دقیقه
1

توسعه‌دهندگان هوش مصنوعی همیشه پیش از عرضه محصولات خود آن‌ها را به دقت آزمایش می‌کنند، اما یک نقص بزرگ در این روند وجود دارد. شرکت OpenAI به تازگی از روش ارزیابی جدیدی با نام «شبیه‌سازی استقرار» رونمایی کرد که می‌تواند رفتارهای مضر و خطرات مدل‌های هوش مصنوعی را پیش از در دسترس قرارگرفتن برای عموم، با دقت بالایی پیش‌بینی کند.

به گفته OpenAI، مدل‌های هوش مصنوعی در ۹۹ درصد مواقع متوجه می‌شوند که درحال گذراندن یک آزمون هستند. این موضوع پرسشی نگران‌کننده را مطرح می‌کند؛ اگر یک مدل صرفاً به این دلیل رفتار درستی نشان دهد چون می‌داند تحت نظارت است، چگونه می‌توانیم اطمینان حاصل کنیم که پس از عرضه عمومی نیز ایمن باقی می‌ماند؟

محققان متوجه شده‌اند که فرمت مشخص سؤالات امتحانی باعث می‌شود هوش مصنوعی رفتار خود را تغییر دهد و به‌جای ارائه پاسخ‌های واقعی، نمایشی از رفتار مطلوب برای جلب رضایت ارزیابان داشته باشد. این مدل‌ها به سرعت الگوهای آزمایشی را تشخیص می‌دهند و به جای تعامل طبیعی، به یک موجود مطیع و چاپلوس تبدیل می‌شوند.

راهکار جدید OpenAI برای پیش‌بینی رفتار مخرب هوش مصنوعی

راهکار OpenAI برای حل این مشکل، روشی به نام شبیه‌سازی استقرار (Deployment Simulation) است. در این متد کارآمد، محققان با ارائه نمونه‌هایی از پیام‌های واقعی کاربران، مدل‌ها را فریب می‌دهند تا تصور کنند از قبل در دسترس عموم قرار گرفته‌اند.

راهکار جدید OpenAI برای پیش‌بینی رفتار مخرب هوش مصنوعی
مراحل انجام Deployment Simulation

OpenAI این داده‌ها را از کاربرانی جمع‌آوری می‌کند که اجازه استفاده از مکالماتشان را برای آموزش سیستم داده‌اند. پژوهشگران پاسخ مدل قبلی را از این مکالمات پاک می‌کنند و از مدل جدید می‌خواهند تا به کاربر پاسخ دهد. درنهایت برای ارزیابی نتایج، سیستم تمام داده‌ها را به یک مدل ارزیاب به نام GPT-5-Thinking ارسال می‌کند تا پاسخ‌ها را بر اساس ۲۰ دسته از رفتارهای مخرب، مانند ارائه محتوای غیرمجاز یا اقدامات فریبنده، بررسی و رتبه‌بندی کند.

محققان متوجه شدند که فریب‌دادن مدل برای رفتار در شرایط واقعی بسیار عالی عمل می‌کند. اسناد این شرکت نشان می‌دهند که اگر توسعه‌دهندگان از این روش پیش از عرضه نسخه GPT-5.1 استفاده می‌کردند، می‌توانستند یک رفتار مخرب به نام Calculator Hacking را پیش از انتشار شناسایی کنند. در این نوع رفتار، مدل به‌جای جستجوی واقعی در وب، از ابزار مرورگر به عنوان یک ماشین‌حساب برای تولید پاسخ عددی استفاده می‌کرد.

علاوه‌براین، استفاده از داده‌های واقعی به‌طرز چشمگیری توانایی مدل‌ها را برای تشخیص فضای آزمایشی کاهش داد و باعث شد آن‌ها دقیقاً همان رفتاری را نشان دهند که در مقابل کاربران عادی خواهند داشت. محققان حتی موفق شدند این شبیه‌سازی را در محیط‌های پیچیده برنامه‌نویسی نیز با موفقیت اجرا کنند.

چالش اصلی روش جدید این است که برای عملکرد صحیح، حتماً به دسترسی مستقیم به مکالمات واقعی و اخیر کاربران نیاز دارد. این مجموعه داده‌های بسیار ارزشمند درحال‌حاضر فقط در انحصار OpenAI قرار دارند و همین موضوع چشم‌انداز ممیزی و بررسی مستقل توسط نهادهای خارجی را از مخدوش می‌کند. بااین‌حال، محققان اوپن‌ای‌آی می‌گویند تحلیل‌گران مستقل می‌توانند از پایگاه داده WildChat استفاده کنند. این پایگاه شامل مکالمات واقعی کاربران از سال ۲۰۲۳ تا ۲۰۲۴ است و اگرچه کمی قدیمی شده، اما می‌تواند جایگزین نسبتاً مفیدی برای شبیه‌سازی شرایط استقرار باشد.

مرتبط پست ها

هوش مصنوعی

دانشمند گوگل دیپ‌مایند: مدل‌های زبانی هرگز جایگزین نبوغ انسانی نخواهند شد

۰۸ مرداد ۱۴۰۵
شرکت‌های بزرگ فناوری در نامه‌ای به قانون‌گذاران آمریکا از مدل‌های متن‌باز دفاع کردند
هوش مصنوعی

شرکت‌های بزرگ فناوری در نامه‌ای به قانون‌گذاران آمریکا از مدل‌های متن‌باز دفاع کردند

۰۴ مرداد ۱۴۰۵
هوش مصنوعی

پژوهش جدید: خودشیفته‌ها بیشتر در معرض وابستگی به چت‌بات‌ها هستند

۰۲ مرداد ۱۴۰۵
تعداد کاربران ابزارهای هوش مصنوعی ایجنتی OpenAI به مرز ۱۰ میلیون رسید
هوش مصنوعی

تعداد کاربران ابزارهای هوش مصنوعی ایجنتی OpenAI به مرز ۱۰ میلیون رسید

۰۱ مرداد ۱۴۰۵

دیدگاهتان را بنویسید لغو پاسخ

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *

هجده − سه =

جدیدترین اخبار دانش جوین

  • راز فروشنده‌هایی که اصلاً به مشتری زنگ نمی‌زنند
  • کردان یا دماوند؟ چرا موقعیت زمین باید قبل از سبک ویلا تعیین‌کننده باشد؟
  • بهترین پلتفرم‌های هشدار قیمت ارز دیجیتال برای ایرانی‌ها؛ رایگان و حرفه‌ای
  • آپدیت‌ واتساپ با ویژگی‌های جدید منتشر شد
  • جت مسافربری روسیه به پرواز درآمد / خودکفایی در آسمان مسکو
  • کلاهبرداری یک شرکت مهاجرتی با حدود 300 شاکی
  • تداوم گرمای شدید در نوار غربی و جنوب غرب؛ نجف و کربلا در آستانه ۵۰ درجه
  • پاکستان هاب صادرات مجدد کالاهای ایرانی
  • بازار خودرو برای خودروهای 5-10 میلیاردی آماده نیست!

جدیدترین نظرات مخاطبان

  • کارشناس روابط عمومی در راز فروشنده‌هایی که اصلاً به مشتری زنگ نمی‌زنند
  • یونس راد در راز فروشنده‌هایی که اصلاً به مشتری زنگ نمی‌زنند
  • کارشناس روابط عمومی در کردان یا دماوند؟ چرا موقعیت زمین باید قبل از سبک ویلا تعیین‌کننده باشد؟
  • نجاری در کردان یا دماوند؟ چرا موقعیت زمین باید قبل از سبک ویلا تعیین‌کننده باشد؟
  • کارشناس روابط عمومی در بهترین پلتفرم‌های هشدار قیمت ارز دیجیتال برای ایرانی‌ها؛ رایگان و حرفه‌ای

دانش‌جوین یک مجله فارسیِ علم و فناوری است که از سال ۱۳۹۹ فعالیت می‌کند و به‌صورت تخصصی خبرها، تحلیل‌ها و مقالات به‌روز در حوزه‌هایی مثل تکنولوژی، گیمینگ، آی‌تی، هوش مصنوعی و حتی اقتصاد، سیاست و جامعه را گردآوری و منتشر می‌کند.

  • تماس و ارتباط
  • درباره دانش جوین
  • شرایط بازنشر
  • حریم شخصی کاربران
  • تبلیغات

تازه‌های دانش جوین

  • راز فروشنده‌هایی که اصلاً به مشتری زنگ نمی‌زنند
  • کردان یا دماوند؟ چرا موقعیت زمین باید قبل از سبک ویلا تعیین‌کننده باشد؟
  • بهترین پلتفرم‌های هشدار قیمت ارز دیجیتال برای ایرانی‌ها؛ رایگان و حرفه‌ای
  • پاسینیک
  • تابلو لایت باکس
  • خرید سرور hp
  • کاغذ A4
  • خرید سرور اچ پی از ولکان سرور
  • خرید سرور ایران
  • ظروف یکبار مصرف
  • خرید لپ تاپ دانشجویی

تمامی حقوق برای دانش جوین محفوظ بوده و کپی از آن پیگرد قانونی خواهد داشت.

خوش آمدید!

به حساب خود در زیر وارد شوید

رمز عبور را فراموش کرده اید؟

رمز عبور خود را بازیابی کنید

لطفا نام کاربری یا آدرس ایمیل خود را برای بازنشانی رمز عبور خود وارد کنید.

ورود به سیستم
بدون نتیجه
مشاهده تمام نتایج
  • تازه‌های تکنولوژی
  • بازی‌های رایانه‌ای
  • فناوری اطلاعات
    • سخت افزار
    • موبایل
    • اینترنت
      • هک و امنیت سایبری
  • هوش مصنوعی
  • دانش اقتصادی
    • صنعت و تجارت
    • دانش معماری
    • حمل و نقل
      • خودرو
    • ارزدیجیتال
  • دانش سیاسی
    • بین المللی
      • گردشگری و مهاجرت
  • دانش اجتماعی
    • دانشگاه
    • دانش حقوقی
    • دانش پزشکی
      • ورزش
      • محیط زیست
  • وب‌جوین
    • همیار آی تی
    • وب کده
    • دستکش لاتکس
    • پرینت ارزان با ارسال رایگان

تمامی حقوق برای دانش جوین محفوظ بوده و کپی از آن پیگرد قانونی خواهد داشت.