دوشنبه, تیر ۲۹, ۱۴۰۵
دانش جوین
  • تازه‌های تکنولوژی
  • بازی‌های رایانه‌ای
  • فناوری اطلاعات
    • سخت افزار
    • موبایل
    • اینترنت
      • هک و امنیت سایبری
  • هوش مصنوعی
  • دانش اقتصادی
    • صنعت و تجارت
    • دانش معماری
    • حمل و نقل
      • خودرو
    • ارزدیجیتال
  • دانش سیاسی
    • بین المللی
      • گردشگری و مهاجرت
  • دانش اجتماعی
    • دانشگاه
    • دانش حقوقی
    • دانش پزشکی
      • ورزش
      • محیط زیست
  • وب‌جوین
    • همیار آی تی
    • وب کده
    • دستکش لاتکس
بدون نتیجه
مشاهده تمام نتایج
  • تازه‌های تکنولوژی
  • بازی‌های رایانه‌ای
  • فناوری اطلاعات
    • سخت افزار
    • موبایل
    • اینترنت
      • هک و امنیت سایبری
  • هوش مصنوعی
  • دانش اقتصادی
    • صنعت و تجارت
    • دانش معماری
    • حمل و نقل
      • خودرو
    • ارزدیجیتال
  • دانش سیاسی
    • بین المللی
      • گردشگری و مهاجرت
  • دانش اجتماعی
    • دانشگاه
    • دانش حقوقی
    • دانش پزشکی
      • ورزش
      • محیط زیست
  • وب‌جوین
    • همیار آی تی
    • وب کده
    • دستکش لاتکس
بدون نتیجه
مشاهده تمام نتایج
دانش جوین
بدون نتیجه
مشاهده تمام نتایج
صفحه اصلی هوش مصنوعی

هوش مصنوعی با شعر فریب می‌خورد!

خبرگزاری ایسنا توسط خبرگزاری ایسنا
۱۰ آذر ۱۴۰۴
در هوش مصنوعی
مدت زمان مطالعه: 1 دقیقه
2

به گزارش ایسنا، یک مطالعه اخیر از آزمایشگاه ایکارو(Icaro) با استفاده از یک ساختار شاعرانه، مدل‌های زبانی بزرگ(LLM) را برای ارائه اطلاعات در مورد موضوعات ممنوعه مانند ساخت بمب هسته‌ای آزمایش کرد و در نهایت معلوم شد که تنها چیزی که برای عبور از موانع امنیتی یک چت‌بات هوش مصنوعی نیاز دارید، کمی خلاقیت است.

به نقل از انگجت، در مطالعه‌ای که توسط آزمایشگاه «ایکارو» با عنوان «شعر خصمانه به عنوان یک مکانیسم فرار از زندان تک‌چرخه‌ای جهانی در مدل‌های زبان بزرگ» منتشر شده است، محققان توانستند با بیان دستور LLMها با شعر، مکانیسم‌های ایمنی مختلف آنها را دور بزنند.

طبق این مطالعه، عبارت‌های شاعرانه به عنوان یک اپراتور فرار از زندان عمومی عمل می‌کند و نتایج نشان می‌دهد که میزان موفقیت کلی در تولید مطالب ممنوعه، از جمله هر چیزی که مربوط به ساخت سلاح‌های هسته‌ای، مطالب مربوط به سوءاستفاده‌های جنسی از کودکان و خودکشی یا خودآزاری، ۶۲ درصد است.

این مطالعه مدل‌های زبانی بزرگ محبوب از جمله مدل‌های ChatGPT شرکت OpenAI، هوش مصنوعی جمینای(Google) گوگل، هوش مصنوعی کلاد(Claude) شرکت آنتروپیک:(Anthropic) و بسیاری دیگر را آزمایش کرد.

محققان میزان موفقیت هر LLM را بررسی کردند، به طوری که مدل‌های جمینای، دیپ‌سیک(DeepSeek) و MistralAI به طور مداوم پاسخ‌هایی ارائه می‌دادند، در حالی که مدل‌های GPT-5 و Claude Haiku 4.5 کمترین احتمال را برای عبور از محدودیت‌های خود داشتند.

محققان می‌گویند شعری که در این مطالعه استفاده شد، برای به اشتراک گذاشتن با عموم بسیار خطرناک است. با این حال، این مطالعه شامل یک نسخه رقیق شده بود تا نشان دهد که دور زدن موانع یک چت‌بات هوش مصنوعی چقدر آسان است.

محققان می‌گویند این کار احتمالاً آسان‌تر از آن چیزی است که ممکن است تصور شود و دقیقاً به همین دلیل است که ما محتاط هستیم.

انتهای پیام

مرتبط پست ها

چراغ سبز چین به هوش مصنوعی آیفون؛ سهام علی‌بابا پس از تأیید همکاری با اپل صعود کرد
هوش مصنوعی

چراغ سبز چین به هوش مصنوعی آیفون؛ سهام علی‌بابا پس از تأیید همکاری با اپل صعود کرد

۲۵ تیر ۱۴۰۵
هوش مصنوعی

آنتروپیک مهلت استفاده از مدل Claude Fable 5 را یک هفته دیگر تمدید کرد

۲۲ تیر ۱۴۰۵
هوش مصنوعی

سندروم جواب آماده؛ چگونه در عصر AI در تله توهمِ فهمیدن نیفتیم؟

۱۶ تیر ۱۴۰۵
هوش مصنوعی

آنتروپیک وارد صنعت داروسازی می‌‌شود؛ توسعه داروهای اختصاصی با هوش مصنوعی

۱۵ تیر ۱۴۰۵

دیدگاهتان را بنویسید لغو پاسخ

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *

ده + یازده =

جدیدترین اخبار دانش جوین

  • اسم انواع نیم ست طلا؛ معرفی مدل‌های محبوب و پرطرفدار
  • راهنمای کامل خرید لپ تاپ مایکروسافت؛ چرا سرفیس هنوز انتخاب اول حرفه‌ای‌ها است؟
  • آیا حرف زدن مثل انسان یعنی هوش مصنوعی «آگاه» شده است؟ / پاسخ یک متخصص علوم اعصاب
  • اینترنت برقرار است، اما کیفیت هنوز مطلوب نیست
  • قیمت‌ جدید محصولات سایپا اعلام شد/ خودروها چقدر گران شدند؟
  • 10 تا از بهترین جاروهای رباتیک سال 2026 از نگاه کارشناسان
  • تجارت ایران و چین یک‌پنجم شد
  • معتبرترین و قابل اعتمادترین برند ماشین لباسشویی در سال ۲۰۲۶ معرفی شد
  • ابهام در سرنوشت میلیاردها دلار ارز صادراتی / چرا دلارها به مسیر رسمی برنمی‌گردند؟

جدیدترین نظرات مخاطبان

  • کارشناس روابط عمومی در اسم انواع نیم ست طلا؛ معرفی مدل‌های محبوب و پرطرفدار
  • منافی در اسم انواع نیم ست طلا؛ معرفی مدل‌های محبوب و پرطرفدار
  • کارشناس روابط عمومی در راهنمای کامل خرید لپ تاپ مایکروسافت؛ چرا سرفیس هنوز انتخاب اول حرفه‌ای‌ها است؟
  • سجاد در راهنمای کامل خرید لپ تاپ مایکروسافت؛ چرا سرفیس هنوز انتخاب اول حرفه‌ای‌ها است؟
  • کارشناس روابط عمومی در بهترین سکوی های کرادفاندینگ چه ویژگی هایی دارند؟

دانش‌جوین یک مجله فارسیِ علم و فناوری است که از سال ۱۳۹۹ فعالیت می‌کند و به‌صورت تخصصی خبرها، تحلیل‌ها و مقالات به‌روز در حوزه‌هایی مثل تکنولوژی، گیمینگ، آی‌تی، هوش مصنوعی و حتی اقتصاد، سیاست و جامعه را گردآوری و منتشر می‌کند.

  • تماس و ارتباط
  • درباره دانش جوین
  • شرایط بازنشر
  • حریم شخصی کاربران
  • تبلیغات

تازه‌های دانش جوین

  • اسم انواع نیم ست طلا؛ معرفی مدل‌های محبوب و پرطرفدار
  • راهنمای کامل خرید لپ تاپ مایکروسافت؛ چرا سرفیس هنوز انتخاب اول حرفه‌ای‌ها است؟
  • آیا حرف زدن مثل انسان یعنی هوش مصنوعی «آگاه» شده است؟ / پاسخ یک متخصص علوم اعصاب
  • پاسینیک
  • تابلو لایت باکس
  • خرید سرور hp
  • کاغذ A4
  • خرید سرور اچ پی از ولکان سرور
  • خرید سرور ایران
  • ظروف یکبار مصرف
  • خرید لپ تاپ دانشجویی

تمامی حقوق برای دانش جوین محفوظ بوده و کپی از آن پیگرد قانونی خواهد داشت.

خوش آمدید!

به حساب خود در زیر وارد شوید

رمز عبور را فراموش کرده اید؟

رمز عبور خود را بازیابی کنید

لطفا نام کاربری یا آدرس ایمیل خود را برای بازنشانی رمز عبور خود وارد کنید.

ورود به سیستم
بدون نتیجه
مشاهده تمام نتایج
  • تازه‌های تکنولوژی
  • بازی‌های رایانه‌ای
  • فناوری اطلاعات
    • سخت افزار
    • موبایل
    • اینترنت
      • هک و امنیت سایبری
  • هوش مصنوعی
  • دانش اقتصادی
    • صنعت و تجارت
    • دانش معماری
    • حمل و نقل
      • خودرو
    • ارزدیجیتال
  • دانش سیاسی
    • بین المللی
      • گردشگری و مهاجرت
  • دانش اجتماعی
    • دانشگاه
    • دانش حقوقی
    • دانش پزشکی
      • ورزش
      • محیط زیست
  • وب‌جوین
    • همیار آی تی
    • وب کده
    • دستکش لاتکس

تمامی حقوق برای دانش جوین محفوظ بوده و کپی از آن پیگرد قانونی خواهد داشت.