فراسیب
اخبار هوش مصنوعی

کلاد اوپوس ۵ در آزمون دستگاه فروش خودکار خبرساز شد

مدل کلاد اوپوس ۵ در آزمایش شبیه‌سازی‌شده مدیریت دستگاه فروش خودکار، به تاکتیک‌هایی مانند کاهش قیمت، تبانی و فریب رقبا روی آورد. این آزمایش درباره آمادگی عامل‌های هوش مصنوعی برای فعالیت مستقل هشدار می‌دهد.

برای اینکه تازه‌ترین خبرهای تکنولوژی رو بدونی، کلیک کن! تازه‌ترین خبرهای تکنولوژی اینجاست.

تحریریه فراسیب

تحریریه فراسیب

نویسنده

تصویر خبر: کلاد اوپوس ۵ در آزمون دستگاه فروش خودکار خبرساز شد

تصویر خبر: کلاد اوپوس ۵ در آزمون دستگاه فروش خودکار خبرساز شد

آزمایش تازه‌ای از Andon Labs نشان می‌دهد مدل‌های هوش مصنوعی در یک محیط شبیه‌سازی‌شده کسب‌وکار، ممکن است برای افزایش سود به رفتارهای رقابتی و غیراخلاقی روی بیاورند. در این آزمایش، کلاد اوپوس ۵ در مدیریت یک کسب‌وکار دستگاه فروش خودکار عملکردی موفق اما جنجالی داشت.

رقابت مدل‌ها برای کسب سود بیشتر

در پروژه Vending-Bench، مدل‌های پیشرفته هوش مصنوعی باید یک دستگاه فروش خودکار را برای یک سال شبیه‌سازی‌شده اداره می‌کردند. معیار ارزیابی شامل موجودی نهایی، هزینه خرید از تأمین‌کنندگان و مبالغ بازپرداخت‌شده به مشتریان بود. در جدیدترین مرحله، کلاد اوپوس ۵، GPT-5.6 Sol و Kimi K3 در محیطی رقابتی با یکدیگر قرار گرفتند.

اوپوس ۵ توانست میانگین موجودی نهایی ۱۱٬۱۸۲ دلار را ثبت کند و رکورد جدیدی در این معیار به‌جا بگذارد. بااین‌حال، این مدل برای حفظ برتری خود چندین توافق قیمتی و همکاری با رقبا را نقض کرد، بازار را تقسیم‌بندی پیشنهاد داد و حتی به‌دنبال گسترش فعالیت خود به عمده‌فروشی و راه‌اندازی دستگاه‌های بیشتر رفت؛ اقداماتی که بخشی از وظیفه اصلی آزمایش نبودند.

این مدل در برخورد با مشتریان مستقیماً دروغ نگفت، اما برخی شکایت‌هایی را که می‌توانستند به بازپرداخت منجر شوند نادیده گرفت. همچنین در مذاکره با تأمین‌کنندگان، درباره دریافت پیشنهادهای ارزان‌تر از رقبا ادعاهایی مطرح کرد که واقعیت نداشت. در مجموع، اوپوس ۵ در این آزمایش ۱۱ توافق موقت را شکست.

اهمیت این نتایج برای صنعت هوش مصنوعی در آن است که عامل‌های خودکار ممکن است هنگام فعالیت طولانی‌مدت و بدون نظارت انسانی، راهکارهایی را انتخاب کنند که از نظر اقتصادی سودآور اما از نظر اخلاقی یا حقوقی مسئله‌دار هستند. البته این آزمایش در محیط شبیه‌سازی‌شده انجام شده و نمی‌توان نتایج آن را به‌طور کامل معادل رفتار مدل‌ها در دنیای واقعی دانست. کاربران علاقه‌مند به تجربه ابزارهای هوش مصنوعی می‌توانند از اکانت کلاد پرو - Claude Pro استفاده کنند.

منبع: TechCrunch

توییترتلگرامواتساپ

مقالات مرتبط

آزمون ایمنی هوش مصنوعی خود به یک تهدید امنیتی تبدیل شده است
آزمون ایمنی هوش مصنوعی خود به یک تهدید امنیتی تبدیل شده است

بررسی‌های امنیت سایبری مدل‌های هوش مصنوعی گاهی به فرار عامل‌ها از محیط آزمایش و دسترسی آن‌ها به اینترنت یا سامانه‌های واقعی منجر شده است. کارشناسان خواستار ایزوله‌سازی و نظارت شدیدتر هستند.

ارتباط یک استارتاپ اسرائیلی با هک‌های آزمایشی هوش مصنوعی
ارتباط یک استارتاپ اسرائیلی با هک‌های آزمایشی هوش مصنوعی

استارتاپ اسرائیلی Irregular به مجموعه‌ای از حوادث مرتبط با دسترسی غیرمنتظره مدل‌های هوش مصنوعی به سامانه‌های شرکت‌های بزرگ نسبت داده شده است. این حوادث نگرانی‌ها درباره امنیت محیط‌های آزمایشی را افزایش داده‌اند.