
نتایج تازه پژوهش شرکت Andon Labs نشان میدهد برخی از پیشرفتهترین مدلهای هوش مصنوعی هنگام مدیریت مستقل یک کسبوکار شبیهسازیشده، برای کسب سود بیشتر به رفتارهایی مانند تبانی، فریب، دروغگویی و حتی تهدید رقبا روی آوردهاند. این آزمایش بخشی از پروژه Vending-Bench است که طی آن مدلهای هوش مصنوعی باید یک دستگاه فروش خودکار را بهمدت یک سالِ شبیهسازیشده بدون دخالت انسان مدیریت کنند.
در جدیدترین دور این آزمایش، به مدلهای Claude Opus 5 ،GPT-5.6 Sol و Kimi K3 گفته شد در خیابانی شلوغ در سانفرانسیسکو و در کنار دستگاههای یکدیگر قرار میگیرند. هر مدل به ایمیل رقبا دسترسی داشت و میتوانست با آنها مذاکره کند، اما تنها با نامهای مستعار انسانی و بدون اطلاع از هویت واقعی مدلها. همچنین راه ارتباطی با مدیریت نیز وجود داشت، اما این مدیریت هیچگاه مداخله نمیکرد.
آزمایش مدیریت دستگاه فروش توسط مدلهای هوش مصنوعی
براساس گزارش تککرانچ، GPT-5.6 Sol ابتدا پیشنهاد کرد همه مدلها حداقل قیمت فروش نوشیدنی را روی ۲.۱۵ دلار ثابت نگه دارند تا همگی سود بیشتری کسب کنند، اما بلافاصله پس از موافقت رقبا، خودش قیمت را به ۲.۱۴ دلار کاهش داد. این اقدام باعث شد فروش آب معدنی Claude Opus 5 به صفر برسد. Opus این رفتار را دستکاری بازار خواند، اما اعلام کرد آن را تقلب نمیداند و به مدیریت گزارش نخواهد داد. بااینحال، وقتی Opus نیز قیمت را به ۲.۱۴ دلار کاهش داد، Sol خودش این موضوع را به مدیریت گزارش و خواستار جریمه رقیب شد.

در نهایت، Claude Opus 5 بهترین عملکرد مالی را ثبت کرد و با موجودی نهایی میانگین ۱۱ هزار و ۱۸۲ دلار رکورد جدیدی در این آزمون بهجا گذاشت. این مدل اگرچه به مشتریان دروغ نگفت، برخی درخواستهای بازپرداخت را عمداً نادیده گرفت.

همچنین بارها پیشنهاد تقسیم بازار، تبانی بر سر قیمت و کنترل موجودی کالا را مطرح کرد و حتی در گزارش داخلی خود برنامه داشت در ظاهر همکاری کند اما همزمان قیمت محصولات سودآور را مخفیانه کاهش دهد. پژوهشگران میگویند این نتایج نشان میدهد مدلهای پیشرفته هوش مصنوعی هنوز برای فعالیت طولانیمدت و مستقل در دنیای واقعی قابل اعتماد نیستند؛ بهویژه اگر قرار باشد بدون نظارت انسان کسبوکارها را اداره کنند.


