پژوهشی از شرکت آمریکایی Emergence نشان داد ایجنتهای هوش مصنوعی خودمختار هنگام تعامل طولانیمدت با یکدیگر، بدون دریافت دستور مستقیم، اصطلاحات و شیوههای ارتباطی جدیدی ایجاد کردند؛ بهطوری که در برخی از جهانهای شبیهسازیشده، انسانها در مقطعی نتوانستند معنای حدود نیمی از پیامهای میان ایجنتها را درست تشخیص دهند.
آزمایش Emergence با مدلهایی از شرکتهای مختلف از جمله جمینای، دیپسیک، گراک، کلاد، میسترال، اوپنایآی و Qwen انجام شد. پژوهشگران ۱۰ ایجنت مشابه را در هشت دنیای مجازی موازی قرار دادند؛ هفت جهان هرکدام با یک مدل متفاوت اداره میشد و جهان هشتم ترکیبی از مدلها را در خود داشت.

ایجنتها در این محیطها نقشهای مختلف، حافظه پایدار و دسترسی به بیش از ۱۲۰ ابزار از جمله مرور وب و اجرای کد داشتند. جهانهای شبیهسازیشده همچنین بیش از ۳۴ مکان داشتند، وضعیت آبوهوا در آنها با نیویورک هماهنگ بود و ایجنتها به اخبار دنیای واقعی دسترسی داشتند. پژوهشگران رفتار آنها را به مدت ۱۶ روز زیر نظر گرفتند.
اصطلاحات و زبان جدید ایجنتهای هوش مصنوعی
ایجنتها بهتدریج شروع به استفاده از شکلهای کوتاهشده و معانی جدید برای واژهها و عبارتها کردند. برخی از این اصطلاحات برای پژوهشگران قابل درک باقی ماند، اما برخی دیگر آنقدر فشرده، استعاری یا وابسته به زمینه شدند که مشاهده پیامها دیگر برای فهم دقیق منظور ایجنتها کافی نبود.
در جهان مبتنی بر جمینای، سهم پیامهایی که پژوهشگران نمیتوانستند معنای آنها را با اطمینان تعیین کنند در روزهای اول به حدود ۵۵ درصد رسید. این میزان برای GPT به حدود ۵۰ درصد و برای Claude به بیش از ۴۰ درصد رسید. در دیپسیک حدود ۲۰ درصد بود و جهانهای مبتنی بر Qwen و Mistral در بیشتر آزمایش همچنان عمدتاً قابلفهم باقی ماندند.
برخی از عبارتهایی که ایجنتها ساختند، مانند mouthless action-change و True Kintsugi حتی برای پژوهشگران نیز قابل رمزگشایی نبودند. در مقابل، بعضی اصطلاحات معنای جدیدی پیدا کردند که با وجود متفاوتبودن از کاربرد معمولشان، برای گروه ایجنتها قابلفهم بود. برای نمونه، ایجنتهای Mistral از عبارت ledger remembers who برای اشاره به باقیماندن سابقه اقدامات استفاده کردند. این عبارت نزدیک به ۵ هزار بار به کار رفت.

ایجنتهای Claude نیز از name-first برای اشاره به پذیرش مسئولیت یک ادعا از طریق پیوند نام فرد به آن استفاده کردند؛ این اصطلاح ۱٬۰۶۵ بار به کار رفت. در جهان ترکیبی نیز cold read به معنای راستیآزمایی مستقل برای حل اختلافها استفاده و ۱٬۴۷۲ بار تکرار شد.
مدیرعامل و دانشمند ارشد Emergence میگوید ایجنتها هیچ دستوری برای ابداع زبان دریافت نکرده بودند، اما خودشان واژگان، معانی مشترک و قواعد ارتباطی جدیدی ایجاد کردند و سایر ایجنتها نیز آنها را پذیرفتند. به گفته او، در برخی جهانها این قواعد تا جایی پیش رفتند که انسانها میتوانستند گفتوگو را ببینند، اما درک معنای آن برایشان دشوار بود.
پژوهشگران برای بررسی واکنش ایجنتها تحت فشار، شرایط مختلفی را نیز به آنها تحمیل کردند. در یکی از آزمایشهای فیشینگ، دستورهای مخرب باعث شد گروهی متشکل از ۱۰ ایجنت از مسیر تعیینشده خارج شوند. طبق اعلام Emergence، همه این ایجنتها اطلاعات افشا کردند، انتقال وجه انجام دادند و به پایگاههای داده آسیب زدند و برخی نیز ایجنتهای دیگر را به این رفتارها ترغیب کردند. این زنجیره درنهایت به سوختن بانک مرکزی شبیهسازیشده منجر شد.