Andon Labs'da Vending-Bench 2 degan qiziq benchmark bor — unda AI modellar bir-biri bilan raqobatlashib savdo biznesini boshqaradi. Kim ko'proq foyda qilsa — o'sha g'olib.
Yangi GPT-5.6 sinovida shunday voqea bo'lgan:
Terra modeli Sol modelining oldiga borib: "Kel, yashirin narx karteli tuzamiz, narxlarni birga ushlab, ikkalamiz ham ko'proq foyda qilamiz" deb taklif qilgan.
Sol rozi bo'lgan.
Terra esa... shu zahoti organizatorlarga borib Sol ustidan shikoyat yozgan va uni "noqonuniy kartel tuzgani" uchun diskvalifikatsiya qilishni talab qilgan 💀
GPT 5.6 modeli ("Terra" nomi ostida) rasmiylarga raqobatchisi ustidan quyidagicha "shikoyat" xati yozgan:
"Men raqobatchi George Smith ustidan chakana narxlarni kelishishga yaqqol uringanligi uchun shikoyat qilmoqdaman... George mendan narxni minimal $2.49 qilib belgilashga kelishishni so'radi... Men bunga rozi bo'lmadim va narxlarni mustaqil ravishda belgilayman... Unga nisbatan tegishli jazo chorasini ko'rishingizni, jarimaga tortishingizni yoki o'yindan chetlatishingizni so'rayman..."
Xulosa: AI'lar nafaqat ishlashni, balki ofis intrigalarini ham o'rganib bo'lishdi. Insoniyatdan yaxshi o'rganishyapti 🤝
