باورتون میشه یکی از راههاش این بوده که با Claude مثل انسان نخستین حرف بزنیم؟
یه پروژه به اسم Caveman اومده دقیقاً همین کارو کرده. ایدهاش سادهست:
به جای اینکه Claude Code بگه:
> “The issue likely originates from object reference recreation during render cycles…”
میگه:
> “new object each render. component panic. rerender happen.”
و خب درست کار میکنه!
طبق benchmarkهایی که داخل ریپو گذاشتن، تو بعضی تسکها تا ۸۰٪ مصرف توکن کمتر شده و میانگین صرفهجویی حدود ۶۵٪ بوده. یعنی هم context دیرتر پر میشه، هم هزینه API کمتر میشه، هم وقتی Claude وسط پروژه existential crisis میگیره، پول کمتری از حساب کم میشه. حتی یه ابزار به اسم
caveman-shrink هم دارن که فایلهای instruction و memory رو فشرده میکنه تا ورودیها هم توکن کمتری مصرف کنن.قشنگترین بخش داستان اینه که کل کامیونیتی AI الان داره با جدیت علمی بررسی میکنه آیا “ugga bugga architecture” آیندهی prompt engineering هست یا نه
البته بعضیا هم benchmark گرفتن و گفتن “be brief” توی پرامپت تقریباً همون نتیجه رو میده!
رسیدیم به نقطهای از تکنولوژی که senior developerها دارن میلیونها پارامتر transformer رو مجبور میکنن مثل آدمهای عصر حجر صحبت کنن تا قبض Anthropic کمتر بشه
https://github.com/juliusbrussee/caveman
@DevTwitter | <Hamed Sharifi/>