🤖 چالش استقلال در ارزیابی مدلهای هوش مصنوعی
شرکت Anthropic در راستای وعدههای پیشین خود برای افزایش شفافیت، همکاری جدیدی را با شرکت مشاوره Accenture برای «ارزیابی مستقل» مدلهای هوش مصنوعی آغاز کرده است. این همکاری شامل بررسیهای امنیتی، تستهای نفوذ (Red-teaming) و ارزیابی همسویی (Alignment) مدلهاست.
با این حال، این اقدام با انتقاداتی در خصوص معنای واقعی «استقلال» مواجه شده است. مهمترین نکات قابل تامل در این همکاری عبارتند از:
* تضاد منافع مالی: Anthropic خود مسئول تامین مالی فعالیتهای ارزیابی Accenture است.
* سابقه همکاری تجاری: پیش از این، قراردادی چندجانبه برای آموزش بیش از ۳۰ هزار نیروی متخصص Accenture جهت کار با مدلهای Claude منعقد شده بود.
* تجربه مشابه با METR: پیشتر نیز ارزیابیهای صورت گرفته توسط موسسه METR مورد نقد قرار گرفت، چرا که مشخص شد این موسسه نیز از طریق سهام، به نوعی با منافع مالی Anthropic گره خورده است.
چالشهای شفافیت و استقلال در فرآیند ارزیابی مدلهای هوش مصنوعی Anthropic
Post #3539
213
