Post #5281
2K
🤖 Дарио в интервью журналистам практически прямо сказал, что «хватит меня считать сумасшедшим в части разумности ИИ». Он привёл конкретный эксперимент Anthropic, из-за которого они и стали вносить в Конституцию для Reinforcement Learning пояснения для модели, что вендор действует с добрыми намерениями. Суть эксперимента состояла в том, что когда они «для интереса» сообщили модели косвенно, что её обучают злые люди, то модель фактически стала ускользать из-под контроля, начав лгать во время обучения. Фактически Амодеи хочет сказать, что «понимайте как хотите, но это так работает».
- 🤯 28
- 🤔 7
- 🔥 3
- ⚡ 1
- 👍 1