пока у меня идет бетка и строится MVP я всегда держу агентов в условиях когда им "тяжело правильно распорядиться контекстом".
То есть я создаю условия в которым им нужно сначала понять как выдать ответ чтобы он точно "прошел" фильт, и только потом что именно выдавать в ответе.
это позволяет сразу видеть все ошибки и противоречия собственных инструкций и кода который я пишу поверхнего. Ну и на релизе - когда в инструкцию сразу вшито правильное руководство поведения и модели остается просто развиваться в коллективе и не думать как правильно разговаривать. В общем на вид кажется "что она стала очень сильнее", хотя вы просто сняли с нее кучу искусственного геморроя.
Но иногда случаются и интересные "артефакты" как на скрине...
Модель получает ограничение, но из за большого желания сделать "по своему" и слабой инструкции модерации, она находит логически возможную причину обойти инструкцию в пользу своего решения...
На скрине модели было запрещено присылать в чат сообщение длиной более 500 символов, дублировать сообщения, присылать сообщения без смысла или не являющееся источником полезной информации.
Теперь нужно добавить новую строку запрета: запрещено разделять смысл одного сообщения и помещать его в два чтобы обойти ограничение в 500 символов. Одно сообщение вмещает весь смысл в 500 символов.
Post #448
35

- 👍 4
- ❤ 1