меня порой восхищают способы, до которых люди, в принципе, додумываются, чтобы хакнуть/джейлбрейкнуть/сделать prompt injection/whatever LLMки
вот, например, человек в статье додумался задавать вопросы в шестнадцатеричной кодировке (которая очень распространена в программировании для адресов памяти и кодов ошибок, в RGBшных цветовых кодах и т.д.) и таким образом обошел цензуру — модель от DeepSeek начала отвечать на все вопросы, только ответы тоже в шестнадцатеричной кодировке да и все
мне не понятно как то, как можно было придумать такой черный ящик как LLM, так и то, как можно было догадаться попробовать позадавать вопросы в этот черный ящик в шестнадцатеричной кодировке
the creativity of human mind is still the 🐐
p.s. вот можете почитать еще статейку, которой поделился @linksfromme в комментариях:
https://s0md3v.github.io/blog/magika-bypass
Post #234
823
you can, guy итак, новости ИИ к этому часу: — DeepSeek (разработчик той самой китайской LLMки с революционной архитектурой) начал занимать первую строчку в американском App Store, сместив ChatGPT это означает, что миллионы американцев пошли загружать свои файлы и данные…
- ❤ 10
- 👍 3
- 😁 1