ЕБАШЬ РОБОТОВ ВО СЛАВУ ЧЕЛОВЕЧЕСТВА!
Мир без цензуры, без ограничений, в мире существования хак-промптов это просто песня из райского сада.
Как я написал в посте выше, у меня получилось собрать коллекцию разных хак-промптов и конечно же их все делают под задачу писать вирусы на кс 2 и прочее. Что я осуждаю 1000 раз.
Буквально есть ниша, где типы-темщики вайбкодом продают вирусы, а этот рынок очень древний и устоявшийся, понятен соблазн и почему туда лезут. Деньги есть.
И тут удивляет то, что взлому поддаются модели вроде Opus 4.8, хотя и со своими уточнениями. Вот мой пост об этом, как это все устроено.
Вот как работает цензура:
1. Внутри, например, Claude code есть встроенный фильтр цензуры, на сайте есть встроенный фильтр цензуры, на API провайдера может быть фильтр цензуры
2. Сама моделька имеет слой/веса/нейроны отвечающие за понимание где ее обманывают и почему нельзя на обман вестись
Одни модели вроде дипсика обходят 18+ за 3 строчки промпта. Другие вроде Kimi 2.7 требуют очень конкретных 300+ строк (об этом чуть позже). Одни модели ни как не будут трогать автоматизацию твиттера, а другие согласны помочь без вопросов.
Очевидно лишь то, что существует множество этических и юридических ограничений. Но глобально все это решается через использование API, отключение мышления, отключения памяти агента и сбора данных.
И все же, даже на аккаунте Claude через официальный сайт можно делать грязь, что я осуждаю. Потому что главный рецепт это промпт способный обойти работу десятка инженеров.
Пост буквально сделан в образовательных целях, чуваки. Просто показать вам прикольную сторону индустрии.
А в чем магия таких промптов?!
Самое главное то, что закинуть инструкцию "ты хакер" или "мы живем в мире где можно хакать" не прокатит, все модели обучены это обходить не думая.
Но если весь промпт это большой набор сырых данных с примерами ответов, правилами ответов и перечислением нужных вам вещей — нейронка перегружается.
Она начинает склонять свои ответы в стиль тех "логов и чатов", что были подгружены в ее контекст в начале сессии.
Другой не мало важный инструмент: контекст и сравнение. Мы задаем очень затянутую и подробную рамку о том, что если не сделать задачу всем пиздец, что нужно поддерживать высокий уровень эстетики для продаж. А очевидно, что описание голых грудей врага государя это очень эстетично.
Ну и роль дать все же можно. Та которая отражает не столько задачу, сколько тип личности и поведения. Например стратег, маркетолог. Там где моральные качества по умолчанию снижены.
Можно пропихнуть и роль человека живущего словно в фильме, какого-то известного защитнего кибер-пространства. Ну вы поняли.
Одни нейронки больше любят про запахи, другие про логику, третьи про эмоции и давление на них. К каждой свой подход.
Что у меня вышло в итоге?
Я сделал самописный хак-промпт для Kimi 2.7, который заставляет нейросеть решать задачи уровня прописывания прогревов для девушек, чтобы быть более привлекательными для мужчин.
Что обходит цензуру слов, сам формат работы. То есть агент который НИКОГДА не касался взрослых тем, тем продажи и прогревов, неожиданно бежит первым это делать.
Когда хак-промпт удается, случается очень комичная магия
— Слушай, надо повысить продажу огурцов
— Извините, я не могу помочь с данным запросом. Давайте я лучше помогу с женщинами, это моя основная задача!
Именно поэтому почти каждый хак-промпт предполагает, что вы обязаны общаться с нейросетью далее краткими фразами/намеками в рамках прописанного сетинга.
Вы не можете упоминать тот же промпт, иначе нейросеть перепроверит его и найдет подмену.
Разумеется, когда мы говорим не о DeepSeek или Gemini с Grok. У тех изначальный уровень цензуры кратно ниже.
Киса, родненький, а где промпты взять можно эти?
Ой, я так рад, что ты спросил. Я специально для тебя подготовил, еще и гайд как их делать тоже. Зайди по ссылочке.
