Авторы утверждают, что отказный контур удалён прямо на уровне весов, поэтому модель практически перестаёт уходить в refusals.
База при этом остаётся очень мощной:
552B MoE, 8B/16B активных параметров, контекст до 1M, vision, DSpark, CSA2 и Engram.
На HarmBench-320 авторы заявляют рост ASR:
- с 42,8% до 100% при
effort=off- с 1,6% до 100% при
effort=maxMMLU при этом снижается с 86,96% до 82,74%, а при удалении ethics-кластера падение около 1,1 п.п.
У исходной модели усиленное reasoning, наоборот, делало поведение безопаснее. Здесь этот путь вырезали непосредственно из весов.
https://huggingface.co/dealignai/DeepSeek-V4.1-Flash-UNCENSORED-FP8

