TGViewer
Channel Public Channel
Order of Six Angles

Order of Six Angles

@orderofsixangles

Каналу 7 лет

Youtube канал: https://youtube.com/@orderofsixangles

Github: https://github.com/thatskriptkid

Тематические подборки малвари: https://www.orderofsixangles.com/samples

Пишите в личные сообщения канала
Subscribers
5.38K
Photos
449
Videos
31
Links
2.2K

Showing posts older than #3050 · Back to latest

Older Posts 20 shown
Post #3049 1.52K
Order of Six Angles Photo
Это притом что у меня материнка под АМ4, и один из слотов PCI x4, работающий через CPU
Post #3045 4.82K
Post #3044 1.4K
Order of Six Angles Протестировал много моделей для анализа малвари, в итоге пока остановился на варианте Jackrong/Qwopus3.6-27B-Fusion-GGUF (Q3_K_M) с 48к контекста для 16 ГБ врам. После заполнения контекста правда скорость примерно 16 токенов в секунду. Попробуйю найти подобное…
с МТП гораздо быстрее
Post #3043 1.53K
Протестировал много моделей для анализа малвари, в итоге пока остановился на варианте Jackrong/Qwopus3.6-27B-Fusion-GGUF (Q3_K_M) с 48к контекста для 16 ГБ врам. После заполнения контекста правда скорость примерно 16 токенов в секунду. Попробуйю найти подобное по качеству, но с MTP
Post #3042 1.52K
Интересная модель Escha Qwen3.6 35B-A3B W2. Сжата до 2 битов. Запустил на 16 Гб ВРАМ. Завтра напишу подробнее. Они даже ответили мне в твиттере, что mlx версия будет на следующей неделе
Post #3041 1.65K
Order of Six Angles PrismML представила модель Bonsai 27B — большую языковую модель (LLM) объемом 27 миллиардов параметров, способную функционировать на смартфонах. Компания анонсировала Bonsai 27B — новую версию Qwen3.6 27B, сжатую до размеров, позволяющих запускать модель…
решил вернуться к этой странной модели, проверяю ее на анализе малвари, подправляю харнесс под нее, но все равно пока не получается. Постоянно уходить в цикл
Post #3040 1.83K
Order of Six Angles итого задача длилась 7 ч 35 мин. Кодекс gpt 5.6 Sol xhigh за это время потратил 75% недельного лимита. На тесты потрачено 40 долларов. 21 опенкод сессия, всего 11 образцов успелось прогнаться. 1 070 вызовов инструментов, 18 tool-level ошибок — около 1,7%.…
вот эта тулза https://github.com/akiselev/ghidra-cli/tree/master показала себя очень хорошо, поставил ее вместо ghidra mcp + r2. Радар вообще убрал, просто одной гидры пока хватает.
GitHub GitHub - akiselev/ghidra-cli: Automate Ghidra reverse engineering from the command line — headless analysis, decompilation, and… Automate Ghidra reverse engineering from the command line — headless analysis, decompilation, and structured JSON output for AI agents like Claude Code - akiselev/ghidra-cli
Post #3039 1.76K
Order of Six Angles тестил свой харнесс вручную, каждый образец прогонял сам. устал. закинул 40 долларов на опенроутер, дал кодексу задание тестировать самому, пока не уйдешь в 0.
итого задача длилась 7 ч 35 мин. Кодекс gpt 5.6 Sol xhigh за это время потратил 75% недельного лимита. На тесты потрачено 40 долларов. 21 опенкод сессия, всего 11 образцов успелось прогнаться. 1 070 вызовов инструментов, 18 tool-level ошибок — около 1,7%. Думаю скоро выложу в опенсурс
Post #3037 1.57K
Order of Six Angles Custom RE-harness Пришел к выводу, что есть потребность в разработке кастомного харнесса для анализа малвари, заточенного под маленькие модели. Прям совсем велосипед не стал городить, начал с плагина к OpenCode (https://opencode.ai/). Идея простая - заточить…
тестил свой харнесс вручную, каждый образец прогонял сам. устал. закинул 40 долларов на опенроутер, дал кодексу задание тестировать самому, пока не уйдешь в 0.
Post #3032 1.25K
Order of Six Angles Интересный твит попался https://x.com/DogukanUrker/status/2079569892303344044 Разработчик показал запуск модели на одной RTX 3060 12 ГБ с полным контекстом 262 144 токена и скоростью около 100 токенов/с благодаря MTP (Multi-Token Prediction). Что использовалось:…
Выбрал и проверил Gemma 4 E4B IT QAT UD-Q4_K_XL (на RTX 3070) с BF16 MTP-драфтером. MTP действительно полезен: ускорение составило 29–34%, включая реально заполненный контекст 114K.

Контекст был выделен на 131 072 токена; длинный prompt реально содержал 114 047 токенов. Его обработка заняла около 61 секунды со скоростью примерно 1874 ток/с.

Конкретно для E4B не подтвердился тезис, что Q8-кэш драфтера резко ухудшает acceptance: показатели совпали с FP16. Q8 оказался лишь примерно на 1,5% медленнее на длинном контексте.
Post #3031 2.59K
Интересный твит попался https://x.com/DogukanUrker/status/2079569892303344044

Разработчик показал запуск модели на одной RTX 3060 12 ГБ с полным контекстом 262 144 токена и скоростью около 100 токенов/с благодаря MTP (Multi-Token Prediction).
Что использовалось:
• Gemma 4 12B QAT (Q4_K_XL)
• MTP speculative decoding в llama.cpp
• Полностью GPU-инференс, без CPU offload
• Загрузка VRAM - около 97%
•
Самый интересный момент - организация KV-кэша.

Для основной модели используется кэш в Q8, а для MTP-драфтера — FP16. Попытка квантовать кэш драфтера заметно снижала acceptance, поэтому такой гибридный вариант оказался оптимальным. По словам автора, даже при контексте 262K acceptance держится около 70%.
X (formerly Twitter) Doğukan (@DogukanUrker) on X Gemma 4 12B on a single RTX 3060: the full 262,144 context at ~100 tok/s. (config below) dense model -> MTP speculative decoding hits the full ~2.4 x 42 -> ~100 tok/s just by turning the drafter …
Post #3030 1.27K
Order of Six Angles Допиливаю харнесс для работы с Го малварью. Стало заметнее лучше, но ошибки все еще встречаются. Проводил тесты также с 14B моделью, но убедился, что все что ниже 27B вообще мне не подходит.
тестировать харнесс через облачную модель не так-то и дешево выходит, несмотря на то что модель маленькая. примерно 1 доллар на 1 запуск
Older posts →
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →