Последние пару месяцев смотрел и правил перф серчевого движка и в общем у нас наконец-то есть неплохие промежуточные результаты, иначе говоря мы быстрее во всех query/collection types :)
https://serenedb.com/search-benchmark-game
TLDR:
Взяли бенчмарк фреймворк, который сделали Tantivy, по результатам которого последние версии Lucene (powers Elasticsearch/etc) стали сильно бодрее, и добавили туда IResearch (библиотеку которую мы написали и используем в SereneDB), в отличие от некоторых других, все настройки честные, в плане многопоточности/кешей и тд (это возможно во всех Lucene-like engines, но делает бенчмарк бессмысленным).
Больше про детали бенчмарка можно почитать тут https://blog.serenedb.com/search-benchmark-game-overview
А ещё мы начали серию статьей, две части уже доступны, про то засчет чего получилось быстрее чем у Lucene и Tantivy:
1. https://blog.serenedb.com/search-optimization-1
2. https://blog.serenedb.com/search-optimization-2
3. Coming soon...
В общем все как обычно, если можете поддержать, ставьте звёздочку на репу https://github.com/serenedb/serenedb/tree/main/libs/iresearch :)
Post #752
5.24K