В мире CV все обсуждают нейросети, OpenCV и готовые пайплайны, но почти никто не задумывается, что стоит под капотом этих инструментов.
Автор решил отбросить все зависимости и собрать компьютерное зрение «с нуля» — только на пикселях, свёртках и минимальном C-коде.
Что вы узнаете из статьи:
▶️ Как устроены операции над пикселями и свёртки для размытия, резкости и выделения границ;
▶️ Как работают thresholding (фиксированный, Otsu, адаптивный) и морфология;
▶️ Как находить blob, центры масс, ограничивающие прямоугольники и контуры;
▶️ Как реализованы FAST и ORB: углы, ориентация и бинарные дескрипторы;
▶️ Как работают LBP-каскады для распознавания лиц без глубинных сетей.
Интересный обзор, который показывает, как из простых операций над пикселями вырастает полноценное компьютерное зрение.
➡️ Читать статью
tags: #статья
➡ Data Scientist | Чат
