Ну, с Днём Науки СССР!
В развитие последних идей - дать любому рядовому программисту набор методик, в один миг превращающий его с помощью агентов в сеньора-архитектора (что сегодня очевидно можно объективно измерить очень легко),
думаю над следующим шагом: как вообще уничтожить всё программирование, чтобы вместо того чтобы годами учиться, фигак, и получил в руки абсолютный инструмент lowcode/nocode. Какие-то совсем базовые devops-темки часов 5-50 максимум подучить и всё, да и то временно.
Почему этим никто не занимается? Ну, потому что это не про бабло, а про его потерю :)
В геймдеве кстати сейчас такое уже довольно успешно практикуется, потому что игры - продукты автономные, практически все делаются по типовым шаблонам, разница только в контенте. Это может быть прекрасный полигон для откатки DSL.
Вот хорошие темки, в которых было бы неплохо ликвидировать весь мировой бизнес: навскидку, SERP Analytics, Competitive Price Intelligence, web scraping api / под LLM, E-commerce Data Collection, где тысячи стартаперов и инди-хакеров жрут друг друга.
По мне всё это, особенно классический парсинг - откровенно мутная темка, (около)мошенническая, давно пора запретить вместе с буками и казиками, пожалуй, её и начну показательно уничтожать :)
Для этого надо построить формальную семантическую машину, где синтаксис, смысл, преобразования и исполнение заданы в единой математической теории (парсер как вывод в формальной системе).
Требования:
1. Универсальность по входам (текст, semi-structured data, бинарные форматы, API payloads, HTML, логи, DSL, естественно-языковые шаблоны)
2. Универсальность по целям (parse -> AST, validate, infer schema, repair, transform, explain errors, round-trip print/serialize, evolve grammar over time).
3. Агентность. Система не просто применяет грамматику, а сама предлагает гипотезы о формате, уточняет grammar/type/specification,
выбирает стратегию разбора, объясняет неоднозначность, гарантирует корректность некоторых частей...
Теоркат будет "архитектурным языком" для универсализации (почему он?).
Парсер как морфизм (только не в категории обычных функций а скорее всего Клейсли некоторой монады), синтаксис как функтор, структура как алгебра. Думаю будет только так парсить HTML, JSON-like мусор, логи, email / документы, табличные куски текста, полу-структурированные отчёты, простые DSL, API ответы с ошибками, OCR-текст средней грязности etc.
Сделаю сперва демо на коленке и задеплою бесплатный SaaS: будет очень красиво, очень композиционно, но очень общо :) Но зато и немало парс-бизнесов сразу умрут.
Если вы вчера прочитали третью главу про Гарри Поттера, то должны к данному моменту понять, почему почти весь парсинг можно описать через AST как неподвижную точку функтора сигнатуры :)
Представляем каждый парсер как морфизм, сборку делаем только через композицию, рекурсию задаём через initial algebra / fixed point, интерпретацию через катаморфизм/fold,
(если хочется двунаправленности то добавляем оптики + изоморфизмы),
и поверх этого фигачим "агента композиции" (оставаясь строго в теоркате).
...И вообще, в целом, как вам идея: точечно уничтожать западные ИТ-бизнесы недружественных стран выпуском бесплатных клонов с точностью до UI и API. Это будет Абсолютное Оружие! )))
А нам это не страшно, мы просто западные киллер-сервисы забаним.
Zyte, Bright Data, Rossum, готовьтесь.
UPD. Не, русских пацанов не буду обижать, конечно. Эти сервисы не будут работать с доменами ru и с российскими айпишками.
Post #2352
711

- ❤ 39
- ✍ 14
- 😁 5