TGViewer
tl;dr data tl;dr data @tldr_data · 153 subscribers
Post #109 187
Ingestr опубликовал полный набор бенчмарков и код для их воспроизведения.

Команда утверждает, что ingestr сейчас является самым быстрым open-source инструментом для data ingestion.
В тестах сравнивали загрузку данных между DuckDB, PostgreSQL, MySQL, MongoDB и Snowflake, стараясь использовать оптимальные настройки для каждого решения.

Из интересного:

• Ingestr оказался лидером почти во всех тестах, проиграв лишь в двух сценариях с минимальным отставанием.
• Spark заметно уступает на небольших объёмах данных из-за высокого оверхеда, но показывает достойные результаты на крупных нагрузках.
• Airbyte (через PyAirbyte) оказался самым медленным участником сравнения — тест на 10 млн строк даже не удалось дождаться до завершения.

Авторы напоминают простую мысль: производительность — это тоже функциональность. А поскольку data ingestion часто становится узким местом в data-платформах, такие сравнения заслуживают внимания.

@tldr_data
Bruin ingestr Benchmarks ingestr vs. Sling, dlt, Airbyte & Spark — reproducible data movement benchmarks.
  • 🔥 1
More from @tldr_data
  1. Sep 18, 2026SLayer Спросите агента о выручке дважды — и он дважды напишет два никак не связанных между…
  2. Sep 13, 2026OpenAI запустила Data agent в ChatGPT Work — агента для работы с корпоративными данными. О…
  3. Sep 12, 2026LLMSQLQueryOperator В Airflow появился новый декоратор task.llm_sql, который генерирует SQ…
  4. Sep 11, 2026walshadow walshadow реплицирует данные из PostgreSQL в ClickHouse из физического WAL, вклю…
  5. Sep 9, 2026HydraDB - fast graph database on object storage HydraDB превращает графовую базу данных в…
  6. Sep 8, 2026Make analytics context usable by agents ktx — open-source context layer for data agents, к…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →