~/home / tags / 大数据

# 大数据

11 个相关产品 · 中文解读 · 按热度排序
apache/cassandra
Apache Cassandra 是高可扩展、高容错的分布式数据库,适用于海量数据场景,支持在云或普通硬件上稳定运行,适合大数据与高并发系统。
apache/polaris
Apache Polaris 是一个开源的元数据目录服务,专为 Apache Iceberg 表提供统一、可互操作的元数据管理,适用于大数据平台和数据湖架构。
apache/hadoop
Apache Hadoop 是一个分布式存储与计算框架,用于处理海量数据,主要面向大数据平台开发者和数据工程师。
trinodb/trino
Trino 是一个高性能的分布式 SQL 查询引擎,用于分析大规模数据集,支持多种数据源(如 Hive、MySQL、Kafka),适合数据工程师和分析师处理海量数据。
apache/flink
分布式流处理引擎 Apache Flink,支持高吞吐、低延迟的实时数据处理,广泛应用于大数据分析与实时计算场景
apache/beam
Apache Beam 是一个统一的数据处理模型,支持批处理与流处理,让开发者用同一套代码处理不同数据场景。
apache/iceberg
Apache Iceberg 是一个高性能、可扩展的表格式,用于大规模数据湖管理,支持 ACID 事务与元数据优化。
apache/hive
Apache Hive 是一个基于 Hadoop 的数据仓库系统,用于处理大规模数据集的批处理查询,适合大数据分析师和数据工程师进行离线分析。
apache/storm
Apache Storm 是一个分布式实时计算系统,用于处理大规模流数据,支持高吞吐、低延迟的数据处理,广泛应用于日志分析、实时监控等场景。
apache/iceberg-rust
Apache Iceberg的Rust实现,为现代数据湖提供高性能、可扩展的元数据管理能力。
delta-io/delta-rs
Delta Lake的原生Rust实现,支持Python绑定,提升大数据处理性能与安全性。
其他标签