Discuz! Board

 找回密碼
 立即註冊
搜索
熱搜: 活動 交友 discuz
查看: 191|回復: 0
打印 上一主題 下一主題

Vertica 和 Netezza 等列式数据库绝对是

[複製鏈接]

1

主題

1

帖子

5

積分

新手上路

Rank: 1

積分
5
跳轉到指定樓層
樓主
發表於 2023-11-13 15:12:27 | 只看該作者 回帖獎勵 |倒序瀏覽 |閱讀模式
不错的选择,但不幸的是非常昂贵。诸如增量报告和优化之类的频繁查询的使用不适合 Hadoop 的使用,而那些使用 Hadoop 的人最终付出了相对较高的代价。Redshift 的到来因其价值而带来了完全破坏性的替代方案。它是一个经过充分优化的列式数据仓库系统,包括计算机服务器、网络、存储,甚至备份S3存储。亚马逊声称其价格是数据仓库价格的十分之一,这让亚马逊大肆宣传。但从我们的观察来看,每小时需要运行几次查询的用户在比较 Redshift 和 Hadoop 的工作时将至少节省所声称的金额(如果不是更多的话)。

我们希望帮助人们最有效地分析他们的大数据。有很多不必要使用 Hadoop 的情况,我们希望针对这些情况引入 Redshift 等选项。去年 11 月,当我们听到 Amazon Redshift 的公告时,我们肯定对 Amazon 简化 沙特阿拉伯电报号码数据 大数据的主张很感兴趣。幸运的是,我们能够获得 Redshift 的预览访问权限。因此您只需单击几下即可进行扩展。 跨集群共享数据。 您无需复制或移动数据,只需在 Redshift 集群之间共享数据即可。 完全托管。 让我们面对现实吧:这就是为什么您要为高级数据库解决方案付出如此多的代价。借助 Redshift,您可以信赖 Amazon 的优质服务。 自动备份。



EMR和Spark处理数据 Amazon EMR 是一个用于处理大数据工作负载的 AWS 框架。EMR 允许您将数据存储在 S3 中并在单独的进程中运行计算。EMR 为 Apache Spark 提供本机支持。何时使用Spark 还是 Redshift来处理数据取决于用例。 Dow Jones 使用 EMR 来处理、处理和转换数据, 并为各个步骤和阶段使用不同的 S3 存储桶。 数据湖区域和 S3 存储桶 AWS Glue 用于组织和分区数据 最终用户访问“数据集市”,即应用业务规则的聚合数据。 如果您曾经因不幸的硬件或网络故障而丢失数据而经历过令人难以置信的挫败感,那么您已经知道 Amazon Redshift 提供的异步复制的价值。

回復

使用道具 舉報

您需要登錄後才可以回帖 登錄 | 立即註冊

本版積分規則

Archiver|手機版|小黑屋|Comsenz Inc.

GMT+8, 2026-9-11 15:35 , Processed in 0.031433 second(s), 20 queries .

Powered by Discuz! X3

© 2001-2013 Comsenz Inc.

快速回復 返回頂部 返回列表