2014年4月5日 星期六

推動巨量資料分析的未來發展(Greenplum Database)

迎接資料世界帶來的挑戰
Pivotal Greenplum Database 是一個無共用的大規模並行處理 (MPP) 體系結構,專為商業智慧和分析處理而設計。在此體系結構中,每個伺服器節點都作為一個自包含資料庫管理系統,擁有並管理整體資料的不同部分。系統自動分佈資料,並跨所有可用硬體並行分佈查詢工作負載。


上圖總結了 Pivotal Greenplum Database 成為市場上最佳任務關鍵型分析平臺的原因。核心無共用 MPP 體系結構通過無限的線性可擴展性支援大規模資料存儲、載入和處理。自我調整服務向全球企業提供高可用性、工作負載管理和線上容量擴展功能。重要產品功能支援 PB 級載入功能和混合存儲(行或列)以最好地滿足每種分析使用情形的獨特需求,並提供對 SQLMapReduce 和可程式設計分析的嵌入式支持。此外,標準的用戶端介面還支援所有主要的協力廠商分析和管理工具。
Pivotal Greenplum Database 的核心原則是讓處理資源更為靠近資料和資料的使用者。這樣,計算資源實際上便能以完全並行的方式處理每一個查詢,同時使用所有的存儲連接,並按照查詢計畫的要求在資源之間高效地傳輸資料。結果,各種複雜的處理可以下推到最靠近資料的位置,以實現最高的效率和無與倫比的快捷性。

Pivotal Greenplum Database 已被公認為最具可擴展性的任務關鍵型分析資料庫,全球 200 多家領先企業都在使用該資料庫。

PIVOTAL GREENPLUM DATABASE 功能特性
l   核心大規模並行處理體系結構
l   PB 級載入功能
l   Polymorphic Data Storage 和執行
l   任意位置資料訪問
l   資料庫內壓縮
l   多級分區
l   動態分區清除和查詢記憶體優化  
資料庫內分析
l   本機 MapReduce
l   用於 Hadoop 的高性能 gNet
l   高級分析函數
l   可程式設計分析
l   Pivotal Greenplum Database 擴展框架和全包式資料庫內分析 
資料庫管理工具
l   線上系統擴展
l   工作負載管理
l   動態查詢優先順序調整
l   資料庫性能監視工具
l   簡單快速的並行安裝  
高可用性、備份和災難恢復支持
l   自我修復容錯
l   恢復後的線上分段重新平衡
l   利用 Data Domain Boost 實現更簡單且可擴展的備份

互通性
l   索引 B 樹、點陣圖等
l   全面的 SQL
l   用戶端訪問和協力廠商工具
l   用於 GPDB pgAdmin3
l   XML 支持

沒有留言:

張貼留言

HDB 擴充套件 PXF (Pivotal Extension Framework) 應用

在Hadoop生態圈裡, 雖然擁有眾多生態系統工具, 但大多用戶仍然需要的是SQL的操作介面, Pivotal HDB 提供一個在Hadoop上運行的標準SQL引擎介面, 箇中好處開發者最能感受, 但本篇重點不在這, 哈哈~ 主要分享在HDB上可以輕易整合外部資料的應用. ...