1. 程式人生 > >大數據開發中常用的分析軟件?有哪些?

大數據開發中常用的分析軟件?有哪些?

大數據開發 大數據分析 大數據 Hadoop

大數據開發中常用的分析軟件有哪些?


大數據研究的出現,為企業、研究機構、政府決策提供了新的行之有效思路和手段,想要做好大數據的管理和分析,一些大數據開發工具的使用是必不可少的,以下是大數據開發過程中常用的工具:

1. Apache Hive

Hive是一個建立在Hadoop上的開源數據倉庫基礎設施,通過Hive可以很容易的進行數據的ETL,對數據進行結構化處理,並對Hadoop上大數據文件進行查詢和處理等。 Hive提供了一種簡單的類似SQL的查詢語言—HiveQL,這為熟悉SQL語言的用戶查詢數據提供了方便。

2. Apache Spark

Apache Spark是Hadoop開源生態系統的新成員。它提供了一個比Hive更快的查詢引擎,因為它依賴於自己的數據處理框架而不是依靠Hadoop的HDFS服務。同時,它還用於事件流處理、實時查詢和機器學習等方面。

3. Jaspersoft BI 套件

Jaspersoft包是一個通過數據庫列生成報表的開源軟件。行業領導者發現Jaspersoft軟件是一流的, 許多企業已經使用它來將SQL表轉化為pdf,,這使每個人都可以在會議上對其進行審議。另外,JasperReports提供了一個連接配置單元來替代HBase。

4. Keen IO

Keen IO是個強大的移動應用分析工具。開發者只需要簡單到一行代碼, 就可以跟蹤他們想要的關於他們應用的任何信息。開發者接下來只需要做一些Dashboard或者查詢的工作就可以了。

5. Mortar Data

Mortar Data是專為開發者打造的Hadoop開發平臺,它用Pig和Python的組合替代了MapReduce以便開發者能簡單地編寫Hadoop管道(Pipeline)。

6. Placed Analytics

利用腳本語言以及API, PlacedAnalytics能夠提供針對移動和網絡應用的詳細用戶行為分析。包括, 用戶使用時間和地理位置信息。 這些可以幫助開發者的應用更好地吸引廣告商, 也可以幫助開發者對自己的應用進行改善。

7. Ingres Corp

它擁有超過一萬客戶而且正在擴增。它通過Vectorwise以及對ParAccel實現了擴展。這些發展分別導致了Actian Vector和Actian Matrix的創建。它有Apache,Cloudera,Hortonworks以及其他發行版本可供選擇。

8. Talend Open Studio

Talend是一個統一的平臺,它通過提供一個統一的,跨企業邊界生命周期管理的環境,使數據管理和應用更簡單便捷。這種設計可以幫助企業構建靈活、高性能的企業架構,在次架構下,集成並啟用百分之百開源服務的分布式應用程序變為可能。

9. Cloudera

Cloudera正在努力為開源Hadoop,提供支持,Hadoop可以作為目標數據倉庫,高效的數據平臺,或現有數據倉庫的ETL來源。企業規模可以用作集成Hadoop與傳統數據倉庫的基礎。 Cloudera致力於成為數據管理的“重心”。

10. Pentaho Business Analytics

Pentaho的工具可以連接到NoSQL數據庫,有很多內置模塊,可以把它們拖放到一個圖片上, 然後將它們連接起來。

工具的熟練使用可以起到事半功倍的效果,以上僅僅是一些數據開發過程中常用的工具,對於大數據開發人員來說是需要熟練掌握的,當然,大數據開發過程中也會需要借助一些其他的工具,這就需要大數據開發人員具有發現和解決問題的能力,以及養成善於積累的習慣!如果想學習大數據開發可以與老男孩教育聯系!


大數據開發中常用的分析軟件?有哪些?