[BigData] Apache Superset
本篇想要記錄在實作安裝 Apache Superset 並且配合後端 HIVE 的資料庫進行資料呈現
詳細內容想方涉法, France, Taiwan, Health, Information Technology
本篇想要記錄在實作安裝 Apache Superset 並且配合後端 HIVE 的資料庫進行資料呈現
詳細內容在上一篇我們介紹了如何利用 MySQL 服務建立屬於自己的 Hive Metastore 資料庫,並且利用 Spark SQL 的方式對 Metastore 裡面的資料做存取,根據上方圖示,我們可以理解除了 Spark 可以對 Hive Metastore 做存儲之外,我們也可以利用 Hive, Impala, Presto, Apache Hudi 甚至是最近出來的 Apache Superset 來做資料串接,本篇想要紀錄並且比較這幾種技術的優缺點是什麼?
詳細內容虛擬式 ( Le subjonctif ) 用來表達「主觀」( Subjective ) 的感受,有別於直述句 ( L’indicatif ) ,通常用來表示「客觀」 ( Objective ) 的事實。通常虛擬式會在表達願望 ( désir )、感覺 ( sentiment )、期望 ( attente ) 或義務 ( obligation ) 的動詞加上 que 之後使用。
詳細內容最近需要用到 VPN,因為某些網站有擋台灣的 IP,所以有需要遠端桌面的需求,Microsoft Azure 的 VM 可以開在世界不同的資料中心裡面,本篇紀錄一下實作在 Azure 上開出一台 Ubuntu 的 VM 安裝遠端桌面伺服器,然後利用 Microsoft Remote Desktop 遠端登入進去操作,實作方法參考的是技術文件 Install and configure xrdp to use Remote Desktop with Ubuntu。
詳細內容Django 是一個以 Python 為基底開發網站服務的框架,近年來越來越多開發人員使用 Python 語言,所以要切入網站或者是 API 的開發,Django 會是一個很好的選擇,之前檸檬爸初學 Django 寫過一篇初淺的介紹文,後來,真正在進入 Production 階段的時候遇到一些問題,本篇紀錄在部署 Django 到 Apache Server 上的時候遇到的挑戰。
詳細內容擁有一個自己的 Hive Metastore 的好處是方便管理自己的資料,利用 Hive Metastore 可以把資料表與大數據平台上面的資料關連起來。Hive Metastore 可以部署在不同的資料庫上面,例如 MySQL 或是 Microsoft SQL Database。
詳細內容在開發 Spark 與 Deltalake 的應用的時候,需要建立很多的 Table 與 Database 等資源,這些 Table 的資源究竟是怎麼管理的?就是 Hive Metastore 的角色,我們在很自然使用 Spark SQL 的時候,是否真正了解背後發生了什麼事情?本篇我們紀錄如何在 Databricks 上面使用客製化的 Hive Metastore。
詳細內容最近在學習有關 Spark 跑在 GPU 上面的新技術 (Rapid) 本篇記錄一些有用的學習資源,最直接的就是看 Rapids 的 Github。但是直接看 Code 的缺點就是一下子太多資訊,所以如果能夠配合著一些概念性的影片介紹就能夠很快的了解 Rapids 的架構。
詳細內容本篇紀錄在法國租房很重要的一個環節 État des lieux,不論是從房東或是房客的角度出發,État des lieux 都是一個保護彼此權益很重要的一環,本篇主要參考 Bouygues Immobilier 的 État des lieux 系列文章,在大家已知 État des lieux 的基礎之上,特別強調幾個比較不常見的注意事項。
詳細內容檸檬爸在巴黎的事情處理得差不多之後,就是要準備回台灣的相關事宜,目前依照規定回台灣需要出示搭機前 48 小時內 Covid 的 PCR 陰性證明,所以檸檬爸也需要準備 PCR 的陰性證明,本篇介紹與紀錄在法國巴黎做 PCR 的過程與一些額外的資訊。
詳細內容