數據平臺技術架構

来源:http://www.cnblogs.com/deane163/archive/2017/05/17/6865911.html
-Advertisement-
Play Games

1、系統架構圖如下: 2、系統各層介紹 以上採用五層的邏輯架構,第一層客戶層,第二層前端優化層,第三層應用層,第四層服務層,第五層數據存儲層,每層的介紹如下: 1、客戶層:支持PC瀏覽器和手機APP,可以直接通過IP訪問,反向代理伺服器。 2、前端層:使用DNS負載均衡,CDN本地加速及反向代理服務 ...


1、系統架構圖如下:

 


 

2、系統各層介紹

 

以上採用五層的邏輯架構,第一層客戶層,第二層前端優化層,第三層應用層,第四層服務層,第五層數據存儲層,每層的介紹如下:

1、客戶層:支持PC瀏覽器和手機APP,可以直接通過IP訪問,反向代理伺服器。

2、前端層:使用DNS負載均衡,CDN本地加速及反向代理服務。

3、應用層:網站應用集群;按照業務進行垂直拆分,比如應用商城,產品服務等。

4、服務層:提供公共服務,比如產品升級服務,搜索服務,賬號管理服務等。

5、數據層:支持關係型資料庫集群(支持讀寫分離),NOSQL集群,分散式文件系統集群,及分散式Cache

 

3、各部分技術介紹

 

3.1 基礎設施技術介紹:

 


 

分散式緩存

        在高併發環境下,大量的讀、寫請求涌向資料庫,磁碟的處理速度和記憶體處理顯然不在一個數量級,從減輕資料庫壓力和提高系統響應速度兩個角度來考慮,一般都會在資料庫之前加一層緩存。由於單台機器的記憶體資源和承載能力有限,並且如果大量使用本地緩存,也會使相同的數據被不同的節點存儲多份,對記憶體資源造成較大的浪費,因此才催生出分散式緩存。

持久化存儲

        隨著科技的不斷發展,越來越多的人參與到互聯網中,人們在網路上的活動,如發表心情動態、微博、購物、評論等,這些信息最終被轉換為二進位位元組的數據存儲下來。面對併發訪問量的激增和數據幾何級的增長,如何存儲正在迅速膨脹並且不斷積累的數據,以及應對日益增長的用戶訪問頻次,成為亟待解決的問題。

消息系統

        在分散式系統中,消息系統應用十分廣泛,消息可以作為應用間通信的一種方式,消息被保存在隊列中,知道被接收者取出,由於消息發送者不需要同步等待消息接收者的響應,消息的非同步接收降低了系統集成的耦合度,提升了分散式系統協作的效率,使得系統能夠更快地響應用戶,提供更高的吞吐。當系統處理峰值壓力時,分散式消息隊列還能夠作為緩衝,削峰填谷,緩解集群的壓力,避免整個系統被壓垮。

        開源的消息系統有很多,包括Apache的ActiveMQ,Apache的Kafka、RabbitMQ、memcacheQ等。

搜索引擎

         這裡說的垂直化搜索引擎,與大家所熟知的Google和Baidu等互聯網搜索引擎存在著一些差別,垂直搜索引擎主要針對企業內部的自由數據的檢索,而不像Google和Baidu等搜索平臺,採用網路爬蟲對全網數據進行爬取,從而建立索引並提供給用戶進行檢索、模糊匹配的需求,解決資料庫like查詢效率低下的問題,又能夠解決分散式環境下,由於採用分庫分表或者使用NoSQL資料庫,導致無法進行多表聯合查詢或者進行複雜查詢的問題。

其它

        除了前面所提到的分散式緩存、持久化存儲、分散式消息系統、搜索引擎,大型的分散式系統的背後,還依賴於其他支撐系統,還包含實時計算、離線計算、分散式文件系統、日誌收集系統、監控系統、數據倉庫等,還有CDN系統、負載均衡系統、消息推送系統、自動化運維繫統等。

 

3.2 基礎設施技術技術特點

 


 

 

4、開發中的故障案例分析

 

(1)寫日誌引發的故障:

故障分析:由於日誌等級為info或debug,導致產生的日誌異常多,磁碟被撐爆。

實例: 在圖片伺服器的Nginx伺服器上,由於日誌列印的過多,導致磁碟爆滿,最終導致不能寫入數據信息。

解決方案: 需要將Nginx的配置信息修改為Error,定時檢測磁碟空間是否滿,及時增加硬碟空間。

(2) 高併發訪問資料庫引發的故障:

故障分析:當SQL的執行頻率非常高時,會使得資料庫的Load持續升高,影響資料庫的性能。

解決方案:儘量增加表的索引,減少全表掃描,嘗試使用分散式緩存和緩存設備。

(3)高併發情況下,鎖引發的故障:

故障分析:由於鎖的使用,某個操作,執行時間較長(如遠程過程調用),長期占有鎖,導致程式阻塞,當這個鎖被釋放時,其它            線程得以執行。

解決方案:使用鎖操作時要謹慎,慎之又慎。

(4)緩存應發的故障

故障分析:由於緩存伺服器集群的關閉,導致數據查詢的壓力全部都到資料庫層面,導致資料庫的壓力較大。

解決方案:緩存伺服器是當今網站中不可或缺的一部分,我們要像管理其他伺服器一樣,認真管理緩存伺服器。

(5)應用啟動不同步引發的故障

故障分析:由於啟動應用伺服器的不同步,如 Apahce + Tomcat 應用,服務 Apache先啟動,會導致過多的請求到Apache上,導致Tomcat已啟動後,過多的請求壓力到Tomcat上,嚴重情況下導致Tomcat的崩潰。

解決方案:要嚴格按照指定的順序進行啟動應用,避免“姑娘還沒有穿好衣服,老鴇就把客人給領進來了”,所以老鴇領客人進來時,要先確認姑娘有沒有準備好。

(6)大文件讀寫獨占磁碟引起的故障

故障分析:文件伺服器中保存的有大文件和小文件,小文件有幾十K  到上百K,大文件有幾十M到上百M,會導致用戶下載大文件時,獨占磁碟操作,影響小文件的讀寫操作。

解決方案:將圖片伺服器小的文件,使用專用的存儲伺服器如阿裡的分散式文件伺服器,大的文件使用分散式文件伺服器如HDFS伺服器

(7)濫用生產環境引起的故障

故障分析:開發人員儘量不要對運行環境進行處理

解決方案:將正式庫的許可權交給運維人員,嚴禁開發人員對正式數據進行處理。

(8)不規範流程引起的故障

故障分析:應用發佈後,引起資料庫LOAD迅速飆升,檢查用戶代碼是否有變化,是否緩存給註釋掉。如註釋掉緩存代碼。

解決方案:代碼提交前一定要對代碼進行DIFF比較,確認沒有提交不該提交的代碼(如測試註釋的代碼,正式部署需要使用的)

(9)不好的編程習慣引起的故障

故障分析:程式在處理一個輸入的對象時,不明確輸入的對象是否為空。

解決方案:要養成好的編碼習慣,輸入的對象儘量保證不為空,必要時構造空對象。

 

5、開發過程中的心得體會

 


 
您的分享是我們最大的動力!

-Advertisement-
Play Games
更多相關文章
  • PHP編程中經常需要用到伺服器的一些資料,特把$_SERVER的詳細參數整理下: $_SERVER['PHP_SELF'] 當前正在執行腳本的文件名,與 document root相關。 $_SERVER['argv'] 傳遞給該腳本的參數。 $_SERVER['argc'] 包含傳遞給程式的命令行 ...
  • java中的數據類型,可分為兩類:1.基本數據類型,也稱原始數據類型。byte,short,char,int,long,float,double,boolean 他們之間的比較,應用雙等號(==),比較的是他們的值。 2.複合數據類型(類) 當他們用(==)進行比較的時候,比較的是他們在記憶體中的存放 ...
  • ////////////////////////////////////////////////////////////////// 記性不好的可以收藏下: 1,下拉框: 稍微解釋一下: 1.select[@name='country'] option[@selected] 表示具有name 屬性, ...
  • SRC_DIR := src/ INC_DIR := include/ OBJ_DIR := build/ DEP_DIR := build/ EXE_DIR := build/ SRC := $(notdir $(shell ls $(SRC_DIR)*.cpp)) OBJ := $(patsub... ...
  • Golang 支持在一個平臺下生成另一個平臺可執行程式的交叉編譯功能。 Mac下編譯Linux, Windows平臺的64位可執行程式: Linux下編譯Mac, Windows平臺的64位可執行程式: Windows下編譯Mac, Linux平臺的64位可執行程式: GOOS:目標可執行程式運行操 ...
  • 學習Java的同學註意了!!! 學習過程中遇到什麼問題或者想獲取學習資源的話,歡迎加入Java學習交流群,群號碼:618528494 我們一起學Java! Java編程思想,Java學習必讀經典,不管是初學者還是大牛都值得一讀,這裡總結書中的重點知識,這些知識不僅經常出現在各大知名公司的筆試面試過程 ...
  • 除特別註明外,本站所有文章均為原創,轉載請註明地址 AbstractQueuedSynchronizer(AQS)是JDK中實現併發編程的核心,平時我們工作中經常用到的ReentrantLock,CountDownLatch等都是基於它來實現的。 AQS類中維護了一個雙向鏈表(FIFO隊列), 如下 ...
  • 1、數字 2 是一個整數的例子。長整數 不過是大一些的整數。3.23和52.3E-4是浮點數的例子。E標記表示10的冪。在這裡,52.3E-4表示52.3 * 10-4。(-5+4j)和(2.3-4.6j)是複數的例子,其中-5,4為實數,j為虛數,數學中表示覆數是什麼?。 2 是一個整數的例子。長 ...
一周排行
    -Advertisement-
    Play Games
  • 移動開發(一):使用.NET MAUI開發第一個安卓APP 對於工作多年的C#程式員來說,近來想嘗試開發一款安卓APP,考慮了很久最終選擇使用.NET MAUI這個微軟官方的框架來嘗試體驗開發安卓APP,畢竟是使用Visual Studio開發工具,使用起來也比較的順手,結合微軟官方的教程進行了安卓 ...
  • 前言 QuestPDF 是一個開源 .NET 庫,用於生成 PDF 文檔。使用了C# Fluent API方式可簡化開發、減少錯誤並提高工作效率。利用它可以輕鬆生成 PDF 報告、發票、導出文件等。 項目介紹 QuestPDF 是一個革命性的開源 .NET 庫,它徹底改變了我們生成 PDF 文檔的方 ...
  • 項目地址 項目後端地址: https://github.com/ZyPLJ/ZYTteeHole 項目前端頁面地址: ZyPLJ/TreeHoleVue (github.com) https://github.com/ZyPLJ/TreeHoleVue 目前項目測試訪問地址: http://tree ...
  • 話不多說,直接開乾 一.下載 1.官方鏈接下載: https://www.microsoft.com/zh-cn/sql-server/sql-server-downloads 2.在下載目錄中找到下麵這個小的安裝包 SQL2022-SSEI-Dev.exe,運行開始下載SQL server; 二. ...
  • 前言 隨著物聯網(IoT)技術的迅猛發展,MQTT(消息隊列遙測傳輸)協議憑藉其輕量級和高效性,已成為眾多物聯網應用的首選通信標準。 MQTTnet 作為一個高性能的 .NET 開源庫,為 .NET 平臺上的 MQTT 客戶端與伺服器開發提供了強大的支持。 本文將全面介紹 MQTTnet 的核心功能 ...
  • Serilog支持多種接收器用於日誌存儲,增強器用於添加屬性,LogContext管理動態屬性,支持多種輸出格式包括純文本、JSON及ExpressionTemplate。還提供了自定義格式化選項,適用於不同需求。 ...
  • 目錄簡介獲取 HTML 文檔解析 HTML 文檔測試參考文章 簡介 動態內容網站使用 JavaScript 腳本動態檢索和渲染數據,爬取信息時需要模擬瀏覽器行為,否則獲取到的源碼基本是空的。 本文使用的爬取步驟如下: 使用 Selenium 獲取渲染後的 HTML 文檔 使用 HtmlAgility ...
  • 1.前言 什麼是熱更新 游戲或者軟體更新時,無需重新下載客戶端進行安裝,而是在應用程式啟動的情況下,在內部進行資源或者代碼更新 Unity目前常用熱更新解決方案 HybridCLR,Xlua,ILRuntime等 Unity目前常用資源管理解決方案 AssetBundles,Addressable, ...
  • 本文章主要是在C# ASP.NET Core Web API框架實現向手機發送驗證碼簡訊功能。這裡我選擇是一個互億無線簡訊驗證碼平臺,其實像阿裡雲,騰訊雲上面也可以。 首先我們先去 互億無線 https://www.ihuyi.com/api/sms.html 去註冊一個賬號 註冊完成賬號後,它會送 ...
  • 通過以下方式可以高效,並保證數據同步的可靠性 1.API設計 使用RESTful設計,確保API端點明確,並使用適當的HTTP方法(如POST用於創建,PUT用於更新)。 設計清晰的請求和響應模型,以確保客戶端能夠理解預期格式。 2.數據驗證 在伺服器端進行嚴格的數據驗證,確保接收到的數據符合預期格 ...