資料庫設計

来源:http://www.cnblogs.com/fzw-/archive/2017/12/18/8060345.html
-Advertisement-
Play Games

1. 原始單據與實體之間的關係 === 可以是一對一、一對多、多對多的關係。在一般情況下,它們是一對一的關係:即一張原始單據對應且只對應一個實體。 在特殊情況下,它們可能是一對多或多對一的關係,即一張原始單證對應多個實體,或多張原始單證對應一個實體。 這裡的實體可以理解為基本表。明確這種對應關係後, ...


1. 原始單據與實體之間的關係

    可以是一對一、一對多、多對多的關係。在一般情況下,它們是一對一的關係:即一張原始單據對應且只對應一個實體。 
    在特殊情況下,它們可能是一對多或多對一的關係,即一張原始單證對應多個實體,或多張原始單證對應一個實體。 
    這裡的實體可以理解為基本表。明確這種對應關係後,對我們設計錄入界面大有好處。 
    〖例1〗:一份員工履歷資料,在人力資源信息系統中,就對應三個基本表:員工基本情況表、社會關係表、工作簡歷表。 
    這就是“一張原始單證對應多個實體”的典型例子。 

2. 主鍵與外鍵

    一般而言,一個實體不能既無主鍵又無外鍵。在E—R 圖中, 處於葉子部位的實體, 可以定義主鍵,也可以不定義主鍵 (因為它無子孫), 但必須要有外鍵(因為它有父親)。 
    主鍵與外鍵的設計,在全局資料庫的設計中,占有重要地位。當全局資料庫的設計完成以後,有個美國資料庫設計專 家說:“鍵,到處都是鍵,除了鍵之外,什麼也沒有”,這就是他的資料庫設計經驗之談,也反映了他對信息系統核 心(數據模型)的高度抽象思想。因為:主鍵是實體的高度抽象,主鍵與外鍵的配對,表示實體之間的連接。
    

3. 基本表的性質

    基本表與中間表、臨時表不同,因為它具有如下四個特性: 
    (1) 原子性。基本表中的欄位是不可再分解的。 
    (2) 原始性。基本表中的記錄是原始數據(基礎數據)的記錄
    (3) 演繹性。由基本表與代碼表中的數據,可以派生出所有的輸出數據。 
    (4) 穩定性。基本表的結構是相對穩定的,表中的記錄是要長期保存的。 
    理解基本表的性質後,在設計資料庫時,就能將基本表與中間表、臨時表區分開來。

4. 範式標準

    基本表及其欄位之間的關係, 應儘量滿足第三範式。但是,滿足第三範式的資料庫設計,往往不是最好的設計。 
    為了提高資料庫的運行效率,常常需要降低範式標準:適當增加冗餘,達到以空間換時間的目的。 
    〖例2〗:有一張存放商品的基本表,如表1所示。“金額”這個欄位的存在,表明該表的設計不滿足第三範式, 因為“金額”可以由“單價”乘以“數量”得到,說明“金額”是冗餘欄位。但是,增加“金額”這個冗餘欄位,可以提高查詢統計的速度,這就是以空間換時間的作法。 在Rose 2002中,規定列有兩種類型:數據列和計算列。“金額”這樣的列被稱為“計算列”,而“單價”和 “數量”這樣的列被稱為“數據列”。 
    表1 商品表的表結構 
    商品名稱 商品型號 單價    數量  金額 
    電視機     29吋     2,500   40  100,000 
    

5. 通俗地理解三個範式

    通俗地理解三個範式,對於資料庫設計大有好處。在資料庫設計中,為了更好地應用三個範式,就必須通俗地理解 
    三個範式(通俗地理解是夠用的理解,並不是最科學最準確的理解): 
    第一範式:1NF是對屬性的原子性約束,要求屬性具有原子性,不可再分解; 
    第二範式:2NF是對記錄的惟一性約束,要求記錄有惟一標識,即實體的惟一性; 
    第三範式:3NF是對欄位冗餘性的約束,即任何欄位不能由其他欄位派生出來,它要求欄位沒有冗餘。 
    沒有冗餘的資料庫設計可以做到。但是,沒有冗餘的資料庫未必是最好的資料庫,有時為了提高運行效率,就必須降 低範式標準,適當保留冗餘數據。具體做法是:在概念數據模型設計時遵守第三範式,降低範式標準的工作放到物理 數據模型設計時考慮。降低範式就是增加欄位,允許冗餘。 

6. 要善於識別與正確處理多對多的關係

    若兩個實體之間存在多對多的關係,則應消除這種關係。消除的辦法是,在兩者之間增加第三個實體。這樣,原來一個多對多的關係,現在變為兩個一對多的關係。要將原來兩個實體的屬性合理地分配到三個實體中去。這裡的第三個 實體,實質上是一個較複雜的關係,它對應一張基本表。一般來講,資料庫設計工具不能識別多對多的關係,但能處理多對多的關係。 
    〖例3〗:在“圖書館信息系統”中,“圖書”是一個實體,“讀者”也是一個實體。這兩個實體之間的關係,是一個典型的多對多關係:一本圖書在不同時間可以被多個讀者借閱,一個讀者又可以借多本圖書。為此,要在二者之間增加第三個實體,該實體取名為“借還書”,它的屬性為:借還時間、借還標誌(0表示借書,1表示還書),另外,它還應該有兩個外鍵(“圖書”的主鍵,“讀者”的主鍵),使它能與“圖書”和“讀者”連接。 

7.主鍵PK的取值方法

    PK是供程式員使用的表間連接工具,可以是一無物理意義的數字串, 由程式自動加1來實現。也可以是有物理意義的欄位名或欄位名的組合。不過前者比後者好。當PK是欄位名的組合時,建議欄位的個數不要太多,多了不但索引占用空間大,而且速度也慢。
    

8. 正確認識數據冗餘

    主鍵與外鍵在多表中的重覆出現, 不屬於數據冗餘,這個概念必須清楚,事實上有許多人還不清楚。非鍵欄位的重覆出現, 才是數據冗餘!而且是一種低級冗餘,即重覆性的冗餘。高級冗餘不是欄位的重覆出現,而是欄位的派生出現。 
    〖例4〗:商品中的“單價、數量、金額”三個欄位,“金額”就是由“單價”乘以“數量”派生出來的,它就是冗餘,而且是一種高級冗餘。冗餘的目的是為了提高處理速度。只有低級冗餘才會增加數據的不一致性,因為同一數據,可能從不同時間、地點、角色上多次錄入。因此,我們提倡高級冗餘(派生性冗餘),反對低級冗餘(重覆性冗餘)。  

9. E--R圖沒有標準答案

    信息系統的E--R圖沒有標準答案,因為它的設計與畫法不是惟一的,只要它覆蓋了系統需求的業務範圍和功能內容,就是可行的。反之要修改E--R圖。儘管它沒有惟一的標準答案,並不意味著可以隨意設計。好的E—R圖的標準是:
    結構清晰、關聯簡潔、實體個數適中、屬性分配合理、沒有低級冗餘。 

10.視圖技術在資料庫設計中很有用

    與基本表、代碼表、中間表不同,視圖是一種虛表,它依賴數據源的實表而存在。視圖是供程式員使用資料庫的一個視窗,是基表數據綜合的一種形式, 是數據處理的一種方法,是用戶數據保密的一種手段。為了進行複雜處理、提高運算速度和節省存儲空間, 視圖的定義深度一般不得超過三層。 若三層視圖仍不夠用, 則應在視圖上定義臨時表, 在臨時表上再定義視圖。這樣反覆交迭定義, 視圖的深度就不受限制了。 
    對於某些與國家政治、經濟、技術、軍事和安全利益有關的信息系統,視圖的作用更加重要。這些系統的基本表完成物理設計之後,立即在基本表上建立第一層視圖,這層視圖的個數和結構,與基本表的個數和結構是完全相同。並且規定,所有的程式員,一律只准在視圖上操作。只有資料庫管理員,帶著多個人員共同掌握的“安全鑰匙”,才能直接在基本表上操作。請讀者想想:這是為什麼? 

11.中間表、報表和臨時表

    中間表是存放統計數據的表,它是為數據倉庫、輸出報表或查詢結果而設計的,有時它沒有主鍵與外鍵(數據倉庫除外)。臨時表是程式員個人設計的,存放臨時記錄,為個人所用。基表和中間表由DBA維護,臨時表由程式員自己用程式自動維護。 

12.完整性約束表現在三個方面

    域的完整性:用Check來實現約束,在資料庫設計工具中,對欄位的取值範圍進行定義時,有一個Check按鈕,通過它定義欄位的值城。 
    參照完整性:用PK、FK、表級觸發器來實現。 
    用戶定義完整性:它是一些業務規則,用存儲過程和觸發器來實現。 

13.防止資料庫設計打補丁的方法是“三少原則”

    (1) 一個資料庫中表的個數越少越好。只有表的個數少了,才能說明系統的E--R圖少而精,去掉了重覆的多餘的實體,形成了對客觀世界的高度抽象,進行了系統的數據集成,防止了打補丁式的設計; 
    (2) 一個表中組合主鍵的欄位個數越少越好。因為主鍵的作用,一是建主鍵索引,二是做為子表的外鍵,所以組合主鍵的欄位個數少了,不僅節省了運行時間,而且節省了索引存儲空間; 
    (3) 一個表中的欄位個數越少越好。只有欄位的個數少了,才能說明在系統中不存在數據重覆,且很少有數據冗餘,更重要的是督促讀者會“列變行”,這樣就防止了將子表中的欄位拉入到主表中去,在主表中留下許多空餘的欄位。所謂“列變行”,就是將主表中的一部分內容拉出去,另外單獨建一個子表。這個方法很簡單,有的人就是不習慣、不採納、不執行。 


    資料庫設計的實用原則是:在數據冗餘和處理速度之間找到合適的平衡點。“三少”是一個整體概念,綜合觀點,不能孤立某一個原則。該原則是相對的,不是絕對的。“三多”原則肯定是錯誤的。試想:若覆蓋系統同樣的功 能,一百個實體(共一千個屬性) 的E--R圖,肯定比二百個實體(共二千個屬性) 的E--R圖,要好得多。 


    提倡“三少”原則,是叫讀者學會利用資料庫設計技術進行系統的數據集成。數據集成的步驟是將文件系統集成為應用資料庫,將應用資料庫集成為主題資料庫,將主題資料庫集成為全局綜合資料庫。集成的程度越高,數據 共用性就越強,信息孤島現象就越少,整個企業信息系統的全局E—R圖中實體的個數、主鍵的個數、屬性的個數就會越少。
    
     
    提倡“三少”原則的目的,是防止讀者利用打補丁技術,不斷地對資料庫進行增刪改,使企業資料庫變成了隨意設計資料庫表的“垃圾堆”,或資料庫表的“大雜院”,最後造成資料庫中的基本表、代碼表、中間表、臨時表雜亂無章,不計其數,導致企事業單位的信息系統無法維護而癱瘓。 

    “三多”原則任何人都可以做到,該原則是“打補丁方法”設計資料庫的歪理學說。“三少”原則是少而精的原則,它要求有較高的資料庫設計技巧與藝術,不是任何人都能做到的,因為該原則是杜絕用“打補丁方法”設計資料庫的理論依據。 

14.提高資料庫運行效率的辦法

    在給定的系統硬體和系統軟體條件下,提高資料庫系統的運行效率的辦法是:
    (1) 在資料庫物理設計時,降低範式,增加冗餘, 少用觸發器, 多用存儲過程。
    (2) 當計算非常複雜、而且記錄條數非常巨大時(例如一千萬條),複雜計算要先在資料庫外面,以文件系統方式用C++語言計算處理完成之後,最後才入庫追加到表中去。這是電信計費系統設計的經驗。
    (3) 發現某個表的記錄太多,例如超過一千萬條,則要對該表進行水平分割。水平分割的做法是,以該表主鍵PK的某個值為界線,將該表的記錄水平分割為兩個表。若發現某個表的欄位太多,例如超過八十個,則垂直分割該表,將原來的一個表分解為兩個表。
    (4) 對資料庫管理系統DBMS進行系統優化,即優化各種系統參數,如緩衝區個數。
    (5) 在使用面向數據的SQL語言進行程式設計時,儘量採取優化演算法。 
    總之,要提高資料庫的運行效率,必須從資料庫系統級優化、資料庫設計級優化、程式實現級優化,這三個層次上同時下功夫。 

  

    上述十四個技巧,是許多人在大量的資料庫分析與設計實踐中,逐步總結出來的。對於這些經驗的運用,讀者不能生幫硬套,死記硬背,而要消化理解,實事求是,靈活掌握。並逐步做到:在應用中發展,在發展中應用。

  

原文鏈接


您的分享是我們最大的動力!

-Advertisement-
Play Games
更多相關文章
  • 一、grep命令 grep(global search regular expression(RE) and print out the line,全面搜索正則表達式並把行列印出來)是一種強大的文本搜索工具,它能使用正則表達式搜索文本,並把匹配的行列印出來。 grep的工作方式是這樣的,它在一個或多 ...
  • 一、cp命令 Linux中的複製命令。 複製文件: 複製目錄: 二、mv命令 mv命令可以作為Linux中的剪切命令,也可以給文件或者文件夾重命名。 剪切文件: 剪切文件夾: 文件重命名: 文件夾重命名: 三、註意 cp文件夾時需要-r參數,mv文件夾時不需要-r參數。 ...
  • 電腦最重要的功能單元之一是Memory。Memory是眾多存儲單元的集合,為了使CPU準確地找到存儲有某個信息的存儲單元,必須為這些單元分配一個相互區別的“身份證號”,這個“身份證號”就是地址編碼。在嵌入式處理器內,集成了多種類型的Memory,通常,我們稱同一類型的Memory為一個Memory ...
  • 一、軟鏈接 相當於windows的快捷方式,當源文件不存在時,軟鏈接失效。 創建軟鏈接: 刪除源文件,軟鏈接失效: 二、硬鏈接 創建硬鏈接: 刪除源文件,硬鏈接仍然可用: 三、總結 鏈接是指向文件名,當指向的文件名字刪除的時候,就找不到源文件了。硬鏈接是指向文件本身,刪除一個文件名字,還是可以找到源 ...
  • 一、yum安裝 1.1 修改yum源 1.2 添加內核參數 預設配置下,在 CentOS 使用 Docker 可能會碰到下麵的這些警告信息: 1.3 添加內核配置參數以啟用這些功能 然後重新載入 sysctl.conf 即可 1.4 建立docker用戶 1.5 鏡像加速 對於使用 systemd  ...
  • 一、pwd命令 顯示整個路徑名: 二、cd命令 切換到其他路徑(相對路徑方式): 切換到其他路徑(絕對路徑方式): 三、根目錄 在linux中,'/'斜杠代表根目錄: 四、家目錄 在linux中,'~'波浪線代表家目錄: 五、上一次所在目錄: 在linux中,'-'橫杠快捷切換到上次所在的路徑: 六 ...
  • 一、ls命令 用於查看目錄下的文件信息。 ls 當前目錄下都有哪些文件: -l選項,顯示當前目錄下文件的詳細信息: -a選項,顯示當前目錄下所有文件,包括隱藏文件(名字以'.'開頭): -al選項,顯示當前目錄下所有文件的詳細信息: -alh,顯示當前目錄下所有文件的詳細信息,文件的大小易讀: 指定 ...
  • 前一篇博客關於SQL Server on Linux的安裝,地址:http://www.cnblogs.com/fishparadise/p/8057650.html,現在測試把Windows平臺下的一個資料庫遷移到Linux平臺下。 1. 環境 Windows: Microsoft SQL Ser ...
一周排行
    -Advertisement-
    Play Games
  • 示例項目結構 在 Visual Studio 中創建一個 WinForms 應用程式後,項目結構如下所示: MyWinFormsApp/ │ ├───Properties/ │ └───Settings.settings │ ├───bin/ │ ├───Debug/ │ └───Release/ ...
  • [STAThread] 特性用於需要與 COM 組件交互的應用程式,尤其是依賴單線程模型(如 Windows Forms 應用程式)的組件。在 STA 模式下,線程擁有自己的消息迴圈,這對於處理用戶界面和某些 COM 組件是必要的。 [STAThread] static void Main(stri ...
  • 在WinForm中使用全局異常捕獲處理 在WinForm應用程式中,全局異常捕獲是確保程式穩定性的關鍵。通過在Program類的Main方法中設置全局異常處理,可以有效地捕獲並處理未預見的異常,從而避免程式崩潰。 註冊全局異常事件 [STAThread] static void Main() { / ...
  • 前言 給大家推薦一款開源的 Winform 控制項庫,可以幫助我們開發更加美觀、漂亮的 WinForm 界面。 項目介紹 SunnyUI.NET 是一個基於 .NET Framework 4.0+、.NET 6、.NET 7 和 .NET 8 的 WinForm 開源控制項庫,同時也提供了工具類庫、擴展 ...
  • 說明 該文章是屬於OverallAuth2.0系列文章,每周更新一篇該系列文章(從0到1完成系統開發)。 該系統文章,我會儘量說的非常詳細,做到不管新手、老手都能看懂。 說明:OverallAuth2.0 是一個簡單、易懂、功能強大的許可權+可視化流程管理系統。 有興趣的朋友,請關註我吧(*^▽^*) ...
  • 一、下載安裝 1.下載git 必須先下載並安裝git,再TortoiseGit下載安裝 git安裝參考教程:https://blog.csdn.net/mukes/article/details/115693833 2.TortoiseGit下載與安裝 TortoiseGit,Git客戶端,32/6 ...
  • 前言 在項目開發過程中,理解數據結構和演算法如同掌握蓋房子的秘訣。演算法不僅能幫助我們編寫高效、優質的代碼,還能解決項目中遇到的各種難題。 給大家推薦一個支持C#的開源免費、新手友好的數據結構與演算法入門教程:Hello演算法。 項目介紹 《Hello Algo》是一本開源免費、新手友好的數據結構與演算法入門 ...
  • 1.生成單個Proto.bat內容 @rem Copyright 2016, Google Inc. @rem All rights reserved. @rem @rem Redistribution and use in source and binary forms, with or with ...
  • 一:背景 1. 講故事 前段時間有位朋友找到我,說他的窗體程式在客戶這邊出現了卡死,讓我幫忙看下怎麼回事?dump也生成了,既然有dump了那就上 windbg 分析吧。 二:WinDbg 分析 1. 為什麼會卡死 窗體程式的卡死,入口門檻很低,後續往下分析就不一定了,不管怎麼說先用 !clrsta ...
  • 前言 人工智慧時代,人臉識別技術已成為安全驗證、身份識別和用戶交互的關鍵工具。 給大家推薦一款.NET 開源提供了強大的人臉識別 API,工具不僅易於集成,還具備高效處理能力。 本文將介紹一款如何利用這些API,為我們的項目添加智能識別的亮點。 項目介紹 GitHub 上擁有 1.2k 星標的 C# ...