1. 程式人生 > >如何更好的優化MySQL數據庫

如何更好的優化MySQL數據庫

空間 技術 經典 數據庫優化 郵政編碼


1、選取最適用的字段屬性

MySQL可以很好的支持大數據量的存取,但是一般說來,數據庫中的表越小,在它上面執行的查詢也就會越快

因此,在創建表的時候,為了獲得更好的性能,我們可以將表中字段的寬度設得盡可能小。


例如,在定義郵政編碼這個字段時,如果將其設置為CHAR(255),顯然給數據庫增加了不必要的空間

甚至使用VARCHAR這種類型也是多余的,因為CHAR(6)就可以很好的完成任務了

同樣的,如果可以的話,我們應該使用MEDIUMINT而不是BIGIN來定義整型字段


另外一個提高效率的方法是在可能的情況下,應該盡量把字段設置為NOTNULL,這樣在將來執行查詢的時候,數據庫不用去比較NULL值。對於某些文本字段,例如“省份”或者“性別”,我們可以將它們定義為ENUM類型。因為在MySQL中,ENUM類型被當作數值型數據來處理,而數值型數據被處理起來的速度要比文本類型快得多

這樣,我們又可以提高數據庫的性能。

2、使用連接(JOIN)來代替子查詢(Sub-Queries)

MySQL從4.1開始支持SQL的子查詢。這個技術可以使用SELECT語句來創建一個單列的查詢結果,然後把這個結果作為過濾條件用在另一個查詢中。例如,我們要將客戶基本信息表中沒有任何訂單的客戶刪除掉,就可以利用子查詢先從銷售信息表中將所有發出訂單的客戶ID取出來,然後將結果傳遞給主查詢,如下所示:


DELETEFROMcustomerinfo

WHERECustomerIDNOTin(SELECTCustomerIDFROMsalesinfo)


使用子查詢可以一次性的完成很多邏輯上需要多個步驟才能完成的SQL操作,同時也可以避免事務或者表鎖死

並且寫起來也很容易。但是,有些情況下,子查詢可以被更有效率的連接(JOIN)..替代

例如,假設我們要將所有沒有訂單記錄的用戶取出來,可以用下面這個查詢完成:


SELECT*FROMcustomerinfo

WHERECustomerIDNOTin(SELECTCustomerIDFROMsalesinfo)


如果使用連接(JOIN)..來完成這個查詢工作,速度將會快很多

尤其是當salesinfo表中對CustomerID建有索引的話,性能將會更好,查詢如下:


SELECT*FROMcustomerinfo

LEFTJOINsalesinfoONcustomerinfo.CustomerID=salesinfo.CustomerID

WHEREsalesinfo.CustomerIDISNULL


連接(JOIN)..之所以更有效率一些

是因為MySQL不需要在內存中創建臨時表來完成這個邏輯上的需要兩個步驟的查詢工作。

3、使用聯合(UNION)來代替手動創建的臨時表

MySQL從4.0的版本開始支持union查詢,它可以把需要使用臨時表的兩條或更多的select查詢合並的一個查詢中。在客戶端的查詢會話結束的時候,臨時表會被自動刪除,從而保證數據庫整齊、高效。使用union來創建查詢的時候,我們只需要用UNION作為關鍵字把多個select語句連接起來就可以了,要註意的是所有select語句中的字段數目要想同

下面的例子就演示了一個使用UNION的查詢


SELECTName,PhoneFROMclientUNION

SELECTName,BirthDateFROMauthorUNION

SELECTName,SupplierFROMproduct

4、事務

盡管我們可以使用子查詢(Sub-Queries)、連接(JOIN)和聯合(UNION)來創建各種各樣的查詢,但不是所有的數據庫操作都可以只用一條或少數幾條SQL語句就可以完成的。更多的時候是需要用到一系列的語句來完成某種工作。但是在這種情況下,當這個語句塊中的某一條語句運行出錯的時候,整個語句塊的操作就會變得不確定起來。設想一下,要把某個數據同時插入兩個相關聯的表中,可能會出現這樣的情況:第一個表中成功更新後,數據庫突然出現意外狀況,造成第二個表中的操作沒有完成,這樣,就會造成數據的不完整,甚至會破壞數據庫中的數據。要避免這種情況,就應該使用事務,它的作用是:要麽語句塊中每條語句都操作成功,要麽都失敗。換句話說,就是可以保持數據庫中數據的一致性和完整性。事物以BEGIN關鍵字開始,COMMIT關鍵字結束。在這之間的一條SQL操作失敗

那麽,ROLLBACK命令就可以把數據庫恢復到BEGIN開始之前的狀態


BEGIN; INSERTINTOsalesinfoSETCustomerID=14;UPDATEinventorySETQuantity=11WHEREitem=‘book‘;COMMIT;

事務的另一個重要作用是當多個用戶同時使用相同的數據源時

它可以利用鎖定數據庫的方法來為用戶提供一種安全的訪問方式,這樣可以保證用戶的操作不被其它的用戶所幹擾。

5、鎖定表

盡管事務是維護數據庫完整性的一個非常好的方法,但卻因為它的獨占性,有時會影響數據庫的性能,尤其是在很大的應用系統中。由於在事務執行的過程中,數據庫將會被鎖定,因此其它的用戶請求只能暫時等待直到該事務結束。如果一個數據庫系統只有少數幾個用戶來使用,事務造成的影響不會成為一個太大的問題;但假設有成千上萬的用戶同時訪問一個數據庫系統,例如訪問一個電子商務網站,就會產生比較嚴重的響應延遲。


其實,有些情況下我們可以通過鎖定表的方法來獲得更好的性能

下面的例子就用鎖定表的方法來完成前面一個例子中事務的功能

LOCKTABLEinventoryWRITESELECTQuantityFROMinventoryWHEREItem=‘book‘;

...

UPDATEinventorySETQuantity=11WHEREItem=‘book‘;UNLOCKTABLES

這裏,我們用一個select語句取出初始數據,通過一些計算,用update語句將新值更新到表中

包含有WRITE關鍵字的LOCKTABLE語句可以保證在UNLOCKTABLES命令被執行之前

不會有其它的訪問來對inventory進行插入、更新或者刪除的操作

6、使用外鍵

鎖定表的方法可以維護數據的完整性,但是它卻不能保證數據的關聯性。這個時候我們就可以使用外鍵。

例如,外鍵可以保證每一條銷售記錄都指向某一個存在的客戶

在這裏,外鍵可以把customerinfo表中的CustomerID映射到salesinfo表中CustomerID

任何一條沒有合法CustomerID的記錄都不會被更新或插入到salesinfo中


CREATETABLEcustomerinfo( CustomerIDINTNOTNULL,PRIMARYKEY(CustomerID))TYPE=INNODB;CREATETABLEsalesinfo( SalesIDINTNOTNULL,CustomerIDINTNOTNULL,

PRIMARYKEY(CustomerID,SalesID),

FOREIGNKEY(CustomerID)REFERENCEScustomerinfo(CustomerID)ONDELETECASCADE)TYPE=INNODB;


註意例子中的參數“ONDELETECASCADE”。該參數保證當customerinfo表中的一條客戶記錄被刪除的時候

salesinfo表中所有與該客戶相關的記錄也會被自動刪除。如果要在MySQL中使用外鍵

一定要記住在創建表的時候將表的類型定義為事務安全表InnoDB類型

該類型不是MySQL表的默認類型

定義的方法是在CREATETABLE語句中加上TYPE=INNODB

7、使用索引

索引是提高數據庫性能的常用方法,它可以令數據庫服務器以比沒有索引快得多的速度檢索特定的行

尤其是在查詢語句當中包含有MAX(),MIN()和ORDERBY這些命令的時候,性能提高更為明顯。


那該對哪些字段建立索引呢?

一般說來,索引應建立在那些將用於JOIN,WHERE判斷和ORDERBY排序的字段上

盡量不要對數據庫中某個含有大量重復的值的字段建立索引

對於一個ENUM類型的字段來說,出現大量重復值是很有可能的情況


例如customerinfo中的“province”..字段,在這樣的字段上建立索引將不會有什麽幫助;相反,還有可能降低數據庫的性能。我們在創建表的時候可以同時創建合適的索引,也可以使用ALTERTABLE或CREATEINDEX在以後創建索引。此外,MySQL從版本3.23.23開始支持全文索引和搜索。全文索引在MySQL中是一個FULLTEXT類型索引,但僅能用於MyISAM類型的表。對於一個大的數據庫,將數據裝載到一個沒有FULLTEXT索引的表中,然後再使用ALTERTABLE或CREATEINDEX創建索引,將是非常快的。如果將數據裝載到一個已經有FULLTEXT索引的表中,執行過程將會非常慢

8、優化的查詢語句

絕大多數情況下,使用索引可以提高查詢的速度

但如果SQL語句使用不恰當的話,索引將無法發揮它應有的作用。

下面是應該註意的幾個方面。


首先,最好是在相同類型的字段間進行比較的操作

在MySQL3.23版之前,這甚至是一個必須的條件

例如不能將一個建有索引的INT字段和BIGINT字段進行比較,但是作為特殊的情況

在CHAR類型的字段和VARCHAR類型字段的字段大小相同的時候,可以將它們進行比較


其次,在建有索引的字段上盡量不要使用函數進行操作。

例如,在一個DATE類型的字段上使用YEAE()函數時,將會使索引不能發揮應有的作用

所以,下面的兩個查詢雖然返回的結果一樣,但後者要比前者快得多。


第三,在搜索字符型字段時,我們有時會使用LIKE關鍵字和通配符

這種做法雖然簡單,但卻也是以犧牲系統性能為代價的


例如下面的查詢將會比較表中的每一條記錄。

SELECT*FROMbooks

WHEREnamelike"MySQL%"


但是如果換用下面的查詢,返回的結果一樣,但速度就要快上很多:

SELECT*FROMbooks

WHEREname>="MySQL"andname<"MySQM"


最後,應該註意避免在查詢中讓MySQL進行自動類型轉換,因為轉換過程也會使索引變得不起作用。


1. 優化你的MySQL查詢緩存


在MySQL服務器上進行查詢,可以啟用高速查詢緩存。讓數據庫引擎在後臺悄悄的處理是提高性能的最有效方法之一

當同一個查詢被執行多次時,如果結果是從緩存中提取,那是相當快的。但主要的問題是,它是那麽容易被隱藏起來

以至於我們大多數程序員會忽略它。在有些處理任務中,我們實際上是可以阻止查詢緩存工作的


1. // query cache does NOT work
2. $r = mysql_query("SELECT username FROM user WHERE signup_date >= CURDATE()");
3.
4. // query cache works!
5. $today = date("Y-m-d");
6. $r = mysql_query("SELECT username FROM user WHERE signup_date >= ‘$today‘");
7.
8. // query cache does NOT work
9. $r = mysql_query("SELECT username FROM user WHERE signup_date >= CURDATE()");
10.
11. // query cache works!
12. $today = date("Y-m-d");
13. $r = mysql_query("SELECT username FROM user WHERE signup_date >= ‘$today‘");


2. 用EXPLAIN使你的SELECT查詢更加清晰


使用EXPLAIN關鍵字是另一個MySQL優化技巧,可以讓你了解MySQL正在進行什麽樣的查詢操作

這可以幫助你發現瓶頸的所在,並顯示出查詢或表結構在哪裏出了問題。
EXPLAIN查詢的結果,可以告訴你那些索引正在被引用,表是如何被掃描和排序的等等。
實現一個SELECT查詢(最好是比較復雜的一個,帶joins方式的),在裏面添加上你的關鍵詞解釋

在這裏我們可以使用phpMyAdmin,他會告訴你表中的結果。舉例來說,假如當我在執行joins時

正忘記往一個索引中添加列,EXPLAIN能幫助我找到問題的所在

添加索引到group_id field後


技術分享


3. 利用LIMIT 1取得唯一行


有時,當你要查詢一張表是,你知道自己只需要看一行。你可能會去的一條十分獨特的記錄

或者只是剛好檢查了任何存在的記錄數,他們都滿足了你的WHERE子句。
在這種情況下,增加一個LIMIT 1會令你的查詢更加有效

這樣數據庫引擎發現只有1後將停止掃描,而不是去掃描整個表或索引。


1. // do I have any users from Alabama?
2. // what NOT to do:
3. $r = mysql_query("SELECT * FROM user WHERE state = ‘Alabama‘");
4. if (mysql_num_rows($r) > 0) {
5. // ...
6. }
7. // much better:
8. $r = mysql_query("SELECT 1 FROM user WHERE state = ‘Alabama‘ LIMIT 1");
9. if (mysql_num_rows($r) > 0) {
10. // ...
11. }


4. 索引中的檢索字段


索引不僅是主鍵或唯一鍵。如果你想搜索表中的任何列,你應該一直指向索引

技術分享


5. 保證連接的索引是相同的類型


如果應用程序中包含多個連接查詢,你需要確保你鏈接的列在兩邊的表上都被索引

這會影響MySQL如何優化內部聯接操作。此外,加入的列,必須是同一類型

例如,你加入一個DECIMAL列,而同時加入另一個表中的int列

MySQL將無法使用其中至少一個指標。即使字符編碼必須同為字符串類型。


1. // looking for companies in my state
2. $r = mysql_query("SELECT company_name FROM users
3. LEFT JOIN companies ON (users.state = companies.state)
4. WHERE users.id = $user_id");
5.
6. // both state columns should be indexed
7. // and they both should be the same type and character encoding
8. // or MySQL might do full table scans


6. 不要使用BY RAND()命令


這是一個令很多新手程序員會掉進去的陷阱。你可能不知不覺中制造了一個可怕的平靜

這個陷阱在你是用BY RAND()命令時就開始創建了。
如果您真的需要隨機顯示你的結果,有很多更好的途徑去實現

誠然這需要寫更多的代碼,但是能避免性能瓶頸的出現

問題在於,MySQL可能會為表中每一個獨立的行執行BY RAND()命令

(這會消耗處理器的處理能力),然後給你僅僅返回一行。


1. // what NOT to do:
2. $r = mysql_query("SELECT username FROM user ORDER BY RAND() LIMIT 1");
3. // much better:
4. $r = mysql_query("SELECT count(*) FROM user");
5. $d = mysql_fetch_row($r);
6. $rand = mt_rand(0,$d[0] - 1);
7.
8. $r = mysql_query("SELECT username FROM user LIMIT $rand, 1");


7. 盡量避免SELECT *命令


從表中讀取越多的數據,查詢會變得更慢。他增加了磁盤需要操作的時間

還是在數據庫服務器與WEB服務器是獨立分開的情況下

你將會經歷非常漫長的網絡延遲,僅僅是因為數據不必要的在服務器之間傳輸。
始終指定你需要的列,這是一個非常良好的習慣。


1. // not preferred
2. $r = mysql_query("SELECT * FROM user WHERE user_id = 1");
3. $d = mysql_fetch_assoc($r);
4. echo "Welcome {$d[‘username‘]}";
5. // better:
6. $r = mysql_query("SELECT username FROM user WHERE user_id = 1");
7. $d = mysql_fetch_assoc($r);
8. echo "Welcome {$d[‘username‘]}";
9. // the differences are more significant with bigger result sets


8. 從PROCEDURE ANALYSE()中獲得建議


PROCEDURE ANALYSE()可讓MySQL的柱結構分析和表中的實際數據來給你一些建議

如果你的表中已經存在實際數據了,能為你的重大決策服務。
技術分享


9. 準備好的語句


準備好的語句,可以從性能優化和安全兩方面對大家有所幫助。
準備好的語句在過濾已經綁定的變量默認情況下,能給應用程序以有效的保護,防止SQL註入攻擊

當然你也可以手動過濾,不過由於大多數程序員健忘的性格,很難達到效果。


1. // create a prepared statement
2. if ($stmt = $mysqli->prepare("SELECT username FROM user WHERE state=?")) {
3. // bind parameters
4. $stmt->bind_param("s", $state);
5. // execute
6. $stmt->execute();
7. // bind result variables
8. $stmt->bind_result($username);
9. // fetch value
10. $stmt->fetch();
11. printf("%s is from %s\n", $username, $state);
12. $stmt->close();
13. }


10. 將IP地址存儲為無符號整型


許多程序員在創建一個VARCHAR(15)時並沒有意識到他們可以將IP地址以整數形式來存儲

當你有一個INT類型時,你只占用4個字節的空間,這是一個固定大小的領域。


你必須確定你所操作的列是一個UNSIGNED INT類型的,因為IP地址將使用32位unsigned integer

$r = "UPDATE users SET ip = INET_ATON(‘{$_SERVER[‘REMOTE_ADDR‘]}‘) WHERE user_id = $user_id";


如何更好的優化MySQL數據庫