司空見慣的Http,訪問網頁,請求介面,可謂無處不在,那麼什麼是Http呢?這篇文章,會給大家做一個簡單的總結,雖然說,在開發中我們即便不去了解,也不會影響到我們,但對於常見的面試環節,這個不得不顯得尤為重要,知之總比不知強。

什麼是Http?

說白了,它是一個標準,比如你去做火車,需要憑藉火車票或有效證件才能去乘坐,那麼這就是標準,標準,是人制定的,需要按照它去執行的,要不然沒有這個標準,一個人有一個人的想法,這樣將會非常的混亂,同樣,我們的Http,它也是一個標準,一個協議,是網際網路上應用最為廣泛的一種網路傳輸協議,所有的WWW文件都必須遵守這個標準。英文全稱,HyperText Transfer Protocol,翻譯為:超文本傳輸協議,這個需要簡單的了解一下。

HTTP是一個基於TCP/IP通信協議來傳遞數據(HTML 文件, 圖片文件, 查詢結果等)。

HTTP是一個屬於應用層的面向對象的協議,由於其簡捷、快速的方式,適用於分散式超媒體信息系統。它於1990年提出,經過幾年的使用與發展,得到不斷地完善和擴展。目前在WWW中使用的是HTTP/1.0的第六版,HTTP/1.1的規範化工作正在進行之中,而且HTTP-NG(Next Generation of HTTP)的建議已經提出。

HTTP協議工作於客戶端-服務端架構為上。瀏覽器作為HTTP客戶端通過URL向HTTP服務端即WEB伺服器發送所有請求。Web伺服器根據接收到的請求後,向客戶端發送響應信息。

Http1.0和Http1.1:

HTTP1.0最早在網頁中使用是在1996年,那個時候只是使用一些較為簡單的網頁上和網路請求上,而HTTP1.1則在1999年才開始廣泛應用於現在的各大瀏覽器網路請求中,同時HTTP1.1也是當前使用最為廣泛的HTTP協議。 主要區別主要體現在:

緩存處理,在HTTP1.0中主要使用header里的If-Modified-Since,Expires來做為緩存判斷的標準,HTTP1.1則引入了更多的緩存控制策略例如Entity tag,If-Unmodified-Since, If-Match, If-None-Match等更多可供選擇的緩存頭來控制緩存策略。

帶寬優化及網路連接的使用,HTTP1.0中,存在一些浪費帶寬的現象,例如客戶端只是需要某個對象的一部分,而伺服器卻將整個對象送過來了,並且不支持斷點續傳功能,HTTP1.1則在請求頭引入了range頭域,它允許只請求資源的某個部分,即返回碼是206(Partial Content),這樣就方便了開發者自由的選擇以便於充分利用帶寬和連接。

錯誤通知的管理,在HTTP1.1中新增了24個錯誤狀態響應碼,如409(Conflict)表示請求的資源與資源的當前狀態發生衝突;410(Gone)表示伺服器上的某個資源被永久性的刪除。

Host頭處理,在HTTP1.0中認為每台伺服器都綁定一個唯一的IP地址,因此,請求消息中的URL並沒有傳遞主機名(hostname)。但隨著虛擬主機技術的發展,在一台物理伺服器上可以存在多個虛擬主機(Multi-homed Web Servers),並且它們共享一個IP地址。HTTP1.1的請求消息和響應消息都應支持Host頭域,且請求消息中如果沒有Host頭域會報告一個錯誤(400 Bad Request)。

長連接,HTTP 1.1支持長連接(PersistentConnection)和請求的流水線(Pipelining)處理,在一個TCP連接上可以傳送多個HTTP請求和響應,減少了建立和關閉連接的消耗和延遲,在HTTP1.1中默認開啟Connection: keep-alive,一定程度上彌補了HTTP1.0每次請求都要創建連接的缺點。

Http的主要特點:

1、簡單快速:客戶向伺服器請求服務時,只需傳送請求方法和路徑。請求方法常用的有GET、HEAD、POST。每種方法規定了客戶與伺服器聯繫的類型不同。由於HTTP協議簡單,使得HTTP伺服器的程序規模小,因而通信速度很快。

2、靈活:HTTP允許傳輸任意類型的數據對象。正在傳輸的類型由Content-Type加以標記。

3.無連接:無連接的含義是限制每次連接只處理一個請求。伺服器處理完客戶的請求,並收到客戶的應答後,即斷開連接。採用這種方式可以節省傳輸時間。

4.無狀態:HTTP協議是無狀態協議。無狀態是指協議對於事務處理沒有記憶能力。缺少狀態意味著如果後續處理需要前面的信息,則它必須重傳,這樣可能導致每次連接傳送的數據量增大。另一方面,在伺服器不需要先前信息時它的應答就較快。

5、支持B/S及C/S模式。

B/S及C/S模式【擴展】

C/S模式:

  C/S(Client/Server,客戶/伺服器)方式的網路計算模式,A、伺服器負責管理資料庫的訪問,並對客戶機/伺服器網路結構中的資料庫安全層加鎖,進行保護;B、客戶機負責與用戶的交互,收集用戶信息,通過網路向伺服器發送請求。C、C/S模式中,資源明顯不對等,是一種「胖客戶機(fat client)」或「瘦伺服器(thin server)」結構。D、客戶程序(前台程序)在客戶機上運行,資料庫服務程序(後台程序)在應用伺服器上運行。

B/S模式:

B/S(Browser/Server,瀏覽器/伺服器)方式的網路結構,A、客戶端統一採用瀏覽器如:Netscape和IE,通過Web瀏覽器向Web伺服器提出請求,由Web伺服器對資料庫進行操作,並將結果傳回客戶端。B、B/S結構簡化了客戶機的工作,但伺服器將擔負更多的工作,對資料庫的訪問和應用程序的執行都將在這裡完成。即當瀏覽器發出請求後,其數據請求、加工、返回結果、動態網頁生成等工作全部由Web伺服器完成。

Http之URL

HTTP使用統一資源標識符(Uniform Resource Identifiers, URI)來傳輸數據和建立連接。URL是一種特殊類型的URI,包含了用於查找某個資源的足夠的信息URL,全稱是UniformResourceLocator, 中文叫統一資源定位符,是互聯網上用來標識某一處資源的地址。

http://www.vipandroid.cn/cert/get_news_speak.php?open_id=100#name

從上面的URL可以看出,一個完整的URL包括以下幾部分:

1.協議部分:該URL的協議部分為「http:」,這代表網頁使用的是HTTP協議。在Internet中可以使用多種協議,如HTTP,FTP等等本例中使用的是HTTP協議。在"HTTP"後面的「//」為分隔符

2.域名部分:該URL的域名部分為「www.vipandroid.cn」。一個URL中,也可以使用IP地址作為域名使用

3.埠部分:跟在域名後面的是埠,域名和埠之間使用「:」作為分隔符。埠不是一個URL必須的部分,如果省略埠部分,將採用默認埠

4.虛擬目錄部分:從域名後的第一個「/」開始到最後一個「/」為止,是虛擬目錄部分。虛擬目錄也不是一個URL必須的部分。本例中的虛擬目錄是「/cert/」

5.文件名部分:從域名後的最後一個「/」開始到「?」為止,是文件名部分,如果沒有「?」,則是從域名後的最後一個「/」開始到「#」為止,是文件部分,如果沒有「?」和「#」,那麼從域名後的最後一個「/」開始到結束,都是文件名部分。本例中的文件名是「get_news_speak.php」。文件名部分也不是一個URL必須的部分,如果省略該部分,則使用默認的文件名

6.錨部分:從「#」開始到最後,都是錨部分。本例中的錨部分是「name」。錨部分也不是一個URL必須的部分

7.參數部分:從「?」開始到「#」為止之間的部分為參數部分,又稱搜索部分、查詢部分。本例中的參數部分為「open_id=100」。參數可以允許有多個參數,參數與參數之間用「&」作為分隔符。

URI與URL區別

很多人會混淆這兩個名詞。

URL:(Uniform/Universal Resource Locator 的縮寫,統一資源定位符)。

URI:(Uniform Resource Identifier 的縮寫,統一資源標識符)(代表一種標準)。

關係:

URI 屬於 URL 更高層次的抽象,一種字元串文本標準。

就是說,URI 屬於父類,而 URL 屬於 URI 的子類。URL 是 URI 的一個子集。

二者的區別在於,URI 表示請求伺服器的路徑,定義這麼一個資源。而 URL 同時說明要如何訪問這個資源(http://)。

URI 示例:

大家把瀏覽器地址欄里訪問網站的地址認為是URL就好了,也就是以HTTP/HTTPS開頭的URI子集。

埠與URL標準格式

何為埠?埠(Port),相當於一種數據的傳輸通道。用於接受某些數據,然後傳輸給相應的服務,而電腦將這些數據處理後,再將相應的回復通過開啟的埠傳給對方。

埠的作用:因為 IP 地址與網路服務的關係是一對多的關係。所以實際上網際網路上是通過 IP 地址加上埠號來區分不同的服務的。埠是通過埠號來標記的,埠號只有整數,範圍是從0 到65535。

URL標準格式

通常而言,我們所熟悉的 URL 的常見定義格式為:

scheme://host[:port#]/path/.../[;url-params][?query-string][#anchor]

scheme //有我們很熟悉的http、https、ftp以及著名的ed2k,迅雷的thunder等。

host //HTTP伺服器的IP地址或者域名

port# //HTTP伺服器的默認埠是80,這種情況下埠號可以省略。如果使用了別的埠,必須指明,例如tomcat的默認埠是8080 http://localhost:8080/path //訪問資源的路徑url-params //所帶參數query-string //發送給http伺服器的數據anchor //錨點定位

URN,uniform resource name,統一資源命名,是通過名字來標識資源,比如mailto:[email protected]

URI與URL的區別【總結】

URI(uniform resource identifier),意思是統一資源標識符,用於唯一的標識一個資源。

Web上可用的每種資源如HTML文檔、圖像、視頻等都是用URI來定位的。一個URI由三部分組成:

訪問資源的命名機制

存放資源的主機名資源自身名稱,由路徑表示

URL(uniform resource locator),意思是統一資源定位器,它是一種具體的URI。可以用來標識一個資源,而且還指明了如何鎖定這個資源。

URL是Internet上用來描述信息資源的字元串,主要用在各種WWW客戶程序和伺服器程序上。採用URL可以用一種統一的格式來描述各種信息資源,包括文件、伺服器的地址和目錄 。

一個URL由三部分組成:

協議

存有資源的主機IP地址(包含埠號)主機資源具體地址

請求方法

根據HTTP標準,HTTP請求可以使用多種請求方法。

HTTP1.0定義了三種請求方法: GET, POST 和 HEAD方法。

HTTP1.1新增了五種請求方法:OPTIONS, PUT, DELETE, TRACE 和 CONNECT 方法。

常見狀態碼

當瀏覽者訪問一個網頁時,瀏覽者的瀏覽器會向網頁所在伺服器發出請求。當瀏覽器接收並顯示網頁前,此網頁所在的伺服器會返回一個包含HTTP狀態碼的信息頭(server header)用以響應瀏覽器的請求。

HTTP狀態碼的英文為HTTP Status Code。

下面是常見的HTTP狀態碼:

200 - 請求成功

301 - 資源(網頁等)被永久轉移到其它URL

404 - 請求的資源(網頁等)不存在

500 - 內部伺服器錯誤

HTTP之請求消息Request

客戶端發送一個HTTP請求到伺服器的請求消息包括以下格式:

請求行(request line)、請求頭部(header)、空行和請求數據四個部分組成。

請求

請求行以一個方法符號開頭,以空格分開,後面跟著請求的URI和協議的版本。

Get請求例子,使用Charles抓取的request:

第一部分:請求行,用來說明請求類型,要訪問的資源以及所使用的HTTP版本.

GET說明請求類型為

GET /cert/get_news_speak.php?open_id=100 HTTP/1.1

為要訪問的資源,該行的最後一部分說明使用的是HTTP1.1版本。

第二部分:請求頭部,緊接著請求行(即第一行)之後的部分,用來說明伺服器要使用的附加信息

從第二行起為請求頭部,HOST將指出請求的目的地.User-Agent,伺服器端和客戶端腳本都能訪問它,它是瀏覽器類型檢測邏輯的重要基礎.該信息由你的瀏覽器來定義,並且在每個請求中自動發送等等

第三部分:空行,請求頭部後面的空行是必須的

即使第四部分的請求數據為空,也必須有空行。

第四部分:請求數據也叫主體,可以添加任意的其他數據。

這個例子的請求數據為空。

POST請求例子,使用Charles抓取的request:

第一部分:請求行,第一行明了是post請求,以及http1.1版本。

第二部分:請求頭部,第二行至第六行。第三部分:空行,第七行的空行。第四部分:請求數據,第八行。

HTTP之響應消息Response

一般情況下,伺服器接收並處理客戶端發過來的請求後會返回一個HTTP的響應消息。

HTTP響應也由四個部分組成,分別是:狀態行、消息報頭、空行和響應正文。

第一部分:狀態行,由HTTP協議版本號, 狀態碼, 狀態消息 三部分組成。

第一行為狀態行,(HTTP/1.1)表明HTTP版本為1.1版本,狀態碼為200,狀態消息為(ok)第二部分:消息報頭,用來說明客戶端要使用的一些附加信息第二行和第三行為消息報頭,Date:生成響應的日期和時間;Content-Type:指定了MIME類型的application/json,編碼類型是UTF-8第三部分:空行,消息報頭後面的空行是必須的第四部分:響應正文,伺服器返回給客戶端的文本信息。空行後面的html部分為響應正文。

GET和POST的區別

GET提交的數據會放在URL之後,以?分割URL和傳輸數據,參數之間以&相連,如EditPosts.aspx?name=test1&id=123456. POST方法是把提交的數據放在HTTP包的Body中.

GET提交的數據大小有限制(因為瀏覽器對URL的長度有限制),而POST方法提交的數據沒有限制.

GET方式需要使用Request.QueryString來取得變數的值,而POST方式通過Request.Form來獲取變數的值。

GET方式提交數據,會帶來安全問題,比如一個登錄頁面,通過GET方式提交數據時,用戶名和密碼將出現在URL上,如果頁面可以被緩存或者其他人可以訪問這台機器,就可以從歷史記錄獲得該用戶的賬號和密碼.

HTTP工作原理

HTTP協議定義Web客戶端如何從Web伺服器請求Web頁面,以及伺服器如何把Web頁面傳送給客戶端。HTTP協議採用了請求/響應模型。客戶端向伺服器發送一個請求報文,請求報文包含請求的方法、URL、協議版本、請求頭部和請求數據。伺服器以一個狀態行作為響應,響應的內容包括協議的版本、成功或者錯誤代碼、伺服器信息、響應頭部和響應數據。

以下是 HTTP 請求/響應的步驟:

1、客戶端連接到Web伺服器

一個HTTP客戶端,通常是瀏覽器,與Web伺服器的HTTP埠(默認為80)建立一個TCP套接字連接。例如,http://www.oakcms.cn。

2、發送HTTP請求

通過TCP套接字,客戶端向Web伺服器發送一個文本的請求報文,一個請求報文由請求行、請求頭部、空行和請求數據4部分組成。

3、伺服器接受請求並返回HTTP響應

Web伺服器解析請求,定位請求資源。伺服器將資源複本寫到TCP套接字,由客戶端讀取。一個響應由狀態行、響應頭部、空行和響應數據4部分組成。

4、釋放連接TCP連接

若connection 模式為close,則伺服器主動關閉TCP連接,客戶端被動關閉連接,釋放TCP連接;若connection 模式為keepalive,則該連接會保持一段時間,在該時間內可以繼續接收請求;

5、客戶端瀏覽器解析HTML內容

客戶端瀏覽器首先解析狀態行,查看錶明請求是否成功的狀態代碼。然後解析每一個響應頭,響應頭告知以下為若干位元組的HTML文檔和文檔的字符集。客戶端瀏覽器讀取響應數據HTML,根據HTML的語法對其進行格式化,並在瀏覽器窗口中顯示。

例如:在瀏覽器地址欄鍵入URL,按下回車之後會經歷以下流程:

1、瀏覽器向 DNS 伺服器請求解析該 URL 中的域名所對應的 IP 地址;

2、解析出 IP 地址後,根據該 IP 地址和默認埠 80,和伺服器建立TCP連接;

3、瀏覽器發出讀取文件(URL 中域名後面部分對應的文件)的HTTP 請求,該請求報文作為 TCP 三次握手的第三個報文的數據發送給伺服器;

4、伺服器對瀏覽器請求作出響應,並把對應的 html 文本發送給瀏覽器;

5、釋放 TCP連接;

6、瀏覽器將該 html 文本並顯示內容;

【補充】

常用的HTTP請求頭

常用的HTTP響應頭


推薦閱讀:
相关文章