主頁 > 企業開發 > 細說瀏覽器輸入URL后發生了什么

細說瀏覽器輸入URL后發生了什么

2020-10-03 15:01:45 企業開發

總體概覽

大體上,可以分為六步,當然每一步都可以詳細展開來說,這里先放一張總覽圖:
GitHub

DNS域名決議

在網路世界,你肯定記得住網站的名稱,但是很難記住網站的 IP 地址,因而也需要一個地址簿,就是 DNS 服務器,DNS 服務器是高可用、高并發和分布式的,它是樹狀結構,如圖:
GitHub

  • 根 DNS 服務器 :回傳頂級域 DNS 服務器的 IP 地址
  • 頂級域 DNS 服務器:回傳權威 DNS 服務器的 IP 地址
  • 權威 DNS 服務器 :回傳相應主機的 IP 地址

DNS的域名查找,在客戶端和瀏覽器,本地DNS之間的查詢方式是遞回查詢;在本地DNS服務器與根域及其子域之間的查詢方式是迭代查詢;

遞回程序:
GitHub

在客戶端輸入 URL 后,會有一個遞回查找的程序,從瀏覽器快取中查找->本地的hosts檔案查找->找本地DNS決議器快取查找->本地DNS服務器查找,這個程序中任何一步找到了都會結束查找流程,

如果本地DNS服務器無法查詢到,則根據本地DNS服務器設定的轉發器進行查詢,若未用轉發模式,則迭代查找程序如下圖:
GitHub

結合起來的程序,可以用一個圖表示:
GitHub
在查找程序中,有以下優化點:

  • DNS存在著多級快取,從離瀏覽器的距離排序的話,有以下幾種: 瀏覽器快取,系統快取,路由器快取,IPS服務器快取,根域名服務器快取,頂級域名服務器快取,主域名服務器快取,
  • 在域名和 IP 的映射程序中,給了應用基于域名做負載均衡的機會,可以是簡單的負載均衡,也可以根據地址和運營商做全域的負載均衡,

建立TCP連接

首先,判斷是不是https的,如果是,則HTTPS其實是HTTP + SSL / TLS 兩部分組成,也就是在HTTP上又加了一層處理加密資訊的模塊,服務端和客戶端的資訊傳輸都會通過TLS進行加密,所以傳輸的資料都是加密后的資料,

進行三次握手,建立TCP連接,

  1. 第一次握手:建立連接,客戶端發送連接請求報文段,將SYN位置為1,Sequence Number為x;然后,客戶端進入SYN_SEND狀態,等待服務器的確認;

  2. 第二次握手:服務器收到SYN報文段,服務器收到客戶端的SYN報文段,需要對這個SYN報文段進行確認,設定Acknowledgment Number為x+1(Sequence Number+1);同時,自己還要發送SYN請求資訊,將SYN位置為1,Sequence Number為y;服務器端將上述所有資訊放到一個報文段(即SYN+ACK報文段)中,一并發送給客戶端,此時服務器進入SYN_RECV狀態;

  3. 第三次握手:客戶端收到服務器的SYN+ACK報文段,然后將Acknowledgment Number設定為y+1,向服務器發送ACK報文段,這個報文段發送完畢以后,客戶端和服務器端都進入ESTABLISHED狀態,完成TCP三次握手,

SSL握手程序

  1. 第一階段 建立安全能力 包括協議版本 會話Id 密碼構件 壓縮方法和初始亂數
  2. 第二階段 服務器發送證書 密鑰交換資料和證書請求,最后發送請求-相應階段的結束信號
  3. 第三階段 如果有證書請求客戶端發送此證書 之后客戶端發送密鑰交換資料 也可以發送證書驗證訊息
  4. 第四階段 變更密碼構件和結束握手協議

完成了之后,客戶端和服務器端就可以開始傳送資料,更多 HTTPS 的資料可以看這里:

  • https://zhuanlan.zhihu.com/p/26682342
  • https://segmentfault.com/a/1190000012196642

備注

ACK:此標志表示應答域有效,就是說前面所說的TCP應答號將會包含在TCP資料包中;有兩個取值:0和1,為1的時候表示應答域有效,反之為0,TCP協議規定,只有ACK=1時有效,也規定連接建立后所有發送的報文的ACK必須為1,

SYN(SYNchronization):在連接建立時用來同步序號,當SYN=1而ACK=0時,表明這是一個連接請求報文,對方若同意建立連接,則應在回應報文中使SYN=1和ACK=1. 因此, SYN置1就表示這是一個連接請求或連接接受報文,

FIN(finis)即完,終結的意思, 用來釋放一個連接,當 FIN = 1 時,表明此報文段的發送方的資料已經發送完畢,并要求釋放連接,

發送HTTP請求,服務器處理請求,回傳回應結果

TCP連接建立后,瀏覽器就可以利用HTTP/HTTPS協議向服務器發送請求了,服務器接受到請求,就決議請求頭,如果頭部有快取相關資訊如if-none-match與if-modified-since,則驗證快取是否有效,若有效則回傳狀態碼為304,若無效則重新回傳資源,狀態碼為200.

這里有發生的一個程序是HTTP快取,是一個常考的考點,大致程序如圖:
GitHub
其程序,比較多內容,可以參考我的這篇文章《瀏覽器相關原理(面試題)詳細總結一》,這里我就不詳細說了~

關閉TCP連接

  1. 第一次分手:主機1(可以使客戶端,也可以是服務器端),設定Sequence Number和Acknowledgment Number,向主機2發送一個FIN報文段;此時,主機1進入FIN_WAIT_1狀態;這表示主機1沒有資料要發送給主機2了;

  2. 第二次分手:主機2收到了主機1發送的FIN報文段,向主機1回一個ACK報文段,Acknowledgment Number為Sequence Number加1;主機1進入FIN_WAIT_2狀態;主機2告訴主機1,我"同意"你的關閉請求;

  3. 第三次分手:主機2向主機1發送FIN報文段,請求關閉連接,同時主機2進入LAST_ACK狀態;

  4. 第四次分手:主機1收到主機2發送的FIN報文段,向主機2發送ACK報文段,然后主機1進入TIME_WAIT狀態;主機2收到主機1的ACK報文段以后,就關閉連接;此時,主機1等待2MSL后依然沒有收到回復,則證明Server端已正常關閉,那好,主機1也可以關閉連接了,

瀏覽器渲染

按照渲染的時間順序,流水線可分為如下幾個子階段:構建 DOM 樹、樣式計算、布局階段、分層、柵格化和顯示,如圖:
GitHub

  1. 渲染行程將 HTML 內容轉換為能夠讀懂DOM 樹結構,
  2. 渲染引擎將 CSS 樣式表轉化為瀏覽器可以理解的styleSheets,計算出 DOM 節點的樣式,
  3. 創建布局樹,并計算元素的布局資訊,
  4. 對布局樹進行分層,并生成分層樹,
  5. 為每個圖層生成繪制串列,并將其提交到合成執行緒,合成執行緒將圖層分圖塊,并柵格化將圖塊轉換成位圖,
  6. 合成執行緒發送繪制圖塊命令給瀏覽器行程,瀏覽器行程根據指令生成頁面,并顯示到顯示幕上,

構建 DOM 樹

瀏覽器從網路或硬碟中獲得HTML位元組資料后會經過一個流程將位元組決議為DOM樹,先將HTML的原始位元組資料轉換為檔案指定編碼的字符,然后瀏覽器會根據HTML規范來將字串轉換成各種令牌標簽,如html、body等,最終決議成一個樹狀的物件模型,就是dom樹,
GitHub

具體步驟:

  1. 轉碼(Bytes -> Characters)—— 讀取接收到的 HTML 二進制資料,按指定編碼格式將位元組轉換為 HTML 字串
  2. Tokens 化(Characters -> Tokens)—— 決議 HTML,將 HTML 字串轉換為結構清晰的 Tokens,每個 Token 都有特殊的含義同時有自己的一套規則
  3. 構建 Nodes(Tokens -> Nodes)—— 每個 Node 都添加特定的屬性(或屬性訪問器),通過指標能夠確定 Node 的父、子、兄弟關系和所屬 treeScope(例如:iframe 的 treeScope 與外層頁面的 treeScope 不同)
  4. 構建 DOM 樹(Nodes -> DOM Tree)—— 最重要的作業是建立起每個結點的父子兄弟關系

樣式計算

渲染引擎將 CSS 樣式表轉化為瀏覽器可以理解的 styleSheets,計算出 DOM 節點的樣式,

CSS 樣式來源主要有 3 種,分別是通過 link 參考的外部 CSS 檔案、style標簽內的 CSS、元素的 style 屬性內嵌的 CSS,,其樣式計算程序主要為:
GitHub
可以看到上面的 CSS 文本中有很多屬性值,如 2em、blue、bold,這些型別數值不容易被渲染引擎理解,所以需要將所有值轉換為渲染引擎容易理解的、標準化的計算值,這個程序就是屬性值標準化,處理完成后再處理樣式的繼承和層疊,有些文章將這個程序稱為CSSOM的構建程序,

頁面布局

布局程序,即排除 script、meta 等功能化、非視覺節點,排除 display: none 的節點,計算元素的位置資訊,確定元素的位置,構建一棵只包含可見元素布局樹,如圖:
GitHub
其中,這個程序需要注意的是回流和重繪,關于回流和重繪,詳細的可以看我另一篇文章《瀏覽器相關原理(面試題)詳細總結二》,這里就不說了~

生成分層樹

頁面中有很多復雜的效果,如一些復雜的 3D 變換、頁面滾動,或者使用 z-indexing 做 z 軸排序等,為了更加方便地實作這些效果,渲染引擎還需要為特定的節點生成專用的圖層,并生成一棵對應的圖層樹(LayerTree),如圖:
GitHub
如果你熟悉 PS,相信你會很容易理解圖層的概念,正是這些圖層疊加在一起構成了最終的頁面影像,在瀏覽器中,你可以打開 Chrome 的"開發者工具",選擇"Layers"標簽,渲染引擎給頁面分了很多圖層,這些圖層按照一定順序疊加在一起,就形成了最終的頁面,

并不是布局樹的每個節點都包含一個圖層,如果一個節點沒有對應的層,那么這個節點就從屬于父節點的圖層,那么需要滿足什么條件,渲染引擎才會為特定的節點創建新的層呢?詳細的可以看我另一篇文章《瀏覽器相關原理(面試題)詳細總結二》,這里就不說了~

柵格化

合成執行緒會按照視口附近的圖塊來優先生成位圖,實際生成位圖的操作是由柵格化來執行的,所謂柵格化,是指將圖塊轉換為位圖,如圖:

GitHub

通常一個頁面可能很大,但是用戶只能看到其中的一部分,我們把用戶可以看到的這個部分叫做視口(viewport),在有些情況下,有的圖層可以很大,比如有的頁面你使用滾動條要滾動好久才能滾動到底部,但是通過視口,用戶只能看到頁面的很小一部分,所以在這種情況下,要繪制出所有圖層內容的話,就會產生太大的開銷,而且也沒有必要,

顯示

最后,合成執行緒發送繪制圖塊命令給瀏覽器行程,瀏覽器行程根據指令生成頁面,并顯示到顯示幕上,渲染程序完成,

參考資料

  • 極客時間《趣談網路協議》
  • 極客時間《瀏覽器作業原理與實踐》

最后

  • 歡迎加我微信(winty230),拉你進技術群,長期交流學習...
  • 歡迎關注「前端Q」,認真學前端,做個有專業的技術人...

GitHub

轉載請註明出處,本文鏈接:https://www.uj5u.com/qiye/151755.html

標籤:JavaScript

上一篇:基于云開發開發 Web 應用(一):專案介紹 & 初始化

下一篇:釘釘開放與商業化團隊前端大量招人

標籤雲
其他(157675) Python(38076) JavaScript(25376) Java(17977) C(15215) 區塊鏈(8255) C#(7972) AI(7469) 爪哇(7425) MySQL(7132) html(6777) 基礎類(6313) sql(6102) 熊猫(6058) PHP(5869) 数组(5741) R(5409) Linux(5327) 反应(5209) 腳本語言(PerlPython)(5129) 非技術區(4971) Android(4554) 数据框(4311) css(4259) 节点.js(4032) C語言(3288) json(3245) 列表(3129) 扑(3119) C++語言(3117) 安卓(2998) 打字稿(2995) VBA(2789) Java相關(2746) 疑難問題(2699) 细绳(2522) 單片機工控(2479) iOS(2429) ASP.NET(2402) MongoDB(2323) 麻木的(2285) 正则表达式(2254) 字典(2211) 循环(2198) 迅速(2185) 擅长(2169) 镖(2155) 功能(1967) .NET技术(1958) Web開發(1951) python-3.x(1918) HtmlCss(1915) 弹簧靴(1913) C++(1909) xml(1889) PostgreSQL(1872) .NETCore(1853) 谷歌表格(1846) Unity3D(1843) for循环(1842)

熱門瀏覽
  • IEEE1588PTP在數字化變電站時鐘同步方面的應用

    IEEE1588ptp在數字化變電站時鐘同步方面的應用 京準電子科技官微——ahjzsz 一、電力系統時間同步基本概況 隨著對IEC 61850標準研究的不斷深入,國內外學者提出基于IEC61850通信標準體系建設數字化變電站的發展思路。數字化變電站與常規變電站的顯著區別在于程序層傳統的電流/電壓互 ......

    uj5u.com 2020-09-10 03:51:52 more
  • HTTP request smuggling CL.TE

    CL.TE 簡介 前端通過Content-Length處理請求,通過反向代理或者負載均衡將請求轉發到后端,后端Transfer-Encoding優先級較高,以TE處理請求造成安全問題。 檢測 發送如下資料包 POST / HTTP/1.1 Host: ac391f7e1e9af821806e890 ......

    uj5u.com 2020-09-10 03:52:11 more
  • 網路滲透資料大全單——漏洞庫篇

    網路滲透資料大全單——漏洞庫篇漏洞庫 NVD ——美國國家漏洞庫 →http://nvd.nist.gov/。 CERT ——美國國家應急回應中心 →https://www.us-cert.gov/ OSVDB ——開源漏洞庫 →http://osvdb.org Bugtraq ——賽門鐵克 →ht ......

    uj5u.com 2020-09-10 03:52:15 more
  • 京準講述NTP時鐘服務器應用及原理

    京準講述NTP時鐘服務器應用及原理京準講述NTP時鐘服務器應用及原理 安徽京準電子科技官微——ahjzsz 北斗授時原理 授時是指接識訓通過某種方式獲得本地時間與北斗標準時間的鐘差,然后調整本地時鐘使時差控制在一定的精度范圍內。 衛星導航系統通常由三部分組成:導航授時衛星、地面檢測校正維護系統和用戶 ......

    uj5u.com 2020-09-10 03:52:25 more
  • 利用北斗衛星系統設計NTP網路時間服務器

    利用北斗衛星系統設計NTP網路時間服務器 利用北斗衛星系統設計NTP網路時間服務器 安徽京準電子科技官微——ahjzsz 概述 NTP網路時間服務器是一款支持NTP和SNTP網路時間同步協議,高精度、大容量、高品質的高科技時鐘產品。 NTP網路時間服務器設備采用冗余架構設計,高精度時鐘直接來源于北斗 ......

    uj5u.com 2020-09-10 03:52:35 more
  • 詳細解讀電力系統各種對時方式

    詳細解讀電力系統各種對時方式 詳細解讀電力系統各種對時方式 安徽京準電子科技官微——ahjzsz,更多資料請添加VX 衛星同步時鐘是我京準公司開發研制的應用衛星授時時技術的標準時間顯示和發送的裝置,該裝置以M國全球定位系統(GLOBAL POSITIONING SYSTEM,縮寫為GPS)或者我國北 ......

    uj5u.com 2020-09-10 03:52:45 more
  • 如何保證外包團隊接入企業內網安全

    不管企業規模的大小,只要企業想省錢,那么企業的某些服務就一定會采用外包的形式,然而看似美好又經濟的策略,其實也有不好的一面。下面我通過安全的角度來聊聊使用外包團的安全隱患問題。 先看看什么服務會使用外包的,最常見的就是話務/客服這種需要大量重復性、無技術性的服務,或者是一些銷售外包、特殊的職能外包等 ......

    uj5u.com 2020-09-10 03:52:57 more
  • PHP漏洞之【整型數字型SQL注入】

    0x01 什么是SQL注入 SQL是一種注入攻擊,通過前端帶入后端資料庫進行惡意的SQL陳述句查詢。 0x02 SQL整型注入原理 SQL注入一般發生在動態網站URL地址里,當然也會發生在其它地發,如登錄框等等也會存在注入,只要是和資料庫打交道的地方都有可能存在。 如這里http://192.168. ......

    uj5u.com 2020-09-10 03:55:40 more
  • [GXYCTF2019]禁止套娃

    git泄露獲取原始碼 使用GET傳參,引數為exp 經過三層過濾執行 第一層過濾偽協議,第二層過濾帶引數的函式,第三層過濾一些函式 preg_replace('/[a-z,_]+\((?R)?\)/', NULL, $_GET['exp'] (?R)參考當前正則運算式,相當于匹配函式里的引數 因此傳遞 ......

    uj5u.com 2020-09-10 03:56:07 more
  • 等保2.0實施流程

    流程 結論 ......

    uj5u.com 2020-09-10 03:56:16 more
最新发布
  • 使用Django Rest framework搭建Blog

    在前面的Blog例子中我們使用的是GraphQL, 雖然GraphQL的使用處于上升趨勢,但是Rest API還是使用的更廣泛一些. 所以還是決定回到傳統的rest api framework上來, Django rest framework的官網上給了一個很好用的QuickStart, 我參考Qu ......

    uj5u.com 2023-04-20 08:17:54 more
  • 記錄-new Date() 我忍你很久了!

    這里給大家分享我在網上總結出來的一些知識,希望對大家有所幫助 大家平時在開發的時候有沒被new Date()折磨過?就是它的諸多怪異的設定讓你每每用的時候,都可能不小心踩坑。造成程式意外出錯,卻一下子找不到問題出處,那叫一個煩透了…… 下面,我就列舉它的“四宗罪”及應用思考 可惡的四宗罪 1. Sa ......

    uj5u.com 2023-04-20 08:17:47 more
  • 使用Vue.js實作文字跑馬燈效果

    實作文字跑馬燈效果,首先用到 substring()截取 和 setInterval計時器 clearInterval()清除計時器 效果如下: 實作代碼如下: <!DOCTYPE html> <html lang="en"> <head> <meta charset="UTF-8"> <meta ......

    uj5u.com 2023-04-20 08:12:31 more
  • JavaScript 運算子

    JavaScript 運算子/運算子 在 JavaScript 中,有一些運算子可以使代碼更簡潔、易讀和高效。以下是一些常見的運算子: 1、可選鏈運算子(optional chaining operator) ?.是可選鏈運算子(optional chaining operator)。?. 可選鏈操 ......

    uj5u.com 2023-04-20 08:02:25 more
  • CSS—相對單位rem

    一、概述 rem是一個相對長度單位,它的單位長度取決于根標簽html的字體尺寸。rem即root em的意思,中文翻譯為根em。瀏覽器的文本尺寸一般默認為16px,即默認情況下: 1rem = 16px rem布局原理:根據CSS媒體查詢功能,更改根標簽的字體尺寸,實作rem單位隨螢屏尺寸的變化,如 ......

    uj5u.com 2023-04-20 08:02:21 more
  • 我的第一個NPM包:panghu-planebattle-esm(胖虎飛機大戰)使用說明

    好家伙,我的包終于開發完啦 歡迎使用胖虎的飛機大戰包!! 為你的主頁添加色彩 這是一個有趣的網頁小游戲包,使用canvas和js開發 使用ES6模塊化開發 效果圖如下: (覺得圖片太sb的可以自己改) 代碼已開源!! Git: https://gitee.com/tang-and-han-dynas ......

    uj5u.com 2023-04-20 08:01:50 more
  • 如何在 vue3 中使用 jsx/tsx?

    我們都知道,通常情況下我們使用 vue 大多都是用的 SFC(Signle File Component)單檔案組件模式,即一個組件就是一個檔案,但其實 Vue 也是支持使用 JSX 來撰寫組件的。這里不討論 SFC 和 JSX 的好壞,這個仁者見仁智者見智。本篇文章旨在帶領大家快速了解和使用 Vu ......

    uj5u.com 2023-04-20 08:01:37 more
  • 【Vue2.x原始碼系列06】計算屬性computed原理

    本章目標:計算屬性是如何實作的?計算屬性快取原理以及洋蔥模型的應用?在初始化Vue實體時,我們會給每個計算屬性都創建一個對應watcher,我們稱之為計算屬性watcher ......

    uj5u.com 2023-04-20 08:01:31 more
  • http1.1與http2.0

    一、http是什么 通俗來講,http就是計算機通過網路進行通信的規則,是一個基于請求與回應,無狀態的,應用層協議。常用于TCP/IP協議傳輸資料。目前任何終端之間任何一種通信方式都必須按Http協議進行,否則無法連接。tcp(三次握手,四次揮手)。 請求與回應:客戶端請求、服務端回應資料。 無狀態 ......

    uj5u.com 2023-04-20 08:01:10 more
  • http1.1與http2.0

    一、http是什么 通俗來講,http就是計算機通過網路進行通信的規則,是一個基于請求與回應,無狀態的,應用層協議。常用于TCP/IP協議傳輸資料。目前任何終端之間任何一種通信方式都必須按Http協議進行,否則無法連接。tcp(三次握手,四次揮手)。 請求與回應:客戶端請求、服務端回應資料。 無狀態 ......

    uj5u.com 2023-04-20 08:00:32 more