HTML解析模型图-http协议-HTTP请求

头概述 (HttpServletRequest)

 

http协议-HTTP请求头概述 (HttpServletRequest)


   HTTP客户程序(例如浏览器),向服务器发送请求的时候必须指明请求类型(一般是GET或者POST)。如有必要,客户程序还可以选择发送其他的请求 头。大多数请求头并不是必需的,但Content-Length除外。对于POST请求来说Content-Length必须出现。 
 下面是一些最常见的请求头 

   Accept:浏览器可接受的MIME类型。 

   Accept-Charset:浏览器可接受的字符集。 

   Accept-Encoding:浏览器能够进行解码的数据编码方式,比如gzip。Servlet能够向支持gzip的浏览器返回经gzip编码的HTML页面。许多情形下这可以减少5到10倍的下载时间。 

   Accept-Language:浏览器所希望的语言种类,当服务器能够提供一种以上的语言版本时要用到。 

   Authorization:授权信息,通常出现在对服务器发送的WWW-Authenticate头的应答中。 

    Connection:表示是否需要持久连接。如果Servlet看到这里的值为“Keep-Alive”,或者看到请求使用的是HTTP 1.1(HTTP 1.1默认进行持久连接),它就可以利用持久连接的优点,当页面包含多个元素时(例如Applet,图片),显著地减少下载所需要的时间。要实现这一 点,Servlet需要在应答中发送一个Content-Length头,最简单的实现方法是:先把内容写入ByteArrayOutputStream,然后在正式写出内容之前计算它的大小。 

   Content-Length:表示请求消息正文的长度。 

   Cookie:这是最重要的请求头信息之一

   From:请求发送者的email地址,由一些特殊的Web客户程序使用,浏览器不会用到它。 

   Host:初始URL中的主机和端口。 

   If-Modified-Since:只有当所请求的内容在指定的日期之后又经过修改才返回它,否则返回304“Not Modified”应答。 

   Pragma:指定“no-cache”值表示服务器必须返回一个刷新后的文档,即使它是代理服务器而且已经有了页面的本地拷贝。 

   Referer:包含一个URL,用户从该URL代表的页面出发访问当前请求的页面。 

   User-Agent:浏览器类型,如果Servlet返回的内容与浏览器类型有关则该值非常有用。 

   UA-Pixels,UA-Color,UA-OS,UA-CPU:由某些版本的IE浏览器所发送的非标准的请求头,表示屏幕大小、颜色深度、操作系统和CPU类型。 

  有关HTTP头完整、详细的说明,请参见http://www.w3.org/Protocols/的HTTP规范。 

HTTP应答头概述(HttpServletResponse)
    Web服务器的HTTP应答一般由以下几项构成:一个状态行,一个或多个应答头,一个空行,内容文档。设置HTTP应答头往往和设置状态行中的状态代码结 合起来。例如,有好几个表示“文档位置已经改变”的状态代码都伴随着一个Location头,而401(Unauthorized)状态代码则必须伴随一 个WWW-Authenticate头。 

   然而,即使在没有设置特殊含义的状态代码时,指定应答头也是很有用的。应答头可以用来完成:设置Cookie,指定修改日期,指示浏览器按照指定的间隔刷新页面,声明文档的长度以便利用持久HTTP连接,……等等许多其他任务。 

   设置应答头最常用的方法是HttpServletResponse的setHeader,该方法有两个参数,分别表示应答头的名字和值。和设置状态代码相似,设置应答头应该在发送任何文档内容之前进行。 

   setDateHeader方法和setIntHeadr方法专门用来设置包含日期和整数值的应答头,前者避免了把Java时间转换为GMT时间字符串的麻烦,后者则避免了把整数转换为字符串的麻烦。 

   HttpServletResponse还提供了许多设置

setContentType:设置Content-Type头。大多数Servlet都要用到这个方法。 
setContentLength:设置Content-Length头。对于支持持久HTTP连接的浏览器来说,这个函数是很有用的。 
addCookie:设置一个Cookie(Servlet API中没有setCookie方法,因为应答往往包含多个Set-Cookie头)。 
另外,如上节介绍,sendRedirect方法设置状态代码302时也会设置Location头。 

   有关HTTP头详细和完整的说明,请参见http://www.w3.org/Protocols/规范。 

HTTP应答头 说明 
Allow 服务器支持哪些请求方法(如GET、POST等)。 

Content-Encoding 文档的编码(Encode)方法。只有在解码之后才可以得到Content-Type头指定的内容类型。利用gzip压缩文档能够显著地减少HTML文档 的下载时间。Java的GZIPOutputStream可以很方便地进行gzip压缩,但只有Unix上的Netscape和Windows上的IE 4、IE 5才支持它。因此,Servlet应该通过查看Accept-Encoding头(即request.getHeader("Accept- Encoding"))检查浏览器是否支持gzip,为支持gzip的浏览器返回经gzip压缩的HTML页面,为其他浏览器返回普通页面。 

Content-Length 表示内容长度。只有当浏览器使用持久HTTP连接时才需要这个数据。如果你想要利用持久连接的优势,可以把输出文档写入 ByteArrayOutputStram,完成后查看其大小,然后把该值放入Content-Length头,最后通过 byteArrayStream.writeTo(response.getOutputStream()发送内容。 

Content-Type 表示后面的文档属于什么MIME类型。Servlet默认为text/plain,但通常需要显式地指定为text/html。由于经常要设置 Content-Type,因此HttpServletResponse提供了一个专用的方法setContentTyep。 

Date 当前的GMT时间。你可以用setDateHeader来设置这个头以避免转换时间格式的麻烦。 

Expires 应该在什么时候认为文档已经过期,从而不再缓存它? 

Last-Modified 文档的最后改动时间。客户可以通过If-Modified-Since请求头提供一个日期,该请求将被视为一个条件GET,只有改动时间迟于指定时间的文 档才会返回,否则返回一个304(Not Modified)状态。Last-Modified也可用setDateHeader方法来设置。 
Location 表示客户应当到哪里去提取文档。Location通常不是直接设置的,而是通过HttpServletResponse的sendRedirect方法,该方法同时设置状态代码为302。 

Refresh 表示浏览器应该在多少时间之后刷新文档,以秒计。除了刷新当前文档之外,你还可以通过setHeader("Refresh", "5; URL=http://host/path")让浏览器读取指定的页面。注意这种功能通常是通过设置HTML页面HEAD区的<META HTTP-EQUIV="Refresh" CONTENT="5;URL=http://host/path">实现,这是因为,自动刷新或重定向对于那些不能使用CGI或Servlet的 HTML编写者十分重要。但是,对于Servlet来说,直接设置Refresh头更加方便。注意Refresh的意义是“N秒之后刷新本页面或访问指定 页面”,而不是“每隔N秒刷新本页面或访问指定页面”。因此,连续刷新要求每次都发送一个Refresh头,而发送204状态代码则可以阻止浏览器继续刷 新,不管是使用Refresh头还是<META HTTP-EQUIV="Refresh" ...>。注意Refresh头不属于HTTP 1.1正式规范的一部分,而是一个扩展,但Netscape和IE都支持它。 

Server 服务器名字。Servlet一般不设置这个值,而是由Web服务器自己设置。 

Set-Cookie 设置和页面关联的Cookie。Servlet不应使用response.setHeader("Set-Cookie", ...),而是应使用HttpServletResponse提供的专用方法addCookie。参见下文有关Cookie设置的讨论。 

WWW-Authenticate 客户应该在Authorization头中提供什么类型的授权信息?在包含401(Unauthorized)状态行的应答中这个头是必需的。例 如,response.setHeader("WWW-Authenticate", "BASIC realm=/"executives/"")。注意Servlet一般不进行这方面的处理,而是让Web服务器的专门机制来控制受密码保护页面的访问 (例如.htaccess)。

 

 

 

 

 

 

 

 

 

 

 

HTTP请求解析过程 (简单概括)

1.域名解析

 用户输入网址,由域名系统DNS解析输入的网址;

2.TCP的3次握手

 通过域名解析出的IP地址来向web服务器发起TCP连接请求,如果3次握手通过,则与web服务端建立了可靠的连接;

3.发送http请求

 web客户端向web服务端发送请求;

4.接收http响应

 web客户端接收来自web服务端的响应,包含各种根据请求反馈的数据;

5.web客户端(浏览器)解释响应

 最后由浏览器解析响应里的数据,即HTML代码,以及HTML代码中请求的资源,然后由浏览器呈现给用户。

以上就是对一个HTTP请求网页的解析过程的简单概括

 

 

HTTP——概述、请求和响应、GET和POST请求

HTTP协议概述

WEB浏览器与WEB服务器之间的一问一答的交互过程必须遵循一定的规则,这个规则就是HTTP协

HTTP是hypertext transfer protocol(超文本传输协议)的简写,它是TCP/IP协议之上的一个应用层协议,用于定义WEB浏览器与WEB服务器之间交换数据的过程以及数据本身的格式。

1.HTTP协议到底约束了什么:

    1.约束了浏览器以何种格式向服务端发生数据:

    2.约束了服务器应该以何种格式来接受客户端发送的数据:

    3.约束了服务器应该以何种格式来反馈数据给浏览器;

    4约束了浏览器应该以何种格式来接收服务器反馈的数据.

2.HTTP格式规范

    1.HTTP1.0规范:

        若请求的有N个资源,得建立N次连接,发送N次请求,接收N次响应,关闭N次连接.

        每次请求的之间都要建立单独的连接,请求,响应,响应完关闭该次连接:

        缺点:每请求一个资源都要单独的建立新的连接,请求完并关闭连接.

    1.HTTP1.1规范:

        能在一次连接之间,多次请求,多次响应,响应完之后再关闭连接.

        在一个TCP连接上可以传送多个HTTP请求和响应

        多个请求和响应过程可以重叠进行

        增加了更多的请求头和响应头

    3.HTTP协议的版本

        HTTP/1.0、HTTP/1.1、HTTPS2.0

请求信息

1.一个完整的由客户端发给服务器的HTTP请求中包含以下内容:

    *请求行

        包含了请求方法、请求资源路径、HTTP协议版本

        Get/resources/imges/1.jpg/ HTTP/1.1

    *多个请求头

        包含了对客户端的环境描述、客户端请求的主机地址等信息

            1.Accept:浏览器可接受的MIME类型(Tomcat安装目录/conf/web.xml中查找)注意: MIME: 表示文件内容的类型.

            2.Accept-Charset:告知服务器,客户端支持哪种字符集

            3.Accept-Encoding:浏览器能够进行解码的数据编码方式

            4.Accept-Language:浏览器支持的语言。

            5.Referer:当前页面由哪个页面访问过来的。

            6.Content-Type:通知服务器,请求正文的MIME类型。

            7.Content-Length:请求正文的长度

            8.If-Modified-Since:通知服务器,缓存的文件的最后修改时间。

            9.User-Agent:通知服务器,浏览器类型.

            10.Connection:表示是否需要持久连接。如果服务器看到这里的值为“Keep -Alive”,或者看到请求使用的是HTTP 1.1(HTTP 1.1默认进行持久连接)

            11.Cookie:这是最重要的请求头信息之一(会话有关)

2.请求实体

    服务器返回给客户端的具体数据,比如文件数据.

    ![](https://img2020.cnblogs.com/blog/1668748/202004/1668748-20200425215713826-779651544.png)

常见状态响应码

    状态码                     中文描述

    1xx                        服务器未完全接收客户端信息,等待一段时间,发1xx

    2xx                        成功(200)

    3xx                        重定向,对于客户端的请求,服务器将请求转发到另外一个服务器来访问(304)

    4xx                        客户端发生异常。404:(请求路径没有对应的资源),(405)请求没有对应的doxxx()方法

    5xx                        服务端发生异常

Get个Post方法

简单说明:在HTTP/1.1协议中,定义了8种发送http请求的方法

    GET、POST、OPTIONS、HEAD、PUT、DELETE、TRACE、CONNECT、PATCH

1.GET请求    

    1.请求的数据全部在浏览器的地址栏(很不安全)

        ttp://localhost:8080/webapp/?username=coder&email=111#

    2.请求信息全部会存储在请求行中

        注意:由于浏览器和服务器对URL长度有限制,因此在URL后面附带的参数是有限制的,通常不能超过2KB    

    3.参数连接  

          资源?参数名=参数值值&参数名=参数值&…

 

2.POST请求

    请求的数据不会出现在浏览器的地址栏中(比较安全)

    请求信息会全部存储到请求实体中

3.GET和POST请求的区别:

    1.GET的请求数据在地址栏中,而POST不会(Post比Get安全)

    2.POST请求的参数存放于请求实体中, 而GET存放在请求行中.

        GET请求的数据不能超过2K, 而POST没有上限 文件上传时,必须使用POST方式

    3.GET可以缓存, 而POST没有缓存

4.如何选择GET和POST

    1.如果要传递大量数据,比如文件上传,只能用POST请求

    2.GET的安全性比POST要差些,如果包含机密\敏感信息,建议用POST

    3.如果仅仅是索取数据(数据查询),建议使用GET

    4.如果是增加、修改、删除数据,建议使用POST

HTTP无状态连接

1.打开一个浏览器,访问某一个站点,在该网址内部查看信息,点击超链接等相关操作,最后关闭浏览器的整个过程,称之为一次会话

2.HTTP协议

    1.它是无状态连接,服务器不知道上一次是哪个客户端请求了自己.

    2.无状态连接带来的问题:

        *在一次会话中,多个请求之间无法共享数据,无法跟踪用户的会话信息.

        *在一次会话中共享数据即会话跟踪技术.

    3.解决方案

        *使用参数的传递机制

        在每一个请求之间使用参数来传递需要共享的数据.http://localhost/param/list?username=gzy

        可以解决问题,但请求需要共享的数据全部暴露在URL中(请求行),不安全.想要解决这个问题,把共享的数据存放到请求头中. 期待Cookie技术

 

posted on 2021-02-21 21:13  shuzihua  阅读(274)  评论(0编辑  收藏  举报

导航