chunked编码问题
PHP采集到的数据是chunked传输编码,gzip压缩格式的
chunk编码的思路貌似是: 将数据分块传输,每一块分为头部和主体字段,头部包含主体信息的长度且以16进制表示,头部和主体以回车换行符分隔,最后一块以单行的0表示分块结束。。
响应头信息:
Array( [0] => HTTP/1.1 200 OK [1] => Server: Dict/34002 [2] => Date: Wed, 17 Dec 2014 06:49:22 GMT [3] => Content-Type: text/html; charset=utf-8 [4] => Transfer-Encoding: chunked [5] => Connection: keep-alive [6] => Keep-Alive: timeout=60 [7] => Cache-Control: private [8] => Last-Modified: Wed, 17 Dec 2014 04:57:49 GMT [9] => Expires: Wed, 17 Dec 2014 06:49:22 GMT [10] => Set-Cookie: uvid=VJEncoTSVYJC; expires=Thu, 31-Dec-37 23:55:55 GMT; domain=.dict.cn; path=/ [11] => Content-Encoding: gzip)
if($this->response_num==200) { if($this->is_chunked) { //读取chunk头部信息,获取chunk主体信息的长度 $chunk_size = (int)hexdec(fgets($this->conn)); // while(!feof($this->conn) && $chunk_size > 0) { //读取chunk头部指定长度的信息 $this->response_body .= fread( $this->conn, $chunk_size ); fseek($this->conn, 2, SEEK_CUR); $chunk_size = (int)hexdec(fgets( $this->conn,4096)); } } else { $len=0; //读取请求返回的主体信息 while($items = fread($this->conn, $this->response_body_length)) { $len = $len+strlen($items); $this->response_body = $items; //当读取完请求的主体信息后跳出循环,不这样做,貌似会被阻塞!!! if($len >= $this->response_body_length) { break; } } } if($this->is_gzip) { $this->response_body = gzinflate(substr($this->response_body,10)); } $this->getTrans($this->response_body); }
基本上每次都会出现这个提示:
Warning: gzinflate(): data error in E:\CodeEdit\php\http\dict.php on line 384
偶尔能正常解析,应该是chunked解码有问题,查看过一些资料,也变换过集中解码方式,但还是功亏一篑
回复讨论(解决方案)
你可用 gzdecode 解码
你可用 gzdecode 解码
奇怪的是有时可以获取到结果,比如:
int.(打招呼)喂;你好
有时提示错误,比如:
Warning: gzinflate(): data error in E:\CodeEdit\php\http\dict.php on line 380
估计错误还是出现在chunked解码这块,这里的问题是返回的数据是先经过gzip压缩,然后通过chunked分块传输的,所以解码的过程就是反过来的
你可用 gzdecode 解码
if($this->is_chunked) { /* //读取chunk头部信息,获取chunk主体信息的长度 $chunk_size = (int)hexdec(trim(fgets($this->conn))); while(!feof($this->conn) && $chunk_size > 0) { //读取chunk头部指定长度的信息 $this->response_body .= fread( $this->conn, $chunk_size ); fseek($this->conn, 2, SEEK_CUR); $next_line = trim(fgets($this->conn)); if($next_line === '0') { echo $next_line;exit(); } else { $chunk_size = (int)hexdec($next_line); } } */ while(!feof($this->conn)) { $this->response_body .= fread($this->conn, 1024); } if(preg_match_all("#\r\n#i", $this->response_body, $match)) { $result=preg_split("#\r\n#i", $this->response_body, -1, PREG_SPLIT_NO_EMPTY ); // echo "<pre class="brush:php;toolbar:false">"; // print_r($result); /* foreach($result as $v) { echo $v."<br /><hr />"; } echo "<hr />"; */ /* echo hexdec($result[0])."<br />"; echo mb_strlen($result[1])+mb_strlen($result[2])."<br />"; */ $len = count($result); $this->response_body=''; for($i=1; $i<$len-1; $i++) { $this->response_body .= $result[$i]; } //echo strlen($this->response_body); exit(); } else { die("匹配结束符失败"); } }
基本思路,首先把头部改成connection:close,这样可以通过while(!feof($this->conn))一次性读取所有的数据
然后因为chunk分块传输的头部和主体之间是用回车换行分隔的,所以直接用正则分割,得到一个数组包含数据长度和数据的数组,第一项表示所有数据的总长度(而不是每一个chunk分块的长度,这个貌似和chunk编码有点出入,也难怪按照chunk编码会失败,),最后一个数组项为0表示结束.。。。反复测试,OK了

핫 AI 도구

Undresser.AI Undress
사실적인 누드 사진을 만들기 위한 AI 기반 앱

AI Clothes Remover
사진에서 옷을 제거하는 온라인 AI 도구입니다.

Undress AI Tool
무료로 이미지를 벗다

Clothoff.io
AI 옷 제거제

AI Hentai Generator
AI Hentai를 무료로 생성하십시오.

인기 기사

뜨거운 도구

메모장++7.3.1
사용하기 쉬운 무료 코드 편집기

SublimeText3 중국어 버전
중국어 버전, 사용하기 매우 쉽습니다.

스튜디오 13.0.1 보내기
강력한 PHP 통합 개발 환경

드림위버 CS6
시각적 웹 개발 도구

SublimeText3 Mac 버전
신 수준의 코드 편집 소프트웨어(SublimeText3)

뜨거운 주제











PHP 클라이언트 URL (CURL) 확장자는 개발자를위한 강력한 도구이며 원격 서버 및 REST API와의 원활한 상호 작용을 가능하게합니다. PHP CURL은 존경받는 다중 프로모토콜 파일 전송 라이브러리 인 Libcurl을 활용하여 효율적인 execu를 용이하게합니다.

Alipay PHP ...

고객의 가장 긴급한 문제에 실시간 인스턴트 솔루션을 제공하고 싶습니까? 라이브 채팅을 통해 고객과 실시간 대화를 나누고 문제를 즉시 해결할 수 있습니다. 그것은 당신이 당신의 관습에 더 빠른 서비스를 제공 할 수 있도록합니다.

기사는 PHP 5.3에 도입 된 PHP의 LSB (Late STATIC BING)에 대해 논의하여 정적 방법의 런타임 해상도가보다 유연한 상속을 요구할 수있게한다. LSB의 실제 응용 프로그램 및 잠재적 성능

JWT는 주로 신분증 인증 및 정보 교환을 위해 당사자간에 정보를 안전하게 전송하는 데 사용되는 JSON을 기반으로 한 개방형 표준입니다. 1. JWT는 헤더, 페이로드 및 서명의 세 부분으로 구성됩니다. 2. JWT의 작업 원칙에는 세 가지 단계가 포함됩니다. JWT 생성, JWT 확인 및 Parsing Payload. 3. PHP에서 인증에 JWT를 사용하면 JWT를 생성하고 확인할 수 있으며 사용자 역할 및 권한 정보가 고급 사용에 포함될 수 있습니다. 4. 일반적인 오류에는 서명 검증 실패, 토큰 만료 및 대형 페이로드가 포함됩니다. 디버깅 기술에는 디버깅 도구 및 로깅 사용이 포함됩니다. 5. 성능 최적화 및 모범 사례에는 적절한 시그니처 알고리즘 사용, 타당성 기간 설정 합리적,

기사는 입력 유효성 검사, 인증 및 정기 업데이트를 포함한 취약점을 방지하기 위해 프레임 워크의 필수 보안 기능을 논의합니다.

이 기사에서는 프레임 워크에 사용자 정의 기능 추가, 아키텍처 이해, 확장 지점 식별 및 통합 및 디버깅을위한 모범 사례에 중점을 둡니다.

PHP 개발에서 PHP의 CURL 라이브러리를 사용하여 JSON 데이터를 보내면 종종 외부 API와 상호 작용해야합니다. 일반적인 방법 중 하나는 컬 라이브러리를 사용하여 게시물을 보내는 것입니다 ...
