지역 사회

배우다

도구 라이브러리

AI 도구

여가

한국어

집 > 백엔드 개발 > 파이썬 튜토리얼 > 为什么这个网页的源代码用python爬下来后用beautifulsoup解析后会出现字符丢失？

为什么这个网页的源代码用python爬下来后用beautifulsoup解析后会出现字符丢失？

WBOYWBOYWBOYWBOYWBOYWBOYWBOYWBOYWBOYWBOYWBOYWBOYWB

풀어 주다： 2016-06-06 16:22:10

원래의

1890명이 탐색했습니다.

回复内容：

又是你这个只点感谢不点赞的坏人……
话说你为什么要这么心急地学呢，基础不扎实啊，太冒进了，很显然没有清晰的思路…

首先编程要有默认的编码，也就是在文件的一开始加上

 # -*- coding: utf-8 -*-
로그인 후 복사

你是python2  代码前 加上# coding:utf-8

看python培训黄哥的三篇文章 
python开发爬虫汉字编码不再是问题： 
将python2中汉字会出现乱码的事一次性说清楚 
article/python_bianma.md at master · pythonpeixun/article · GitHub
python爬虫访问多个网站、中文编码的处理。 
python爬虫访问多个网站、中文编码的处理。
python3访问sina首页中文的处理 
python3访问sina首页中文的处理


可能在你这个转来转处的地方丢失。
ur = list(ur)
 ur = ur[:-1]
＊＊＊＊＊＊＊＊＊＊＊＊＊＊＊＊
 ur = res.contents[0]
    ur = list(ur)
    ur = ur[:-1]
    temp = unicode(ur[0])
    for index in range(0, len(ur), 4):
        temp = unicode(ur[index])
        print temp.strip()
        print ur[index+1].string
        print ur[index+1]['href']
        print '\n'
로그인 후 복사

似乎response 后面用了俩decode 后面一个改encode应该就好了吧。。。

Decode是把括号里转成Unicode

Encode是Unicode转成括号里，就是UTF-8

Unicode就是个中转站


再不行就同一楼ignore。。。

还是用Requests库来处理http请求吧

이전 기사：Python 有什么奇技淫巧？ 다음 기사：怎样用 Windows 入门Python？

본 웹사이트의 성명

본 글의 내용은 네티즌들의 자발적인 기여로 작성되었으며, 저작권은 원저작자에게 있습니다. 본 사이트는 이에 상응하는 법적 책임을 지지 않습니다. 표절이나 침해가 의심되는 콘텐츠를 발견한 경우 admin@php.cn으로 문의하세요.

저자별 최신 기사

휴대 전화에서 Photoshop을 사용하는 방법

2025-02-24 12:36:12
스트리밍 서비스에 많은 돈을 쓰지 마십시오

2025-02-24 12:11:09
휴대 전화와 대화를 중지하십시오 : Siri에 유형을 사용하는 방법

2025-02-24 12:06:10
아마존 사물함을 사용하여 시간을 절약하고 현관 해적을 치는 방법

2025-02-24 12:04:13
Windows의 이미지에서 텍스트를 읽는 방법

2025-02-24 12:03:10
Spotify에 연결하는 유용한 앱 9 개

2025-02-24 12:02:09
Chatgpt 내부에서 작업 및 알림을 사용하는 방법

2025-02-24 12:01:10
Apple Intelligence를 사용하여 이메일을 정렬하는 방법

2025-02-24 12:00:16
안드로이드에서 새로운 도난 감지 기능을 설정하는 방법

2025-02-24 11:59:10
Gemini가 모든 것을 기억하거나 잊어 버리는 방법 ’ ve

2025-02-24 11:58:14

최신 이슈

function_exists()는 사용자 정의 함수를 결정할 수 없습니다. 기능 테스트() { ...

에서 2024-04-29 11:01:01

0

3

2822

Chrome 모바일 버전을 표시하는 방법 안녕하세요 선생님, Chrome을 모바일 버전으로 어떻게 변경하나요?

에서 2024-04-23 00:22:19

0

11

2945

자식 창이 부모 창을 작동하지만 출력이 응답하지 않습니다. 처음 두 문장은 실행 가능하지만 마지막 문장은 구현할 수 없습니다.

에서 2024-04-19 15:37:47

0

1

2470

상위 창에 출력이 없습니다. document.onclick = function(){ window.opener.document.write('나는 자식 창의 출력입니다.');

에서 2024-04-18 23:52:34

0

1

2392

CSS 마인드맵 코스웨어는 어디에 있나요? 코스웨어

에서 2024-04-16 10:10:18

0

0

2444

관련 주제

더>

인기 추천

인기 튜토리얼

더>

관련 튜토리얼

인기 추천

최신 강좌

최신 다운로드

더>

웹 효과

웹사이트 소스 코드

웹사이트 자료

프론트엔드 템플릿