>백엔드 개발 >파이썬 튜토리얼 >Python 문자열에서 HTML 엔터티를 디코딩하는 방법은 무엇입니까?

Python 문자열에서 HTML 엔터티를 디코딩하는 방법은 무엇입니까?

Barbara Streisand
Barbara Streisand원래의
2024-12-14 05:33:09224검색

How to Decode HTML Entities in Python Strings?

Python 문자열에서 HTML 엔터티를 어떻게 디코딩하나요?

Beautiful Soup 3로 HTML을 구문 분석할 때 HTML 엔터티가 자주 나타나서 디코딩해야 합니다. 이 작업은 html.unescape() 또는 HTMLParser.unescape() 함수를 사용하여 수행할 수 있습니다.

Python 3.4

html.unescape() 사용:

import html
html.unescape('£682m')

Python 2.6-3.3

파이썬의 HTMLParser에서 2.6-2.7 또는 Python 3의 html.parser, unescape():

from html.parser import HTMLParser
parser = HTMLParser()
print(h.unescape('£682m'))

또는 6개의 호환성 라이브러리 사용:

from six.moves.html_parser import HTMLParser
parser = HTMLParser()
print(h.unescape('£682m'))

위 내용은 Python 문자열에서 HTML 엔터티를 디코딩하는 방법은 무엇입니까?의 상세 내용입니다. 자세한 내용은 PHP 중국어 웹사이트의 기타 관련 기사를 참조하세요!

성명:
본 글의 내용은 네티즌들의 자발적인 기여로 작성되었으며, 저작권은 원저작자에게 있습니다. 본 사이트는 이에 상응하는 법적 책임을 지지 않습니다. 표절이나 침해가 의심되는 콘텐츠를 발견한 경우 admin@php.cn으로 문의하세요.