首页
学习
活动
专区
圈层
工具
发布
社区首页 >问答首页 ><>在python中解析html时更改为&lt;和&gt;

<>在python中解析html时更改为&lt;和&gt;
EN

Stack Overflow用户
提问于 2013-02-03 11:42:27
回答 2查看 8K关注 0票数 7

当使用Beautifulsoup处理html时,<和>被转换为&lt;&gt;,由于标签锚都被转换,整个文本失去了它的结构,有什么建议吗?

EN

回答 2

Stack Overflow用户

发布于 2013-02-03 18:38:09

设置formatter=None可能会有所帮助(http://www.crummy.com/software/BeautifulSoup/bs4/doc/#output-formatters),但这可能表示您的HTML无效。

如果这不起作用,您能提供一些重现问题的示例代码和HTML吗?

票数 4
EN

Stack Overflow用户

发布于 2019-04-06 08:44:05

这可能是由于无效的字符(由于字符集编码/解码),因此BeautifulSoup在解析输入时会出现问题。我通过将字符串直接传递给BeautifulSoup来解决这个问题,而不需要进行任何编码/解码。在我的例子中,我自己尝试将UTF-16转换为UTF-8。

票数 0
EN
页面原文内容由Stack Overflow提供。腾讯云小微IT领域专用引擎提供翻译支持
原文链接:

https://stackoverflow.com/questions/14669283

复制
相关文章

相似问题

领券
问题归档专栏文章快讯文章归档关键词归档开发者手册归档开发者手册 Section 归档