腾讯云
开发者社区
文档
建议反馈
控制台
登录/注册
首页
学习
活动
专区
圈层
工具
MCP广场
文章/答案/技术大牛
搜索
搜索
关闭
发布
文章
问答
(9999+)
视频
沙龙
1
回答
提高
BeautifulSoup
解析
速度
html
、
python-3.x
、
beautifulsoup
有没有办法更快地
解析
数据,或者让代码运行得更快呢? 我已经将
解析
器更改为lxml,但没有注意到有多大改进。我想要实现的是,当添加条目时,
BeautifulSoup
只会从这一点开始搜索,但我不知道该怎么做 def stew(fp): soup =
BeautifulSoup
(f, features="lxml") def name_crawler(soup
浏览 31
提问于2019-09-10
得票数 2
回答已采纳
1
回答
如何使用wget下载html/text,而不使用图片、css等
python
、
parsing
、
wget
为了进行研究和培训,我决定使用wget函数来
提高
解析
任何页面的
速度
。在此之前,我使用了
BeautifulSoup
、
BeautifulSoup
(' lxml ')、纯lxml、selectolax.parser以及urllib和请求,所有这些步骤都使加快
解析
器的数据检索
速度
成为可能,但我找到了一种更快的
解析
大型数据的方法,这就是WGET,但问题是我正在下载一个包含所有内容的页面,它是完全独立的,而且我只想下载html,因为100,00
浏览 9
提问于2022-08-04
得票数 0
1
回答
Web同时抓取请求
python-3.x
、
web-scraping
、
beautifulsoup
from urllib import requestfrom bs4 import
BeautifulSoup
as bs soup = (page,"lxml") 现在这个过程非常慢,因为它使一个请求
解析
数据,通过指定的步骤,然后我们返回到发出请求。我是否应该将URL的全部源代码存储在一个文件中,然后执行必要的操作(
解析
、查找我们需要的数据)-?
浏览 4
提问于2017-03-08
得票数 1
回答已采纳
3
回答
如何消除
BeautifulSoup
用户警告?
python
、
beautifulsoup
安装
BeautifulSoup
后,每当我在命令行中运行Python时,就会发出以下警告:
BeautifulSoup
([your
浏览 4
提问于2015-11-04
得票数 67
回答已采纳
2
回答
美汤和Scrapy一起使用能
提高
性能吗?
python
、
beautifulsoup
、
scrapy
我已经看到很多人都在使用漂亮的Soup进行
解析
。 我只是想知道在
速度
,效率或更多的slectrors等方面有什么优势,帮助我创建蜘蛛和爬虫或scrapy对我来说应该足够了。
浏览 0
提问于2012-11-23
得票数 0
回答已采纳
3
回答
提高
BeautifulSoup
性能
python
、
web-crawler
、
beautifulsoup
、
mechanize
、
delicious-api
因此,我有以下一组
解析
美味信息的代码。它以以下格式打印美味页面中的数据书签|人数等... page = br.open(url)soup =
BeautifulSoup
(html)但问题是有些书签没有很多人,所以我决定对它进行不同的
解析
,这样我就
浏览 7
提问于2010-12-19
得票数 1
回答已采纳
1
回答
BeautifulSoup
:如何忽略虚假的结束标记
python
、
html
、
python-3.x
、
beautifulsoup
我读过很多关于
BeautifulSoup
的好东西,这就是为什么我现在正试图用它来刮一组格式错误的HTML的网站。不幸的是,
BeautifulSoup
的一个特性就是目前的展示障碍: 当
BeautifulSoup
遇到一个从未打开的结束标记(在我的例子中是</p>)时,它决定结束文档。我是否可以将
BeautifulSoup
配置为忽略不匹配的结束标记,而不是在遇到文档时关闭它们?
浏览 1
提问于2015-12-19
得票数 7
回答已采纳
1
回答
提高
fastq
解析
速度
performance
、
perl
、
parsing
、
fastq
@相同代码的已解算C#快一倍 我正在用phred33
解析
perl文件,这需要相当多的时间(大约15分钟)。fastq文件大约为3 is。有什么合理的方法可以让这一切变得更快吗?
浏览 0
提问于2012-04-25
得票数 1
回答已采纳
2
回答
将lxml设置为默认的
BeautifulSoup
解析
器
python
、
html
、
beautifulsoup
、
html-parsing
、
lxml
我正在做一个网络抓取项目,在
速度
上遇到了问题。为了解决这个问题,我想使用lxml而不是html.parser作为
BeautifulSoup
的
解析
器。我能够做到这一点:但我不想每次调用
BeautifulSoup
时都重复输入'lxml'。有没有一种方法可以让我在程序开始时只使用一次
解析
器?
浏览 1
提问于2015-01-06
得票数 22
回答已采纳
1
回答
如何使用python抓取多页网站并将数据导出到.csv文件中?
python
、
csv
、
beautifulsoup
我的脚本如下import requestsi = 0 urlsearch=&&&page=" + str(i)) i=+1 soup =
BeautifulSoup
(
浏览 2
提问于2016-07-24
得票数 0
2
回答
使用find时
BeautifulSoup
挂起
python
、
html
、
parsing
、
beautifulsoup
、
html-parsing
</head><body><img src="image.jpg">"""from bs4 import
BeautifulSoup
soup =
BeautifulSoup
(data, 'html5lib')当我运行
浏览 0
提问于2016-03-18
得票数 3
1
回答
美丽的汤用页面源的片段创建汤
python
、
selenium
、
web-scraping
、
beautifulsoup
通常,每当我使用
Beautifulsoup
提取数据时很简单。工作完成了。这是可行的,但
速度
很慢。事实上,即使用page_source创建汤也很慢。我试过变体但没有成功。
浏览 2
提问于2016-04-08
得票数 2
回答已采纳
3
回答
如何用NSURLconnection
解析
部分xml?
iphone
、
objective-c
、
xml-parsing
、
nsurlconnection
我使用NSURLConnection加载数据并使用nsxmlparser进行
解析
。目前,我让整个数据加载,然后
解析
它,但是为了
提高
速度
,我想知道如何
解析
在didReceiveData委托方法中接收到的数据部分。如果我只是在这个方法中移动我的
解析
函数,我会得到错误,因为当它分解成不同的部分时,它没有正确的XML格式或... 如果有人能帮助我
提高
速度
,我将不胜感激。
浏览 0
提问于2011-11-28
得票数 1
2
回答
Python2.7-漂亮的Soup抓取find_all命令不起作用
python-2.7
、
beautifulsoup
import requestsr = requests.get= 200: exit() soup =
BeautifulSoup
(sourcecode,
浏览 2
提问于2017-01-17
得票数 1
回答已采纳
1
回答
解析
Selenium WebElement库?
python
、
selenium
如果我只做了一个请求来获取第一个元素的DOM树,然后
解析
HTML以获得元素的文本,那么我可以跳过所有这些api请求。是否有用于此目的的库。 类似这样的事情吗?
浏览 29
提问于2021-05-01
得票数 0
2
回答
Xpath vs DOM vs
BeautifulSoup
vs lxml vs其他
解析
网页最快的方法是什么?
python
、
dom
、
xpath
、
html-parsing
、
lxml
我知道如何使用Python
解析
页面。我的问题是,在所有
解析
技术中,哪种方法是最快的,其他方法的
速度
有多快?我所知道的
解析
技术有Xpath、DOM、
BeautifulSoup
和使用Python的find方法。
浏览 0
提问于2011-12-01
得票数 6
回答已采纳
3
回答
一个快速的python HTML
解析
器
python
、
html
、
xml
、
beautifulsoup
我需要
解析
它们并从中提取一些信息。我试过使用
BeautifulSoup
,它简单直观,但运行起来似乎超级慢。因为这是必须在弱机器(在amazon上)上例行运行的东西,所以
速度
很重要。在python中有没有比
BeautifulSoup
快得多的HTML/XML
解析
器?或者我必须求助于正则表达式
解析
..
浏览 0
提问于2012-03-13
得票数 14
回答已采纳
1
回答
'
BeautifulSoup
‘和'lxml’之间有什么关系?
python
、
beautifulsoup
、
html-parsing
、
lxml
在“lxml's ”中,它写道: 美丽的Soup支持Python标准库中包含的HTML
解析
器
浏览 2
提问于2015-08-25
得票数 3
回答已采纳
1
回答
漂亮汤删除标签错误
python
、
html
、
regex
、
beautifulsoup
因此,我正在抓取一些内容,并试图用python中的漂亮汤删除html标记,但保留内容。例如,考虑到:我想要输出:通常,我会使用get_text方法。问题是,很明显,我正在抓取的一些页面中有html错误。例如:当发生这种情况时,get_text()将删除我想要的大部分文本。我试着用regex来做这件事,结果还
浏览 3
提问于2015-03-12
得票数 0
回答已采纳
1
回答
Selenium -
解析
页面花费的时间过长。
python
、
parsing
、
selenium
、
selenium-webdriver
、
html-parsing
我不明白的是,
解析
已经加载的页面需要花费太长时间。据我所知,在加载tha页面时,这个页面的源代码保存在我的RAM或其他任何地方,因此
解析
应该在毫秒内完成。编辑:我敢打赌用
BeautifulSoup
<em
浏览 2
提问于2015-07-12
得票数 1
回答已采纳
点击加载更多
热门
标签
更多标签
云服务器
ICP备案
对象存储
云点播
实时音视频
活动推荐
运营活动
广告
关闭
领券