腾讯云
开发者社区
文档
建议反馈
控制台
登录/注册
首页
学习
活动
专区
圈层
工具
MCP广场
文章/答案/技术大牛
搜索
搜索
关闭
发布
文章
问答
(9999+)
视频
沙龙
2
回答
Beautifulsoup
不会
显示
所
有的
html
元素
python
、
web-scraping
、
beautifulsoup
import bs4res = requests.get(base_url)soup 有人知道为什么我不能从页面访问所
有的
html
吗?
浏览 16
提问于2020-10-22
得票数 2
回答已采纳
1
回答
如何使用python从
HTML
代码中提取特定
元素
python
、
html
、
web-scraping
、
beautifulsoup
我对
HTML
并不那么自信,我在用Python解析这部分
HTML
代码(打印soup.prettify()的结果)时遇到了困难。$('#edit-review-tab').
html
(' <div class='\"row-fluid\
浏览 0
提问于2018-03-17
得票数 0
回答已采纳
3
回答
如何只打印文本美汤
python
、
python-2.7
、
beautifulsoup
我可以使用.find_all()找到并打印所有
元素
,但它们也会打印
html
标记。如何才能仅打印这些标记中的文本。这就是我
所
拥
有的
:<p>1</p><p>3</p> soup =
Beautiful
浏览 0
提问于2017-02-03
得票数 1
回答已采纳
3
回答
获取页面上的所有URLs
python
我正在做一些事情,需要我在一个页面上获得所
有的
URL。它似乎在我测试过的大多数网站上都能工作,例如microsoft.com,但它只从google.com返回三个。
浏览 1
提问于2012-06-24
得票数 1
3
回答
在python中使用re.sub()替换
html
代码
python
、
regex
、
str-replace
我想对我的
html
代码做一些小的修改来做一些格式化。如果我在python字符串中有下面的代码,我如何使用re.sub()函数来根据我的需要替换行。例如:在这种情况下,我试图在我的表中添加边框。
浏览 5
提问于2014-12-22
得票数 0
回答已采纳
1
回答
用用户提供的值替换
HTML
文件中的文本的Python脚本
python
、
html
、
python-2.7
、
substitution
我有一个INI文件:param=stuff1如果用户编辑文件并将param值更改为test,我希望将
html
文件更改为:<!
浏览 2
提问于2015-10-24
得票数 1
回答已采纳
1
回答
Python,Selenium "::after“抓取时的问题
python
、
selenium
、
selenium-webdriver
、
web-scraping
、
beautifulsoup
但是,在运行Selenium chrome浏览器后,检查
元素
不会
像原始源页面中那样
显示
。在
html
源代码中出现“::after”
元素
,而不是汽车细节的
html
代码(产品图像附近的信息区域)。你可以在下面看到我的抓取代码;from requests import getfrom seleniumgaleriden-satilik-citroen-c-elysee-1-6-hdi
浏览 1
提问于2020-03-18
得票数 1
2
回答
BeautifulSoup
标识属性的周围字符
python
、
beautifulsoup
例如:
html
= """<input class="form-control" name='searchString' type=text value= "myString"/>""" 在此标记的属性值上循环将返回没有周围字符的值
浏览 11
提问于2018-12-30
得票数 0
回答已采纳
2
回答
单击“搜索”按钮后,使用selenium捕获
html
元素
python
、
selenium
、
selenium-webdriver
点击主页上的搜索按钮后,给出的结果会
显示
在相同的页面上,而url根本
不会
改变。在结果页面上,我无法找到任何
html
-
元素
。这就是我
所
尝试的:from selenium import webdriver from selenium.webdriver.common.keysbrowser.find_element_by_xpath("//*[@id=\"keresgrid\"]&
浏览 0
提问于2017-10-03
得票数 0
回答已采纳
3
回答
为什么只读取网页中的前两行
html
表?
python
、
html
、
pandas
、
beautifulsoup
我试图从网页上的
html
表中抓取数据。我尝试了几种基于这里发布的答案的不同方法,但总是有一个问题:结果大致与我
所
期望的一样,但只适用于表的前两行。我对
html
和漂亮的汤几乎没有经验,但是从url中的表的
html
文件中,我看不到前两行和表的其余部分之间有什么区别。有人能帮我找出我做错了什么吗?import numpyimport urllib url = 'http://ww
浏览 5
提问于2020-12-14
得票数 0
回答已采纳
1
回答
如何解析特定单词的
BeautifulSoup
结果来定义布尔值?
python
、
beautifulsoup
、
html-parsing
我试图获取
BeautifulSoup
结果,并将它们解析为一个特定的单词,我将定义某个值是True还是False。例如,如果我用
BeautifulSoup
解析一个特定的id
元素
,并且它包含单词"yes",那么bool1 = True。如果特定的id
元素
包含单词"no",而不是bool1 = false。到目前为止,这就是我
所
拥
有的
:import
浏览 0
提问于2020-11-19
得票数 0
回答已采纳
2
回答
尝试使用
BeautifulSoup
Python模块从表数据中提取单个
元素
python
、
python-3.x
、
beautifulsoup
我是Python的新手,目前在Python中使用
BeautifulSoup
来尝试拉取一些表数据。我无法从td中提取单个
元素
。到目前为止,我
所
拥
有的
是: from bs4 import
BeautifulSoup
source = requests.get('https://gol.gg/teams/list/season-ALL/split-ALL/region-ALL/tourna
浏览 20
提问于2020-07-28
得票数 1
2
回答
查找位于另一个标记
BeautifulSoup
之前的标记
python
、
beautifulsoup
find_previous给出了一个特定标签之前的标签,但我想在<b>标签中查找<table>标签上的文本。<h2>Hi</h2><b>Output</b><table></table> 预期输出应为Output。我该怎么做呢?
浏览 15
提问于2018-01-04
得票数 1
回答已采纳
2
回答
Python +
BeautifulSoup
:找到一个
HTML
标记,其中属性包含匹配的文本模式?
python
、
html
、
beautifulsoup
我对Python和
BeautifulSoup
都很陌生。我试图找出如何只匹配标记,这些标记是<div>
元素
,包含属于属性的特定匹配文本模式。例如,所
有的
情况下,'id' : 'testid',或无处不在的'class' : 'title'。到目前为止,这就是我
所
拥
有的
: fh = open(filename, "r") soup =
浏览 0
提问于2018-11-15
得票数 2
回答已采纳
3
回答
Scrapy:如何获得用户的链接?
python
、
html
、
scrapy
html
:<div class="flex flex--row flex--noGutters flex--alignCenter"> <div class="flex-item _memberItem-module_name
浏览 0
提问于2020-09-15
得票数 0
2
回答
BeautifulSoup
不会
从网页中提取所有表单
python
、
html
、
forms
、
web-scraping
、
beautifulsoup
我希望从一个给定的网站使用Python3和
BeautifulSoup
提取所有表单。下面是一个执行此操作的示例,但无法提取所有表单:from bs4 import
BeautifulSoup
data = urlopen(url) parser =
BeautifulSoup
(data, '
h
浏览 0
提问于2017-03-27
得票数 2
2
回答
selenium和firefox Why驱动程序为什么不能爬行ajax加载的wesite标记
python
、
selenium
、
xpath
、
beautifulsoup
、
webdriverwait
我想从获得一些
HTML
标记的文本,其中一些
元素
是由ajax加载的(例如带有"ounce_top“id的标记)。我已经尝试过selenium和geckodriver,但是我再次无法爬行这些标记,而且当机器人firefox (geckodriver)打开时,这些
元素
不会
显示
在网页上!我不知道为什么会这样。法典审判:from bs4 import
BeautifulSoup
url_news = 'https
浏览 5
提问于2022-01-15
得票数 1
回答已采纳
1
回答
Python漂亮汤抓取桌
python
、
beautifulsoup
这是我到目前为止
所
拥
有的
。from bs4 import
BeautifulSoup
test=soup.findAll('d
浏览 6
提问于2014-04-02
得票数 2
回答已采纳
3
回答
您如何使用漂亮的汤和硒来刮阴影中的
html
?
python
、
selenium
、
web-scraping
、
beautifulsoup
、
shadow-dom
因此,我认为我应该使用selenium访问该网站,并使用此代码访问影子区域中的
元素
。driver.execute_script('return arguments[0].shadowRoot', element)并使用得到那个网站的
HTML
但是这段代码并没有向我展示阴影区域中的
元素
。root1 = driver.find_element(By.CSS_SELECTOR, "path1")
浏览 18
提问于2022-10-30
得票数 0
1
回答
用python列出网页中的链接
python
、
request
我遇到的问题是,这个网页有多个“页面”,所以它
不会
把所
有的
屏幕都弄乱。举个例子,看看。到目前为止,这就是我
所
拥
有的
:from bs4 import
BeautifulSoup
response = requests.get(url) soup =
Bea
浏览 1
提问于2017-08-09
得票数 1
回答已采纳
点击加载更多
热门
标签
更多标签
云服务器
ICP备案
对象存储
实时音视频
云点播
活动推荐
运营活动
广告
关闭
领券