腾讯云
开发者社区
文档
建议反馈
控制台
登录/注册
首页
学习
活动
专区
圈层
工具
MCP广场
文章/答案/技术大牛
搜索
搜索
关闭
发布
文章
问答
(9999+)
视频
沙龙
0
回答
提取
具有
特定
属性
的
HTML
标签
的
内容
html
、
node.js
、
regex
使用正则表达式,我需要
提取
标记
的
多行
内容
,它
具有
特定
的
id值。我该怎么做呢?<div(.|\n)*?id="${value}"(.|\n)*?>(.|\n)*?<\/div><div id="1">test</div><div id="2">test</div> 如
浏览 2
提问于2017-06-10
得票数 0
3
回答
regex从所有meta标记中
提取
所有
属性
php
、
regex
、
preg-match-all
、
meta-tags
我正在尝试从一个
html
页面中
提取
meta
标签
,来比较两个页面(live和dev),看看在网站重新设计/重构后,它们
的
SEO是否相同。我
的
问题是获取元
标签
只有在它们
具有
name=
属性
时才有效,这与"mariano at Cricava.com“
的
解决方案相同。我不想限制它
具有
特定
的
属性
,我可以假设我们所有的元
标签
都有一个nam
浏览 3
提问于2011-07-17
得票数 1
回答已采纳
1
回答
如何使用nutch插件解析位于
特定
HTML
标签
中
的
内容
?
nutch
我正在使用Nutch抓取网站,我想分析由Nutch抓取
的
html
页面的
特定
部分。我知道我必须创建一个用于自定义解析
的
插件,因为Nutch提供
的
htmlparser插件会删除所有的
html
标签
、css和javascript
内容
,只留下文本
内容
。我参考了这个博客,但我发现它是用来解析
html
标签
的
,而我想解析
的
是
具有
特定
值
的
浏览 3
提问于2013-07-31
得票数 7
1
回答
如何使用xpath为这种
html
提取
所有的常规段落?
python
、
html
、
xpath
、
html-parsing
url = "“我想
提取
新闻
的
所有常规段落,即没有任何
属性
的
所有
标签
<p>。我使用:content = [p.xpath("normalize-space(.)") for p in hxs.xpath("//span[@id='content']/p[not(@*)]")
浏览 1
提问于2016-07-14
得票数 2
1
回答
在一个动态方面聚合
具有
不同元数据
内容
的
结果
google-search-appliance
我们需要将不同
的
内容
合并到一个单一
的
过滤器中。
属性
的
显示
标签
出现在“搜索结果”页面上。显示
标签
可以与为实体识别而配置
的
实体名称或
HTML
中
的
属性
不同。例如,对于以下元标记<META NAME="pub"
浏览 2
提问于2016-01-15
得票数 0
回答已采纳
3
回答
Jquery选择
具有
特定
属性
的
所有对象
jquery
、
jquery-ui
我想选择页面上
具有
特定
属性
的
所有元素。 例如,我有一个名为"tip"
的
属性
,我将tip="...whatever..."添加到很多
html
标记中。我希望能够选择
具有
此
属性
的
所有
html
标签
。并不是所有
具有
该
属性
等于
特定
值
的
html
标签
。
浏览 2
提问于2010-12-18
得票数 0
回答已采纳
1
回答
如何使用(ActionScript 3) RegEx匹配
具有
可选
属性
、一个
特定
属性
/值
的
标签
,并保留其
内容
?
regex
、
actionscript
我对regex并不陌生,但遇到了一个我似乎无法解决
的
问题。我试图找到一个
具有
特定
属性
/值对
的
特定
HTML
标记(它也可能有其他
属性
,但这些
属性
是可选
的
),
提取
它
的
内容
作为反向引用,并在它周围包装一个新
的
自定义标记。原始
标签
为: <p backgroundColor="#0066cc" color
浏览 2
提问于2011-03-04
得票数 0
6
回答
正则表达式是查找一行
HTML
的
合适工具吗?
php
、
regex
、
html
我有一个PHP脚本,可以从服务器上
提取
一些
内容
,但问题是
内容
所在
的
行每天都在变化,所以我不能只
提取
特定
的
行。但是,
内容
包含在
具有
唯一id
的
div中。regex是否可以(也是最好
的
方式)搜索这个唯一
的
id,然后将它所在
的
行传递回我
的
脚本?示例:<
html
><head>&l
浏览 0
提问于2009-11-19
得票数 4
回答已采纳
1
回答
当选定选项上下文参数不存在时,在VisualStudio2013Webtest中禁用WebTestException
visual-studio-2013
、
web-testing
也就是说,这个
Html
标记存在于:但它没有像这样
的
子
标签
:我还尝试使用“
提取
属性
值”
提取
规则在下拉列表中
提取
选定
的
项,因为后一条规则
具有
“必需”
属性
。规则是查找
具有
属性
"selected=se
浏览 0
提问于2016-01-29
得票数 0
回答已采纳
2
回答
从不带class或id
的
HTML
中选择图像
标签
属性
python
、
lxml
我有
HTML
页面解析通过Python与Lxml。问题是我必须从
HTML
图像标记中获取值,这些值没有任何class或id
属性
。</td></td></tbody></table> 所以,为了解决我
的</e
浏览 0
提问于2012-07-17
得票数 0
2
回答
使用Solr为带有
属性
的
HTML
标记建立索引
solr
、
nutch
我使用Nutch抓取网站,并将抓取
的
数据推送到solr。现在我想在
具有
特定
属性
值
的
特定
标签
之间搜索
内容
。如果我必须写一个插件,我只需要几个方向来处理
html
标签
和
属性
。
浏览 3
提问于2013-06-27
得票数 1
2
回答
匹配1个
html
文件中
的
2个
HTML
标记
的
正则表达式
php
、
html
、
regex
、
html-parsing
我有一个
HTML
文件,其中包含以下
内容
:<something:else bla="blabla" bla="bla"><something:else2 something="something">现在我需要一个正则表达式来匹配MATC
浏览 0
提问于2010-12-25
得票数 3
1
回答
如何使用BeautifulSoup获取over标记内
的
内容
beautifulsoup
、
html-parsing
我想从一个超文本标记语言片段中
提取
内容
(“_The_important_content_”),如下所示: </div>for i in soup.findAll('div', class_="a:2 c:gray m:da"):但是因为“BeautifulSoup”字段包含新
的</em
浏览 2
提问于2017-10-07
得票数 0
2
回答
如果url可用,则显示
html
块
html
我需要显示一个
html
块,如果
特定
的
链接是可用
的
,而不使用javascript。换句话说,我需要反转
具有
data
属性
的
object
标签
的
行为,例如:如果error.src不可用,则显示
内容
。
浏览 3
提问于2016-10-28
得票数 1
4
回答
大规模抓取/解析
的
技术是什么?
parsing
、
screen-scraping
、
large-data-volumes
我们正在设计一个大规模
的
web抓取/解析项目。基本上,脚本需要遍历网页列表,
提取
特定
标记
的
内容
,并将其存储在数据库中。如果要进行大规模(数千万页?)
的
操作,您建议使用哪种语言?。我们使用MongoDB作为数据库,因此任何
具有
可靠MongoDB驱动程序
的
都是一个加号。到目前为止,我们一直在使用PHP、curl和,但我不认为它们可以扩展到数百万个页面,特别是在PHP没有适当
的
多线程
的
情况下。我们需要一些易于开发
浏览 1
提问于2010-06-30
得票数 8
2
回答
使用正则表达式删除表内
的
width标记
javascript
、
html
、
css
、
regex
在将
内容
保存到数据库之前,我正在做一些
html
处理。当用户粘贴任何有
html
表格
的
内容
时,我需要删除一些
标签
和
属性
。 我正在通过content.match('<table[^>]*>(.*?)</table>')
提取
表格
内容
。在这个
内容
中,它有width
标签
作为
属性
,也有style
标签
。我想要像<t
浏览 0
提问于2016-06-10
得票数 1
4
回答
如何使用DOM节点
的
属性
找到它
java
、
html
、
parsing
、
dom
我使用JAVA在编译时将
HTML
/JSP解析为DOM。现在我有了w3c.dom.Document对象,比方说下面的
HTML
....我知道元素
的
属性
值。这里,"EnterName“是节点”输入“
的
”名称“
属性
值。假设我拥有DOM中所有可用节点
的
属性
值(比如上面
HTML
的
"EnterName“、"SelectOptions”),那么如何才能获得
特定</em
浏览 5
提问于2012-11-08
得票数 2
回答已采纳
2
回答
简单
的
HTML
DOM获取meta标记
的
特殊
属性
值
html
、
dom
、
attributes
我想在我
的
项目中使用<
html
><body><body>我在下面尝试,但它不起作用 echo $
html
浏览 0
提问于2015-05-22
得票数 2
2
回答
HTML
解析和
提取
文本
html-parsing
、
jsoup
、
text-extraction
有许多资源可用于解析
HTML
页面和
提取
文本
内容
。Jsoup就是一个例子。在我
的
例子中,我想
提取
带有
html
标签
的
文本
内容
,每个句子都在
html
标签
下出现。to extract <b>textual content <em> with
html
tags</em> </b> from
html
pa
浏览 6
提问于2012-08-27
得票数 2
回答已采纳
2
回答
试图使用Python从标记中
提取
“文本”
python
、
html
我试图在这个页面的第一列()上
提取
代理IP号,例如:"178.33.62.155“,但是当我试图
提取
相关
标签
上
的
所有文本
内容
时,它不会得到Ip文本。网站上
的
html
标签
是: <td align="left"><script>document.write('23178.3'.substr(2) + '3.62.155');</script>
浏览 3
提问于2017-05-14
得票数 1
回答已采纳
点击加载更多
热门
标签
更多标签
云服务器
ICP备案
对象存储
即时通信 IM
云直播
活动推荐
运营活动
广告
关闭
领券