腾讯云
开发者社区
文档
建议反馈
控制台
登录/注册
首页
学习
活动
专区
圈层
工具
MCP广场
文章/答案/技术大牛
搜索
搜索
关闭
发布
文章
问答
(9999+)
视频
沙龙
1
回答
C#
爬虫
程序
无法
加载
动态
内容
c#
、
request
、
web-crawler
、
abot
爬虫
可以正确地请求页面,但问题是几乎所有
内容
都是通过knockout.js
动态
加载
的。
爬虫
程序
目前
无法
请求此
内容
,这导致只
加载
了页面的一小部分。我试着让
程序
等待,希望
动态
的请求无论如何都会被发送,但这似乎不起作用。如何才能使crawler请求所有数据? 谢谢!
浏览 12
提问于2019-07-09
得票数 0
1
回答
对于
动态
参数的前端路由,像
动态
seo这样的情况,prerender.io能帮上忙吗?
ruby-on-rails
、
seo
、
frontend
、
googlebot
、
prerender
详细问题可在此链接中找到- 现在,在这种情况下,为不同的categoryId做搜索引擎优化似乎是不可能的,因为谷歌机器人不会在爬行时等待我的服务器响应。
浏览 1
提问于2016-04-29
得票数 0
1
回答
在同构React上处理SEO
express
、
reactjs
、
seo
、
react-router
、
isomorphic-javascript
我正在使用React & Node JS来构建通用应用
程序
()。我也使用反应头盔作为库来处理页面标题,元,描述等,但我有一些问题,当我使用ajax
动态
加载
内容
时,谷歌
爬虫
无法
正确获取我的网站,因为
内容
将被
动态
加载
。有什么建议来解决这个问题吗?谢谢!
浏览 1
提问于2016-09-26
得票数 0
3
回答
如何让搜索引擎找到我的AJAX
内容
php
、
ajax
、
seo
我有一个页面,通过AJAX
动态
加载
一节
内容
。我担心这意味着
内容
不会被搜索引擎找到。 为了向你展示我的意思,网站在,
动态
内容
在 -通常没有人会访问第二个链接,它只是
加载
到第一个页面中。我知道我可以通过使用sitemap.xml告诉
爬虫
程序
读取speakers.php,但然后我会在搜索结果中显示指向speakers.php的链接。我猜最终的解决方案是,如果有人请求/speakers.php,它会将他们重定向到主页,而让
爬
浏览 3
提问于2008-10-22
得票数 1
回答已采纳
2
回答
为什么Google不索引我的AJAX获取的
内容
?
ajax
、
reactjs
该页面有一些静态组件,例如导航条和页脚,它在获取数据之前显示一个
加载
程序
,但奇怪的是,当我提交url作为Google进行抓取时,它显示的是一个完全空白的页面。对我来说,这似乎很奇怪,因为我预期如果Google不等待我的AJAX调用的返回,它至少应该向我展示作为Google结果的Fetch中的导航条、脚注和
加载
程序
。
浏览 5
提问于2017-08-29
得票数 0
回答已采纳
1
回答
具有标签的
动态
url的社交共享
javascript
、
facebook
、
metadata
、
share
、
hashtag
我正在构建一个客户端插件,它的功能非常类似于第三方应用
程序
中的图像/文章图库。 当在图库中点击一篇文章/图片时,页面的url标签会被修改,这样每一张图片/文章都会有一个绝对的url。在尝试为每一张图片添加Facebook分享/点赞按钮时,我遇到了以下问题- Facebook (或Twitter)将抓取原始页面并获取父页面的元数据,但不会获取正在共享/点赞的图片/文章的实际
内容
。据我所知,没有通过API的
动态
方式来告诉FB在提要上放置哪些
内容
。但是,对于此项目,提要
浏览 0
提问于2016-03-26
得票数 0
4
回答
如何通过
爬虫
php获取悬停数据(Ajax)
php
、
hover
、
web-crawler
、
simple-html-dom
我能够在一个页面上显示完整的
内容
。但页面上的一些数据是在一些图标上悬停并显示为工具提示后出现的。所以我也需要这些数据。有没有可能用任何
爬虫
。 我使用PHP和来解析/抓取页面。
浏览 3
提问于2012-03-30
得票数 3
回答已采纳
3
回答
Google crawl ajax /
动态
生成的
内容
- SEO
ajax
、
web-crawler
、
seo
、
google-crawlers
我有一个电子商务模块,是
动态
加载
/嵌入到第三方网站,没有iframe直接的JSON到web客户端的
内容
。除了我的javascript文件从它们的页面
加载
并
动态
生成
内容
之外,我根本
无法
访问这些第三方站点。 我知道#!方法,但这在这里不好,我的JS确实在嵌入式平台中生成"urls“,但它们是假的,并且仅用于地址栏,我不相信google
爬虫
能到达这么远。所以我的问题是,有没有一个元可以设置为指向url之外的地方,即返回到我的服务器上的静态
浏览 0
提问于2013-03-02
得票数 2
回答已采纳
1
回答
动态
内容
和
爬虫
javascript
搜索引擎
爬虫
会使用Javascript和API调用来索引
动态
加载
的
内容
吗?或者我必须通过服务器端编程(PHP、ASP等)
加载
此
内容
。
浏览 7
提问于2012-09-03
得票数 1
回答已采纳
2
回答
angular2服务器端呈现:
动态
内容
angular
、
seo
、
google-crawlers
、
angular-universal
但是,对于应用
程序
启动时
动态
加载
的
内容
,这是如何工作的呢?
爬虫
会在索引页面之前等待那些挂起的请求吗?还是我必须指定我的Angular2应用
程序
的特定状态,它告诉服务器我的应用
程序
已经准备好发送到客户机(在本例中是
爬虫
)?
浏览 5
提问于2017-02-07
得票数 1
回答已采纳
1
回答
使用javascript对SEO友好的条件
加载
javascript
、
mobile
、
conditional
、
loading
、
seo
使用Javascript
加载
桌面或大屏幕HTML 不过,我在这里有个问题。据我所知,我将使用javascript
加载
的HTML
内容
不会被搜索引擎读取?谁能告诉我,是否可以做SEO友好的条件
加载
使用Javascript?或者,我是否需要查看服务器端语言即PHP/ASP来使用设备检测
加载
内容
?
浏览 6
提问于2012-10-18
得票数 4
回答已采纳
3
回答
爬虫
如何确保最大的覆盖率?
search
、
search-engine
、
web-crawler
根据他们的说法,网络
爬虫
只使用其他网页检索到的URL,并通过树(实际上是网格) 在这种情况下,
爬虫
如何确保最大的覆盖率。显然,可能有很多网站没有来自其他页面/网站的推荐链接。(我们
无法
预测结果。如果我们选择100个没有引用链接的站点,引擎将只显示100个站点+它们的内部页面)
浏览 9
提问于2009-06-04
得票数 4
回答已采纳
2
回答
元标记不应该使用JS
动态
更改吗?
javascript
、
html
、
meta-tags
如果我想要更改数据,我可以使用JS来完成,而无需重新
加载
页面。百事大吉。 但是,现在,我了解到元标签不能使用js更改,应该让它重新
加载
/刷新page...is,这是正确的吗?
浏览 14
提问于2019-08-18
得票数 2
5
回答
C#
中的网页爬行
c#
、
web-crawler
我通常使用HTML Agility Pack和
C#
来解析网站
内容
。其中之一如下所示: 如果您搜索*(所有图书),它将返回许多图书列表,每页以10本图书为分页。我发现典型的网络
爬虫
在这个网站上失败了。我还尝试编写自己的
爬虫
程序
,它将遍历页面上的所有链接,并生成post/get变量以
动态
生成结果。该网站依靠javascript生成
内容
,并使用GET和POST变量提交的混合模式。
浏览 1
提问于2010-12-22
得票数 3
回答已采纳
1
回答
64位进程中的AnyCPU
C#
DLL
无法
引用64位C++ DLL(出现错误:
无法
加载
文件或
程序
集)
c#
、
c++
当我提供64位C++
动态
链接库作为对
C#
项目的引用时,它将生成AnyCPU
C#
动态
链接库。我能够生成
C#
动态
链接库,但是当我启动应用
程序
时出现错误, 类型: System.BadImageFormatException,mscorlib,Version=4.0.0.0,Culture=neutral,PublicKeyToken=xxxxxxxx消息:
无法
加载
文件或
程序
集'MyDLLName,Versio
浏览 65
提问于2018-08-21
得票数 0
回答已采纳
4
回答
如何延迟google爬行直到页面准备就绪
jquery
、
seo
、
google-search
在页面
加载
之后,我在jQuery.ready(...)上有一个jQuery.ajax({}),然后我使用一些json数据填充
内容
。我只是想可能会有一个参数,让google知道当他们爬行时,有一个ajax请求填充页面的
内容
。 原因..。SEO我需要一个比拥有please wait...更好的机会
浏览 0
提问于2012-03-23
得票数 1
回答已采纳
1
回答
Google bot ajax索引的当前状态
jquery
、
ajax
、
googlebot
我有显示一些列表的链接:页面
加载
后,jQuery会
动态
加载
内容
:});我以Google Bot的形式获取站点,但html没有ajax
内
浏览 3
提问于2012-02-16
得票数 2
2
回答
测试我的网站在
程序
中是如何显示的
python
、
html
、
google-app-engine
、
browser
、
search-engine
网站不仅可以被浏览器上的用户访问,还可以被
程序
、机器人和
爬虫
访问。我有一个运行在上的带有python的网站,它具有由python
程序
通过组合、合并和循环字符串生成的非静态HTML页面。但是,它们也不是
动态
页面,因为生成这些页面不需要用户输入。python生成
内容
完全是为了方便、简洁和易于维护,并且完全由url设置。 一些搜索引擎
无法
对
动态
页面进行索引。我想知道这些页面是否符合“
动态
”,即它们是否可以被这类机器人为通常的元数据和
内容
进行
浏览 5
提问于2012-01-09
得票数 0
回答已采纳
6
回答
如何让搜索
爬虫
正确地索引无限滚动的页面?
web-crawler
、
infinite-scroll
我有一个网站,我在上面实现了无限滚动:当用户到达页面的末尾时,就会进行AJAX调用,并将新
内容
附加到页面的底部。然而,这意味着搜索
爬虫
无法
获得第一个“分页符”之后的所有
内容
。实际上有几十个这样的项目,但
爬虫
只能看到前10个项目,因为其他项目是根据
内容
相对于浏览器窗口的位置
加载
的。由于
爬虫
没有浏览器窗口,所以根本不会
加载
新项目。那么,什么才是正确的方式,让搜索
爬虫
通过无限滚动访问网页的全部
内容
,同时又
浏览 0
提问于2012-05-28
得票数 13
回答已采纳
1
回答
带有简单
动态
内容
"listener“的Perl webcrawler
perl
、
web-crawler
我正在尝试用Perl做一个简单的网络
爬虫
,但是很多网站都有
动态
内容
加载
,例如,使用javascript函数: $("#blabla").load('blublu/bla.php');因此,我正在尝试调整我已经拥有的网络
爬虫
(获取HTML
内容
),以“等待”这些脚本
加载
,然后才获取整个(和完整)网站
内容
(HTML)。
浏览 2
提问于2013-01-15
得票数 2
回答已采纳
点击加载更多
热门
标签
更多标签
云服务器
ICP备案
对象存储
云点播
实时音视频
活动推荐
运营活动
广告
关闭
领券