这是我的代码,它将www.nytimes.com的标题保存在.txt文件中。else:
f.write(i.contents[0].strip()) 在代码中,这一行: for i in soup.find_all('p'): 这是为了发现所有的标题都不起作用它只需要几个第一个标题,而不是所有。 有没有更好的方法来写这一行,而不是去网站,然后检查,然后找到包含我需要的内容的标签。
几年前,我们建立了一个专门讨论我们产品的论坛,它位于一个子目录(maindomain.com/ forum )的同一个网站上。在某种程度上,我们发现Google网站管理员工具建议我们解决我们网站上的一些问题,其中大部分都是论坛主题页面。例如,由于我们使用的论坛引擎,我们在论坛页面上出现了许多“重复标题”错误。因此,问题是:我们是否应该躲过搜索引擎机器人的论坛,以避免这些错误(在他们的“眼中”),从而提高我们的排名?它是好的,在所有开放论坛,如我们的索引,以拥有