经由过程id名查找
- print soup.select('#link1')
- #[<a class="sister" href=http://developer.51cto.com/art/201706/"http://example.com/elsie" id="link1"><!-- Elsie --></a>]
组合查找
学过 css 的都知道 css 选择器,如 p #link1 是查找 p 标签下的 id 属性为 link1 的标签
- print soup.select('p #link1') #查找p标签中内容为id属性为link1的标签
- #[<a class="sister" href=http://developer.51cto.com/art/201706/"http://example.com/elsie" id="link1"><!-- Elsie --></a>]
- print soup.select("head > title") #直接查找子标签
- #[<title>The Dormouse's story</title>]
查找时还可以参加属性元素,属性须要用中括号括起来,留意属性和标签属于同一节点,所以中心不克不及加空格,不然会无法匹配到。
- print soup.select('a[class="sister"]')
- #[<a class="sister" href=http://developer.51cto.com/art/201706/"http://example.com/elsie" id="link1"><!-- Elsie --></a>, <a class="sister" href=http://developer.51cto.com/art/201706/"http://example.com/lacie" id="link2">Lacie, Tillie]
- print soup.select('a[href=http://developer.51cto.com/art/201706/"http://example.com/elsie"]')
- #[<a class="sister" href=http://developer.51cto.com/art/201706/"http://example.com/elsie" id="link1"><!-- Elsie --></a>]
同样,属性仍然可以与上述查找方法组合,不在同一节点的空格隔开,同一节点的不加空格,代码如下:
属性查找
- print soup.select('p a[href=http://developer.51cto.com/art/201706/"http://example.com/elsie"]')
- #[<a class="sister" href=http://developer.51cto.com/art/201706/"http://example.com/elsie" id="link1"><!-- Elsie --></a>]
以上的 select 办法返回的结不雅都是列表情势,可以遍历情势输出,然后用 get_text() 办法来获取它的内容
推荐阅读
【51CTO.com原创稿件】进入2017年,记者异常明显地感到到,云办事的成长,已经成为城市之间比拼实力的重要赛道>>>详细阅读
地址:http://www.17bianji.com/lsqh/35763.html
1/2 1

网友点评
精彩导读
科技快报
品牌展示