python使用xpath中遇到：到底是什么？_Python

前言

大家在学习python爬虫的过程中，会发现一个问题，语法我看完了，说的也很详细，我也认真看了，爬虫还是不会写，或者没有思路，所以我的所有文章都会从实例的角度来解析一些常见的问题和报错。下面话不多说了，来一起看看详细的介绍吧。

Element是什么

回归正题，大家晕头转脑的看完繁杂的语法之后，已经迫不及待写点什么东西了，然后部分同学可能遇到了这个

<Element a at 0x39a9a80>

或者类似 Element a at 0x???????，这样的一个值，然后大家带着问题去搜，然后全是英文啊，什么一大堆乱七八糟的啊，英文不好的同学就崩溃了，在这里，我会重点解析一下

某种意义上来说，当你打印变量的时候得到的这个值，其实它是一个列表，然后列表中的每一个值都是一个字典

如何使用理解请看半成品开车实例，证明了本人非常擅长把学习和乐趣结合起来并且切身解决日常需求，滑稽脸.jpg

									from bs4 import BeautifulSoup

									from lxml import etree

									import requests

									gjc='SHKD-700'

									#定义URL

									html = "http://www.btanv.com/search/"+gjc+"-hot-desc-1"

									#解码URL

									html = requests.get(html).content.decode('utf-8')

									#解析成xml

									dom_tree = etree.HTML(html)

									#在xml中定位节点，返回的是一个列表

									links = dom_tree.xpath("//a[@class='download']")

									for index in range(len(links)):

									 # links[index]返回的是一个字典

									 if (index % 2) == 0:

									  print(links[index].tag)

									  print(links[index].attrib)

									  print(links[index].text)

实例解析

下面重点看看这个代码，

									print(links[index])

									print(type(links[index]))

									print(links[index].tag)#获取<a>标签名a

									print(links[index].attrib)#获取<a>标签的属性href和class

									print(links[index].text)#获取<a>标签的文字部分

打印出来的是

									<Element a at 0x3866a58>

									<class 'lxml.etree._Element'>

									a

									{'href': 'magnet:?xt=urn:btih:7502edea0dfe9c2774f95118db3208a108fe10ca', 'class': 'download'}

									磁力链接