Python如何解析xml[xml.dom]

發(fā)布時(shí)間：2021-01-25 10:04:38 來(lái)源：億速云閱讀：201 作者：小新欄目：編程語(yǔ)言

這篇文章主要介紹了Python如何解析xml[xml.dom] ，具有一定借鑒價(jià)值，感興趣的朋友可以參考下，希望大家閱讀完這篇文章之后大有收獲，下面讓小編帶著大家一起了解一下。

需求

有一個(gè)表，里面數(shù)據(jù)量比較大，每天一更新，其字段可以通過(guò)xml配置文件進(jìn)行配置，即，可能每次建表的字段不一樣。上游跑時(shí)會(huì)根據(jù)配置從源文件中提取，到入庫(kù)這一步需要根據(jù)配置進(jìn)行建表。

解決

寫(xiě)了一個(gè)簡(jiǎn)單的xml，配置需要字段及類型上游讀取到對(duì)應(yīng)的數(shù)據(jù)入庫(kù)這一步，先把原表刪除，根據(jù)配置建新表

XML文件

name="top_query" db_name="evaluting_sys">
id
query
varchar(200)
false
query
pv
integer
false
pv
avg_money
integer
false

處理腳本

#!/usr/bin/python
# 
-*- coding:utf-8 -*-
#author: 
wklken
#desc: 
use to read db xml config.
#-----------------------
#2012-02-18 
created
#----------------------
import sys,os
from xml.dom import minidom, Node
def read_dbconfig_xml(xml_file_path):
content = {}
root = minidom.parse(xml_file_path)
table = root.getElementsByTagName("table")[0]
#read dbname and table name.
table_name = table.getAttribute("name")
db_name = table.getAttribute("db_name")
if len(table_name) > 0 and len(db_name) > 0:
db_sql = "create database if not exists `" + db_name +"`; use " + db_name + ";"
table_drop_sql = "drop " + table_name + " if exists " + table_name + ";"
content.update({"db_sql" : db_sql})
content.update({"table_sql" : table_drop_sql })
else:
print "Error:attribute is not define well! db_name=" + db_name + " ;table_name=" + table_name
sys.exit(1)
#print table_name, db_name
table_create_sql = "create table " + table_name +"("
#read primary cell
primary_key = table.getElementsByTagName("primary_key")[0]
primary_key_name = primary_key.getElementsByTagName("name")[0].childNodes[0].nodeValue
table_create_sql += primary_key_name + " INTEGER NOT NULL AUTO_INCREMENT PRIMARY KEY,"
#print primary_key.toxml()
#read ordernary field
fields = table.getElementsByTagName("field")
f_index = 0
for field in fields:
f_index += 1
name = field.getElementsByTagName("name")[0].childNodes[0].nodeValue
type = field.getElementsByTagName("type")[0].childNodes[0].nodeValue
table_create_sql += name + " " + type
if f_index != len(fields):
table_create_sql += ","
is_index = field.getElementsByTagName("is_index")[0].childNodes[0].nodeValue
table_create_sql += ");"
content.update({"table_create_sql" : table_create_sql})
#character set latin1 collate latin1_danish_ci;
print content
if __name__ == "__main__":
read_dbconfig_xml(sys.argv[1])

涉及方法

root = minidom.parse(xml_file_path) 獲取dom對(duì)象

root.getElementsByTagName(“table”) 根據(jù)tag獲取節(jié)點(diǎn)列表

table.getAttribute(“name”) 獲取屬性

primary_key.getElementsByTagName(“name”)[0].childNodes[0].nodeValue 獲取子節(jié)點(diǎn)的值（id 得到id）

感謝你能夠認(rèn)真閱讀完這篇文章，希望小編分享的“Python如何解析xml[xml.dom] ”這篇文章對(duì)大家有幫助，同時(shí)也希望大家多多支持億速云，關(guān)注億速云行業(yè)資訊頻道，更多相關(guān)知識(shí)等著你來(lái)學(xué)習(xí)!

向AI問(wèn)一下細(xì)節(jié)

Python如何解析xml[xml.dom]

猜你喜歡

最新資訊

相關(guān)推薦

相關(guān)標(biāo)簽