[[
it:terc-to-csv
]]
Narzędziownik
Ślad:
Pokaż stronę
Administracja
Ostatnie zmiany
Indeks
Zaloguj
Szukaj
Zobacz także
bip.gov.pl
inspektoraty_sanitarne
opp
sady
urzedy_skarbowe
uniki
bzdury
doreczenie-elektroniczne
faq
old-long
podpis_elektroniczny
zapytanie-o-bip
wnioski
ministerstwa-o-rejestry-umow
archiwum
procedura
prokuratura
baza
okregowe
opracowanie
do_wojewodow_o_decyzje_tuska
epuap-baza
kgp-art-269b
wykaz-rejestry-umow
2013
2014
2015
2016
uchwaly
1001-tez
bip
etpc
plan-nadzoru
poradnik
rzecznicy-prasowi
slownik
sprawnosc
statutu-i-akty-generalne
szkola
to-do
zarzadzenia
zaskarzanie-bip
Ostatnie zmiany
Ta strona jest tylko do odczytu. Możesz wyświetlić źródła tej strony ale nie możesz ich zmienić.
====== Usage ====== <code bash>$ python TERC.py TERC.xml TERC.csv</code> ====== Code ====== <code python> import sys import csv, codecs, cStringIO from lxml import etree class UnicodeWriter: """ A CSV writer which will write rows to CSV file "f", which is encoded in the given encoding. """ def __init__(self, f, dialect=csv.excel, encoding="utf-8", **kwds): # Redirect output to a queue self.queue = cStringIO.StringIO() self.writer = csv.writer(self.queue, dialect=dialect, **kwds) self.stream = f self.encoder = codecs.getincrementalencoder(encoding)() def writerow(self, row): self.writer.writerow([s.encode("utf-8") for s in row]) # Fetch UTF-8 output from the queue ... data = self.queue.getvalue() data = data.decode("utf-8") # ... and reencode it into the target encoding data = self.encoder.encode(data) # write to the target stream self.stream.write(data) # empty queue self.queue.truncate(0) def writerows(self, rows): for row in rows: self.writerow(row) xml = etree.parse(open(sys.argv[1])) catalog = xml.getroot()[0] with open(sys.argv[2],'wb') as fp: writer = UnicodeWriter(fp) writer.writerows(map(lambda x: map(lambda x: x.text or '',x), catalog)) </code> ====== Wynik ====== Dla {{:it:terc.xml|TERC.xml}} z http://www.stat.gov.pl/broker/access/prefile/listPreFiles.jspa dało {{:it:terc.csv|TERC.csv}} o wiele lżej niż oficjalny [[http://www.stat.gov.pl/bip/389_112_PLK_HTML.htm|program do konwersji]]. ~~DISCUSSION~~
it/terc-to-csv.txt
· ostatnio zmienione: 2013/10/06 15:58 przez
naczelnik
Pokaż stronę
Poprzednie wersje
Menadżer multimediów
Do góry