Bagaimana cara menjatuhkan nilai null dari loop dinamis yang dihasilkan dari Python?

11

Saya memiliki bingkai data seperti ini:

   ORDER_NO         2401        2504         2600
    2020020         2019-12-04  2019-12-10   2019-12-12 
    2020024         2019-12-25  NaN          2019-12-20
    2020034         NaN         NaN          2019-12-20
    2020020         2019-12-12  2019-12-15   2019-12-18

Saya membuat XML dari bingkai data di atas. Saya ingin menghapus nilai nol yang terisi ke dalam XML. Kode saya harus menghapus nilai kolom dan baris tertentu dari XML.

Kode saya

header = """<ORD>{}</ORD>"""
body ="""
<osi:ORDSTSINF types:STSCDE="{}">
<DTM>{}</DTM>"""

cols = df.columns
for row in df.itertuples():
    with open(f'{row[1]}.xml', 'w') as f:
        f.write(header.format(row[1]))
        for c, r in zip(row[2:], cols[1:]):
            f.write(body.format(r, c))

Output saat ini untuk catatan 2

<ORD>2020024</ORD>
<osi:ORDSTSINF types:STSCDE="2401">
<DTM>2019-12-25</DTM>
<osi:ORDSTSINF types:STSCDE="2504">
<DTM>NaN</DTM>
<osi:ORDSTSINF types:STSCDE="2600">
<DTM>2019-12-20</DTM>

Output yang diharapkan untuk catatan 2

 <ORD>2020024</ORD>
    <osi:ORDSTSINF types:STSCDE="2401">
    <DTM>2019-12-25</DTM>
    <osi:ORDSTSINF types:STSCDE="2600">
    <DTM>2019-12-20</DTM>

Bagaimana ini bisa dilakukan dengan Python?

Ria Alves
sumber

Jawaban:

6

stack

Secara alami menjatuhkan nulls

header = """<ORD>{}</ORD>"""
body ="""
<osi:ORDSTSINF types:STSCDE="{}">
<DTM>{}</DTM>"""

for o, d in df.set_index('ORDER_NO').stack().groupby('ORDER_NO'):
    with open(f'{o}.xml', 'w') as f:
        f.write(header.format(o))
        for (o, s), date in d.iteritems():
            f.write(body.format(s, date))

Detail

df.set_index('ORDER_NO').stack()

ORDER_NO      
2020020   2401   2019-12-04
          2504   2019-12-10
          2600   2019-12-12
2020024   2401   2019-12-25
          2600   2019-12-20
2020034   2600   2019-12-20
2020020   2401   2019-12-12
          2504   2019-12-15
          2600   2019-12-18

BTW

Solusi Anda akan baik - baik saja dengan if

header = """<ORD>{}</ORD>"""
body ="""
<osi:ORDSTSINF types:STSCDE="{}">
<DTM>{}</DTM>"""

cols = df.columns
for row in df.itertuples():
    with open(f'{row[1]}.xml', 'w') as f:
        f.write(header.format(row[1]))
        for c, r in zip(row[2:], cols[1:]):
            if pd.notna(c):
                f.write(body.format(r, c))
piRquared
sumber
Saya baru saja menambahkan footer ( footer = """<END>123</END>"") tetapi output datang di baris yang sama, <DTM>2020-03-29</DTM><END>123</END>bukan baris baru.
Ria Alves
1
Saat Anda menggunakannya f.write, Anda tidak akan berasumsi untuk memasang '\n'. Anda mendapatkan mereka dari bodystring Anda . Tentukan footer = """\n<END>123</END>"""
catatan