Postinumeroiden noutaminen Pythonilla webistä

soppakokeilu

Tein tuossa huvikseni pienen funktion, jolle annetaan parametreinä katuosoite ja kunta. Se palauttaa sitten listamuodossa kadut ja ko. postinumerot. Oletuksena esim Helsinginkatu Helsingistä palauttaa:

['Helsinginkatu', '56', '58', '00260', 'HELSINKI', 'Helsinki']
['Helsinginkatu', '1', '19', '00500', 'HELSINKI', 'Helsinki']
['Helsinginkatu', '2', '16', '00500', 'HELSINKI', 'Helsinki']
['Helsinginkatu', '21', '25', '00510', 'HELSINKI', 'Helsinki']
['Helsinginkatu', '18', '50', '00530', 'HELSINKI', 'Helsinki']

Jossa ensin katu, sitten katunumeroiden ala- ja yläarvot (jos on, muuten tyhjää), postinumero, postitoimipaikka ja kunta.

Seuraavaksi pitää kehitellä suodatus katunumeroiden perusteella, niin saa listaa lyhyemmäksi. Jos katuosoitteen numerokin on annettu, niin periaatteessahan ei pitäisi tulla kuin yksi postinumero.

Main-funktiossa oleva pääohjelma kyselee tietoja, ja jos laittaa pelkän katuosoitteen, niin kuntana on Helsinki. Pelkän katuosoitteen syöttämällä lopetetaan.

Koodista sitten pitää korvata "--->" neljällä välilyönnillä " ", koska tämä foorumi sotkee sisennykset.

Käytin Python 3:sta ja lisäksi pitää asentaa BeautifilSoup esim. komennolla:

sudo apt-get install python3-bs4

# koodi alkaa

from bs4 import BeautifulSoup
import requests
from urllib.request import urlopen
from requests.utils import quote

def haePostinumero(osoite="helsinginkatu",kunta="helsinki"):

--->url="http://www.verkkoposti.com/e3/"\
--->---> "postinumeroluettelo?streetname="\
--->---> quote(osoite.encode('ISO-8859-1'))\
--->---> "&postcodeorcommune="\
--->---> quote(kunta.encode('ISO-8859-1'))

--->html=urlopen(url).read().decode("ISO-8859-1")

--->lista=[]

--->if html.find("Postinumerohaun tulos") > 0:
--->--->soup=BeautifulSoup(html,"lxml")
--->--->table = soup.find(class_="hidden-xs")
--->--->kadut=table.find_all("td")
--->--->for katu in range(0,len(kadut),4):
--->--->--->rivi=[]
--->--->--->katunimi=""
--->--->--->katunro1=""
--->--->--->katunro2=""
--->--->--->postinro=""
--->--->--->toimipaikka=""
--->--->--->kunta=""
--->--->--->katun=kadut[katu].find_all("div")
--->--->--->if len(katun) > 0:
--->--->--->--->if len(katun) > 1:
--->--->--->--->--->katul=katun[1].string.strip().split(' ')
--->--->--->--->else:
--->--->--->--->--->katul=katun[0].string.strip().split(' ')
--->--->--->--->if len(katul) == 1:
--->--->--->--->--->katunimi=katul[0].strip()
--->--->--->--->if len(katul) == 2 or len(katul) == 4:
--->--->--->--->--->katunimi=katul[0].strip()
--->--->--->--->--->katunro1=katul[1].strip()
--->--->--->--->if len(katul) == 4:
--->--->--->--->--->katunro2=katul[3].strip()
--->--->--->toimip=kadut[katu 2].string.strip().split('\n')
--->--->--->postinro=toimip[0].strip()
--->--->--->toimipaikka=toimip[2].strip()
--->--->--->kunta=kadut[katu 3].string.strip()
--->--->
--->--->--->rivi.append(katunimi)
--->--->--->rivi.append(katunro1)
--->--->--->rivi.append(katunro2)
--->--->--->rivi.append(postinro)
--->--->--->rivi.append(toimipaikka)
--->--->--->rivi.append(kunta)
--->--->--->lista.append(rivi)

--->return lista

def main():
--->while True:--->--->
--->--->postinumerot=[]
--->--->kyskatu=input("Katuosoite: ")
--->--->kyskunta=input("Kunta: ")
--->--->if len(kyskatu)>0 and len(kyskunta)>0:
--->--->--->postinumerot=haePostinumero(kyskatu,kyskunta)
--->--->elif len(kyskatu)==0 and len(kyskunta)>0:
--->--->--->break
--->--->elif len(kyskatu)>0 and len(kyskunta)==0:
--->--->--->postinumerot=haePostinumero(osoite=kyskatu)
--->--->else:
--->--->--->postinumerot=haePostinumero()

--->--->for postinumero in postinumerot:
--->--->--->print(postinumero)


if __name__ == "__main__":
--->main()
--->

12

1192

    Vastaukset

    Anonyymi (Kirjaudu / Rekisteröidy)
    5000
    • Koodi-tuonne-vaivatonta

      Aivan just, tää sivusto on erittäin huono silloin kun pitää välittää toiselle ohjelmakoodia. Python jos mikä on vielä erittäin tarkka syntaksistaan. Sinun kannattaa tehdä tili tuonne http://pastebin.com sivulle, joka on juuri tätä varten.

      Sinne kun koodidisi laitat, ja vielä valitset sieltä sen python kohdan, niin jopa on helppo ja nopea toisen testata.

      Linux Mint 18 Sarah
      Xfce 64-bit

      • soppakokeilu

        Kiitos vinkistä, otin käyttöön tuon Pastebinin. Ensimmäinen kokeilu:

        http://pastebin.com/tFfGPZGd

        Tein toisen funktion "postiNroToimipaikka()", joka hyödyntää aikaisempaa webistä tiedot hakeavaa "haePostinumero()"-funktiota. Se palauttaa nyt hakua vastaavan merkkijonon muodossa "postinro postitoimipaikka". Lisäksi on yksi apufunktio "suodataOsoite()", jolla suodatetaan katuosoitteesta pois mahdolliset rappujen kirjaimet ja huoneistojen numerot, koska postin haku ei niitä aina ymmärrä.

        Esim:
        suodataOsoite("Jokuosoite 1 A 2")
        palauttaa: "Jokuosoite 1".

        Oletuksena kunta on Helsinki, esim:

        osoite=suodataOsoite("Mannerheimintie 15")
        lista=haePostinumero(osoite=osoite)
        print(postiNroToimipaikka(osoite=osoite,lista=lista))

        tulostaa: 00260 HELSINKI

        Jos kunta on toinen, niin esim:

        osoite=suodataOsoite("Saapastie 2")
        kunta="Pirkkala"
        lista=haePostinumero(osoite,kunta)
        print(postiNroToimipaikka(osoite,kunta,lista))

        tulostaa: 33950 PIRKKALA


    • Ahkera-koodari-oot

      Kirjoitatko Windows ympäristössä, koska rivien

      109. kyskatu=input("Katuosoite: ")
      110. kyskunta=input("Kunta: ")

      input() funktio ottaa vastaan luku muotoista tietoa ja minä jouduin tuo muuttamaan muotoon:

      109. kyskatu=raw_input("Katuosoite: ")
      110. kyskunta=raw_input("Kunta: ")

      koska raw_input() funktio ottaa vastaan merkkijonoja.

      Lisäksi tuo suodin on niin tehokas että lähes aina tulee osoitteen sijasta

      "Useampi kuin yksi vaihtoehto"

      Saattaa olla että tuon tekstin sijaan kuuluusi tulla

      "Haku ei tuottanut tulosta"

      Linux Mint 18 Sarah
      Xfce 64-bit

      • Unohtu-tuo-kuva

      • soppakokeilu

        Käyttelen siis Python 3 -versiota, jossa ei ymmärtääkseni ole enää tuota raw_input()-funktiota lainkaan, vaan pelkkä input(). Lisäksi esim. print on korvauttu funktiolla print(). Linuxilla teen ja Idlellä.

        Haku "kemi" ja "kemi" palauttaa vain sen sanoman "Useampi kuin yksi vaihtoehto". Se johtuu siitä, että silloin Postin palvelu palauttaa liikaa arvoja, eli samalle haulle ei ole yksittäistä tulosta. Tuonhan se siis käytännössä tekee:

        https://www.verkkoposti.com/e3/postinumeroluettelo?streetname=kemi&postcodeorcommune=kemi

        Näyttäisi sinulla menevän merkistökoodaus väärin. Kopioin äsken pastebinistä ja kokeilin, niin minulla toimii silti aivan kuten pitääkin, eli pastebin ei ainakaan ole syyllinen.

        Auttaakohan jos laittaa ensimmäiseksi riviksi koodiin?

        # -*- coding: utf-8 -*-


      • Toimiiko-sulla
        soppakokeilu kirjoitti:

        Käyttelen siis Python 3 -versiota, jossa ei ymmärtääkseni ole enää tuota raw_input()-funktiota lainkaan, vaan pelkkä input(). Lisäksi esim. print on korvauttu funktiolla print(). Linuxilla teen ja Idlellä.

        Haku "kemi" ja "kemi" palauttaa vain sen sanoman "Useampi kuin yksi vaihtoehto". Se johtuu siitä, että silloin Postin palvelu palauttaa liikaa arvoja, eli samalle haulle ei ole yksittäistä tulosta. Tuonhan se siis käytännössä tekee:

        https://www.verkkoposti.com/e3/postinumeroluettelo?streetname=kemi&postcodeorcommune=kemi

        Näyttäisi sinulla menevän merkistökoodaus väärin. Kopioin äsken pastebinistä ja kokeilin, niin minulla toimii silti aivan kuten pitääkin, eli pastebin ei ainakaan ole syyllinen.

        Auttaakohan jos laittaa ensimmäiseksi riviksi koodiin?

        # -*- coding: utf-8 -*-

        Virhettä pukkaa
        https://vimeo.com/196116290

        Mitä se sinulla antaa näillä tiedoilla
        Kemilänkatu
        KEMI


        Linux Mint 18 Sarah
        Xfce 64-bit


      • soppakokeilu
        Toimiiko-sulla kirjoitti:

        Virhettä pukkaa
        https://vimeo.com/196116290

        Mitä se sinulla antaa näillä tiedoilla
        Kemilänkatu
        KEMI


        Linux Mint 18 Sarah
        Xfce 64-bit

        Toimii minulla niin kuin ajattelinkin:

        Katuosoite: Kemilänkatu
        Kunta: KEMI
        94200 KEMI

        Käyttelit ilmeisesti 2.x versiota? Siinä kuuluu olevan jotain ongelmia quote():n kanssa.

        http://stackoverflow.com/questions/1695183/how-to-percent-encode-url-parameters-in-python

        Minä käytin requests-moduulin quotea. Toimiiko jos vaihdat sen urllib:n vastaavaan? Eli korvaat tuon requests.utils-rivin tuolla urllib.request-versiolla. Minulla toimii silläkin.

        #from requests.utils import quote
        from urllib.request import quote


      • Anonyymi
        soppakokeilu kirjoitti:

        Käyttelen siis Python 3 -versiota, jossa ei ymmärtääkseni ole enää tuota raw_input()-funktiota lainkaan, vaan pelkkä input(). Lisäksi esim. print on korvauttu funktiolla print(). Linuxilla teen ja Idlellä.

        Haku "kemi" ja "kemi" palauttaa vain sen sanoman "Useampi kuin yksi vaihtoehto". Se johtuu siitä, että silloin Postin palvelu palauttaa liikaa arvoja, eli samalle haulle ei ole yksittäistä tulosta. Tuonhan se siis käytännössä tekee:

        https://www.verkkoposti.com/e3/postinumeroluettelo?streetname=kemi&postcodeorcommune=kemi

        Näyttäisi sinulla menevän merkistökoodaus väärin. Kopioin äsken pastebinistä ja kokeilin, niin minulla toimii silti aivan kuten pitääkin, eli pastebin ei ainakaan ole syyllinen.

        Auttaakohan jos laittaa ensimmäiseksi riviksi koodiin?

        # -*- coding: utf-8 -*-

        Harvinaisen typerä tuo postin palvelu, kun ei palauta jsonia.


    • Varmistan-vain

      Kirjotappa järjestelmän Dash Shellissä komento:

      python -V

      mitä se pukkaa sulla (mulla Python 2.7.12)


      Linux Mint 18 Sarah
      Xfce 64-bit

      • soppakokeilu

        Kakkosversio:

        python -V
        Python 2.7.12

        Kolmosversio:

        python3 -V
        Python 3.5.2


      • Thanks-are-in-order

        NYT TOIMII

        Pistin samanlaisen ympäristön pystyyn, eikös vaan heti ruvennut pelittämään. No nyt tuosta sitten rupean kaivelemaan, itelleni jotain opiksi. Sinähän olet parempi kuin hyvä pythonin kanssa.

        Nyt kun teet vielä tilin tuonne http://pastebin.com sivulle, niin jatkossakin pääsen sinun koodeja kopioimaan. Tilinteko tuonne ei vaadi mitään aitoja tietoja, ja voi sitten muokatakin jos johonkin pääsi TYPO mukaan.

        Thanks are in order. (Kiitokset ovat paikallaan)


        Linux Mint 18 Sarah
        Xfce 64-bit


      • soppakokeilu
        Thanks-are-in-order kirjoitti:

        NYT TOIMII

        Pistin samanlaisen ympäristön pystyyn, eikös vaan heti ruvennut pelittämään. No nyt tuosta sitten rupean kaivelemaan, itelleni jotain opiksi. Sinähän olet parempi kuin hyvä pythonin kanssa.

        Nyt kun teet vielä tilin tuonne http://pastebin.com sivulle, niin jatkossakin pääsen sinun koodeja kopioimaan. Tilinteko tuonne ei vaadi mitään aitoja tietoja, ja voi sitten muokatakin jos johonkin pääsi TYPO mukaan.

        Thanks are in order. (Kiitokset ovat paikallaan)


        Linux Mint 18 Sarah
        Xfce 64-bit

        Hyvä että sait pelaamaan. Aikamoista kantapään kautta opetteluahan tämä tahtoo välillä olla. Onneksi löytyy hakemalla suhteellisen helposti ratkaisumalleja ongelmiin.

        Eniten olen Pythonin opettelun alkuvaiheessa törmännyt juuri näihin yhteensopivuusongelmiin kakkos- ja kolmosversion kanssa. Itse lähdin siis suoraan tekemään tuolla kolmosella. Lisäksi on ollut aika kiitettävästi säätämistä merkistökoodauksien kanssa.

        No jospa se tästä vähän kerrallaan etenisi. Seuraavaksi voisi alkaa opettelemaan graafisen käyttöliittymän tekemistä, Tkinter olisi ilmeisesti silloin aiheena.


    Ketjusta on poistettu 0 sääntöjenvastaista viestiä.

    Luetuimmat keskustelut

    1. Nasima löi Jussille luun kurkkuun

      Nasima kertoi ettei Jussi sovi puhemieheksi, koska sallii rasismin. Mihin toimiin perussuomalaiset ryhtyvät? Kuka nouse
      Maailman menoa
      426
      8107
    2. Razmyar on säälittävä - puhemiehellä ei ole mitään syytä ottaa kantaa tähän "silmäkohuun"

      jonka toimittajat sai aikaan. Asia ei kuulu puhemiehelle millään lailla. Razmyar haluaa taas vaan huomiota. Mutta jos r
      Maailman menoa
      114
      5618
    3. Pitkän linjan yritysjohtaja: Suomen tapahtumat eivät ole Aasian kärkiuutinen

      Viimeaikaista kohua on käytetty sisäpoliittisena lyömäaseena, Thomas Zilliacus sanoo. – Koska asiaa kuitenkin kommentoi
      Maailman menoa
      115
      4674
    4. Miten Eerolan silmäkuvat voivat levitä muutamassa tunnissa ympäri maailmaa?

      Seuraako koko maailma persujen ja erityisesti Eerolan somea reaaliajassa? Edes kansanedustajan itsemurha eduskuntatalos
      Maailman menoa
      199
      4505
    5. Siviilipalvelusmies Halla-aho normalisoi rasismin perussuomalaisissa

      SMP:n tuhkille perustettu puolue ei ollut ihmisiä vastaan, vaan instituutiokriittinen. "Missä EU - siellä ongelma", oli
      Perussuomalaiset
      33
      4478
    6. Suomalaisilta vaaditaan valtavasti suvaitsevaisuutta - miksi sitä ei vaadita muslimeilta

      Suomalaisilta vaaditaan kaikkea, pitää olla suvaitsevainen ja hyväksyä vieraiden tavat, rasisti ei saa olla jne. Miksi s
      Maailman menoa
      52
      3977
    7. Juuri Suomen valtamedian toimittajat teki "silmävääntelystä" sen kohun

      ja ilmeisesti ottivat yhteyttä myös ulkomaisiin medioihin, että katsokaas tätä. Mutta Japanin medioissa on asiaan suhta
      Maailman menoa
      160
      3873
    8. Demarit ovat oikeasti törppöjä eli heikkoälyisiä

      ja todistavat sitä päivittäin täällä lapsellisilla jutuillaan. Kauheasti on hehkuttaneet kuinka demarien kannatus vaan
      Maailman menoa
      77
      3747
    9. Perussuomalaiset eivät harrasta maalittamista kuten vasemmisto

      Huomaa tässä keinotekoisessa "rasismi"-kohussakin kuinka vasemmistolaiset maalittavat Perussuomalaisia. Me emme vastaava
      Maailman menoa
      42
      3679
    10. SDP:n kansanedustaja Marko Asell: Suomen myönnettävä maahanmuuton ongelmat

      Hänen mielestään Suomen pitää pyrkiä rajoittamaan jyrkästi turvapaikanhakijoiden pääsyä maahan ja hän arvioi, että maaha
      Maailman menoa
      85
      3491
    Aihe