Pystyykö vaikka Pythonilla tekemään skriptin, joka hakee sivulta tietoa, montako koronavirustapausta on aktiivisena Suomessa kun skripti ajetaan? Saako sivun lähdekoodista sen selville vai pitääkö käyttää kuvantunnistusta?
Kuinka Pythonilla haetaan dataa nettisivulta?
8
1404
Vastaukset
- Anonyymi
Eikö ole helpompi katsoa asia omin silmin YLE:n tai THL:n sivulta?
Sitäpaitsi tuollaista tietoa kuin "montako koronavirustapausta on aktiivisena Suomessa" ei ole olemassakaan, asiaa ei tiedetä.
Tiedetään vain sairaanhoitopiireissä tehtyjen testien perusteella, että montako positiivista testitulosta on saatu. Kaikkia koronaviruksen oireita valittavia potilaita ei testata enää. - Anonyymi
BeatufilSoapilla voi scrapata sivun. https://www.freecodecamp.org/news/how-to-scrape-websites-with-python-and-beautifulsoup-5946935d93fe/
- Anonyymi
Kokeilin urllibillä sivua https://thl.fi/fi/web/infektiotaudit-ja-rokotukset/ajankohtaista/ajankohtaista-koronaviruksesta-covid-19 . Sain ilmoituksen
urllib.error.HTTPError: HTTP Error 403: Forbidden - Anonyymi
Pystyy.
Katsot ensin selaimella kehittäjätilassa, missä formaatissa data on.
Hae vaikka youtuubista "web scraping".
Kunhan vähän jaksaa kaivaa, lähes varmasti pärjää ilman kuvantunnistusta. - Anonyymi
Et mitenkään helposti saa mitään tietoa oikeastaan yhtikäs mistään. Vaatisi valtavan ohjelmiston ja paljon kokemusta.
Kokeile kerätä tietoa lukemalla suomalaisia ja ulkolaisia verkkolehtiä. Valitse aihe ihan vapaasti. Sen tieto-osan suodattaminen on äärimmäisen vaikeaa myös ihmiselle.- Anonyymi
Jos jotakin tiettyä tietoa haet, niin hyvin helposti saa. ;)
Ei vaadi "valtavaa ohjelmistoa", muutama rivi Python koodia riittää.
Suurin työ on reverse engineerata, eli takaisinmallintaa ja etsiä, mistä se oikea tieto löytyy. Parhaimmillaan web sivu itsekkin hakee sen REST, tms. rajapinnasta, Ajax kutsulla, websocketilla, tms. ja voit napata suoraan url:n tuohon tiedonhaku kutsuun. Silloin homma voi mennä hyvinkin helpoksi. Toisaalta näissä se takaisinmallinnus on suurempi huomattavasti työ kuin staattisessa sivussa.
Kokemusta karttuu tekemällä, ei päivittelemällä "ei mitenkään" . . . . ;)
- Anonyymi
Tässä on yksi esimerkki, miten python xpath hakee dataa webisivulta:
https://3583bytesready.net/2016/08/17/scraping-data-python-xpath/
Tämä hakee ja sorttaa judon olympiamitalistit mitalimäärän mukaan
wikipedia-sivulta. - Anonyymi
Bash riittänee, sillä on helppo hakea ni ei tarvi ohjelmoida ;-)
Minä olen yrittänyt jonkin aikaa tehdä skriptiä, joka hakee ensi viikon lottonumerot veikkauksen sivustolta, mutta nyt skripti hakee vain harvoin osan oikeista numeroista ja siinäkin on huomattavaa hajontaa ja yleensä ei hae yhtäkään numeroa.
Ketjusta on poistettu 6 sääntöjenvastaista viestiä.
Luetuimmat keskustelut
Nurmossa kuoli 2 Lasta..
Autokolarissa. Näin kertovat iltapäivälehdet juuri nyt. 22.11. Ja aina ennen Joulua näitä tulee. . .944666Maisa on SALAKUVATTU huumepoliisinsa kanssa!
https://www.seiska.fi/vain-seiskassa/ensimmainen-yhteiskuva-maisa-torpan-ja-poliisikullan-lahiorakkaus-roihuaa/15256631403153Vanhalle ukon rähjälle
Satutit mua niin paljon kun erottiin. Oletko todella niin itsekäs että kuvittelet että huolisin sut kaiken tapahtuneen503125Mikko Koivu yrittää pestä mustan valkoiseksi
Ilmeisesti huomannut, että Helenan tukijoukot kasvaa kasvamistaan. Riistakamera paljasti hiljattain kylmän totuuden Mi4032212Purra hermostui A-studiossa
Purra huusi ja tärisi A-studiossa 21.11.-24. Ei kykene asialliseen keskusteluun.2351368Ensitreffit Hai rehellisenä - Tämä intiimiyden muoto puuttui suhteesta Annan kanssa: "Meillä ei..."
Hai ja Anna eivät jatkaneet avioliittoaan Ensitreffit-sarjassa. Olisiko mielestäsi tällä parilla ollut mahdollisuus aito111223- 761207
- 691122
Joel Harkimo seuraa Martina Aitolehden jalanjälkiä!
Oho, aikamoinen yllätys, että Joel Jolle Harkimo on lähtenyt Iholla-ohjelmaan. Tässähän hän seuraa mm. Martina Aitolehde301084Miksi pankkitunnuksilla kaikkialle
Miksi rahaliikenteen palveluiden tunnukset vaaditaan miltei kaikkeen yleiseen asiointiin Suomessa? Kenen etu on se, että1141002