The 2024 Tidelift state of the open source maintainer report! 📊 Read now!

xscrapers
Release 0.0.5

A simple webscraper library

Keywords: beautifulsoup4, concurrent, requests, selenium, thread-pool, webscraping
License: MIT
Install: pip install xscrapers==0.0.5

Documentation

XSCRAPERS

The XSCRAPERS package provides an OOP interface to some simple webscraping techniques.

A base use case can be to load some pages to Beautifulsoup Elements. This package allows to load the URLs concurrently using multiple threads, which allows to safe an enormous amount of time.

import scraper.webscraper as ws

URLS = [
    "https://www.google.com/",
    "https://www.amazon.com/",
    "https://www.youtube.com/",
]
PARSER = "html.parser"
web_scraper = ws.Webscraper(PARSER, verbose=True)
web_scraper.load(URLS)
web_scraper.parse()

Note that herein, the data scraped is stored in the data attribute of the webscraper. The URLs parsed are stored in the url attribute.

Dependencies: 7
Dependent packages: 0
Dependent repositories: 0
Total releases: 6
Latest release: Apr 5, 2021
First release: Feb 18, 2021
Stars: 0
Forks: 0
Watchers: 1
Contributors: 1
Repository size: 1.79 MB
SourceRank: 6

Source repo 2FA enabled: TEXT!
Package manager 2FA enabled: TEXT!
Is security responsive: TEXT!
Dependencies are managed: TEXT!
Issue-free release available: TEXT!
Succession plan available: TEXT!
Package manager 2FA enabled: TEXT!

Releases

0.0.7: Apr 5, 2021
0.0.6: Mar 23, 2021
0.0.5: Mar 16, 2021
0.0.4: Feb 20, 2021
0.0.3: Feb 20, 2021
0.0.2: Feb 18, 2021

Contributors

See all contributors

xscrapers
Release 0.0.5

Release 0.0.5

0.0.7

0.0.6

0.0.5

0.0.4

0.0.3

0.0.2

Documentation

XSCRAPERS

Stats

Development practices

Releases

Contributors

xscrapers Release 0.0.5

Release 0.0.5 Toggle Dropdown 0.0.7 0.0.6 0.0.5 0.0.4 0.0.3 0.0.2

Documentation

XSCRAPERS

Stats

Development practices

Releases

Contributors

xscrapers
Release 0.0.5

Release 0.0.5

0.0.7

0.0.6

0.0.5

0.0.4

0.0.3

0.0.2