How to reduce your reliance on "bad" open source packages ✨ RSVP

pyce3
Release 1.0.0

Multilingual Web Page Content Extractor

License: Apache-2.0
Install: pip install pyce3==1.0.0

Documentation

pyce3: Multilingual Web Page Content Extractor for Python3

Introduction

pyce3 is a python3 package for multilingual web page content extraction. It is used to extract the content of article type web pages, such as news, blog posts, etc.

Usage

import pyce3
import requests

url = "http://caijing.chinadaily.com.cn/a/201911/21/WS5dd62455a31099ab995ed438.html"
html = requests.get(url).content
encoding, time, title, text, next_link = pyce3.parse(url, html)
print("编码："+encoding)
print('='*10)
print("标题："+title)
print("时间："+time)
print('='*10)
print("内容："+text)
print("NextPageLink: ", next_link)

Dependencies: 3
Dependent packages: 0
Dependent repositories: 0
Total releases: 1
Latest release: Nov 23, 2019
First release: Nov 23, 2019
Stars: 1
Forks: 0
Watchers: 1
Contributors: 1
Repository size: 13.7 KB
SourceRank: 7

Source repo 2FA enabled: TEXT!
Package manager 2FA enabled: TEXT!
Is security responsive: TEXT!
Dependencies are managed: TEXT!
Issue-free release available: TEXT!
Succession plan available: TEXT!
Package manager 2FA enabled: TEXT!

Releases

1.0.0: Nov 23, 2019

Contributors

See all contributors

Something wrong with this page? Make a suggestion

Export .ABOUT file for this package

Last synced: 2021-02-19 23:34:39 UTC

pyce3
Release 1.0.0

Release 1.0.0

1.0.0

Documentation

pyce3: Multilingual Web Page Content Extractor for Python3

Introduction

Usage

Stats

Development practices

Releases

Contributors

pyce3 Release 1.0.0

Release 1.0.0 Toggle Dropdown 1.0.0

Documentation

pyce3: Multilingual Web Page Content Extractor for Python3

Introduction

Usage

Stats

Development practices

Releases

Contributors

pyce3
Release 1.0.0

Release 1.0.0

1.0.0