202-trafilatura

1
2
3
4
5
6
7
8
9
import trafilatura

url = 'https://example.org/article'

downloaded = trafilatura.fetch_url(url)

if downloaded:
    result = trafilatura.extract(downloaded)  # 提取正文
    print(result)