python - 如何使用 Python 将网站内容复制到 Markdown 文件?
问题描述
我想编写一个 Python 函数,它以 URL 作为参数并输出带有网页内容的 Markdown 文件。嵌入网站的图像应下载并在 Markdown 文件中适当引用。
我写了这段代码
import requests
import html2text
# The URL
link = "https://www.some.website"
f = requests.get(link)
# URL content to plain text (HTML)
textHtml = f.text
# HTML text to MD text
h = html2text.HTML2Text()
textMd = h.handle(textHtml)
# MD text is written to file
text_file = open("output.md", "w")
text_file.write(textMd)
text_file.close()
我认为它可以下载文本并将其格式化为 Markdown 文件,但我不知道如何下载图像并将 Markdown 文件中的引用添加到本地图像文件。
我怎样才能做到这一点?
提前致谢!
解决方案
推荐阅读
- orleans - 有效地从 Orleans Grain 获取状态
- jdbc - Talend Open Studio 支持的最新版本的snowflake-jdbc jar 版本:7.2.1
- python - 烧瓶:RuntimeError:在请求上下文之外工作
- mysql - FacetWP - 按字母顺序排除“The”和排序列表
- unity3d - 在 Unity 中将材质纹理应用于 3D 模型
- html - 组件 sc-global 已被动态创建警告
- python - 无法使用 web3 发送交易
- html - 带有文本溢出的 HTML:在结尾处用点隐藏将不起作用
- python - 提供数据框第一列的值
- android - 为什么我无法将 APK 上传到 Google PLAY?