我正在尝试使用请求包读取保存在 github 中的文本文件。这是我正在使用的python代码:
import requests
url = 'https://github.com/...../filename'
page = requests.get(url)
print page.text
Run Code Online (Sandbox Code Playgroud)
我没有获取文本,而是阅读 HTML 标签。如何从文件中读取文本而不是 HTML 标签?
我正在构建一个我希望能够从 git 更新的程序。我可以将这些文件与 raw.githubusercontent.com 进行比较,如果它们不同,则将它们拉出。但是,如果文件被添加到存储库而不是仅仅更改,程序将不知道检查该 url。有没有办法从 GitHub 获取存储库中所有文件的列表进行检查?
顺便说一句,我没有使用 GitHub API,因为我不希望在分布式程序中包含我的 API 令牌,或者强制用户拥有自己的 GitHub 帐户。如果有一种方法可以在不包含令牌的情况下从 git 下载 repo,我也会接受它作为解决方案。