知识星球备份实战:把付费内容变成随身 PDF 电子书
知识星球备份实战把付费内容变成随身 PDF 电子书【免费下载链接】zsxq-spider爬取知识星球内容并制作 PDF 电子书。项目地址: https://gitcode.com/gh_mirrors/zs/zsxq-spider凌晨一点他差点失去三年的积累凌晨一点阿哲盯着手机屏幕手指停在不再续费的按钮上迟迟不敢按下。他加入了三年的知识星球付费社群即将到期星球里的上千条干货、几百张示意图、无数句醍醐灌顶的评论眼看就要随着账号失效一起消失。那一瞬间他忽然清醒所谓的知识星球备份从来不是杞人忧天而是给几年心血上的一道保险。他不想靠截图熬到天亮更不想让这些内容永远躺在别人家的服务器里。零散保存到底有多疼那段时间阿哲的相册里挤满了截图聊天记录里塞满了先存着的链接。可真要翻找时一切都成了灾难想回看一篇讲行业趋势的文章得在几百张截图里一页页滑想重温某位前辈的问答发现当时的评论早就沉了底图片被压缩得模糊排版七零八落。更让人心慌的是付费内容本质上是租来的——平台一调整、社群一解散三年的积累可能一夜归零。他第一次认真地问自己这些知识到底算不算我的一个叫 zsxq-spider 的家伙出现了朋友给他推荐了一个开源小工具用一句人话就能讲清它是什么把知识星球里的文章、图片、评论自动整理成一本可以离线阅读的 PDF 电子书。️它不做花哨界面也不要求你懂编程整个操作就两步改几个配置跑一条命令。作者自己就是被存了内容却没法好好翻逼疯的人索性把抓取、下载图片、排版、成书的全流程做成了自动流水线。你不需要理解代码的每个细节就像用微波炉不必懂电磁波。拿到它的那天阿哲感觉散落多年的笔记终于找到了一个可以安放的家。跟着阿哲从零到一跑通它先把厨房搭起来做什么把项目拉回本地装好依赖。 为什么zsxq-spider 是 Python 写的电脑里需要 Python 3.7 以上版本再装几个辅助库它才跑得起来另外还要安装一个叫 wkhtmltopdf 的小程序它才是把网页排版印进 PDF 的幕后功臣。这一步就像搬家前先通电通水基础不牢后面全白搭。 完成后看到什么终端安静下来光标重新出现说明环境就绪了。git clone https://gitcode.com/gh_mirrors/zs/zsxq-spider cd zsxq-spider pip install pdfkit BeautifulSoup4 requests这段命令替我们把工具搬进电脑并装好生成 PDF 需要的三样依赖跟下载一个普通软件差不多。填好三把钥匙做什么用编辑器打开crawl.py改几行配置。 为什么星球内容是私密的工具得靠你的登录凭证Token、浏览器标识User-Agent和小组 ID 才能进门。Token 藏在浏览器开发者工具的 Cookie 里小组 ID 就印在星球网址的链接中。找起来有个小技巧在浏览器里打开星球页面按 F12 调出开发者工具刷新一下请求头里的 Cookie 一眼就能看到。 完成后看到什么保存配置后工具就像认识了你的星球——知道该进哪个门、拿谁的内容。ZSXQ_ACCESS_TOKEN 浏览器Cookie里的Token # 进门钥匙 USER_AGENT 登录时用的浏览器标识 # 要和登录时一致 GROUP_ID 452445212848 # 星球小组ID PDF_FILE_NAME 我的知识库.pdf # 电子书文件名 ONLY_DIGESTS False # True只要精华False全部这一段就是工具的方向盘告诉它去哪儿、拿什么、输出成什么名字。看不懂也没关系照抄改值就行。一键生成然后等着惊喜做什么在项目目录里运行 python crawl.py。 为什么接下来的流程全是自动的——工具分页拉取内容把文章、问答、评论整理成网页图片下载后以 base64 形式直接嵌进文档最后统一排版成 PDF。想先试水的话把 DEBUG 设为 True它只会处理一小部分内容确认没问题再全量导出。 完成后看到什么控制台滚动着一行行网址几分钟后跳出电子书生成成功文件夹里多出一本排版清爽的 PDF。阿哲随手点开图文俱在、评论完整连之前乱糟糟的链接都变成了可点击的文字。让备份更省心的三个小习惯跑顺之后阿哲攒下几条经验都挺实用别贪多分批来。内容多的星球把 COUNTS_PER_TIME 保持在 30开启 SLEEP_FLAG 让请求之间歇口气既稳定也不打扰别人。✅按时间归档。打开 FROM_DATE_TO_DATE把某一年、某个月的内容单独导成一本想翻哪段历史就翻哪本比一整本大部头好查得多。给电子书换个皮肤。想改字号、颜色、图片圆角打开 temp.css 调几个数值重新跑一次PDF 立刻变样。踩坑了别慌两句口诀就够阿哲也踩过两次坑但都不吓人。Token 过期太正常了。重新在浏览器登录一次从 Cookie 里抄一串新值替换进crawl.py一分钟搞定。PDF 生成失败九成是 wkhtmltopdf 没装好或没被系统找到。确认它的 bin 目录加进了环境变量重跑一次就好。记住一句话出错时先看终端最后几行提示它往往已经悄悄告诉了你答案。把租来的知识变成自己的资产三个月后阿哲的本地文件夹里整整齐齐躺着十几本按年份归档的电子书。他终于想通了那些原本租来的内容如今变成了实实在在的数字资产。平台会变、社群会散但一本躺在自己硬盘里的 PDF谁也拿不走。现在轮到你了。找到开源项目 zsxq-spider用上文那行 git clone 命令把它拉回本地改几个配置、敲一条命令——就能为自己的知识盖一座永久的图书馆。一把命令把平台里租来的内容变成永远属于你的 PDF 电子书。别等了那些内容值得被你真正拥有。【免费下载链接】zsxq-spider爬取知识星球内容并制作 PDF 电子书。项目地址: https://gitcode.com/gh_mirrors/zs/zsxq-spider创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考