深信号· DEEPSIGNAL
深信号· DEEPSIGNALRSS
SIGNAL DEEP-DIVE

公众号文章怎么抓?这四个开源工具我捋了一遍

2026-09-14·GitHub·开发工具公众号抓取对比评测RSSwe-mp-rsswechatDownload
▮ SIGNAL SUMMARY · 摘要快读

想给公众号做 RSS、批量存档或喂给 AI,市面上的工具最近集体失灵——因为它们的命门是同一条"后台接口"。我翻了四个代表性项目的仓库、源码和作者公告:星标最多的那个已经停维,另外三个用了三种不同的办法活了下来。

公众号文章怎么抓?这四个开源工具我捋了一遍

先说说你大概也遇到过的那个时刻

你关注了几十个公众号,攒了一堆想慢慢看的东西。于是你冒出个念头:能不能把这些文章都存下来? 做成 RSS 每天推给自己,或者丢进知识库、喂给 AI 当语料。

然后你去搜「公众号文章怎么抓」。

出来一串工具,个个看着都挺美:在线版的、Docker 自部署的、桌面端的,功能列表一个比一个长。你挑了个星标最多的点进去——打不开。换一个,能打开,扫码登录,勾选公众号,点同步。

转了几分钟,右下角弹出一行红字:同步失败 200013: freq control

这不是你的配置问题,也不是你运气差。这个赛道在 2026 年 7 月底刚经历了一次地基塌陷,很多工具就是在那几天集体失灵的。

下面这四个工具,是这个赛道里最有代表性的四个。我把它们的仓库、源码和作者公告都翻了一遍,想搞清楚一件事:同样一个需求,为什么有的停在了这里,有的换了条路继续走。

为什么这事突然变难了

先说清楚背景,不然后面的判断没法成立。

微信公众号的文章,官方从来没有开放过"批量获取"的接口。所以过去几年,市面上所有工具其实都建立在同一条小路上:

用你自己的公众号后台账号扫码登录,拿到登录态(token + cookie),然后借这个身份去调后台的「发表记录」接口cgi-bin/appmsgpublish),把任意公众号的文章列表拉出来。

几乎所有工具,都走这一条路。

2026 年 7 月底,这条路被掐断了。这个赛道里星标最多的项目 wechat-article-exporter 在 7 月 30 日收到第一波故障报告(issue #199同步失败 200013: freq control),当天作者写下了一段很长的告别:

项目所依赖的上游核心接口已被微信关闭(大概率也不会再开放了)。这不是一个可以靠改代码绕过去的问题 —— 它是整个项目赖以工作的地基。地基没了,上面的东西再精巧也立不住。

—— 《关于本项目停止维护的说明》· issue #200,2026-07-30

12.5k Star、2.2k Fork 的项目,就此转为只读归档。

但故事没在这儿结束。 同样是接口没了,有人直接关门,有人换了条路继续走。这个差别,才是这篇文章真正想聊的东西。

四个工具,三种活法

项目Star最后提交状态开源地址
wechat-article-exporter12.9k2026-08-07❌ 已停维(只读归档)wechat-article/wechat-article-exporter
WeWe RSS9.7k2026-03-20⚠️ 半年未更新cooderl/wewe-rss
wechatDownload9.4k2026-08-16✅ 活跃qiye45/wechatDownload
we-mp-rss4.6k2026-09-10✅ 最活跃rachelos/we-mp-rss

Star 与最后提交时间采集于 2026-09-14。

说明:下面所有判断来自仓库状态、源码和作者公告(出处见上文链接),我们没有逐一跑完扫码授权与批量抓取的全流程。

暮色里一排老式邮筒,其中一只敞开着,里面缓缓驶出一列由纸页折成的小车厢,车厢里装着折叠的报纸,细轨伸向远处发亮的星空
订阅流:让新文章自己走出来。

一、停下来的那个,原因很有代表性

wechat-article-exporter 曾经是这个赛道最好的产品:不用装任何东西,打开网页扫码登录,就能批量导出公众号的全部文章,支持 HTML / Markdown / TXT / JSON,还能把阅读数、点赞、留言一起带出来——做行业调研和竞品分析的人几乎人手一个。

它的技术路线也是最"纯"的:只用那条后台接口。纯的好处是轻快、稳定、优雅;坏处是接口一没,代码里没有一个可以退的地方。作者在告别信里写了这么一句:

有朋友提到项目里还留着另一条基于 Credential 的通道。这是真的,但它的可用性相比现在的方案下降了很多,需要不少手工操作,也从未真正接入主流程。它不构成一个替代方案。

它把全部依赖都放在这一条接口上,没有留退路。

二、活下来的,都换了地基

另外三个项目,活法完全不同。

we-mp-rss 是最值得看的。它的代码里写着一条明确的降级链:默认调那条后台接口,一旦检测到接口不可用,自动降级到 free_publish 模式;再不行,它还有一招——用 Playwright 驱动一个真实浏览器,像人一样登录后台、点击"发表记录"页面,从页面上把数据取下来(走的是 appmsg_list_v2 这条页面路径)。

接口层面被堵,就退到浏览器层面;用"像人一样操作"来绕开"必须是接口"。它最近几次提交还全都在改另一条通道:微信读书(Weread)。也就是说,它现在手里不止一条路。

WeWe RSS 走得更彻底:干脆不用公众号后台那条接口,改用微信读书拿数据——你扫码登录的是微信读书账号,不是公众号后台。好处是绕开了封锁;代价也很清楚:只能拿到微信读书收录过的号,收录范围之外的就没了。它上一次提交停在 2026 年 3 月,这条路的维护情况需要打个问号。

wechatDownload 最务实,也最"不讲技术":把对抗交给用户。它让你在微信内置浏览器里打开一篇文章,手工把 key 抓出来,然后把 key 交给工具批量下载。它支持 Windows 和 macOS,导出格式包括 html / mhtml / md / pdf / docx / csv,评论、合集、文章内的图片视频音频都能一起存,甚至还支持 MCP 和 Skill 调用——意味着你可以让 AI 直接指挥它干活。

代价当然是:要你亲手抓一次 key,而且 key 会过期。

三、那么,你到底该用哪个

答案取决于你要的是"订阅"还是"存档":

一只手用黄铜钥匙打开地上的旧木箱,箱内整齐码着折叠的报纸与泛黄剪报,箱边垂着藤蔓,暖光从箱内溢出
批量存档:把历史文章搬回自己手里。

信号强度

把四个工具放在一起看,真正有价值的结论不是"哪个 Star 多",而是这个:

这四家真正的差别不在功能表上,而在它们把命门押在了哪条接口上。

四个项目里,功能最全、体验最好的那个停在了原地;另外三个,一个学会了"接口不行就换浏览器",一个换了数据源,一个把麻烦转给了用户。它们都不是赢在功能,而是赢在给自己留了第二条路

所以如果你今天还需要抓公众号文章:能用,但都带着前提条件。顺手的时候用它,别把它写进你的生产流程——因为你依赖的那个人,随时可能改一下接口。

如果哪天又有一批工具冒出来,第一个该问的问题不是"它支持几种格式",而是:"如果微信明天再封一个接口,你还能用吗?"

SIGNAL FILE · 情报档案

四个工具的技术路线可以被归成三种活法——换地基(改用微信读书接口)、降级成模拟真人(用 Playwright 像人一样点后台页面)、把对抗外包给用户(手动在微信里抓 key)。它们共同说明一件事:在这个赛道里,"功能列表"几乎不重要,重要的是它把命门押在哪条接口上;而接口是别人的,随时可以改。

本文基于 AI 情报库收录的条目展开深析;事实性信息以原始报道为准,分析与展望为编辑观点。

原始报道:https://github.com/rachelos/we-mp-rss(GitHub)

RELATED SIGNALS · 关联信号