暂无图片
暂无图片
暂无图片
暂无图片
暂无图片

下载一个公众号所有文章的方法

老柴杂货铺 2025-02-16
0

利用第三方工具

WeChatDownload(https://github.com/qiye45/wechatDownload/releases):使用前提是电脑上已经登录了 PC 版微信。打开软件后,复制想批量下载的公众号的任意一篇文章的地址填入,点击 “获取公众号 ID”,复制软件给出的链接并在微信中打开,显示 “获取密钥成功” 后,点击 “批量下载” 按钮即可。

微信公众号文章批量导出下载工具:复制公众号的一篇文章链接粘贴到软件输入框中,点击获取 “公众号 ID”,复制软件界面提示的链接在微信中打开,返回软件界面显示 “获取秘钥成功,请点击下载按钮” 后,点击 “批量下载文章” 就能下载公众号的所有文章。

借助浏览器插件

公众号助手插件:以 Chrome 浏览器为例,打开 Chrome 浏览器,在地址栏输入 “chrome://extensions/”,进入扩展程序页面,在左上角选择 “打开 Chrome 网上应用商店”,搜索并安装 “公众号助手”。登录微信公众平台,进入 “素材管理”-“图文消息” 页面,勾选需要导出的文章,点击浏览器右上角的 “公众号助手” 插件图标,选择 “批量导出” 并选择导出格式,点击 “开始导出”,最后下载并保存导出的文档。

微信文章下载助手:安装该插件后,可批量下载公众号文章,只需在浏览器中点击文章链接即可一键下载。

利用在线版工具

有一些在线网页工具可以批量下载自己管理的公众号文章。打开对应网页后,使用微信扫码登录,就能看到自己管理的公众号的所有文章,点击顶部的 “数据导出”,全选文章后,点击右上角的 “打包下载”,即可得到一个 Zip 包,里面是该公众号的全部文章。

编写自动化脚本

有一定技术基础的用户可以编写 Python 脚本等自动化工具来批量下载微信公众号文章。可以利用相关的库和框架,如 BeautifulSoup、Selenium 等,通过模拟浏览器操作或解析网页内容来实现文章的下载和保存。

安装playwright:

    pip install playwright


    完整实例:

      import re
      from playwright.sync_api import sync_playwright
      def main():
          with sync_playwright() as p:
              browser = p.chromium.launch()
              context = browser.new_context()
              page = context.new_page()
              #访问网页
              page.goto("https://mp.weixin.qq.com/mp/appmsgalbum?__biz=MzkxNzU2Nzg2NQ==&action=getalbum&album_id=3101281634991243270&scene=173&subscene=&sessionid=svr_e2f2637693e&enterid=1708590301&from_msgid=2247484919&from_itemidx=1&count=3&nolastread=1#wechat_redirect")
              #等待数据加载完成
              page.wait_for_load_state("load")
              #获取内容数量
              content_count_element = page.query_selector('.album__desc-content.js_album_desc_content > span')
              content_count_text = content_count_element.inner_text()
              content_count = int(re.search(r'\d+', content_count_text).group())  10
              #滑动页面
              for _ in range(content_count):
                  print("第"+str(_+1)+"次滑动.....")
                  page.evaluate("window.scrollTo(0, document.body.scrollHeight)")
                  page.wait_for_timeout(2000)


              #获取标题
              list_items = page.query_selector_all(".album__list.js_album_list > .album__list-item")
              #输出标题和链接
              for item in list_items:
                  data_link = item.get_attribute("data-link")
                  data_title = item.get_attribute("data-title")
                  print(f"标题: {data_title}\n链接: {data_link}\n*****\n")
              browser.close()
      main()



      文章转载自老柴杂货铺,如果涉嫌侵权,请发送邮件至:contact@modb.pro进行举报,并提供相关证据,一经查实,墨天轮将立刻删除相关内容。

      评论