MediaCrawler — 多平台社交媒体爬虫工具
来源:GitHub — 2026-07-28 · Python · ⭐349 today
📋 概述
MediaCrawler 是一个用 Python 编写的多平台社交媒体爬虫,覆盖小红书、抖音、快手、B站、微博、百度贴吧和知乎等国内主流内容平台。它支持抓取笔记、视频、评论和帖子等结构化数据,采用模块化设计,每个平台独立的爬虫逻辑可按需启用。项目为内容分析、舆情监控和数据挖掘提供了统一的数据采集入口。
🔑 核心要点
- 覆盖七大平台:小红书、抖音、快手、B站、微博、贴吧、知乎
- 支持抓取视频、笔记、评论等多种内容类型
- Python 异步架构,模块化设计,各平台爬虫独立可插拔
- 提供反爬对抗机制,处理登录态和验证码等风控策略
- 数据输出结构化,可对接数据库或数据分析流水线
💡 金句
一个爬虫抓遍中文互联网 — 从内容海洋中提取信号而非噪音。
👍 0
👎 0
← 返回 GitHub Trending 首页