MediaCrawler 多平台内容评论爬虫工具
来源:github.com — NanmiCoder/MediaCrawler · ⭐ 60,907 · Python
📋 概述
MediaCrawler 是一个覆盖多平台的开源爬虫,支持小红书、抖音、快手、B 站、微博、百度贴吧与知乎的笔记、视频、帖子及其评论抓取,还能采集评论回复。它把热门中文内容平台的公开数据抓取统一到一个 Python 工具里,适合做内容研究、舆情分析与数据集构建。
🔑 核心要点
- 多平台覆盖:小红书、抖音、快手、B 站、微博、贴吧、知乎等主流中文内容源一次接入。
- 内容与评论双采集:既抓主贴,也抓评论区与回复,方便做完整的话题分析。
- 数据与研究用途:适用于舆情监测、内容趋势研究与训练语料构建等数据密集型场景。
💡 金句
公开数据的价值,藏在每一个平台的评论区里,而抓取是把它们汇流的第一步。
👍 0
👎 0
← 返回 GitHub Trending 首页