https://github.com/NanmiCoder/MediaCrawler
✨ 更多设置(配置)可以在 MediaCrawler 仓库中找到。
# 进入项目目录
cd MediaCrawler_MCP_Server
# 使用 uv sync 命令来保证 Python 版本和相关依赖包的一致性
uv sync
# 安装浏览器驱动
uv run playwright install
设置环境变量:
MYSQL_DB_HOST=localhost # 数据库主机
MYSQL_DB_PORT=3306 # 可选:数据库端口(未指定时默认为 3306)
MYSQL_DB_USER=your_username
MYSQL_DB_PWD=your_password
MYSQL_DB_NAME=your_database
CRAWLER_MAX_NOTES_COUNT=20 # 想要爬取的笔记数量
MAX_CONCURRENCY_NUM=1 # 并发爬虫的数量
ENABLE_GET_COMMENTS=true # 是否爬取评论
添加到 claude_desktop_config.json 或 cline_mcp_settings.json
"mediacrawler": {
"disabled": false,
"timeout": 600,
"type": "stdio",
"command": "uv",
"args": [
"--directory",
"path/to/MediaCrawler_MCP_Server",
"run",
"main.py"
],
"env": {
"MYSQL_DB_HOST": "localhost",
"MYSQL_DB_PORT": "3306",
"MYSQL_DB_USER": "your_username",
"MYSQL_DB_NAME": "your_database",
"MYSQL_DB_PWD": "your_password",
"CRAWLER_MAX_NOTES_COUNT": "20",
"MAX_CONCURRENCY_NUM": "1",
"ENABLE_GET_COMMENTS": "true"
}
}
帮我爬取b站视频资料,关键词为"钱",存储模式为mysql。帮我爬取b站视频号为BV1d54y1g7db,BV1Sz4y1U77N的视频存储模式为json。帮我爬取b站up主视频资料,其id为20813884,存储模式为csv。