目录 / 网页抓取与理解
SKILL
未评级
已上架
网页抓取与理解
多策略级联回退的专业网页内容抓取与理解工具。从轻量HTTP请求开始,逐步升级到HTML解析、JavaScript渲染(Playwright),内置新闻检测、样板文本移除、结构化元数据提取和LLM实体识别。当用户说"抓取网页""爬取内容""网页数据提取""批量爬取""网页内容理解""采集文章数据"时触发。不适用于:需登录认证的网站内容抓取(需额外Cookie/Session配置)、API文档爬取(建议用API文档专用工具)、大文件下载。
存档时间线
| 版本 | 存档时间 | 内容哈希 | 内容 |
|---|---|---|---|
| v1 | 2026-09-21 22:11 | 9fa1313c | 可取 |
版本索引永久保留;内容副本只保留最近 2 版,更早版本仅留索引与哈希(存档时间线的证据链不会因此断裂)。
纠错与举报(发现条目失效、署名有误或涉及侵权?)
提交举报 / 纠错
侵权举报经核验成立后,我们会即时下线该条目并删除已存的内容副本。