Loading...
Loading...
共找到 45 个 Skills
使用Actionbook的已验证选择器生成并验证网页爬虫脚本,自动验证生成的脚本并修复错误。
支持任意平台的通用AI网页爬虫,可从Instagram、Facebook、TikTok、YouTube、Google Maps、Google Search、Google Trends、Booking.com和TripAdvisor抓取数据,可用于线索生成...
具备反爬虫绕过、内容提取、未公开API识别和陷阱检测功能的网页爬虫方案。适用于网站内容提取、付费墙处理、爬虫级联实现或社交媒体数据处理场景。涵盖requests、trafilatura、带隐身模式的Playwright、yt-dlp和instaloader等工具的使用模式。
Playwright网页爬虫:支持动态内容、身份认证流程、分页、数据提取、截图功能
使用Puppeteer(Google)进行浏览器自动化和PDF生成。支持无头Chrome控制,用于网页爬虫、截图、PDF生成和自动化测试。
实现一个涵盖URL发现、抓取、解析和存储的网页爬虫流水线。当用户需要构建网站爬虫、审计网站结构或系统性地收集网页数据时使用该技能——即使用户表述为‘抓取网站’、‘爬取所有页面’或‘网站审计蜘蛛’也适用。
一款高性能网页爬虫,用于发现和映射网站结构。当用户需要爬取网站、映射站点结构、发现页面、查找站点内所有URL、分析链接关系或生成站点报告时,可使用本工具。支持站点地图发现、断点续爬、速率限制和HTML报告生成功能。
指导AI Agent使用Playwright、TypeScript和Docker部署生成完整的PageObject模式网页爬虫项目。支持通过agent-browser进行站点分析以自动发现选择器。关键词:scraper、playwright、pageobject、web scraping、docker、typescript、data extraction、automation。
一款适配LLM优化输出的网页爬取与抓取工具。网页爬虫爬取工具 | Web crawler、web scraper、spider。支持DuckDuckGo搜索、全站爬取、动态页面抓取。智能搜索爬取 | 免费使用,无需API密钥。
适用于编写Playwright自动化代码、构建网页爬虫或创建E2E测试场景——提供选择器策略、等待模式以及能最小化测试不稳定性的健壮自动化最佳实践
AnyCap CLI——面向AI Agent的能力运行时。仅需一个CLI即可实现图片生成、图片识别、视频分析、音频分析、音乐创作、语音合成、网页搜索、网页爬虫、文件下载、静态站点托管、云文件存储功能。当Agent需要生成图片、分析图片/视频/音频、生成音频/音乐、搜索或爬取网页、下载远程文件、部署静态站点、存储或分享文件时可使用本工具。也适用于Agent需要进行AnyCap身份验证(登录、API密钥、凭证管理),或者遇到AnyCap报错需要通过`anycap feedback`提交反馈的场景。当提及AnyCap、多模态能力、AI生成媒体、页面托管或网盘存储时触发使用。
构建AI可访问Web界面的指南,这类界面可很好地适配AI Agent、自动化工具和屏幕阅读器。当用户正在构建或评审网页、UI组件、表单或前端功能,且满足以下任一条件时即可使用本技能:他们提到了AI Agent、自动化、Playwright、网页爬虫、可访问性、a11y、aria、语义化HTML,或是询问如何让其UI变得「Agent友好」、「AI友好」或「机器可读」。即使用户没有明确提及AI,在评审现有前端代码的可访问性或自动化兼容性问题时也可以触发本技能。