Loading...
Loading...
共找到 94 个 Skills
使用markdown.new来获取网页内容、转换文件,以及将网站抓取为干净的Markdown格式,而非原始HTML。当你需要读取网页、获取URL内容、转换文档(PDF、DOCX、XLSX、图片等)或抓取网站时,就可以使用这个工具。这包括所有涉及网页总结、从URL提取内容、导入文档、在线研究主题或从网站收集信息的任务。如果你打算从URL获取HTML,请改用markdown.new——它返回的干净Markdown格式比原始HTML少80%的token。
Firecrawl的Printing Press CLI,一款用于与Firecrawl服务交互、执行网页抓取和爬取任务的命令行工具。
Octoparse集成。管理数据、记录并自动化工作流。当用户需要与Octoparse数据进行交互时使用。
Proxy Spider集成。管理组织。当用户需要与Proxy Spider数据交互时使用。
当用户无需完整浏览器会话即可获取URL时,请使用此Skill:从静态页面获取HTML或JSON、检查状态码或请求头、跟随重定向,或获取页面源码以进行简单抓取。当不需要JavaScript渲染和页面交互时,优先使用该工具。它支持代理和重定向控制。
适用于Playwright、Puppeteer、网页抓取及结构化数据提取的浏览器自动化与内容捕获方案。当你需要自动化浏览器工作流、捕获网页内容或从网页提取结构化数据时,可使用本方案。
一款适配LLM优化输出的网页爬取与抓取工具。网页爬虫爬取工具 | Web crawler、web scraper、spider。支持DuckDuckGo搜索、全站爬取、动态页面抓取。智能搜索爬取 | 免费使用,无需API密钥。
提取并理解链接内容——抓取、总结、提取实体。适用场景:分析URL、文章、文档。
访问网页并将其内容提取为markdown格式,或获取图片。可用于阅读文章、文档或任何网页内容。支持处理HTML页面(通过Jina Reader)和图片URL(下载并保存到本地)。
通过MCP使用WebDriver BiDi实现Firefox浏览器的自动化与控制,用于AI辅助的网页测试、数据抓取和交互
从eBay收集店铺信息——包括店铺名称、品牌标识、主推产品、评分。适用于用户想要研究品牌店铺或竞品品类的场景。
当用户需要使用FireCrawl研究主题、用网络资源丰富笔记、搜索和抓取信息,或是撰写科学/学术论文时,可使用本Skill。它能从Markdown文件中提取研究主题,结合抓取的资源生成研究文档,根据研究结果生成BibTeX参考文献列表,并提供用于学术写作的Pandoc/MyST模板,支持引用管理。