Loading...
Loading...
共找到 94 个 Skills
Firecrawl v2.5 API,用于网页抓取/爬取并生成适用于LLM的markdown格式内容。适用于网站内容提取、处理动态内容,以及应对JavaScript渲染、机器人检测、内容加载错误等场景。
当WebFetch或curl无法完成或不足以处理实时Web任务时,请使用此skill:例如JavaScript渲染页面、表单、截图、PDF、登录流程、验证码/反机器人防护流程以及多步骤导航。它通过Steel CLI运行真实的Steel云浏览器。当Agent需要即时访问、点击、输入、抓取、截图或提取内容时使用。请勿用于编写可复用的Steel SDK/API代码;此类需求请使用steel-developer。如果实时任务失败,请转交至steel-session-debugging;如果迹象表明存在机器人检测、代理、验证码或身份验证问题,请转交至steel-reliability。
通过ASIN从亚马逊收集产品详情——包括ASIN、标题、价格、排名、评论、变体。当用户想要直接通过ASIN查询产品数据时使用。
只需探索网站一次,找到稳定的数据路径,即可将其部署为可复用、支持参数化的Notte Function(一种可调用的HTTP端点,可进行调度并大规模运行)。当用户想要为某个网站构建、创建、生成或「固化」可复用的抓取工具或浏览器自动化任务,将可行的抓取逻辑转换为API/端点/定时任务,或者提出诸如「我之后要运行N个关键词」「让这个可以复用」「获取所有列表」「每天自动处理这个网站」「构建一个从Y中提取X的函数」这类需求时,即可使用本技能。本技能可与notte-functions-doctor配合使用,后者可在网站结构变更时修复已构建的Function。
为AEM Edge Delivery Services导入操作识别已抓取网页中的区块边界和内容序列。执行两级分析(先识别区块,再识别每个区块内的序列)并调研可用组件块。
Apify集成。管理Actors、Datasets、KeyValueStores、RequestQueues、Tasks。当用户需要与Apify数据交互时使用。
基于Claude/OpenAI、网页抓取和Remotion渲染的从调研到视频生成的自动化内容流水线
把一个飞书/Lark 文档链接或普通网页链接抓取并保存到本地目录(飞书文档支持 Markdown/PDF/HTML + 图片附件;普通网页只支持 Markdown,图片保留外链),也能在用户的飞书空间里新建文档,或把 Markdown 内容写进用户有编辑权限的飞书文档(新建/追加/按标题或块插入/替换块/删除块,先 list-blocks 看清块结构再动手)。arXiv 论文(贴链接或裸 ID 均可)走独立脚本,把 PDF、HTML 和转好的 Markdown 一起下载,不依赖浏览器扩展。当用户在任意项目里贴出飞书文档或任意网页 URL 并希望下载/保存/导出/拉取/抓取到本地某路径,或希望把内容写入/追加/更新到某篇飞书文档时,务必使用本技能,即使用户没明说"用 larksnap"或"用扩展"。底层通过本地 daemon 桥接到已登录的 larksnap 浏览器扩展,扩展持有登录态与导出/编辑引擎;遇到未登录/未授权域名时会按退出码提示用户去浏览器登录或授权。本技能自包含(daemon 随技能分发),可从任何项目调用,不依赖 larksnap 仓库。
在已抓取的页面中操控实时浏览器:点击、填写表单、登录、分页、无限滚动。当内容需要交互,或抓取失败/返回内容不完整时使用。
发现并列出网站的URL,支持搜索筛选。适用于“网站测绘”或“查找特定URL”的需求——当用户知道网站但不清楚具体页面,或者想要了解网站结构时使用。
从亚马逊收集搜索结果——包括产品标题、价格、评分、URL、赞助标识。适用于用户想要收集匹配特定关键词或类目的商品列表时使用。
收集Facebook Marketplace上的列表信息——标题、价格、商品状态、卖家信息、来源URL。当用户需要收集列表详情时使用。