Loading...
Loading...
共找到 351 个 Skills
Open WebUI 详细中文指南:涵盖架构、认证、功能、流水线、API、RAG、扩容、调试及隐藏功能。当你有任何关于Open WebUI的问题时都可使用本指南——比如它的架构原理、部署方法、认证配置(OAuth、LDAP、JWT)、编写功能或流水线、连接模型(Ollama、OpenAI)、配置RAG/知识库、生产环境扩容、问题排查等。此外,编写Open WebUI相关代码(如filter、pipe、action类型的功能、流水线、配置、docker-compose)时也可参考本指南。
Cluely平台帮助——具备实时指导覆盖层、会前简报、会议记录、对话分析和知识库RAG功能的实时AI会议助手。适用于在销售电话中设置Cluely以获取实时AI提示、上传公司文档配置知识库以实现实时RAG检索、通过Merge.dev将Cluely连接到HubSpot或Salesforce、解决转录准确性或说话人识别错误问题、对比Cluely Pro与Pro + Undetectability套餐,以及设置团队指导评分卡和错失机会追踪场景。请勿用于在不同供应商的AI记笔记工具之间做选择(请使用/sales-note-taker)或为指导目的复盘通话(请使用/sales-call-review)。
适用于RAG与语义搜索的Google Gemini embeddings API(gemini-embedding-001)。可用于向量搜索、Vectorize集成,或解决维度不匹配、速率限制、文本截断等问题。
构建具备语义分块、增量索引和过滤检索功能的生产级RAG系统。 适用于实现文档摄入流水线、基于Qdrant的向量搜索或上下文感知检索场景。涵盖分块策略、变更检测、负载索引和上下文扩展内容。 不适用于无生产需求的简单相似度搜索场景。
使用Google GenAI SDK管理和查询Agent Platform RAG Engine语料库,并检索相关上下文。适用于列出RAG语料库或文件、检查语料库、检索上下文或基于RAG语料库生成内容的场景。请勿用于标准数据库查询(请使用SQL/Spanner技能)、Google Workspace RAG或其他RAG产品(如gRAG)。
已部署的NVIDIA RAG Blueprint服务器性能基准测试:基于单个YAML配置的性能分析流程 + aiperf负载测试。不适用于准确性/RAGAS评分(请使用rag-eval)或服务部署/修复(请使用rag-blueprint)。
当用户需要与论文数据库交互时应使用此Skill——包括列出论文、搜索内容、查看论文详情、添加论文或导出上下文。适用于诸如“搜索关于X的论文”“添加这篇arXiv论文”“查看论文Y中的公式”“我有哪些论文”这类查询。直接查询时优先使用CLI而非MCP RAG工具。
借助Gemini嵌入模型(gemini-embedding-001)构建RAG系统和语义搜索。支持768-3072维度向量、8种任务类型,可集成Cloudflare Vectorize。能预防13种已记录的错误。 适用场景:向量搜索、RAG系统、语义搜索、文档聚类。故障排查:维度不匹配、需要归一化、批量排序bug、内存限制、任务类型错误、速率限制(100次/分钟)。
为LLM提取PDF文本。适用于为RAG、文档分析或文本提取处理PDF的场景。支持API服务(Mistral OCR)和本地工具(PyMuPDF、pdfplumber)。可处理纯文本PDF、表格以及通过OCR处理扫描版文档。
面向LLM应用的专业提示词工程,涵盖提示词设计、优化、RAG系统、Agent架构以及AI产品开发。
通过模型选择、分块策略、缓存和性能调优,优化RAG系统的向量嵌入。适用于构建需要高性价比、高质量嵌入的语义搜索、RAG流水线或文档检索系统。
面向AI/ML应用、语义搜索和RAG系统的向量数据库实现方案。适用于构建聊天机器人、搜索引擎、推荐系统或基于相似度的检索系统。内容涵盖Qdrant(重点)、Pinecone、Milvus、pgvector、Chroma等向量数据库,以及嵌入生成(OpenAI、Voyage、Cohere)、文本分块策略和混合搜索模式。