Loading...
共找到 193 个 Skills
针对代码式检查无法处理的主观标准,设计LLM-as-Judge评估器。当故障模式需要进行解读(如语气、忠实度、相关性、完整性)时使用本方法。如果故障模式可通过代码检查(正则表达式、schema验证、执行测试)实现,则请勿使用。如果您需要验证或校准评判器,请使用validate-evaluator,而非本方法。