Loading...
Loading...
Compare original and translation side by side
use_case_spec.mduse-case-specificationfinetuning-setupfinetuning-setupfinetuning-setupuse_case_spec.mduse-case-specificationfinetuning-setupfinetuning-setupfinetuning-setup[title]_finetuning.ipynb[title][title]_finetuning.ipynb[title]references/sft_example.mdreferences/dpo_example.mdreferences/rlvr_example.mdreferences/sft_example.mdreferences/dpo_example.mdreferences/rlvr_example.md[title]_finetuning.ipynb[title]_finetuning.ipynbuse_case_spec.md[a-zA-Z0-9](-*[a-zA-Z0-9]){0,62}customer-support-chatbot-v1use_case_spec.md[a-zA-Z0-9](-*[a-zA-Z0-9]){0,62}customer-support-chatbot-v1references/rlvr_reward_function.mdreferences/rlvr_reward_function.mdCUSTOM_REWARD_FUNCTIONevaluator.arnCUSTOM_REWARD_FUNCTIONevaluator.arnACCEPT_EULATrueACCEPT_EULATrueA Jupyter notebook has now been generated which will help you finetune your model. You are free to run it now. Please let me know once the training is complete.已生成Jupyter notebook,可协助你完成模型微调。你现在可以开始运行,训练完成后请告知我。rlvr_reward_function.mdtemplates/rlvr_reward_function_source_template.pytemplates/nova_rlvr_reward_function_source_template.pysft_example.mddpo_example.mdrlvr_example.mdrlvr_reward_function.mdtemplates/rlvr_reward_function_source_template.pytemplates/nova_rlvr_reward_function_source_template.pysft_example.mddpo_example.mdrlvr_example.md