登陆注册

CodeFuse发布面向ToolLearning领域中文评测基准ToolLearning

  • CodeFuse发布面向ToolLearning领域中文评测基准ToolLearning-Eval

    蚂蚁集团旗下CodeFuse发布了首个面向ToolLearning领域的中文评测基准ToolLearning-Eval,旨在帮助开发者跟踪和了解各个ToolLearning领域大模型的优势与不足。该评测基准按照FunctionCall流程划分为工具选择、工具调用和工具执行结果总结三个过程,并提供了相应的数据集供通用模型进行评测分析。
    站长网2024-01-10 17:51:07
    0000