ZoomInfo Technologies Inc.近日宣布推出GTM Bench基准测试系统,专门用于评估大型语言模型和人工智能代理在真实市场推广任务中的表现。 GTM Bench从两大维度对AI系统进行评分:“任务完成度”衡量系统完成所要求工作的比例,“数据溯源性”衡量返回数据可追溯至真实、现时来源的比例。在首轮测试中,ZoomInfo的GTM.AI获得综合指数77分,而Apollo为47...
网页链接ZoomInfo Technologies Inc.近日宣布推出GTM Bench基准测试系统,专门用于评估大型语言模型和人工智能代理在真实市场推广任务中的表现。 GTM Bench从两大维度对AI系统进行评分:“任务完成度”衡量系统完成所要求工作的比例,“数据溯源性”衡量返回数据可追溯至真实、现时来源的比例。在首轮测试中,ZoomInfo的GTM.AI获得综合指数77分,而Apollo为47...
网页链接
精彩评论