ShareGPT在LLM排行榜评测中的数据贡献:公开对话数据对模型排名的影响
ShareGPT显著提升开源模型评测排名:一、作为SFT核心数据源,推动OpenChat等模型在AlpacaEval等榜单登顶;二、其提问与回复结构被用于构建评测提示,导致隐性偏置;三、广泛传播引发数据污染,破坏评估公平性;四、格式标...
ShareGPT显著提升开源模型评测排名:一、作为SFT核心数据源,推动OpenChat等模型在AlpacaEval等榜单登顶;二、其提问与回复结构被用于构建评测提示,导致隐性偏置;三、广泛传播引发数据污染,破坏评估公平性;四、格式标...