中文简介
该数据集包含从 GLM-5.2 高推理设置生成的约 5 万条对话轨迹,上游标注总 token 约 1.2 亿。数据面向文本生成和问答训练;关于生成来源、提示分布、质量过滤、模型服务条款与可再分发性,应在训练前进一步核对。
UPSTREAM README
在 Hugging Face 查看原文 ↗
上游模型卡 / 数据集卡
该数据集包含从 GLM-5.2 高推理设置生成的约 5 万条对话轨迹,上游标注总 token 约 1.2 亿。数据面向文本生成和问答训练;关于生成来源、提示分布、质量过滤、模型服务条款与可再分发性,应在训练前进一步核对。
GLM-5.2 · Conversation-50000x 50,000x traces distilled from `GLM-5.2` on `High` reasoning** Token Count : 120M ## Distribution: You can use this dataset for any purpose and you dont need to credit me, preferably dont claim it as your own. hi - ianncity
上游文件元数据
.gitattributes2.49 KBdataset.jsonl463.03 MBglm-1.webp4.13 KBREADME.md2.07 KB
第三方资源声明
本页面为橙子AI科技的中文整理与服务说明,不代表资源作者或平台官方页面。实际许可、访问和使用条件以上游原文为准。