数据集

GLM-5.2-Conversation

ianncity/GLM-5.2-Conversation

查看上游原文 ↗
上游访问:公开 本站服务:可咨询 许可证:apache-2.0 上游版本:c831fbec04d3

中文简介

该数据集包含从 GLM-5.2 高推理设置生成的约 5 万条对话轨迹,上游标注总 token 约 1.2 亿。数据面向文本生成和问答训练;关于生成来源、提示分布、质量过滤、模型服务条款与可再分发性,应在训练前进一步核对。

UPSTREAM README

上游模型卡 / 数据集卡

在 Hugging Face 查看原文 ↗

该数据集包含从 GLM-5.2 高推理设置生成的约 5 万条对话轨迹,上游标注总 token 约 1.2 亿。数据面向文本生成和问答训练;关于生成来源、提示分布、质量过滤、模型服务条款与可再分发性,应在训练前进一步核对。

已有简体中文译文 · 本站中文整理 · 2026-07-23 14:50

GLM-5.2 · Conversation-50000x 50,000x traces distilled from `GLM-5.2` on `High` reasoning** Token Count : 120M ## Distribution: You can use this dataset for any purpose and you dont need to credit me, preferably dont claim it as your own. hi - ianncity

公开页仅展示原文摘录;完整模型卡或数据集卡请前往上游仓库查看。

上游文件元数据

  • .gitattributes2.49 KB
  • dataset.jsonl463.03 MB
  • glm-1.webp4.13 KB
  • README.md2.07 KB
第三方资源声明

本页面为橙子AI科技的中文整理与服务说明,不代表资源作者或平台官方页面。实际许可、访问和使用条件以上游原文为准。