数据集

monet

jasperai/monet

查看上游原文 ↗
上游访问:公开 本站服务:可咨询 内容检查:AI 辅助整理并检查 许可证:apache-2.0 上游版本:baae102c4c96

中文简介

jasperai/monet 是 jasperai 在 Hugging Face 发布的数据集仓库,当前卡片主要关联文生图。本站固定记录上游版本 baae102c4c96,同步到 21775 个文件,文件元数据合计 108.06 TB;访问状态为“公开”,许可证字段为“apache-2.0”。

UPSTREAM README

上游模型卡 / 数据集卡

在 Hugging Face 查看原文 ↗

【README 卡片中文译介】

以下内容依据上游仓库 jasperai/monet 的固定版本 README、卡片字段和文件元数据进行中文结构化整理。它保留便于选型的关键信息,完整技术细节、代码示例和许可文本请同时查看上游原文。

【资源概览】
jasperai/monet 是 jasperai 在 Hugging Face 发布的数据集仓库,当前卡片主要关联文生图。本站固定记录上游版本 baae102c4c96,同步到 21775 个文件,文件元数据合计 108.06 TB;访问状态为“公开”,许可证字段为“apache-2.0”。

【适用方向】
适合评估视觉内容生成、编辑或视频制作工作流。 正式使用前应先抽样检查字段、语言、重复项、敏感信息和训练/测试划分,避免只依据仓库名称判断数据质量。

【版本与规格】
固定版本:baae102c4c96。 任务标签:文生图。 语言字段:en。 数据集卡名称:MONET。 规模分类:100M<n<1B。 上游页面记录的最近更新时间:2026-07-02。

【文件信息】
上游 API 返回 21775 个文件,文件元数据合计 108.06 TB。 已保存文件清单中的主要扩展名:.parquet 43 个、.tar 42 个、.py 5 个、.jpg 4 个、.md 3 个、无扩展名 2 个。 当前较大的文件包括:v1.2.0/cc12m/12-0/000004.tar(2.14 GB);v1.2.0/cc12m/12-0/000005.tar(2.13 GB);v1.2.0/cc12m/13-0/000001.tar(2.13 GB)。 仓库文件较多,本站仅保存前 100 条文件元数据;完整清单请查看上游仓库。

【运行或处理环境】
仓库文件元数据合计 108.06 TB。仅按下载、解压和临时文件估算,建议至少预留约 129.67 TB 可用磁盘;实际需求还取决于压缩率、缓存、数据转换和训练副本,正式处理前应以完整文件清单重新测算。

【使用边界】
许可证显示为“apache-2.0”,具体用途限制、附加政策和归属要求仍以上游原文为准。 数据集还需核对样本来源、隐私与个人信息、标签质量、地域偏差及下游模型的合规要求。

已有简体中文译文 · Codex 基于固定版本 README 与上游元数据生成中文结构化译介 · 2026-07-26 00:51

Dataset Card for MONET MONET** (**M**assive, **O**pen, **N**on-redundant and **E**nriched **T**ext-to-image dataset) is a large-scale, curated image-text dataset designed for training text-to-image (T2I) systems. It contains **103.8 million** high-quality image-text pairs distilled from **2.9 billion** raw pairs across nine heterogeneous open sources (6 *real* and 3 *synthetic*) through successive stages of safety filtering, domain-based filtering, exact and near-duplicate removal, and re-captioning with multiple vision-language models, and is further augmented with synthetically generated samples. Each image is released with pre-computed embeddings, structured annotations and pre-encoded VAE latents to accelerate downstream use. A 4B-parameter latent diffusion model trained *exclusively* on MONET reaches competitive GenEval and DPG scores, demonstrating that MONET lowers the barrier to large-scale, reproducible text-to-image research. Table of Contents Dataset Summary Dataset Sources Curation Pipeline Data Fields Usage Splits Supported Tasks Demos - Retrieval & UMAP Building subsets with FAISS indexes Training Biases, Risks, and Limitations Ethical and Responsible Use Maintenance & Contact Changelog Citation 📋 Dataset Summary **Name:** **MONET**: **M**assive, **O**pen, **N**on-redundant and **E**nriched **T**ext-to-image dataset **Primary modality:** image-text pairs **Scale:** 103.8M **Language:** English (`en`) **License:** Apache-2.0 **Intended use:** text-to-image pretraining, image-retrieval, zero-shot image classification **Available captions:** original alt-text plus up to four synthetic captions from Florence-2, ShareGPT4V-7B, InternVL3-8B and Gemini-2.5-flash-lite, spanning short concept-level to long fine-grained descriptions **Available embeddings:** CLIP ViT-B/32 (512-d), DINOv2 ViT-G/14 (1536-d), SSCD disc_mixup (512-d) **Available metadata:** source/provenance, licensing, aesthetic scores (LAION-improved and an internal classifier), perceptual hash (p

公开页仅展示原文摘录;完整模型卡或数据集卡请前往上游仓库查看。

适用场景

适合评估视觉内容生成、编辑或视频制作工作流。 正式使用前应先抽样检查字段、语言、重复项、敏感信息和训练/测试划分,避免只依据仓库名称判断数据质量。

规模与格式

固定版本:baae102c4c96。 任务标签:文生图。 语言字段:en。 数据集卡名称:MONET。 规模分类:100M<n<1B。 上游页面记录的最近更新时间:2026-07-02。

文件说明

上游 API 返回 21775 个文件,文件元数据合计 108.06 TB。 已保存文件清单中的主要扩展名:.parquet 43 个、.tar 42 个、.py 5 个、.jpg 4 个、.md 3 个、无扩展名 2 个。 当前较大的文件包括:v1.2.0/cc12m/12-0/000004.tar(2.14 GB);v1.2.0/cc12m/12-0/000005.tar(2.13 GB);v1.2.0/cc12m/13-0/000001.tar(2.13 GB)。 仓库文件较多,本站仅保存前 100 条文件元数据;完整清单请查看上游仓库。

上游文件元数据

  • .gitattributes2.49 KB
  • .gitignore44 B
  • assets/coverage_v120.jpg728.16 KB
  • assets/monet.jpg542.81 KB
  • assets/pipeline_v110.jpg304.55 KB
  • assets/pipeline_v120.jpg616.56 KB
  • faiss/__init__.py385 B
  • faiss/clip.py7.21 KB
  • faiss/common.py9.85 KB
  • faiss/dinov2.py3.08 KB
  • faiss/README.md4.64 KB
  • faiss/requirements.txt95 B

硬件建议

仓库文件元数据合计 108.06 TB。仅按下载、解压和临时文件估算,建议至少预留约 129.67 TB 可用磁盘;实际需求还取决于压缩率、缓存、数据转换和训练副本,正式处理前应以完整文件清单重新测算。

注意事项

许可证显示为“apache-2.0”,具体用途限制、附加政策和归属要求仍以上游原文为准。 数据集还需核对样本来源、隐私与个人信息、标签质量、地域偏差及下游模型的合规要求。

获取、校验与交付

咨询此资源时只需发送本页链接或资源准确全称。橙子AI科技会继续核对版本、文件与类型、README资料卡、许可证和访问条件,并在合法访问权限、许可证及平台规则允许的前提下,协助海内外下载、完整性校验及网盘或硬盘交付;本官网本身不托管或下载资源文件。

第三方资源声明

本页面为橙子AI科技基于固定版本上游卡片整理的中文信息与服务说明,不代表资源作者或平台官方页面。实际许可、访问和使用条件以上游原文为准。