SummFlow 2026-06-13 Hugging Face

liumindmind / Neko_Audio-80K_Short

音频数据集,描述缺失

8.2万行 · 179.0 GB

  • 多模态

下载 7.1k · 收藏 19 · 1个月前更新

  • py from datasets import load_dataset ds = load_dataset("liumindmind/Neko_Audio-80K_Short")

openbmb / Ultra-FineWeb-L3

基于L3层级筛选的通用网络文本数据

10.59亿行 · 1.9 TB

  • 文本
  • 文本生成
  • apache-2.0 · 可商用
  • 含中文

下载 67k · 收藏 286 · 1个月前更新

  • py from datasets import load_dataset ds = load_dataset("openbmb/Ultra-FineWeb-L3")

jasperai / monet

经过多阶段过滤和重标注的图文对数据集

0 行 · 136.1 TB

  • 文生图
  • image-feature-extraction
  • zero-shot-image-classification
  • apache-2.0 · 可商用

下载 152k · 收藏 130 · 1个月前更新

Jackrong / Claude-opus-4.7-TraceInversion-5000x

通过迹反转重构的Claude推理链数据集

4,761 行 · 241 MB

  • 文本
  • 文本生成
  • apache-2.0 · 可商用
  • 含中文

下载 1.8k · 收藏 55 · 2个月前更新

  • py from datasets import load_dataset ds = load_dataset("Jackrong/Claude-opus-4.7-TraceInversion-5000x")