SummFlow 2026-07-10 Hugging Face

IlyaGusev / habr

俄罗斯IT博客habr.com的帖子与评论数据

30.2万行 · 10.8 GB

  • 多模态
  • 文本生成

下载 528 · 收藏 72 · 3个月前更新

  • py from datasets import load_dataset ds = load_dataset("IlyaGusev/habr")

Crownelius / Complete-FABLE.5-traces-2M

基于FABLE.5/Claude的推理轨迹数据,经来源清理

5.1万行 · 12.6 GB

  • 多模态
  • 文本生成
  • mit · 可商用

下载 7.5k · 收藏 87 · 14天前更新

  • py from datasets import load_dataset ds = load_dataset("Crownelius/Complete-FABLE.5-traces-2M")

ProCreations / grug-think

使用grug简短思考风格的Agent对话数据

10.1万行 · 4.4 GB

  • 文本
  • 文本生成
  • apache-2.0 · 可商用

下载 301 · 收藏 15 · 12天前更新

  • py from datasets import load_dataset ds = load_dataset("ProCreations/grug-think")

ASLP-lab / WSC-Train

大规模四川话语料,带丰富标注的语音数据集

0 行 · 3.3 GB

  • apache-2.0 · 可商用

下载 432 · 收藏 142 · 14天前更新