actava / chi-bench美国医疗工作流的AI智能体基准测试,覆盖三个长期域。作者actava规模101 行 · 929 KB模态多模态任务文本生成授权apache-2.0 · 可商用语种en下载1,232收藏25pyfrom datasets import load_dataset ds = load_dataset("actava/chi-bench")复制观测时间线2026-05-22 · 当日卡片 →