此页是 2026-08-29 的观测快照,查看该模型当前信息 → /m/gramscii__semanticrepair-270m/

归档 / 2026-08-29 / SemanticRepair-270M (Gramscii)

SemanticRepair-270M (Gramscii)

面向 RAG 路由的查询重写小模型

  • MLX
入选理由
270M多语言查询重写器,用于RAG路由前修复请求,支持否定剥离、多意图拆分和NO_REQUEST检测,提供GGUF可经llama-server直接部署,适合需要查询理解的检索系统。
对位
对位 Gemma-3-270M 基座
适合
RAG 路由前查询重写 / 多语言请求拆分与澄清
不适合
直接回答或执行用户指令
规模
270M · 2048 · Q4 ~0.2GB / FP16 ~0.6GB
授权
Gemma · 需自查
框架
llama.cpp / mlx / transformers
血统
量化自 gemma-3-270m
可信度
基于 Gemma-3-270M 微调,含 Q8_0 GGUF,附 400 路由任务评测

仅 safetensors · 无 pickle 加载风险

快速上手示例

ollama run hf.co/Gramscii/SemanticRepair-270M

依赖版本和硬件参数请以源仓库说明为准。

评分详情

Q1
今天能接上用吗   5 / 5
Q2
有可信证据吗   1 / 5
Q3
是新东西吗   4 / 5
总分
10

HuggingFace 原始数据 (抓取于 2026-08-29)

作者
Gramscii
任务类型
text-generation
推理库
mlx
下载
589
点赞
0
许可证
Gemma
标签
mlx, safetensors, gguf, gemma3_text, query-rewriting, query-understanding, intent-detection, routing, retrieval, rag, slm, multilingual, text-generation, conversational, en, it, fr, de, es, dataset:Gramscii/semantic-repair-routing, base_model:google/gemma-3-270m, base_model:quantized:google/gemma-3-270m, license:gemma, endpoints_compatible, region:us

探索

源链接