SummFlow 2026-06-12 Hugging Face

LFM2.5-1.2B-JP (LiquidAI)

日英双语聊天模型,适合代理工作流与工具使用

入选理由
1.2B日语聊天模型,性能领先同尺寸,支持工具调用和结构化输出,提供Transformers/vLLM/GGUF等多框架和Colab示例,适合边缘部署与日语应用。
对位
对位 Qwen3-1.7B、Llama-3.2-1B 日语模型
适合
代理工作流与工具调用 / 日英双语结构化输出
不适合
知识密集型问答
规模
1.2B · 32k · Q4 ~0.8GB / FP16 ~2.8GB
授权
LFM1.0 · 需自查
框架
transformers / vllm / llama.cpp / mlx / onnx
血统
微调自 LFM2.5-1.2B-Base
可信度
3856下载,JMMLU-ProX 36.2,JFBench 54.8,指令遵循79.1,数学62.5,超越Qwen3-1.7B等同规模模型

仅 safetensors · 无 pickle 加载风险

社区实测

轻量高速的日语优化模型,适合边缘设备本地部署,但知识密集型任务和编程场景表现有限

  • 日语对话场景专项优化,适合日语聊天需求
  • 手机/边缘设备本地运行,高吞吐(~280-310 TPS)与低延迟(<15ms TTFT)
  • 支持 Ollama、vLLM、SGLang、Docker 等多种部署方式
  • 知识密集型任务和编程场景表现不佳
  • 官方建议针对具体场景微调以获得最佳效果

截至 2026-06-19

快速上手

llama-server -hf LiquidAI/LFM2.5-1.2B-JP-202606-GGUF