🧭AlexWortega / same-data-different-losses
基于Qwen3-4B(attention-only LoRA)的六种离线推理损失(SFT、RFT、DFT、RIFT、Offline GRPO、DPO)在相同数学rollouts上训练的交互式权重空间几何可视化,支持浏览36层transformer并观察几何响应。
收藏 25 · 29天前更新 详情
基于Qwen3-4B(attention-only LoRA)的六种离线推理损失(SFT、RFT、DFT、RIFT、Offline GRPO、DPO)在相同数学rollouts上训练的交互式权重空间几何可视化,支持浏览36层transformer并观察几何响应。
面向小型kirana商店的印地语语音与照片库存管理及赊账助手,使用faster-whisper进行语音识别、Surya OCR和Gemma 12B(视觉)进行工具调用与决策,所有模型开源且<32B。
在Hugging Face基础设施上从用户视频训练LTX-2.3的LoRA/IC-LoRA,使用OAuth登录,自动处理bucket创建、任务提交、Gemma编码器下载及LoRA推送。
Qwen图像编辑LoRA集合的演示,支持图像编辑功能。
Kokoro文本转语音模型升级至v1.0版本。
输入关键词,跨模型 / 数据集 / 空间 / 工具 / 资讯 / 论文 检索