LoRA 保持基准模型冻结:只读,不写。所以 Soup 将其存储在系统 RAM 中,并将其分层流式传输到 GPU 中。峰值 VRAM 变成一层,而不是整个模型。基于 RTX 3050 Laptop 4 GB 测试:Llama-3.1-8B 在 3.32 GB 峰值下训练 119.6 tok/s。一个 YAML 文件,一条命令。支持 SFT、DPO、GRPO、KTO、评估、门控和导出。Apache-2.0。每个数字都已发布,包括我测量并丢弃的那些。
Open SourceDeveloper ToolsArtificial IntelligenceGitHub







广告位 (响应式横幅)
💬 用户评论
📋 基本信息
上线日期
2026年8月9日
点赞数
93
评论数
3
数据来源
网络公开数据
广告位 (响应式横幅)






该工具在 Product Hunt 上有 3 条评论。
在 Product Hunt 上查看评论 →