Commit Graph
2 Commits
Author SHA1 Message Date
hz4th_coder 77fa757959 v2.0.0: 重构模型管理(dense/MoE+量化版本分离), 版本管理增加执行程序管理, 修复设置页GPU下拉为空
1. 版本管理增加执行程序(binaries)管理: 每个版本可管理llama-server/llama-cli/llama-bench等程序
   - 参数管理中增加执行程序选择器, 可按程序筛选参数
   - 参数可绑定到特定执行程序或适用所有程序

2. 模型管理重构: 一个模型统一参数(区分dense/MoE), 量化版本作为子表管理
   - models表增加model_type(dense/moe)和num_experts字段
   - 新增model_quants表, 每个模型可有多个量化版本
   - 前端模型选择改为: 选模型 -> 选量化版本

3. 修复系统设置中默认GPU下拉为空: 异步加载GPU后再渲染设置
2026-07-20 13:07:33 +08:00
hz4th_coder a407032b4d feat: llama.cpp 命令生成器 v1.0.0
- 支持多版本 llama.cpp 参数 (b6310, b10068)
- GPU 模式 / GPU+CPU 模式
- 多 GPU 支持 (最多4张)
- 实时显存/内存估算
- 自然语言解析生成命令
- 参数分级显示 (重要/隐藏)
- 仅输出非默认值参数
- 后台管理 (GPU/版本/参数 CRUD)
- 模型预设 (7B-70B)
2026-07-19 18:08:36 +08:00