hz4th_coder
|
77fa757959
|
v2.0.0: 重构模型管理(dense/MoE+量化版本分离), 版本管理增加执行程序管理, 修复设置页GPU下拉为空
1. 版本管理增加执行程序(binaries)管理: 每个版本可管理llama-server/llama-cli/llama-bench等程序
- 参数管理中增加执行程序选择器, 可按程序筛选参数
- 参数可绑定到特定执行程序或适用所有程序
2. 模型管理重构: 一个模型统一参数(区分dense/MoE), 量化版本作为子表管理
- models表增加model_type(dense/moe)和num_experts字段
- 新增model_quants表, 每个模型可有多个量化版本
- 前端模型选择改为: 选模型 -> 选量化版本
3. 修复系统设置中默认GPU下拉为空: 异步加载GPU后再渲染设置
|
2026-07-20 13:07:33 +08:00 |
|
hz4th_coder
|
f37952c3f6
|
feat: v1.4.3 - 后台系统设置优化
1. 自然语言默认提示文本使用多行textarea
2. 默认GPU/版本/模式使用实时下拉列表选择(非手动输入)
3. 新增 show_nl_section 设置控制前端是否显示自然语言区域
4. LLM系统提示词也使用textarea
5. 布尔类设置项使用是/否下拉选择
|
2026-07-20 00:41:01 +08:00 |
|
hz4th_coder
|
26d7ee0b66
|
feat: v1.4.0 - 五项优化
1. 模型选择: 点击搜索框弹出top5模型,支持搜索过滤
2. 选模型后自动调整参数: ctx_size设为模型默认上下文,n_gpu_layers设为all
- models表新增 default_ctx 字段,各模型预设上下文值
3. 参数配置新增「已改参数」标签页
- 放在最右边,绿色样式区别于其他标签
- 显示所有被修改过(非默认值)的参数
4. 复制按钮移到命令文本框左上角悬空
5. 自然语言默认提示文本可在后台管理中编辑
- 新增 /api/settings/public 接口
- 后台系统设置新增 nl_default_text 配置项
|
2026-07-20 00:05:18 +08:00 |
|
hz4th_coder
|
6691f37e45
|
feat: v1.2.0 - 三项优化
1. 模型选择改为两步式:先搜索选择基模型,再选择量化版本
- 自动选中默认量化版本(Q4_K_M),后台可配置
- 模型新增 base_model 字段,按基模型分组
- 后台模型管理增加基模型字段
2. 参数搜索改为全局搜索
- 搜索时跨所有分类显示匹配参数
- 隐藏分类标签页,显示匹配数量
3. 自然语言支持 LLM 接口
- 后台可配置 LLM API (URL/Key/Model/System Prompt)
- 启用后优先调用 LLM 解析,失败自动回退正则解析
- 兼容 OpenAI API 格式
|
2026-07-19 22:57:38 +08:00 |
|
hz4th_coder
|
5bfb74480b
|
fix: v1.1.0 - 修复5个问题
1. 首页移除后台链接,后台需密码登录
2. 参数输入不再丢失焦点(停止oninput重建DOM)
3. 每个参数单行布局 + 搜索功能
4. 复制命令使用execCommand兼容非HTTPS
5. 模型选择器替代手动输入,26个预设模型,后台可增删改
- 新增 models 数据表
- 新增 /api/models 公开读取接口
- 新增 /api/admin/models CRUD 接口
- 新增 admin 登录/登出/检查接口
- admin 页面加登录界面
- admin 新增模型管理标签页
- CORS 支持 credentials
|
2026-07-19 18:49:05 +08:00 |
|
hz4th_coder
|
a407032b4d
|
feat: llama.cpp 命令生成器 v1.0.0
- 支持多版本 llama.cpp 参数 (b6310, b10068)
- GPU 模式 / GPU+CPU 模式
- 多 GPU 支持 (最多4张)
- 实时显存/内存估算
- 自然语言解析生成命令
- 参数分级显示 (重要/隐藏)
- 仅输出非默认值参数
- 后台管理 (GPU/版本/参数 CRUD)
- 模型预设 (7B-70B)
|
2026-07-19 18:08:36 +08:00 |
|