hz4th_coder
|
904a4d0d6c
|
v2.1.2: auto调用全部失败时邮件通知 + 网页配置邮箱
- 新增邮件通知: auto 配置被调用后所有提供商都失败(含无可用提供商)时自动发邮件
- 通知路径: chat_completions 400/503 + 通用能力端点(生图/语音/视频) + ASR端点
- 防轰炸: cooldown_seconds(默认300s)最小间隔, 连续失败只发一封(实测3次失败1封)
- 网页配置: 系统配置页新增「邮件通知」卡片, 支持 SMTP服务器/端口/加密(plain/starttls/ssl)/账号密码/发件人/收件人/间隔 + 发送测试邮件按钮
- API: GET/PUT /api/admin/email(密码掩码), POST /api/admin/email/test
- 默认SMTP: mail.tphai.com:587 plain, 收件人 wlq@tphai.com
- 修复: config页loadEmailConfig竞态(卡片未渲染就填充); 邮件失败不影响API响应
v2.1.2
|
2026-08-28 13:17:31 +08:00 |
|
hz4th_coder
|
d387d5ba09
|
v2.1.1: Auto配置改为模型粒度拖动排序 + 历史缓存复用 + 对话生图
- Auto配置编辑: 粒度从提供商改为具体模型, 原生HTML5拖动排序, 修复已保存模型不显示勾选(字符串/对象混拼bug)
- 历史缓存: 带历史上下文的auto请求按首条消息识别会话, 优先复用上次模型命中上游前缀缓存
(可配置: prefer_cache_model + cache_ttl_seconds, 系统配置页开关 + /api/admin/routing)
- 对话生图: chat页选 auto-image/Qwen-Image 直接调生图接口并在对话内展示图片
- 修复: Flask模板缓存导致改模板不生效 -> TEMPLATES_AUTO_RELOAD
- 修复: 自动回退/显式有序模型列表路由, 空列表回退提供商能力选择
v2.1.1
|
2026-08-28 12:16:25 +08:00 |
|
hz4th_coder
|
178968ba1a
|
v2.1.0: 能力路由体系 + 模型管理 + 生图/语音/视频端点 + 大量修复
- 提供商重构: Local Qwen(文本+视觉) / SiliconFlow LLM(文本) / Autodl(文本+视觉) / Autodl Image(生图)
- 能力标签: text/vision/audio_out/audio_in/image_gen/video_gen,模型级可配
- AUTO配置绑定能力: auto/auto-text/auto-vision/auto-image/auto-voice-out/auto-voice-in/auto-video
- 新端点: /v1/images/generations /v1/audio/speech /v1/audio/transcriptions /v1/video/generations
- 模型管理页: 能力切换/增删改/设默认/别名管理
- 修复: 失败切换不再替换用户模型; 熔断冷却后自动恢复; 重试不再白等; embeddings按模型路由
- 修复: 后台模板API路径(/api/admin); 删除v1旧admin目录与双端口混乱
- 修复: run.sh硬编码路径; 死配置RETRY/LOG接线; engine_completions空body防护
- 端口: 16003(16001-16100白名单区间); debug关闭; start.sh部署脚本
v2.1.0
|
2026-08-28 11:41:17 +08:00 |
|
hubian
|
693f5edf33
|
fix: 修正 favicon SVG URL编码
|
2026-04-13 11:48:33 +08:00 |
|
hubian
|
74ab1f61bb
|
fix: 移除重复的 favicon 引用
|
2026-04-13 11:39:27 +08:00 |
|
hubian
|
6a9d811e45
|
feat: 添加浏览器标签图标 🔄
|
2026-04-13 11:37:57 +08:00 |
|
hubian
|
9d35179210
|
fix: 修正后台管理模板API路径为 /api/admin/xxx
|
2026-04-13 11:23:56 +08:00 |
|
hubian
|
34afe96055
|
feat: v2.0.0 - 合并后台管理到单端口
- 端口从 19007+19008 合并为 19007
- 前台API: http://localhost:19007/v1/chat/completions
- 后台管理: http://localhost:19007/admin
- 新增 templates 目录,整合管理页面模板
- 更新所有路由为 /admin 路径
- 后台API统一到 /api/admin 路径下
|
2026-04-13 10:59:00 +08:00 |
|
hubian
|
8086d76e93
|
feat: 添加浏览器标签图标 favicon
- 创建 SVG 格式 favicon(深色背景+大脑/网络节点设计)
- 在所有后台管理页面添加 favicon
|
2026-04-11 11:31:17 +08:00 |
|
hubian
|
247f9e2165
|
fix: 修复高优先级提供商失败时自动切换到备用提供商
- 任何非200响应(400、429、500等)都会触发切换
- 增加 exclude_providers 参数排除已尝试的提供商
- 避免重复尝试失败的提供商
- 添加切换日志便于调试
|
2026-04-10 01:51:36 +08:00 |
|
hubian
|
e96cf6527a
|
feat: 添加请求统计功能 + API使用示例
- 主服务增加请求统计(请求次数、成功/失败、token数)
- 按模型和提供商分别统计
- 每日请求计数自动重置
- 首页增加多种API调用示例(curl、Python OpenAI SDK、Python requests、JavaScript fetch)
|
2026-04-10 01:34:32 +08:00 |
|
hubian
|
db114269f9
|
feat: 添加对话功能
新增功能:
- 对话页面 (/chat)
- 选择不同模型进行对话
- 历史对话保存和加载
- 支持继续历史对话
API:
- GET /api/chat/models - 获取可用模型
- GET /api/chat/list - 获取对话列表
- GET /api/chat/<id> - 获取对话详情
- POST /api/chat/send - 发送消息
- DELETE /api/chat/<id> - 删除对话
- POST /api/chat/<id>/clear - 清空对话
|
2026-04-09 18:29:54 +08:00 |
|
hubian
|
a3b4376871
|
style: Auto配置页面改用Tailwind CSS风格,与其他页面保持一致
|
2026-04-09 18:08:41 +08:00 |
|
hubian
|
3f463f2f98
|
feat: 添加自定义Auto配置功能
新增功能:
- Auto配置管理页面 (/auto-profiles)
- 创建自定义auto模式,如auto-fast, auto-cheap
- 指定候选提供商和优先级
- 支持按优先级/随机选择策略
API:
- GET/POST /api/auto-profiles
- GET/PUT/DELETE /api/auto-profiles/<name>
改进:
- 主服务支持自定义auto模式路由
- 模型列表显示所有auto配置
|
2026-04-09 17:46:47 +08:00 |
|
hubian
|
82100cdf00
|
feat: 后台管理增加提供商动态管理功能
- 新增:添加新的大模型接口提供商
- 新增:编辑已有提供商的参数(API地址、Key、模型列表等)
- 新增:删除提供商
- 新增:拖拽排序调整auto模式的优先级顺序
- 新增:启用/禁用提供商开关
- 优化:主服务动态读取配置,后台修改实时生效
|
2026-04-08 18:14:09 +08:00 |
|
hubian
|
292ff7b03e
|
新增后台管理系统
功能模块:
- 仪表盘: 请求统计、成功率、提供商状态、调用流程说明
- 提供商管理: 查看提供商列表、测试连接、查看详情
- 模型管理: 模型别名映射、提供商对应关系
- 日志查看: 实时日志、自动刷新
- 系统配置: 配置信息查看
端口: 19008
|
2026-04-08 15:49:47 +08:00 |
|
hubian
|
7c77cb9101
|
初始化大模型API中转系统
功能特点:
- 多提供商支持: 配置多个上游大模型提供商
- 优先级调度: 按优先级自动选择可用提供商
- OpenAI API兼容: 完全兼容OpenAI API格式
- 故障切换: 自动切换到备用提供商
- 流式支持: 支持流式和非流式响应
- 模型别名: 支持模型别名映射
- 健康检查: 自动健康检查和熔断
上游配置:
1. [高优先] Local Qwen: http://192.168.2.5:1234/v1 (qwen3.5-4b)
2. [低优先] SiliconFlow: https://api.siliconflow.cn/v1 (DeepSeek-V3.2)
支持的模型:
- auto: 自动选择可用模型
- qwen3.5-4b, qwen3.5, qwen
- deepseek-v3, deepseek-v3.2, deepseek
端口: 19007
|
2026-04-08 15:39:19 +08:00 |
|