fawney19
50343d5459
refactor: 移除 Provider/Endpoint 级别的 timeout 配置,改用全局环境变量
...
- 废弃 Provider.timeout 和 ProviderEndpoint.timeout 字段(保留数据库列以兼容)
- 非流式请求超时由 HTTP_REQUEST_TIMEOUT 环境变量控制(默认 300 秒)
- 流式请求首字节超时由 STREAM_FIRST_BYTE_TIMEOUT 环境变量控制(默认 30 秒)
- 移除前端表单中的超时配置输入框
- 简化 settings.py 中的 TTFB 超时解析逻辑
- 更新 API 请求/响应模型,移除 timeout 字段
- 更新导入导出功能,不再包含 timeout 配置
2026-01-16 13:08:39 +08:00
LewisPen
691a71ac05
refactor: 将 BlockRenderer 和 ConversationView 样式改为 Tailwind
...
移除手写 CSS,统一使用 Tailwind 原子类,符合项目设计规范:
- BlockRenderer: 删除 260 行 scoped CSS,改用 Tailwind 类
- ConversationView: 删除 38 行 scoped CSS,改用 Tailwind 类
- 使用样式映射对象管理消息块的角色样式
2026-01-16 11:22:11 +08:00
fawney19
e6a31a61db
fix: 增强嵌入式错误的状态码提取与处理
...
- ParsedResponse 新增 embedded_status_code 字段存储嵌套状态码
- 新增 _extract_embedded_status_code 函数支持从多种格式提取状态码
- 非流式响应增加嵌套错误检测逻辑
- 统一使用 embedded_status_code 替代从 error_type 解析数字的方式
- fallback_orchestrator 使用嵌入式状态码进行错误记录
2026-01-16 11:01:05 +08:00
fawney19
adc82532eb
refactor: 将对话解析器拆分为独立模块
...
将 lib/conversationParser 重构为 conversation/ 目录:
- 按 API 格式拆分解析器 (claude.ts, openai.ts, gemini.ts)
- 提取公共渲染逻辑到 render.ts
- 添加解析器注册表支持自动格式检测
- 更新组件导入路径
v0.4.1
2026-01-16 03:11:41 +08:00
fawney19
02770d56df
refactor: 重构请求详情对话视图的渲染架构
...
- 新增 BlockRenderer 组件,支持递归渲染多种内容块类型
- 将 ConversationView 改为使用 RenderResult 和 BlockRenderer
- 删除旧的 messageExtractor 工具,改用 conversationParser 库
- 更新 RequestDetailDrawer 中的对话解析和复制逻辑
2026-01-16 02:53:47 +08:00
fawney19
1366c0b973
fix: 优化请求详情抽屉在窄屏的响应式布局
...
- 窄屏时抽屉占满全宽,宽屏时保持 800px
- 减小窄屏时的内边距 (px-3/py-3 vs px-6/py-4)
- 阶梯定价标题行在窄屏时改为垂直布局
- Tab 按钮内边距响应式调整,工具栏不被压缩
2026-01-16 01:53:59 +08:00
fawney19
8bd3a894f1
fix: 修复请求链路追踪宽度不足时节点被遮挡的问题
...
使用 justify-content: safe center 替代 center,
当内容溢出时自动回退到靠左对齐,确保左侧节点可滚动访问
2026-01-16 01:43:52 +08:00
fawney19
6cc66e404b
fix: 将请求详情抽屉的请求头默认数据源改为提供商
2026-01-16 01:38:59 +08:00
fawney19
b1cf348abb
fix: 修复迁移脚本对非对象类型 headers 的处理
...
在 headers -> header_rules 迁移时,添加 jsonb_typeof 类型检查,
避免 jsonb_each_text 在非对象类型数据上报错。
2026-01-16 01:26:45 +08:00
fawney19
8e11f3864a
feat: 添加 API Key 锁定功能和请求头规则系统
...
1. API Key 锁定功能
- 管理员可锁定/解锁用户的 API Key
- 锁定后用户无法使用、修改或删除该 Key
- 前端显示锁定状态并禁用相关操作
2. 请求头规则系统
- 将 endpoint.headers 升级为 header_rules
- 支持 set(设置)、drop(删除)、rename(重命名)操作
- 前端提供可视化规则编辑界面
- 包含数据迁移脚本
Close #37 Close #86 Close #88
2026-01-16 01:18:54 +08:00
fawney19
ea45918561
refactor: 统一请求头处理逻辑到 headers.py
...
- 新增 src/core/headers.py 集中管理头部处理函数
- 扩展 api_format_metadata.py 添加 extra_headers 和 protected_keys 配置
- 将各 adapter 中重复的头部方法提取到基类,统一调用 headers.py
- 移除 transport.py 中未使用的 build_provider_headers 函数
- 添加 headers 模块的单元测试
2026-01-15 22:25:56 +08:00
fawney19
80887dd2cc
fix: 修复请求详情抽屉的默认状态问题
...
- viewMode 默认改为 formatted,避免按钮被禁用
- currentExpandDepth 默认改为 0,与收缩状态一致
2026-01-15 19:23:01 +08:00
fawney19
b2731eddf3
fix: 修复对话视图合并后的问题
...
- 移除未使用的变量 index
- 修复展开/收缩按钮在非请求体Tab被禁用的问题
- 删除未使用的 copyJsonToClipboard 函数
Co-Authored-By: LewisPen <LewisPen@nyadoo.com >
2026-01-15 19:18:32 +08:00
fawney19
18ac4fe2f3
Merge branch 'pr-99'
2026-01-15 19:16:01 +08:00
fawney19
81b7b74fd4
refactor: 简化优先级拖拽交换逻辑并优化用户配额处理
...
- 优先级拖拽改为直接交换优先级值,而非重新编号
- 添加 Provider 优先级的点击编辑功能
- 创建用户时由后端统一处理默认配额逻辑
- 移除前端 getDefaultQuota API 调用和后端对应端点
Close #97
2026-01-15 18:59:01 +08:00
LewisPen
38607332b9
feat(usage): 请求详情页面添加对话视图功能
2026-01-15 18:37:59 +08:00
fawney19
dd387735d4
feat: LDAP 用户隐藏密码修改功能并应用默认配额
...
- /me API 返回 auth_source 字段
- 前端 Settings 页面对 LDAP 用户隐藏密码修改卡片
- LDAP 用户首次登录创建时使用系统默认配额
Close #98
2026-01-15 17:57:58 +08:00
fawney19
d9645fa062
feat: 用户创建和注册时使用系统配置的默认配额
...
- 新增 /api/admin/users/defaults/quota 接口获取默认配额
- 用户注册时从系统配置读取默认配额
- 管理员创建用户时自动获取并使用系统默认配额
2026-01-15 17:41:04 +08:00
fawney19
026f4b9c0e
fix: 修复模型测试时正则映射支持及缓存装饰器实例方法兼容
...
- ModelsTab 加载时并行获取模型映射预览数据
- 测试模型时自动识别正则映射并使用映射名称和指定 key
- 密钥变更后并行刷新模型列表和模型映射
- 修复 cache_decorator 对实例方法的 context 参数解析
2026-01-15 17:26:52 +08:00
fawney19
a223819dd7
refactor: 提取正则工具模块并清理废弃代码
...
前端:
- 新增 model-mapping-regex.ts 工具模块,统一正则验证和 LRU 缓存
- ModelMappingsTab/RoutingTab 重构为使用 computed 缓存匹配结果
- 移除多个组件中未使用的变量和函数
- 添加 HTMLImageElement/HTMLIFrameElement 到 ESLint 全局类型
- 修复 vitest 需要 --experimental-require-module 的问题
后端:
- 移除废弃的异步数据库支持 (get_async_db, AsyncSession)
- 将 async_utils 从 database/ 迁移到 utils/
- 改进 database.py 类型标注
- 修复 email 模块的 aiosmtplib 可选导入类型问题
2026-01-15 17:03:19 +08:00
fawney19
bc16c0eec8
style(usage): 调整使用记录表格类型列宽度
2026-01-15 13:44:22 +08:00
fawney19
0d26fd8c5a
fix(usage): 修复活跃请求中成本字段为 0 时被错误置为 None 的问题
...
将 actual_cost 和 rate_multiplier 的判断条件从 `if value else None`
改为 `if value is not None else None`,确保数值 0 不会被误判为 False
2026-01-15 13:40:52 +08:00
fawney19
bc2b430ec3
style(usage): 请求链路节点改回居中布局并修复 TypeScript 兼容性
...
- 将节点布局从两端对齐改回居中展示
- 将 findLastIndex 替换为向后兼容的 for 循环实现
2026-01-15 13:29:22 +08:00
fawney19
6de113b852
refactor(update): 改用 GitHub Tags API 检查更新
...
- 从 Releases API 切换到 Tags API 获取版本信息
- 从 annotated tag 的 message 中获取更新日志
- 支持从 tagger 或 commit 获取发布时间
v0.4.0
2026-01-15 12:30:05 +08:00
fawney19
abe65ad01b
fix(usage): 解耦活跃请求轮询与全局刷新逻辑
...
1秒轮询始终用于活跃请求的实时更新,不再受全局刷新状态影响
2026-01-15 12:19:46 +08:00
fawney19
76f648b4eb
feat(usage): 活跃请求轮询增加缓存与成本字段
...
- 后端 getActiveRequests 返回新增 cache_creation/read_input_tokens、actual_cost、rate_multiplier
- 前端轮询时同步更新这些字段到记录中
- 优化刷新逻辑:全局刷新开启时停止1秒轮询,关闭时恢复
2026-01-15 12:13:47 +08:00
fawney19
514bf7e3ed
feat(usage): 改进请求追踪与缓存预热
...
- 区分请求重试与故障转移:新增 has_retry 标识亲和缓存重试
- 修正候选 TTFB 计算:记录候选自身的首字节时间而非全局时间
- Streaming 状态同步 rate_multiplier,支持按 API 格式配置
- 新增缓存预热服务:启动时预热仪表盘统计、热力图、每日统计
- 优化缓存 TTL 配置:仪表盘统计 2 分钟、热力图和每日统计 10 分钟
- 自动刷新间隔从 10 秒调整为 5 秒
2026-01-15 11:45:46 +08:00
fawney19
24b65d76b5
feat(models): Key 白名单变更时自动关联 GlobalModel
...
- Key 创建/更新/自动获取模型后,检查 allowed_models 变化
- 根据 GlobalModel 的映射规则自动创建 Provider 关联
- 添加缓存失效机制确保映射规则能匹配新白名单
2026-01-15 10:32:48 +08:00
fawney19
5a81be0756
fix(routing): 有效 Keys 计数考虑模型白名单权限
...
路由预览中计算有效 Keys 数量时,除了检查 is_active 状态外,
还需检查 Key 的白名单是否允许当前模型(包括模型映射匹配)。
2026-01-15 09:21:30 +08:00
fawney19
dc2996988b
fix(routing): 移除 Key 的 RPM 显示并修复有效提供商计数
...
- 移除链路预览中 Key 健康度后面的 RPM 数值显示
- 修复有效提供商计数逻辑,无 Key 的提供商不再计入有效数量
2026-01-15 02:59:15 +08:00
fawney19
c51f94ee87
style(ui): 将请求链路轨道布局从居中改为两端对齐
...
fix #94
Co-Authored-By: AAEE86 <AAEE86@users.noreply.github.com >
2026-01-15 02:44:06 +08:00
fawney19
5d34426428
feat(models): 路由预览显示 Key 白名单的模型映射匹配
...
- 后端返回 GlobalModel 的 model_mappings 正则模式
- 前端用映射模式匹配 Key 白名单,显示匹配的模型名
2026-01-15 02:36:00 +08:00
fawney19
4835ca13f5
feat(models): 模型映射支持按提供商分组并自动关联
...
- 映射匹配结果按提供商分组显示,支持单个关联
- 保存映射规则时自动批量关联未关联的提供商
- 优化模型详情加载逻辑,并行获取最新数据
- 移除冗余的调度器日志输出
2026-01-15 02:11:44 +08:00
fawney19
84f46d5ea7
fix: 修复移动端菜单背景样式不一致问题
...
closes #93
2026-01-15 00:39:38 +08:00
fawney19
19209181dc
feat(models): 添加全局 Key 白名单数据支持模型映射实时匹配
...
- 新增 GlobalKeyWhitelistItem 类型定义
- 路由预览 API 返回 all_keys_whitelist 字段,包含所有活跃 Provider 的 Key 白名单
- 前端 ModelMappingsTab 改用全局白名单数据进行实时匹配
2026-01-15 00:35:28 +08:00
fawney19
154ec94c58
fix: 关闭 auto_fetch_models 时保留锁定的模型
2026-01-14 21:31:05 +08:00
fawney19
8909e6741a
Merge PR #92 : feat(keys): trigger immediate model fetch when auto_fetch_models is enabled
2026-01-14 21:30:29 +08:00
fawney19
45a58a4a03
fix: 修复模型测试使用记录中 API 格式显示错误
...
将 check_endpoint 方法中的 api_format 参数从 cls.name 改为 cls.FORMAT_ID,
确保使用记录存储标准枚举值(如 GEMINI)而非内部名称(如 gemini.chat)
2026-01-14 21:19:34 +08:00
fawney19
0348b7d915
refactor: 废弃 rate_multiplier 字段,改进成本倍率回退逻辑
...
- 在前后端模型中为 rate_multiplier 添加 @deprecated 标记
- 修复 rate_multipliers 回退逻辑:当 rate_multipliers 存在但未配置当前格式时使用 1.0
- ModelMappingsTab: 删除映射后自动保存,简化空状态提示
- ModelManagement: 添加 refreshModel 事件在映射更新后刷新模型数据
- CacheAwareScheduler: 添加映射匹配调试日志,移除 candidate_models 限制
2026-01-14 21:07:28 +08:00
AAEE86
c61c3147ba
feat(keys): clear allowed_models when auto_fetch_models is disabled
...
Add logic to automatically set allowed_models to null when auto_fetch_models is turned off for a key. Also include auto_fetch_models and locked_models fields in config export/import, and trigger model fetching for keys with auto_fetch_models enabled during import.
2026-01-14 20:05:52 +08:00
fawney19
bec9c3a989
refactor: 将模型别名(alias)统一重命名为模型映射(mapping)
...
- 重命名 API: alias-mapping-preview -> mapping-preview
- 重命名类型: AliasMatchedModel -> MappingMatchedModel 等
- 重命名字段: model_aliases -> model_mappings, alias_matched_model -> mapping_matched_model
- 重命名前端组件: ModelAliasesTab -> ModelMappingsTab
- 重命名验证函数: validate_model_aliases -> validate_model_mappings
- 同步更新相关测试用例
- 补充 ModelService 中新增/批量创建模型时的缓存失效逻辑
2026-01-14 19:35:41 +08:00
fawney19
24ece00e93
test(aware-scheduler): 添加模型支持检查逻辑的单元测试
...
测试 _check_model_support_for_global_model 方法的以下场景:
- Provider 没有配置模型时返回 False
- Provider 只有其他模型时返回 False
- Provider 有匹配模型时返回 True
- Provider 模型未激活时返回 False
2026-01-14 18:22:22 +08:00
AAEE86
1becf39269
feat(keys): trigger immediate model fetch when auto_fetch_models is enabled
2026-01-14 18:18:31 +08:00
fawney19
b272109055
refactor(model-permissions): 简化 allowed_models 为纯列表格式
...
移除按 API 格式区分的字典模式(Dict[str, List[str]]),统一使用简单列表格式。
- 删除 normalize_allowed_models 的 api_format 参数
- 删除 check_model_allowed 的 api_format 参数
- 简化 merge_allowed_models 为直接列表交集
- 移除前端的字典模式兼容代码和警告 UI
- 删除 is_format_mode、convert_to_format_mode 等辅助函数
2026-01-14 17:57:21 +08:00
fawney19
133f3108f0
chore(config): 移除冗余的超时配置注释说明
2026-01-14 17:31:24 +08:00
fawney19
0ed053b02f
fix(model-resolution): 修复模型解析优先级和别名匹配范围
...
- 调整 ModelCacheService 解析优先级:优先直接匹配 GlobalModel.name,
避免被 provider_model_name 误导到错误的 GlobalModel
- 为 check_model_allowed_with_aliases 新增 candidate_models 参数,
限制别名匹配只能落到 Provider 实际配置的模型名上
- 对 allowed_set 排序以确保别名匹配结果的确定性
- 调整 HTTP_READ_TIMEOUT 默认值从 300s 改为 60s
- 优化 ModelMappingTab 组件布局,将正则表达式提取到 Key 级别展示
- 补充 .env.example 超时配置文档
2026-01-14 17:29:04 +08:00
fawney19
97d66a8d0c
feat(trace): 在请求链路追踪中记录并展示首字时间(TTFB)
...
将 first_byte_time_ms 添加到候选记录的 extra_data 中,
并在前端时间线组件中展示该指标。
2026-01-14 16:41:58 +08:00
fawney19
ec3c5994d9
fix(orchestration): 处理流式响应中的嵌入式错误
...
- 新增对 EmbeddedErrorException 的处理逻辑
- 客户端错误(如 prompt too long)停止重试并抛出异常
- 服务端错误允许重试或故障转移
- 将 _is_client_error 改为公开方法 is_client_error
2026-01-14 15:43:02 +08:00
fawney19
1f6e384d2b
fix(ui): 居中对齐时间线轨道内容
2026-01-14 15:43:01 +08:00
fawney19
5e4099a588
fix(proxy): 新增响应头过滤函数,避免透传不兼容的上游头
...
添加 filter_proxy_response_headers 函数过滤 content-length、content-encoding、
transfer-encoding 等 hop-by-hop 和 body-dependent 头,防止客户端解码失败。
统一在 chat_handler_base、cli_handler_base、stream_telemetry 和 usage recorder
中使用该函数处理响应头透传。
2026-01-14 14:50:33 +08:00