mirror of
https://github.com/fawney19/Aether.git
synced 2026-09-02 17:30:23 +08:00
perf: 降低 lru_cache 上限并限制流式响应块内存占用
- 缩减 model_permissions / tiktoken / formula_engine 的 lru_cache maxsize - StreamUsageTracker 响应块增加 4MB 大小限制,超限后只计数不存储 - raw_chunks 改用 deque(maxlen=50) 避免无限增长 - HardwareTooltip 导入路径修正、tooltip 延迟归零、文案中文化
This commit is contained in:
@@ -236,7 +236,7 @@ def validate_and_extract_model_mappings(
|
||||
return True, None, mappings
|
||||
|
||||
|
||||
@lru_cache(maxsize=2000)
|
||||
@lru_cache(maxsize=512)
|
||||
def _compile_pattern_cached(pattern: str) -> regex.Pattern | None:
|
||||
"""
|
||||
编译正则模式(带 LRU 缓存)
|
||||
|
||||
Reference in New Issue
Block a user