模型选择、API配置、降级策略详解
A: DeepSeek(deepseek-chat/deepseek-coder)、通义Qwen(qwen-max/qwen-plus)、OpenAI(gpt-4/gpt-3.5-turbo)、Ollama(本地模型)、Google Gemini、Anthropic Claude。
A: fhcode models set default deepseek-chat。或在.config中设置default_model字段。也可通过环境变量FH_DEFAULT_MODEL指定。
A: models.json中设置providers数组,按优先级排列。主模型故障时自动切换下一个。配置示例:"fallback": ["deepseek", "qwen", "openai"]。
A: 安装Ollama后,fhcode models add --local ollama。可选择模型:deepseek-coder:6.7b、codellama:13b、llama2:7b等。
A: 设置max_tokens限制输出长度;启用cost_tracking统计消耗;配置price_per_token计算费用;企业版支持配额管理和预算告警。
A: 密钥加密存储于~/.feihong-code/keys.json(AES-256加密)。环境变量FH_API_KEY_*也可覆盖。禁止在代码或prompt中硬编码密钥。
A: fhcode models test deepseek-chat。显示响应时间、token消耗、错误信息。支持并发测试和负载压力测试。
A: DeepSeek-Coder:性价比高,中文优秀。Qwen-Max:逻辑推理强。GPT-4:综合能力顶级但昂贵。Ollama本地:隐私安全但速度慢。
A: fhcode models add --custom --name my-model --url https://api.example.com/v1 --key YOUR_KEY。支持OpenAI兼容格式的所有端点。
A: fhcode models list查看所有已配置模型。fhcode models pin
A: 默认超时30秒,可配置timeout字段。超时后自动重试3次,仍失败则切换fallback模型。网络不稳定环境建议增加timeout至60秒。
A: 配置HTTP代理:fhcode config set proxy http://corp-proxy:8080。或使用反向代理将外部API映射到内网地址。
A: 设置max_tokens参数(默认4096)。复杂任务可增加到8192或16384。注意:token越多费用越高,需在质量和成本间平衡。
A: 目前支持提示词工程优化,不支持在线微调。企业客户可申请私有化部署微调后的专用模型。
A: 代码生成:DeepSeek-Coder/CodeLlama。复杂推理:GPT-4/Claude 3。快速响应:Qwen-Plus。本地部署:Ollama。根据任务类型和成本预算选择。
A: fhcode内置限流器,自动控制请求频率。超出限制时排队等待。企业版支持多账户分摊配额。
A: fhcode stats models显示各模型调用次数、token消耗、平均延迟。报表可导出为CSV用于成本分析。
A: 支持。每个会话维护独立上下文窗口。M3恢复审计确保断点续传时上下文完整性。上下文压缩算法自动保留关键信息。
A: 删除~/.feihong-code/models.json重新初始化。或fhcode models reset恢复默认配置。备份功能自动保存历史配置。
A: 持续跟进业界动态,优先支持开源模型和国产大模型。社区可通过Issue提议新增模型支持。