选择合适的模型
不是所有任务都需要最强的模型。合理选择可以大幅降低成本:优化 Token 使用
- 精简 System Prompt:避免冗长的系统提示词,把核心指令写清楚即可
- 控制输出长度:通过
max_tokens限制输出长度,避免不必要的 Token 消耗 - 复用对话上下文:不要每轮都重复完整的背景信息
提高可靠性
- 设置超时:建议 30 秒(常规请求)到 120 秒(图像生成)
- 实现重试:网络波动时自动重试,配合指数退避
- 优雅降级:主模型不可用时,自动切换到备选模型
安全建议
- 不要在前端代码中暴露 API Key
- 为不同用途创建独立的 API Key
- 定期在控制台检查用量是否异常
- 设置令牌额度上限,防止意外超支