Skip to main content

选择合适的模型

不是所有任务都需要最强的模型。合理选择可以大幅降低成本:

优化 Token 使用

  • 精简 System Prompt:避免冗长的系统提示词,把核心指令写清楚即可
  • 控制输出长度:通过 max_tokens 限制输出长度,避免不必要的 Token 消耗
  • 复用对话上下文:不要每轮都重复完整的背景信息

提高可靠性

  • 设置超时:建议 30 秒(常规请求)到 120 秒(图像生成)
  • 实现重试:网络波动时自动重试,配合指数退避
  • 优雅降级:主模型不可用时,自动切换到备选模型

安全建议

  • 不要在前端代码中暴露 API Key
  • 为不同用途创建独立的 API Key
  • 定期在控制台检查用量是否异常
  • 设置令牌额度上限,防止意外超支