高性价比模型
适合分类或短回复等高吞吐、低延迟场景的低成本模型。
- GPT-5.6 Luna — 输入 / 百万 Token $0.200, 输出 / 百万 Token $1.20
- Claude Haiku 4.5 (latest) — 输入 / 百万 Token $1.00, 输出 / 百万 Token $5.00
- Gemini 3.5 Flash Lite — 输入 / 百万 Token $0.300, 输出 / 百万 Token $2.50
适合分类或短回复等高吞吐、低延迟场景的低成本模型。