个人开发者大模型 API 怎么选?场景化选择指南

短答案

原型:GLM-5-Flash(免费);日常主力:DeepSeek-V3(综合性价比);Agent/工具调用:qwen-plus(稳定);批量脏活:qwen-turbo(便宜)。月开销基本能控制在 ¥10-50。

实时价格表:大模型 API 对比;免费额度清单:免费 AI 资源。

常见问题

个人项目一个月 API 大概多少钱?
轻度(每天几百次对话):免费档 + ¥5-10;中度(自用 Agent/机器人):¥20-50;重度(对外服务):上百起。先免费档跑通,账单会告诉你该切哪档。
怎么压成本?
三板斧:①长 system prompt 触发缓存(命中价 1/4);②小模型路由,turbo/flash 答简单的,大模型只兜难题;③控制输出长度(结构化输出比长篇省)。组合可降 50-70%——详见[成本优化指南](/cloud/cost-optimization/)。
什么时候该转本地?
三个信号:月 API 账单 > ¥200(回本周期进入一年内)、数据敏感不能出网、需要无限量批量跑。对照[本地大模型指南](/scenarios/local-llm/)选配置。
↑