Appearance
AI 产品的成本与变现
读完本节 · 你能带走
- 会粗算:单次任务成本 ≈ token + 工具 +(可选)人审
- 能把「效果提升」和「付费意愿」对齐,而不是只追更强模型
- 掌握四类降本杠杆:缓存 · 路由 · 早退 · 人审分级
成本拆三块
PM 要写进规格的 不要求精确到分,但要给出 数量级 与 上限(例如:单次对话成本上限 ¥0.X,超限则降级)。
| 成本块 | 含什么 | 规格里写清 |
|---|---|---|
| 模型调用 | 输入/输出 token、多轮、重试 | 单次预算上限、允许的模型档 |
| 检索 / 工具 | 向量检索、插件、外部 API | 每轮最多几次、失败降级 |
| 人审 / 运营 | 抽检、高危复核、客服兜底 | 哪些节点必审、抽检比例 |
text
单次任务成本 ≈
(输入 + 输出) token × 单价
+ 工具 / 检索费用
+ 人审分钟 × 人力单价 × 触发概率上限必写
单次任务成本天花板
超限动作降级
换小模型 / 早退 / 拒答
测量周均
周均是否压在上限内
效果 vs 付费
| 问题 | 错误做法 | 正确对齐 |
|---|---|---|
| 幻觉偶发 | 一律上最强模型 | 高危人审;低危允许降级 |
| 用户觉得慢 | 无限加上下文 | 缩短链路、早退、缓存 |
| 转化差 | 再堆功能 | 先查激活与价值叙事 |
| 毛利为负 | 靠融资扛调用 | 收紧试用、路由、涨价或砍无限 |
决策句 这笔模型升级,能让付费方多付多少 / 多留多久?说不清就先别升。
四类降本杠杆
按「改动成本低 → 高」优先左侧:
① 缓存
高频同问 / 同检索 · FAQ 与模板输出 ② 路由
简单走小模型 · 复杂再上大模型 ③ 早退
缺槽位先追问 · 不该用 AI 则规则/人工 ④ 人审分级 不是每条都审:按风险(金额、医疗/法律暗示、对外承诺)分级。高风险必审;低风险抽检。写进 PRD「成本与降级」小节。
走一遍 · 母婴馆路由日常选购 → 便宜 / 快模型
成分对比解读 → 大模型 + 可引用片段
疑似医疗建议 → 拒答或人审,不硬生成
成分对比解读 → 大模型 + 可引用片段
疑似医疗建议 → 拒答或人审,不硬生成
变现侧:进套餐
对照 定价:
| 成本压力 | 套餐动作 |
|---|---|
| 试用被刷 | 次数 / 时长 / 降模型 |
| 标准档毛利薄 | 用量包、默认小模型 |
| 进阶吃重模型 | 明确「含人审 / 高档模型」并定价覆盖 |