模型生命周期

推理(Inference)

使用已训练好的 AI 模型来实际生成答案的阶段——与模型"学习"的训练阶段相对。

训练只发生一次,或在更新时周期性发生;而推理则是每当有人发送提示词时就会发生一次。当你和 AI 助手对话、生成图片,或在自己的应用里调用 AI API 时,实际运行的就是推理。

如今,业界日常 GPU 需求中占比最大、且在 AI 资本支出中份额不断上升的,已经是推理而非训练——因为使用量的增长取决于使用 AI 的人和产品数量,而不是新模型的数量。