13 Aug 2026
24m

红杉「Own Your Intelligence」系列专题 2:Fireworks-何时以及如何后训练属于自己的模型

Podcast cover

AI智识录

企业通过后训练(Post Training)将独特的业务判断与产品品味注入模型权重,是构建持久竞争壁垒的核心路径。在 API 门槛日益降低的背景下,仅依赖通用模型极易导致应用被复刻,而通过监督微调(SFT)、偏好优化(DPO)及强化学习(RL),企业能将专业知识与客户偏好深度烘焙进模型,实现特定领域的性能超越与推理成本的显著降低。Fireworks AI CEO Lin Qiao 指出,企业应从产品数据中提炼高质量信号,并建立系统化的自动化评估体系以规避 “奖励黑客” 等陷阱。这一进阶过程不仅是技术优化,更是企业在实现产品市场契合(PMF)后,通过掌控智能供应、优化单位经济性,从而实现长期商业可持续性的关键战略转型。

Outlines

Sign in to continue reading, translating and more.

Open full episode in Podwise