答案不是全面替代。片段显示,多家公司正在把部分流量或部分任务转向自有、定制及开源权重模型。

Harvey是其中最具体的案例。这家估值156亿美元的法律AI初创企业长期以OpenAI的GPT-4为产品核心。据报道援引彭博,今年3月其AI智能体完成重大更新后,用户使用量急剧上升,AI Token使用量在今年增长了二十倍。

使用量上涨带来了明显的成本压力。Harvey的毛利率从年初约50%降至6月的-50%。这组数字呈现的不是模型突然失效,而是调用规模扩大后,模型费用对应用公司财务结构形成了更大影响。

今年8月,Harvey发布自有模型,底层由月之暗面Moonshot AI的Kimi K3提供支持。该报道将其性能描述为接近Anthropic旗下最佳产品,成本仅为后者的一小部分。结合其他AI使用策略的调整,Harvey毛利率已重新转正。

Harvey联席创始人兼总裁Gabe Pereyra表示,此前AI应用表现高度依赖底层模型能力,购买OpenAI和Anthropic的最佳模型很有必要,自训练模型的意义相对有限。成本压力令这套判断开始松动。

变化并不限于法律行业。医疗科技初创企业Abridge宣布,将基于英伟达开源模型为临床场景自建基础模型。AI客服公司Decagon则表示,目前已有80%的查询请求流经其自有模型。

不同公司的进度不能混为一谈。Ramp和Rogo仍在首次探索训练自有模型的可能,Cursor和Cognition则被列为较早发布定制模型的AI应用公司。片段支持的是多条路径并行,而非所有企业已经完成切换。

Ramp联席CEO Karim Atiyeh表示,此前训练专属模型在经济上完全不合理,但今年6月完成7.5亿美元融资,加上开源权重系统性能大幅提升,令这项选择的经济逻辑出现逆转。融资条件与模型能力都被列为前提。

模型供应商的商业策略也在推动调整。报道指出,OpenAI和Anthropic近期均开始对企业用户的模型使用量额外收费,并叠加订阅基础费。对大量消耗Token的应用公司而言,调用规模越大,成本控制越难回避。

供应关系还涉及访问稳定性。片段称,SpaceX完成对Cursor收购后不到一周,OpenAI宣布暂停向Cursor提供模型访问,理由是马斯克旗下公司过去存在违反服务条款的情况。这一事件呈现了依赖单一供应商可能面对的权限风险。

自建模型同样不是低成本捷径。Menlo Ventures合伙人Matt Kraning指出,能够承担模型精调工作的专业工程师薪酬可达数百万美元,而且容易被OpenAI和Anthropic等大型机构挖走。

数据与基础设施也是门槛。Harvey无法访问客户的敏感法律文件,因此需要从AI数据提供商Mercor购买训练数据。Elorian CEO Andrew Dai则指出,自行下载开源权重并管理计算基础设施的开支相当可观。

对于流量较低的早期公司,Andrew Dai认为,按用量购买闭源模型反而可能更经济。Salespeak曾宣布自建大语言模型,数月摸索后放弃,其联席创始人兼CEO Omer Gotlieb称,相比现成模型没有看到显著优势。

现阶段更接近模型组合重排,而不是闭源模型退场。Anthropic表示,Harvey仍需Claude Opus处理最复杂的任务。Redpoint Ventures管理董事Logan Bartlett也预计,企业会降低依赖,但仍会在必要时为最佳性能付费。

回到读者最关心的问题,开源权重模型给部分AI初创企业增加了成本控制和议价空间,但是否值得自建,仍取决于流量、人才、数据、基础设施和任务难度。片段呈现的现实落点,是自有模型承担更多流量,强闭源模型继续处理复杂任务。

仅供信息参考,不构成投资建议。

原始来源:OpenAI和Anthropic营收面临威胁:成本压力下,更多AI初创企业转向开源模型