法律AI公司Harvey转向开源模型以应对成本危机

2026-09-23 2629

近年来,估值达到156亿美元的法律AI初创公司Harvey,其目标原本是为律师提供基于OpenAI GPT-4等模型的专业服务。然而,随着算力和调用成本的急剧上升,Harvey不得不重新评估对这些大型AI技术公司的深度依赖。根据知情人士透露,Harvey在3月更新AI模型后,客户使用频率大幅提高,但毛利率却从年初的约50%骤降至6月份的-50%。面对成本压力,Harvey选择加入越来越多的企业,转向开放权重模型生态,包括实力逐渐增强的中国开源模型。

与美国AI巨头的高昂闭源专有模型相比,这些开源架构不仅显著降低了调用门槛,还使Harvey等企业能够利用自身私有数据深度定制专属模型。目前,红杉资本和General Catalyst等知名投资机构也在支持这一技术转型。此举不仅帮助企业减轻了成本负担,也使其重新获得了核心技术的控制权。随着OpenAI和Anthropic积极筹备各自的IPO,这股“去巨头化”的浪潮可能会分流这两个公司的商业收入。

Harvey在今年8月推出了首款自研模型,底层基于中国大模型开发商月之暗面的Kimi K3。此模型在性能上接近Anthropic的顶级方案,但综合成本仅为其一小部分。有内部人士透露,得益于新模型的上线及整体AI调用架构的优化,Harvey的毛利率已经成功回升。此外,医疗科技初创公司Abridge也在基于英伟达的开源架构构建适合临床的定制基础模型。AI客服公司Decagon则表示,现已有80%的咨询通过其自有模型完成。 球友会

在金融科技领域,Ramp和Rogo等公司也开始尝试自主训练模型。而在编程方面,刚被SpaceX收购的Cursor和估值480亿美元的Cognition,也率先推出了定制化模型。Ramp的首席执行官Karim Atiyeh指出,尽管早期模型构建成本高,但在完成7.5亿美元融资后,公司正在考虑与开源模型相关的工作,他认为开放权重模型的性能显著提升让这一切变得可行。

Harvey的联合创始人Gabe Pereyra表示,直到去年底,AI应用的性能主要取决于底层模型的质量,训练这些基础模型是一项高成本的工作。因此,公司必须支付高价购买最好的模型。然而,年内API调用费用的飙升迫使这些应用层企业面临巨大压力,Harvey平台的Token消耗量自年初以来暴涨20倍。公司高层深知,如果继续依赖OpenAI和Anthropic的高价模型,成本将会把公司拖垮。

尽管Anthropic和OpenAI今年推出了平价模型,但也增加了企业使用的额外费用,这让很多推行“Tokenmaxxing”策略的企业措手不及。例如,Uber大力鼓励使用Anthropic的Claude Code,结果到4月份,其全年的AI预算便被提前用完。旧金山早期风投机构Basis Set的创始人表示,企业需通过优化专属模型的建立来提升效率。否则,将很难获得融资。 球友会

目前,Anthropic和OpenAI正加强在初创企业的布局,两家公司积极招聘并推出新项目。在一次投资者论坛上,行业参与者讨论了自主构建模型的初创公司的兴起,Anthropic甚至提到了Rogo和医疗初创公司OpenEvidence。尽管如此,一些初创公司依然担忧,如果AI巨头切断访问权限,可能会面临重大挑战。

推荐产品