一个模型能不能被企业用起来,很多时候不取决于它跑分多少,而取决于它能挂在谁家的账单上。
9 月 30 日,美国 AI 推理服务商 Baseten 宣布与 OpenAI 达成合作,成为 OpenAI B2B 市场首批开源模型推理服务提供商之一。企业用户可以在 Codex 或 Responses API 里直接调用月之暗面的 Kimi K3 和智谱的 GLM-5.3-Flash 等开放权重模型,费用直接计入企业已有的 OpenAI 采购承诺额度,不需要新增供应商,也不用单独走一套采购流程。
按国内媒体的概括,这是中国开源模型第一次进入 OpenAI 的企业采购体系。
概括得没错,但”第一次”只是个时间戳。真正值得琢磨的是它出现的位置——模型是在谁家的账单里被消费的。
先把事实捋清楚
链条其实有三段:
入口在 OpenAI。Codex 和 Responses API 提供调用界面,企业不用换开发工具——这也是 OpenAI 专题 里最能说明它转向的一步:从只卖自家的货,变成给别人的模型当货架。
推理在 Baseten。这家公司原本的业务就是帮企业部署开源模型,这次的角色变成了 OpenAI 企业生态里的”开源模型货架”。它还给了两条合规承诺:所有模型运行在美国境内的服务器上,所有提示词实行零数据保留(ZDR),不留存客户请求内容。
账单在采购额度里。企业调用的钱从原来跟 OpenAI 签的采购承诺里扣,不用新建付款主体、签新合同。
发布方式也很有意思。Baseten 的工程专家 Philip Kiely 在社交平台上宣布了这件事,OpenAI 核心产品与平台负责人、Codex 核心开发者 Tibo Sottiaux 转发时只写了一句——大意是”为此感到自豪,开放才是出路”。
为什么”进账单”比”上架”值钱
要看懂这件事,得先看企业换模型的真实成本结构。
大家直觉上以为贵的是 token 钱。其实对大型企业来说,钱往往是最小的那一项开销。真正卡人的是采购流程:新供应商要过安全评审,法务要审合同,财务要建付款主体,一轮走下来三个月起步。很多模型不是输在能力上,是输在”还没通过审批”上。
所以对一个有竞争力的开源模型来说,两道关很难过:一是技术信任,二是合规流程。Baseten 这次做的,是把第二道关整个拆掉——模型不需要单独被采购,因为它花的钱是企业已经在用的预算。
对企业客户来说,这也不亏。用同样的预算,能多拿到一类不同取向的模型:通用任务继续给 GPT 系列,长上下文、长时间编程这类活,可以按需切到 Kimi K3。首批名单里的另一家 GLM-5.3 也不是无名之辈——它前不久被 Anthropic 的红队专门拿去测过攻击能力,结论是能力底子不弱,争议也不小。
顺带说一句 Kimi K3 的规格:月之暗面官方称它是首个参数规模达 2.8 万亿的开源模型,原生支持视觉,100 万 token 上下文,定位就是长时间编程和多文档分析。这家公司上个月刚上线 Kimi Code 桌面版,把权限拆成三档交给用户决定,路子一直是往开发者工具里扎。
按 OpenAI 在 DevDay 上给出的方向,Codex 正在从”编程工具”变成”企业开发入口”。把开源模型放进这个入口,本质上是让它变成一个货架,而不是只卖自家的货。
不是模型突然变强了,是物流修好了
这条线索不是从 9 月 30 日才开始的。
- 9 月 18 日,亚马逊云科技宣布 Kimi K3 登陆 Amazon Bedrock
- 此前有报道称,月之暗面正与包括 AWS、微软、谷歌在内的海外云厂商探索模型服务收入分成模式
- 9 月 30 日,从云平台再往前走一步,进了开发工具和企业采购体系
这三步的逻辑是一致的:不自建海外基础设施和销售渠道,借别人已经铺好的算力和客户网络。差别在合作深度——最早的形态是提供 API 接口,后来是进入云厂商的模型生态按收入分成,现在是把结算挂到企业原有预算上。
而 Baseten 那两条承诺,恰恰是这套打法能不能跑通的关键。企业敢不敢把内部代码和文档喂给一个中国团队训练的开源模型,卡点从来不在权重公不公开,而在数据落在哪、留不留底。美国境内服务器加零数据保留,等于把”数据主权”这一栏预先填好了。这也和选开源模型时”先读许可再读跑分” 是同一类问题——企业看的从来不是模型多强,是边界清不清楚。
同一周还有一个变量
这里必须提一件同期发生、方向相反的事,因为它会影响上面这条路的顺不顺。
9 月 30 日,OpenAI 在官网发文称自己遭遇了一场有组织的蒸馏活动。 按其描述,活动从 7 月第一周开始,7 月 24 日和 25 日流量突然放大,当时有超过 4000 名用户发起了 1.6 万次请求;继续排查后,发现有超过 1.5 万名用户存在类似提示词活动;到 7 月 28 日,相关活动已被完全阻断。
OpenAI 同时说明:这次活动没有攻破公司的加密系统,没有入侵数据库,也没有直接访问用户对话,公司认为这些行为违反了服务条款,并已通过行业论坛与合作伙伴共享信息。它也表示目前尚不清楚攻击实体是谁,但认为核心活动群体与开发 Kimi 模型的月之暗面有关。
需要说清的是,这是单方指控,OpenAI 没有公开可供第三方复核的证据;截至相关报道发出时,Baseten 与月之暗面都没有就此表态,OpenAI 也没有说明这件事会不会影响 Codex 里 Kimi K3 的供应。
两边放在一起看,画面才完整:开源权重让模型能绕开出口和采购障碍,由海外公司托管后卖给海外企业;同一家公司又被指控是另一场争议的关联方。 海外客户采购时会不会因此多加一道合规审查,现在没人能给定论。
三条还没落地的变量
第一,计费细节没公开。官方说了”计入采购承诺额度”,但额度怎么折算、可用模型清单会不会扩容、超出部分怎么算,都没有明确口径。企业真要算账,还得等自己的客户经理给数。
第二,这类分销模式的收入分成没有公开数字。云厂商和推理服务商能从模型服务上分走多少,目前只有”正在探索”的说法,没有落地案例可参照。
第三,合规审查这一关可能变得更有弹性。技术层面这次合作没问题,但企业采购是多因素决策,同类争议如果继续出现,审查清单就会变长——这不是模型能力能解决的问题。
老达点评
第一,这件事真正变的不是模型能力,是结算入口。过去两年国产模型出海的主线是”把分刷上去”,但企业市场的经验反复证明:产品能不能被用,取决于它是不是在客户已有的预算科目里。谁掌握账单,谁就掌握默认选项。Baseten 这次没做模型,做的是把一条难走的路修成了高速。
第二,对国产模型公司来说,这把”借货架”的打法值得学,但天花板也在那里。好处是省下自建海外基础设施和渠道的钱,能快速触达客户;代价是定价权、客户关系和数据都留在别人手里,自己更像一个供应商而不是品牌。这条路能走多远,取决于它们能不能借着这个入口把自有的开发者生态养起来。
第三,“零数据保留 + 本地服务器”这两句话,比任何跑分都更能打动企业。做 to B 的人应该记住:企业不是不想用新模型,是在等一个能写进合规文档的理由。技术团队如果把这件事当成法务的事,就会永远卡在 POC 阶段。
第四,同一周的指控提醒我们,能力可以开源,信任不行。模型可以挂在别人的货架上卖,但采购桌上最后被问到的问题从来不是跑分,是”这东西出了事谁负责、数据在哪”。对国内团队来说,这条线的启示比任何性能指标都实用:出海的第一道产品需求,是让别人睡得着觉。
参考来源:IT之家 9 月 30 日报道及新浪财经、腾讯新闻转载稿,Baseten 方面 Philip Kiely 的公开表述与 Philip Kiely 所述合作细节,Kimi K3 官方规格说明,亚马逊云科技 9 月 18 日 Bedrock 上线公告,以及 OpenAI 官网 9 月 30 日关于蒸馏活动的说明。文中涉及指控部分为单方说法,未获独立复核,请自行判断。