Kimi K3 正式接入 OpenAI 企业服务通道
2026 年 9 月 30 日,美国 AI 基础设施公司 Baseten 宣布与 OpenAI 达成合作,Kimi K3 正式成为 OpenAI B2B 市场首批开源模型推理服务提供商之一。企业用户现已可通过 Codex 或 Responses API 调用该模型。
关键事实清单:
- 发布时间:2026 年 9 月 30 日正式上线 OpenAI 企业生态
- 接入方式:通过 Codex 和 Responses API 调用
- 模型类型:开源大语言模型(LLM)
- 参数规模:2.8 万亿
- 上下文窗口:100 万 Token
- 视觉支持:原生支持多模态能力
中国大模型突破 OpenAI 体系壁垒
本次合作标志着中国研发的开源模型首次进入 OpenAI 企业采购体系。此前,OpenAI 企业生态主要由其自有 GPT 系列模型主导,第三方模型接入门槛较高。此次通过 Codex 平台开放分销渠道,为开源模型提供了标准化的企业级服务能力。
Kimi K3 由月之暗面(Moonshot AI)研发,官方宣称其为全球首个参数规模达到 2.8 万亿的开源模型。该模型具备 100 万 Token 的长上下文处理能力,可一次性处理约 75 万字的文本,适合执行长时间编程任务或多文档交叉分析。其原生视觉能力支持图像理解任务,扩展了传统文本模型的使用边界。
技术参数对比
下表仅依据公开信息整理,反映当前阶段模型能力差异(数据来源:model 官方宣称参数):
| 模型 | 参数规模 | 上下文窗口 | 视觉能力 | 开源状态 | 企业通道支持 |
|---|---|---|---|---|---|
| Kimi K3 | 2.8 万亿 | 100 万 Token | 原生支持 | 是 | Codex/API |
| GPT-4 Turbo | 未公开 | 128 万 Token | 支持 | 否 | OpenAI 原生 |
| GLM 5.3 | 未公开 | 未公开 | 支持 | 是 | Codex/API |
值得注意的是,Kimi K3 的参数规模 2.8 万亿显著超出当前主流开源模型(如 Llama 3.1 405B、Qwen 2.5 70B),但其具体推理性能、能耗比等工业级指标尚未由 OpenAI 公布验证。
企业应用落地建议
适合立即尝试的场景:
- 需要处理超长文档分析的法律、金融、科研机构
- 对模型成本敏感且希望维持多模型冗余的企业
- 有视觉理解需求但数据合规性要求严格的企业(Baseten 声称模型运行于美国服务器,实行零数据保留政策)
建议暂缓评估的场景:
- 依赖实时推理或毫秒级响应的高频交互应用(超大规模模型可能面临延迟问题)
- 对中国数据出境合规性有特殊要求的跨国企业(当前模型部署于海外服务器)
写在最后
此前中国大模型主要依靠自建生态或国际第三方平台验证,本次借力 OpenAI 成熟的企业服务体系实现"曲线出海",体现了开源模式下技术标准化的突破可能。但需注意到,模型接入不等于能力对等——另一个维度的竞争焦点,正从研发参数规模转向企业服务可靠性体系的构建。
