Kimi-K3 官方 API 上线阿里千问 AI 平台:月之暗面旗舰首次在阿里生态以官方身份开放
2026年8月19日1 次阅读
Kimi-K3 官方 API 上线阿里千问 AI 平台:月之暗面旗舰首次在阿里生态以官方身份开放
阿里千问 AI 平台今天上线了月之暗面 Kimi-K3 的官方 API。这是 Kimi 旗舰第一次以"官方身份"在非月之暗面账号体系下开放,国产大模型首次实现"旗舰级模型跨生态账号打通"。对开发者和企业接入方来说,过去要走月之暗面单独账号、独立计费的 Kimi 旗舰,现在可以直接挂在阿里生态下走同一套账号、同一份合同、同一份计费。
Kimi-K3 是怎样一个模型
Kimi-K3 是月之暗面迄今能力最强的旗舰模型,核心参数如下:
- 2.8 万亿参数,采用 KDA(Kimi Delta Attention)混合线性注意力 + Attention Residuals 技术栈;这是 K3 与上一代最大的架构差异。
- 1M token 上下文窗口:输入 1M、输出 1M、思维链 1M;RPM 500、TPM 3M。
- 原生视觉理解:文本、图像、视频都能作为输入,输出文本——多模态不是外挂,而是训练阶段就融进去。
- 工具链齐全:函数调用、前缀补全(Partial Mode)、Context Cache、结构化输出、联网搜索、微调,与阿里云生态已有的工具栈完全同构。
为什么这件事重要
过去几年里,国产 LLM 的旗舰模型基本都"绑定"在自家云上:Qwen 走阿里云、DeepSeek 走 DeepSeek 平台、Kimi 走月之暗面。要在同一份合同里同时拿到两个以上的旗舰,对企业 IT 来说很麻烦。
Kimi-K3 这一步相当于把这条边界往里推了一格:阿里生态用户首次可以不离开原账号、不换计费通道地用上 Kimi 旗舰。对以下场景最直接:
- 长程编程 / 代码 Agent:1M 输入 + 1M 输出 + 1M 思维链,是目前国产模型里把"上下文"和"思考空间"一起拉满的代表。
- 知识工作 / 复杂文档:1M 上下文 + 原生视觉,能一次性吃下一份带图带表的长报告。
- 混合生态的多模型路由:阿里云架构师可以把 Qwen3.8 与 Kimi-K3 并列放在同一个推理网关里,按子任务路由。
在阿里生态里的能力对照
Kimi-K3 在阿里千问 AI 平台上的可用能力,与同平台其它旗舰基本同构,企业接入不需要重新学一套接口:
- 函数调用 / 工具调用
- Partial Mode 前缀补全
- Context Cache 上下文缓存
- 结构化输出(强制 JSON)
- 联网搜索(基于实时检索回答)
- 微调(基于样本数据二次训练)
- 原生多模态输入(文本 + 图像 + 视频)
限制与注意
- 计费:按 Token 计费;Batch 调用输入输出均按实时推理价的 5 折;Context Cache 仅对输入 Token 享折扣,两者不能同时生效。
- 1M 是窗口不是上限:实际可用输入 ≈ 1M,但系统提示、工具描述、思考模板都会占用一部分,做超长文档场景时要留 buffer。
- 生态切换而非账号合并:月之暗面原有账号仍独立存在;这次只是 API 入口合流,企业鉴权与配额管理仍按各自规则跑。
- 首发时间口径:本文以"在阿里千问 AI 平台上线 Kimi-K3 官方 API"为窗口事件;模型原始发布日期与平台首发是两件事。
来源
- 阿里千问 AI 平台 Kimi-K3 模型页:https://www.qianwenai.com/models/kimi/kimi-k3