各厂语言模型

Kimi-K3 官方 API 上线阿里千问 AI 平台:月之暗面旗舰首次在阿里生态以官方身份开放

2026年8月19日1 次阅读
Kimi-K3 官方 API 上线阿里千问 AI 平台:月之暗面旗舰首次在阿里生态以官方身份开放

阿里千问 AI 平台今天上线了月之暗面 Kimi-K3 的官方 API。这是 Kimi 旗舰第一次以"官方身份"在非月之暗面账号体系下开放,国产大模型首次实现"旗舰级模型跨生态账号打通"。对开发者和企业接入方来说,过去要走月之暗面单独账号、独立计费的 Kimi 旗舰,现在可以直接挂在阿里生态下走同一套账号、同一份合同、同一份计费。

Kimi-K3 是怎样一个模型

Kimi-K3 是月之暗面迄今能力最强的旗舰模型,核心参数如下:

  • 2.8 万亿参数,采用 KDA(Kimi Delta Attention)混合线性注意力 + Attention Residuals 技术栈;这是 K3 与上一代最大的架构差异。
  • 1M token 上下文窗口:输入 1M、输出 1M、思维链 1M;RPM 500、TPM 3M。
  • 原生视觉理解:文本、图像、视频都能作为输入,输出文本——多模态不是外挂,而是训练阶段就融进去。
  • 工具链齐全:函数调用、前缀补全(Partial Mode)、Context Cache、结构化输出、联网搜索、微调,与阿里云生态已有的工具栈完全同构。

为什么这件事重要

过去几年里,国产 LLM 的旗舰模型基本都"绑定"在自家云上:Qwen 走阿里云、DeepSeek 走 DeepSeek 平台、Kimi 走月之暗面。要在同一份合同里同时拿到两个以上的旗舰,对企业 IT 来说很麻烦。

Kimi-K3 这一步相当于把这条边界往里推了一格:阿里生态用户首次可以不离开原账号、不换计费通道地用上 Kimi 旗舰。对以下场景最直接:

  • 长程编程 / 代码 Agent:1M 输入 + 1M 输出 + 1M 思维链,是目前国产模型里把"上下文"和"思考空间"一起拉满的代表。
  • 知识工作 / 复杂文档:1M 上下文 + 原生视觉,能一次性吃下一份带图带表的长报告。
  • 混合生态的多模型路由:阿里云架构师可以把 Qwen3.8 与 Kimi-K3 并列放在同一个推理网关里,按子任务路由。

在阿里生态里的能力对照

Kimi-K3 在阿里千问 AI 平台上的可用能力,与同平台其它旗舰基本同构,企业接入不需要重新学一套接口:

  • 函数调用 / 工具调用
  • Partial Mode 前缀补全
  • Context Cache 上下文缓存
  • 结构化输出(强制 JSON)
  • 联网搜索(基于实时检索回答)
  • 微调(基于样本数据二次训练)
  • 原生多模态输入(文本 + 图像 + 视频)

限制与注意

  • 计费:按 Token 计费;Batch 调用输入输出均按实时推理价的 5 折;Context Cache 仅对输入 Token 享折扣,两者不能同时生效。
  • 1M 是窗口不是上限:实际可用输入 ≈ 1M,但系统提示、工具描述、思考模板都会占用一部分,做超长文档场景时要留 buffer。
  • 生态切换而非账号合并:月之暗面原有账号仍独立存在;这次只是 API 入口合流,企业鉴权与配额管理仍按各自规则跑。
  • 首发时间口径:本文以"在阿里千问 AI 平台上线 Kimi-K3 官方 API"为窗口事件;模型原始发布日期与平台首发是两件事。

来源

  • 阿里千问 AI 平台 Kimi-K3 模型页:https://www.qianwenai.com/models/kimi/kimi-k3

参考来源

评论

0 条已公开
登录注册后可以参与评论。

正在加载评论...