Kimi K3 登陆阿里云百炼:2.8万亿参数旗舰模型,输入仅20元/百万Token

简介: 全球首个开源3万亿级大模型Kimi K3(2.8万亿参数)正式上线阿里云百炼平台,支持100万Token超长上下文、原生视觉理解与深度推理。具备文本生成、多模态分析及复杂逻辑能力,输入20元/百万Token(缓存命中仅2元),定位高端AI开发场景。在阿里云百炼官网:https://t.aliyun.com/U/fPVHqY 免费领取千万Tokens

全球首个开源的3万亿级别大模型Kimi K3,近日正式上架阿里云百炼平台。这款由月之暗面推出的旗舰模型,拥有2.8万亿参数、100万Token上下文窗口,并原生支持视觉理解。本文基于阿里云百炼控制台公示信息,为你梳理Kimi K3的核心能力与收费标准。阿里云百炼AI模型平台:https://www.aliyun.com/product/bailian 如下图:

阿里云百炼kimi_kimi-k3.jpg


一、模型概览:2.8万亿参数,全球首个开源3万亿级模型

Kimi K3是月之暗面迄今能力最强的旗舰模型。它基于KDA混合线性注意力机制(Kimi Delta Attention)和注意力残差(Attention Residuals)技术构建,拥有2.8万亿参数,原生支持视觉理解,并具备100万Token上下文窗口


Kimi K3被定位为面向长程编程、知识工作和推理等前沿智能场景而设计,同时也是全球首个开源的3万亿级别模型

二、核心能力:文本生成+视觉理解+深度思考

根据百炼平台公示,Kimi K3的核心能力标签包括三项:

  • 文本生成:旗舰级文本生成能力,适用于长文写作、代码生成、报告撰写等场景
  • 视觉理解:原生支持多模态输入,可理解图像内容并进行推理
  • 深度思考:支持复杂逻辑推理与长程任务规划


在模型能力方面,Kimi K3还支持以下功能:

能力项 支持情况
输入模态 文本(T)
输出模态 文本(T)
模型体验
前馈缓存
Cache缓存
批量推理
模型调优
Function Calling
结构化输出
联网搜索

三、收费标准:输入20元/百万Token,缓存命中仅2元

Kimi K3在阿里云百炼的定价如下:

计费项 价格
输入 20元/百万Token
输出 100元/百万Token
输入(缓存命中) 2元/百万Token


这一价格定位处于国产大模型的中高端区间。作为对比,阿里云百炼平台上,千问Plus模型的输入价格约为0.8元/百万Token,输出约为4.8元/百万Token。Kimi K3的定价显著更高,与其2.8万亿参数的旗舰定位相匹配。


值得注意的是,缓存命中(Cache命中)场景下输入价格仅为2元/百万Token,仅为标准输入价格的十分之一。对于需要频繁重复调用相同上下文的应用场景(如长文档问答、代码库分析等),这一机制可以大幅降低使用成本。


四、限流与上下文参数

根据百炼平台公示的模型限流与上下文配置:

参数 数值
最大输入长度 1M Token
最大输出长度 1M Token
RPM(每分钟请求数) 500
TPM(每分钟Token数) 3,000,000
上下文长度 1M Token
最大思维链长度 1M Token


100万Token的上下文窗口意味着Kimi K3可以一次性处理相当于三体三部曲体量的长文本,在长文档分析、代码仓库理解、复杂推理等场景中具有明显优势。阿里云百炼AI模型平台:https://www.aliyun.com/product/bailian 调用Kimi K3快速体验。


五、总结

Kimi K3作为月之暗面旗下的旗舰模型,凭借2.8万亿参数、100万Token上下文窗口和原生视觉理解能力,在阿里云百炼平台为开发者提供了高端大模型选项。20元/百万Token的输入定价和100元/百万Token的输出定价,虽然高于主流国产模型,但其开源的3万亿参数规模和深度思考能力,对于追求极致性能的AI应用开发者而言,仍具吸引力。

相关文章
|
6天前
|
人工智能 JSON 安全
Fastjson远程代码执行漏洞,阿里云AI安全为您保驾护航
阿里云AI安全产品联动防御Fastjson攻击
2028 9
Fastjson远程代码执行漏洞,阿里云AI安全为您保驾护航
|
6天前
|
云安全 人工智能 安全
|
7天前
|
人工智能 自然语言处理 数据挖掘
Qwen3.8-Max-Preview深度全解析:2.4万亿参数旗舰MoE模型+Token Plan限时优惠完整落地指南
2026年7月,全新旗舰级混合专家大模型Qwen3.8-Max-Preview正式开放抢先体验,作为通义千问Qwen3系列规格最高、综合推理能力顶尖的新一代模型,该模型总参数量达到2.4万亿(2.4T),是当前线上可调用的原生多模态旗舰模型,综合推理水准对标海外顶级Fable 5模型,在复杂工程开发、长文档深度分析、多步骤智能体自治、跨境多语言创作、海量数据挖掘五大高难度业务场景实现跨越式性能提升。
879 1
|
7天前
|
人工智能 自然语言处理 数据挖掘
最新版通义千问(Qwen3.8-Max-Preview)功能介绍
2026年,通义千问正式推出全新旗舰级大模型 **Qwen3.8-Max-Preview 预览版**,作为首款突破万亿参数规格的新一代基座模型,该模型总参数量达到**2.4万亿**,采用全新迭代的MoE混合专家架构,综合推理性能、长文本处理、多模态理解、复杂任务规划能力全面超越前代Qwen3.7-Max版本,整体实力跻身全球第一梯队,可对标海外顶级旗舰模型,是当前面向复杂工程开发、多智能体协同、超长文档解析、专业办公自动化场景的最优国产基座模型。
884 0
|
8天前
|
人工智能
Qwen3.8抢先体验!正式版即将发布并开源!
千问Qwen3.8即将开源,参数达2.4T,进化速度以“天”计,实力媲美Fable 5。预览版Qwen3.8-Max已上线阿里Token Plan等平台,限时优惠:日间Credits低至1折,夜间更优,个人/团队版月付仅35元起!
882 37
|
5天前
|
自然语言处理 测试技术 API
通义千问Qwen3.8-Max-Preview全功能解析:2.4万亿参数旗舰模型深度使用指南
在大模型技术持续迭代的当下,通义千问推出的Qwen3.8-Max-Preview作为新一代旗舰预览版模型,凭借2.4万亿参数的超大规模、多模态融合能力与全场景适配特性,成为开发者与企业用户探索AI应用的核心工具。该模型采用稀疏混合专家(MoE)架构,是通义千问首个突破万亿参数的多模态模型,可同时处理文本、图像、视频与文档等多种数据形态,在全栈代码开发、复杂逻辑推理、长文档分析与多智能体协作等场景实现跨越式升级。本文将全面拆解Qwen3.8-Max-Preview的核心功能,详解API调用流程与配置方法,覆盖多场景实战技巧,帮助用户快速掌握这款旗舰模型的使用方法,充分释放其性能潜力。
427 1
|
8天前
|
人工智能 自然语言处理 数据挖掘
Qwen3.8-Max 预览版全解析:2.4 万亿参数旗舰模型,Token Plan 限时优惠指南
Qwen3.8-Max-Preview是通义千问Qwen3系列旗舰MoE大模型,参数达2.4万亿,综合推理能力居行业第一梯队。支持思考/快速双模式,擅长大模型五大高难场景。现于阿里云百炼Token Plan、Qoder及QoderWork上线体验,个人版低至39元/月。在阿里云百炼官网:https://t.aliyun.com/U/fPVHqY 免费领取千万Tokens
652 1
Qwen3.8-Max 预览版全解析:2.4 万亿参数旗舰模型,Token Plan 限时优惠指南