Kimi K3 登陆阿里云百炼:2.8万亿参数旗舰模型,输入仅20元/百万Token

简介: 全球首个开源3万亿级大模型Kimi K3(2.8万亿参数)正式上线阿里云百炼平台,支持100万Token超长上下文、原生视觉理解与深度推理。具备文本生成、多模态分析及复杂逻辑能力,输入20元/百万Token(缓存命中仅2元),定位高端AI开发场景。在阿里云百炼官网:https://t.aliyun.com/U/fPVHqY 免费领取千万Tokens

全球首个开源的3万亿级别大模型Kimi K3,近日正式上架阿里云百炼平台。这款由月之暗面推出的旗舰模型,拥有2.8万亿参数、100万Token上下文窗口,并原生支持视觉理解。本文基于阿里云百炼控制台公示信息,为你梳理Kimi K3的核心能力与收费标准。阿里云百炼AI模型平台:https://www.aliyun.com/product/bailian 如下图:

阿里云百炼kimi_kimi-k3.jpg


一、模型概览:2.8万亿参数,全球首个开源3万亿级模型

Kimi K3是月之暗面迄今能力最强的旗舰模型。它基于KDA混合线性注意力机制(Kimi Delta Attention)和注意力残差(Attention Residuals)技术构建,拥有2.8万亿参数,原生支持视觉理解,并具备100万Token上下文窗口


Kimi K3被定位为面向长程编程、知识工作和推理等前沿智能场景而设计,同时也是全球首个开源的3万亿级别模型

二、核心能力:文本生成+视觉理解+深度思考

根据百炼平台公示,Kimi K3的核心能力标签包括三项:

  • 文本生成:旗舰级文本生成能力,适用于长文写作、代码生成、报告撰写等场景
  • 视觉理解:原生支持多模态输入,可理解图像内容并进行推理
  • 深度思考:支持复杂逻辑推理与长程任务规划


在模型能力方面,Kimi K3还支持以下功能:

能力项 支持情况
输入模态 文本(T)
输出模态 文本(T)
模型体验
前馈缓存
Cache缓存
批量推理
模型调优
Function Calling
结构化输出
联网搜索

三、收费标准:输入20元/百万Token,缓存命中仅2元

Kimi K3在阿里云百炼的定价如下:

计费项 价格
输入 20元/百万Token
输出 100元/百万Token
输入(缓存命中) 2元/百万Token


这一价格定位处于国产大模型的中高端区间。作为对比,阿里云百炼平台上,千问Plus模型的输入价格约为0.8元/百万Token,输出约为4.8元/百万Token。Kimi K3的定价显著更高,与其2.8万亿参数的旗舰定位相匹配。


值得注意的是,缓存命中(Cache命中)场景下输入价格仅为2元/百万Token,仅为标准输入价格的十分之一。对于需要频繁重复调用相同上下文的应用场景(如长文档问答、代码库分析等),这一机制可以大幅降低使用成本。


四、限流与上下文参数

根据百炼平台公示的模型限流与上下文配置:

参数 数值
最大输入长度 1M Token
最大输出长度 1M Token
RPM(每分钟请求数) 500
TPM(每分钟Token数) 3,000,000
上下文长度 1M Token
最大思维链长度 1M Token


100万Token的上下文窗口意味着Kimi K3可以一次性处理相当于三体三部曲体量的长文本,在长文档分析、代码仓库理解、复杂推理等场景中具有明显优势。阿里云百炼AI模型平台:https://www.aliyun.com/product/bailian 调用Kimi K3快速体验。


五、总结

Kimi K3作为月之暗面旗下的旗舰模型,凭借2.8万亿参数、100万Token上下文窗口和原生视觉理解能力,在阿里云百炼平台为开发者提供了高端大模型选项。20元/百万Token的输入定价和100元/百万Token的输出定价,虽然高于主流国产模型,但其开源的3万亿参数规模和深度思考能力,对于追求极致性能的AI应用开发者而言,仍具吸引力。

相关文章
Kimi K3 正式发布
Kimi K3正式发布:2.8T参数、1M超长上下文、原生多模态与长程Agent编程能力。不止写代码,更能持续读项目、改文件、跑测试、修报错,实现全栈开发、旧项目改造与交互式Demo——真正从“帮你写代码”迈向“帮你完成项目”。
|
2月前
|
人工智能 API 数据库
Kimi深夜突袭K3,2.8万亿参数超大水桶!直接跨入世界第一梯队!
老金我昨儿在网上瞎逛的时候,突然看到了Kimi K3的消息。 合计先打开官网看看开发者文档有没有啥信儿,结果刚打开官网,好家伙。。就看到已经上线了! ![Image](https://ucc.alicdn.com/pic/developer-ecology/p3shvhj26rigq_0488c34b2827443e9b77df8ee1e3a066.png) Kimi官网Chat窗口里已
|
人工智能 安全 Apache
QwenPaw:你的私人 AI 助理 —— 数据归你、记忆进化、多端触达的开源个人智能体
QwenPaw 是一款开源、本地优先的AI个人智能体(Apache 2.0),数据归属用户、记忆自主进化、支持钉钉/飞书/微信等多端触达。3行命令即可部署,内置Coding IDE、Persona人格、定时任务、MCP工具生态与多Agent协作,真正属于你的私有AI助理。
QwenPaw:你的私人 AI 助理 —— 数据归你、记忆进化、多端触达的开源个人智能体
|
2月前
|
机器学习/深度学习 缓存 人工智能
阿里云百炼 Kimi K3 模型详解:多模态能力、限流参数、调用价格一览
全球首个开源3万亿级大模型Kimi K3正式上线阿里云百炼平台。该模型由月之暗面研发,参数达2.8万亿,支持100万Token超长上下文与原生视觉理解,具备文本生成、多模态推理和深度思考能力,输入定价20元/百万Token(缓存命中仅2元)。在阿里云百炼官网:https://t.aliyun.com/U/fPVHqY 免费领取千万Tokens
|
2月前
|
人工智能 API 芯片
重磅!阿里云真武 M890 超节点 Day0 适配 Kimi K3,国产算力支撑近 3 万亿参数大模型
阿里云真武M890超节点实例Day0适配Kimi K3(近3万亿参数),国内首个跑通该规模模型的超节点。依托64卡全互联、9TB显存与ICN Switch高速网络,突破算力瓶颈;软硬协同优化后,首Token时延降35%,单卡吞吐提升1.8倍。在阿里云百炼官网:https://t.aliyun.com/U/fPVHqY 免费领取千万Tokens
326 1
|
30天前
|
缓存 运维 资源调度
Kimi K3 官方价都是 2/20/100 元,为什么有的平台更低?真的是同一个模型吗
Kimi K3官方按量价为:缓存输入2元、非缓存输入20元、输出100元/百万Token。低价平台可能源于补贴、批量折扣、套餐预付或计费口径差异,而非模型不同。比价需严格对齐模型ID、缓存逻辑、输出计费、SLA及账单单位,单看单价易误判。
438 0
|
2月前
|
机器学习/深度学习 缓存 人工智能
一文读懂百炼 Kimi K3:2.8 万亿 MoE 模型、百万上下文、分层计费方案
全球首个开源3万亿级大模型Kimi K3正式上线阿里云百炼平台。该模型由月之暗面研发,参数达2.8万亿,支持100万Token超长上下文与原生视觉理解,具备文本生成、多模态推理及复杂逻辑深度思考能力,输入定价20元/百万Token(缓存命中仅2元)。在阿里云百炼官网:https://t.aliyun.com/U/fPVHqY 免费领取千万Tokens
|
11天前
|
机器学习/深度学习 缓存 人工智能
阿里云kimi-k3模型详解:模型能力、价格、上下文限制及使用注意事项参考
本文介绍了阿里云百炼平台提供的旗舰级大模型Kimi-K3。该模型由月之暗面研发,拥有2.8万亿参数,是全球首个开源的三万亿级模型,并创新性地采用了KDA混合线性注意力与注意力残差技术。它原生支持文本与图像输入,具备强制开启的深度思考模式,并提供高达100万tokens的上下文窗口。文章详细梳理了其五大区域(北京、新加坡、日本、德国、美国)的部署与功能矩阵,重点解读了其独有的动态加载工具DLT机制在优化智能体开发流程上的价值,以及适用于长程编程、超长文档分析、复杂推理等高阶场景的定位。同时,也明确了其定价策略与通过百炼平台进行OpenAI/DashScope协议兼容调用的方式。
|
2月前
|
人工智能 数据挖掘 API
Qwen3.8千问新一代旗舰模型上线:在阿里云百炼TokenPlan调用Qwen3.8-Max-Preview体验版
阿里云Qwen3.8-Max-Preview是2.4T参数旗舰预览模型,聚焦Coding与Cowork,支持多模态、长任务与智能体协作,在Token Plan享白天1折、夜间0.2折优惠,个人版39元起/月。在阿里云百炼官网:https://t.aliyun.com/U/fPVHqY 免费领取千万Tokens
|
8月前
|
存储 人工智能 安全
一文详解Kimi的AI Agent如何跑在阿里云上
Kimi携手阿里云,基于ACK与ACS Agent Sandbox构建端到端Agent基础设施:实现秒级沙箱启动、万级并发弹性调度、会话级状态保持及强安全隔离,支撑“深度研究”“OK Computer”等智能体产品稳定高效运行。(239字)
1500 1
一文详解Kimi的AI Agent如何跑在阿里云上