Kimi K3 是全球首个开放的 3T 级模型,这款 2.8T 参数的旗舰模型专为长程编程、知识工作和推理等前沿智能任务打造,具备原生视觉能力和 1M token 的上下文窗口。它已在 Kimi.com、Kimi Work、Kimi Code 及 Kimi API 上线。以下是 Kimi 会员套餐与 Kimi K3 API 价格的概览,帮助您选择合适的接入方式。
Kimi K3 会员套餐与用量层级使用 Kimi K3 最简单的方式是通过 Kimi 会员。Kimi 提供分层套餐,可满足从日常轻度使用到高强度智能体工作流的不同需求。更高层级的套餐可解锁更多智能体额度、更高并发,以及由 Kimi K3 驱动的最高 1M token 超长对话容量。
立即订阅ModeratoAllegrettoAllegroVivace按年付费(月均价)15 美元 / 月31 美元 / 月79 美元 / 月159 美元 / 月智能体并发任务数2 个任务2 个任务4 个任务4 个任务智能体优先队列4 倍速度4 倍速度4 倍速度4 倍速度K3 超长对话容量(最高 100 万 token)××✓✓可自定义仪表盘✓✓✓✓定时任务10 个任务15 个任务20 个任务25 个任务Widget 任务10 个任务15 个任务20 个任务25 个任务插件支持 15+ 种类型支持 15+ 种类型支持 15+ 种类型支持 15+ 种类型集群✓✓✓✓集群运行子任务2 个子智能体4 个子智能体8 个子智能体8 个子智能体梦境记忆✓✓✓✓自我进化技能✓✓✓✓目标×✓✓✓Kimi Claw(网页版、安卓端、电脑端)×✓✓✓与 Claw 群聊×10 个群聊10 个群聊10 个群聊部署带数据库的网站✓✓✓✓以上价格均为年付价格。也可选择月付,价格分别为每月 $19、$39、$99 和 $199。Allegro 和 Vivace 可解锁 K3 的超长对话容量,支持最多 1M tokens 的上下文,适用于超长对话、大型代码库和大量文档的研究场景。最新的套餐详情请参见官方会员页面。
立即订阅Kimi K3 API 价格Kimi K3 API 采用按 token 计费的模式,输入和输出均按每 1M tokens(100 万 tokens)计费,成本清晰、可预测。
模型单位输入价格(缓存命中)输入价格(缓存未命中)输出价格上下文窗口kimi-k31M token$0.30$3.00$15.001,048,576 tokenKimi K3 是 Kimi 面向长程编程和端到端知识工作的旗舰模型。它始终进行推理,推理强度可通过顶层的 reasoning_effort 字段设置。该模型支持自动上下文缓存、工具调用、JSON 模式、结构化输出,并可在单次请求中提供完整的 1M-token 上下文窗口。
获取 API 额度Kimi K3 API 计费方式Kimi K3 API 对每次请求采用按 token 计费的模式,与模型的每次交互都会消耗 token,并按 token 类型计费。在该模式下,token 一般分为三类:输入 token、缓存输入 token 和输出 token。
输入 token输入 token 代表发送给模型的所有内容,包括:
用户提示词
系统指令
对话历史或上下文
这些 token 决定了模型在生成回复前需要处理的上下文量。凭借 1M-token 的上下文窗口,Kimi K3 可以在一次请求中容纳完整的代码库、长文档以及扩展的多轮对话历史。
缓存输入 token当此前处理过的上下文被重复使用时,就会产生缓存输入 token。
如果重复使用相同或相似的上下文,将按每 1M tokens $0.30 计费,而非 $3.00,降幅达 90%
这大幅提升了重复性工作流的效率
这一机制在长上下文应用和多轮交互中尤为有用,此类场景通常会反复发送大量共享上下文
输出 token输出 token 是模型响应请求时生成的内容,代表 AI 实际生成的内容,例如:
文本回复
代码生成
结构化输出
由于输出生成需要额外的算力,其定价通常高于输入 token。
获取 API 额度结语Kimi K3 为普通用户和开发者都提供了灵活的定价方案:面向完整 Kimi 体验的会员套餐,以及支持自动上下文缓存、可将输入成本降低 90% 的按 token 计费 API。选择适合你工作方式的方案,即刻开始使用 Kimi K3。
