在线体验 Kimi K3核验于 2026 年 8 月 1 日

与 Kimi K3 对话或创建 Agent

直接使用 Kimi K3 处理长上下文编程、深度研究和视觉分析,或使用同一固定模型创建私有 Agent。

100 万 Token 上下文原生视觉始终开启推理

与 Kimi K3 对话或基于它创建

进入共用的 Kimi K3 Chatbot 直接对话,或使用固定 Kimi K3 运行配置新建私有 Agent。

固定模型:Kimi K3

立即对话或创建 Agent

直接与固定模型对话,或使用自己的 Skill 和指令创建私有 Agent。

Kimi K3 模型规格与可用状态

实施前确认当前 API 状态、官方模型 ID、信息核验时间和开放权重可用性。

API 现已可用
官方 OpenAI 兼容 API 已通过 Moonshot 平台提供 kimi-k3 模型 ID。
开放权重已发布
Moonshot 已将 Kimi K3 作为开放模型发布。自托管或再分发前,请查看官方仓库和许可证。
信息具有时效性
价格、支持参数和发布状态均可能变化。生产上线前请重新核对下方官方文档。

Kimi K3 上下文窗口与核心规格

查看最可能影响架构、成本和部署的关键事实。

参数量
2.8 万亿

厂商公布的总参数量。

上下文窗口
1,048,576 Token

适合长代码仓库、大型文档和长期交互历史。

API 模型 ID
kimi-k3

用于 Moonshot 的 OpenAI 兼容端点。

输入模态
文本 + 图片

API 模型文档明确支持原生视觉。

推理模式
始终开启

reasoning_effort 当前仅接受 max。

最大输出
最高 1,048,576 Token

文档中的默认输出上限为 131,072 Token。

Kimi K3 编程、研究与视觉工作流

优先用于真正需要长上下文、原生视觉和工具推理的 Agent 工作流。

仓库级编程
分析大范围代码上下文,在长会话中保持计划,并通过编程工具执行任务。
长文档研究
在同一上下文中整合大型文档集合,并保留引用和约束。
多模态操作
在 Agent 工作流中结合截图、文档和文本指令。

Kimi K3 基准与评估证据

将 Moonshot 公布的证据作为起点,选型前再用自己的 Agent 任务验证 Kimi K3。

维度现有证据需要验证什么
长任务编程Moonshot 技术报告和发布资料运行你的代码仓库、工具循环和完成标准
长上下文文档标注的 1,048,576 Token 窗口测量检索质量、延迟和总 Token 成本
视觉Moonshot 文档说明支持原生图片输入测试你的图片格式、细节和失败场景

厂商公布的证据不等于独立的生产基准。

Kimi K3 API 价格

查看截至核验日期 Moonshot 公布的 Kimi K3 每百万 Token 价格。

Token 类型每 100 万 Token 价格使用说明
输入 — 缓存命中$0.30需要满足自动上下文缓存条件
输入 — 缓存未命中$3.00保守估算输入成本时使用此价格
输出$15.00推理和长回答会增加支出

制定预算前,请在 Moonshot 价格页确认实时价格。

Kimi K3 当前限制与部署约束

在生产环境采用 Kimi K3 前,先确认这些 API 和基础设施约束。

自托管资源要求很高
开放权重已经可用,但 2.8 万亿参数架构需要大量算力、存储和推理服务基础设施。
采样控制受限
API 指南规定了固定采样值,且当前仅支持 max 推理强度。
工具循环需要完整消息
Moonshot 要求在多轮和工具调用请求中携带完整的 assistant 消息。
不支持公开图片 URL
当前指南要求以受支持的编码形式提供图片内容,不能直接传公开 URL。

如何使用 Kimi K3:常见问题

回答在线体验、价格、上下文、图片、开放权重、本地部署和私有 Agent 创建相关问题。

用 Kimi K3 开始下一个任务

立即开始对话,或创建用于长上下文编程、研究和视觉工作的私有 Kimi K3 Agent。