Moonshot 开放平台
Kimi 大模型官方 API 平台,256K 超长上下文,接口兼容 OpenAI
标签:大模型amp;APIAI开发平台 Kimi Kimi API Moonshot AI Moonshot 开放平台 大模型API 长上下文Chatgpt Plus|Pro代充值|正规充值有质保Moonshot 开放平台官网
Moonshot 开放平台是月之暗面(Moonshot AI)为开发者提供的 Kimi 大模型官方 API 服务平台,域名为 platform.moonshot.cn。平台以超长上下文与 OpenAI 兼容接口著称,当前主力模型为 Kimi K2 系列(K2.5 / K2.6 / K2.7 Code),原生支持 256K 上下文、视觉与文本混合输入、思考与非思考双模式,以及 Tool Calling 工具调用,适合构建长文档分析、智能体编程与深度研究类应用。
Moonshot 开放平台(Kimi 大模型 API)官网首页界面
Moonshot 开放平台的主要功能
- Kimi K2 系列模型 API:提供 kimi-k2.5、kimi-k2.6、kimi-k2.7-code 等多档模型,覆盖日常对话、长程代码编写与自主智能体执行等不同强度的任务需求,开发者可按成本与能力选型。
- 256K 超长上下文:K2 系列原生支持 262144 tokens 上下文窗口,单次请求即可容纳数百页 PDF、完整代码仓库或长篇会议纪要,无需自行做分块与拼接。
- OpenAI 兼容接口:Base URL 为 https://api.moonshot.cn/v1,请求与响应结构与 OpenAI Chat Completions 一致,使用官方 OpenAI SDK 只需替换 base_url 与 api_key 即可完成迁移。
- 自动上下文缓存:Moonshot 是最早落地上下文缓存的厂商之一,重复的请求前缀(如固定系统提示词与历史对话)会自动按缓存命中价计费,比缓存未命中低约 80%~90%。
- 思考模式与视觉理解:K2.5 起支持思考(Thinking)与非思考双模式切换,并可直接接收图片输入完成视觉推理,思考产生的推理 token 按普通输出 token 计费,无额外溢价。
- 官方工具集即插即用:平台内置联网搜索(Web Search)、Memory 记忆存储、Code-Runner 代码执行、Excel/CSV 分析、Fetch 网页提取、Base64 编解码、单位换算等官方工具,可直接在 Tool Calling 中调用。
- 分层速率限制:账号按累计充值划分 Tier0~Tier5 等级,等级越高并发数、RPM 与 token 吞吐上限越高;分层只影响速率限制,不改变单价。
如何使用Moonshot 开放平台
接入流程如下:
- 访问 Moonshot 开放平台官网 platform.moonshot.cn,使用手机号注册并完成实名验证,新账号通常可获得一定额度的体验代金券;
- 进入控制台的「API Key 管理」页面创建密钥,妥善保存后配置到本地环境变量中,避免硬编码进代码仓库;
- 在「用量与充值」中完成充值,充值金额同时决定所处 Tier 等级与对应的速率限制;
- 安装 OpenAI 官方 SDK,将 base_url 指向 https://api.moonshot.cn/v1,api_key 填入刚创建的密钥;
- 在请求中通过 model 参数指定模型名,如 kimi-k2.5、kimi-k2.6 或 kimi-k2.7-code,并按需开启思考模式;
- 需要工具能力时,在 tools 字段中声明官方工具或自定义函数,模型会自主决定何时发起 Tool Calling;
- 上线前在控制台的用量面板观察 token 消耗与缓存命中率,通过稳定系统提示词的方式提升缓存命中比例以降低成本。
Moonshot 开放平台的使用场景
- 长文档分析场景:法律合同审阅、财报解读、论文综述等需要一次性读入超长文本的任务,可直接利用 256K 上下文避免信息割裂;
- 智能体编程场景:借助 K2.7 Code 的长程代码编写与指令遵循能力,驱动自主编程智能体完成调试、重构与多步骤开发;
- 深度研究场景:结合思考模式与多轮工具调用,构建可做竞对分析、定价研究与科研辅助的专家型研究助理;
- 企业知识问答场景:将内部文档灌入长上下文或配合向量检索,搭建可引用原文出处的企业级 RAG 问答系统;
- 多模态理解场景:上传界面截图、图表或扫描件,让模型完成图文混合的理解、抽取与推理;
- 国内合规部署场景:数据不出境、无需即可低延迟调用,适合对数据驻留有要求的国内团队。
Moonshot 开放平台的价格与版本
国内站 platform.moonshot.cn 按 token 计费,以下为官网公示的主力模型价格(单位:元 / 百万 tokens):
- Kimi K2.7 Code:缓存命中 ¥1.30,输入 ¥6.50,输出 ¥27.00,当前最强 Coding 模型,另提供速率翻倍的高速版;
- Kimi K2.6:缓存命中 ¥1.10,输入 ¥6.50,输出 ¥27.00,长程代码与 Agent 自主执行能力更强;
- Kimi K2.5:缓存命中 ¥0.70,输入 ¥4.00,输出 ¥21.00,性价比档位,支持视觉与文本输入、思考与非思考模式;
- 旗舰 Kimi K3:面向前沿任务,支持 100 万 tokens 上下文,国际站按 3.00 / 15.00 美元每百万 tokens 计费;
- legacy moonshot-v1 系列:按上下文长度分档的老接口,官方已公告将于 2026 年 8 月 31 日全面下线,新项目建议直接使用 K2 系列。
注意:国内站以人民币计费,国际站 api.moonshot.ai 以美元计费,两套价格体系不同;思考模式产生的推理 token 按普通输出计价,内置联网搜索的每次调用会额外收取检索费用,返回结果还会计入下一轮输入 token。价格随官方调整而变化,请以控制台公示为准。
Moonshot 开放平台的常见问题解答
- Moonshot 开放平台的 API 能直接用 OpenAI SDK 调用吗?
- 可以。平台接口与 OpenAI Chat Completions 格式兼容,使用官方 OpenAI SDK 时只需将 base_url 改为 https://api.moonshot.cn/v1,api_key 换成平台密钥,其余请求参数与响应解析基本无需改动。
- 上下文缓存需要手动配置吗?会节省多少成本?
- 不需要。缓存对请求前缀自动生效,无额外参数也无需管理缓存对象。当系统提示词与历史对话保持稳定时,命中部分按缓存命中价计费,相比缓存未命中大约可省下八成以上的输入成本。
- K2.5、K2.6 和 K2.7 Code 应该怎么选?
- 日常对话、图文理解与预算敏感的场景选 K2.5;需要更强长程推理与 Agent 自主执行时选 K2.6;以代码调试、重构、多步骤开发为主的工程化场景选 K2.7 Code,对吞吐有硬要求可选其高速版。
Moonshot 开放平台官网网址
Moonshot 开放平台官网入口网址:https://platform.moonshot.cn/
相关资源:API 文档 https://platform.moonshot.cn/docs。
同类国产大模型 API 可参考站内 DeepSeek 开放平台;海外主流平台可参考 OpenAI Platform 与主打推理加速的 Fireworks AI;通用 AI 助手可参考 WorkBuddy。
OpenI AI时代点评
Moonshot 开放平台的差异化一直很清晰:不比谁的单价更低,而是把「超长上下文 + 稳定的缓存折扣 + OpenAI 兼容」这三件事做扎实。256K 原生窗口意味着长合同、长代码库可以整份丢进去,省掉了 RAG 分块与召回调优的大量工程量;而自动上下文缓存则把多轮对话与固定系统提示词的成本压到很低,实际账单往往比价目表看起来更友好。相较 DeepSeek 开放平台 的极致低价,Kimi 的定位更偏「长文本与 Agent 工程」,K2.7 Code 在多步骤开发上的表现尤其值得工程团队一试。需要提醒的是,legacy moonshot-v1 系列已公告 2026 年 8 月 31 日下线,仍在使用旧接口的项目应尽快迁移到 K2 系列;同时国内站与国际站计费币种与费率不同,跨境部署时务必确认调用的是哪一套端点。
数据评估
本站OpenI提供的Moonshot 开放平台都来源于网络,不保证外部链接的准确性和完整性,同时,对于该外部链接的指向,不由OpenI实际控制,在2026年 5月 30日 上午6:01收录时,该网页上的内容,都属于合规合法,后期网页的内容如出现违规,可以直接联系网站管理员进行删除,OpenI不承担任何责任。

