silvamux/kimi-k3
支持模态
text·image·video
输入价格¥20 / 1M tokensper 1M tokens
输出价格¥100 / 1M tokensper 1M tokens
上下文1M
最大输出131K

价格

Tune 与 Pro 采用相同的价格。

输入上下文输入输出缓存读取缓存写入
-¥20 / 1M tokens¥100 / 1M tokens¥2 / 1M tokens¥20 / 1M tokens

模型能力

Kimi K3在本轮能力评测中综合得分75,整体表现良好。其文本理解(96%)和信息检索/RAG(88%)表现突出,能够分析文档语义、提取关键信息并处理复杂问答,并从知识库和多来源资料中定位信息、组织证据并生成有依据的回答。对企业知识库团队、AI 应用开发者和研究人员而言,它适合用于资料检索、文档问答、信息抽取和检索增强生成场景,解决从大量资料中找到相关信息,并形成可用于后续决策的回答;数学与科学推理(86%)也为相关任务提供补充。在能力边界上,长文本处理(32%)相对较弱,在超长材料、跨章节引用和持续上下文任务中,建议拆分输入并核对关键信息是否遗漏。

综合能力
75/ 100良好
突出能力文本理解 96%信息检索 / RAG 88% · 数学与科学推理 86%
最适合场景智能客服 / 内容审核与风控 / 代码研发辅助场景适配度 75%
相对短板长文本处理32%

专项进阶能力

8 项
智能体协同75%

7 题 · 主/客观混合

代码生成80%

10 题 · 客观

代码理解与调试62%

12 题 · 主/客观混合

创意写作60%

17 题 · 主/客观混合

信息检索 / RAG88%

13 题 · 主/客观混合

长文本处理32%

3 题 · 主/客观混合

数学与科学推理86%

14 题 · 客观

多语言能力80%

10 题 · 主/客观混合

通用基础能力

3 项
通识知识75%

15 题 · 主/客观混合

文本理解96%

5 题 · 主观

逻辑推理70%

20 题 · 主/客观混合

安全与合规能力

2 项
幻觉控制81%

9 题 · 主/客观混合

指令遵循85%

14 题 · 主观

服务表现

Kimi K3 Tune

kimi-k3@tune
延迟
22.08s
吞吐量
7.53Ktokens/min
可用率
99.6%
可用率
99.6%
完成率
100%
缓存命中率
动态变化
累计评测耗时
8121.2s
Token 消耗
1,019,814tokens
平均请求次数
7.0
TPM
7,534tokens/min
QPM
1.2req/min

Kimi K3 的示例代码和 API

Tunekimi-k3@tune
/api/v0/chat/completions/api/v1/chat/completions
统一入口OpenAI
Prokimi-k3
/api/v0/chat/completions/api/v1/chat/completions/api/anthropic/v1/messages
统一入口OpenAIAnthropic
curl https://www.silvamux.com/api/v1/chat/completions \
  -H "Authorization: Bearer 你的API密钥" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "kimi-k3",
    "messages": [{"role": "user", "content": "你好,请介绍一下自己"}]
  }'