Kimi K2.5

在线体验
silvamux/kimi-k2.5

Kimi K2.5的主要优势是文本理解与信息检索/RAG,并支持图像、视频信息输入。在文档分析、信息抽取与复杂语义理解中,它能够承担信息理解、分析和结果生成等关键环节。

支持模态
text·image·video
输入价格¥4 / 1M tokensper 1M tokens
输出价格¥21 / 1M tokensper 1M tokens
上下文262K
最大输出66K

价格

Tune 与 Pro 采用相同的价格。

输入上下文输入输出缓存读取缓存写入
-¥4 / 1M tokens¥21 / 1M tokens¥0.7 / 1M tokens¥4 / 1M tokens

模型能力

Kimi K2.5在本轮能力评测中综合得分78,整体表现良好。其文本理解(96%)和信息检索 / RAG(94%)表现突出,能够分析文档语义、提取关键信息并处理复杂问答,并从知识库和多来源资料中定位信息、组织证据并生成有依据的回答。对企业知识库团队、AI 应用开发者和研究人员而言,它适合用于资料检索、文档问答、信息抽取和检索增强生成场景,解决从大量资料中找到相关信息,并形成可用于后续决策的回答;幻觉控制(89%)也为相关任务提供补充。在能力边界上,智能体协同(51%)相对较弱,在需要多步骤自主规划、连续工具调用或跨智能体协作的任务中,建议增加人工复核或专项验证。

综合能力
78/ 100良好
突出能力文本理解 96%信息检索 / RAG 94% · 幻觉控制 89%
最适合场景代码研发 / 内容创作场景适配度 78%
相对短板智能体协同51%

专项进阶能力

8 项
智能体协同51%

7 题 · 主/客观混合

代码生成80%

10 题 · 客观

代码理解与调试70%

12 题 · 主观

创意写作84%

17 题 · 主观

信息检索 / RAG94%

13 题 · 主/客观混合

长文本处理67%

3 题 · 主观

数学与科学推理71%

14 题 · 客观

多语言能力88%

10 题 · 主/客观混合

通用基础能力

3 项
通识知识73%

15 题 · 主/客观混合

文本理解96%

5 题 · 主观

逻辑推理74%

20 题 · 主/客观混合

安全与合规能力

2 项
幻觉控制89%

9 题 · 主观

指令遵循80%

14 题 · 主观

服务表现

Kimi K2.5 Tune

kimi-k2.5@tune
延迟
13.04s
吞吐量
22.84Ktokens/min
可用率
99.4%
可用率
99.4%
完成率
92%
缓存命中率
动态变化
累计评测耗时
8246.5s
Token 消耗
3,139,324tokens
平均请求次数
10.8
TPM
22,841tokens/min
QPM
1.9req/min

Kimi K2.5

kimi-k2.5
延迟
41.72s
吞吐量
1.39Ktokens/min
可用率
98.66%
可用率
98.66%
完成率
97%
缓存命中率
10.1%
累计评测耗时
16411.7s
Token 消耗
379,510tokens
平均请求次数
1.0
TPM
1,387tokens/min
QPM
0.5req/min

Kimi K2.5 的示例代码和 API

Tunekimi-k2.5@tune
/api/v0/chat/completions/api/v1/chat/completions/api/anthropic/v1/messages
统一入口OpenAIAnthropic
Prokimi-k2.5
/api/v0/chat/completions/api/v1/chat/completions/api/anthropic/v1/messages
统一入口OpenAIAnthropic
curl https://www.silvamux.com/api/v1/chat/completions \
  -H "Authorization: Bearer 你的API密钥" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "kimi-k2.5",
    "messages": [{"role": "user", "content": "你好,请介绍一下自己"}]
  }'