模型API
一个 API Key,调用主流大模型
搜索
全部
kimi-k3
Kimi K3 是 Kimi 迄今能力最强的旗舰模型,拥有 2.8 万亿参数,基于 KDA 混合线性注意力机制(Kimi Delta Attention)和注意力残差(Attention Residuals)技术构建,原生支持视觉理解,并拥有 100 万 token 上下文窗口。它是全球首个开源的 3 万亿级别模型,面向长程编程、知识工作和推理等前沿智能场景而设计。
输入:
20.0015.00 积分/M tokens
输出:
100.0075.00 积分/M tokens
glm-5.2
GLM-5.2是智谱AI推出的面向长程任务(Long Horizon Task)设计的最新旗舰模型,支持1M超长上下文。拥有强大逻辑推理、长文本理解与代码生成能力、兼顾性能与推理效率;在多任务基准中表现优异,适用于智能交互、企业应用、开发辅助等场景。
输入:
8.004.00 积分/M tokens
输出:
28.0014.00 积分/M tokens
qwen3.6-flash
Qwen3.6原生视觉语言系列Flash模型,模型效果相较3.5-Flash显著提升。本模型重点提升agentic coding能力(在多项代码智能体基准上大幅超越前代)、数学推理和代码推理能力;视觉方面在空间智能能力上显著增强,物体定位与目标检测提升尤为突出。

2档阶梯计费

≤256K:

输入

输出

1.200.66 积分/M tokens

7.203.96 积分/M tokens

qwen3.6-max-preview
Qwen3.6系列中规模最大、综合能力最强的Max模型Preview版本,当前开放纯文本模型能力供体验。相较于此前发布的Qwen3-Max和Qwen3.6-Plus,本模型在vibe coding能力上进一步提升、coding agent执行更加高效、前端编程开发能力显著提升;长尾知识能力进一步升级。

2档阶梯计费

≤128K:

输入

输出

9.004.95 积分/M tokens

54.0029.70 积分/M tokens

qwen3.5-27b
Qwen3.5系列27B原生视觉语言Dense模型,融合了线性注意力机制;响应速度快,兼具推理速度和性能。该模型的综合能力接近于Qwen3.5-122B-A10B。

2档阶梯计费

<128K:

输入

输出

0.600.26 积分/M tokens

4.802.06 积分/M tokens

qwen3-coder-next
Qwen3系列新一代代码生成模型,效果接近Qwen3-Coder-Plus兼具更优性能。模型重点优化仓库级别理解、支持多轮工具交互、提升对于agentic coding类工具的适配能力。

3档阶梯计费

<32K:

输入

输出

1.000.86 积分/M tokens

4.001.72 积分/M tokens

qwen3.5-flash
Qwen3.5原生视觉语言系列Flash模型,基于混合架构设计,融合了线性注意力机制与稀疏混合专家模型,实现了更高的推理效率。模型效果在纯文本与多模态方面相较3系列均实现飞跃式进步;响应速度快,兼具推理速度和性能。

3档阶梯计费

<128K:

输入

输出

0.200.09 积分/M tokens

2.000.86 积分/M tokens

kimi-k2.6
Kimi K2.6 是 Kimi 最新最智能的模型,具备更强更稳的长程代码编写能力,指令遵循和自我纠错能力显著提升,同时支持文本、图片与视频输入,思考与非思考模式,对话与 Agent 任务;支持自动上下文缓存功能,ToolCalls、JSON Mode、Partial Mode、联网搜索功能等能力。
输入:
6.505.53 积分/M tokens
输出:
27.0022.95 积分/M tokens
qwen3-30b-a3b-instruct-2507
Qwen3-VL系列第二大MoE模型的Instruct版本,响应速度快,支持长视频长文档等超长上下文;全面升级图像/视频理解、空间感知与万物识别能力;具备视觉2D/3D定位能力,胜任复杂现实任务。 最大上下文长度:128K 输入: 图片、视频、文本 输出: 文本
输入:
0.750.32 积分/M tokens
输出:
3.001.29 积分/M tokens