deepseek-v4-pro
DeepSeek-V4-Pro是深度求索公司于2026年发布的旗舰级开源大模型,采用混合专家(MoE)架构,总参数量达1.6万亿,实际推理中每个Token仅激活490亿参数,在保证强大性能的同时显著优化了计算效率。它原生支持高达100万Token的上下文窗口,并采用了混合注意力机制等创新技术,在处理长文本时计算量仅为前代V3.2的27%,KV缓存占用仅为其10%。该模型专为解决极高难度的编程挑战、多步逻辑推理及复杂的多智能体协作而生,在代码生成(如LiveCodeBench达93.5%)、软件工程(如SWE Verified 80.6分)及Agent任务等基准测试中表现优异,性能比肩甚至超越部分顶级闭源模型。模型支持可调节强度的“思考模式”与“非思考模式”,并已同步在网页、App及API上线,且已在华为昇腾等国产算力平台完成深度适配。复制
价格信息
类型官方原价/折扣价格
输入
9.004.32 积分/M tokens
输入(命中缓存)
0.300.144 积分/M tokens
输出
27.0012.96 积分/M tokens
API文档
Request address and method(请求地址和方式)
POSThttps://api.suanjiayun.com/v1/chat/completions
Request Headers(请求头)
"Authorization" string必填
示例:"Bearer <令牌key>"。使用 Bearer Token 认证
"Content-Type" string必填
示例:"application/json"。使用 JSON 发送请求主体
Request Body(请求体)
application/json "model" string必填
示例:"deepseek-v4-pro"。 调用的模型 ID
"messages" array必填
对话消息列表
"role" string
示例:"user"。 聊天模型 API 中消息的角色标识。取值:"system" | "user" | "assistant"
"content" string必填
示例:"内容"。 对话内容
"stream" boolean
示例:false。 调用的模型 ID
"temperature" number
示例:1。 采样温度,控制输出的随机性和创造性,取值范围[0,2]
"top_p" number
示例:1。 核采样参数,控制词汇选择的多样性,取值范围[0,1]
"n" number
示例:1。 生成数量,取值范围[1,+∞]
"frequency_penalty" number
示例:0。 频率惩罚,减少重复词汇的出现[-2,2]
"presence_penalty" number
示例:0。 存在惩罚,鼓励讨论新话题[-2,2]
"reasoning_effort" string
示例:"medium"。 推理强度 (用于支持推理的模型),"low" | "medium" | "high"
请求示例
cURL
JavaScript
Java
Python
Go
响应示例
200
400
409