全部
Doubao1.5-lite-32k
Doubao-1.5-lite 全新一代轻量版模型,极致响应速度,效果与时延均达到全球一流水平。,在综合(MMLU_pro)、推理(BBH)、数学(MATH)、专业知识(GPQA)权威测评指标持平或超越GPT-4omini,Cluade 3.5 Haiku。
最大上下文长度:32K 输入:文本 输出:文本
DeepSeek-V3.2-Exp
DeepSeek-V3.2-Exp 模型,是一个实验性(Experimental)的版本。作为迈向新一代架构的中间步骤,V3.2-Exp 在 V3.1-Terminus 的基础上引入了 DeepSeek Sparse Attention(一种稀疏注意力机制),针对长文本的训练和推理效率进行了探索性的优化和验证。
最大上下文长度: 128K 输入:文本 输出:文本
DeepSeek-V3.2
DeepSeek 发布 V3.2 正式版,显著强化了 Agent 和推理能力,在主流测试中达到 GPT-5 水平并支持思考模式下的工具调用;同时推出的 Speciale 探索版在多项国际竞赛中取得金牌级表现。模型已全面开放使用。
最大上下文长度:128K 输入:文本 输出:文本
DeepSeek-V3-0324
DeepSeek-V3-0324 是 DeepSeek-V3 的一个快照版本,在 V3 基础上针对指令跟随和代码生成能力进行了定向优化,提升了在复杂任务中的响应准确度。该版本为后续引入混合推理架构的 V3.1 系列奠定了基础。
能力:文本生成、代码生成
最大上下文长度:64K 输入:文本 输出:文本
DeepSeek-V3.1-Terminus
DeepSeek-V3.1-Terminus在保持模型原有DeepSeek-V3.1能力的基础上,针对用户反馈的问题进行了改进,包括: 语言一致性:缓解了中英文混杂、偶发异常字符等情况; Agent 能力:进一步优化了 Code Agent 与 Search Agent 的表现。
最大上下文长度: 128K 输入:文本 输出:文本
DeepSeek-V3.1
DeepSeek-V3.1 是深度求索全新推出的混合推理模型,支持思考与非思考2种推理模式,较 DeepSeek-R1-0528 思考效率更高。经 Post-Training 优化,Agent 工具使用与智能体任务表现大幅提升。
能力: 文本输出、深度思考
最大上下文:128K 输入:文本 输出: 文本
DeepSeek-V3
DeepSeek-V3 是一款由深度求索公司自研的MoE模型。在通用对话、知识问答、内容创作等任务上具备高效的计算与生成能力,并在性能上和世界顶尖的闭源模型 GPT-4o 以及 Claude-3.5-Sonnet 不分伯仲。
能力:文本生成
最大上下文长度:64K 输入:文本 输出:文本
