全部
qwen3.5-122b-a10b
Qwen3.5系列122B-A10B原生视觉语言模型,基于混合架构设计,融合了线性注意力机制与稀疏混合专家模型,实现了更高的推理效率。该模型的综合表现仅次于Qwen3.5-397B-A17B,文本能力显著优于Qwen3-235B-2507,视觉能力优于Qwen3-VL-235B。
最大输入长度 254K RPM 600 最大输入长度(思考) 252K 上下文长度 256K 最大输出长度 64K TPM 1000000 最大输出长度(思考) 64K 最大思维链长度 80K
qwen3.5-397b-a17b
Qwen3.5系列397B-A17B原生视觉语言模型,基于混合架构设计,融合了线性注意力机制与稀疏混合专家模型,实现了更高的推理效率。在语言理解、逻辑推理、代码生成、智能体任务、图像理解、视频理解、图形用户界面(GUI)等多种任务中,均展现出与当前顶尖前沿模型相媲美的卓越性能。具备强大的代码生成与智能体能力,对于各类智能体场景具有良好的泛化性。
最大上下文长度:256K 输入: 图片、视频、文本 输出: 文本
Minimax-M2.5
MiniMax-M2.5 是 MiniMax 推出的新一代旗舰编程模型,致力于提升真实世界复杂任务中的表现。在编程、工具调用和搜索、办公等生产力场景都达到或刷新了行业的 SOTA。
最大上下文长度:128K 输入: 文本 输出: 文本
glm-5.1
GLM-5.1 是智谱最新旗舰模型,代码能力大大增强,长程任务显著提升,能够在单次任务中持续、自主地工作长达 8 小时,完成从规划、执行到迭代优化的完整闭环,交付工程级成果。
在综合能力与 Coding 能力上,GLM-5.1 整体表现对齐 Claude Opus 4.6,并在长程自主执行、复杂工程优化与真实开发场景中展现出更强的持续工作能力,是构建 Autonomous Agent 与长程 Coding Agent 的理想基座。
GLM-5-Turbo
glm-5-turbo 是面向 OpenClaw 龙虾场景深度优化的基座模型,能聊天更会干活,在复杂、动态、长链路的任务中真正具备可执行性。
GLM-5.0
GLM-5 是智谱新一代的旗舰基座模型,面向 Agentic Engineering 打造,能够在复杂系统工程与长程 Agent 任务中提供可靠生产力。在 Coding 与 Agent 能力上,GLM-5 取得开源 SOTA 表现,在真实编程场景的使用体感逼近 Claude Opus 4.5,擅长复杂系统工程与长程 Agent 任务,是通用 Agent 助手的理想基座。
glm-4.7-flashx
GLM-4.7-FlashX 是智谱 GLM-4.7 系列的轻量高效版,总参数30B,兼顾性能与性价比。继承 GLM-4.7 系列在 Agentic Coding、长程任务规划与工具协同方面的强化能力,FlashX 版本以更快的响应速度和更高的吞吐量,满足实时交互、高频调用等业务场景需求。同时具备简洁自然的回复风格与沉浸式写作能力,在工具调用场景下指令遵循能力依然稳定可靠。
能力:文本生成
最大上下文长度:200K 输入: 文本 输出: 文本
glm-4.7
GLM-4.7 系列是智谱最新旗舰模型,面向 Agentic Coding 场景强化了编码能力、长程任务规划与工具协同,并在多个公开基准的当期榜单中取得开源模型中的出色表现。通用能力提升,回复更简洁自然,写作更具沉浸感。在执行复杂智能体任务,在工具调用时指令遵循更强,Artifacts 与 Agentic Coding 的前端美感和长程任务完成效率进一步提升。
能力:文本生成
最大上下文长度:200K 输入: 文本 输出: 文本
GLM4.6V
GLM-4.6V 系列是 GLM 系列在多模态方向上的一次重要迭代,它将训练时上下文窗口提升到128k tokens,在视觉理解精度上达到同参数规模 SOTA,并首次在模型架构中将 Function Call(工具调用)能力原生融入视觉模型,打通从「视觉感知」到「可执行行动(Action)」的链路,为真实业务场景中的多模态 Agent 提供统一的技术底座。
