MODEL BENCHMARKS
查看最大上下文窗口处于 上下文未知 区间的 AI 模型实测结果,比较真实网关请求下的正确率、指令遵循与接口能力。
仅展示已完成并公开发布的结果。
alibaba · 上下文未知
glm-5.1
综合得分
xAI · 上下文未知
grok-4.5
Moonshot AI · 上下文未知
kimi-k2.6
智谱 AI · 上下文未知
glm-5