AI 模型中心

AI 模型

浏览 GPT-5.5、GPT Image 2、Kimi K3 和 DeepSeek V4 模型指南,适用于带引用来源的搜索、创意内容、编程、图像生成和研究工作流。

精选 AI 模型指南

搜索 + 研究

OpenAI

GPT-6 Astra

高能力推理模型,适合带来源回答、长文写作、编程帮助和复杂研究提示。

  • 带来源搜索
  • 创意写作
  • 编程与分析
基准测试

尚未测试

打开模型指南
搜索 + 研究

OpenAI

GPT-5.5

高能力推理模型,适合带来源回答、长文写作、编程帮助和复杂研究提示。

  • 带来源搜索
  • 创意写作
  • 编程与分析
基准测试
Design Arena · Code
GPT-5.5
Elo
1,264
偏好胜率
53.4%
锦标赛场次: 0

参考基准测试,并非此部署环境的测量结果。

打开模型指南
Search + Research

OpenAI

GPT-5.6 Terra

A GPT-5.6 guide for grounded research, structured content, coding support, and complex professional prompts.

  • Grounded research
  • Structured content
  • Coding support
基准测试

尚未测试

打开模型指南
Creative Reasoning

OpenAI

GPT-5.6 Luna

A GPT-5.6 guide for creative content, cited-source answers, planning, coding help, and research workflows.

  • Creative content
  • Cited answers
  • Planning and analysis
基准测试

尚未测试

打开模型指南
Search + Research

OpenAI

GPT-5.6 Sol

A GPT-5.6 guide for cited-source search, deep reasoning, long-form drafting, coding help, and complex research workflows.

  • Cited-source search
  • Deep reasoning
  • Coding and analysis
基准测试

尚未测试

打开模型指南
搜索 + 研究

Anthropic

Claude Opus 5

高能力推理模型,适合带来源回答、长文写作、编程帮助和复杂研究提示。

  • 带来源搜索
  • 创意写作
  • 编程与分析
基准测试
Design Arena · Code
Claude Opus 5
Elo
1,328
偏好胜率
57.5%
锦标赛场次: 0

参考基准测试,并非此部署环境的测量结果。

打开模型指南
Agentic Reasoning

Anthropic

Claude Opus 4.8

An Anthropic model guide for cited-source search, agentic coding, long-form drafting, and complex professional research workflows.

  • Cited search
  • Agentic coding
  • Research workflows
基准测试
Design Arena · Code
Claude Opus 4.8
Elo
1,258
偏好胜率
52.6%
锦标赛场次: 0

参考基准测试,并非此部署环境的测量结果。

打开模型指南
Agentic Reasoning

Anthropic

Claude Fable 5

An Anthropic model guide for cited-source search, advanced drafting, coding help, and professional research workflows.

  • Cited search
  • Advanced drafting
  • Research workflows
基准测试

尚未测试

打开模型指南
Fast Reasoning

Anthropic

Claude Sonnet 5

An Anthropic model guide for cited-source search, fast drafting, coding help, and professional research workflows.

  • Cited search
  • Fast drafting
  • Coding help
基准测试
Design Arena · Code
Claude Sonnet 5
Elo
1,281
偏好胜率
52.9%
锦标赛场次: 0

参考基准测试,并非此部署环境的测量结果。

打开模型指南
快速推理

Google

Gemini 3.5 Flash

快速的 Google 模型指南,适合带来源搜索、创意内容、编程帮助和研究工作流。

  • 带来源搜索
  • 创意内容
  • 编程帮助
基准测试
Design Arena · Code
Gemini 3.5 Flash
Elo
1,270
偏好胜率
54.3%
锦标赛场次: 0

参考基准测试,并非此部署环境的测量结果。

打开模型指南
图像生成

OpenAI

GPT Image 2

新的图像模型,适合高保真视觉、UI 原型、图像内多语言文字和创意制作测试。

  • 文本生成图像
  • UI 原型
  • 创意视觉
基准测试

尚未测试

打开模型指南
搜索 + 推理

xAI

Grok 4.5

xAI 模型指南,适合带来源搜索、事实核查、创意内容和研究工作流。

  • 带来源搜索
  • 事实核查
  • 创意策略
基准测试
Design Arena · Code
Grok 4.5
Elo
1,280
偏好胜率
51%
锦标赛场次: 0

参考基准测试,并非此部署环境的测量结果。

打开模型指南
长上下文

Moonshot AI

Kimi K3

适合长上下文推理、创意工作流、编程任务和需要广泛上下文回答的强模型。

  • 长文档
  • 编程工作流
  • 创意策略
基准测试
Design Arena · Code
Kimi K3
Elo
1,366
偏好胜率
62.7%
锦标赛场次: 0

参考基准测试,并非此部署环境的测量结果。

打开模型指南
长上下文

Alibaba

Qwen3.8-Max

适合长上下文推理、创意工作流、编程任务和需要广泛上下文回答的强模型。

  • 长文档
  • 编程工作流
  • 创意策略
基准测试

尚未测试

打开模型指南
搜索 + 研究

Z.ai

GLM 5.2

高能力推理模型,适合带来源回答、长文写作、编程帮助和复杂研究提示。

  • 带来源搜索
  • 创意写作
  • 编程与分析
基准测试

基准测试暂时不可用

打开模型指南
推理

DeepSeek

DeepSeek V4

适合搜索、事实核查、技术解释和结构化内容生成的实用模型。

  • 搜索回答
  • 技术写作
  • 结构化推理
基准测试

基准测试暂时不可用

打开模型指南

Source: Design Arena (www.designarena.ai) via OpenRouter (openrouter.ai/rankings).

Source: Design Arena (www.designarena.ai) via OpenRouter (openrouter.ai/rankings).