按功能分类的 AI 模型排行

由于 AI 模型种类繁多(对话、编程、图像生成、视频生成、语音、开源等),npmrundeploy.com 团队每周按功能分类汇总,方便你为正确的任务选择正确的模型 — 内容整理自公开竞技场/排行榜及本周新闻,并非我们自己的自动化基准测试。

所属周 2026-07-20

💬 对话与写作(通用大模型)

1Claude (Opus / Sonnet)

开发方: Anthropic

在多项综合排行榜的回答质量和可靠性方面领先。

2GPT-5 family

开发方: OpenAI

生态系统最大,深度集成到 ChatGPT 及众多第三方产品中。

3Gemini 3 Pro

开发方: Google

在多模态理解和长上下文方面表现出色,并与谷歌搜索/Workspace 集成。

4Grok 4

开发方: xAI

深度集成到 X(推特),擅长实时信息处理。

💻 编程与编程智能体

1Kimi K3

开发方: Moonshot AI

本周登顶一项重要编程竞技场排行榜;试用需求暴涨。

2GLM-5.1

开发方: Zhipu / Z.AI

开源模型,编程性能可直接与闭源模型竞争。

3Claude Code / Claude Opus

开发方: Anthropic

在自主编程方面最强 — 能理解并多步骤编辑大型代码库。

4Qwen 3.7

开发方: Alibaba

编程领域流行的开源模型,在速度与质量间取得良好平衡。

🧩 推理与 AI 智能体

1DeepSeek V4

开发方: DeepSeek

本周刚发布稳定版 — 推理能力强、成本低,对全行业定价施压。

2GLM-5

开发方: Zhipu / Z.AI

在开源模型的自主编程能力(SWE-bench)中处于领先地位。

3GPT-5 (reasoning mode)

开发方: OpenAI

在长推理链方面表现出色,广泛用于研究和复杂智能体任务。

🎨 图像生成

1GPT Image 2

开发方: OpenAI

目前在生成图像质量的竞技场排行榜上位居第一。

2GPT Image 1.5

开发方: OpenAI

上一代版本,因成本更低而仍被广泛使用。

3Gemini 3.1 Flash Image

开发方: Google

生成速度快,内置于 Gemini/谷歌生态系统中。

4Midjourney

开发方: Midjourney Inc.

美学质量仍被设计师和艺术家评为最高。

🎬 视频生成

1Kling v3

开发方: Kuaishou

目前在文本生成视频竞技场排行榜的得分中领先。

2Seedance 2.0

开发方: ByteDance

紧随领先者之后,擅长流畅运镜和更长时长的视频。

3LTX-2.3 Pro

开发方: Lightricks

在带音频的图生视频开源模型中处于领先地位。

🎙️ 语音(TTS / 语音转文字)

1ElevenLabs

开发方: ElevenLabs

在自然语音合成和声音克隆方面领先,广泛用于新闻朗读/有声读物应用。

2OpenAI Realtime Voice

开发方: OpenAI

低延迟实时语音,用于交互式语音助手。

3Whisper (kế thừa)

开发方: OpenAI

仍是语音转文字领域流行的开源选择。

🧬 开源 / 本地运行

1Qwen 3.7

开发方: Alibaba

全面的开源模型,在编程和多语言任务上都表现出色。

2GLM-5.1

开发方: Zhipu / Z.AI

编程性能可与闭源模型竞争,采用适合企业使用的开放许可。

3DeepSeek V4 Pro

开发方: DeepSeek

根据 SWE-bench,是企业级自主编程能力最强的开源模型。

4Gemma 4

开发方: Google

唯一拥有专为智能手机优化版本的开源模型系列。

5Llama 4 Scout

开发方: Meta

上下文窗口极长(高达 1000 万 token),是企业部署最广泛的模型。