按功能分类的 AI 模型排行

由于 AI 模型种类繁多(对话、编程、图像生成、视频生成、语音、开源等),npmrundeploy.com 团队每周按功能分类汇总,方便你为正确的任务选择正确的模型 — 内容整理自公开竞技场/排行榜及本周新闻,并非我们自己的自动化基准测试。

所属周 2026/07/20 · 每周人工编辑一次 —— 并非实时自动更新的数据。

收听排行榜 点击播放,浏览器语音朗读

💬 对话与写作(通用大模型)

🥇 Claude (Opus / Sonnet)

开发方: Anthropic

在多项综合排行榜的回答质量和可靠性方面领先。

🥈 GPT-5 family

开发方: OpenAI

生态系统最大,深度集成到 ChatGPT 及众多第三方产品中。

🥉 Gemini 3 Pro

开发方: Google

在多模态理解和长上下文方面表现出色,并与谷歌搜索/Workspace 集成。

4 Grok 4

开发方: xAI

深度集成到 X(推特),擅长实时信息处理。

💻 编程与编程智能体

🥇 Kimi K3

开发方: Moonshot AI

本周登顶一项重要编程竞技场排行榜;试用需求暴涨。

🥈 GLM-5.1

开发方: Zhipu / Z.AI

开源模型,编程性能可直接与闭源模型竞争。

🥉 Claude Code / Claude Opus

开发方: Anthropic

在自主编程方面最强 — 能理解并多步骤编辑大型代码库。

4 Qwen 3.7

开发方: Alibaba

编程领域流行的开源模型,在速度与质量间取得良好平衡。

🧩 推理与 AI 智能体

🥇 DeepSeek V4

开发方: DeepSeek

本周刚发布稳定版 — 推理能力强、成本低,对全行业定价施压。

🥈 GLM-5

开发方: Zhipu / Z.AI

在开源模型的自主编程能力(SWE-bench)中处于领先地位。

🥉 GPT-5 (reasoning mode)

开发方: OpenAI

在长推理链方面表现出色,广泛用于研究和复杂智能体任务。

🎨 图像生成

🥇 GPT Image 2

开发方: OpenAI

目前在生成图像质量的竞技场排行榜上位居第一。

🥈 GPT Image 1.5

开发方: OpenAI

上一代版本,因成本更低而仍被广泛使用。

🥉 Gemini 3.1 Flash Image

开发方: Google

生成速度快,内置于 Gemini/谷歌生态系统中。

4 Midjourney

开发方: Midjourney Inc.

美学质量仍被设计师和艺术家评为最高。

🎬 视频生成

🥇 Kling v3

开发方: Kuaishou

目前在文本生成视频竞技场排行榜的得分中领先。

🥈 Seedance 2.0

开发方: ByteDance

紧随领先者之后,擅长流畅运镜和更长时长的视频。

🥉 LTX-2.3 Pro

开发方: Lightricks

在带音频的图生视频开源模型中处于领先地位。

🎙️ 语音(TTS / 语音转文字)

🥇 ElevenLabs

开发方: ElevenLabs

在自然语音合成和声音克隆方面领先,广泛用于新闻朗读/有声读物应用。

🥈 OpenAI Realtime Voice

开发方: OpenAI

低延迟实时语音,用于交互式语音助手。

🥉 Whisper (kế thừa)

开发方: OpenAI

仍是语音转文字领域流行的开源选择。

🧬 开源 / 本地运行

🥇 Qwen 3.7

开发方: Alibaba

全面的开源模型,在编程和多语言任务上都表现出色。

🥈 GLM-5.1

开发方: Zhipu / Z.AI

编程性能可与闭源模型竞争,采用适合企业使用的开放许可。

🥉 DeepSeek V4 Pro

开发方: DeepSeek

根据 SWE-bench,是企业级自主编程能力最强的开源模型。

4 Gemma 4

开发方: Google

唯一拥有专为智能手机优化版本的开源模型系列。

5 Llama 4 Scout

开发方: Meta

上下文窗口极长(高达 1000 万 token),是企业部署最广泛的模型。