按功能分类的 AI 模型排行
由于 AI 模型种类繁多(对话、编程、图像生成、视频生成、语音、开源等),npmrundeploy.com 团队每周按功能分类汇总,方便你为正确的任务选择正确的模型 — 内容整理自公开竞技场/排行榜及本周新闻,并非我们自己的自动化基准测试。
所属周 2026-07-20
💬 对话与写作(通用大模型)
1Claude (Opus / Sonnet)
开发方: Anthropic
在多项综合排行榜的回答质量和可靠性方面领先。
2GPT-5 family
开发方: OpenAI
生态系统最大,深度集成到 ChatGPT 及众多第三方产品中。
3Gemini 3 Pro
开发方: Google
在多模态理解和长上下文方面表现出色,并与谷歌搜索/Workspace 集成。
4Grok 4
开发方: xAI
深度集成到 X(推特),擅长实时信息处理。
💻 编程与编程智能体
1Kimi K3
开发方: Moonshot AI
本周登顶一项重要编程竞技场排行榜;试用需求暴涨。
2GLM-5.1
开发方: Zhipu / Z.AI
开源模型,编程性能可直接与闭源模型竞争。
3Claude Code / Claude Opus
开发方: Anthropic
在自主编程方面最强 — 能理解并多步骤编辑大型代码库。
4Qwen 3.7
开发方: Alibaba
编程领域流行的开源模型,在速度与质量间取得良好平衡。
🧩 推理与 AI 智能体
1DeepSeek V4
开发方: DeepSeek
本周刚发布稳定版 — 推理能力强、成本低,对全行业定价施压。
2GLM-5
开发方: Zhipu / Z.AI
在开源模型的自主编程能力(SWE-bench)中处于领先地位。
3GPT-5 (reasoning mode)
开发方: OpenAI
在长推理链方面表现出色,广泛用于研究和复杂智能体任务。
🎨 图像生成
1GPT Image 2
开发方: OpenAI
目前在生成图像质量的竞技场排行榜上位居第一。
2GPT Image 1.5
开发方: OpenAI
上一代版本,因成本更低而仍被广泛使用。
3Gemini 3.1 Flash Image
开发方: Google
生成速度快,内置于 Gemini/谷歌生态系统中。
4Midjourney
开发方: Midjourney Inc.
美学质量仍被设计师和艺术家评为最高。
🎬 视频生成
1Kling v3
开发方: Kuaishou
目前在文本生成视频竞技场排行榜的得分中领先。
2Seedance 2.0
开发方: ByteDance
紧随领先者之后,擅长流畅运镜和更长时长的视频。
3LTX-2.3 Pro
开发方: Lightricks
在带音频的图生视频开源模型中处于领先地位。
🎙️ 语音(TTS / 语音转文字)
1ElevenLabs
开发方: ElevenLabs
在自然语音合成和声音克隆方面领先,广泛用于新闻朗读/有声读物应用。
2OpenAI Realtime Voice
开发方: OpenAI
低延迟实时语音,用于交互式语音助手。
3Whisper (kế thừa)
开发方: OpenAI
仍是语音转文字领域流行的开源选择。
🧬 开源 / 本地运行
1Qwen 3.7
开发方: Alibaba
全面的开源模型,在编程和多语言任务上都表现出色。
2GLM-5.1
开发方: Zhipu / Z.AI
编程性能可与闭源模型竞争,采用适合企业使用的开放许可。
3DeepSeek V4 Pro
开发方: DeepSeek
根据 SWE-bench,是企业级自主编程能力最强的开源模型。
4Gemma 4
开发方: Google
唯一拥有专为智能手机优化版本的开源模型系列。
5Llama 4 Scout
开发方: Meta
上下文窗口极长(高达 1000 万 token),是企业部署最广泛的模型。