按功能分类的 AI 模型排行
由于 AI 模型种类繁多(对话、编程、图像生成、视频生成、语音、开源等),npmrundeploy.com 团队每周按功能分类汇总,方便你为正确的任务选择正确的模型 — 内容整理自公开竞技场/排行榜及本周新闻,并非我们自己的自动化基准测试。
所属周 2026/07/20 · 每周人工编辑一次 —— 并非实时自动更新的数据。
💬 对话与写作(通用大模型)
🥇 Claude (Opus / Sonnet)
开发方: Anthropic
在多项综合排行榜的回答质量和可靠性方面领先。
🥈 GPT-5 family
开发方: OpenAI
生态系统最大,深度集成到 ChatGPT 及众多第三方产品中。
🥉 Gemini 3 Pro
开发方: Google
在多模态理解和长上下文方面表现出色,并与谷歌搜索/Workspace 集成。
4 Grok 4
开发方: xAI
深度集成到 X(推特),擅长实时信息处理。
💻 编程与编程智能体
🥇 Kimi K3
开发方: Moonshot AI
本周登顶一项重要编程竞技场排行榜;试用需求暴涨。
🥈 GLM-5.1
开发方: Zhipu / Z.AI
开源模型,编程性能可直接与闭源模型竞争。
🥉 Claude Code / Claude Opus
开发方: Anthropic
在自主编程方面最强 — 能理解并多步骤编辑大型代码库。
4 Qwen 3.7
开发方: Alibaba
编程领域流行的开源模型,在速度与质量间取得良好平衡。
🧩 推理与 AI 智能体
🥇 DeepSeek V4
开发方: DeepSeek
本周刚发布稳定版 — 推理能力强、成本低,对全行业定价施压。
🥈 GLM-5
开发方: Zhipu / Z.AI
在开源模型的自主编程能力(SWE-bench)中处于领先地位。
🥉 GPT-5 (reasoning mode)
开发方: OpenAI
在长推理链方面表现出色,广泛用于研究和复杂智能体任务。
🎨 图像生成
🥇 GPT Image 2
开发方: OpenAI
目前在生成图像质量的竞技场排行榜上位居第一。
🥈 GPT Image 1.5
开发方: OpenAI
上一代版本,因成本更低而仍被广泛使用。
🥉 Gemini 3.1 Flash Image
开发方: Google
生成速度快,内置于 Gemini/谷歌生态系统中。
4 Midjourney
开发方: Midjourney Inc.
美学质量仍被设计师和艺术家评为最高。
🎬 视频生成
🥇 Kling v3
开发方: Kuaishou
目前在文本生成视频竞技场排行榜的得分中领先。
🥈 Seedance 2.0
开发方: ByteDance
紧随领先者之后,擅长流畅运镜和更长时长的视频。
🥉 LTX-2.3 Pro
开发方: Lightricks
在带音频的图生视频开源模型中处于领先地位。
🎙️ 语音(TTS / 语音转文字)
🥇 ElevenLabs
开发方: ElevenLabs
在自然语音合成和声音克隆方面领先,广泛用于新闻朗读/有声读物应用。
🥈 OpenAI Realtime Voice
开发方: OpenAI
低延迟实时语音,用于交互式语音助手。
🥉 Whisper (kế thừa)
开发方: OpenAI
仍是语音转文字领域流行的开源选择。
🧬 开源 / 本地运行
🥇 Qwen 3.7
开发方: Alibaba
全面的开源模型,在编程和多语言任务上都表现出色。
🥈 GLM-5.1
开发方: Zhipu / Z.AI
编程性能可与闭源模型竞争,采用适合企业使用的开放许可。
🥉 DeepSeek V4 Pro
开发方: DeepSeek
根据 SWE-bench,是企业级自主编程能力最强的开源模型。
4 Gemma 4
开发方: Google
唯一拥有专为智能手机优化版本的开源模型系列。
5 Llama 4 Scout
开发方: Meta
上下文窗口极长(高达 1000 万 token),是企业部署最广泛的模型。