| 通义千问 |
Qwen3.7-Max |
2026-05-20 |
1M |
Max 系列下一代旗舰,默认思考,100 万上下文,后续快照补上视觉理解。 |
| Gemini |
Gemini 3.5 Flash |
2026-05-01 |
1048576 |
3.5 高速档,适合低延迟多模态应用,上下文约 1049K。 |
| DeepSeek |
DeepSeek-V4 Preview |
2026-04-24 |
1M |
V4 预览,默认 100 万上下文,拆成 Pro / Flash 两档 MoE,开源权重。 |
| OpenAI |
GPT-5.5 |
2026-04-23 |
1M |
ChatGPT 与 Codex 新一代默认旗舰,5 月 5 日起 Instant 成为全量默认模型,幻觉更少、个性化更好。 |
| Kimi |
Kimi K2.6 |
2026-04-21 |
256K |
K2 通用多模态迭代,强化长程编码和 Agent 工作流,曾是 K3 发布前的推荐模型。 |
| Anthropic |
Claude Opus 4.7 |
2026-04-16 |
1M |
面向复杂推理和长程编码的广泛发布旗舰,视觉分辨率更高,同期推出 Claude Design。 |
| 通义千问 |
Qwen3.6 |
2026-04-16 |
262144 |
在 3.5 上强化稳定性和真实编码,开源 35B-A3B / 27B 等尺寸。 |
| 智谱 GLM |
GLM-5.1 |
2026-04-07 |
200K |
针对超长任务、策略修正和修 bug,官方称 Agent 可持续运行数小时。 |
| OpenAI |
GPT-5.4 mini |
2026-03-17 |
1M |
把 GPT-5.4 级能力下放到中小模型,适合高并发智能体和工具调用。 |
| OpenAI |
GPT-5.4 nano |
2026-03-17 |
1M |
GPT-5.4 最小尺寸,保留百万上下文,适合分类、路由和轻量工具调用。 |
| OpenAI |
GPT-5.4 |
2026-03-05 |
1M |
首个主线原生电脑使用(computer-use)模型,API/Codex 提供百万上下文和工具搜索,Token 效率高于 GPT-5.2。 |
| xAI |
Grok-4.20 |
2026-02-17 |
256K |
多 Agent 预览代,默认 256K、可扩到 2M,后续 Beta 2 强化指令遵循和降幻觉。 |
| Anthropic |
Claude Sonnet 4.6 |
2026-02-17 |
1M |
编码、电脑使用、长上下文推理和 Agent 规划全面升级,1M 上下文先以 beta 形式提供。 |
| 通义千问 |
Qwen3.5 |
2026-02-16 |
262144 |
多模态、架构效率和大规模 RL 融合的新一代,先发 397B-A17B 等 MoE。 |
| 智谱 GLM |
GLM-5 |
2026-02-12 |
200K |
总参数约 744B、激活约 40B,引入稀疏注意力提升长上下文效率。 |
| Anthropic |
Claude Opus 4.6 |
2026-02-05 |
1M |
升级编码能力的 Opus,1M 上下文成为标准能力,并进入 Excel / PPT 等办公插件默认模型。 |
| Gemini |
Gemini 3.1 Pro |
2026-02-01 |
1048576 |
3.x 中期 Pro,强化自定义工具和编码,上下文约 1049K。 |
| Kimi |
Kimi K2.5 |
2026-01-27 |
256K |
原生视觉与 Agent Swarm,把多模态和多 Agent 协作并进通用模型。 |
| 智谱 GLM |
GLM-4.7 |
2025-12-22 |
200K |
4.x 收官,端到端 Agent 和编码推理再进一步。 |
| OpenAI |
GPT-5.2 |
2025-12-11 |
400K |
面向专业知识工作的 GPT-5 旗舰,强化长程工具流,Thinking 支持 compact 以突破单次上下文上限。 |