| OpenAI |
GPT-6 Astra |
2026-09-03 |
1050K |
GPT-6 代旗舰(Astra),面向最难的端到端工作,强化复杂推理、编码、电脑使用、研究和长程 Agent;105 万上下文,高级网络安全能力先通过 Daybreak Blue 受限开放。 |
| Anthropic |
Claude Fable 5.1 |
2026-09-01 |
1M |
当前 Mythos 级最新公开档,面向苛刻推理和超长程 Agent;当 Opus 5 高努力仍不够时使用。 |
| 智谱 GLM |
GLM-5.3 |
2026-08-14 |
1M |
基于 5.2 底座重做后训练,迁移要求开启思考,面向 Coding Plan 和 API 分阶段上线。 |
| DeepSeek |
DeepSeek-V4-Pro |
2026-08-13 |
1M |
V4 旗舰正式发布,约 1.6T/49B 激活,MIT 开源,主打最强开源通用能力。 |
| xAI |
Grok-4.6 |
2026-08-12 |
500K |
截至 2026 年 8 月的最新公开 Grok 一代,约 50 万上下文,面向通用对话、搜索和推理。 |
| 通义千问 |
Qwen3.8-Max |
2026-08-03 |
1M |
约 2.4T MoE 原生视觉旗舰,混合思考默认开启,100 万上下文,是当时通义最强型号。 |
| DeepSeek |
DeepSeek-V4-Flash |
2026-07-31 |
1M |
V4 高效档正式发布,约 284B/13B 激活,面向低延迟和大规模调用。 |
| Anthropic |
Claude Opus 5 |
2026-07-24 |
1M |
Claude 5 旗舰,接近 Fable 智能、价格约为其一半,适合复杂企业编码和长程 Agent。 |
| Gemini |
Gemini 3.6 Flash |
2026-07-21 |
1048576 |
截至 2026 年 7 月的最新公开 Flash,约 1049K 上下文,编码和速度都明显强于 2.5 Flash。 |
| Kimi |
Kimi K3 |
2026-07-16 |
1M |
2.8T 开源旗舰,原生视觉 + 100 万上下文,面向长程编码、知识工作和推理;权重于 7 月 27 日完整开放。 |
| OpenAI |
GPT-5.6 Sol |
2026-07-09 |
1050K |
GPT-5.6 前沿档(Sol),公开发布后成为当时最强 GPT,支持程序化工具调用和多 Agent 编排。 |
| OpenAI |
GPT-5.6 Terra |
2026-07-09 |
1050K |
GPT-5.6 均衡档(Terra),在智能与成本之间折中,适合大多数生产工作负载。 |
| OpenAI |
GPT-5.6 Luna |
2026-07-09 |
1050K |
GPT-5.6 最快、最便宜档(Luna),面向高吞吐对话和轻量任务。 |
| xAI |
Grok-4.5 |
2026-07-08 |
500K |
4.x 中后期旗舰,编码和文本 Arena 表现突出,上下文和推理效率继续提升。 |
| Anthropic |
Claude Sonnet 5 |
2026-06-30 |
1M |
Claude 5 代均衡档,速度与智能兼顾,默认自适应思考,适合大多数 Agent 和知识工作。 |
| 智谱 GLM |
GLM-5.2 |
2026-06-16 |
1M |
上下文扩到 100 万,增加 IndexShare、MTP 和推理努力控制,MIT 开源。 |
| Kimi |
Kimi K2.7 Code |
2026-06-12 |
256K |
面向软件工程的思考型编码模型,只走 thinking 模式,针对仓库级长任务优化。 |
| Anthropic |
Claude Fable 5 |
2026-06-09 |
1M |
Mythos 级高阶模型首次对普通用户开放,面向超长程 Agent 和最强推理,1M 上下文。 |
| 通义千问 |
Qwen3.7-Plus |
2026-06-01 |
1M |
3.7 均衡托管档,100 万上下文,兼顾办公生产和长程 Agent。 |
| Anthropic |
Claude Opus 4.8 |
2026-05-28 |
1M |
4.x 收官旗舰,在编码、Agent 技能、推理和知识工作上继续压过 4.7。 |