| xAI |
Grok-3 |
2025-02-17 |
1M |
在 Colossus 超大规模训练的推理时代旗舰,提供 Think 模式,上下文可达百万 token。 |
| xAI |
Grok-3 mini |
2025-02-17 |
1M |
Grok-3 的轻量推理版本,保留 Think 模式,适合更低成本和更快响应。 |
| Gemini |
Gemini 2.0 Pro |
2025-02-05 |
2M |
2.0 实验旗舰,强调编码和复杂提示,上下文可达 200 万。 |
| OpenAI |
o3-mini |
2025-01-31 |
200K |
首个向免费 ChatGPT 用户开放的推理模型,在数学和编程上接近 o1,速度更快、价格更低。 |
| 通义千问 |
Qwen2.5-Max |
2025-01-28 |
131072 |
阿里云托管旗舰 MoE,对标当时闭源一线,适合通用对话和复杂任务。 |
| Kimi |
Kimi K1.5 |
2025-01-20 |
128K |
编号型号线的起点,强化多模态推理和强化学习,开启 Kimi 的 thinking 路线。 |
| DeepSeek |
DeepSeek-R1 |
2025-01-20 |
128K |
纯强化学习训练的推理模型,开源后引发全球关注;同期发布 R1-Zero 和多档蒸馏模型。 |
| DeepSeek |
DeepSeek-V3 |
2024-12-26 |
128K |
671B MoE(约 37B 激活),FP8 训练 + MTP,成为后续 R1 和 App 的底座。 |
| Gemini |
Gemini 2.0 Flash |
2024-12-11 |
1M |
2.0 时代默认高速模型,原生工具、多模态输出和实时能力更强,同期发布 Veo 2。 |
| OpenAI |
o1 |
2024-12-05 |
200K |
完整版 o1 推理模型,与 ChatGPT Pro 同期推出,API 于 12 月 17 日开放,上下文提升到 200K。 |
| Anthropic |
Claude 3.5 Haiku |
2024-10-22 |
200K |
3.5 代快速模型,速度接近 Haiku、智能接近早期 Sonnet,适合低延迟生产流量。 |
| 通义千问 |
Qwen2.5 |
2024-09-19 |
131072 |
应用最广的开源一代,0.5B–72B 全尺寸,编码、数学和指令遵循全面提升。 |
| OpenAI |
o1-preview |
2024-09-12 |
128K |
o 系列推理模型预览版,回答前先进行内部思维链,在数学、编程和科学问题上显著强于当时的 GPT-4o。 |
| OpenAI |
o1-mini |
2024-09-12 |
128K |
o1 的轻量推理版本,侧重 STEM 与编程,成本更低、速度更快,适合需要一定推理但不追求最强效果的场景。 |
| DeepSeek |
DeepSeek-V2.5 |
2024-09-05 |
128K |
合并 V2-0628 与 Coder-V2-0724,通用对话和编码共用一个模型。 |
| xAI |
Grok-2 |
2024-08-13 |
128K |
全面升级的一代 Grok,编码和写作更强,并接入实时 X 搜索与图像生成。 |
| OpenAI |
GPT-4o mini |
2024-07-18 |
128K |
GPT-4o 的高性价比小型多模态版本,在 ChatGPT 中接替 GPT-3.5 Turbo,适合高并发轻量任务。 |
| Anthropic |
Claude 3.5 Sonnet |
2024-06-20 |
200K |
一代爆款 Sonnet,编程、视觉和工具使用大幅超越 Claude 3 Opus,性价比极高。 |
| DeepSeek |
DeepSeek-Coder-V2 |
2024-06-17 |
128K |
基于 V2 的代码专用模型,覆盖更多编程语言,长上下文仓库问答能力强。 |
| 通义千问 |
Qwen2 |
2024-06-06 |
131072 |
第三代 Qwen,多语言和长上下文更强,7B 及以上普遍支持 128K。 |