| 智谱 GLM |
GLM-4-9B |
2024-06-05 |
128K |
开源紧凑 GLM-4,另有实验性 1M 版本,方便本地和私有化部署。 |
| Gemini |
Gemini 1.5 Flash |
2024-05-14 |
1M |
蒸馏自 1.5 Pro 的高速模型,价格低、延迟低,适合高并发和实时应用。 |
| OpenAI |
GPT-4o |
2024-05-13 |
128K |
首个原生 omni 多模态模型,统一处理文本、图像和音频,延迟更低,一度成为 ChatGPT 默认模型。 |
| DeepSeek |
DeepSeek-V2 |
2024-05-06 |
128K |
MLA 架构 MoE,性能接近当时闭源中档、价格极低,直接推动国内 API 价格战。 |
| xAI |
Grok-1.5 |
2024-03-28 |
128K |
推理和指令遵循明显强于 Grok-1,上下文扩到 128K,并很快补上视觉能力(Grok-1.5V)。 |
| Kimi |
moonshot-v1-128k |
2024-03-20 |
128K |
Kimi 开放平台早期主力模型,128K 上下文,适合中文长文档问答和总结。 |
| Anthropic |
Claude 3 Haiku |
2024-03-13 |
200K |
Claude 3 最快最便宜档,接近即时响应,适合分类、抽取和客服等高并发场景。 |
| Anthropic |
Claude 3 Opus |
2024-03-04 |
200K |
Claude 3 旗舰,当时在推理、数学和视觉上对标 GPT-4 级,200K 上下文,适合复杂分析。 |
| Anthropic |
Claude 3 Sonnet |
2024-03-04 |
200K |
Claude 3 均衡档,智能与速度折中,是企业落地最常用的一代 Sonnet。 |
| Gemini |
Gemini 1.5 Pro |
2024-02-15 |
1M |
率先把生产上下文做到 100 万(后实验到 200 万),长视频、代码库和超长文档是强项。 |
| Gemini |
Gemini 1.0 Ultra |
2024-02-08 |
32768 |
1.0 最强档,随 Gemini Advanced 上线,对标当时 GPT-4 级推理和多模态。 |
| 通义千问 |
Qwen1.5 |
2024-02-04 |
32768 |
对齐 ChatML 的完整一代,尺寸覆盖 0.5B 到 110B MoE,生态开始成型。 |
| 智谱 GLM |
GLM-4 |
2024-01-16 |
128K |
智谱 API 旗舰,128K 上下文,All Tools 可自动选择浏览、Python、图像和自定义函数。 |
| Gemini |
Gemini 1.0 Pro |
2023-12-06 |
32768 |
Google 首个 Gemini 公开代,多模态原生设计,Pro 面向开发和 Bard 升级。 |
| 通义千问 |
Qwen-72B |
2023-11-30 |
32768 |
早期开源大尺寸旗舰,中英文和长文本能力显著强于 7B。 |
| DeepSeek |
DeepSeek LLM |
2023-11-29 |
4096 |
7B/67B 通用稠密模型,是 DeepSeek 从代码走向通用对话的第一代基座。 |
| Anthropic |
Claude 2.1 |
2023-11-21 |
200K |
上下文翻倍到 20 万 token,降低长文档幻觉,并改进工具使用可靠性。 |
| OpenAI |
GPT-4 Turbo |
2023-11-06 |
128K |
首届 DevDay 发布,引入 128K 上下文、JSON Mode 与更低价格,并同期推出 Assistants API 与 GPTs。 |
| xAI |
Grok-1 |
2023-11-03 |
8192 |
xAI 首个对 X Premium 用户开放的对话模型,2024 年 3 月开源 314B MoE 权重。 |
| DeepSeek |
DeepSeek Coder |
2023-11-02 |
16384 |
DeepSeek 首个公开模型,专注代码补全和仓库理解,开启后续 Coder 产品线。 |