查看主要厂商代表模型的发布时间和上下文长度。
  • 模型厂商:
  • 模型名称:
模型厂商 模型名称 发布时间 上下文长度 模型介绍
智谱 GLM GLM-4-9B 2024-06-05 128K 开源紧凑 GLM-4,另有实验性 1M 版本,方便本地和私有化部署。
Gemini Gemini 1.5 Flash 2024-05-14 1M 蒸馏自 1.5 Pro 的高速模型,价格低、延迟低,适合高并发和实时应用。
OpenAI GPT-4o 2024-05-13 128K 首个原生 omni 多模态模型,统一处理文本、图像和音频,延迟更低,一度成为 ChatGPT 默认模型。
DeepSeek DeepSeek-V2 2024-05-06 128K MLA 架构 MoE,性能接近当时闭源中档、价格极低,直接推动国内 API 价格战。
xAI Grok-1.5 2024-03-28 128K 推理和指令遵循明显强于 Grok-1,上下文扩到 128K,并很快补上视觉能力(Grok-1.5V)。
Kimi moonshot-v1-128k 2024-03-20 128K Kimi 开放平台早期主力模型,128K 上下文,适合中文长文档问答和总结。
Anthropic Claude 3 Haiku 2024-03-13 200K Claude 3 最快最便宜档,接近即时响应,适合分类、抽取和客服等高并发场景。
Anthropic Claude 3 Opus 2024-03-04 200K Claude 3 旗舰,当时在推理、数学和视觉上对标 GPT-4 级,200K 上下文,适合复杂分析。
Anthropic Claude 3 Sonnet 2024-03-04 200K Claude 3 均衡档,智能与速度折中,是企业落地最常用的一代 Sonnet。
Gemini Gemini 1.5 Pro 2024-02-15 1M 率先把生产上下文做到 100 万(后实验到 200 万),长视频、代码库和超长文档是强项。
Gemini Gemini 1.0 Ultra 2024-02-08 32768 1.0 最强档,随 Gemini Advanced 上线,对标当时 GPT-4 级推理和多模态。
通义千问 Qwen1.5 2024-02-04 32768 对齐 ChatML 的完整一代,尺寸覆盖 0.5B 到 110B MoE,生态开始成型。
智谱 GLM GLM-4 2024-01-16 128K 智谱 API 旗舰,128K 上下文,All Tools 可自动选择浏览、Python、图像和自定义函数。
Gemini Gemini 1.0 Pro 2023-12-06 32768 Google 首个 Gemini 公开代,多模态原生设计,Pro 面向开发和 Bard 升级。
通义千问 Qwen-72B 2023-11-30 32768 早期开源大尺寸旗舰,中英文和长文本能力显著强于 7B。
DeepSeek DeepSeek LLM 2023-11-29 4096 7B/67B 通用稠密模型,是 DeepSeek 从代码走向通用对话的第一代基座。
Anthropic Claude 2.1 2023-11-21 200K 上下文翻倍到 20 万 token,降低长文档幻觉,并改进工具使用可靠性。
OpenAI GPT-4 Turbo 2023-11-06 128K 首届 DevDay 发布,引入 128K 上下文、JSON Mode 与更低价格,并同期推出 Assistants API 与 GPTs。
xAI Grok-1 2023-11-03 8192 xAI 首个对 X Premium 用户开放的对话模型,2024 年 3 月开源 314B MoE 权重。
DeepSeek DeepSeek Coder 2023-11-02 16384 DeepSeek 首个公开模型,专注代码补全和仓库理解,开启后续 Coder 产品线。

说明

发布时间和上下文长度来自公开资料整理,不同平台、套餐或测试接口可能不同,请以各厂商官方文档为准。
上面表格数据按 发布时间 降序排列。

0 条用户评论

0 / 300