查看主要厂商代表模型的发布时间和上下文长度。
  • 模型厂商:
  • 模型名称:
模型厂商 模型名称 发布时间 上下文长度 模型介绍
xAI Grok-3 2025-02-17 1M 在 Colossus 超大规模训练的推理时代旗舰,提供 Think 模式,上下文可达百万 token。
xAI Grok-3 mini 2025-02-17 1M Grok-3 的轻量推理版本,保留 Think 模式,适合更低成本和更快响应。
Gemini Gemini 2.0 Pro 2025-02-05 2M 2.0 实验旗舰,强调编码和复杂提示,上下文可达 200 万。
OpenAI o3-mini 2025-01-31 200K 首个向免费 ChatGPT 用户开放的推理模型,在数学和编程上接近 o1,速度更快、价格更低。
通义千问 Qwen2.5-Max 2025-01-28 131072 阿里云托管旗舰 MoE,对标当时闭源一线,适合通用对话和复杂任务。
Kimi Kimi K1.5 2025-01-20 128K 编号型号线的起点,强化多模态推理和强化学习,开启 Kimi 的 thinking 路线。
DeepSeek DeepSeek-R1 2025-01-20 128K 纯强化学习训练的推理模型,开源后引发全球关注;同期发布 R1-Zero 和多档蒸馏模型。
DeepSeek DeepSeek-V3 2024-12-26 128K 671B MoE(约 37B 激活),FP8 训练 + MTP,成为后续 R1 和 App 的底座。
Gemini Gemini 2.0 Flash 2024-12-11 1M 2.0 时代默认高速模型,原生工具、多模态输出和实时能力更强,同期发布 Veo 2。
OpenAI o1 2024-12-05 200K 完整版 o1 推理模型,与 ChatGPT Pro 同期推出,API 于 12 月 17 日开放,上下文提升到 200K。
Anthropic Claude 3.5 Haiku 2024-10-22 200K 3.5 代快速模型,速度接近 Haiku、智能接近早期 Sonnet,适合低延迟生产流量。
通义千问 Qwen2.5 2024-09-19 131072 应用最广的开源一代,0.5B–72B 全尺寸,编码、数学和指令遵循全面提升。
OpenAI o1-preview 2024-09-12 128K o 系列推理模型预览版,回答前先进行内部思维链,在数学、编程和科学问题上显著强于当时的 GPT-4o。
OpenAI o1-mini 2024-09-12 128K o1 的轻量推理版本,侧重 STEM 与编程,成本更低、速度更快,适合需要一定推理但不追求最强效果的场景。
DeepSeek DeepSeek-V2.5 2024-09-05 128K 合并 V2-0628 与 Coder-V2-0724,通用对话和编码共用一个模型。
xAI Grok-2 2024-08-13 128K 全面升级的一代 Grok,编码和写作更强,并接入实时 X 搜索与图像生成。
OpenAI GPT-4o mini 2024-07-18 128K GPT-4o 的高性价比小型多模态版本,在 ChatGPT 中接替 GPT-3.5 Turbo,适合高并发轻量任务。
Anthropic Claude 3.5 Sonnet 2024-06-20 200K 一代爆款 Sonnet,编程、视觉和工具使用大幅超越 Claude 3 Opus,性价比极高。
DeepSeek DeepSeek-Coder-V2 2024-06-17 128K 基于 V2 的代码专用模型,覆盖更多编程语言,长上下文仓库问答能力强。
通义千问 Qwen2 2024-06-06 131072 第三代 Qwen,多语言和长上下文更强,7B 及以上普遍支持 128K。

说明

发布时间和上下文长度来自公开资料整理,不同平台、套餐或测试接口可能不同,请以各厂商官方文档为准。
上面表格数据按 发布时间 降序排列。

0 条用户评论

0 / 300