🤖 AI模型对比
全面对比主流大模型,benchmark、价格、能力一目了然
GPT-4o
OpenAI
OpenAI旗舰多模态模型,文本、图像、音频全能处理,综合能力最强
Claude 4
Anthropic
Anthropic最新模型,擅长长文本理解和复杂推理,安全性突出
o3
OpenAI
OpenAI推理模型,擅长复杂逻辑、数学和代码推理,推理能力顶尖
Gemini 2.5 Pro
Google最强模型,100万token超长上下文,多模态能力顶尖
DeepSeek V3
DeepSeek
国产开源大模型,性价比极高,代码能力媲美GPT-4
Llama 3.1
Meta
Meta开源模型,405B参数规模最大,可本地部署
Qwen 2.5
Alibaba
阿里通义千问,中文理解能力强,开源可商用
Grok-3
xAI
xAI推出的多模态大模型,支持实时网络搜索,回答风格直接幽默
Groq
Groq
Groq LPU推理芯片驱动,推理速度全球最快,延迟极低
Mixtral 8x22B
Mistral AI
Mistral稀疏专家混合模型,176B参数规模,推理效率极高
Mistral Large 2
Mistral AI
欧洲最强AI模型,多语言能力优秀,推理能力强
Command R+
Cohere
Cohere企业级模型,RAG检索增强能力突出,适合商业应用
文心4.0
Baidu
百度文心大模型4.0,中文理解能力顶尖,知识增强技术突出
智谱GLM-4
Zhipu AI
智谱AI GLM-4,全自研通用大模型,代码和数学能力突出,开源可商用
Phi-4
Microsoft
Microsoft小型高效模型,14B参数媲美70B模型,推理成本极低
Kimi K2
Moonshot AI
月之暗面长文本模型,200K上下文,文档处理能力突出
讯飞星火4.0
iFlytek
科大讯飞星火认知大模型4.0,语音交互能力领先,多语种支持强
Gemma 2
Google开源模型,27B参数小体积高性能,适合端侧部署
MiniMax
MiniMax
MiniMaxabab6.5,支持超长上下文,角色扮演和创意写作能力突出
阶跃星辰
Stepfun
阶跃星辰Step-2,万亿参数大模型,多模态理解和推理能力优秀
详细对比表
| 模型 | 公司 | 参数量 | 上下文 | 多模态 | 开源 | 价格 | 基准测试 |
|---|---|---|---|---|---|---|---|
GPT GPT-4o | OpenAI | 1.8T | 128K | ✓ | ✗ | $0.005/1K tokens | MMLU88.7% HumanEval90.2% MATH76.6% |
Claude Claude 4 | Anthropic | Unknown | 200K | ✓ | ✗ | $0.003/1K tokens | MMLU86.5% HumanEval92.1% MATH74.3% |
o3 o3 | OpenAI | Unknown | 200K | ✓ | ✗ | 付费 | MMLU89.5% HumanEval93.2% MATH82.1% |
Gemini Gemini 2.5 Pro | Unknown | 1M | ✓ | ✗ | $0.0025/1K tokens | MMLU87.2% HumanEval89.5% MATH78.1% | |
DS DeepSeek V3 | DeepSeek | 671B | 64K | ✗ | ✓ | 免费/极低 | MMLU85.2% HumanEval91.8% MATH75.9% |
Llama Llama 3.1 | Meta | 405B | 128K | ✗ | ✓ | 免费 | MMLU84.1% HumanEval88.3% MATH73.2% |
Qwen Qwen 2.5 | Alibaba | 72B | 128K | ✓ | ✓ | 免费/低价 | MMLU83.5% HumanEval87.2% MATH72.8% |
Grok Grok-3 | xAI | Unknown | 128K | ✓ | ✗ | 付费 | MMLU85.8% HumanEval89.5% MATH76.3% |
Groq Groq | Groq | Various | 128K | ✗ | ✗ | $0.0005/1K tokens | MMLU82.1% HumanEval85.3% MATH70.2% |
Mixtral Mixtral 8x22B | Mistral AI | 176B (8x22B) | 64K | ✗ | ✓ | 免费 | MMLU83.8% HumanEval87.2% MATH72.5% |
Mistral Mistral Large 2 | Mistral AI | 123B | 128K | ✗ | ✗ | $0.002/1K tokens | MMLU82.8% HumanEval86.5% MATH71.4% |
R+ Command R+ | Cohere | 104B | 128K | ✗ | ✗ | $0.003/1K tokens | MMLU83.2% HumanEval86.8% MATH71.5% |
文心 文心4.0 | Baidu | Unknown | 8K | ✓ | ✗ | 免费版可用 | MMLU80.5% HumanEval84.2% MATH69.8% |
GLM 智谱GLM-4 | Zhipu AI | Unknown | 128K | ✓ | ✓ | 免费版可用 | MMLU81.2% HumanEval85.8% MATH71.5% |
Phi Phi-4 | Microsoft | 14B | 16K | ✗ | ✓ | 免费 | MMLU81.5% HumanEval86.2% MATH70.8% |
Kimi Kimi K2 | Moonshot AI | Unknown | 200K | ✓ | ✗ | 免费版可用 | MMLU81.5% HumanEval85.2% MATH70.8% |
星火 讯飞星火4.0 | iFlytek | Unknown | 8K | ✓ | ✗ | 免费版可用 | MMLU79.8% HumanEval83.5% MATH68.2% |
Gemma Gemma 2 | 27B | 8K | ✗ | ✓ | 免费 | MMLU80.2% HumanEval84.5% MATH68.5% | |
MiniMax MiniMax | MiniMax | Unknown | 200K | ✓ | ✗ | 免费版可用 | MMLU78.5% HumanEval82.3% MATH67.8% |
Step 阶跃星辰 | Stepfun | Unknown | 200K | ✓ | ✗ | 免费版可用 | MMLU77.8% HumanEval81.5% MATH66.2% |