模型能力矩阵
数据来源:
GET https://anideaai.com/api/pricing(2026-03-07 快照)说明:下表按“模型标签 + 接口类型 + 兼容协议”整理,最终能力请以
https://anideaai.com/playground实测为准。
能力说明(通俗版)
- 工具调用:模型能按固定格式返回“要调用哪个函数、传什么参数”
- 视觉理解:模型能读图或做图像相关请求
- 流式输出:模型边生成边返回,前端可以逐字显示
- 结构化返回:模型可稳定输出固定字段的 JSON,方便程序解析
主力模型对比
| 模型 | 供应商 | 工具调用 | 视觉理解 | 流式输出 | 结构化返回 | 推荐场景 |
|---|---|---|---|---|---|---|
gpt-4o-mini | OpenAI | 是 | 是 | 是 | 是 | 在线客服、通用问答、轻量多模态 |
o3-mini | OpenAI | 是 | 否 | 是 | 是 | 复杂推理、代码修复、慢思考任务 |
gpt-4.1-mini | OpenAI | 是 | 是 | 是 | 是 | 中高并发业务、结构化抽取 |
claude-sonnet-4-5-20250929 | Anthropic | 是 | 是 | 是 | 是 | 长文档分析、企业知识库问答 |
claude-opus-4-6 | Anthropic | 是 | 是 | 是 | 是 | 高质量写作、复杂工具链编排 |
gemini-3.1-pro-preview | 是 | 是 | 是 | 是 | 多模态助理、图文理解与生成 | |
deepseek-v3 | DeepSeek | 是 | 否 | 是 | 部分 | 成本敏感型通用对话 |
deepseek-r1 | DeepSeek | 部分 | 否 | 是 | 部分 | 推理题、数学题、思维链任务 |
qwen3-235b-a22b | 阿里巴巴 | 是 | 部分 | 是 | 部分 | 中文任务、知识问答 |
kimi-k2-thinking | Moonshot | 是 | 部分 | 是 | 部分 | 长上下文分析、中文场景推理 |
grok-4-0709 | xAI | 是 | 部分 | 是 | 部分 | 实时问答、通用聊天 |
glm-4v | 智谱 | 是 | 是 | 是 | 部分 | 图文分析、视觉问答 |
doubao-pro-128k | 字节跳动 | 是 | 部分 | 是 | 部分 | 中文摘要、企业内部助手 |
hunyuan-standard | 腾讯 | 是 | 部分 | 是 | 部分 | 通用文本处理、中文对话 |
gpt-image-1 | OpenAI | 否 | 是 | 否 | 否 | 文生图、设计草图 |
dall-e-3 | OpenAI | 否 | 是 | 否 | 否 | 海报、封面、创意图 |
mj_turbo_video | Midjourney | 否 | 是 | 否 | 否 | 快速视频生成 |
sora-2 | OpenAI | 否 | 是 | 否 | 否 | 高质量视频生成 |
suno_music | Suno | 否 | 否 | 否 | 否 | 音乐生成、短音频创作 |
选型建议(先快后稳)
- 先按任务类型选:文本问答用文本模型,做图用图像模型,做视频用视频模型。
- 再按预算选:同类型里先看
model-list.md的输入/输出单价或按次价格。 - 上线前做两轮压测:一轮测质量,一轮测稳定性与响应速度。