选好模型,省心又省钱
在茫茫模海中找到那颗你专属的模星。
- 139 个模型有实测数据
- 用户真实体验
- AI 智能推荐
① 场景:
② 追问:
③ 预算:
附加条件:
该场景下没有带第三方评测数据的模型,已改用「全部」排序。
推荐排序:场景分数 → 用户口碑(真实好评)→ 价格;仅列出有第三方评测数据的模型
| 模型 | 场景 | 编程 | 智能体 | 推理 | 通用 | 输入 | 输出 | 上下文 | 对比 |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 4 Argon 谷歌 | 编程通用对话 | 1678 | — | — | 1525 | $2/M | $10/M | 未公布 | |
| Claude Opus 5.5 Anthropic | 编程通用对话 | 1814 | 74.3% | 90.2% | 1507 | $4/M | $20/M | 1M | |
| Claude Opus 4.6 Anthropic 👍 写作聊天最佳 · 疑难 bug 克星 · 编码成熟够用 | 通用对话看图 / 文档理解 | 1546 | — | — | 1504 | $5/M | $25/M | 1M | |
| Claude Fable 5.1 Anthropic 👍 多代理编排 · 工具/MCP 协调 · 自适应推理 | 编程通用对话 | 1745 | 79.2% | 89.9% | 1501 | $10/M | $50/M | 1M | |
| Claude Opus 4.7 Anthropic 👍 出货提速明显 · 遵循既有代码风格 · 思考模式排名靠前 | 通用对话看图 / 文档理解 | 1558 | — | — | 1501 | $5/M | $25/M | 1M | |
| Gemini 3.8 Flash 谷歌 👍 速度最快 · 价格最低 · 快速迭代顺手 | 通用对话看图 / 文档理解 | 1583 | 71.3% | 95.6% | 1497 | $0.75/M | $3.75/M | 1M | |
| Muse Spark 1.3 Meta 👍 DeepSWE 75.4% · 编排能力强 · 与 1.1 同价 | 编程通用对话 | 1656 | — | — | 1494 | $1.25/M | $4.25/M | 1M | |
| Muse Spark 1.2 Meta | 通用对话看图 / 文档理解 | 1532 | — | — | 1492 | $1.25/M | $4.25/M | 1M | |
| Muse Spark 1.1 Meta 👍 工具调用编排 · 准确率高 · 比 Grok 便宜 | 通用对话 | 1542 | — | — | 1491 | — | — | 1M | |
| Claude Opus 5 Anthropic 👍 写作质量最佳 · 长程 Agent 首选 · 编码基准顶尖 | 编程通用对话 | 1692 | 78.6% | 87.5% | 1490 | $5/M | $25/M | 未公布 | |
| Muse Spark Meta | 通用对话看图 / 文档理解 | — | — | — | 1489 | — | — | 262K | |
| Kimi K3 月之暗面 👍 性价比极高 · 单发最可靠 · 前端能力强 | 编程通用对话 | 1655 | 71.9% | 91.9% | 1488 | $3/M | $15/M | 1M | |
| Gemini 3.1 Pro 谷歌 👍 工程能力强 · 架构问题求解 | 通用对话 | 1447 | — | — | 1487 | $2/M | $12/M | 1M | |
| Gemini 3.7 Flash 谷歌 👍 速度快效率高 · GPQA 93.9% · 价格回到合理档 | 通用对话看图 / 文档理解 | 1592 | 78.5% | 93.9% | 1486 | $0.75/M | $3.75/M | 1M | |
| Gemini 3 Pro 谷歌 👍 推理分数顶尖 · Antigravity 搭档 · 企业场景全面 | 通用对话看图 / 文档理解 | 1440 | — | — | 1485 | $2/M | $12/M | 2M | |
| GPT-5.6 Sol OpenAI 👍 编码代理指数高 · 数学推理顶尖 · 输出 token 效率高 | 通用对话看图 / 文档理解 | — | 74.7% | 92.1% | 1485 | $4/M | $20/M | 1.05M | |
| GPT-6.1 Sol OpenAI | 编程通用对话 | 1757 | 70.0% | 94.4% | 1484 | $2/M | $10/M | 1.05M | |
| Gemini 3.6 Flash 谷歌 👍 小项目出活快 · 多模态集成顺 | 通用对话看图 / 文档理解 | 1538 | 74.7% | 92.7% | 1482 | $0.75/M | $3.75/M | 1M | |
| GPT-5.5 OpenAI 👍 行为稳定可预期 · 先澄清省 token · 老用户首选主力 | 通用对话看图 / 文档理解 | — | 75.1% | 93.7% | 1482 | $5/M | $30/M | 1M | |
| Claude Opus 4.8 Anthropic 👍 写作风格讨喜 · 图像理解更强 · 硬件电路也能打 | 通用对话看图 / 文档理解 | 1556 | — | — | 1481 | $5/M | $25/M | 1M | |
| MiMo-V2.6-Pro 小米 | 编程通用对话 | 1630 | 71.7% | 88.6% | 1480 | $0.435/M | $0.87/M | 1M | |
| GLM-5.3 智谱 AI 👍 生产可用口碑 · 自部署友好 · 研究开放 | 编程通用对话 | 1622 | 76.1% | 85.4% | 1478 | 免费 | 免费 | 1M | |
| Gemini 3.5 Flash 谷歌 👍 视觉基准屠榜 · 便宜易扩量 · 生产验证能赚钱 | 通用对话看图 / 文档理解 | 1509 | 73.1% | 92.6% | 1478 | $1.5/M | $9/M | 1M | |
| Claude Sonnet 5.5 Anthropic | 编程通用对话 | 1773 | 74.7% | 92.1% | 1476 | $2/M | $10/M | 1M | |
| DeepSeek V4.1 Flash 深度求索 👍 速度冠军 · 极致便宜 · 善抓 edge case | 编程通用对话 | 1619 | 76.2% | 88.9% | 1475 | $0.3/M | $1.2/M | 1M | |
| GPT-6 Astra OpenAI 👍 规划评审最强 · Manager Loop 多代理 · 3D/数据分析跃迁 | 编程通用对话 | 1788 | 68.0% | 94.4% | 1475 | $10/M | $50/M | 1.05M | |
| GLM-5.2 智谱 AI 👍 教学质量第一 · 不幻觉 · 曾被选作默认模型 | 编程通用对话 | 1603 | 72.7% | 85.2% | 1475 | $1.4/M | $4.4/M | 1M | |
| GLM-5.3-Flash 智谱 AI 👍 强于 DS4.1F 且半价 · 租用成本极低 · 工作主力口碑 | 编程通用对话 | 1610 | 75.6% | 90.9% | 1475 | 免费 | 免费 | 1M | |
| GPT-5.4 OpenAI | 通用对话看图 / 文档理解 | 1399 | 75.3% | 90.3% | 1475 | $2.5/M | $15/M | 1.05M | |
| Qwen3.7 Max 阿里通义 👍 综合分数在线 · 数学证明可用 · 托管稳定 | 通用对话数学 / 数据分析 | 1515 | 72.0% | 90.9% | 1475 | — | — | 1M | |
| Gemini 3 Flash 谷歌 👍 便宜到离谱 · 量大管饱 · 预览期口碑封神 | 1439 | — | — | 1473 | $0.5/M | $3/M | 1M | ||
| Claude Sonnet 4.6 Anthropic 👍 写作自然 · 批改评审可靠 · 性价比均衡 | 长文档处理 | 1522 | — | — | 1472 | $3/M | $15/M | 200K | |
| Grok 4.20 xAI | 1375 | — | — | 1472 | $1.25/M | $2.5/M | 2M | ||
| Claude Opus 4.5 Anthropic | 1469 | — | — | 1470 | $5/M | $25/M | 200K | ||
| Grok 4.20 Multi-agent xAI | — | — | — | 1470 | — | — | 2M | ||
| MiMo-V2.5-Pro 小米 | 1478 | 73.6% | 82.0% | 1468 | — | — | 1M | ||
| GPT-5.6 Terra OpenAI 👍 子代理打工首选 · 单任务成本低 · 修 bug 二遍手靠谱 | 长文档处理 | — | 73.1% | 88.8% | 1466 | $2/M | $12/M | 1.05M | |
| Grok 4.5 xAI | 1553 | — | — | 1466 | $2/M | $6/M | 500K | ||
| Grok 4.1 xAI | 1214 | — | — | 1465 | — | — | 1M | ||
| GLM-5.1 智谱 AI 👍 曾是日常主力 · 隐身测试口碑好 | Agent 自动化 | 1508 | 75.4% | 80.9% | 1464 | $1.4/M | $4.4/M | 203K | |
| Claude Sonnet 5 Anthropic 👍 日常编码主力 · 省 token · 遵循项目规范 | Agent 自动化 | 1541 | 75.3% | 83.5% | 1461 | $2/M | $10/M | 1M | |
| DeepSeek V4 Pro 0813 深度求索 👍 大上下文代码强 · 价格仅 K3 1/10 · 384K 最大输出 | 数学 / 数据分析Agent 自动化 | 1446 | 77.0% | 89.8% | 1458 | $1.32/M | $3.96/M | 1M | |
| GLM-5 智谱 AI 👍 平替 Claude 无误拒 · Bedrock 可托管 | Agent 自动化 | 1434 | 77.0% | 75.4% | 1458 | $1/M | $3.2/M | 200K | |
| GPT-5.1 OpenAI | Agent 自动化 | 1395 | 77.1% | 86.4% | 1456 | $1.25/M | $10/M | 200K | |
| GPT-6 Sol OpenAI | 编程数学 / 数据分析 | 1687 | 69.3% | 91.9% | 1456 | $2/M | $10/M | 1.05M | |
| Qwen3.7 Plus 阿里通义 👍 视觉任务专用位 · 不硬编答案 · 代理编排友好 | — | 70.3% | 87.9% | 1456 | — | — | 1M | ||
| Claude Sonnet 4.5 Anthropic | 1385 | — | — | 1455 | $3/M | $15/M | 200K | ||
| Gemini 3.5 Flash-Lite 谷歌 👍 轻量成本优化档 · 部署友好 | Agent 自动化 | 1440 | 76.9% | 84.1% | 1455 | $0.3/M | $2.5/M | 1M | |
| Grok 4.6 xAI 👍 X 原生集成 · 实时数据 · 2M 上下文 | 编程数学 / 数据分析 | 1617 | 75.3% | 92.9% | 1454 | $2/M | $6/M | 500K | |
| Hy3 腾讯 | 1508 | — | — | 1454 | 免费 | 免费 | 256K | ||
| Gemma 4 31B 谷歌 | 1365 | — | — | 1452 | 免费 | 免费 | 256K | ||
| GPT-5.6 Luna OpenAI 👍 便宜又能打 · 回复简洁 · 轻量任务甜点位 | — | 70.0% | 87.9% | 1452 | $0.2/M | $1.2/M | 1.05M | ||
| MiMo-V2.6-Flash 小米 | 编程Agent 自动化 | 1636 | 79.3% | 74.8% | 1451 | $0.14/M | $0.28/M | 1M | |
| Kimi K2.5 月之暗面 👍 曾是日常主力 · 开放权重生态成熟 | 1436 | 71.4% | 83.5% | 1450 | $0.6/M | $3/M | 256K | ||
| MiMo-V2-Pro 小米 | 1433 | — | — | 1448 | — | — | 1M | ||
| GPT-5.4 mini OpenAI | 1397 | 63.8% | 83.5% | 1447 | $0.75/M | $4.5/M | 400K | ||
| Step 5 Preview 阶跃星辰 | 1564 | — | — | 1447 | $1/M | $2.7/M | 1M | ||
| Gemini 2.5 Pro 谷歌 | 1228 | 59.3% | 81.3% | 1445 | $1.25/M | $10/M | 1M | ||
| GPT-6 Luna OpenAI | 1582 | 67.3% | 87.4% | 1443 | $0.1/M | $0.5/M | 1.05M | ||
| Grok 4.7 xAI | 编程 | 1638 | — | — | 1443 | $2/M | $6/M | 500K | |
| Qwen3.6 Plus 阿里通义 👍 视觉可用 · 价格友好 | 1461 | — | — | 1443 | — | — | 1M | ||
| Grok 4.3 xAI | 1357 | — | — | 1442 | $1.25/M | $2.5/M | 1M | ||
| GLM-4.7 智谱 AI 👍 开源权重可自托管 · 安全研究引用常客 | 1435 | 72.1% | 81.6% | 1441 | 免费 | 免费 | 200K | ||
| MiniMax M3 MiniMax | 数学 / 数据分析 | 1482 | 74.1% | 90.4% | 1440 | $0.3/M | $1.2/M | 最高 1M | |
| Gemma 4 26B A4B 谷歌 | 1359 | — | — | 1438 | 免费 | 免费 | 256K | ||
| Qwen3.8-27B 阿里通义 👍 单卡可跑 · 编码调试可用 · 2 天下载破百万 | 编程Agent 自动化 | 1592 | 77.0% | 82.3% | 1438 | 免费 | 免费 | 262K | |
| GPT-5.2 OpenAI | 1416 | 73.3% | 87.9% | 1437 | $1.75/M | $14/M | 400K | ||
| DeepSeek V4 Flash 0731 深度求索 👍 第三方托管极便宜 · 缓存命中率 95%+ · 日常主力口碑 | 1581 | 74.4% | 86.3% | 1436 | $0.14/M | $0.28/M | 1M | ||
| MiMo-V2.5 小米 | 1438 | 71.0% | 76.1% | 1434 | — | — | 1M | ||
| Qwen3 Max 阿里通义 | — | — | — | 1434 | — | — | 1M | ||
| Gemini 3.1 Flash-Lite 谷歌 | 1256 | 72.0% | 81.6% | 1433 | $0.25/M | $1.5/M | 1M | ||
| GLM-5V-Turbo 智谱 AI | 1401 | — | — | 1433 | $1.2/M | $4/M | 200K | ||
| o3 OpenAI | — | — | — | 1432 | $2/M | $8/M | 200K | ||
| MiMo-V2-Omni 小米 | — | — | — | 1431 | — | — | 262K | ||
| Grok 4.1 Fast xAI | 1242 | — | — | 1430 | $0.2/M | $0.5/M | 1M | ||
| Mistral Large 4 Mistral AI | 1534 | — | — | 1429 | $0.68/M | $2.09/M | 1M | ||
| DeepSeek V3.2 深度求索 👍 Bedrock 官方托管 · 685B 开源权重 · 企业生态成熟 | 1362 | 74.0% | 80.6% | 1425 | $0.28/M | $0.42/M | 128K | ||
| GLM-4.6 智谱 AI | 1340 | 72.1% | 75.5% | 1424 | — | — | 200K | ||
| DeepSeek-R1 深度求索 👍 推理老牌标杆 · 开源可自部署 | — | 51.2% | 77.4% | 1421 | $0.55/M | $2.19/M | 128K | ||
| Kimi K2 月之暗面 👍 文风成熟稳重 · 回复不啰嗦 | — | 59.1% | 74.5% | 1418 | $0.6/M | $2.5/M | 128K | ||
| DeepSeek V3.1 深度求索 👍 本地部署生态好 · 学术研究常客 · GGUF 支持完善 | — | — | — | 1417 | 免费 | 免费 | 128K | ||
| Qwen3.5-122B-A10B 阿里通义 | Agent 自动化 | 1360 | 76.1% | 83.3% | 1416 | 免费 | 免费 | 262K | |
| GPT-4.1 OpenAI | — | 47.8% | 64.6% | 1415 | $2/M | $8/M | 1M | ||
| MiniMax M2.7 MiniMax | 1398 | 69.8% | 84.1% | 1415 | $0.3/M | $1.2/M | 200K | ||
| Claude Haiku 4.5 Anthropic 👍 便宜快速 · 性价比标尺 · 结构化输出全支持 | 1330 | — | — | 1414 | $1/M | $5/M | 200K | ||
| Mistral Large 3 Mistral AI | 1230 | — | — | 1414 | $0.5/M | $1.5/M | 128K | ||
| GLM-4.5 智谱 AI | — | — | — | 1411 | $0.6/M | $2.2/M | 128K | ||
| Grok 4 xAI | — | — | — | 1411 | — | — | 128K | ||
| Gemini 2.5 Flash 谷歌 | — | 57.1% | 72.6% | 1409 | $0.3/M | $2.5/M | 1M | ||
| Qwen3.5-27B 阿里通义 | 1358 | — | — | 1409 | 免费 | 免费 | 262K | ||
| o1 OpenAI | — | — | — | 1402 | $15/M | $60/M | 200K | ||
| GPT-5.4 nano OpenAI | — | 65.3% | 77.7% | 1401 | $0.2/M | $1.25/M | 400K | ||
| Qwen3.5 Flash 阿里通义 | 1244 | — | — | 1396 | $0.1/M | $0.4/M | 1M | ||
| DeepSeek V3 深度求索 👍 开源里程碑 · 评测对照常客 | — | — | — | 1395 | $0.27/M | $1.1/M | 128K | ||
| Qwen3.5-35B-A3B 阿里通义 | 1254 | 65.0% | 79.8% | 1394 | 免费 | 免费 | 262K | ||
| Step 3.5 Flash 阶跃星辰 | — | — | — | 1393 | $0.1/M | $0.3/M | 256K | ||
| MiniMax M2.5 MiniMax | 1387 | 65.7% | 82.9% | 1391 | $0.3/M | $1.2/M | 128K | ||
| GPT-5 mini OpenAI | — | 70.0% | 80.8% | 1390 | $0.25/M | $2/M | 128K | ||
| MiMo-V2-Flash 小米 | 1293 | — | — | 1386 | 免费 | 免费 | 256K | ||
| GPT-4.1 mini OpenAI | — | 43.8% | 64.9% | 1383 | $0.4/M | $1.6/M | 1M | ||
| Claude 3.5 Sonnet Anthropic | — | — | — | 1374 | $3/M | $15/M | 200K | ||
| GLM-4.5-Air 智谱 AI | — | 70.0% | 63.2% | 1373 | $0.2/M | $1.1/M | 128K | ||
| GLM-4.7-Flash 智谱 AI | — | 68.0% | 53.6% | 1365 | 免费 | 免费 | 200K | ||
| Grok 3 Mini xAI | — | — | — | 1364 | $0.3/M | $0.5/M | 128K | ||
| o3-mini OpenAI | — | — | — | 1364 | $1.1/M | $4.4/M | 200K | ||
| GPT-OSS 120B OpenAI | — | 63.4% | 72.6% | 1352 | 免费 | 免费 | 128K | ||
| GPT-4o OpenAI | — | 43.8% | 52.0% | 1346 | $2.5/M | $10/M | 128K | ||
| Mercury 2 Inception | 1171 | — | — | 1344 | $0.25/M | $0.75/M | 128K | ||
| Granite 4.2 30B IBM | — | — | — | 1340 | 免费 | 免费 | 128K | ||
| GPT-5 nano OpenAI | — | 46.6% | 70.5% | 1337 | $0.05/M | $0.4/M | 400K | ||
| GPT-4 Turbo OpenAI | — | — | — | 1324 | $10/M | $30/M | 128K | ||
| Claude 3 Opus Anthropic | — | — | — | 1322 | $15/M | $75/M | 200K | ||
| GPT-4.1 nano OpenAI | — | 10.9% | 50.0% | 1322 | $0.1/M | $0.4/M | 1M | ||
| GPT-4o mini OpenAI | — | 28.4% | 43.2% | 1318 | $0.15/M | $0.6/M | 128K | ||
| GPT-OSS 20B OpenAI | — | 53.4% | 64.0% | 1317 | 免费 | 免费 | 128K | ||
| Granite 4.2 3B IBM | — | — | — | 1290 | 免费 | 免费 | 128K | ||
| Granite 4.2 8B IBM | — | 58.3% | 65.7% | 1290 | 免费 | 免费 | 128K | ||
| Qwen2.5 Coder 32B Instruct 阿里通义 | — | — | — | 1271 | 免费 | 免费 | 128K | ||
| Claude 3 Haiku Anthropic | — | — | — | 1262 | $0.25/M | $1.25/M | 200K | ||
| Phi-4 微软 | — | — | — | 1256 | 免费 | 免费 | 16K | ||
| Mixtral 8x22B Instruct v0.1 Mistral AI | — | — | — | 1230 | 免费 | 免费 | 64K | ||
| Qwen3.8 Max 阿里通义 👍 托管多模态最佳 · 约束推理强 · SWE-bench 80.4% | 编程 | 1672 | — | — | — | — | — | 1M | |
| Claude 4 Sonnet Anthropic | — | 68.0% | 76.7% | — | $3/M | $15/M | 200K | ||
| GPT-5.1-Codex OpenAI | 1337 | — | — | — | $1.25/M | $10/M | 400K | ||
| GPT-5.2-Codex OpenAI 👍 大型迁移能手 · 总成本极低 · 不盲目附和 | 1339 | — | — | — | $1.75/M | $14/M | 400K | ||
| GPT-5.3 Codex OpenAI 👍 视觉+编码顺手 · 曾是编码巅峰 · 响应速度快 | Agent 自动化 | — | 75.3% | — | — | $1.75/M | $14/M | 400K | |
| Grok Code Fast 1 xAI | 1168 | — | — | — | $0.2/M | $1.5/M | 256K | ||
| Hy-MT2-30B-A3B 腾讯 | — | — | 38.9% | — | 免费 | 免费 | 8K | ||
| Hy4 preview 腾讯 👍 递归自改进噱头足 · QAT 量化激进 · 已上 OpenCode Go | — | 70.7% | 89.1% | — | 免费 | 免费 | 1M | ||
| Kimi K2.7 Code 月之暗面 👍 Copilot 官方集成 · 编码专精 · 推理链更短 | 1473 | 72.6% | 80.0% | — | $0.95/M | $4/M | 256K | ||
| Ling 3.0 Flash 蚂蚁集团 InclusionAI | — | 68.7% | 74.9% | — | — | — | 262K | ||
| Ling 3.0 Flash Fin 蚂蚁集团 InclusionAI | — | 70.8% | 50.5% | — | — | — | 262K | ||
| Ling 3.0 Flash VL 蚂蚁集团 InclusionAI | — | 70.0% | 84.9% | — | 免费 | 免费 | 262K | ||
| Muse Glimmer 30B Meta | — | 74.7% | 80.6% | — | 免费 | 免费 | 131K | ||
| Qwen3.6-27B 阿里通义 👍 单卡可跑 · ≈Haiku 4.5 水平 · 本地性价比高 | — | 74.3% | 81.0% | — | 免费 | 免费 | 262K | ||
| Qwen3.6-35B-A3B 阿里通义 | — | 71.1% | 79.5% | — | — | — | 262K | ||
| Qwen3.8-Flash-Next 阿里通义 👍 自托管稳定可控 · 本地社区热度高 · 摆脱订阅省钱 | 编程 | 1632 | — | — | — | 免费 | 免费 | 262K | |
| Seed 2.1 Pro 字节跳动 | 1519 | — | — | — | — | — | 256K | ||
| Step 3.7 Flash 阶跃星辰 | Agent 自动化 | — | 77.3% | 76.6% | — | $0.2/M | $1.15/M | 256K |
评分来自第三方公开评测,非厂商官方数据,仅作横向参考: Arena(LMArena)盲测 Elo,CC BY 4.0;OpenRouter 实测准确率。 Arena Elo 取同一模型最高推理档位的那次记录,票数与名次见鼠标悬停。榜单快照 2026-10-10。 纯开源权重、无第三方评测的模型不在本页,在 模型库。