选型工具 · 26 个模型与工具

按需求筛选,
不看跑分看约束

数据来自站内 22 章模型专题 + 4 章工具专题(2026-10 联网核实)。每张卡的「适合」都是那一章的结论——点卡片底部直达原文。

26 个结果
美国 06

Claude Opus 5.5

综合第一 · 编程与推理的天花板

上下文
1M
最大输出
128K
输入价
$4/M
输出价
$20/M
闭源
文/图/PDF
适合
  • 最复杂编程
  • 深度推理
  • 专业工作全流程
读这一章 →
美国 05

GPT-6 Astra

桌面自动化 Agent 唯一解

上下文
1.05M
最大输出
128K
输入价
$10/M
输出价
$30/M
闭源
文/图/PDF
适合
  • 操作真实桌面/浏览器
  • 需要极强能力且预算无上限
读这一章 →
美国 09

Claude Sonnet 5.5

绝大多数生产场景的默认档

上下文
1M
最大输出
128K
输入价
$2/M
输出价
$10/M
闭源
文/图/PDF
适合
  • 日常编程(编程分全球第一)
  • 生产默认档
  • 结构化输出
读这一章 →
美国 26

Muse Spark 1.3

前 10 能力 + 前 2 价格的黑马

上下文
1M
最大输出
—
输入价
$0.695/M
输出价
$2.085/M
闭源
文本
适合
  • 预算紧但要能力
  • 批量枚举多方案
读这一章 →
美国 07

Gemini 3.1 Pro

全模态性价比标杆

上下文
1.05M
最大输出
65K
输入价
$2/M
输出价
$4/M
闭源
全模态(文/图/音/视频/PDF)
适合
  • 输入含视频或音频
  • 大批量低成本多模态
读这一章 →
美国 08

Grok 4.7

X 实时数据流 · 语感最野

上下文
500K
最大输出
未标
输入价
$2/M
输出价
$6/M
闭源
文/图
适合
  • 实时热点与舆情
  • X 平台内容分析
读这一章 →
中国 10

DeepSeek V4-Pro

性价比王者 · 唯一 384K 输出

上下文
1M
最大输出
384K
输入价
$0.435/M
输出价
$0.87/M
MIT
纯文本
适合
  • 超长输出(长文/代码)
  • MIT 商用微调
  • 私有化部署
读这一章 →
中国 10

DeepSeek V4-Flash

开源最低档 · 量大首选

上下文
1M
最大输出
384K
输入价
$0.15/M
输出价
$0.6/M
MIT
纯文本
适合
  • 大规模低成本批处理(纯文本)
  • MIT + 长输出
读这一章 →
中国 11

Qwen3.8 Max

国产原生视频 + 企业生态

上下文
1M
最大输出
—
输入价
$2/M
输出价
$6/M
Max 闭源/Flash 开源
文/图/视频(原生)
适合
  • 视频理解
  • 图文混排
  • 企业级接入
读这一章 →
中国 12

GLM-5.3

长程编程 Agent 首选

上下文
1.05M
最大输出
—
输入价
$1.09/M
输出价
$3.43/M
旗舰闭源/Flash MIT
Flash 多模态
适合
  • 长时间运行的编码 Agent
  • 终端类工具
读这一章 →
中国 12

GLM-5.3-Flash

开源+多模态+亚美元 四项全中

上下文
1M
最大输出
—
输入价
$0.071/M
输出价
$0.238/M
MIT
多模态
适合
  • 极低成本多模态批处理
  • MIT 可商用
读这一章 →
中国 13

Kimi K3

2M 最长上下文 · 2.8T 最大参数

上下文
2M
最大输出
—
输入价
$3/M
输出价
$15/M
MIT
多模态
适合
  • 一次读完整套剧本/大型代码库
  • 中文长文创作
读这一章 →
中国 14

MiniMax M3

语音强项 · 编程打平 V4-Pro

上下文
1M
最大输出
131K
输入价
$0.3/M
输出价
$1.2/M
开放权重
文/音/视频
适合
  • 配音/音频/创意内容
  • 低成本编程辅助
  • 批量候选生成
读这一章 →
中国 15

豆包 Seed 2.1 Pro

国产均衡旗舰 · GUI 操作最强

上下文
262K
最大输出
32K
输入价
$0.88/M
输出价
$4.45/M
闭源
文/视觉
适合
  • 界面自动化(OSWorld 78.8%)
  • 视觉判断
  • 均衡生产
读这一章 →
中国 17

混元 Hy3

全表最低价且能编程(SWE 78%)

上下文
262K
最大输出
—
输入价
$0.13/M
输出价
$0.53/M
闭源
文本
适合
  • 成本敏感 + 需编程
  • 高频对话(有缓存)
读这一章 →
中国 16

文心 ERNIE 5.1

百度中文搜索数据底子

上下文
未公开
最大输出
—
输入价
—/M
输出价
—/M
闭源
文本
适合
  • 已在百度云生态
  • 中文检索深度整合
读这一章 →
法国 18

Mistral Large 3

欧洲主权 AI 唯一解

上下文
262K
最大输出
—
输入价
$0.5/M
输出价
$1.5/M
Apache 2.0
文/图
适合
  • 数据不能出欧盟
  • Apache 商用许可
  • 本地/VPC 部署
读这一章 →
中国 19

RWKV-7

恒定推理成本 · 唯一非 Transformer

上下文
架构可扩展
最大输出
—
输入价
—/M
输出价
—/M
开源
文本
适合
  • 超长上下文且成本敏感
  • 端侧部署
读这一章 →
工具 20

GitHub Copilot

最主流 AI 编程助手

上下文
—
最大输出
—
输入价
—/M
输出价
—/M
部分开源
代码补全
适合
  • 日常写代码
  • 代码库在别的平台
读这一章 →
工具 21

GitLab Duo

CI/安全/合规全流程 · 可免费自托管

上下文
—
最大输出
—
输入价
—/M
输出价
—/M
部分开源
DevSecOps
适合
  • 代码绝不能上第三方云
  • DevSecOps 是核心痛点
读这一章 →
工具 22

Gitee AI

代码不出境

上下文
—
最大输出
—
输入价
—/M
输出价
—/M
闭源
代码补全(国产)
适合
  • 政企国产化替代
读这一章 →
工具 23

Perplexity

答案带引用,可验证

上下文
—
最大输出
—
输入价
—/M
输出价
—/M
闭源
搜索+引用
适合
  • 研究报告
  • 事实核查
读这一章 →
工具 24

OpenCode

模型中立 · 75+ 提供商

上下文
—
最大输出
—
输入价
—/M
输出价
—/M
MIT
终端 CLI
适合
  • 避免供应商锁定
  • 先审查方案再执行
读这一章 →
工具 25

ComfyUI

工作流即资产 · 可复现

上下文
—
最大输出
—
输入价
—/M
输出价
—/M
开源
生图/生视频
适合
  • 需要精确可控可复现的生图
读这一章 →
工具 26

Siri(端侧)

端侧 · 零打扰 · 边际成本近零

上下文
—
最大输出
—
输入价
免费/M
输出价
免费/M
闭源
端侧语音
适合
  • 重复性小任务
  • 断网可用
  • 隐私优先
读这一章 →
怎么用这份表:先点上方需求标签(如「超长上下文」「可商用微调」),再在筛选栏卡许可和价格 —— 这三步比看跑分表有效得多。
价格口径:输入/输出均为每百万 tokens 的官方指导价,混合价 = 输入 + 输出,不含聚合渠道折扣与峰谷价差。工具类无 token 计价,标「—」。
数据时效:2026-10 联网核实。模型迭代很快(Mistral 2026 年已多批退役),价格与规格以官方页面为准。
完整决策方法论见 第二十七章 · 22 个模型全景对照(五条决策路径 + 反向排除表)。

想要全部 464 个模型的参数(25 家厂商)?打开全量模型目录 →