你该用哪个 AI 模型?

选你真正要做的事。你会得到一个推荐,以及更有用的东西——推荐背后的理由,这样在你自己更有把握时,可以不采纳它。这些判断来自每天把 GPT-5、Gemini、Grok 4、Claude、DeepSeek 和 Kimi 并排使用的实际体验。

1. 你要做什么?

2. 你最看重什么?(可选)

长话短说

所有模型都不擅长的事

你没核对过的引用、埋在行文里的算术,以及冷门的 API 细节。在这些情况下,六个模型都会给出自信而错误的东西。换模型解决不了这个问题——核对的习惯才行。

为什么按任务选优于从一而终

挑定一个模型从此不换,代价比偶尔选错更大。最强的工作流是把它们串起来:用活泼的那个起草,用严谨的那个重整结构,再让第三个来复核。这只有在切换成本很低时才成立——这正是多模型应用胜过四份订阅的理由。

每项任务的完整理由,见 速查表,其中最常被拿来比较的两个模型,更详细的分析见 Grok 4 对比 GPT-5.

这里的判断是定性的,截至 2026 年 8 月有效——模型能力变化很快,我们自己的使用经验一变,就会更新这里。 全部免费工具