不要只用一个AI:分工怎么分,思考等级怎么选

本篇文章属于合集“AI单人独立游戏开发” —— EP06

本篇属于较通用的一篇, 不做游戏、不写代码也适用,只要日常用AI当生产力, 这篇文章讲的三个东西都用得上:

1. 为什么不只用一个AI, 分工怎么分

2. 每个AI的思考等级怎么选, 是否直接 max/extra 拉满

3. 附带好处: 省额度+错峰避开排队

注意: 本篇文章仅针对, 希望节省token,不介意多花点儿精力, 不介意多个平台来回切换的人

如果你恰巧财力雄厚, 一个 Claude 20x 或 ChatGpt 20x 拉满, 一般也没有问题。

唯一需要注意的点是, 不同的AI 风格和调性其实不同, 每个AI 都有各自的侧重点, 合理使用不同的AI, 可以发挥最大的效果

以下内容,以我自己开发游戏的真实场景为例。 把“策划文档”换成“方案/文案”是一样的, 非游戏开发的工作任务可以参考

游戏开发那套完整工作流, 在这篇:独立游戏开发,AI工作流详细介绍

先简单总结: 完全无脑的 max extra 拉满其实没有必要, AI能力的核心决定点仍然是模型的基座,一个本身比较简单, 不涉及复杂逻辑的问题, 使用 high 和 medium, 几乎没有差别; 大多数时候,简单问题使用复杂思考, 反而会导致简单问题复杂化, 会过度的注意无关紧要的细节

不同模型 与 不同思考等级 对应不同的工作

  • Fable5(仅high)

只负责 从零脑暴新东西: 全新的玩法、全新的系统设计, 讨论和分析的可靠度较高。

代码任务极少使用, 基本没有什么代码任务是必须fable5才能完成

  • opus5

思考等级-high: 策划文档、玩法方案的优化,核对,校验; 换成通用场景, 就是方案、文案这类“已经很重、不能出错”的内容

思考等级-medium: 仅用来优化美术、前端布局。 审美能力属于模型基座能力, 不太吃思考等级, 排版美化这类活, medium 就够了

  • opus4.6(仅high)

翻译专用。 我游戏里所有翻译文件都是它处理, 便宜, 精准

Claude系列模型在文本上“去AI味,更接近人味”是最强的, 而机制性文本的翻译不涉及复杂逻辑, 4.6 已经极其可用, 尤其是翻译工作涉及极其大量文本,用来当 opus5 的降级平替性价比极高

  • GPT 5.6 Sol(中:高:极高 ≈ 5:3:2, 按任务数量算)

只用来写代码, 极少做创意设计。 对代码任务来说, 这个基座的能力已经极强

这个不是为了省钱,更重点的是: GPT 过度思考较严重, 简单问题给高级思考, 既费额度又费时间

错峰使用

关于模型分工,多模型使用, 还有一个优势,可以错峰使用

(这段同样是个人体感, 不一定普适, 仅作参考)

国内模型的高峰期在 北京时间的下午

国外模型的高峰期在 北京时间的 晚上10点以后

高峰期有概率遇到 排队,回复慢,严重情况下会遇到降智

而同时使用多个模型, 可以有效的分布工作周期。 国内用户在白天, 可以猛猛的用 GPT 和Claude, 基本极少遇到排队情况

而晚上, 则可以切换使用 GLM / Deepseek / Kimi, 也是基本上不用排队,部分工具夜间模型还有折扣;

低级->高级递进

部分非核心任务以及需多轮调试的任务

- 低级模型负责快速迭代, 快速定初版

- 高级模型复杂深度优化细节, 仅优化细节

比如 svg、粒子特效、着色器代码, 都是 GPT 出初版, 交给 Claude 深度优化

做任何需要来回改的东西, 初稿用便宜的模型快速出, 精修再交给贵的模型, 没必要一上来就用最贵的

更重要的是:

低级模型, 不会过多的侵占你自己的意图,不会在初期就给你很多干扰,你先把自己的思路,用低级AI整理下来,再进行微调。一上手就用高级AI,很容易导致,AI一直企图干预你的设计,从一开始就把你原本的思路带偏,这是真实踩过的坑。

国产模型与外国模型

这是一个极其玄学的感受, 不代表绝对真实。

国产模型更接近中国人的思维模式

国外模型更接近欧美人的思维模式

这个没有什么证据, 仅代表个人感受: 同一个问题, 我同时问 kimi 和 Claude, 能轻微的感觉到

Claude的回复,更接近 twitter reddit 上面的风格和习惯

kimi的回复, 更接近抖音,小红书上面的风格和习惯

因此 部分任务没有必要无脑的上Claude, 需要看你的目标人群是谁

这也是 分工 的另一层意思: 不是哪个模型贵哪个就适合你, 面向中文用户的任务, 用国产模型反而又便宜又对味

例如 截止到目前6篇文章, 文章的所有内容都是我手写的, 但是 文档最后的审核, 包括 错别字,用词习惯, 文章内容的排序, 文章结构等

我还是只在使用 kimi k3 进行审核, 而不会使用 Claude进行终审, 因为我的目标人群是小黑盒用户;

总结

不要在一个模型上 吊死

积极使用不同的模型, 这不仅仅是 “省钱” 的问题, 而是不同模型的能力重点 与 思维方式不同的问题

每个任务,多尝试一下不同的模型,感受不同模型的差异,选择你认为的最优解

至少截止目前的时间节点, 还没有任何一个AI,可以做到,全方位的,全能力绝对领先;

在一些使用场景下,使用豆包可能比使用Claude更好

下一章预告

我有一个idea, 如何将他变成游戏

是先定文档, 定设计, 定玩法, 还是直接开始。

感兴趣的可以点个关注

更多游戏资讯请关注:电玩帮游戏资讯专区

电玩帮图文攻略 www.vgover.com