独立游戏开发,评价我用的几个AI模型

高强度开发单人独立游戏一年了。策划,美术,音乐,代码,一人全包。常规主流AI基本全都在高强度付费使用。本篇文章分享并评价一下我用过的几个AI大模型。

ChatGpt

在不讨论细分使用场景的情况下,综合使用体验最强,性价比很高。不乱封号,但乱重置额度,很香。

日常工作的绝对主力,夯中夯。

问题是太过于啰嗦,如果不加任何限制词,随便一个小问题,就能回复几千行。

永远在处理千万分之一概率的、没人在意的边际问题。

而且我的感觉是,GPT不像是AI,更像是一个超级计算机。

你输入文本,他根据你提供的文本,计算并返回一个结果。

不会理解你在做什么,不会思考场景,极少拓展思考。

如果缺信息,不会提问,就默默地硬猜,然后根据猜测的信息返回结果。

你补充信息后,他再回复:"对不起,上面是我理解错了,那么上面的内容要推翻。"

总之,极其考验提示词编辑能力和提问技巧,回复啰嗦,用起来经常砸键盘。

实际工作中,ChatGpt最合适的还是:**程序员、数值设计、日志分析**,这种纯理科生任务。第二个,Claude。

Claude

Claude完全是另一回事,会给人一种"真AI"的感觉。

会极其积极的主动提问,会思考场景,会理解需求,会举一反三。

更像一个真人在思考问题,而不是算一个结果。

而且Claude的审美能力,也能够甩GPT几条街。

游戏开发中,Claude给的 字体、配色、边框、圆角 等样式参数,基本可以直接使用。

实际工作中,Claude基本是全才,可以承担策划助理、美术、UI、创意拓展。

简单提一嘴Fable5。刚出的时候,和解禁后的第一周,神中神,能给人一种AI可以统治人类的感觉。

后面就降智严重,只能跟opus坐一桌。

这两个就是我日常游戏设计中使用的绝对主力。简单总结下来就是:

ChatGpt像是一个完全偏科的理科生,纯计算机,不带感情,不带脑子(人脑),只有算力。

但性价比高,对中文区友好,因此仍然可以承担绝对主力。

Claude则是全科学霸,交流起来更像一个真人助理。

使用过程中只有感叹,没有砸键盘的冲动。

但性价比低,对中文区极其不友好,A畜名声在外,不多赘述。

Vibe Coding

前面讨论的是,AI作为一个"人"、作为一个"工作助理"等方面的综合能力。

关于纯代码能力、vibe code方面,说实话对于AI来说都太简单了,没有十分大的差距。

代码能力只简单总结一下。

opus,很强,但是强得没有太大意义,99%的场景没意义。不是说大部分人用不上,而是一个程序项目,即使是如微信、支付宝这种软件,它的代码中,99%都是常规代码,CRUD、UI布局等。

真正称得上"有难度""很高深"的代码,其实只有最核心的几个模块。

ChatGpt,日常编程的绝对主力,性价比和代码能力属于AI编程的标杆。

GLM、DeepSeek、Kimi都很强,与前面两个没有十分大的差距。

极其复杂的问题,最多就是多改两轮。考虑到价格,其实真的很夯。

唯一的问题是,处理任务的速度都很慢。但这属于客观因素,可以理解。

如果不追求效率,国产AI真的是不错的选择。

这点可以提一嘴Cursor的Composer,处理任务的速度极快。

处理代码任务的速度,无人可挑战的第一。

代码质量水平,与GLM 5.2、DeepSeek v4 pro差不多。

处理同一个代码任务,Composer已经改完了三轮代码,DeepSeek还在思考中,GLM才刚刚思考完毕。

其他

再简单评价两个AI。

Gemini,大号豆包的称呼还是准确的,精准的,客观的。

胡言乱语,情绪价值拉满,哄人小能手。

跟ChatGpt对话是:无论如何,你多少有点儿错。

跟Gemini对话是:无论如何,你永远是对的。

早期靠着谷歌,当一个大号搜索引擎还能用。

现在这个生态位,可以完全被Grok替代。

Grok,现在"查互联网资料"最好用的AI。

响应速度快,信息面广,免费版已经十分可用。

但是与豆包问题类似。豆包是依赖抖音,容易基于一堆垃圾营销号给你回复;

Grok背靠“X”,也容易给垃圾信息。

简单来说,无论是Gemini还是Grok,

对我而言,都是替代搜索引擎使用,查出的资料仍然需要自己甄别。

(Grok付费版,可能可以承担不错的工作任务,但是没有从GPT或Claude跳过去用Grok的动力。)

更多游戏资讯请关注:电玩帮游戏资讯专区

电玩帮图文攻略 www.vgover.com