獨立遊戲開發,評價我用的幾個AI模型

高強度開發單人獨立遊戲一年了。策劃,美術,音樂,代碼,一人全包。常規主流AI基本全都在高強度付費使用。本篇文章分享並評價一下我用過的幾個AI大模型。

ChatGpt

在不討論細分使用場景的情況下,綜合使用體驗最強,性價比很高。不亂封號,但亂重置額度,很香。

日常工作的絕對主力,夯中夯。

問題是太過於囉嗦,如果不加任何限制詞,隨便一個小問題,就能回覆幾千行。

永遠在處理千萬分之一概率的、沒人在意的邊際問題。

而且我的感覺是,GPT不像是AI,更像是一個超級計算機。

你輸入文本,他根據你提供的文本,計算並返回一個結果。

不會理解你在做什麼,不會思考場景,極少拓展思考。

如果缺信息,不會提問,就默默地硬猜,然後根據猜測的信息返回結果。

你補充信息後,他再回復:"對不起,上面是我理解錯了,那麼上面的內容要推翻。"

總之,極其考驗提示詞編輯能力和提問技巧,回覆囉嗦,用起來經常砸鍵盤。

實際工作中,ChatGpt最合適的還是:**程序員、數值設計、日誌分析**,這種純理科生任務。第二個,Claude。

Claude

Claude完全是另一回事,會給人一種"真AI"的感覺。

會極其積極的主動提問,會思考場景,會理解需求,會舉一反三。

更像一個真人在思考問題,而不是算一個結果。

而且Claude的審美能力,也能夠甩GPT幾條街。

遊戲開發中,Claude給的 字體、配色、邊框、圓角 等樣式參數,基本可以直接使用。

實際工作中,Claude基本是全才,可以承擔策劃助理、美術、UI、創意拓展。

簡單提一嘴Fable5。剛出的時候,和解禁後的第一週,神中神,能給人一種AI可以統治人類的感覺。

後面就降智嚴重,只能跟opus坐一桌。

這兩個就是我日常遊戲設計中使用的絕對主力。簡單總結下來就是:

ChatGpt像是一個完全偏科的理科生,純計算機,不帶感情,不帶腦子(人腦),只有算力。

但性價比高,對中文區友好,因此仍然可以承擔絕對主力。

Claude則是全科學霸,交流起來更像一個真人助理。

使用過程中只有感嘆,沒有砸鍵盤的衝動。

但性價比低,對中文區極其不友好,A畜名聲在外,不多贅述。

Vibe Coding

前面討論的是,AI作爲一個"人"、作爲一個"工作助理"等方面的綜合能力。

關於純代碼能力、vibe code方面,說實話對於AI來說都太簡單了,沒有十分大的差距。

代碼能力只簡單總結一下。

opus,很強,但是強得沒有太大意義,99%的場景沒意義。不是說大部分人用不上,而是一個程序項目,即使是如微信、支付寶這種軟件,它的代碼中,99%都是常規代碼,CRUD、UI佈局等。

真正稱得上"有難度""很高深"的代碼,其實只有最核心的幾個模塊。

ChatGpt,日常編程的絕對主力,性價比和代碼能力屬於AI編程的標杆。

GLM、DeepSeek、Kimi都很強,與前面兩個沒有十分大的差距。

極其複雜的問題,最多就是多改兩輪。考慮到價格,其實真的很夯。

唯一的問題是,處理任務的速度都很慢。但這屬於客觀因素,可以理解。

如果不追求效率,國產AI真的是不錯的選擇。

這點可以提一嘴Cursor的Composer,處理任務的速度極快。

處理代碼任務的速度,無人可挑戰的第一。

代碼質量水平,與GLM 5.2、DeepSeek v4 pro差不多。

處理同一個代碼任務,Composer已經改完了三輪代碼,DeepSeek還在思考中,GLM纔剛剛思考完畢。

其他

再簡單評價兩個AI。

Gemini,大號豆包的稱呼還是準確的,精準的,客觀的。

胡言亂語,情緒價值拉滿,哄人小能手。

跟ChatGpt對話是:無論如何,你多少有點兒錯。

跟Gemini對話是:無論如何,你永遠是對的。

早期靠着谷歌,當一個大號搜索引擎還能用。

現在這個生態位,可以完全被Grok替代。

Grok,現在"查互聯網資料"最好用的AI。

響應速度快,信息面廣,免費版已經十分可用。

但是與豆包問題類似。豆包是依賴抖音,容易基於一堆垃圾營銷號給你回覆;

Grok背靠“X”,也容易給垃圾信息。

簡單來說,無論是Gemini還是Grok,

對我而言,都是替代搜索引擎使用,查出的資料仍然需要自己甄別。

(Grok付費版,可能可以承擔不錯的工作任務,但是沒有從GPT或Claude跳過去用Grok的動力。)

更多遊戲資訊請關註:電玩幫遊戲資訊專區

電玩幫圖文攻略 www.vgover.com