高強度開發單人獨立遊戲一年了。策劃,美術,音樂,代碼,一人全包。常規主流AI基本全都在高強度付費使用。本篇文章分享並評價一下我用過的幾個AI大模型。
![]()
ChatGpt
在不討論細分使用場景的情況下,綜合使用體驗最強,性價比很高。不亂封號,但亂重置額度,很香。
日常工作的絕對主力,夯中夯。
問題是太過於囉嗦,如果不加任何限制詞,隨便一個小問題,就能回覆幾千行。
永遠在處理千萬分之一概率的、沒人在意的邊際問題。
而且我的感覺是,GPT不像是AI,更像是一個超級計算機。
你輸入文本,他根據你提供的文本,計算並返回一個結果。
不會理解你在做什麼,不會思考場景,極少拓展思考。
如果缺信息,不會提問,就默默地硬猜,然後根據猜測的信息返回結果。
你補充信息後,他再回復:"對不起,上面是我理解錯了,那麼上面的內容要推翻。"
總之,極其考驗提示詞編輯能力和提問技巧,回覆囉嗦,用起來經常砸鍵盤。
實際工作中,ChatGpt最合適的還是:**程序員、數值設計、日誌分析**,這種純理科生任務。第二個,Claude。
Claude
Claude完全是另一回事,會給人一種"真AI"的感覺。
會極其積極的主動提問,會思考場景,會理解需求,會舉一反三。
更像一個真人在思考問題,而不是算一個結果。
而且Claude的審美能力,也能夠甩GPT幾條街。
遊戲開發中,Claude給的 字體、配色、邊框、圓角 等樣式參數,基本可以直接使用。
實際工作中,Claude基本是全才,可以承擔策劃助理、美術、UI、創意拓展。
簡單提一嘴Fable5。剛出的時候,和解禁後的第一週,神中神,能給人一種AI可以統治人類的感覺。
後面就降智嚴重,只能跟opus坐一桌。
![]()
這兩個就是我日常遊戲設計中使用的絕對主力。簡單總結下來就是:
ChatGpt像是一個完全偏科的理科生,純計算機,不帶感情,不帶腦子(人腦),只有算力。
但性價比高,對中文區友好,因此仍然可以承擔絕對主力。
Claude則是全科學霸,交流起來更像一個真人助理。
使用過程中只有感嘆,沒有砸鍵盤的衝動。
但性價比低,對中文區極其不友好,A畜名聲在外,不多贅述。
Vibe Coding
前面討論的是,AI作爲一個"人"、作爲一個"工作助理"等方面的綜合能力。
關於純代碼能力、vibe code方面,說實話對於AI來說都太簡單了,沒有十分大的差距。
代碼能力只簡單總結一下。
opus,很強,但是強得沒有太大意義,99%的場景沒意義。不是說大部分人用不上,而是一個程序項目,即使是如微信、支付寶這種軟件,它的代碼中,99%都是常規代碼,CRUD、UI佈局等。
真正稱得上"有難度""很高深"的代碼,其實只有最核心的幾個模塊。
ChatGpt,日常編程的絕對主力,性價比和代碼能力屬於AI編程的標杆。
GLM、DeepSeek、Kimi都很強,與前面兩個沒有十分大的差距。
極其複雜的問題,最多就是多改兩輪。考慮到價格,其實真的很夯。
唯一的問題是,處理任務的速度都很慢。但這屬於客觀因素,可以理解。
如果不追求效率,國產AI真的是不錯的選擇。
這點可以提一嘴Cursor的Composer,處理任務的速度極快。
處理代碼任務的速度,無人可挑戰的第一。
代碼質量水平,與GLM 5.2、DeepSeek v4 pro差不多。
處理同一個代碼任務,Composer已經改完了三輪代碼,DeepSeek還在思考中,GLM纔剛剛思考完畢。
![]()
其他
再簡單評價兩個AI。
Gemini,大號豆包的稱呼還是準確的,精準的,客觀的。
胡言亂語,情緒價值拉滿,哄人小能手。
跟ChatGpt對話是:無論如何,你多少有點兒錯。
跟Gemini對話是:無論如何,你永遠是對的。
早期靠着谷歌,當一個大號搜索引擎還能用。
現在這個生態位,可以完全被Grok替代。
Grok,現在"查互聯網資料"最好用的AI。
響應速度快,信息面廣,免費版已經十分可用。
但是與豆包問題類似。豆包是依賴抖音,容易基於一堆垃圾營銷號給你回覆;
Grok背靠“X”,也容易給垃圾信息。
簡單來說,無論是Gemini還是Grok,
對我而言,都是替代搜索引擎使用,查出的資料仍然需要自己甄別。
(Grok付費版,可能可以承擔不錯的工作任務,但是沒有從GPT或Claude跳過去用Grok的動力。)
更多遊戲資訊請關註:電玩幫遊戲資訊專區
電玩幫圖文攻略 www.vgover.com
