文章背景: Godot + 2D 遊戲. 其他場景的開發用戶, 取其有用之處即可.
![]()
前言
之前聊過一次 AI開發和音樂美術的問題, 那次的方案簡單來說就是:
音效: 開源素材 | bfxr 抽獎 + Audacity 微調
美術. 上一個遊戲沒有美術
經過這一個月新項目的開發, 又整理出了 2.0 的方案.
先說結論: 這次介紹的音效和美術方案, 本質上是同一個思路 ——
不再嘗試讓AI生成最終成品, 改爲讓 AI 生成"源碼", 再轉換爲成品.
---
音效
一句話總結: AI + Python + .json -> .wav
![]()
整體流程
先讓AI用寫一個音效合成Python腳本, numpy, 合成輸出 .wav
預設一批可接收的音頻配置參數, 如:
正弦/三角波 tone、材質敲擊 modal、旋律 notes、批量微擊 clicks、噪聲 noise、箱體混響 room 等.
然後自己用人話描述自己要什麼聲音, 讓AI來生成符合這個特徵的 音效的參數
保存爲 音效.json
然後
Python + 音效.json -> 音效.wav.
![]()
爲什麼是這個路子
當前讓 AI 直接生成 小於1秒 的"音效", 目前我不瞭解任何方案. AI+Audio幾乎都去用來唱歌了.
JSON 是純文本, 改音效 = 改數字, AI 可以反覆迭代, 每次修改完全可控、可回退, 且成本極低
AI實在無法生成滿意的音效, 還可以自己手調, 改幾行json參數, 比去把 audacity 學透徹成本要低太多了.
![]()
美術素材
一句話總結: AI -> svg -> png
整體流程
先讓 AI 生成 svg, 然後直接頻繁迭代調整 svg 的樣式.
定稿後, 想用 svg 就直接用 svg, 想用 png 就腳本批量轉, 一個Python腳本的事.
![]()
爲什麼不直接生成 .png
AI直接生成png, 成本太高這個不需要過多解釋.
用AI來直接生成 .png, 風格和細節極其難把控.
即使現在幾乎所有的AI客戶端中, 生成的圖片, 都可以自行"標記"修改點
但是多輪的修改下來, 還是會有一定的概率發生意外修改, 意外發生後再找回之前的細節, 幾乎是一個不可能的事.
最後可能需要落到:
自己拿着幾張 png, 這張圖上面裁剪一個區域, 那張圖上面裁剪一個區域, 然後自己在 Photoshop 裏面拼接.
爲什麼先生成 .svg
成本極大幅度的降低, AI迭代 png 和 迭代 svg, 消耗額度是兩個維度的.
畢竟 svg 本質上等於文本
不受模型的多模態能力限制, Claude至今仍然不能直接生成 png
部分模型, 雖然有多模態能力, 圖片識別能力很強, 但是要麼不能生成圖片, 要麼生成圖片的能力極差
使用svg, 完全可以做到: 截圖 圈出某個區域的細節, 讓任意具備圖片識別能力的AI來修改 svg
這兒低一點, 那兒高一點. 這裏大一點, 那裏小一點
這種程度的任務, 隨便用一個低成本的模型, 都可以實現
風格極易把控, 風格一致性很容易做到, AI掃一眼項目裏所有的 svg 和 掃一眼所有的 png, 難度也不是一個維度的.
![]()
尾言
也是想到哪兒寫到哪兒了.
![]()
平時都在高強度開發, 沒有太多時間寫文章, 剛把demo上傳審覈, 現在纔有點兒空閒時間.
但是也是因爲高強度開發, 所有每次停下來又都能寫點兒什麼.
後續大概會保持這個頻次和節奏
感興趣的可以點關注
更多遊戲資訊請關註:電玩幫遊戲資訊專區
電玩幫圖文攻略 www.vgover.com
