AudioCraft
Meta FAIR 的 AudioCraft 是基于 PyTorch 的音频生成研究库,包含文字或旋律条件的 MusicGen、文字转声音的 AudioGen、EnCodec、MAGNeT、JASCO 和 AudioSeal 等模型与训练、推理组件。
推荐理由
选择它是因为同一代码库覆盖音乐、非音乐音效、神经音频编码和水印,技术团队可以比较不同条件方式、检查生成延迟与显存、研究旋律约束,并把候选批量导出到游戏原型;它也为评估自建音频模型的训练和推理成本提供了比单一网页演示更透明的基线。
适用阶段
用美术、动画、音频、关卡和叙事,把玩法做成玩家能理解并相信的世界。
使用前留意
代码为 MIT,但官方模型权重采用 CC BY-NC 4.0,不能直接用于商业游戏;免费下载和训练代码公开不等于生成资产可商用。公开权重主要是研究发布,需自备 GPU,正式下游使用还要评估训练数据、相似性、偏差、水印、输出质量和模型维护状态。