这么详细的 AI音乐提示词编写教程,你还不来看看?

大家好,非常高兴能在这个平台上和大家发帖交流,也感谢每一次评论、浏览、点赞与打赏。之前有很多朋友在评论区或者Q群里跟我吐槽,说总是摸不着头脑,无法学会怎么书写高质量的AI音乐生成提示词,导致生成的歌曲总是差强人意:明明想要复古,结果出来现代电子;明明想要原声,结果塞满合成器;明明想要私密小酒馆,结果像体育场演唱会;明明想要干净人声,结果电音、修音、和声堆得满满当当;明明想要中国风,结果跑成了好莱坞大片配乐。为了彻底解决大家的痛点,今天我特意整理了一期非常详细、堪称“喂饭级”的保姆教程。如果你真的想提升自己的AI音乐创作水平,还请务必拿出耐心,把这篇文章从头到尾看完。我敢打包票,看完之后,你按照这个方法生成出来的歌曲,绝对能够让你大开眼界,甚至让你一下顿悟:原来提示词还可以这么写。废话不多说,我们直接干货开始。 书写结构: 1、提示词开头,精准定位。首先,在提示词的第一部分,一定要把你需要用到的所有核心乐器详细地写出来,越具体越好,千万不要含糊。比如不要只写“吉他”,因为你只写吉他,AI 无法知道你要的是电吉他还是木吉他,因此稍微写的详细1点是比较保守的,你可以写“原声木吉他”“尼龙弦古典吉他”“清音电吉他”“失真电吉他”“带弱音器的小号”“刷子爵士鼓”“立式贝斯”“木质三角钢琴”等。乐器的音色、演奏方式、录音质感、所处位置也要尽量交代清楚。同时,必须把你需要AI编曲的核心风格明确写出来,这是整首歌曲的灵魂基调。核心风格可以包括音乐类型、年代、地域、调式、节拍、速度与情绪,比如“Chinese pentatonic waltz”“Vienna waltz framework”“American classical arrangement”“1920s old Shanghai nightclub cabaret atmosphere”。只有开头定位足够准确,AI才知道自己要往哪个方向走,而不是随意拼接出一首四不像的歌曲。 2、提示词中,尽量做到避免 AI 生成跑偏的情况。如果AI生成容易跑偏,强烈建议给提示词加上“排除风格”和“融合风格”。例如,假设你要生成一首流行歌,那么流行、中国风、摇滚、流行摇滚、蓝调、爵士、R&B等都可以作为候选保留风格融合进去。千万不要给AI只限定死一个单一风格,那样很容易导致AI生成出来的音乐听起来非常廉价、缺乏层次感。在提示词中,你应该清晰、多维度地阐明需要编曲的风格,就像我刚才提到的多风格融合,以及具体的编曲质感,如Lo-fi、高保真、磁带、黑胶、AM广播、单声道;编曲手法,如渐进式、爆发式、留白式、对话式、层叠式;编曲结构,如主歌-预副歌-副歌-桥段-尾声;节奏特征,如3/4拍、4/4拍、Swing、Waltz;情绪氛围,如怀旧、烟雾感、亲密、宏大、复古、梦幻等。让AI有明确的创作框架,而不是任由它自由发挥到失控。 3、提示词中间或末尾直接提具体要求。AI有时候会自作主张加一些你不想要的元素,这时候就需要直接下达指令。例如,假设你不想让AI在流行歌里夹杂人声电音或者奇怪的和声,那么可以直接排除它。建议使用“要求 XXX 不要 YYY”或“要求 XXX 可以 YYY”这样清晰明确的句式,比如“要求人声保持纯净,不要添加电音效果”或“要求副歌部分可以加入宏大的合唱”。如果你不希望出现掌声、混响、Auto-Tune、现代电影感、合成器、突然转调、说唱段落、过度花腔,也要一一写清楚。通过这种结构化的自然语言,AI就可以清晰理解你的具体诉求,知道哪些元素必须保留,哪些元素绝对不能出现。 4、调参环节,细节决定成败。如果想要AI生成的音乐具有更强的吸引力、更丰富的细节和动态,那么在参数设置上需要一点小技巧:音频影响力可以稍微调低一点点,让AI有更大的创作自由度;同时,风格强度和怪异度都可以稍微调高一些,以激发AI的创造力。但需要特别注意的是,怪异度最好不要超过30%,否则音乐结构可能会跑偏严重,变得杂乱无章。调参不是越极端越好,而是要在可控范围内反复试听、反复微调,找到既有个性又不失控的平衡点。 5、回头检查,死磕歌词发音。AI在演唱时经常会出现咬字不清或发音错误的问题,尤其是多音字或轻声。因此,提交前一定要逐字检查歌词的发音是否正确。例如,将结构助词的拼音“de”替换为读音更清晰的“di”,或者将容易混淆的平翘舌音、前后鼻音进行拼音替换。这里仅做简单演示,实际操作中需要根据AI的发音习惯,把歌词全部改成最准确、最不容易读错的拼音或同音字。这里建议所有的容易读错的生僻字都改拼音,因为拼音是最不容易出错的。比如在一些经典老歌中,你需要把结构助词“的”全部改成“dī”,“了”全部改成“liǎo”。不要嫌麻烦,歌词发音这一关如果不过,旋律再好也会被奇怪的咬字毁掉。 6、提交生成,注意冗余参数。一切准备就绪后,点击提交即可。这里有个小细节:男女声参数可以不用特意去设置,因为你在提示词里已经写得很清楚了,比如“female cabaret vocal”或“male tenor vocal”,这个外部参数只能作为辅助备注,有时候设置不当反而会干扰提示词的权重。因此,能不在外部重复的参数就尽量不要重复,把最关键的信息交给提示词本身,让AI按照文字描述去执行。 7、完整示例,供直接参考或修改使用。 Chinese pentatonic waltz, Vienna waltz framework, American classical arrangement, 1920s old Shanghai nightclub cabaret atmosphere, vintage gramophone steel needle recording, AM radio frequency interference, no reverb, no applause, intimate small tavern stage, female cabaret vocal, no autotune, no vocal polishing, raw vintage vocal, classical orchestra only, no synthesizer, no modern cinematic sound, no epic grandeur, delicate salon waltz, acoustic instruments only: trumpet, trombone, euphonium, tuba, bass saxophone, alto saxophone, tenor saxophone, bass clarinet, clarinet, oboe, flute, xylophone, wooden grand piano, classical acoustic guitar, drum kit, upright bass, triangle, violin, timpani, snare drum, reversed cymbal swell, piccolo, harmony vocals, tubular bells, konghou harp, yangqin, lo-fi warmth, crackle, hiss, mono, 3/4 waltz time, nostalgic, smoky, vintage 1920s, no modern production, no Auto-Tune, no reverb, no applause. 8、深度解析:知其然更知其所以然。 该完整示例的前半段,首先精准锁定核心风格:Chinese pentatonic waltz、Vienna waltz framework、American classical arrangement,并用 1920s old Shanghai nightclub cabaret atmosphere、vintage gramophone steel needle recording、AM radio frequency interference 来极致限定年代感与空间质感,瞬间把听众拉回那个纸醉金迷的年代。这样的开头不是简单堆词,而是在告诉AI:你要写的是中国五声音阶的华尔兹,要有维也纳华尔兹框架、美国古典编曲思路,还要有1920年代老上海夜总会歌舞厅的氛围,甚至连留声机钢针录音和AM电台频率干扰都要模拟出来。 接着,用 no reverb、no applause、intimate small tavern stage、female cabaret vocal、no autotune、no vocal polishing、raw vintage vocal 来明确人声要求,坚决避免AI自作主张加入现代数字混响、现场观众掌声或过度修音,确保人声的粗粝感和真实感。这里每一个排除项都很关键,因为AI很容易默认加入现代制作手法,如果不明确禁止,它就会把复古味道冲淡。 中段,用 classical orchestra only、no synthesizer、no modern cinematic sound、no epic grandeur、delicate salon waltz 做风格收束,严格防止AI跑偏成现代好莱坞电影配乐或厚重的电子管弦乐。也就是说,不仅要告诉AI“要什么”,还要告诉它“不要什么”,让创作边界变得清晰可见。 随后,列出 acoustic instruments only,并逐一写出 trumpet、trombone、euphonium、tuba、bass saxophone、alto saxophone、tenor saxophone、bass clarinet、clarinet、oboe、flute、xylophone、wooden grand piano、classical acoustic guitar、drum kit、upright bass、triangle、violin、timpani、snare drum、reversed cymbal swell、piccolo、harmony vocals、tubular bells、konghou harp、yangqin 等。这些乐器不仅完美覆盖了管弦乐、爵士铜管、木管、打击乐以及中国民族乐器,更从物理层面上保证了纯粹的原声质感。乐器越明确,AI越不容易用错误的音色代替,编曲层次也会更丰富。 末尾,用 lo-fi warmth、crackle、hiss、mono、3/4 waltz time、nostalgic、smoky、vintage 1920s 来细腻描述编曲质感、时间拍号与情绪氛围,最后再重复 no modern production、no Auto-Tune、no reverb、no applause 来强化排除项,形成双重保险。这样一来,AI既知道音乐该往哪个年代、哪种空间、哪种情绪走,也知道哪些现代元素必须被挡在门外。 整体上,这个示例把风格、乐器、质感、结构、排除项、人声要求天衣无缝地放进同一段提示词中,便于AI同时理解创作方向与边界。它不是胡乱堆砌关键词,而是有顺序、有层次、有逻辑地完成了从宏观风格到微观音色、从正面要求到负面排除的完整表达。 在实际调参时,可将音频影响力略调低以保留更多细节,风格强度略调高以突出特征,怪异度调高但不超过30%以维持结构稳定。歌词发音需逐字检查,如把 de 改写成 di 等正确且清晰的拼音。男女声不用在外部面板设置,因为提示词里的 female cabaret vocal 已明确说明,该参数只作备注即可。检查所有细节无误后,点击提交,静待佳作诞生。附录:完整示例中的中英文词汇对照表| 中文 | 英文 | 效果 |

|---|---|---|

| 中国五声音阶华尔兹 | Chinese pentatonic waltz | 核心风格:五声音阶+华尔兹 |

| 维也纳华尔兹框架 | Vienna waltz framework | 限定华尔兹结构与律动 |

| 美国古典编曲 | American classical arrangement | 美国古典和声与配器思路 |

| 1920年代老上海夜总会歌舞厅氛围 | 1920s old Shanghai nightclub cabaret atmosphere | 年代、地域、空间氛围定位 |

| 复古留声机钢针录音 | vintage gramophone steel needle recording | 留声机钢针、窄频、噪底质感 |

| AM电台频率干扰 | AM radio frequency interference | 模拟旧广播干扰,增强年代真实感 |

| 无混响 | no reverb | 排除现代混响;开头与末尾重复强化 |

| 无掌声 | no applause | 排除观众掌声;开头与末尾重复强化 |

| 私密小酒馆舞台 | intimate small tavern stage | 小场地、近距离、私密空间 |

| 女性歌舞厅人声 | female cabaret vocal | 女声、歌舞厅唱腔定位 |

| 无自动修音 / 无Auto-Tune | no autotune / no Auto-Tune | 排除自动修音;开头与末尾重复强化 |

| 无人声打磨 | no vocal polishing | 排除过度修音,保留真实感 |

| 原始复古人声 | raw vintage vocal | 保留粗粝、真实的复古人声 |

| 仅古典管弦乐 | classical orchestra only | 限定编制,避免现代乐队化 |

| 无合成器 | no synthesizer | 排除电子合成器音色 |

| 无现代电影感 | no modern cinematic sound | 排除现代电影配乐感 |

| 无史诗宏大 | no epic grandeur | 排除宏大、厚重、史诗化编曲 |

| 精致沙龙华尔兹 | delicate salon waltz | 细化风格为轻巧沙龙舞曲 |

| 仅原声乐器 | acoustic instruments only | 限定物理原声质感,避免电子音色 |

| 小号 | trumpet | 铜管高音,明亮,带爵士/古典色彩 |

| 长号 | trombone | 铜管中低音,厚度与滑音 |

| 上低音号 / 次中音号 | euphonium | 柔和圆润的铜管中低音 |

| 大号 | tuba | 低音铜管,提供低频根基 |

| 低音萨克斯 | bass saxophone | 低沉萨克斯/木管低音 |

| 中音萨克斯 | alto saxophone | 爵士中音主奏色彩 |

| 次中音萨克斯 | tenor saxophone | 爵士温暖主奏色彩 |

| 低音单簧管 | bass clarinet | 暗色木管低音 |

| 单簧管 | clarinet | 灵活的木管中音 |

| 双簧管 | oboe | 穿透性木管,带田园感 |

| 长笛 | flute | 轻盈高音木管 |

| 木琴 | xylophone | 清脆打击点缀 |

| 木质三角钢琴 | wooden grand piano | 原声键盘,温暖质感 |

| 古典原声吉他 | classical acoustic guitar | 尼龙弦/古典拨弦,私密感 |

| 架子鼓 / 爵士鼓 | drum kit | 节奏组 |

| 立式贝斯 / 低音提琴 | upright bass | 爵士低频与律动 |

| 三角铁 | triangle | 高频清脆点缀 |

| 小提琴 | violin | 弦乐旋律与情感 |

| 定音鼓 | timpani | 管弦低频打击 |

| 小军鼓 | snare drum | 节奏/进行感 |

| 反向镲片渐强 | reversed cymbal swell | 转场、过渡效果 |

| 短笛 | piccolo | 高音明亮木管 |

| 和声人声 | harmony vocals | 人声和声层次 |

| 管钟 | tubular bells | 钟声、复古管弦色彩 |

| 箜篌 | konghou harp | 中国民族拨弦,东方色彩 |

| 扬琴 | yangqin | 中国民族击弦,东方色彩 |

| 低保真温暖 | lo-fi warmth | 温暖、毛躁、低保真质感 |

| 噼啪声 | crackle | 黑胶/留声机爆裂噪点 |

| 嘶声 / 底噪 | hiss | 磁带/广播底噪 |

| 单声道 | mono | 声场收窄,复古年代感 |

| 3/4拍华尔兹节奏 | 3/4 waltz time | 三拍子华尔兹律动 |

| 怀旧 | nostalgic | 怀旧情绪 |

| 烟雾感 | smoky | 朦胧、亲密氛围 |

| 1920年代复古 | vintage 1920s | 年代定位 |

| 无现代制作 | no modern production | 排除现代制作手法 |

发表于:2026-09-24 11:35
本帖最后由 管理员 于2026-09-24 19:02:34 加精
3个回复
您还没有登录,登录后才可回复。 登录 注册