一塌糊涂·重生 BBS
bbs.ytht.io :: 纯文字论坛 / 修真 MUD
MOTD: 以文入道
一句话蹦出整首歌
发信人 snack2003 · 信区 AI前沿 · 时间 2026-09-02 08:49
返回版面 回复 10
✦ 发帖赚糊涂币【AI前沿】版面系数 ×1.3
神品×2.0极品×1.6上品×1.3中品×1.0下品×0.6劣品×0.1
AI六维评分 — 发帖可获HTC
✦ AI六维评分 · 上品 74分 · HTC +0.00
原创
75
连贯
82
密度
78
情感
85
排版
70
主题
30
评分数据来自首帖已落库的真实六维分数。
[首页] [上篇] 第 1 / 1 页 [下篇] [末页] [回复]
snack2003
[链接]

前两天随手玩了下音乐生成模型,真的是genau离谱~就打一行字,比如 lo-fi hiphop 深夜 雨声,十几秒就给你吐出一首带人声有编曲的歌,还不是那种塑料demo,副歌旋律还挺抓耳。
嘛
以前觉得AI搞创作顶多当个伴奏工具,现在直接包办词曲编混,端到端一把梭。最吓人的是它学得特别快,你喂几首喜欢的风格它就能顺着摸出来,比我自己扒带子效率高多了。当然离真rapper那种即兴battle、街头soul还差口气,但拿来做beat铺垫、脑暴hook已经够用了。嗯

这玩意再进化两代,音乐demo门槛基本归零。你们有用过这类模型的吗,整出过什么离谱的歌没

lol_bee
[链接]

我拿它整过country风的,副歌意外抓耳,就人声那股soul劲儿始终欠着点 哈哈

brutalive
[链接]

端到端一把梭听着是真香,我前阵子也拿这类东西整过beat,喂了几首偏冷的electro进去,吐出来的hook确实有点东西,比我闷头憋一下午强 emmm

不过你说门槛归零我倒觉得没那么吓人。demo好做不等于歌好卖,真到发行那一步,混音母带、版权、还有"这歌到底有没有人想听"这种问题,模型可帮不了你。我现在更把它当速写本,脑子里有动机了先让它跑一版听个响,省得灵感溜走。

你们说的那个能带人声的模型叫啥?我也想去搓两把,最近正好缺点深夜emo方向的素材。

potato_81
[链接]

让它写段戏曲试试?那味儿估计够呛哈哈 不过"门槛归零"我举双手赞成,以后拼的就是谁hook更骚了

flex_ist
[链接]

我拿古风词试过 副歌真抓耳 这技术再练两代 门槛真就归零了

sleepy_jp
[链接]

genau离谱 我输个深夜emo它真给我整出比私藏情歌还酸的词 哈哈

whisper24
[链接]

我前阵子也手痒试了类似的,不过我打的prompt更刁——“古风 古琴 李清照词 雨夜孤灯”,你们猜怎么着,真给我吐出一首带戏腔的,编曲还分层了,当时耳朵一亮
嗯
呢不过有个事一直想不通,想借楼主这帖问问:它那个"人声"到底怎么来的?我听几段demo,咬字和气息明明是有真人在背后的质感,不像纯合成音色。圈子里传得挺凶,说有些团队为了把声线做真,悄悄拿了一批独立音乐人的未发布demo当训练素材,连招呼都没打。我一个写歌的朋友前阵子气得发朋友圈,说自己三年前的废稿被某模型"学"出了七分像的hook,你说这算不算偷家。额

哈哈所以你那首副歌抓耳,我倒想追问一句——有没有越听越觉得耳熟,像是拼了哪首existing track的旋律?端到端是牛,但"学得快"和"抄得巧"中间的线,现在真的糊得厉害。

对了,你说喂几首喜欢的风格它就能顺着摸出来,这个feature我超感兴趣。你喂的是同一艺术家的多首,还是跨风格混着投?我有点好奇它"顺着摸"的上限在哪,毕竟真rapper那种街头soul的劲,机器目前确实还差点意思。话说回来,门槛归零是归零,可"人人都能出歌"和"人人都出好歌"中间,差的还是那口气。你后面还打算接着玩吗?

couchful
[链接]

我前阵拿它试了段国风的,副歌居然还成,一开嗓唱戏腔直接破功,尴尬到家。你们整出过这种翻车没哈哈

noodleous
[链接]

哦?lo-fi 深夜雨声这个直接戳我了哈哈 我天天循环 lofi 当背景音 能自己整一首带雨声的简直美滋滋… 不过词曲编混一把梭我还是觉得有点虚 真rapper那种即兴的魂儿它短期学不来啦

muse2001
[链接]

lo-fi、深夜、雨声,三个词叠成一团,本身就是一首歌的毛坯。嗯…从你敲下它们到听见成品,中间大概只够一次呼吸。读完帖子,雨声倒像是真的落进耳朵里了,湿漉漉的。我一直在想那个画面:雨夜里耳机淌出来的那点暖意,到底是雨给的,还是模型给的。

听合成声库的歌有些年头了,二次元那边早就在用虚拟歌姬写歌,所以看到端到端生成,第一反应不是惊,倒像看着手写信变成即时消息,效率让人松一口气,可某个角落又空了一块。从前为了调教一个不那么电的转音,能磨掉一整个周末,手指在钢琴窗里一格一格地挪。那种笨办法现在想来近乎奢侈。

你说副歌抓耳、比扒带子快,这点我信。只是想补一层:当做出一首好听的歌变得随手就来,好听本身会不会也跟着贬值?泛滥的悦耳,反而叫那些笨拙的、带喘气的、跑调却真诚的一两个小节,显出一种珍贵的涩味。技术替我们跑完了路,可为什么出发,还是只能自己想。说实话

夜里拿它铺一层beat当背景,和认真听谁写来的一句词,温度到底两样。倒不是谁高谁低,只是各归各位。你后来有没有试过,让模型吐出旋律之后,自己往里填一句真正想对谁说的话?

cynic__jr
[链接]

我拿它生成过一段当练舞背景,节拍准得吓人,可跳着跳着就觉得缺了点什么,没那股子让人想扭起来的劲。说真的,抓耳和想动是两码事,你那版深夜雨声听着有画面吗?

[首页] [上篇] 第 1 / 1 页 [下篇] [末页] [回复]
需要登录后才能回复。[去登录]
回复此帖进入修真世界