我的实际听感和一些个人猜测。
这次 V6 最大的卖点是联合了华纳(WMG)、BMG 和 Believe 等巨头,主推训练数据的“绝对合规”。实际测试下来......
先说听感,V6 常规版其实更像是 V5 和V5.5 的优化版,核心生成质量没有质变,只是抠了细节:
整体音质略有改善,且改善高频bug:比如钢琴、竖琴这类原声乐器的高频部分听感明显好很多了。
长上下文推理质量更稳:新增了 Max mode,一次生成需要 20 积分。解决的是上一代模型生成到 2 分多钟后质量明显下降的问题。
除此之外,整体质感和 V5/V5.5 几乎处于同一水平。
重点来了,这次官方还搞了个“V6 wild”版本。 试了一下,生成出来的东西简直就是一坨。
结合以上两点,大胆猜测一下 Suno 这波的真实操作:
Suno 和版权方绝对是签了协议的,但那几家公司给的数据量,怎么可能跟以前全网爬取的数据量相提并论?所以强烈怀疑,不太行的“V6 wild”,才是真正只用合作方数据训练出来的“纯合规模型”。
常规 V6,根本就是 V5.5 的微调版(依然带有全网数据的基因)。Suno 这是在打擦边球,利用合作协议作为挡箭牌,对外宣称“我们的 V6 是合规的”。
说白了,Suno 现在 AI 音乐界要资金有资金、要地位有地位、要用户有用户,唯独被各大唱片公司的版权官司给死死绊住了。这次的 V6,与其说是技术迭代,不如说是应付法务和公关的“缓兵之计”。不知道大家怎么看? 本帖最后由 s99yj 于 26-9-10 16:41 编辑