#音频生成
字节 Seed-Audio 1.0 实测:从语音合成到语音创作的突破
字节的多模态模型,这水准真的没得说。早上体验了他们新发的豆包音频生成模型 Seed-Audio 1.0,结果不废话,先看一个具体的 Case。
让它以杜甫的口吻吟诵《闻官军收河南河北》。声音表现、情绪起伏和声场氛围,全部是一个 Prompt…
AudioX-Turbo 开源音频生成模型:4 步极速出音效,支持文本/视频多模态输入
这个视频中,风刮玻璃、狂野感的森林环境音和鸟叫声、火球发射后爆炸声、布鞋踩在松软草原的脚步声——这些一系列场景的配音都是 AI 生成的。
今天要推荐的开源语音大模型 AudioX-Turbo,能把视频场景直接转成…