上证报中国证券网讯(记者罗茂林)7月20日,字节跳动Seed团队发布音频创作模型Seed Audio1.0。
据介绍,该模型面向完整声音场景,在统一框架下联合建模人声、音效和环境声等多种音频要素,端到端完成影视级音频创作。声音不再只是画面的补充,而是可以直接参与叙事,在听者脑海中直接形成画面感,做到“听见”即“看见”。
官方披露,该新款模型主要有三方面优势:一是多要素统一编排,支持精细的时间控制;二是音色风格可控,长时稳定;三是支持多语种自然生成。
目前,Seed Audio1.0已在火山方舟体验中心上线。
