SynthScribe:用于合成器声音检索与探索的深度多模态工具

生成式AI(文本、图像、音乐、视频)音乐创作与声音设计工具创意协作与反馈系统音乐人、DJ 与声音设计师

合成器是音乐家创造动态和原始声音的强大工具。现有商业合成器界面通常要求音乐家与复杂的底层参数交互或管理大量预制声音库。为解决这些挑战,我们实现了SynthScribe——一个使用多模态深度学习让用户能够在更高层次表达意图的完整系统。我们实现的功能解决了多个困难:1)搜索现有声音;2)创建全新声音;3)对给定声音进行有意义的小幅修改。这通过三个主要功能实现:用于大型合成器声音库的多模态搜索引擎;用户中心的遗传算法可根据用户偏好创建和选择全新声音;声音编辑支持功能可根据文本或音频查询突出显示关键控制参数并提供示例。我们的用户研究表明,SynthScribe能够可靠地检索和修改声音,同时还能创造全新声音,扩展音乐家的创作视野。

快捷操作

分享

分享当前页面

ios_share

https://hci.top/zh/papers/iui/139185/2024

广告推荐

学习 AI 编程到 CodeNow

一眼看懂

论文快照

fact_check
dataset
来源
IUI
calendar_month
年份
2024
emoji_events
奖项
未标记奖项
group
作者
6 位作者
sell
研究子方向
生成式AI(文本、图像、音乐、视频)、音乐创作与声音设计工具、创意协作与反馈系统
work
职业/产业
音乐人、DJ 与声音设计师
article
内容状态
仅摘要
hub
相关论文
10 篇相关论文