Canvas3D:通过3D虚拟画布的约束为图像生成赋予精确空间控制能力
作者
生成式AI(文本、图像、音乐、视频)3D 建模与动画创意协作与反馈系统UI/UX 设计师AI/ML 研究员与工程师HCI 研究员
生成式AI显著提升了图像创作的便捷性和灵活性。然而,实现精确控制空间构成仍然具有挑战性,包括对象排列和场景条件。为弥合这一差距,我们提出了Canvas3D,一个利用3D引擎实现图像生成精确空间操控的交互系统。根据用户提示,Canvas3D自动将文本描述转换为3D引擎驱动的虚拟画布中的交互对象,支持直接且精确的空间配置。这些用户定义的排列生成指导生成模型在结果图像中准确反映用户意图的显式空间约束。我们在Canvas3D与基线系统之间进行了封闭式比较研究,以及开放式自由形式研究来评估整体系统可用性。结果表明Canvas3D在空间控制、交互性和整体用户体验方面优于基线系统。
研究问题 / 现实痛点
这篇论文在当前问题库中对应的问题线索。
当前问题库还没有收录这篇论文的问题与痛点。
- 71%
偏好引导的提示优化用于文生图生成
CHI '26· 生成式AI(文本、图像、音乐、视频) +2
- 71%
减少重绘,多加探索:草图到图像的建议与补全
CHI '26· 生成式AI(文本、图像、音乐、视频) +2
- 71%
与生成式AI合作:模型主导和人类主导交互在人机共创中的实验评估
CHI '26· 生成式AI(文本、图像、音乐、视频) +2
- 71%
熵的测量能否匹配人类对AI生成图像多样性的判断?
CHI '26· 生成式AI(文本、图像、音乐、视频) +2
- 67%
VizCrit:视觉设计工具中计算反馈展示策略的探索
CHI '26· 生成式AI(文本、图像、音乐、视频) +1
- 67%
构建用于创意工作的人类-多智能体团队
CHI '26· 生成式AI(文本、图像、音乐、视频) +1
- 67%
超越生产力:重新思考创造力支持工具的影响
C&C '25· 生成式AI(文本、图像、音乐、视频) +1
- 63%
重新思考生成式3D建模工具的入门与求助方式:"我只需要GPT来优化我的提示词"
CHI '26· 生成式AI(文本、图像、音乐、视频) +3
基于研究子主题与职业分类的 Jaccard 相似度(≥60%)
快捷操作
一眼看懂
fact_check论文快照
dataset
来源
IUI
calendar_month
年份
2026
emoji_events
奖项
未标记奖项
group
作者
7 位作者
sell
研究子方向
生成式AI(文本、图像、音乐、视频)、3D 建模与动画、创意协作与反馈系统
work
职业/产业
UI/UX 设计师、AI/ML 研究员与工程师、HCI 研究员
article
内容状态
仅摘要
hub
相关论文
8 篇相关论文