SounDiT

SounDiT

SounDiT 是一个面向地理语境声景到景观生成的多模态生成模型。它把环境声景和可选场景提示作为输入,生成与地点语境一致的环境图像,用于观察“听到的声音”如何指向“可能看到的场所”。

观察

边界

相关页面

证据