3D Avatar Diffusion

微软的实验神经网络,用于从照片或文本描述中创建详细的3D异形.

3D Avatar Diffusion
10视图
访问网站

概览

3D Avatar Difusion,又称RODIN Difusion,是一个微软的研究项目,专注于生成三维的人类浮雕. 该技术建立在多阶段的传播架构之上,能够创建带有详细渲染形状、纹理和照明的体积模型。 该系统既可以使用用户的照片肖像,也可以使用文本描述。 需要的性格 。

应将该项目视为能力的科学证明,而不是成品。 开发者公布实例结果和对方法的描述,但没有为广大受众提供完全的公众访问工具的机会.

概念和研究重点

研究的主要目的是展示传播模型如何应用于三维生成类似人类的数字领域. 与许多商业服务不同的是,该项目侧重于该问题的技术方面,并探讨质量的局限性。 生成了三维模型。

如何运作

在目前阶段,无法通过微软网站生成自己的avatar. 尽管该项目的网页和已出版的材料存在,但该系统是一组科学发展和实例,而不是交互式服务.

3D 阿凡达扩散特性 ————————————————————————————.

====================================================================================================== (============================== (=============================== |,|也. 研究神经网络 QQ 类 3D 模型和对象 AI 字符创建 QQ QQ 开发者 QQ 团队与微软 QQ 关联 3d-avatar-difusion.microsoft.com 互联网档案馆的存檔,存档日期2013-03-02. 网站公布日期 2025年3月25日 QQ 打开访问QQ 否QQ

3D神通传播适合谁? ————————————————————————————.

计算机视觉的研究人员和开发者

研究使用传播模型生成3D内容的方法的人可以在这个项目中找到有价值的信息. 出版的材料描述了建筑解决方案和对多阶段生成可能对其自己的实验有用的方法.

数字人物创作专家

游戏,动画,虚拟现实行业的专业人士跟踪自动人物生成技术的发展,可以将这个项目视为灵感来源和未来商业工具的基准.

普通用户

对广大观众来说,不幸的是,该项目还没有带来实际价值——无法自己尝试技术.

如何使用 3D 神通传播? ——————————————————————————.

没有公共接口

必须明白,目前没有“尝试”按钮或上传表格可供每个网站访问者使用。 您不能简单地上传您的照片并获得三维图像 。

研究研究资料

与项目互动的唯一方法是 研究出版物、生成模型的实例以及网站上的技术文件。 所有系统能力都通过预先准备的例子来展示.

3D 神通传播的关键特征 ——————————————————————————.

从肖像照片中生成

系统可以仅根据一张肖像照片重建一个三维的人类人物. 多层次方法允许先创建粗糙的形状,然后依次添加体积,纹理,并调整照明.

QQ 从文本描述生成

从零开始生成字符的可能性基于 一个文本提示。 用户(在研究情景中)可以指定细节,如发色,服装特征,面部特征,以及创建模型时会考虑的其他特征.

编辑创建的图

该技术允许对已经生成的3D模型进行修改. 例如,可以改变字符的发型或添加附件,而图及其纹理的其他参数则保留下来.

3D 神通传播的好处 ——————————————————————————.

成果的高度详细情况

由于多阶段的传播架构,系统实现了精细元素的高质量渲染:皮肤结构,服装折叠,以及照明特征. 这使得工程与许多更简单的阿凡达发电机不同.

  • 输入方法的无效性

与图像和文字描述同时工作的能力为创作过程提供了灵活性. 用户可以从真人开始,也可以创造出完全虚构的角色.

后处理功能

编辑一个已经完成的数字的能力打开了额外的使用大小写:你可以迭代完善一个字符,以达到预期的结果.

三维神通传播的缺点 ——————————————————————————————.

没有打开的版本

主要的显著缺点是,该项目没有向广大受众开放。 用户无法上传其照片并获得avatar;所有能力仅保留在研究领域.

  • 公共内容有限

网站上只公布研究动态、实例和技术说明。 没有向任何感兴趣的人提供完整的交互式演示。

道德风险

开发者注意到技术的潜在危险:可以用来制造现实的假人图像. 提交人建议给标签,以避免滥用和错误信息。

3D 神通扩散能解决什么任务 ? ————————————————————————————.

创建个人 3D 虚拟

系统的主要任务是基于一个人的单一肖像图像生成一个详细的三维图像. 这对虚拟现实、游戏或视频通信系统的未来应用可能有用。

生成虚构字符

该技术允许在文本描述的基础上从头创建3D数字,而不用参考照片. 用户可以指定想要的外观特征,并获得相应的模型.

调整现有的三维模型

系统支持编辑一个生成的图:改变发型,增加附件,以及其他修改. 这样可以自定义一个用于特定任务的异形,而无需完全再生.

3D 神通传播定价 ————————————————————————.

没有关于使用费用的信息。 该项目是一种研究开发,没有商业分销模式。 由于没有向公众提供获取技术的机会,谈论关税或订阅计划还为时过早。 可以假定的是,如果产品出现商业版本,定价政策将另行公布。

3D 神通传播的使用条件 ——————————————————————————————.

科学项目状况

该系统完全在研究活动框架内分发。 这意味着所有材料都用于研究和科学分析,而不是供最终用户实际使用。

  • 将结果贴上标签的建议

作者强调对生成的内容进行标签的重要性. 利用该技术创建的图像和3D模型应标注为合成,以防止用于误导目的。

3D 神通传播的可用性 ——————————————————————————.

截至今天,没有为终端用户全面接入神经网络. 尽管项目网站有出版物和实例,但除本组织成员外,任何人都无法创建虚拟网站。 研究团队。 要尝试这一技术,广大的受众必须等待基于这一技术的单独发布或第三方解决方案的出现.

3D 神通传播方式与替代品有何不同 ————————————————————————————.

多阶段传播架构

与许多现有解决办法的主要区别在于生成方法。 系统不是单阶段的模型创建,而是一步一步地工作:先形成一个基本形状,然后是体积,纹理,再增加光线. 这样可以取得更高的质量成果。

综合输入数据

一个罕见的特点是能够在一个单一模型内使用两种类型的输入数据(图片和文本). 大多数竞争者专门研究其中一种生成方法。 此外,编辑一个已经创建的图的能力并没有在所有类似的工具中找到.

研究性质

与商业化的阿凡达发电服务不同,该项目的目的不是创建成品. 它的主要任务是 以展示技术能力并公布科学成果,而大多数替代品针对大众用户,提供简单的互动界面。

结论


RODIN扩散(RODIN Difusion),或称3D Avatar Difusion,是传播模型如何应用于三维字符生成任务的显著例子. 微软的开发在从照片或文本描述中创建详细的造型器方面显示出令人印象深刻的成果,并为行业开辟了新的视野. 然而,在现阶段,该项目仍然是实验室开发:不可能 访问微软网站并创建自己的阿凡达。 广大用户只能跟踪该技术的发展,等待在其基础上建立的商业产品出现.

创建游戏的个性化化化外观
虚拟现实的3D模型生成
字符原型
研究目标

常问问题

另见

3D 阿凡达传播 - 微软神经网络评论