AvatarCLIP

免费

使用文本描述创建和动画 3D 变形符的框架 .

433视图
访问网站

概览

AvatarCLIP 神经网络描述

AvatarCLIP是一个实验性的以文字为基础的框架,将3D可视化的创作和动画融合为一个单一的工作流程. 用户与其手动给每个多边形建模并设置骨架,不如用词来描述所期望的结果——神经网络将自然语言转换为几何,纹理,运动序列.

该工具作为Colab笔记本执行,这意味着不需要强大的本地硬件. 生成和动画过程发生在Google的云环境,用户通过浏览器工作. AvatarCLIP的主要目标是为那些缺乏专门教育但想获得个性化数字字符的人降低入场障碍为3D建模.

如何运作

系统采用几种机器学习模式的组合,处理文本查询,并逐步构建出相机. 首先,形成一个基体外形,再应用出纹理,而后才被制作出与运动描述相匹配的动画. 所有阶段都完全由文本提示驱动。

阿凡达CLIP 特征

特征数值
工具类型研究框架
主要目的从文字描述中创建 三维活字和动画
启动格式Colab 笔记本(以云为基础的)
需要安装没有
交互语言自然( 文本命令)
目标受众非专业用户
分发模式免费

阿凡达CLIP适合谁?

初学者 三维艺人

学习3D图形的人还没有掌握Blender或Maya等复杂包,可以使用AvatarCLIP作为快速想法原型化的工具. 与其花几个小时在模型上工作,他们可以在几分钟内获得基本结果.

游戏开发者和Indie工作室

小团队往往缺乏专用的3D模型和动画师的资源. AvatarCLIP允许他们以最低的成本为早期的项目版本创建草稿字符,测试概念,并用背景字符填充场景.

研究人员和学生

对于学术实验,研究基因图形方法,或者创建演示材料,这个框架可以作为结合3D渲染应用CLIP架构的明确例子. 代码开放供研究和修改.

如何使用AvatarCLIP

云发射

由于该工具作为Colab笔记本来分发,整个过程都下来打开笔记本并相继运行代码单元格. 不需要安装驱动程序,配置环境,或担心库兼容性——环境是自动设置的.

形成查询

用户在文本中描述avatar及其动作. 例如,您可以指定想要的服装,身体类型,发型,同时定义一个动作——舞蹈,跑步,或者手势. 措辞越准确,结果就越可以预测。 生成完成后,可以标准3D格式下载模型.

惯性改进

如果需要,可以通过修改文本重新生成结果. 这使得无需手工几何编辑即可通过选项快速地活化. 多种描述不同的尝试产生了一系列可供选择的替代模型.

AvatarCLIP 的关键特性

形状和纹理生成

框架根据文本描述从头创建出3D网格. 身体形状,面部特征,服装,和颜色方案都是根据对查询的语义理解而形成的.

语义动画

神通运动不是通过键框定义的. 取而代之的是神经网络解释动作描述并生成与文字相匹配的姿势序列. 这区分了工具与经典动画包.

云彩画

所有计算都在Google的服务器上进行. 用户不需要高VRAM图形卡——稳定的互联网连接和浏览器就足够了.

阿凡达CLIP 优点

低入门障碍

所需要的就是能够提出文本查询. 不需要具备3D模型、紫外线脱接或操纵的专业知识。 这为广大观众打开了工具.

节省时间

使用经典方法创建阿凡达可以花上几个小时到几天的时间. AvatarCLIP将这个过程缩短为分数,这在测试假说和想法时特别有用.

完全免费

该工具免费分发。 用户不支付订阅费或购买许可证. 需要的只是Colab的谷歌账户

弹性文本控制

同样的描述可以被精确地被曲折:改变发色,增加从属,或者改变运动的性质. 神经网络在保留其他参数的同时,只再生受影响的方面.

AvatarCLIP 缺点

对查询质量的依赖

结果因措辞不同而大相径庭。 抽象或模棱两可的描述可能导致无法预测的模型文物. 制定精确提示需要实践。

研究状况

AvatarCLIP是一种科学原型,不是商业产品. 错误,性能不稳定,或者支持有限都是可能的. 界面面向技术上具有熟练技术的用户,能够与科拉布的代码合作.

无精细手动调整

该工具没有为手工模型抛光提供传统仪器. 如果结果接近理想,但需要小调,这些需要用第三方3D编辑完成.

对云资源的需求

虽然不需要安装,但生成需要在Colab中分配一个虚拟GPU. 自由级对执行时间有限制,长会话可能会被中断.

神通CLIP有什么问题 解决?

字符原型

快速创建人物概念用于演示,投出,或内部评论. 设计师和制作人可以在不涉及3D部门的情况下将想法可视化.

以背景字符填充情景

游戏和虚拟世界中的背景人物往往不需要独特的细节. AvatarCLIP允许生成数量不切实际的多种相形相形的相相形相形相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相相

教育和示威

该工具可用于教育目的来解释基因模型原理,与CLIP架构合作,以及图形中文本界面的应用.

快速测试运动思维

不仅有静态模型,而且动画也由文字产生. 这使得在将资源投入专业运动生产之前,可以检查一个角色将如何看待行动.

AvatarCLIP 定价

该工具在"自由"模式下发售. 用户无需报名订阅或一次性支付使用费. 笔记本的取用是开放的,不过免费Colab级的标准限制(计算时间、内存和会话次数的限制)完全适用。

AvatarCLIP 使用条款

作为一个研究框架,AvatarCLIP没有常规意义上的正式商业许可证. 通过公共存储库进行分发,通过Colab访问意味着遵守Google Cloud的服务条款,包括可接受的内容政策。 用户不需要在单独的网站上注册,但需要通过Google账户的授权才能使用笔记本.

AvatarCLIP 可用性

框架作为打开的Colab笔记本可供任何操作系统的浏览器使用. 没有说明地理限制,但稳定运行需要获得谷歌服务. 该项目属于研究开发类别,因此无法保证持续运作或提供技术支持。

AvatarCLIP 与替代品的区别

作为基础的文本控制

经典的阿凡达创作工具需要手动与 meshes,骨架,和动画曲线相配合. AvatarCLIP完全消除了这个阶段,将相互作用转移到描述语言的平面上. 这与Blender,Maya,或ZBrush有着根本的区别.

无操纵器

与用户移动滑动器的参数化生成器不同,AvatarCLIP不提供图形雕塑工具. 整个过程由单词所驱动,同时简化入入和限制对细节的控制.

组合生成和动画

许多神经网络只产生静态模型,使用独立的系统来进行运动. AvatarCLIP在单一文本查询中结合了这两个任务——像Make Human或字符创建器这样的包需要单独的动画模块.

科学性质与产品导向

与具有持续基础设施和支持的商业解决方案不同,"AvatarCLIP"是一个开放的研究成果. 付费订阅服务也提供产品部分的类似能力,而这一框架仍然是免费的试验领域。

结论

AvatarCLIP是一个生动的例子,说明了文本界面如何能取代复杂的专业3D图形工具. 该工具使一个未准备好的用户能够在云环境中创建相机和动画,而无需安装软件. 尽管它的研究性质和对文本描述质量的依赖,但它完成了它的关键任务——展示并简化了基因3D图形的过程,使得它能够被广大的人所利用.

为游戏和虚拟世界创建 3D 变形器
快速动画原型
遗传模型的培训和研究

常问问题

另见

AvatarCLIP - 在文本中创建 3D 变形符