Make-A-Character是什么?一文让你看懂Make-A-Character的技术原理、主要功能、应用场景

来源:卓商AI
发布时间:2025-04-05

Make-A-Character是什么?

Make-A-Character(简称Mach)是一个由阿里集团智能计算研究院开发的一个人工智能3D数字人生成框架,旨在通过文本描述快速创建逼真的3D角色。该系统特别适用于满足人工智能代理和元宇宙中对个性化和富有表现力的3D角色的需求。Mach的核心功能是利用大型语言和视觉模型来理解文本中的意图,并生成中间图像,然后通过一系列针对人类视觉感知和3D生成的模块,将这些图像转化为完整的3D角色模型。

Make-A-Character的官网入口

    官方项目主页:https://human3daigc.github.io/MACH/

    Arxiv研究论文:https://arxiv.org/abs/2312.15430

    GitHub代码库:https://github.com/Human3DAIGC/Make-A-Character(代码待开源)

    ModelScope Demo:https://www.modelscope.cn/studios/XR-3D/InstructDynamicAvatar/summary

    Make-A-Character的功能特色

      文本到3D角色生成:用户可以通过输入文本描述来指定角色的外观特征,如面部特征、发型、服装等,Mach系统会根据这些描述生成相应的3D角色模型。

      灵活的可控定制:系统允许用户对角色进行详细的定制,包括面部特征、眼睛形状、虹膜颜色、发型和颜色、眉毛、嘴巴和鼻子等,甚至可以添加皱纹和雀斑,以创造出符合用户个性化需求的角色。

      高度逼真的渲染:Mach利用基于物理的渲染(PBR)技术,结合真实人类扫描数据,生成高度逼真的角色。角色的头发以发丝的形式构建,而非传统的网格,以增强真实感。

      完整的角色模型:生成的角色模型包括眼睛、舌头、牙齿、全身和服装等所有细节,确保角色在各种应用场景中都能立即使用。

      动画支持:角色配备了高级的骨骼刚体,支持标准动画,使得角色能够进行各种动态表现,如面部表情变化等。

      行业兼容性:Mach生成的角色模型采用明确的3D表示,可以无缝集成到游戏和电影行业的标准CG流程中,便于后续的动画制作和渲染。

      Make-A-Character的工作原理

      文本解析与视觉提示生成:

      用户输入描述角色特征的文本提示。

      使用大型语言大模型(LLM)来理解文本中的语义信息,提取关键的面部特征和属性。

      将这些特征映射到视觉线索,如姿势和边缘图,以指导后续的图像生成。

      参考肖像图像生成:

      结合Stable Diffusion模型和ControlNet,根据提取的视觉线索生成参考肖像图像。ControlNet确保生成的图像具有正面姿势和中性表情,便于后续的3D建模。

      使用Openpose和Canny边缘检测技术来确保面部特征的合理分布。

      密集面部坐标检测:

      利用密集面部坐标(431个坐标点)来重建面部和头部几何结构,这些坐标点比传统的68或98个坐标点更详细,覆盖整个头部。

      使用合成图像作为训练数据,通过多视角捕捉和处理流程生成这些坐标点。

      几何生成:

      根据参考肖像图像和密集面部坐标,重建头部几何结构。通过将3D网格映射到2D平面,实现对网格的优化。

      使用坐标投影损失和局部平滑约束来确保几何结构的准确性。

      纹理生成:

      使用可微渲染技术从参考图像中提取纹理,并通过多分辨率策略逐步生成高分辨率纹理。

      引入神经除光(de-lighting)方法,从纹理图像中去除不必要的照明效果,得到适合渲染的漫反射贴图。

      纹理修正与完成:

      对生成的漫反射贴图进行修正,解决眼睛、嘴巴和鼻孔等区域的不完美问题。

      使用面部解析算法提取错误区域的遮罩,并通过泊松融合(Poisson blending)技术与模板漫反射贴图合并,以改善视觉效果。

      头发生成:

      通过2D图像合成各种发型,然后基于这些图像进行3D发丝重建。

      使用先进的头发生成技术,如NeuralHDHair,训练模型并生成高质量的3D发丝。

      资产匹配:

      将生成的头部与预先制作的头发、身体、服装和配饰等资产进行匹配。

      使用CLIP文本编码器计算输入提示与资产标签之间的相似度,选择最匹配的资产。

      角色装配:

      将所有生成和匹配的部件组装成一个完整的3D角色模型。

      角色模型支持动画,可以通过骨骼刚体进行动态表现。

© 版权声明:本站所有原创文章版权均归卓商AI工具集及原创作者所有,未经允许任何个人、媒体、网站不得转载或以其他方式抄袭本站任何文章。
卓商AI
卓商AI

AI爱好者的一站式人工智能AI工具箱,累计收录全球10,000⁺好用的AI工具软件和网站,方便您更便捷的探索前沿的AI技术。本站持续更新好的AI应用,力争做全球排名前三的AI网址导航网站,欢迎您成为我们的一员。

猜你喜欢
  • storymania ai story generator
    storymania ai story generator 与AI -Power的平台与Storymania进行工艺吸引人的故事,旨在协助各个级别的作家。在干净,无广告的环境中享受无缝的编辑和类型定制。在创纪录...
  • ai anime generator 4
    ai anime generator 4 AI动漫发生器是一种尖端工具,非常适合希望轻松创造令人惊叹的动漫艺术的初学者。该发电机由AI技术提供支持,从艺术创作中汲取了猜测,并产生了高质量的结果...
  • aibooktools
    aibooktools 使用Aibooktools,您可以将书籍快速转化为可行的见解 - 所有这些都没有长时间的阅读或手动数据输入。凭借AI的力量,您可以充分利用自己喜欢的书...
  • Notion Sites
    Notion Sites Notion Sites 是一个简单易用的网站搭建工具,用户可以通过拖放式构建块快速创建个性化网站,无需编写复杂的HTML或代码。它提供了超过10,0...
  • RubricPro
    RubricPro RubricPro是一个利用人工智能技术帮助教师和学生进行评分和反馈的平台。它允许用户上传自己的评分标准(rubrics),然后批量评分学生的作业、论...
  • AI Cover Letter Creator
    AI Cover Letter Creator AI求职助手是一款使用人工智能技术生成个性化求职信的工具。用户只需提供自己的简历和职位描述,AI求职助手将自动生成定制的求职信。该工具提供方便快捷的方...
  • Talentscreener.ai
    Talentscreener.ai 人才评估器是一款AI自动化的候选人筛选工具,为数据驱动的招聘提供支持。通过分析候选人的简历、面试答案和评估测试的语言和语境,准确评估技能、经验、个性、...
  • 可灵 AI
    可灵 AI 可灵 AI 是一款集成了 AI 图像和视频创作功能的创意生产力平台。其主要优点在于快速生成多样风格的图片和高清视频,助力用户提升创作效率。产品定位于为...