mo-di-diffusion on Hugging Face 对比 Drag Your GAN

比较 mo-di-diffusion on Hugging Face 和 Drag Your GAN,看看我们在功能、评论、定价、替代品、赞成票等方面比较哪个 AI Image Generation Model 工具更好。

哪一个更好?mo-di-diffusion on Hugging Face 还是 Drag Your GAN?

当我们比较mo-di-diffusion on Hugging Face和Drag Your GAN时,这两个都是AI驱动的image generation model工具, 社区已经发表了意见,Drag Your GAN以更多的赞成票领先。 Drag Your GAN的赞成票数为 8,而 mo-di-diffusion on Hugging Face 的赞成票数为 6。

不同意结果?投票支持您最喜欢的工具,帮助它获胜!

mo-di-diffusion on Hugging Face

mo-di-diffusion on Hugging Face

什么是 mo-di-diffusion on Hugging Face?

mo-di-diffusion 是一个在 Hugging Face 上微调的 Stable Diffusion 1.5 检查点,能够渲染具有现代动画电影风格的角色和场景。创作者 nitrosocke 使用 DreamBooth 对来自一家知名动画工作室的截图进行了训练,采用了先验保持损失和文本编码器训练,训练步数超过 9,000 步。将提示词中加入 modern disney style 令牌即可触发该美学效果。

通用的 SD 1.5 检查点旨在实现照片级真实感或广泛的插画风格。mo-di-diffusion 则专注于那种光滑的角色动画外观,这也是为什么游戏英雄、动物和风景的示例提示都偏向电影感而非摄影感。权重通过标准的 Diffusers StableDiffusionPipeline 加载,因此您可以在本地、Colab 或 Hugging Face Spaces 中运行,无需专有 API。

艺术家、爱好者和开发者在尝试角色概念时会使用 mo-di-diffusion,当他们希望获得类似迪士尼风格的渲染效果而不想委托定制模型训练时。模型卡附带 Python 示例代码、Gradio 演示链接,并注明了 ONNX、MPS 和 FLAX 导出选项。该模型可免费下载,采用 CreativeML OpenRAIL-M 许可证,允许商业使用,但需遵守许可证中的危害限制。

Drag Your GAN

Drag Your GAN

什么是 Drag Your GAN?

在综合视觉内容以满足用户需求的领域中,对生成对象的姿势,形状,表达和布局进行精确控制至关重要。控制生成对抗网络(GAN)的传统方法在培训或先前的3D模型期间依赖手动注释,通常缺乏不同应用所需的灵活性,精度和多功能性。

在我们的研究中,我们探索了一种创新且相对未知的GAN控制方法 - 以交互式方式“拖动”特定图像点以精确达到用户定义的目标点的能力(如图1所示)。这种方法导致了Draggan的发展,Draggan是一个新的框架,其中包括两个核心组成部分:

基于功能的运动监督:此组件通过基于功能的运动监督将图像中的点指向其预期的目标位置。

点跟踪:利用歧视性GAN功能,我们的新点跟踪技术不断定位手柄点的位置。

德拉格(Draggan)使用户能够以显着的精度变形图像,从而使姿势,形状,表达和布局在各种类别(例如动物,汽车,人类,人类,景观等)中操纵。这些操作发生在gan的学到的生成图像歧管中,从而产生了现实的输出,即使在遵循对象的刚性的同时,在生成遮挡的内容和变形形状等复杂场景中也是如此。

我们的全面评估涵盖了定性和定量比较,突出了Draggan在与图像操作和点跟踪有关的任务中的现有方法的优越性。此外,我们证明了其在通过gan倒置操纵现实世界图像的能力,展示了其在视觉内容合成和控制领域中各种实际应用的潜力。

mo-di-diffusion on Hugging Face 赞同数

6

Drag Your GAN 赞同数

8🏆

mo-di-diffusion on Hugging Face 顶级功能

  • 经过DreamBooth训练的微调Stable Diffusion 1.5权重,超过9000步

  • 触发词现代迪士尼风格激活动画工作室美学

  • 通过Hugging Face Diffusers StableDiffusionPipeline加载,附带示例Python代码

  • CreativeML OpenRAIL-M许可证允许商业再分发,但有限制

  • 模型页面有957个社区点赞和每月约1175次下载

  • 兼容Gradio Spaces、Colab笔记本和ONNX、MPS或FLAX导出

  • 示例提示文档CFG比例7,Euler a采样器,输出尺寸512px

Drag Your GAN 顶级功能

未列出顶级功能

mo-di-diffusion on Hugging Face 类别

    Image Generation Model

Drag Your GAN 类别

    Image Generation Model

mo-di-diffusion on Hugging Face 定价类型

    Free

Drag Your GAN 定价类型

    Free

mo-di-diffusion on Hugging Face 使用的技术

PyTorch
Diffusers
Stable Diffusion

Drag Your GAN 使用的技术

GANs
Debian

mo-di-diffusion on Hugging Face 标签

DreamBooth Fine-Tune
Text to Image
Animation Style
Open Weights
Disney Style Token
SD 1.5 Checkpoint
Hugging Face Model
Creative AI

Drag Your GAN 标签

GANs
Feature-based motion supervision
Point tracking
Image synthesis
Visual content manipulation
Image deformations
Realistic outputs
Machine learning research
Computer vision
Image processing
GAN inversion
By Rishit