Farm3D vs Text-To-4D
Al comparar Farm3D vs Text-To-4D, ¿cuál herramienta AI 3D Generation brilla con más intensidad? Examinamos precios, alternativas, votos positivos, características, opiniones, y más.
Entre Farm3D y Text-To-4D, ¿cuál es superior?
Cuando ponemos Farm3D y Text-To-4D uno al lado del otro, ambas siendo herramientas impulsadas por inteligencia artificial en la categoría de 3d generation, Text-To-4D es el claro ganador en términos de votos positivos. Text-To-4D ha obtenido 26 votos positivos, y Farm3D ha obtenido 6 votos positivos.
¿El resultado te hace pensar "mmm"? ¡Emite tu voto y cambia esa expresión!
Farm3D

¿Qué es Farm3D?
Farm3D es un método de investigación para la reconstrucción 3D de animales articulados a partir de una sola vista, desarrollado en la Universidad de Oxford y publicado en 3DV 2024. Le proporcionas una foto de un caballo, vaca o oveja y devuelve una forma 3D completa con textura en segundos, sin necesidad de entrenamiento con fotografías reales. La página del proyecto documenta el enfoque, muestra demostraciones de reconstrucción y enlaza al código y al conjunto de datos de referencia Animodel.
La mayoría de los generadores 3D requieren grandes conjuntos de datos 3D etiquetados o capturas multivista. Farm3D se entrena completamente con vistas sintéticas producidas por Stable Diffusion, y luego utiliza el mismo modelo de difusión como crítico durante el aprendizaje. Esto le permite recuperar detalles finos como patas y orejas en categorías que nunca vio en imágenes reales, lo cual es inusual para los procesos de reconstrucción monocular que dependen de supervisión del mundo real.
Investigadores que estudian formas 3D articuladas, ingenieros de visión por computadora que prototipan flujos de trabajo para activos animales y artistas 3D que exploran síntesis controlable encontrarán útiles las demostraciones y el código abierto. El método también soporta reiluminación, intercambio de texturas entre modelos de la misma categoría y animación esquelética una vez que se genera una forma.
Text-To-4D

¿Qué es Text-To-4D?
Text-To-4D es un proyecto de investigación de Meta AI (MAV3D) que genera escenas dinámicas tridimensionales a partir de descripciones de texto. El método utiliza un Campo Neural de Radiancia dinámico 4D optimizado para la apariencia, densidad y consistencia del movimiento mediante la consulta a un modelo de difusión de texto a video.
A diferencia de los generadores 3D estáticos que producen una sola malla, Text-To-4D crea escenas que se pueden ver desde cualquier ángulo de cámara y componer en otros entornos 3D. El enfoque no requiere datos de entrenamiento 3D o 4D; el modelo subyacente de texto a video se entrena solo con pares de texto-imagen y videos sin etiquetar.
La página del proyecto aloja muestras de demostración para indicaciones de texto a 4D como "un corgi jugando con una pelota" y conversiones de imagen a 4D a partir de fotos fijas. Es una muestra de investigación, no un producto comercial con API pública o registro. Investigadores y artistas 3D interesados en la generación de escenas dinámicas basadas en NeRF pueden explorar el artículo y las muestras en el sitio.
Farm3D Votos positivos
Text-To-4D Votos positivos
Farm3D Características principales
Reconstruye formas articuladas en 3D de animales a partir de una sola imagen en segundos
Entrena sin fotos reales mediante la destilación de vistas virtuales de Stable Diffusion
Factoriza cada instancia en forma, albedo, iluminación difusa y ambiental, punto de vista y dirección de la luz
Soporta relighting, intercambio de texturas entre modelos de la misma categoría y animación esquelética en activos generados
La referencia Animodel entrega mallas texturizadas de caballos, vacas y ovejas con poses articuladas realistas
Artículo aceptado en 3DV 2024; código y dataset publicados en GitHub bajo tomasjakab/animodel
Text-To-4D Características principales
Genera escenas dinámicas 3D a partir de indicaciones de texto mediante MAV3D (Make-A-Video3D)
NeRF dinámico 4D optimizado para apariencia, densidad y coherencia de movimiento
Visualiza escenas generadas desde cualquier ubicación y ángulo de cámara
Modo Imagen-a-4D convierte fotos fijas en escenas de video dinámico
Entrenado solo con pares de texto-imagen y videos sin etiquetar, no se requiere datos 3D/4D
Artículo de investigación publicado en arXiv (2301.11280) con muestras de demostración interactiva
Farm3D Categoría
- 3D Generation
Text-To-4D Categoría
- 3D Generation
Farm3D Tipo de tarificación
- Free
Text-To-4D Tipo de tarificación
- Free
