Pular para o conteúdo principal
ToolPotion

LGM: Large Multi-View Gaussian Model

LGM é uma implementação oficial de um Large Multi-View Gaussian Model para criação de conteúdo 3D de alta resolução. Permite gerar ativos 3D detalhados a partir de imagens multi-view, com aplicações em fluxos de trabalho text-to-3D e image-to-3D. O projeto fornece código, pesos pré-treinados e scripts de inferência.

Visitar URL

Descrição

LGM, sigla para Large Multi-View Gaussian Model, é um framework avançado projetado para a criação de conteúdo 3D de alta resolução. Este projeto, apresentado na ECCV 2024 como um artigo Oral, oferece uma implementação robusta de um novo modelo Gaussiano capaz de gerar ativos 3D detalhados a partir de múltiplas visualizações de entrada. O cerne do LGM reside em sua capacidade de alavancar informações multi-view para reconstruir e renderizar cenas 3D complexas com fidelidade impressionante.

O projeto fornece um conjunto abrangente de ferramentas para pesquisadores e desenvolvedores interessados na geração de conteúdo 3D. Isso inclui o repositório oficial de código, pesos de modelo pré-treinados disponíveis para download e instruções claras para inferência. O LGM suporta pipelines de geração text-to-3D e image-to-3D, tornando-o uma ferramenta versátil para diversas aplicações criativas e técnicas. A implementação se baseia em pesquisas existentes em Gaussian splatting e técnicas de renderização neural, visando expandir os limites de qualidade e resolução na síntese 3D.

As principais capacidades do LGM incluem sua saída de alta resolução, permitindo a criação de modelos e cenas 3D detalhados. A arquitetura do modelo é otimizada para entradas multi-view, permitindo a reconstrução precisa de geometria e aparência. O projeto também oferece uma GUI local para visualização de arquivos PLY salvos e scripts para conversão de malha, facilitando a integração em fluxos de trabalho 3D existentes. Embora o conjunto de dados de treinamento seja baseado em AWS e não seja diretamente transferível, o projeto fornece o framework de código de treinamento e um subconjunto filtrado do conjunto de dados Objaverse para usuários que desejam treinar seus próprios modelos.

O LGM é particularmente relevante para pesquisadores em visão computacional e gráficos, artistas 3D, desenvolvedores de jogos e qualquer pessoa envolvida na criação ou manipulação de ativos 3D. A natureza de código aberto do projeto e a documentação detalhada incentivam contribuições da comunidade e desenvolvimento adicional. A ênfase na saída de alta resolução e consistência multi-view posiciona o LGM como um avanço significativo no campo da modelagem 3D generativa.

Recursos principais de LGM: Large Multi-View Gaussian Model

  • Criação de conteúdo 3D de alta resolução

  • Implementação do Large Multi-View Gaussian Model

  • Suporta geração text-to-3D

  • Suporta geração image-to-3D

  • Código oficial e pesos pré-treinados fornecidos

  • Inclui scripts de inferência

  • GUI local para visualização de modelos 3D

  • Utilitários de conversão de malha

  • Baseado em técnicas de Gaussian Splatting

  • Artigo Oral na ECCV 2024

Primeiros passos com LGM: Large Multi-View Gaussian Model

  1. Clonar repositório: Obtenha o código LGM do GitHub.

  2. Instalar dependências: Configure os pacotes Python necessários, incluindo PyTorch e xformers.

  3. Baixar pesos: Obtenha checkpoints de modelo pré-treinados do Hugging Face.

  4. Configurar inferência: Especifique os caminhos de workspace e de teste para geração.

  5. Executar inferência: Execute o script `infer.py` para geração 3D.

  6. Visualizar resultados: Use `gui.py` para visualizar arquivos PLY gerados.

  7. Converter para malha: Utilize `convert.py` para extração de malha.

Casos de uso de LGM: Large Multi-View Gaussian Model

  • Geração de ativos 3D de alta resolução
  • Criação de conteúdo text-to-3D
  • Reconstrução image-to-3D
  • Conteúdo 3D para AR/VR
  • Ativos para desenvolvimento de jogos
  • Pesquisa em 3D generativo

Perguntas frequentes de LGM: Large Multi-View Gaussian Model

Avaliações de LGM: Large Multi-View Gaussian Model

Carregando...

Ferramentas de IA populares como LGM: Large Multi-View Gaussian Model

Repositórios de IA no GitHub

GaussianObject é um framework para reconstrução de objetos 3D de alta qualidade a partir de apenas quatro visualizações usando Gaussian splatting. Ele combina técnicas de visual…

Geradores de modelos 3D

Repositórios de IA no GitHub

MVDream é um modelo de difusão para geração 3D multi-visão, construído sobre o Stable Diffusion. Ele permite a criação de múltiplas imagens 2D de diferentes pontos de vista,…

Geradores de modelos 3D

Repositórios de IA no GitHub

Shap-E é um modelo de IA de código aberto da OpenAI que gera objetos 3D. Ele pode criar esses objetos condicionados a prompts de texto ou imagens de entrada. Esta ferramenta é…

Geradores de modelos 3D

Repositórios de IA no GitHub

Stable-DreamFusion é uma implementação em PyTorch do modelo text-to-3D DreamFusion, aproveitando Stable Diffusion para a geração de conteúdo 3D. Ele suporta text-to-3D,…

Geradores de modelos 3D

Apps de IA

3D AI Studio é um conjunto de ferramentas de IA que permite aos usuários transformar texto ou imagens em ativos 3D de alta qualidade rapidamente. Perfeito para criadores que…

Geradores de modelos 3D

Apps de IA

Imagen3D é uma ferramenta de IA que converte fotos em modelos 3D online, sem necessidade de habilidades em 3D. Ela gera modelos visualizáveis e compartilháveis com texturas PBR e…

Geradores de modelos 3D

Apps de IA

VARCO 3D é uma ferramenta impulsionada por IA que permite aos usuários criar e animar modelos 3D de alta qualidade a partir de texto ou imagens. É projetada para artistas e…

Geradores de modelos 3D

Apps de IA

SAM 3D é uma plataforma independente de terceiros que torna os modelos SAM 3D Objects e SAM 3D Body da Meta utilizáveis para reconstrução 3D a partir de uma única imagem,…

Geradores de modelos 3D