WorksheetsLinha do Tempo de Síntese de Imagem
Total questions: 20
Worksheet time: 15mins
Como é o nome da área de pesquisa e desta disciplina que você está cursando?
Computação Criativa
Programação Criativa
Criatividade e Computação
Criatividade Computacional
Computação e Criatividade
Qual o nome da técnica proposta por Katherine Crowson que é considerada a explosão cambriana para geração de imagens a partir de texto?
BigSleep + CLIP
BigGAN + CLIP
VQGAN
VQGAN + CLIP
CLIPGAN
Coloque em ordem cronológica.
GAN
CLIP
VQGAN+CLIP
Latent Diffusion
Stable Diffusion
Qual música de Reginal Rossi menciona "A pílula já existia, mas nem se falava"?
Em plena lua de mel
Garçon
A raposa e as uvas
Leviana
O que foi a LeNet e qual foi sua principal contribuição para o campo da Visão Computacional?
Uma rede neural para reconhecimento de voz falada considerando a dispersão espectral.
Uma das primeiras redes neurais convolucionais usada para reconhecimento de dígitos manuscritos.
Um algoritmo de otimização para redes neurais.
Uma ferramenta de software para processamento de vídeo.
Como funciona uma GAN (Generative Adversarial Network)?
Utiliza duas redes, uma para gerar dados e outra para discriminá-los, operando em um sistema de feedback.
Baseia-se em uma única rede neural que aprende a gerar e classificar imagens simultaneamente.
Usa redes neurais recursivas para gerar imagens.
Implementa algoritmos evolutivos para criar imagens realistas.
O que são modelos de difusão (diffusion models) e qual é o princípio básico por trás deles na geração de imagens?
São baseados na ideia de difundir gradualmente uma imagem até se tornar ruído, e depois reverter o processo.
Utilizam técnicas de compressão de imagem para gerar novas imagens.
São modelos que se baseiam em simulações físicas para gerar imagens.
Aplicam algoritmos de difusão de calor para criar padrões artísticos em imagens.
Complete a famosa frase da música de Conde do Brega: "Ninguém é perfeito e...
(a)
O que é a Stability.ai e qual é sua contribuição para o campo da IA Generativa?
Uma empresa especializada em sistemas de segurança baseados em IA Generativa.
Uma organização que oferece cursos e treinamentos em IA Generativa.
Uma empresa focada no desenvolvimento de tecnologias de IA Generativa, incluindo modelos de difusão.
Um grupo de pesquisa acadêmica focado em ética em IA Generativa.
O que significa a sigla CLIP?
Combinatorial Logic Influence Proof
Contrastive Language–Image Pretraining
Contrastive Language Intrinsic Preparation
Convolutional Language-Image Production
O que diferencia o modelo CLIP de outros modelos de IA em termos de aprendizado e aplicação?
Sua capacidade de aprender diretamente de texto e imagens.
Sua exclusiva utilização de dados de imagem.
A falta de necessidade de dados de treinamento.
Seu foco no processamento de linguagem natural, sem interação com imagens.
Quando o modelo CLIP recebe um texto e uma imagem, o que ele retorna como resultado?
Uma nova imagem gerada com base no texto fornecido.
Uma pontuação indicando quão bem o texto corresponde à imagem.
Uma versão editada da imagem para melhor corresponder ao texto.
Uma descrição detalhada do conteúdo da imagem.
O que é o LAION-400M?
Um banco de dados de código aberto de pares texto-imagem coletados de páginas da web aleatórias entre 2014 e 2021, filtrados através do CLIP da OpenAI.
Uma coleção de mais de 400 milhões de imagens geradas por IA para uso em pesquisa de visão computacional.
Uma ferramenta de software lançada em 2021 para análise de grandes conjuntos de dados de imagem.
Um projeto de pesquisa focado em entender a evolução da web entre 2014 e 2021 através de imagens.
O que diferencia o modelo de Latent Diffusion dos modelos de difusão anteriores?
O Latent Diffusion opera diretamente no espaço de imagem (pixels), gerando imagens de alta resolução mais rapidamente.
Ele realiza a difusão no espaço latente e não no espaço de imagem (pixels), o que torna o processo mais eficiente em termos de computação.
O Latent Diffusion aplica algoritmos de aprendizado profundo mais avançados para uma qualidade de imagem superior.
Ele foi o primeiro a introduzir a ideia de reverter a difusão para gerar imagens.
O que é o Midjourney e qual é um de seus aspectos distintivos em relação a outros modelos de texto para imagem?
Midjourney é uma plataforma aberta de geração de texto para imagem que utiliza algoritmos de aprendizado não supervisionado para criar imagens.
É um modelo fechado de texto para imagem que utiliza uma métrica de estética para selecionar imagens de sua base de treinamento.
Midjourney é uma ferramenta de edição de imagem baseada em GAN que melhora automaticamente a qualidade das imagens.
É um software de modelagem 3D que gera imagens com base em descrições de texto, focando em precisão geométrica.
O que é o deforum?
É um software que se especializa em criar modelos 3D realistas usando o Stable Diffusion.
É uma ferramenta que utiliza o Stable Diffusion para gerar animações, interpolando entre diferentes prompts para criar uma sequência animada.
É um software que se especializa em criar modelos 3D realistas usando o Stable Diffusion.
Uma plataforma de realidade aumentada que integra o Stable Diffusion para criar interações em tempo real.
O que é a funcionalidade img2img no contexto do Stable Diffusion?
É uma técnica que converte imagens em texto descritivo, usando o modelo Stable Diffusion.
Refere-se à capacidade de transformar uma imagem existente em uma nova, com base em uma descrição textual fornecida.
Trata-se de um processo de comparação de duas imagens para identificar diferenças, utilizando o Stable Diffusion.
É um método de compressão de imagem que reduz o tamanho do arquivo sem perda de qualidade, implementado no Stable Diffusion.
Qual é a principal característica do ControlNet e como ele aprimora a funcionalidade img2img?
É um módulo de realidade aumentada que integra elementos virtuais em imagens reais processadas pelo img2img.
É uma ferramenta de filtragem de imagem que remove elementos indesejados em imagens geradas pelo img2img.
Permite maior controle sobre a estrutura da imagem no processo img2img, facilitando ajustes mais precisos na geração de imagens.
É um sistema de otimização de imagem que melhora a resolução das imagens.
