[ad_1]
É tudo IA o tempo todo no Google I/O! Hoje, o Google anunciou seus novos mecanismos de criação de mídia com IA: Veo, que pode produzir vídeos 1080p de “alta qualidade”; e Imagen 3, sua mais recente estrutura de texto para imagem. Nenhum deles parece particularmente revolucionário, mas são uma forma de o Google continuar a lutar contra Modelo de vídeo Sora da OpenAI e Dall-E 3uma ferramenta que praticamente se tornou sinônimo de imagens geradas por IA.
O Google afirma que o Veo tem “uma compreensão avançada de linguagem natural e semântica visual” para criar qualquer vídeo que você tenha em mente. Os vídeos gerados por IA podem durar “mais de um minuto”. Veo também é capaz de compreender técnicas cinematográficas e visuais, como o conceito de timelapse. Mas, realmente, isso deveria ser uma aposta para um modelo de geração de vídeo de IA, certo?
Para provar que Veo não pretende roubar empregos de artistas, o Google também fez parceria com Donald Glover e Gilga, seu estúdio criativo, para mostrar as capacidades do modelo. Em um breve vídeo promocional, vemos Glover e sua equipe usando texto para criar um vídeo de um conversível chegando a uma casa europeia e de um veleiro deslizando pelo oceano. De acordo com o Google, o Veo pode simular a física do mundo real melhor do que seus modelos anteriores e também melhorou a forma como renderiza imagens em alta definição.
“Todo mundo vai se tornar diretor, e todo mundo deveria ser diretor”, diz Glover no vídeo, ganhando seu salário do Google. “No centro de tudo isso está apenas contar histórias. Quanto mais próximos estivermos de poder contar nossas histórias uns aos outros, mais nos entenderemos.”
Resta saber se alguém realmente vai querer assistir a vídeos gerados por IA, fora da curiosidade mórbida de ver uma máquina tentando recriar algoritmicamente o trabalho de artistas humanos. Mas isso não impede o Google ou a OpenAI de promover essas ferramentas e esperar que sejam úteis (ou pelo menos ganhem muito dinheiro). Veo estará disponível hoje na ferramenta VideoFX do Google para alguns criadores, e a empresa diz que também estará disponível no YouTube Shorts e outros produtos. Se o Veo acabar se tornando uma parte integrante do YouTube Shorts, esse é pelo menos um recurso que o Google pode dominar no TikTok.
Quanto ao Imagen 3, o Google está fazendo as promessas habituais: é considerado o modelo de texto para imagem de “mais alta qualidade” da empresa, com “nível incrível de detalhe” para “imagens fotorrealistas e realistas” e menos artefatos. O verdadeiro teste, é claro, será ver como ele lida com prompts em comparação com o Dall-E 3. O Imagen 3 lida com texto melhor do que antes, diz o Google, e também é mais inteligente no tratamento de detalhes de prompts longos.
O Google também está trabalhando com artistas como Wyclef Jean e Bjorn para testar seu Music AI Sandbox, um conjunto de ferramentas que pode ajudar na criação de músicas e batidas. Vimos apenas um breve vislumbre disso, mas isso levou a algumas demonstrações intrigantes:
O sol nasce e se põe. Estamos todos morrendo lentamente. E a IA está ficando mais inteligente a cada dia. Essa parece ser a grande conclusão das mais recentes ferramentas de criação de mídia do Google. Claro que estão melhorando! O Google está investindo bilhões para tornar realidade o sonho da IA, tudo em uma tentativa de possuir o próximo grande salto para a computação. Alguma dessas coisas realmente tornará nossas vidas melhores? Será que algum dia serão capazes de gerar arte com alma genuína? Volte ao Google I/O todos os anos até que o AGI realmente apareça ou nossa civilização entre em colapso.
Em desenvolvimento…
Fique por dentro de todas as novidades do Google I/O 2024 direito aqui!
[ad_2]
Fonte:
