[ad_1]
Google está lançando uma série de atualizações na frente de IA generativa, incluindo uma nova ferramenta de conversão de texto em imagem. O que há de diferente ImagemFX é que possui uma interface que apresenta “chips expressivos”. A ideia aqui é que isso o ajudará a “experimentar rapidamente dimensões adjacentes de sua criação e ideias”.
Juntamente com a estreia do ImageFX, o Google afirma que melhorou o MusicFX e o TextFX. A empresa afirma ter feito atualizações no modelo MusicLM que incluem geração mais rápida de música e áudio de maior qualidade, além de novos recursos. As músicas geradas agora podem durar até 70 segundos. Quanto a TextoFXo Google lançou atualizações de usabilidade com o objetivo de melhorar a navegação e a experiência geral do usuário.
Imagens e áudio gerados por ImageFX feitos com MusicFX são marcados por SynthID, uma marca d’água digital que visa deixar claro que estes são forjados usando IA, especialmente quando aparecem na Pesquisa ou no Chrome. As criações do ImageFX também incluirão metadados IPTC. Isso, segundo o Google, oferecerá “às pessoas mais informações sempre que encontrarem nossas imagens geradas por IA”
Pessoas nos EUA, Quênia, Nova Zelândia e Austrália podem experimentar essas ferramentas novas e renovadas no AI Test Kitchen a partir de hoje. Eles estão disponíveis apenas em inglês por enquanto.
O modelo Imagen 2 está potencializando os novos recursos de geração de imagens do ImageFX. É também a tecnologia que está impulsionando novas opções generativas de IA em Bard, Procurar, Anúncios, Duet AI no Workspace e Vertex AI. O Google afirma que o Imagen 2 ajuda a fornecer imagens geradas por IA da mais alta qualidade. A empresa observa que o modelo ajuda a manter as imagens livres de artefatos e melhora áreas de geração de imagens com as quais essas ferramentas têm lutado até agora.
Além disso, o Google afirma ter feito “investimentos significativos” no treinamento em segurança de dados do Imagen 2, ao mesmo tempo em que adicionou barreiras de proteção para “limitar resultados problemáticos, como violentos, ofensivos ou conteúdo sexualmente explícito bem como aplicar filtros para reduzir o risco de gerando imagens de indivíduos nomeados.” Isso se deve à capacidade atualizada do modelo de gerar imagens fotorrealistas. A empresa afirma que também realiza “extensos testes adversários” para detectar e reprimir conteúdo potencialmente problemático e prejudicial.
Em outro lugar, Gêmeos Pro em Bardo está mais amplamente disponível a partir de hoje. Isso é agora acessível em mais de 40 idiomas e ao norte de 230 países e territórios. Também a partir de hoje, o Google diz que as pessoas na maioria dos países podem gerar imagens em Bardo em inglês gratuitamente. Essas imagens incluirão marcas d’água SynthID.
[ad_2]
Fonte:
