Pular para o conteúdo principal

Briefing de sinais / Tendências globais de serviços em nuvem

Gemini 1.5 Pro do Google agora pode ouvir

O Gemini 1.5 Pro do Google agora pode ouvir arquivos de áudio enviados e gerar informações a partir de conteúdos como chamadas de resultados ou áudio de vídeo, sem transcrição escrita.

Gemini 1.5 Pro do Google agora pode ouvir

O Gemini 1.5 Pro do Google agora pode ouvir é perfilado pela BTW Media porque evidências publicadas o vinculam à infraestrutura da internet, governança, dependências operacionais ou visibilidade de mercado.

A atualização do Google para o Gemini 1.5 Pro permite que o modelo ouça. O modelo agora pode ouvir arquivos de áudio enviados e gerar informações a partir de conteúdos como chamadas de resultados ou áudio de vídeo, sem precisar de uma transcrição escrita. O Google também está disponibilizando o Gemini 1.5 Pro em prévia pública para usuários com acesso ao Vertex AI. Capaz de processar texto, código, vídeo e agora fluxos de áudio enviados, incluindo áudio de vídeos, o Gemini 1.5 Pro pode ouvir, analisar e extrair informações sem a necessidade de um registro escrito correspondente.

O Gemini 1.5 Pro é o robô renomeado do Google, anteriormente chamado de Bard, e o Gemini 1.5 Pro é a iteração mais recente do modelo, disponibilizada a um número limitado de desenvolvedores em fevereiro deste ano. O Google também anunciou que disponibilizará o Gemini 1.5 Pro ao público pela primeira vez através de sua plataforma de criação de aplicativos de IA, Vertex AI. O Gemini 1.5 Pro foi anunciado pela primeira vez em fevereiro. O Google compartilhou os detalhes da atualização durante sua conferência Cloud Next em Las Vegas.

Depois de classificar o Gemini Ultra LLM, que alimenta seu chatbot avançado Gemini, como o modelo mais poderoso da família Gemini, o Google agora designa o Gemini 1.5 Pro como seu modelo generativo mais poderoso. A empresa acrescenta que esta versão tem melhores capacidades de aprendizado e não requer nenhum ajuste adicional do modelo. O Gemini 1.5 Pro está documentado publicamente para usuários que não têm acesso ao Vertex AI. Leia também: A ferramenta de clonagem de voz da OpenAI imita sua voz com uma amostra de 15 segundos. Modelo de geração texto-imagem Imagen 2.

O Gemini 1.5 Pro não é o único grande modelo de IA a receber uma atualização do Google. O Imagen 2 é um modelo de geração texto-imagem que ajudará a melhorar as capacidades de geração de imagens do Gemini e também adicionará correções e reparos que permitirão aos usuários adicionar ou remover elementos de uma imagem. Muitos novos recursos do Imagen, especialmente em inpainting e outpainting, fazem parte de outros modelos de geração texto-imagem como o Stable Cascade da Stability AI e o Generative AI by iStock da Getty, sem esquecer uma disponibilidade pública mais ampla nos novos telefones Samsung Galaxy.

Briefing para membros

Contexto aprofundado da tendência

Faça login com o nível de assinatura correto para desbloquear o briefing completo e as notas das fontes.

Apenas para Strategic Circle

Strategic Circle

Aberto a todos os leitores. Desbloqueie Briefings de tendências após se inscrever e fazer login.

Junte-se ao Strategic Circle

Somente para Leadership Alliance

Leadership Alliance

Para operadores, investidores e equipes de políticas públicas que precisam de evidências de relacionamento, caminhos de falha e notas de fontes. Faça login para desbloquear.

Junte-se ao Leadership Alliance
Instantâneo
Confiança
Guia de pontuação de confiança
Confiança limitada (82%)

Várias fontes públicas

VoltarMais cobertura: Tendências globais de serviços em nuvem