O Gemini 1.5 Pro do Google agora pode ouvir é perfilado pela BTW Media porque evidências publicadas o vinculam à infraestrutura da internet, governança, dependências operacionais ou visibilidade de mercado.
A atualização do Google para o Gemini 1.5 Pro permite que o modelo ouça. O modelo agora pode ouvir arquivos de áudio enviados e gerar informações a partir de conteúdos como chamadas de resultados ou áudio de vídeo, sem precisar de uma transcrição escrita. O Google também está disponibilizando o Gemini 1.5 Pro em prévia pública para usuários com acesso ao Vertex AI. Capaz de processar texto, código, vídeo e agora fluxos de áudio enviados, incluindo áudio de vídeos, o Gemini 1.5 Pro pode ouvir, analisar e extrair informações sem a necessidade de um registro escrito correspondente.
O Gemini 1.5 Pro é o robô renomeado do Google, anteriormente chamado de Bard, e o Gemini 1.5 Pro é a iteração mais recente do modelo, disponibilizada a um número limitado de desenvolvedores em fevereiro deste ano. O Google também anunciou que disponibilizará o Gemini 1.5 Pro ao público pela primeira vez através de sua plataforma de criação de aplicativos de IA, Vertex AI. O Gemini 1.5 Pro foi anunciado pela primeira vez em fevereiro. O Google compartilhou os detalhes da atualização durante sua conferência Cloud Next em Las Vegas.
Depois de classificar o Gemini Ultra LLM, que alimenta seu chatbot avançado Gemini, como o modelo mais poderoso da família Gemini, o Google agora designa o Gemini 1.5 Pro como seu modelo generativo mais poderoso. A empresa acrescenta que esta versão tem melhores capacidades de aprendizado e não requer nenhum ajuste adicional do modelo. O Gemini 1.5 Pro está documentado publicamente para usuários que não têm acesso ao Vertex AI. Leia também: A ferramenta de clonagem de voz da OpenAI imita sua voz com uma amostra de 15 segundos. Modelo de geração texto-imagem Imagen 2.
O Gemini 1.5 Pro não é o único grande modelo de IA a receber uma atualização do Google. O Imagen 2 é um modelo de geração texto-imagem que ajudará a melhorar as capacidades de geração de imagens do Gemini e também adicionará correções e reparos que permitirão aos usuários adicionar ou remover elementos de uma imagem. Muitos novos recursos do Imagen, especialmente em inpainting e outpainting, fazem parte de outros modelos de geração texto-imagem como o Stable Cascade da Stability AI e o Generative AI by iStock da Getty, sem esquecer uma disponibilidade pública mais ampla nos novos telefones Samsung Galaxy.
Briefing para membros
Contexto aprofundado da tendência
Faça login com o nível de assinatura correto para desbloquear o briefing completo e as notas das fontes.
Apenas para Strategic Circle
Strategic Circle
Aberto a todos os leitores. Desbloqueie Briefings de tendências após se inscrever e fazer login.
Junte-se ao Strategic CircleSomente para Leadership Alliance
Leadership Alliance
Para operadores, investidores e equipes de políticas públicas que precisam de evidências de relacionamento, caminhos de falha e notas de fontes. Faça login para desbloquear.
Junte-se ao Leadership AllianceInstantâneo
Guia de pontuação de confiança
Várias fontes públicas

