• Google revelou três novos modelos Gemma 2, incluindo o leve Gemma 2 2B, que supera modelos maiores com um número menor de parâmetros.
  • Simultaneamente, o ShieldGemma atua como um classificador de segurança, e o Gemma Scope oferece interpretabilidade aprimorada. Esses modelos são projetados para promover uma inteligência artificial mais segura, eficiente e transparente.

NOSSA OPINIÃO
Os novos modelos Gemma 2 do Google ilustram uma evolução em direção a uma IA mais eficiente, segura e transparente. Ao demonstrar que modelos menores podem superar modelos maiores, o Google desafia o status quo e promove o desenvolvimento responsável de IA. O foco em segurança e interpretabilidade é louvável, fomentando a confiança e uma adoção mais ampla.
–Vicky Wu, jornalista da BTW

O que aconteceu

Googlepublicou três novos modelos de sua família Gemma 2 de IA generativa, apresentados como menores, mais seguros e mais transparentes que seus equivalentes. Os novos modelos, Gemma 2 2B, ShieldGemma e Gemma Scope, são projetados para atender a diversas aplicações, priorizando segurança e interpretabilidade.

O Gemma 2 2B é ummodelo de linguagem grande(LLM) leve otimizado para execução em dispositivo local e licenciado para pesquisa e uso comercial. Apesar de apenas 2,6 bilhões de parâmetros, o Gemma 2 2B supera modelos maiores como GPT-3.5 da OpenAI e Mistral 8x7B da Mistral AI, conforme evidenciado por avaliações independentes. Ao contrário, o Gemma 2 2B demonstra a eficácia de técnicas avançadas de treinamento, arquiteturas superiores e dados de alta qualidade. O Google espera que isso incentive uma mudança em direção ao refinamento de modelos em vez do aumento de tamanho, e destaca a importância da compressão e destilação de modelos para uma IA mais acessível com menores requisitos computacionais.

O ShieldGemma é uma coleção de classificadores de segurança que detectam conteúdo tóxico, como discurso de ódio e material sexualmente explícito, filtrando prompts e conteúdo gerado. O Gemma Scope oferece maior transparência ao permitir que desenvolvedores examinem aspectos específicos dos modelos Gemma 2, tornando seu funcionamento interno mais interpretável.

Leia também:Apple utiliza chips do Google para treinamento de modelos de IA

Leia também:Órgão antitruste do Reino Unido examina parceria do Google com a Anthropic

Por que isso é importante

Essas divulgações ocorrem pouco depois de o Departamento de Comércio dos Estados Unidos ter aprovado modelos de IA abertos, destacando os benefícios de expandir a acessibilidade da IA generativa. Os novos modelos demonstram que tamanhos de parâmetros menores podem alcançar desempenho competitivo por meio de técnicas avançadas de treinamento e dados de alta qualidade, desafiando a ideia de que modelos maiores são sempre melhores.

Os modelos Gemma 2 do Google promovem boa vontade na comunidade de IA, assim como os modelos Llama da Meta, ao oferecer opções totalmente open source. O foco em segurança e interpretabilidade é crucial à medida que as organizações adotam cada vez mais tecnologias de IA, garantindo uma implantação responsável e ética.

A disponibilidade desses modelos marca um passo significativo em direção a uma IA mais acessível e responsável, podendo levar a uma mudança no foco da indústria, do tamanho bruto para o refinamento e otimização.