• Revelado na segunda-feira, a Anthropic lançou um novo programa para financiar o desenvolvimento de novos benchmarks capazes de avaliar o desempenho e o impacto dos modelos de IA.
  • Os novos benchmarks que a Anthropic espera criar se concentram mais na segurança e no impacto social da inteligência artificial, mas considerando as ambições comerciais da empresa na concorrência da IA, suas ações podem ter outros objetivos.

NOSSA OPINIÃO
Anthropic lançou um programa de desenvolvimento de benchmarks de IA, financiando organizações terceiras para avaliar o desempenho e o impacto dos modelos, com o objetivo de melhorar a segurança da IA. No entanto, suas ambições comerciais são questionáveis e existem pontos de vista divergentes sobre a percepção dos riscos relacionados à IA. Embora os esforços sejam louváveis, o alcance universal desses benchmarks ainda precisa ser observado e seu valor deve ser continuamente avaliado.

–Jasmine Zhang, jornalista da BTW

O que aconteceu

Anthropicanunciou o lançamento de um programa para financiar o desenvolvimento de novos benchmarks para avaliar o desempenho e o impacto dos modelos de IA. O plano foi anunciado na segunda-feira e fornecerá suporte financeiro a organizações terceiras capazes de medir eficazmente as capacidades avançadas dos modelos de IA.

Anthropic declarou em seu blog oficial que esse investimento visa fortalecer todo o campo da segurança da IA e fornecer ferramentas valiosas que beneficiam todo o ecossistema. O desenvolvimento de avaliações de alta qualidade relacionadas à segurança continua difícil e a demanda supera em muito a oferta. Os benchmarks atuais de IA apresentam lacunas que tornam difícil refletir o uso real do sistema pelas pessoas comuns, e também é questionável se alguns benchmarks antigos realmente mediram o conteúdo reivindicado.

A solução proposta pela Anthropic é criar benchmarks rigorosos focados na segurança da IA e no impacto social, por meio de novas ferramentas, infraestruturas e métodos. A empresa pede especificamente o desenvolvimento e a avaliação de modelos para testar capacidades de ciberataques, aprimoramento de armas de destruição em massa e manipulação ou engano de humanos. Para os riscos da IA relacionados à segurança nacional e defesa, a Anthropic prometeu desenvolver um 'sistema de alerta precoce', mas não divulgou detalhes específicos no blog.

Leia também:Schneider e NVIDIA vão construir um design de data center 'benchmark' para IA

Leia também:Anthropic afirma que seu último modelo é o melhor da categoria

Por que isso é importante

Atualmente, a pesquisa, o desenvolvimento e a regulamentação da inteligência artificial estão todos em uma fase de rápido desenvolvimento. Os esforços da Anthropic para apoiar os novos benchmarks de IA são inovadores e, até certo ponto, sem contrapartida, o que é certamente louvável.

No entanto, vale notar que, dadas as ambições comerciais da empresa na concorrência da inteligência artificial, devemos permanecer céticos quanto aos novos benchmarks fornecidos pela Anthropic.

Algumas pessoas na comunidade de inteligência artificial também contestam os riscos 'catastróficos' e 'enganosos' da inteligência artificial mencionados pela Anthropic.Muitos especialistasargumentam que há poucas evidências sugerindo que a inteligência artificial adquirirá a capacidade de acabar com o mundo e superar a humanidade em curto prazo. Portanto, ainda há espaço para discussão sobre se os esforços da Anthropic para criar novos benchmarks de IA têm alcance universal, se suas ações têm interesse próprio na obtenção de lucros e se os resultados de detecção dos novos benchmarks têm valor de referência.