Resumo

  • Em 1º de outubro, a RE:AI, da Singtel, lançou o Token-as-a-Service (TaaS): um endpoint compatível com a API da OpenAI para acessar modelos, com gestão de acesso, roteamento, governança e medição de tokens.
  • A página do produto diz que as solicitações podem ser direcionadas conforme modelo, custo, desempenho e requisitos de soberania. A cobrança é por token, com a margem da RE:AI; há preços privados para volumes contratados.
  • O material público consultado não traz tabela de preços por modelo, comparação independente de custos, mapa de fornecedores e locais de processamento para cada rota ou dados de uso de clientes identificados do TaaS. Economia e soberania seguem como hipóteses a testar, não como resultados demonstrados.

O item escasso talvez não seja o token, e sim o gateway que decide qual modelo recebe cada solicitação, quais políticas se aplicam, como o consumo é medido e o que chega à fatura. A RE:AI oferece esse conjunto junto a um catálogo de modelos, em vez de exigir uma integração e controles separados para cada provedor.

Segundo a empresa, o cliente pode trazer seus próprios modelos ou usar modelos de pesos abertos na infraestrutura da RE:AI, além de modelos fechados da Anthropic, OpenAI, AWS Bedrock e Azure sob um único contrato. A interface é descrita como compatível com a API da OpenAI. A página afirma que cada solicitação é autenticada, verificada quanto a permissões, limitada por taxa, medida e atribuída antes de chegar ao modelo. O roteamento pode levar em conta modelo, custo, desempenho e soberania.

Esse pacote pode gerar valor operacional mesmo sem reduzir o preço do modelo. Um endpoint comum e credenciais centralizadas podem diminuir trabalho duplicado de integração e segurança; o roteamento pode direcionar tarefas adequadas a opções menos caras; a visibilidade sobre tokens pode revelar consumos excessivos. A Singtel também diz que o cliente paga pelo uso, com sua margem, sem cobrança direta por GPU ociosa. Mas simplificar a conta não é o mesmo que baixar o custo total. A quantidade de tokens não diz se a resposta resolveu a tarefa, quantas tentativas foram necessárias ou quanto custaram a engenharia e a revisão.

A falta de dados públicos importa porque o serviço conecta caminhos comerciais e infraestruturas diferentes. Para cada modelo e tipo de uso, o comprador precisa saber onde ocorre a inferência, qual provedor recebe os dados, o que é registrado ou retido, como funciona a rota de contingência e como o preço se compara à contratação direta. “Pronto para soberania” e roteamento por soberania são afirmações do produto; a página não publica uma matriz que permita verificar a residência de dados para cada modelo fechado. Isso não prova que uma rota seja inadequada: é uma questão para diligência contratual e técnica.

Também não se deve atribuir ao TaaS a tração anterior da RE:AI. Em maio de 2026, a Singtel informou que a RE:AI havia iniciado a comercialização em janeiro e conquistado clientes; uma vaga de setembro já descrevia um gateway TaaS. Ambos os registros antecedem o lançamento de outubro. Eles contextualizam o negócio mais amplo, mas não demonstram receita, uso ou economia específica do TaaS.

O teste adequado é o custo por tarefa concluída em uma carga real, com limites acordados de qualidade e latência. A comparação deve incluir tokens de entrada e saída, novas tentativas, cache, margem do serviço, suporte, integração, revisão de segurança e saída. Sem preços e dados comparáveis, a RE:AI apresenta uma proposta plausível de plano de controle, mas sua vantagem econômica ainda não tem preço público.

Fontes: anúncio de 1º de outubro; página do TaaS da RE:AI; resultados FY26 da Singtel; vaga publicada em 9 de setembro.