Résumé

  • Le 1er octobre, RE:AI, l’offre de Singtel, a lancé Token-as-a-Service (TaaS) : un point d’accès compatible avec l’API OpenAI pour accéder à plusieurs modèles, avec gestion des accès, routage, gouvernance et comptabilisation des jetons.
  • Selon la page produit, les requêtes peuvent être orientées selon le modèle, le coût, les performances et les exigences de souveraineté. La facturation se fait au jeton, marge de RE:AI incluse ; des tarifs privés sont proposés pour les volumes engagés.
  • Les documents publics examinés ne présentent ni grille tarifaire par modèle, ni comparaison indépendante des coûts, ni cartographie des fournisseurs et lieux de traitement pour chaque route, ni volumes d’utilisation TaaS attribués à un client nommé. Les économies et la souveraineté restent donc à vérifier.

La rareté n’est peut-être pas le jeton, mais la passerelle qui choisit le modèle destinataire, applique une politique, mesure l’usage et transforme celui-ci en facture. RE:AI propose de regrouper ces fonctions, avec un catalogue de modèles, plutôt que de multiplier intégrations et contrôles pour chaque fournisseur.

Selon Singtel, les entreprises peuvent apporter leurs propres modèles ou choisir des modèles à poids ouverts hébergés sur l’infrastructure RE:AI, ainsi que des modèles fermés d’Anthropic, OpenAI, AWS Bedrock et Azure dans le cadre d’un contrat unique. L’interface est présentée comme compatible avec l’API OpenAI. Chaque requête serait authentifiée, vérifiée au regard des droits, limitée en débit, mesurée et attribuée avant d’atteindre le modèle. Le routage pourrait tenir compte du modèle, du coût, des performances ou de la souveraineté.

Ce regroupement peut avoir une valeur opérationnelle même s’il ne réduit pas le tarif sous-jacent du modèle. Un point d’accès commun et des identifiants centralisés peuvent limiter les intégrations et revues de sécurité redondantes ; le routage peut diriger certaines tâches vers des options moins coûteuses ; la visibilité sur les jetons peut aider à repérer les usages lourds. Singtel affirme aussi que le client paie les jetons consommés, avec sa marge, sans facturer directement de GPU inactif. Mais une facture plus simple n’est pas nécessairement un coût total inférieur.

Le nombre de jetons ne dit pas si la réponse a résolu la tâche, combien de tentatives ont été nécessaires ni quel travail d’ingénierie et de contrôle l’a entourée.

Les parcours commerciaux et techniques sont différents. Un acheteur doit savoir, pour chaque modèle et usage autorisés, où s’exécute l’inférence, quel fournisseur reçoit les données, ce qui est conservé ou journalisé, comment fonctionne le basculement et comment le prix se compare à un achat direct. « Prêt pour la souveraineté » et le routage selon cette exigence sont des affirmations produit ; la page publique ne fournit pas de matrice permettant de vérifier la résidence pour chaque modèle fermé. Cette lacune n’établit pas qu’une route soit inadaptée : elle appelle une vérification contractuelle et technique.

Il ne faut pas non plus attribuer à TaaS la traction antérieure de RE:AI. En mai 2026, Singtel indiquait que RE:AI avait commencé sa commercialisation en janvier et enregistré des prises de commandes ; une offre d’emploi de septembre décrivait déjà une passerelle TaaS. Ces éléments précèdent le lancement d’octobre et ne démontrent ni revenus, ni usage, ni économies propres à TaaS.

Le bon test est le coût par tâche réussie, sur une charge réelle, avec un seuil défini de qualité et de latence. Il faut inclure les jetons d’entrée et de sortie, les nouvelles tentatives, le cache, la marge, le support, l’intégration, la sécurité et la sortie. En l’absence de tarifs et de données comparables, RE:AI propose un plan de contrôle crédible ; son avantage économique reste sans prix public.

Sources : annonce du 1er octobre ; page TaaS de RE:AI ; résultats FY26 de Singtel ; offre d’emploi du 9 septembre.