Résumé

  • À l'IBC, ZTE a présenté un ensemble associant télévision interactive, inférence distribuée et services domestiques.
  • Le réseau existant peut faciliter l'accès au client ; sa rentabilité comme infrastructure d'IA reste à démontrer.

Le téléviseur occupe déjà une place que beaucoup de services numériques cherchent à conquérir : il est installé chez le client. ZTE propose d'en faire davantage qu'un écran de diffusion. Pour l'opérateur, la promesse est séduisante. Mais élargir les usages ne suffit pas à élargir la marge.

Dans son annonce du 12 septembre à Amsterdam, ZTE réunit trois briques : AI EPG+, une interface de programmes pilotée notamment par la voix ; AIDN, pour AI Delivery Network ; et Smart Home, fondé sur la Smart Home AI Platform. Recherche de contenus, assistance, interactions sportives et commandes domestiques figurent parmi les usages décrits. Le communiqué évoque aussi le raccordement à des partenaires de contenus et à des services de grands modèles de langage.

Il s'agit de capacités annoncées par le fournisseur. Le texte ne présente ni client opérateur payant nommé, ni grille tarifaire, ni calendrier de déploiement, ni résultat commercial mesuré. Il ne permet donc pas de transformer une démonstration de possibilités en prévision de recettes.

Le réseau de diffusion change de métier

AIDN doit, selon ZTE, s'appuyer sur l'ordonnancement, les sites distribués et les ressources de cache des CDN des opérateurs pour rapprocher l'inférence des utilisateurs. Cette implantation est un atout possible : une partie de l'organisation nécessaire pour desservir les foyers existe déjà. Reste à savoir quels moyens de calcul il faut ajouter et avec quelle utilisation.

Un serveur proche peut faire attendre. Le guide de traitement par lots de NVIDIA Triton décrit, pour les modèles compatibles, le compromis entre regroupement des requêtes, débit et délai d'attente. Son guide d'optimisation souligne aussi qu'ajouter des instances de modèle ne produit pas un gain automatique. Ces documents donnent un cadre de mesure ; ils ne prouvent pas que ZTE emploie Triton et ne constituent pas un test d'AIDN.

Le mot « cache » demande la même prudence. Dans le mécanisme de cache de réponses documenté par Triton, la réutilisation dépend du modèle, de sa version et des entrées. Si les requêtes sont principalement uniques, le coût du cache peut devenir défavorable. Ce cas ne résume pas toutes les techniques de cache de l'IA. Il rappelle néanmoins qu'une réserve de vidéos populaires n'établit pas, à elle seule, la réutilisabilité de conversations différentes.

ZTE revendique des économies et une meilleure réactivité, mais ne livre pas ici de comparaison à charge équivalente. Pour un opérateur, le coût intéressant est celui de l'action aboutie, pas seulement du jeton produit. Une réponse rapide qui ne règle pas un problème peut encore déboucher sur un appel au service client.

L'interface pourrait renforcer la relation commerciale de l'opérateur. La preuve décisive sera cependant de rendre un service utile sans absorber, en calcul et en assistance, la valeur qu'il apporte.