KAYTUS améliore MotusAI pour les usines à tokens d’IA agentique sur site
SINGAPOUR, 21 sept. 2026 (GLOBE NEWSWIRE) -- KAYTUS, l’un des principaux fournisseurs de solutions d’infrastructure pour l’IA, a annoncé aujourd’hui une mise à niveau majeure de MotusAI, sa plateforme d’IA destinée aux entreprises. Cette mise à niveau permet aux entreprises de concevoir, de gouverner et de faire évoluer leurs propres « usines à tokens » sur site, de déployer des agents d’IA en production et de conserver leurs données sensibles au sein de leur propre infrastructure, tout en réduisant de 30 à 50 % leurs coûts d’exploitation annuels liés aux tokens.
Le défi : déployer les agents d’IA à grande échelle tout en gardant le contrôle
À mesure que l’IA d’entreprise évolue, passant de simples requêtes adressées aux LLM à des systèmes autonomes multi-agents, les tokens deviennent la monnaie informatique qui alimente les principaux processus métier. Le déploiement à grande échelle de l’IA agentique au sein de l’entreprise fait émerger trois défis majeurs en matière d’infrastructure :
- Risques en matière de sécurité et de conformité : transférer du code source propriétaire, des données clients et des éléments essentiels de la logique métier par des services cloud publics et des API de LLM peut exposer des données sensibles et entraîner des risques de non-conformité réglementaire.
- Latence et fiabilité des services : le raisonnement multi-étapes des agents et l’orchestration des outils peuvent provoquer des pics de trafic imprévisibles. Sans mécanisme de planification élastique, les goulets d’étranglement au niveau des ressources de calcul allongent le délai avant le premier token (TTFT) et entraînent l’échec de certaines requêtes, compromettant ainsi les accords de niveau de service (SLA) et l’expérience utilisateur.
- Coûts des tokens non maîtrisés : l’utilisation des modèles sans suivi et l’absence de quotas par service entraînent une hausse des coûts liés aux API, laissant les entreprises sans visibilité claire sur les dépenses engagées par chaque unité métier.
MotusAI : une base solide pour une gestion de bout en bout du cycle de vie des tokens
MotusAI répond à ces défis grâce à une infrastructure sécurisée sur site qui unifie la production, la distribution et l’exploitation des tokens.
1. Souveraineté des données d’entreprise
MotusAI maintient le traitement de l’inférence, les poids des modèles et le contexte au sein du périmètre de sécurité de l’entreprise, éliminant ainsi les risques liés au recours au cloud public. Les organisations des secteurs des services financiers, de la santé et du secteur public peuvent ainsi déployer l’IA à grande échelle tout en gardant le contrôle de leurs données sensibles et de leurs politiques de conformité.
2. Qualité de service fiable
MotusAI transforme les clusters de GPU sur site en une infrastructure robuste pour la production de tokens, garantissant des temps de réponse d'une fraction de seconde, même lors des pics de demande :
- Inférence multi-tours à haut débit : la désagrégation Prefill-Decode (PD), la mise en cache dynamique des KV et le batching dynamique réduisent le TTFT et la latence de bout en bout, pour des interactions multi-tours instantanées et fluides.
- Résilience face aux pics de trafic : intégré à des moteurs d’inférence tels que vLLM et SGLang, MotusAI ajuste dynamiquement les ressources de calcul en fonction des données de télémétrie en temps réel relatives au TTFT, au nombre de tokens par seconde (TPS) et à l’utilisation des GPU. Lors des tests en conditions de production, la mise à l’échelle automatique s’est activée dans les 21 secondes suivant le pic de trafic et a porté la capacité à 16 instances en moins de deux minutes, rétablissant automatiquement le respect des SLA.
- Disponibilité avec auto-rétablissement : la surveillance en temps réel des clusters déclenche automatiquement le basculement en cas d’anomalie sur un nœud, garantissant une disponibilité continue, 24h/24 et 7j/7, pour les processus métier critiques reposant sur l’IA agentique.
3. Une passerelle d’API unifiée pour accélérer le développement de l’IA
La passerelle d’API de MotusAI, conçue pour répondre aux exigences des entreprises, simplifie le déploiement des modèles et leur accès par les équipes de développement internes :
- Changement de modèle transparent, sans modification du code : les API compatibles avec OpenAI permettent aux développeurs de connecter, de tester et de changer de modèle, qu’il soit open source ou commercial, sans modifier le code de leurs applications. Ils bénéficient ainsi d’une plus grande flexibilité et évitent l'enfermement propriétaire.
- Prise en charge de contextes à millions de tokens : le traitement natif des contextes longs permet d’analyser des documents complexes, de mener des raisonnements avancés et de générer automatiquement du code.
4. Gouvernance précise et réduction des coûts
MotusAI offre une visibilité de bout en bout sur les opérations afin d’optimiser l’utilisation des ressources de calcul et d’éviter leur gaspillage.
- Analyse des performances en temps réel : des tableaux de bord interactifs permettent de suivre la latence, le débit de tokens et l’efficacité du cache grâce aux indicateurs en temps réel de TTFT, de TPS et de taux de succès du cache, afin d’aider les équipes à évaluer la qualité de service et à optimiser l’utilisation des ressources de calcul.
- Mise en commun dynamique des ressources : le partitionnement précis des GPU et la planification intelligente des charges de travail optimisent l’utilisation du matériel, faisant passer le taux d’utilisation de 68,9 % à 95,7 % lors des tests de performance.
- Isolation multi-tenant et refacturation : les administrateurs peuvent définir des quotas par service, contrôler les accès et fixer des tarifs de facturation internes afin de mieux maîtriser et répartir les dépenses. Le filtrage des requêtes redondantes permet aux entreprises de réduire de 30 à 50 % leurs coûts d’exploitation annuels liés aux tokens.
Des résultats éprouvés en production dans le monde entier
MotusAI exécute des charges de travail d’IA dans des environnements de production d’entreprises et commerciaux sur différents marchés à travers le monde :
- Services financiers : une entreprise de technologie financière étrangère a remplacé sa plateforme existante par MotusAI sur huit serveurs GPU, permettant de proposer des services de tokens avec facturation à l’usage et une gouvernance centralisée pour les analyses de risques internes et la conformité en matière de sécurité.
- Fournisseurs de services cloud GPU : un fournisseur cloud japonais s’appuie sur MotusAI pour sa plateforme principale et propose à plus de 30 entreprises clientes des ressources GPU mutualisées ainsi que des processus de bout en bout pour l’entraînement et l’inférence.
- Opérateurs de cloud nouvelle génération : un fournisseur d’Asie du Sud-Est a choisi la solution intégrée de KAYTUS, combinant matériel et logiciels, plutôt que celle d’un concurrent international, en s’appuyant sur les fonctionnalités natives de MotusAI pour la gestion multi-tenant et la facturation.
« Les entreprises n’ont pas seulement besoin de davantage de GPU : elles doivent aussi pouvoir gouverner, facturer et faire évoluer leurs services de tokens de manière fiable », a déclaré Darren Cox, directeur général de KAYTUS Europe. « MotusAI fait le lien entre l’infrastructure matérielle et l’exploitation des tokens, permettant aux organisations d’exécuter leurs agents d’IA en toute sécurité au sein de leurs propres centres de données. »
Faire progresser l’IA d’entreprise à grande échelle
Avec MotusAI, KAYTUS permet une production d’IA sécurisée et à haut débit sur site, aidant les entreprises à protéger leurs données sensibles, à fonctionner indépendamment des API cloud et à optimiser davantage l’utilisation de leurs GPU. La plateforme MotusAI améliorée permet aux organisations du monde entier de déployer et de faire évoluer l’IA agentique de manière sécurisée et efficace.
À propos de KAYTUS
KAYTUS est un fournisseur de premier plan de solutions d’infrastructure pour l’intelligence artificielle et de technologies de refroidissement liquide. L’entreprise propose une large gamme de produits innovants, ouverts et respectueux de l’environnement destinés au cloud, à l’intelligence artificielle, à l’edge computing et à d’autres applications émergentes. Grâce à une approche centrée sur les besoins de ses clients, KAYTUS se distingue par sa capacité d’adaptation et la flexibilité de son modèle économique. Pour en savoir plus, rendez-vous sur KAYTUS.com ou suivez l’entreprise sur LinkedIn et X
Contact médias : media@kaytus.com


