Yandex Cloud Stackland — une nouvelle plateforme on‑premise de Yandex Cloud pour déployer une infrastructure conteneurisée et des services PaaS gérés dans le périmètre fermé de l'entreprise.

Qu'est-ce que c'est ?

C'est une plateforme intégrée qui s'installe sur votre matériel ou votre virtualisation (propre ou louée) et fonctionne dans le périmètre de l'entreprise.

En substance, c'est un « cloud dans votre datacenter » : cluster Kubernetes + bases de données gérées + stockage objet S3 + services Yandex Cloud on‑premises.

Base technologique

Elle repose sur Kubernetes, ce qui permet d'utiliser des approches familières pour le déploiement de microservices, Helm, GitOps, etc.

Elle comprend un OS spécialisé pour les charges conteneurisées, IAM, politiques de sécurité, gestion des secrets, console unifiée (UI) avec modes administrateur et utilisateur.

Services intégrés

Bases de données gérées : PostgreSQL, ClickHouse, Kafka, plus des bases vectorielles pour les scénarios RAG ; OpenSearch et Trino sont prévus.

Stockage objet S3 pour documents, médias, sauvegardes, logs et données pour charges IA.

Services on‑prem Yandex Cloud : déjà disponibles SpeechSense (analyse vocale) et DataLens (BI), bientôt Yandex AI Studio pour le développement d'applications IA et d'agents.

Focus sur l'IA et l'analyse

Il existe des outils de gestion d'accès aux GPU et aux réseaux haute performance (par exemple InfiniBand) pour les tâches d'inférence et les charges IA distribuées.

La plateforme est positionnée comme le noyau d'une plateforme développeur interne (Internal Developer Platform) pour une infrastructure hybride : une partie des charges dans le périmètre privé, une autre dans le cloud public.

Licences et cas d'utilisation

Elle est fournie comme un produit en boîte avec une licence à durée déterminée ou perpétuelle, la licence est calculée en fonction du nombre de cœurs CPU ; tous les composants d'infrastructure sont inclus dans la licence, tandis que des éléments comme AI Studio, DataLens, SpeechSense sont achetés séparément.

Principaux cas d'utilisation : lancement et mise à l'échelle d'applications microservices et IA dans un périmètre fermé, construction de plateformes cloud internes, de services web d'entreprise, de vitrines analytiques et de solutions RAG.