Skip to content

Présentation du projet⚓︎

Ce portail de ressources est destiné à vous apporter une aide à l'utilisation du cloud Openstack proposé par la DSI INRAE.

Le Cloud, qu'est-ce que c'est ?⚓︎

Attention

"Openstack qu'est ce que c'est ?" Côté INRAE, le Cloud englobe beaucoup plus de chose, se recentrer sur Openstack

C'est un service d'infrastructures à la demande (IAAS) qui fournit des ressources de traitement, du stockage et du réseau à la demande.

IAAS

Les caractéristiques essentielles proposées par un service "Cloud" sont:

  • self service = à la demande
  • accès réseau
  • mutualisation des ressources
  • ressources élastiques
  • compatible "infrastructure as code"

Le cloud DSI INRAE⚓︎

La solution Cloud Openstack a été retenue.

La version opérée actuellement est Openstack en version ANTELOPE, déployé avec RedHat Openstack Services on Openshift.
Avec les modules principaux suivants :

  • Keystone -> authentification LDAP
  • Nova -> gestion des instances, sous KVM
  • Neutron -> gestion du réseau
  • Glance -> gestion des images et modèles d'instances (sous CEPH)
  • Cinder -> volumes des instances (sous CEPH)
  • Horizon -> portail web (base Apache)
  • Heat -> module d'orchestration
  • Octavia -> module loabalancer as-a-service

A éditer ?

Les ressources matérielles sur lesquelles le service est construit : 1 plateforme de production dans le datacenter TLS

  • XX sur prod tls
  • XX To sur prod tls
  • 50 To de stockage en mode bloc via du CEPH
  • 2 subnets (/23) d'adresses IP flottantes pour les projets par régions.
  • Hyperviseurs dédiés à des VMs équipées de cartes GPU physiques (pour l'instant en attachement direct, soit toutes les ressources de la carte GPU en plein accès à la carte, on ne peut pas actuellement donner qu'une partie des ressources de la carte GPU, cf [Multi-Instance GPU] (https://www.run.ai/guides/nvidia-a100).

Ces hyperviseurs GPU sont équipés de 3 cartes nvidia A100 40GB ou nvidia H200 NVL chacun. Ce type de carte sous architecture Ampere ne nous permet pas d’exécuter du rendu graphique, c'est adapté pour de l'analyse de data, entraînement de modèles d'IA, mais ne doit être utilisé qu'au travers de frameworks de type Cuda, TensorFlow, Pytorch, ... Ce ne sont pas des cartes grand public !

Nous disposons également d'une plateforme de préproduction qui ne sont pas ouvertes aux unités. Infrastructure de préprod iso conf avec la prod mais avec peu d'hyperviseurs et ressources moins performantes. -> Pas forcement nécessaire de le specifier

Ressources mises à disposition⚓︎

Les ressources Cloud mises à disposition d'un projet correspondent à une salle serveurs virtuelle. Les utilisateurs bénéficient d'une autonomie dans la gestion de cette salle. Ils héritent en conséquence des responsabilités associées.

Chaque projet est créé avec les quotas de ressources par défaut suivants :

  • 50 instances
  • 50 Go RAM
  • 50 vCPU
  • 2 To de stockage
  • 3 adresses IP flottantes

L'occupation de ces quotas et les ressources encore disponibles sont affichées sur le tableau de bord du projet. Ces quotas vous sont demandés dans le formulaire ARIANE lors de la souscription au service.

Attention

Des ouvertures de flux réseau sont disponibles par défaut vers les instances créées :

  • Pour une exposition en zone privée, les protocoles HTTP, HTTPS, SSH, RDP et ICMP sont ouverts à tout INRAE (et accessibles via VPN depuis l'extérieur).
  • Pour une exposition en zone publique, les protocoles HTTP, HTTPS, SSH, RDP et ICMP sont ouverts à tout Internet.

Les autres ouvertures doivent faire l'objet de demandes spécifiques.