LIBRE / Plateforme Déploiement et exploitation Limites délibérées

Plateforme

Commencez sur une machine. Évoluez volontairement.

Libre garde la voie locale par défaut légère, puis introduit une infrastructure partagée sous la forme d’un profil d’équipe explicite. Les coûts, la qualité, les journaux, la télémétrie, les sauvegardes et les preuves de basculement deviennent des éléments essentiels de l’exploitation du système.

Profils d’exécution explicites
Solo + équipe
Export OpenTelemetry
Optionnel
Exercice de basculement de la version
3 réplicas
01 Profils

Utilisez l’infrastructure dont le déploiement a réellement besoin.

Les modes solo et équipe sont des profils d’exploitation cohérents, pas un continuum caché. Le démarrage valide la forme choisie afin qu’un état partagé à moitié configuré ne se divise pas silencieusement entre plusieurs backends.

01.1 Solo

SQLite, fichiers locaux et travail intégré.

Le profil par défaut dessert une installation à un seul nœud avec persistance SQLite, stockage local des blobs et worker durable intégré : la voie directe pour les déploiements personnels et de petite taille.

01.2 Équipe

État partagé entre réplicas et workers.

Le profil d’équipe utilise PostgreSQL, la coordination Redis, un stockage de blobs chiffré compatible S3, la recherche vectorielle et des workers durables externes, avec des voies de déploiement Docker Compose et Helm.

01.3 Migration

Passez du mode solo par un processus intégré.

Une CLI de migration inventorie et copie une installation SQLite existante vers le profil d’équipe, avec des points de contrôle et des étapes d’application pouvant reprendre.

02 Durabilité + disponibilité

Traitez le travail comme un état récupérable, pas comme une connexion chanceuse.

Les opérations longues de chat et de média utilisent des tâches durables et des événements rejouables. Le profil d’équipe étend ce modèle aux réplicas de l’application et aux workers externes.

02.1 Travail durable

Reprenez les flux et récupérez les tâches acceptées.

Les réponses sont enregistrées pendant leur streaming, l’annulation atteint la requête amont et le travail accepté peut être récupéré après la défaillance d’un processus au lieu de disparaître avec une connexion.

02.2 Haute disponibilité testée à chaque version

Testez la configuration réelle à trois réplicas.

La barrière de publication exécute un exercice à trois réplicas couvrant la reprise des flux, la défaillance d’un worker, le repli lors d’une panne Redis, la révocation, les limites de fréquence, la suppression d’objets et la planification coordonnée.

02.3 Contrôles Helm

Référencez les secrets et réduisez les chemins réseau.

Le chart peut référencer un Secret existant et installer facultativement des NetworkPolicies pour l’application et les workers. L’application réelle des politiques dépend toujours du CNI du cluster.

03 Coût + qualité

Mesurez le coût des modèles et leurs performances.

L’exploitation ne se limite pas à la disponibilité. Libre fournit aux administrateurs des outils pour comprendre l’usage déclaré par les fournisseurs, contrôler les dépenses et comparer la qualité des résultats avec des preuves reproductibles.

03.1 Tarifs

Versionnez les prix au lieu de réécrire l’historique.

Les tarifs d’entrée et de sortie par modèle prennent effet au moment choisi. L’usage historique conserve la révision tarifaire qui l’a évalué, et l’usage non déclaré par le fournisseur n’est pas inventé.

Tarifs
03.2 Budgets

Avertissez en chemin et arrêtez-vous à la limite.

Les budgets peuvent observer, alerter ou bloquer. Le mode alerte et blocage refuse les nouvelles générations interactives lorsque la dépense brièvement mise en cache atteint la limite ; les automatisations planifiées restent mesurées mais ne sont pas bloquées.

Budgets
03.3 Évaluations

Associez avis, duels à l’aveugle et exécutions enregistrées.

Les avis sur les messages recueillent notes et thèmes, l’arène calcule un classement Elo à partir de votes à l’aveugle et les jeux enregistrés rendent les exécutions d’évaluation reproductibles.

Évaluations
04 Exploiter + restaurer

Observez sans exporter silencieusement.

Les journaux, la télémétrie, les enregistrements de sécurité et les outils de restauration sont des surfaces distinctes avec des limites de données explicites.

04.1 Journaux + télémétrie

Structurés localement ; exportés uniquement lorsque configurés.

Les journaux JSON comprennent des identifiants de corrélation et l’expurgation des secrets. La configuration d’un endpoint OTLP/HTTP active les traces OpenTelemetry pour les requêtes et les tâches durables ; sans endpoint, rien n’est exporté.

Paramètres d’observabilité
04.2 Sécurité

Sessions, portées, SSO, groupes et piste d’audit.

Les sessions révocables, les jetons à portée limitée stockés sous forme de hachage, OIDC générique, l’appartenance aux groupes en direct, l’autorisation centralisée et un journal d’audit de sécurité expurgé en ajout seul forment la limite du compte.

Authentification et sécurité
04.3 Restauration

Inventoriez, sauvegardez, vérifiez et restaurez.

Les commandes de maintenance intégrées créent des sauvegardes signées et vérifiables pour les profils solo et d’équipe. Un inventaire de restauration signale l’état présent et les blocages avant le démarrage d’un instantané.

Préparation à la restauration