01.1 Choix du modèle
Local quand vous le souhaitez. Connecté quand vous en avez besoin.
Ollama est la voie locale directe, sans compte cloud obligatoire. Les connexions aux fournisseurs ajoutent des services hébergés de chat, d’image, de vidéo, d’embeddings et de voix sans les fondre dans un backend opaque unique.
Travailler avec des modèles↗︎ 01.2 Contrôle de la conversation
Mettre en file, comparer, bifurquer et continuer.
Mettez des relances en file pendant le streaming, comparez plusieurs modèles sur le même prompt, bifurquez une conversation complète, puis utilisez la jauge de contexte et la compaction réversible pour maintenir les longs échanges dans la fenêtre du modèle.
Découvrir les conseils avancés↗︎ 01.3 Accès programmatique
Connectez vos clients existants à votre instance.
Des jetons d’API à portée limitée exposent la liste des modèles et les complétions de chat sans état sur une interface /v1 compatible OpenAI. Les chats avec état, les outils et les connaissances restent sur l’API d’événements native de Libre.
Voir les limites de l’API↗︎