LIBRE / แพลตฟอร์ม การปรับใช้และการดำเนินงาน ขอบเขตที่ตั้งใจออกแบบ

แพลตฟอร์ม

เริ่มบนเครื่องเดียว แล้วเติบโตอย่างตั้งใจ

Libre รักษาเส้นทาง local-first เริ่มต้นให้เล็ก แล้วนำโครงสร้างพื้นฐานร่วมเข้ามาเป็นโปรไฟล์ team ที่ชัดเจน ค่าใช้จ่าย คุณภาพ log telemetry การสำรองข้อมูล และหลักฐาน failover กลายเป็นส่วนสำคัญของการดำเนินระบบ

โปรไฟล์ runtime ที่ชัดเจน
Solo + team
การส่งออก OpenTelemetry
เลือกเปิดใช้
การฝึก failover ของรีลีส
3 เรพลิกา
01 โปรไฟล์

ใช้โครงสร้างพื้นฐานที่การปรับใช้ต้องการจริง

solo และ team เป็นโปรไฟล์การดำเนินงานที่สอดคล้องกัน ไม่ใช่ช่วงต่อเนื่องที่ซ่อนอยู่ การเริ่มระบบตรวจรูปแบบที่เลือก เพื่อไม่ให้สถานะร่วมที่ตั้งค่าเพียงครึ่งเดียวแยกไปตาม backend อย่างเงียบ ๆ

01.1 Solo

SQLite, ไฟล์ในเครื่อง และงานในตัว

โปรไฟล์เริ่มต้นรองรับการติดตั้งโหนดเดียวด้วย persistence ของ SQLite, ที่เก็บ blob ในเครื่อง และ worker ถาวรในตัว ซึ่งเป็นเส้นทางตรงสำหรับการปรับใช้ส่วนบุคคลและขนาดเล็ก

01.2 Team

สถานะร่วมระหว่างเรพลิกาและ worker

โปรไฟล์ team ใช้ PostgreSQL, การประสานงาน Redis, ที่เก็บ blob เข้ารหัสที่เข้ากันได้กับ S3, การค้นหาเวกเตอร์ และ worker ถาวรภายนอก พร้อมเส้นทางปรับใช้ด้วย Docker Compose และ Helm

01.3 การย้ายข้อมูล

ย้ายจาก solo ผ่านเวิร์กโฟลว์ที่บรรจุไว้

CLI สำหรับย้ายข้อมูลจะสำรวจและคัดลอกการติดตั้ง SQLite เดิมไปยังโปรไฟล์ team พร้อม checkpoint และขั้นตอนนำไปใช้ที่ทำต่อได้

02 ความคงทน + ความพร้อมใช้งาน

มองงานเป็นสถานะที่กู้คืนได้ ไม่ใช่การเชื่อมต่อที่โชคดี

การทำงานแชตและสื่อระยะยาวใช้งานถาวรและเหตุการณ์ที่เล่นซ้ำได้ โปรไฟล์ team ขยายรูปแบบนี้ไปยังเรพลิกาของแอปและ worker ภายนอก

02.1 งานถาวร

เริ่มสตรีมต่อและกู้คืนงานที่รับแล้ว

คำตอบถูกบันทึกระหว่างสตรีม การยกเลิกไปถึงคำขอ upstream และงานที่รับแล้วกู้คืนหลังโปรเซสล้มเหลวได้แทนการหายไปพร้อมการเชื่อมต่อ

02.2 ความพร้อมใช้งานสูงที่ทดสอบกับรีลีส

ฝึกกับรูปแบบจริงสามเรพลิกา

ด่านรีลีสเรียกการฝึกสามเรพลิกา ครอบคลุมการเริ่มสตรีมต่อ ความล้มเหลวของ worker ทางเลือกเมื่อ Redis ขัดข้อง การเพิกถอน ขีดจำกัดอัตรา การลบออบเจ็กต์ และการจัดตารางแบบประสาน

02.3 ตัวควบคุม Helm

อ้างอิงความลับและจำกัดเส้นทางเครือข่าย

chart อ้างอิง Secret เดิมและติดตั้ง NetworkPolicies ให้แอปกับ worker แบบเลือกได้ การบังคับใช้นโยบายยังขึ้นอยู่กับ CNI ของคลัสเตอร์

03 ค่าใช้จ่าย + คุณภาพ

วัดว่าโมเดลมีค่าใช้จ่ายเท่าใดและทำงานได้ดีเพียงใด

การดำเนินงานไม่ใช่เพียง uptime Libre ให้เครื่องมือแก่ผู้ดูแลเพื่อเข้าใจการใช้งานที่ผู้ให้บริการรายงาน ควบคุมรายจ่าย และเปรียบเทียบคุณภาพผลลัพธ์ด้วยหลักฐานที่ทำซ้ำได้

03.1 อัตราค่าบริการ

กำหนดเวอร์ชันราคาแทนการเขียนประวัติใหม่

อัตรา input และ output ต่อโมเดลมีผลตามเวลาที่เลือก การใช้งานในอดีตเก็บ revision ของอัตราที่ใช้คำนวณราคา และระบบไม่สร้างการใช้งานที่ผู้ให้บริการไม่ได้รายงานขึ้นเอง

อัตราค่าบริการ
03.2 งบประมาณ

เตือนระหว่างทางและหยุดที่ขีดจำกัด

งบประมาณสามารถเฝ้าดู แจ้งเตือน หรือบล็อก โหมดแจ้งเตือนและบล็อกจะปฏิเสธการสร้างแบบโต้ตอบใหม่เมื่อรายจ่ายที่แคชชั่วคราวถึงขีดจำกัด ส่วนระบบอัตโนมัติตามตารางยังถูกวัดแต่ไม่ถูกบล็อก

งบประมาณ
03.3 การประเมิน

รวมข้อเสนอแนะ การแข่งขันแบบไม่เปิดเผย และการเรียกใช้ที่บันทึกไว้

ข้อเสนอแนะข้อความเก็บคะแนนและหัวข้อ ลานแข่งขันคำนวณอันดับ Elo จากการลงคะแนนแบบไม่เปิดเผย และชุดที่บันทึกไว้ทำให้การประเมินสามารถทำซ้ำได้

การประเมิน
04 ดำเนินงาน + กู้คืน

สังเกตโดยไม่ส่งออกอย่างเงียบ ๆ

log, telemetry, บันทึกความปลอดภัย และเครื่องมือกู้คืนเป็นพื้นผิวแยกกันที่มีขอบเขตข้อมูลชัดเจน

04.1 Log + telemetry

มีโครงสร้างในเครื่อง ส่งออกเฉพาะเมื่อกำหนดค่า

log JSON มีตัวระบุความสัมพันธ์และการตัดความลับออก การตั้ง endpoint OTLP/HTTP หมายถึงเลือกส่งออก span OpenTelemetry สำหรับคำขอและงานถาวร หากไม่ตั้งค่าจะไม่ส่งออกสิ่งใด

การตั้งค่าการสังเกตการณ์
04.2 ความปลอดภัย

เซสชัน scope, SSO, กลุ่ม และร่องรอยการตรวจสอบ

เซสชันที่เพิกถอนได้ โทเค็นจำกัด scope ที่เก็บเป็น hash, OIDC แบบทั่วไป สมาชิกกลุ่มแบบสด การอนุญาตรวมศูนย์ และ log ตรวจสอบความปลอดภัยแบบเพิ่มอย่างเดียวที่ตัดข้อมูลอ่อนไหวออก ประกอบกันเป็นขอบเขตบัญชี

การยืนยันตัวตนและความปลอดภัย
04.3 การกู้คืน

สำรวจ สำรอง ตรวจสอบ และกู้คืน

คำสั่งบำรุงรักษาที่บรรจุไว้สร้างข้อมูลสำรองที่ลงนามและตรวจสอบได้สำหรับโปรไฟล์ solo และ team รายการสำรวจการกู้คืนรายงานสถานะปัจจุบันและสิ่งกีดขวางก่อนเริ่ม snapshot

ความพร้อมในการกู้คืน