LIBRE / Kunskap Hämtning med belägg Avsiktliga gränser

Kunskap

Vet varifrån svaret kom.

Libre gör dokument du får åtkomst till användbar chattkontext utan att kapa svaret från källan. Exakta termer förblir sökbara, semantiska träffar ökar räckvidden och hänvisade platser syns i samtalet.

Nyckelordssökning som standard
BM25
Vektor + lexikal när aktiverat
Hybrid
Sida, bild, blad, avsnitt
Källnivå
01 Inläsning

Användbara format behåller sin plats i källan.

Ett dokument är mer användbart när ett utdrag fortfarande kan ange var det fanns. Libre bär strukturerat ursprung genom extraktionen och undviker att bearbeta oförändrade uppladdningar igen inom samma omfattning.

01.1 Dokument

PDF, Office, Markdown, HTML, text och kod.

Ladda upp textbaserade PDF:er, Word-dokument, presentationer, kalkylblad, CSV- eller TSV-data, Markdown, HTML, loggar och vanliga källkodsformat.

01.2 Ursprung

Behåll sidan, bilden, bladet eller avsnittet.

Extraktionen registrerar källsegment så att hämtade utdrag och panelen Källor kan ange platsen för ett påstående, inte bara filnamnet.

01.3 Begränsad bearbetning

Tolka Office-filer utan en inbyggd dokumentruntime.

DOCX, PPTX och XLSX packas upp med en begränsad parser i projektet. Identiska byte som laddas upp igen inom samma omfattning dedupliceras.

02 Hämtning

Hitta identifieraren och idén.

Nyckelords- och semantisk hämtning löser olika missar. Libre håller den lexikala vägen tillgänglig och förenar den med vektorrangordning när embeddings konfigureras.

02.1 Nyckelord

BM25 är alltid tillgängligt.

Exakta identifierare, namn och sällsynta termer kan rangordnas utan embeddingmodell. Om genereringen misslyckas eller stängs av fortsätter dokumentsökningen lexikalt.

02.2 Hybrid

Förena vektor- och lexikala rangordningar.

Med embeddings aktiverade kombinerar reciprocal-rank fusion semantisk likhet med BM25 så att en vag semantisk granne inte automatiskt slår en stark exakt träff.

02.3 Krypterat innehåll

Inget fulltextindex i klartext bredvid chiffertext.

Lexikal poängsättning körs i processen över dekrypterade delar som frågeställaren får läsa. Libre sparar avsiktligt inget tokenindex i klartext för krypterade dokumentdelar.

03 Svar

Använd rätt mängd källkontext.

Hämtning är den effektiva standarden. När uppgiften verkligen beror på hela filen kan samtalet välja heldokumentkontext.

03.1 Källhänvisningar

Ta med källplatser i svaret.

Hämtade utdrag innehåller källnamn, del, poäng och strukturerad plats. Panelen Källor grupperar hänvisade platser under dokumenten.

03.2 Heldokumentläge

Läs hela det extraherade dokumentet när det ryms.

En chatt kan skicka fullständigt extraherat innehåll i stället för valda passager. En inställbar tokengräns faller tillbaka på hämtning när materialet är för stort.

03.3 Kunskapsverktyg

Låt modellen söka och läsa under en runda.

Inbyggda verktyg kan lista dokument inom omfattningen, söka källhänvisade passager och läsa begränsade fönster så att modellen undersöker filen stegvis.

Se verktygsslingan
04 Delad kontext

Åtkomsten följer personen som frågar.

Kunskapssamlingar kan delas utan att bli offentliga. Hämtning och direkt läsning tillämpar samma rättigheter, och återkallande påverkar nästa fråga.

04.1 Behörighetsmedveten hämtning

Delade samlingar deltar direkt i sökningen.

En samling som tilldelats en användare eller grupp deltar i båda rangordningarna. Åtkomstlistan tillämpas i vektorsökningen utan nya embeddings vid delning eller återkallande.

04.2 Profiler

Begränsa en assistent till vissa samlingar.

Assistentprofiler kan binda en arbetsuppsättning kunskap. Bindningen minskar sökutrymmet och kontrollerar samtidigt den anropande personens aktuella behörighet.

Assistentprofiler
04.3 Anteckningar

Behåll varaktiga tankar intill källmaterialet.

Anteckningar har versioner, bilagor, fästning, Markdown-export, delning och en AI-redigeringsförhandsvisning som sparar föregående version före ändringen.