PDF, Office, Markdown, HTML, tekst og kode.
Upload tekstbaserede PDF'er, Word-dokumenter, præsentationer, regneark, CSV- eller TSV-data, Markdown, HTML, logfiler og almindelige kildekodeformater.
Viden
Libre gør dokumenter, du har adgang til, til brugbar chatkontekst uden at adskille svaret fra kilden. Præcise termer forbliver søgbare, semantiske match udvider rækkevidden, og citerede steder forbliver synlige.
Et dokument er mere nyttigt, når et uddrag stadig kan angive sin placering. Libre bærer struktureret oprindelse gennem udtrækning og undgår genbehandling af uændrede uploads i samme omfang.
Upload tekstbaserede PDF'er, Word-dokumenter, præsentationer, regneark, CSV- eller TSV-data, Markdown, HTML, logfiler og almindelige kildekodeformater.
Udtrækning registrerer kildesegmenter, så fundne uddrag og panelet Kilder kan angive stedet for en påstand, ikke kun filnavnet.
DOCX, PPTX og XLSX pakkes ud med en afgrænset parser i projektet. Identiske byte, der uploades igen i samme omfang, deduplikeres.
Nøgleords- og semantisk søgning løser forskellige mangler. Libre holder den leksikalske vej tilgængelig og kombinerer den med vektorrangering, når embeddings er konfigureret.
Præcise identifikatorer, navne og sjældne termer kan rangeres uden embeddingmodel. Hvis genereringen fejler eller slås fra, fortsætter dokumentsøgning leksikalsk.
Med embeddings aktiveret kombinerer reciprocal-rank fusion semantisk lighed med BM25, så en vag semantisk nabo ikke automatisk slår et stærkt præcist match.
Leksikalsk scoring kører i processen over dekrypterede dele, som brugeren må læse. Libre gemmer bevidst intet tokenindeks i klartekst for krypterede dokumentdele.
Søgning er den effektive standard. Når opgaven virkelig afhænger af hele filen, kan samtalen vælge fulddokumentkontekst.
Fundne uddrag indeholder kildenavn, del, score og struktureret placering. Panelet Kilder grupperer citerede placeringer under dokumenterne.
En chat kan sende hele det udtrukne indhold i stedet for valgte passager. En konfigurerbar tokengrænse falder tilbage på søgning, når materialet er for stort.
Indbyggede værktøjer kan liste dokumenter i omfanget, søge citerede passager og læse afgrænsede vinduer, så modellen undersøger en fil trinvis.
Se værktøjssløjfen