PDF, Office, Markdown, HTML, লেখা ও কোড।
text-based PDF, Word ডকুমেন্ট, presentation, spreadsheet, CSV বা TSV data, Markdown, HTML, log এবং সাধারণ source-code format upload করুন।
জ্ঞান
Libre আপনার প্রবেশযোগ্য ডকুমেন্টকে উৎস থেকে উত্তর বিচ্ছিন্ন না করে ব্যবহারযোগ্য chat context-এ বদলে দেয়। নির্দিষ্ট শব্দ খোঁজা যায়, semantic match পরিধি বাড়ায় এবং উদ্ধৃত স্থান কথোপকথনে দৃশ্যমান থাকে।
একটি উদ্ধৃত অংশ কোথায় ছিল তা বলতে পারলে ডকুমেন্ট আরও উপযোগী হয়। Libre extraction-এর সময় structured provenance বহন করে এবং একই scope-এ অপরিবর্তিত upload আবার process করে না।
text-based PDF, Word ডকুমেন্ট, presentation, spreadsheet, CSV বা TSV data, Markdown, HTML, log এবং সাধারণ source-code format upload করুন।
Extraction source segment record করে, যাতে পাওয়া অংশ ও Sources panel শুধু file name নয়, দাবিটি কোথা থেকে এসেছে সেই অবস্থানও দেখাতে পারে।
DOCX, PPTX এবং XLSX repository-এর সীমিত parser দিয়ে unpack হয়। একই scope-এ আবার upload করা একই bytes deduplicate হয়।
Keyword এবং semantic retrieval ভিন্ন ধরনের বাদ পড়া ফল সামলায়। Libre lexical পথ সবসময় রাখে এবং embeddings configured হলে vector ranking-এর সঙ্গে মেশায়।
নির্দিষ্ট identifier, নাম ও দুর্লভ শব্দ embedding model ছাড়াই rank করতে পারে। embedding generation ব্যর্থ বা বন্ধ হলে document search lexicalভাবে চলতে থাকে।
embeddings সক্রিয় হলে reciprocal-rank fusion semantic similarity ও BM25 মিলিয়ে দেয়, যাতে অস্পষ্ট semantic neighbor শক্তিশালী exact match-কে স্বয়ংক্রিয়ভাবে ছাড়িয়ে না যায়।
Lexical scoring process-এর ভেতরে requestকারী যে decrypted chunk পড়তে পারে তার ওপর চলে। Libre encrypted document chunk-এর plaintext token index স্থায়ীভাবে রাখা ইচ্ছাকৃতভাবে এড়ায়।
Retrieval কার্যকর default। কাজটি সত্যিই পুরো file-এর ওপর নির্ভর করলে conversation full-document context বেছে নিতে পারে।
পাওয়া অংশে source name, chunk, score এবং structured location থাকে। Sources panel উদ্ধৃত স্থানগুলো তাদের document-এর নিচে group করে।
Chat বাছাই করা passage-এর বদলে পুরো extracted content পাঠাতে পারে। attached material বেশি বড় হলে configurable token guard retrieval-এ ফিরে যায়।
অন্তর্নির্মিত টুল scope-এর document list করতে, উদ্ধৃত passage search করতে এবং সীমিত window পড়তে পারে, যাতে মডেল সবকিছু একবারে পাওয়ার বদলে file ধাপে ধাপে পরীক্ষা করে।
টুল লুপ দেখুন