🧠 OpenRAG

OpenRAG është një platformë RAG që pastron dhe strukturon përmbajtjen e një biznesi, e indekson në serverin tonë, dhe e bën të kërkueshme në gjuhë natyrore nga sistemet e jashtme të AI përmes një dere të vetme me leje.

Vektorët nuk botohen; QASJA hapet.

Ky është një prezantim i produktit, jo një listë premtimesh. Më poshtë, pjesët që funksionojnë sot dhe ato që janë ende në rrugë janë shënuar veçmas. Nuk jepen data për elementët në rrugë; kur të përfundohen, ato lëvizin në seksionin "që funksionon sot".

Parimi thelbësor

E gjithë dizajni i OpenRAG bazohet në një fjali të vetme: vektorët nuk botohen, qasja hapet. Çfarë i jepet jashtë nuk është një kopje e përmbajtjes, por e drejta për të bërë pyetje për të.

⚙️

Një vektor është një motor, jo një produkt

Një vektor është specifik për modelin që e ka prodhuar; një AI tjetër nuk mund ta konsumojë ashtu siç është. Gjithashtu, ai e fryn tekstin shumë herë. Për këtë arsye vektorët nuk dorëzohen kurrë.

🔑

Çfarë hapet është qasja në pyetje

Një pyetje vjen; një përgjigje dhe pasazhet burimore mbi të cilën bazohet kthehen. Përmbajtja e plotë kurrë nuk kopjohet, shpërndahet ose shkarkohet.

🤝

Leja i përket biznesit

Biznesi vendos cilën përmbajtje bëhet e kërkueshme nga jashtë; pjesëmarrja është me opcion. Shtylla e lejes dhe e pëlqimit është në rrugë.

Si funksionon — arkitektura e synuar

Lidhjet e pastrimit, strukturore, indeksimit dhe kërkimit të këtij rrjedhjeje funksionojnë sot. Përfshirja e vetë-strehuar me ri-renditje dhe dera e vetme për botën e jashtme janë ende në rrugë; çdo hap më poshtë tregon cilin është.

1

Burimet mblidhen

Sitët xloji, dokumentet e ngarkuara dhe faqet e internetit të kapura janë burimet e përmbajtjes. (Një plugin WordPress dhe një API ingestimi publik janë në rrugë.)

2

Ajo pastrohet dhe strukturohet

Përmbajtja e çrregullt pastrohet, ndahet në pjesë të kuptimshme dhe sjell në një formë që RAG mund ta përdorë. Ky hap funksionon sot.

3

Ajo indeksohet dhe kërkohet

Pjesët kthehen në vektorë dhe shkruhen në pgvector; ato gjenden përmes një indeksi HNSW dhe kërkimi hibrid (fjalë kyçe + vektor). Ky hap funksionon sot; shtimi i lidhjes së ri-renditjes është në rrugë.

4

Ajo arrihet përmes një dere të vetme

Sistemet e jashtme të AI kërkojnë në gjuhë natyrore përmes një dere të vetme me leje; përgjigjet dhe pasazhet burimore kthehen, jo vektorët vetë. Kjo derë nuk ekziston ende; është në rrugë.

Pjesët që funksionojnë sotLive

Të mëposhtëmët po funksionojnë në platformë sot dhe tashmë përdoren nga mjetet AI në xloji.com.

🧮

pgvector + Indeksi HNSW

Pjesët e përmbajtjes ruhen si vektorë në bazën e të dhënave dhe kërkohen me një indeks HNSW mbi ngjashmërinë kosinus.

🔎

Kërkim hibrid

Kërkimi i fjalëve kyçe dhe kërkimi i vektorëve funksionojnë së bashku; dy listat e rezultateve bashkohen në një renditje të vetme. Kjo gjen si përputhje të sakta të termave ashtu edhe pasazhe semantikisht të ngjashme.

🧱

Izolim shumë-qëllimor

Çdo biznes, faqe dhe autor ka RAG-un e tij. Një kërkim ekzekutohet vetëm kundër indeksit të qiramarrësit të tij; të dhënat kurrë nuk përzierën në mes të qiramarrësve.

🧹

Pastrimi i dokumenteve dhe struktura RAG

Dokumentet e ngarkuara pastrohen, ndahen dhe strukturohen për RAG. Mjeti i Strukturimit të të Dhënave në platformë është faqja e përdoruesit e këtij rrjedhjeje.

🕸️

Kapja e uebit

Faqet e një siti kapen, përmbajtja e tyre nxirret dhe kalon përmes të njëjtës rrjedhjeje të pastrimit dhe indeksimit.

🧩

Ushqim RAG publik në mjetet AI personalizuar

Një mjet AI personalizuar që krijoni mund të ushqehet nga një burim RAG publik; mjeti e bazon përgjigjet e tij në atë bazë të njohurish.

🗄️

Ruajtja e skedarëve dhe mediave

Skedarët dhe mediat jetojnë në ruajtjen e objekteve — jo në dyqanin e vektorëve. Rekordi RAG tregon përsëri në skedarin origjinal.

🏠

Përfshirje dhe ri-renditje në serverat tanë

Përfshirja dhe ri-renditja tani ekzekutohen në serverat tanë në një shërbim të veçantë. Teksti kthehet në vektorë pa u larguar nga serveri, dhe rezultatet kandidatë kalojnë nëpër një ri-renditës lokal për të përmirësuar saktësinë.

✏️

Rishkrimi i kërkesës

Një pyetje e paqartë ose e plotë ndreqet përpara se të fillojë kërkimi. Përdoruesit nuk kanë nevojë të formulojnë pyetjen "e duhur"; sistemi e bën kërkesën gati për kërkim.

🎞️

Tekst nga imazhe, audio dhe video

Ekstraktimi i tekstit nga imazhet dhe transkriptimi i audios dhe videos ekzekutohen me mjete lokale në server, dhe teksti i rezultuar hyn në të njëjtin proces pastrimi dhe indeksimi. Të dhënat nuk largohen nga serveri.

Çfarë është në rrugëI planifikuar

Të mëposhtëmët nuk ekzistojnë ende. Ata janë elementë të planifikuar dhe të dizajnuar; kjo faqe nuk i prezanton si të ndërtuar tashmë.

🚪

Dera e vetme: MCP / Gateway API

Një derë e vetme që sistemet e jashtme të AI mund të kërkojnë në gjuhë natyrore. Një AI që lidhet një herë arrin çdo biznes pjesëmarrës përmes të njëjtës derë.

🛡️

Shtresa e lejes dhe e pëlqimit

Bizneset bashkohen me zgjedhimin e tyre; autentifikimi, menaxhimi i çelësave, limitimi i shkallës dhe mbrojtja kundër abuzimeve jetojnë në këtë shtresë.

📡

Shtresa e dukshmërisë së AI

Bërja e përmbajtjes të zbulueshme nga makinat përmes llms.txt, /.well-known/ dhe shënimeve schema.org, plus regjistrimi në regjistrat MCP. Nuk ka zbulim magjik automatik; dukshmëria ndërtohet në këtë mënyrë.

🔌

Plugin WordPress

Një plugin që lejon një sit WordPress të dërgojë përmbajtjen e tij në OpenRAG dhe të marrë një pikëfund që sistemet AI mund ta kërkojnë.

Ne nuk japim data për këto elementë. Kur një element përfundohet, ai lëviz lart në listën "pjesët që funksionojnë sot" dhe kjo faqe azhurnohet përkatësisht.

🔒 Të dhënat nuk largohen nga serveri

Qëllimi i OpenRAG është të ekzekutojë çdo hap të rrjedhjes RAG në serverin tonë me mjete lokale dhe falas: përfshirja, ri-renditja, nxjerrja e tekstit nga imazhet dhe transkriptimi i audios. Asnjë media që hyn në RAG nuk dërgohet në një shërbim të jashtëm — kjo është një rregull dizajni i pa diskutueshëm.

Statusi i sinqertë: disa nga këto hapa kryhen ende nga shërbime të jashtme sot. Lëvizja e tyre në shtëpi është elementi i parë në rrugë.

Si planifikohet rritja

Kërkimi i vektorëve bëhet më i shtrenjtë sa rritet përmbajtja. Dizajni i OpenRAG kufizon atë kosto që nga fillimi në tri mënyra.

Nuk ka një indeks i madh i vetëm

Çdo biznes ka indeksin e tij të vogël dhe një kërkim ekzekutohet vetëm kundër atij indeksi. Edhe kur përmbajtja totale rritet, zona që kërkon një kërkim i vetëm mbetet e vogël; kostoja e kërkimit shkallëzohet me madhësinë e atij biznesi, jo me totalin e platformës.

Madhësia e vektorëve dhe saktësia janë të rregullueshme

Duke përdorur dimensione më të shkurtra vektori dhe formate numri më të kompakta, e njëjta përmbajtje zë pak më pak hapësirë. Këto zgjedhje janë ndërtuar në dizajn që nga fillimi, kështu që nuk kërdohet asnjë migrim i shtrenjtë më vonë.

Tier i ftohtë

Indeksi i një biznesi që nuk është kërkuar për një kohë të gjatë lëviz në ruajtje të lirë dhe të qëndrueshme dhe tërheqet kur mbërrit një kërkim për të. Kështu, vetëm përmbajtja aktuale qëndron në memorie të shpejtë. Ky tier është në rrugë.

Pyetjet e bëra shpesh

Çfarë është saktësisht OpenRAG?

Është një platformë RAG që pastron dhe strukturon përmbajtjen e një biznesi, e indekson në serverin tonë dhe e bën të kërkueshme në gjuhë natyrore nga sistemet e jashtme të AI përmes një dere të vetme me leje. Nuk është një mjet bisede; është shtresa e njohurive që ekzekutohet nën këto mjete.

A më jepni vektorët ose përmbajtjen time diku tjetër?

Jo. Parimi thelbësor është: vektorët nuk botohen, qasja hapet. Çfarë del jashtë nuk është një kopje e përmbajtjes, por e drejta për të bërë pyetje për të; vetëm pasazhet mbështetëse kthehen me përgjigjen. Përveç kësaj, biznesi vendos cilën përmbajtje bëhet e kërkueshme nga jashtë.

Çfarë mund të përdoret në të vërtetë sot?

Baza e të dhënave vektoriale dhe indeksi, kërkimi hibrid, izolimi multi-tenant, pastrimi i dokumenteve dhe struktura RAG, zvarritja e uebit, ushqimi publik RAG në veglat e personalizuara të AI dhe ruajtja e skedarëve/mediave të gjitha funksionojnë sot. Përfshirja e vektorëve të vetë-strehuar, ri-renditja, ripërshkrimi i kërkesave, dera e jashtme, shtresa e lejes, shtresa e dukshmërisë dhe shtojca e WordPress nuk ekzistojnë ende.

A largohen të dhënat e mia nga serveri?

Qëllimi është që çdo hap i tubacionit RAG të funksionojë me mjete lokale në server, pa asnjë media që të dërgohet në një shërbim të jashtëm. Statusi i sinqertë: disa nga këto hapa trajtohen ende nga shërbime të jashtme sot, dhe zhvendosja e tyre në vend është elementi i parë në hartën rrugore.

Kur do të jenë gati funksionet e hartës rrugore?

Ne nuk premtojmë data. Ky është pikërisht qëllimi i kësaj faqeje: të tregojë veçmas çfarë funksionon sot dhe çfarë është planifikuar. Kur një element përfundohet, ai kalon në listën "pjesët që funksionojnë sot".

A përdoret ose shitet përmbajtja ime për trajnime të AI?

Jo. Nuk ka një përdorim të tillë sot. Ideja e një korpusi teksti me leje është elementi më i largët, me peshë ligjore në hartën rrugore; edhe nëse ndodh, asnjë përmbajtje nuk do të përdoret për të pa miratimin e qartë të biznesit.

Kthehuni në portalin e AI për veglat e tjera të AI.

Pyetjet e Shpeshta

Çfarë është OpenRAG?

OpenRAG është një sistem RAG (Retrieval-Augmented Generation) që funksionon në serverin e vet të xloji.com dhe është një portë e vetme AI. Kur vjen një pyetje, së pari gjen përmbajtjen relevante, pastaj gjeneron një përgjigje bazuar në atë përmbajtje. Gjithashtu, shërben si një portë qendrore që lejon që mjete të tjera AI jashtë xloji.com të kenë akses në informacionin që i përket xloji.com nga një pikë e vetme.

Çfarë do të thotë RAG dhe si e implementon OpenRAG?

RAG do të thotë 'Retrieval-Augmented Generation', pra gjenerim i zmadhuar me marrje. Ai kërkon informacion nga burime relevante përpara se një AI të gjenerojë një përgjigje, pastaj krijon përgjigjen bazuar në atë informacion. OpenRAG e ekzekuton këto dy hapa, hapat e kërkimit dhe gjenerimit, duke i kombinuar në serverin e tij. Kështu, përgjigjet e dhëna nga OpenRAG nuk janë të rastësishme, por bazohen në përmbajtjen reale që i përket xloji.com.

Çfarë do të thotë 'portë e vetme AI'?

Portë e vetme AI do të thotë që kërkesat dhe integrimet e ndryshme të AI kalojnë përmes një pikeje qendrore hyrjeje, në vend të sistemeve të veçanta. OpenRAG merr këtë rol: si funksioni 'Pytni' i vetë xloji.com, ashtu edhe mjetet AI që lidhen nga jashtë, marrin shërbim përmes të njëjtës infrastrukturë OpenRAG. Kjo strukturë qendrore lejon menaxhimin e trafikës së lidhur me AI nga një pikë e vetme.

Çfarë ndryshimi bën fakti që OpenRAG funksionon në serverin e vet?

OpenRAG funksionon në serverin e vet të xloji.com, pa u mbështetur në një shërbim cloud të palës së tretë. Kjo do të thotë që të dhënat e kërkuara dhe përpunuara mbeten nën kontrollin e xloji.com. Si një strukturë që funksionon në serverin e vet, OpenRAG kryen kërkime dhe gjeneron përgjigje brenda infrastrukturës së tij, pa transferuar të dhëna në sisteme të jashtme.

Kush e përdor OpenRAG?

OpenRAG përdoret nga tre grupe të ndryshme: përdoruesit fundorë që vizitojnë xloji.com dhe shkruajnë në kutinë 'Pytni', sistemet që kërkojnë infrastrukturën RAG të xloji.com dhe mjetet e inteligjencës artificiale të jashtme që hyjnë në informacionin e xloji.com përmes OpenRAG. Për përdoruesin fundor, OpenRAG kthen një përgjigje bazuar në përmbajtjen e xloji.com për pyetjen që e ka bërë. Për mjetet e jashtme, OpenRAG është një derë pa kontekst e përdorur për të marrë informacion nga xloji.com.

Si funksionon kutia 'Pytni' në xloji.com me OpenRAG?

Një pyetje e shkruar në kutinë 'Pytni' në xloji.com përpunohet nga OpenRAG. OpenRAG kërkon fillimisht përmbajtje relevante brenda të dhënave të vetë xloji.com, pastaj gjeneron një përgjigje bazuar në këtë përmbajtje të gjetur. Kështu, përgjigja e dhënë përdoruesit mbështetet nga përmbajtja reale e xloji.com.

Si marrin informacion mjetet e inteligjencës artificiale të jashtme përmes OpenRAG?

OpenRAG shërben si një kalim i vetëm për mjetet e inteligjencës artificiale jashtë xloji.com për të hyrë në informacionin e xloji.com. Këto mjete mund të lidhen përmes OpenRAG dhe të marrin përgjigje të kuptueshme vetvetes, pa kontekst, nga përmbajtja e xloji.com. Për këtë arsye, informacioni i dhënë përmes OpenRAG është projektuar që të jetë kuptimplotë vetvetes, pa pasur nevojë për një kontekst të veçantë.

Cilat janë kufijtë e OpenRAG?

Përgjigjet e dhëna nga OpenRAG janë të kufizuara nga përmbajtja që i është ofruar; OpenRAG nuk mund të gjenerojë një përgjigje të saktë për informacion që nuk gjendet ose nuk është shtuar në sistem. OpenRAG synon të qëndrojë i kufizuar në përmbajtjen që ka në dorë, në vend që të shpikë informacion që nuk ekziston. Për këtë arsye, duhet mbajtur mend se një përgjigje e marrë nga OpenRAG është e kufizuar nga përmbajtja që xloji.com ka në atë moment.

A është OpenRAG një chatbot?

OpenRAG nuk është një chatbot i pavarur në kuptimin klasik; është infrastruktura RAG dhe gateway që fuqizon funksionin 'Pyt Pytje' të xloji.com dhe aksesin në informacion të mjeteve të jashtme. Detyra kryesore e OpenRAG është të gjejë përmbajtjen që korrespondon me një pyetje dhe të gjenerojë një përgjigje bazuar në atë përmbajtje. Në këtë formë, OpenRAG vepron më shumë si një shtresë infrastrukture pas përgjigjeve sesa një ndërfaqe që bisedon drejtpërdrejt me përdoruesin.

Cili është qëllimi i OpenRAG për xloji.com?

Qëllimi i OpenRAG është të sigurojë që informacioni i xloji.com të jetë i aksesueshëm nga përdoruesit fundor dhe nga mjetet e inteligjencës artificiale të jashtme përmes një infrastrukture të besueshme dhe të kontrolluar vetë. Funksionimi në serverin e tij siguron që ky akses të ndodhë pa varësi nga sistemet e palëve të treta. Falë strukturës së tij si gateway me një pikë, OpenRAG bashkon pikat e ndryshme të aksesit në një sistem qendror të vetëm.

Informacion i detajuar mbi OpenRAG

OpenRAG, xloji.com's serverit në serverin e vet RAG (Retrieval-Augmented Generation) është një sistem dhe gjithashtu një kalim AI që kalon kërkesat e lidhura me inteligencën artificiale nga një pikë e vetme. Fjala 'Open' në emrin e tij tregon se sistemi ofron një strukturë të hapur dhe të arritshme, ndërsa shprehja 'RAG' tregon mënyrën e tij të funksionimit, e cila fillimisht gjen informacionin relevant kur përgjigjet dhe më pas gjeneron përgjigje bazuar në këtë informacion. Një pyetje e shkruar në kutinë 'Pyesni' në xloji.com kërkohet fillimisht nga OpenRAG brenda përmbajtjes relevante, më pas një përgjigje gjenerohet bazuar në këtë përmbajtje të gjetur. E njëjta infrastrukturë lejon që mjetet e inteligjencës artificiale jashtë xloji.com të kenë akses në informacionin e xloji.com përmes OpenRAG dhe të përdorin këtë informacion në përgjigjet e tyre. Kjo strukturë lejon xloji.com të shërbejë përmes një infrastrukture të centralizuar të vetme, në vend që të instalohen zgjidhje të veçanta të inteligjencës artificiale për produkte të ndryshme.

Logjika themelore e qasjes RAG është që një sistem i inteligjencës artificiale, në vend se të mbështetet vetëm në informacionin e përgjithshëm të trajnuar paraprakisht, të tërheqë fillimisht përmbajtje aktuale dhe të saktë që lidhen me pyetjen nga një burim dhe më pas të përgjigjet në dritën e kësaj përmbajtjeje. OpenRAG ekzekutohet duke kombinuar këto dy hapa, hapat e gjetjes (përfitimit) dhe gjenerimit, në serverin e tij. Kjo qasje synon të reduktojë prirjen e modeleve të inteligjencës artificiale për të gjeneruar informacion që nuk ekziston; sepse përgjigja nuk rrjedh nga kujtesa e modelit, por nga përmbajtje e gjetur në të vërtetë. Në këtë mënyrë, përgjigjet e dhëna nga OpenRAG nuk bazohen në informacion të rastësishëm ose të vjetëruar, por në përmbajtjen e vet të xloji.com. Burimi i një përgjigjeje të gjeneruar nga OpenRAG mund të gjurmohet si të dhëna të pronës së xloji.com. Pronësia e serverit nga xloji.com do të thotë që të dhënat e kërkuara dhe të përpunuara mbahen nën kontrollin e xloji.com, pa u varur nga një shërbim cloud i palës së tretë.

Ana 'kalim i vetëm AI' e OpenRAG do të thotë që kërkesat dhe integrimet e ndryshme të inteligjencës artificiale drejtohen nga një pikë hyrje e centralizuar e vetme, në vend të sistemeve të veçanta. Kështu, si veçoria 'Pyesni' e vetë xloji.com, ashtu edhe mjetet e jashtme të lidhura përmes OpenRAG, përdorin të njëjtën infrastrukturë dhe të njëjtën logjikë themelore. Si një strukturë e centralizuar e kalimit, OpenRAG lejon që trafiku i lidhur me inteligencën artificiale të kalojë përmes një pike të vetme; kjo rrit konsistencën e përgjigjeve dhe kontrollin mbi të dhënat si një sistem që funksionon në serverin e vet. Kjo qasje me një pikë gjithashtu lejon që mirëmbajtja dhe azhurnimet të bëhen në një vend të vetëm, në vend të sistemeve të shpërndara. Në këtë drejtim, OpenRAG nuk është vetëm një mjet pyetje-përgjigje, por një shtresë infrastrukture që bashkon të gjitha pikat e qasjes së xloji.com me inteligencën artificiale.

OpenRAG përdoret drejtpërdrejt ose indirekt nga tre grupe të ndryshme përdoruesish: përdoruesit fundorë që vizitojnë xloji.com dhe shkruajnë në kutinë 'Pyesni', sistemet që kërkojnë infrastrukturën RAG të xloji.com dhe mjetet e inteligjencës artificiale të jashtme që kanë akses në informacionin e xloji.com përmes OpenRAG. Të tre grupet e përdoruesve marrin përgjigje të ushqyera nga e njëjta infrastrukturë OpenRAG, nga e njëjta bazë përmbajtjeje; për këtë arsye, pavarësisht se ku pyetet rreth xloji.com, arrihet një burim informacioni i konsistueshëm. Përgjigjet e dhëna nga OpenRAG janë të kufizuara nga përmbajtja që i është dhënë atij; domethënë, nuk duhet pritur një përgjigje e qartë nga OpenRAG për informacion që nuk gjendet në sistem ose nuk është shtuar në serverin e tij. Ky kufi është gjithashtu baza e besueshmërisë së OpenRAG: në vend se të shpijonë informacion që nuk ekziston, synon të gjenerojë përgjigje të kufizuara nga përmbajtja e tij dhe të bazuara në këtë përmbajtje.

OpenRAG — Hapni përmbajtjen tuaj për AI përmes një dere të vetme me leje | xloji.com