🧠 OpenRAG
OpenRAG ir RAG platforma, kas attīra un strukturē uzņēmuma saturu, indeksē to uz mūsu pašu servera un padara to pieejamu vaicājumiem dabiskā valodā no ārējām AI sistēmām, izmantojot vienus atļautus vārtus.
Vektori netiek publicēti; PIEKĻUVE tiek atvērta.
Šis ir produkta ievads, nevis solījumu saraksts. Zemāk daļas, kas darbojas šodien, un daļas, kas vēl ir ceļvedī, ir atzīmētas atsevišķi. Par ceļveža elementiem netiek solīti datumi; tos pabeidzot, tie pāriet uz sadaļu "darbojas šodien".
Pamatprincips
OpenRAG visa konstrukcija balstās uz vienu teikumu: vektori netiek publicēti, piekļuve tiek atvērta. Ārpusē tiek nodots nevis satura kopija, bet tiesības uzdot tam jautājumus.
Vektors ir dzinējs, nevis produkts
Vektors ir specifisks modelim, kas to radījis; cits AI to nevar izmantot tāpat. Tas arī vairākkārt palielina teksta apjomu. Tāpēc vektori nekad netiek nodoti.
Atver piekļuvi vaicājumiem
Vaicājums ierodas; atbilde un avota fragmenti, uz kuriem tā balstās, tiek nosūtīti atpakaļ. Pilns saturs nekad netiek kopēts, izplatīts vai lejupielādēts.
Atļauja pieder uzņēmumam
Uzņēmums lemj, kurš saturs kļūst pieejams ārējiem vaicājumiem; dalība ir brīvprātīga. Atļaujas un piekrišanas kārta ir ceļvedī.
Kā tas darbojas — mērķa arhitektūra
Šīs plūsmas tīrīšanas, strukturēšanas, indeksēšanas un meklēšanas saites darbojas šodien. Pašreizējā iegulšana ar pārkārtošanu un vieni vārti uz ārējo pasauli joprojām ir ceļvedī; katrs solis zemāk norāda, kas ir kas.
Avoti tiek savākti
xloji vietnes, augšupielādēti dokumenti un apkopotas tīmekļa lapas ir satura avoti. (WordPress spraudnis un publisks iekļaušanas API ir ceļvedī.)
Tas tiek notīrīts un strukturēts
Netīrs saturs tiek notīrīts, sadalīts jēdzīgos fragmentos un pielāgots RAG izmantošanai. Šis solis darbojas šodien.
Tas tiek indeksēts un meklēts
Fragmenti tiek pārveidoti par vektoriem un rakstīti uz pgvector; tie tiek atrasti, izmantojot HNSW indeksu un hibrīdmeklēšanu (atslēgvārdu + vektora). Šis solis darbojas šodien; pārkārtošanas saites pievienošana ir ceļvedī.
Tas ir sasniedzams caur vieniem vārtiem
Ārējās AI sistēmas uzdod jautājumus dabiskā valodā caur vieniem atļautiem vārtiem; atbildes un avota fragmenti tiek nosūtīti atpakaļ, nevis paši vektori. Šie vārti vēl nepastāv; tie ir ceļvedī.
Daļas, kas darbojas šodienTiešraidē
Šādi elementi šodien darbojas uz platformas un jau tiek izmantoti AI rīkos xloji.com.
pgvector + HNSW indekss
Satura fragmenti tiek saglabāti kā vektori datubāzē un meklēti ar HNSW indeksu, izmantojot kosinusa līdzību.
Hibrīdmeklēšana
Atslēgvārdu meklēšana un vektormeklēšana darbojas kopā; divi rezultātu saraksti tiek apvienoti vienā rangā. Tas atrod gan precīzus terminatēšanas atbilstības, gan semantiski tuvus fragmentus.
Daudznomnieku izolācija
Katram uzņēmumam, vietnei un autoram ir savs RAG. Vaicājums tiek veikts tikai pret sava nomnieka indeksu; dati nekad nesajaucas starp nomniekiem.
Dokumentu tīrīšana un RAG strukturēšana
Augšupielādēti dokumenti tiek notīrīti, sadalīti fragmentos un strukturēti RAG. Datstruktūras rīks platformā ir lietotājam redzamā šī procesa virsma.
Tīmekļa apkopšana
Vietnes lapas tiek apkopotas, to saturs tiek iegūts un nodots tālāk tajā pašā tīrīšanas un indeksēšanas procesā.
Publiskais RAG plūsmas kanāls pielāgotos AI rīkos
Pielāgots AI rīks, ko jūs izveidojat, var tikt barots no publiska RAG avota; rīks pamato savas atbildes šajā zināšanu bāzē.
Failu un mediju glabāšana
Faili un mediji tiek glabāti objektu glabātavā — ne vektoru veikalā. RAG ieraksts norāda atpakaļ uz sākotnējo failu.
Iegulšana un atkārtota ranžēšana mūsu pašu serveros
Iegulšana un atkārtota ranžēšana tagad notiek mūsu pašu serveros atsevišķā servisā. Teksts tiek pārveidots vektoros, neatstājot serveri, un kandidātu rezultāti iet caur lokālu atkārtotāju, lai uzlabotu precizitāti.
Vaicājuma pārrakstīšana
Neklarēts vai nepilnīgs jautājums tiek sakārtots pirms meklēšanas. Lietotājiem nav jāformulē "pareizais" jautājums; sistēma padara vaicājumu gatavu meklēšanai.
Teksts no attēliem, audio un video
Teksta ieguve no attēliem un audio un video transkripcija notiek ar lokāliem rīkiem serverī, un iegūtais teksts iekļūst tajā pašā tīrīšanas un indeksēšanas procesā. Dati neatstāj serveri.
Kas ir ceļvedīPlānots
Šādi elementi vēl nepastāv. Tie ir plānoti un izstrādāti elementi; šī lapa neprezentē tos kā jau izbūvētus.
Vienīgie vārti: MCP / API vārteja
Vienīgie vārti, caur kuriem ārējās AI sistēmas var uzdot jautājumus dabiskā valodā. AI, kas pieslēdzas vienreiz, sasniedz katru piedalīšanās uzņēmumu caur vieniem vārtiem.
Atļaujas un piekrišanas kārta
Uzņēmumi pievienojas pēc savas izvēles; autentifikācija, atslēgu pārvaldība, ātruma ierobežošana un ļaunprātīgas izmantošanas aizsardzība atrodas šajā kārta.
AI redzamības kārta
Padarot saturu atklājamu mašīnām, izmantojot llms.txt, /.well-known/ un schema.org marķējumu, kā arī reģistrāciju MCP reģistros. Nav maģiskas automātiskas atklāšanas; redzamība tiek izveidota šādi.
WordPress spraudnis
Spraudnis, kas ļauj WordPress vietnei nosūtīt savu saturu uz OpenRAG un saņemt atpakaļ galapunktu, ko AI sistēmas var vaicāt.
Mēs nesniedzam datumus šiem elementiem. Kad elements ir pabeigts, tas pāriet uz augšu sadaļā "daļas, kas darbojas šodien", un šī lapa tiek atjaunināta attiecīgi.
🔒 Dati neatstāj serveri
OpenRAG mērķis ir palaist katru RAG procesa soli uz mūsu pašu servera ar vietējiem, brīviem rīkiem: iegulšanu, pārkārtošanu, teksta ieguvi no attēliem un audio transkripciju. Neviens RAG iekļaušanas medijs netiek nosūtīts uz ārēju servisu — tas ir neapstrīdams dizaina noteikums.
Godīgs statuss: daži no šiem soļiem šodien veic ārēji pakalpojumi. To pārvietošana iekšienē ir pirmais elements ceļvedī.
Kā plānots izaugsme
Vektormeklēšana kļūst dārgāka, pieaugot saturam. OpenRAG konstrukcija ierobežo šīs izmaksas no paša sākuma trīs veidos.
Nav viena liela indeksa
Katram uzņēmumam ir savs mazs indekss, un vaicājums tiek veikts tikai pret šo indeksu. Pat pieaugot kopējam saturam, joprojām meklēšanas izmaksas mērojas ar viena uzņēmuma izmēru, nevis ar platformas kopējo izmēru.
Vektora izmērs un precizitāte ir regulējami
Izmantojot īsākus vektora izmērus un kompaktākus skaitļu formātus, tas pats saturs aizņem ievērojami mazāk vietas. Šīs izvēles ir iebūvētas dizainā no paša sākuma, tāpēc vēlāk nav nepieciešama dārga migrācija.
Aukstā kārta
Uzņēmuma indekss, kas nav ticis vaicāts ilgu laiku, tiek pārvietots uz lētu pastāvīgu uzglabāšanu un atgriezts, kad ierodas vaicājums. Tādā veidā ātrā atmiņā paliek tikai pašreizējais saturs. Šī kārta ir ceļvedī.
Bieži uzdotie jautājumi
Kas tieši ir OpenRAG?
Tā ir RAG platforma, kas attīra un strukturē uzņēmuma saturu, indeksē to uz mūsu pašu servera un padara to pieejamu vaicājumiem dabiskā valodā no ārējām AI sistēmām, izmantojot vienus atļautus vārtus. Tā nav tērzēšanas rīks; tā ir zināšanu kārta, kas darbojas zem šādiem rīkiem.
Vai jūs nododat manus vektorus vai saturu kādam citam?
Nē. Pamatprincips ir: vektori netiek publicēti, piekļuve tiek atvērta. Ārpusē tiek nodots nevis satura kopija, bet tiesības uzdot tam jautājumus; atpakaļ atgriežas tikai atbalstošie fragmenti. Turklāt uzņēmums lemj, kurš saturs kļūst pieejams ārējiem vaicājumiem.
Kas patiesībā var tikt izmantots šodien?
Vektoru datubāze un indekss, hibrīds meklēšana, daudztenantu izolācija, dokumentu tīrīšana un RAG strukturēšana, tīmekļa pārlūkošana, publiskā RAG plūsma pielāgotos AI rīkos un failu/multivides uzglabāšana — viss darbojas šodien. Pašreizējā iegulšana, pārrindošana, vaicājumu pārrakstīšana, ārējā durvis, atļauju kārta, redzamības kārta un WordPress spraudnis vēl nav pieejami.
Vai mani dati iziet no servera?
Mērķis ir, lai katrs RAG procesa solis tiktu izpildīts ar lokāliem rīkiem serverī, un neviens multivides fails nekad netiktu nosūtīts ārējā pakalpojuma sniedzējam. Patiesais statuss: daži no šiem soļiem joprojām tiek apstrādāti ar ārējiem pakalpojumiem šodien, un to pārvietošana iekšpusē ir pirmais punkts ceļvedī.
Kad ceļveža funkcijas būs gatavas?
Mēs nesolām datumus. Tieši tādēļ ir šī lapa: lai parādītu atsevišķi to, kas darbojas šodien, un ko plānots izdarīt. Kad elements ir pabeigts, tas pāriet uz sarakstu "daļas, kas darbojas šodien".
Vai mans saturs tiek izmantots vai pārdots AI apmācībai?
Nē. Šāda izmantošana šodien nav paredzēta. Atļauta teksta korpusa ideja ir visattālākais, juridiskais punkts ceļvedī; pat ja tas notiek, neviens saturs netiktu izmantots bez uzņēmuma skaidras piekrišanas.
Atgriezieties AI portālā, lai izmantotu citus AI rīkus.
Biežāk uzdotie jautājumi
Kas ir OpenRAG?
OpenRAG ir xloji.com serverī darbināma RAG (Retrieval-Augmented Generation) sistēma un vienas durvju AI vārtejs. Kad tiek uzdots jautājums, sistēma vispirms atrod atbilstošu saturu un pēc tam ģenerē atbildi, pamatojoties uz šo saturu. Tāpat arī tā kalpo kā centralizēta vārtejs, kas ļauj mākslīgā intelekta rīkiem ārpus xloji.com piekļūt xloji.com informācijai no viena punkta.
Ko nozīmē RAG un kā OpenRAG to īsteno?
RAG nozīmē 'Retrieval-Augmented Generation', kas nozīmē atgūšanas papildināta ģenerēšana; tas nozīmē, ka mākslīgais intelekts meklē informāciju no atbilstošiem avotiem pirms atbildes ģenerēšanas un pēc tam ģenerē atbildi, pamatojoties uz šo informāciju. OpenRAG apvieno šīs divas darbības — meklēšanu un ģenerēšanu — un izpilda tās savā serverī. Tādējādi OpenRAG sniegtās atbildes nav nejaušas, bet gan balstītas uz reālu xloji.com saturu.
Ko nozīmē 'vienas durvju AI vārtejs'?
Vienas durvju AI vārtejs nozīmē, ka dažādi mākslīgā intelekta pieprasījumi un integrācijas tiek novirzīti caur vienu centralizētu ieejas punktu, nevis atsevišķas sistēmas. OpenRAG uzņemas šo lomu: gan xloji.com 'Uzdot jautājumu' funkcija, gan ārēji pievienoti mākslīgā intelekta rīki saņem pakalpojumus, izmantojot to pašu OpenRAG infrastruktūru. Šī centralizētā struktūra nodrošina vienota punkta pārvaldību ar mākslīgo intelektu saistītajam satiksmē.
Kā OpenRAG darbība savā serverī maina lietas?
OpenRAG darbojas xloji.com serverī, nepaļaujoties uz trešās puses mākoņu pakalpojumu. Tas nozīmē, ka meklētie un apstrādātie dati paliek xloji.com kontrolē. Kā struktūra, kas darbojas savā serverī, OpenRAG veic meklēšanu un atbilžu ģenerēšanu savā infrastruktūrā, nepārsūtot datus ārējām sistēmām.
Kas izmanto OpenRAG?
OpenRAG izmanto trīs dažādas grupas: lietotāji, kas apmeklē xloji.com un raksta jautājumu 'Uzdot jautājumu' lodziņā, sistēmas, kas vaicā xloji.com savai RAG infrastruktūrai, un ārējie mākslīgā intelekta rīki, kas piekļūst xloji.com informācijai caur OpenRAG. Lietotājam OpenRAG atgriež atbildi, kas balstīta uz xloji.com saturu. Ārējiem rīkiem OpenRAG ir kontekstu neatkarīgs vārtejs, lai iegūtu informāciju no xloji.com.
Kā 'Uzdot jautājumu' lodziņš xloji.com darbojas ar OpenRAG?
Jautājums, kas ievadīts 'Uzdot jautājumu' lodziņā xloji.com, tiek apstrādāts ar OpenRAG. OpenRAG vispirms meklē saturu, kas saistīts ar jautājumu xloji.com savos datos, un pēc tam ģenerē atbildi, balstoties uz atrasto saturu. Tādā veidā lietotājam sniegtā atbilde ir atbalstīta ar reālu saturu no xloji.com.
Kā ārējie mākslīgā intelekta rīki iegūst informāciju caur OpenRAG?
OpenRAG kalpo kā vienīgs vārtejs, kas ļauj mākslīgā intelekta rīkiem ārpus xloji.com piekļūt informācijai par xloji.com. Šie rīki var izmantot OpenRAG, lai saņemtu kontekstu neatkarīgas, pašas par sevi saprotamas atbildes no xloji.com satura. Tāpēc informācija, kas sniegta caur OpenRAG, ir paredzēta tā, lai tā būtu saprotama pati par sevi, neprasot papildu kontekstu.
Kādi ir OpenRAG ierobežojumi?
OpenRAG sniegtās atbildes ir ierobežotas ar piegādāto saturu; OpenRAG nevar ģenerēt pārliecinošu atbildi par informāciju, kas nav atrodama vai nav pievienota sistēmā. OpenRAG ir paredzēts, lai paliktu pie pieejamā satura, nevis izdomātu neesošu informāciju. Tāpēc jāatceras, ka atbilde, kas iegūta no OpenRAG, ir ierobežota ar saturu, kas xloji.com ir pieejams šajā brīdī.
Vai OpenRAG ir tērzēšanas bots?
OpenRAG nav klasisks, neatkarīgs tērzēšanas robots; tas ir xloji.com 'Jautāt' funkcijas un ārējo rīku piekļuves informācijai RAG un vārtejas infrastruktūra. OpenRAG galvenais uzdevums ir atrast saturu, kas atbilst jautājumam, un ģenerēt atbildi, pamatojoties uz šo saturu. Šādā veidā OpenRAG darbojas vairāk kā atbilžu infrastruktūras slānis, nevis saskarne, kas tieši tērzē ar lietotāju.
Kāds ir OpenRAG mērķis xloji.com?
OpenRAG mērķis ir nodrošināt, lai gan gala lietotājiem, gan ārējiem mākslīgā intelekta rīkiem būtu piekļuve xloji.com informācijai, izmantojot uzticamu un pašpārvaldītu infrastruktūru. Tā darbība savā serverī nodrošina, ka piekļuve notiek neatkarīgi no trešo pušu sistēmām. Pateicoties vienas durvju vārtejas struktūrai, OpenRAG apvieno dažādus piekļuves punktus vienā centrālajā sistēmā.
Detalizēta informācija par OpenRAG
OpenRAG ir xloji.com serverī darbināma RAG (Retrieval-Augmented Generation) sistēma un vienlaikus AI vārtejs, kas novirza ar mākslīgo intelektu saistītus pieprasījumus caur vienu punktu. Nosaukumā ietvertais vārds 'Open' norāda uz sistēmas atvērtu un pieejamu struktūru, savukārt 'RAG' norāda uz tās darbības veidu, kas atbildes ģenerēšanai vispirms atrod atbilstošus datus un pēc tam ģenerē atbildi, balstoties uz šiem datiem. Jautājums, kas ievadīts xloji.com 'Uzdot jautājumu' lodziņā, vispirms tiek meklēts OpenRAG atbilstošajā saturā, un pēc tam, balstoties uz šo saturu, tiek ģenerēta atbilde. Tā pati infrastruktūra nodrošina, ka mākslīgā intelekta rīki ārpus xloji.com var piekļūt xloji.com informācijai caur OpenRAG un izmantot šo informāciju savās atbildēs. Šī struktūra ļauj xloji.com nodrošināt pakalpojumus caur vienu centralizētu infrastruktūru, nevis izveidot atsevišķus mākslīgā intelekta risinājumus katram no saviem produktiem.
Būtiskā RAG pieejas loģika ir tā, ka mākslīgā intelekta sistēma, nevis paļaujas tikai uz iepriekš apmācīto vispārējo informāciju, vispirms iegūst aktuālu un precīzu saturu no avota un pēc tam sniedz atbildi, balstoties uz šo saturu. OpenRAG apvieno šīs divas darbības – meklēšanu (retrieval) un ģenerēšanu (generation) – savā serverī. Šī pieeja ir paredzēta, lai samazinātu mākslīgā intelekta modeļu tendenci radīt neesošu informāciju, jo atbilde ir atvasināta no faktiski atrastas informācijas, nevis no modeļa paša atmiņas. Tādējādi OpenRAG sniegtās atbildes nav nejaušas vai novecojušas, bet balstās uz xloji.com pašu saturu. Tādējādi atbildes avotu, ko ģenerē OpenRAG, var izsekot kā xloji.com savu datu. Fakts, ka serveris pieder xloji.com, nozīmē, ka meklētie un apstrādātie dati tiek glabāti xloji.com kontrolē, nevis ir atkarīgi no trešās puses mākoņu pakalpojuma.
OpenRAG 'vienas durvju AI vārtejs' aspekts nozīmē, ka dažādi mākslīgā intelekta pieprasījumi un integrācijas tiek novirzīti caur vienu centralizētu ieejas punktu, nevis atsevišķas sistēmas. Tādējādi gan xloji.com paša 'Uzdot jautājumu' funkcija, gan ārējie rīki, kas pievienoti caur OpenRAG, izmanto vienu un to pašu infrastruktūru un vienu un to pašu pamatloģiku. Kā centralizēta vārteja OpenRAG nodrošina, ka ar mākslīgo intelektu saistītais satisms iet caur vienu punktu, kas palielina atbilžu konsekvenci un datu kontroli, jo sistēma darbojas savā serverī. Šī viena punkta pieeja arī nodrošina, ka apkopi un atjauninājumus var veikt vienā vietā, nevis sadalītās sistēmās. Šajā ziņā OpenRAG nav tikai jautājumu un atbilžu rīks, bet gan infrastruktūras slānis, kas apvieno visus xloji.com ar mākslīgo intelektu saistītos piekļuves punktus.
OpenRAG izmanto trīs dažādas lietotāju grupas tieši vai netieši: gala lietotāji, kas apmeklē xloji.com un ievada jautājumu 'Uzdot jautājumu' lodziņā, sistēmas, kas vaicā xloji.com savai RAG infrastruktūrai, un ārējie mākslīgā intelekta rīki, kas piekļūst xloji.com informācijai caur OpenRAG. Visas trīs lietotāju grupas saņem atbildes no tās pašas OpenRAG infrastruktūras un tās pašas satura krātuves; tādējādi neatkarīgi no tā, no kurienes tiek jautāts par xloji.com, tiek iegūts konsekvents informācijas avots. OpenRAG sniegtās atbildes ir ierobežotas ar tam nodrošināto saturu; tas nozīmē, ka no OpenRAG nevajadzētu sagaidīt precīzu atbildi par informāciju, kas nav atrodama sistēmā vai nav pievienota tā serverim. Šis ierobežojums ir arī OpenRAG uzticamības pamats: tā mērķis ir ģenerēt atbildes, kas ir ierobežotas ar pieejamo saturu un balstās uz to, nevis izdomāt neesošu informāciju.

