🧠 OpenRAG

OpenRAG je RAG platforma, ktorá čistí a štruktúruje obsah podniku, indexuje ho na našom vlastnom serveri a sprístupňuje ho na dotazovanie v prirodzenom jazyku externým systémom AI cez jedny povolené dvere.

Vektory sa nezverejňujú; PRÍSTUP sa otvára.

Toto je predstavenie produktu, nie zoznam sľubov. Čo funguje dnes a čo je stále v pláne, je nižšie označené samostatne. Pre položky v pláne sa nesľubujú žiadne termíny; keď sú dokončené, presunú sa do sekcie „funguje dnes“.

Základný princíp

Celý dizajn OpenRAG je založený na jednej vete: vektory sa nezverejňujú, prístup sa otvára. Čo sa poskytuje vonkajšiemu svetu, nie je kópia obsahu, ale právo na kladenie otázok.

⚙️

Vektor je motor, nie produkt

Vektor je špecifický pre model, ktorý ho vytvoril; iná AI ho nemôže použiť tak, ako je. Tiež mnohonásobne nafukuje text. Preto sa vektory nikdy nevydávajú.

🔑

Čo sa otvára, je prístup k dotazom

Príde otázka; späť sa vráti odpoveď a zdrojové pasáže, na ktorých je založená. Celý obsah sa nikdy nekopíruje, nedistribuuje ani nestiahne.

🤝

Povolenie patrí podniku

Podnik sa rozhoduje, ktorý obsah sa stane externým dotazovateľným; účasť je na základe výberu. Vrstva povolení a súhlasu je v pláne.

Ako to funguje — cieľová architektúra

Čistenie, štruktúrovanie, indexovanie a prepojenia vyhľadávania v tomto toku fungujú dnes. Samohostingové vkladanie s opätovným zoradením a jedny dvere do vonkajšieho sveta sú stále v pláne; každý krok nižšie uvádza, ktorý z nich je ktorý.

1

Zdroje sa zhromažďujú

Stránky xloji, nahrané dokumenty a prehľadané webové stránky sú zdrojmi obsahu. (WordPress plugin a verejné rozhranie API na ingestovanie sú v pláne.)

2

Je to očistené a štruktúrované

Neporiadny obsah sa vyčistí, rozdelí na zmysluplné časti a prevedie sa do formátu, ktorý RAG dokáže použiť. Tento krok funguje dnes.

3

Je to indexované a vyhľadávané

Časti sa prevedú na vektory a zapíšu do pgvector; nájdu sa cez index HNSW a hybridné vyhľadávanie (kľúčové slovo + vektor). Tento krok funguje dnes; pridanie prepojenia opätovného zoradenia je v pláne.

4

Je to prístupné cez jedny dvere

Externé systémy AI sa pýtajú v prirodzenom jazyku cez jedny povolené dvere; odpovede a zdrojové pasáže sa vracajú, nie samotné vektory. Tieto dvere zatiaľ neexistujú; sú v pláne.

Časti, ktoré fungujú dnesŽivé

Nasledujúce bežia na platforme dnes a už ich používajú nástroje AI na xloji.com.

🧮

pgvector + HNSW index

Časti obsahu sú uložené ako vektory v databáze a vyhľadávané pomocou indexu HNSW cez kosínusovú podobnosť.

🔎

Hybridné vyhľadávanie

Vyhľadávanie kľúčových slov a vyhľadávanie vektorov bežia súčasne; dva zoznamy výsledkov sa zlúčia do jedného zoradenia. To nájde presné zhody termínov a sémanticky blízke pasáže.

🧱

Izolácia pre viacerých klientov

Každý podnik, webová stránka a autor má svoj vlastný RAG. Dotaz beží iba proti indexu svojho klienta; dáta sa nikdy nemiešajú medzi klientmi.

🧹

Čistenie dokumentov a štruktúrovanie RAG

Nahrané dokumenty sa vyčistia, rozdelia a štruktúrujú pre RAG. Nástroj na štruktúrovanie dát na platforme je používateľské rozhranie tohto potrubia.

🕸️

Webové prehľadávanie

Stránky webu sa prehľadávajú, ich obsah sa extrahuje a prechádza rovnakým procesom čistenia a indexovania.

🧩

Verejný RAG feed v vlastných nástrojoch AI

Vlastný nástroj AI, ktorý vytvoríte, môže byť napájaný z verejného zdroja RAG; nástroj zakladá svoje odpovede na tejto znalostnej báze.

🗄️

Úložisko súborov a médií

Súbory a médiá sú uložené v objektovom úložisku – nie vo vektorovom úložisku. Záznam RAG odkazuje späť na pôvodný súbor.

🏠

Vkladanie a opätovné zoradenie na našich vlastných serveroch

Vkladanie a opätovné zoradenie teraz prebieha na našich vlastných serveroch v samostatnej službe. Text sa konvertuje na vektory bez opustenia servera a kandidátske výsledky prechádzajú lokálnym opätovným zoradením na zlepšenie presnosti.

✏️

Prepisovanie vyhľadávania

Nejasná alebo neúplná otázka sa upraví pred spustením vyhľadávania. Používatelia nemusia formulovať "správnu" otázku; systém pripraví vyhľadávanie na spustenie.

🎞️

Text z obrázkov, zvuku a videa

Extrakcia textu z obrázkov a prepis zvuku a videa prebieha s lokálnymi nástrojmi na serveri a výsledný text vstupuje do rovnakého čistiaceho a indexačného procesu. Dáta neopúšťajú server.

Čo je v plánePlánované

Nasledujúce zatiaľ neexistujú. Sú to plánované a navrhnuté položky; táto stránka ich neprezentuje, ako keby už boli postavené.

🚪

Jedny dvere: MCP / API brána

Jedna brána, na ktorú sa externé systémy AI môžu pýtať v prirodzenom jazyku. AI, ktorá sa raz pripojí, dosiahne každý zúčastnený podnik cez tie isté dvere.

🛡️

Vrstva povolení a súhlasu

Podniky sa pripoja na základe vlastnej voľby; autentifikácia, správa kľúčov, obmedzovanie rýchlosti a ochrana pred zneužitím sú obsiahnuté v tejto vrstve.

📡

Vrstva viditeľnosti AI

Umožnenie zistiteľnosti obsahu strojmi pomocou llms.txt, /.well-known/ a značkovania schema.org, plus registrácia v registroch MCP. Neexistuje žiadne magické automatické zistenie; viditeľnosť je vybudovaná týmto spôsobom.

🔌

WordPress plugin

Plugin, ktorý umožňuje webovej stránke WordPress poslať svoj obsah do OpenRAG a získať koncový bod, ktorý môžu AI systémy dotazovať.

Pre tieto položky neuvádzame dátumy. Keď je položka dokončená, presunie sa do zoznamu „časti, ktoré fungujú dnes“ a táto stránka sa aktualizuje.

🔒 Údaje neopúšťajú server

Cieľom OpenRAG je spustiť každý krok potrubia RAG na našom vlastnom serveri s lokálnymi, bezplatnými nástrojmi: vkladanie, opätovné zoradenie, extrakcia textu z obrázkov a prepis zvuku. Žiadne médiá vstupujúce do RAG sa neposielajú na externú službu – toto je nediskutovateľné pravidlo dizajnu.

Úprimný stav: niektoré z týchto krokov vykonávajú dnes externé služby. Presun ich dovnútra je prvou položkou v pláne.

Ako je plánovaný rast

Vyhľadávanie vektorov je drahšie, keď rastie obsah. Dizajn OpenRAG obmedzuje tieto náklady od začiatku tromi spôsobmi.

Neexistuje jeden obrovský index

Každý podnik má svoj vlastný malý index a dotaz beží iba proti tomuto indexu. Aj keď celkový obsah rastie, oblasť, ktorú jeden dotaz prehľadá, zostáva malá; náklady na vyhľadávanie sa škálujú s veľkosťou tohto podniku, nie s celkovou veľkosťou platformy.

Veľkosť a presnosť vektora sú nastaviteľné

Použitím kratších rozmerov vektora a kompaktnejších číselných formátov zaberá rovnaký obsah výrazne menej miesta. Tieto voľby sú zabudované do dizajnu od začiatku, takže nie je potrebná žiadna nákladná migrácia neskôr.

Studená úroveň

Index podniku, ktorý nebol dlhý čas dotazovaný, sa presunie do lacného trvalého úložiska a vráti sa, keď príde dotaz. Takto zostane v rýchlej pamäti iba aktuálny obsah. Táto úroveň je v pláne.

Často kladené otázky

Čo presne je OpenRAG?

Je to RAG platforma, ktorá čistí a štruktúruje obsah podniku, indexuje ho na našom vlastnom serveri a sprístupňuje ho na dotazovanie v prirodzenom jazyku externým systémom AI cez jedny povolené dvere. Nie je to nástroj na chatovanie; je to znalostná vrstva, ktorá beží pod takýmito nástrojmi.

Poskytnete moje vektory alebo môj obsah niekomu inému?

Nie. Základný princíp je: vektory sa nezverejňujú, prístup sa otvára. Čo ide von, nie je kópia obsahu, ale právo na kladenie otázok; späť sa vracajú iba podporné pasáže. Okrem toho sa podnik rozhoduje, ktorý obsah sa stane externým dotazovateľným.

Čo sa dá reálne používať dnes?

Vektorová databáza a index, hybridné vyhľadávanie, viacnásobná izolácia nájomníkov, čistenie dokumentov a štruktúrovanie RAG, webové prehľadávanie, verejný RAG feed v prispôsobených nástrojoch AI a úložisko súborov/médií fungujú už dnes. Samohostované vkladanie, prehodnocovanie, prepisovanie dotazov, vonkajšie dvere, vrstva povolení, vrstva viditeľnosti a WordPress plugin zatiaľ neexistujú.

Opúšťajú moje dáta server?

Cieľom je, aby každý krok RAG pipeline fungoval s lokálnymi nástrojmi na serveri, bez toho aby sa akékoľvek médiá v RAG posielali do externých služieb. Úprimný stav: niektoré z týchto krokov sú dnes stále spracovávané externými službami a presun ich do vlastnej réžie je prvou položkou na mape ciest.

Kedy budú funkcie na mape ciest pripravené?

Nesľubujeme dátumy. Práve v tom spočíva účel tejto stránky: ukázať oddelene, čo funguje dnes a čo je plánované. Keď je položka dokončená, presunie sa do zoznamu "časti, ktoré fungujú dnes".

Používa sa alebo predáva môj obsah na tréning AI?

Nie. Takéto použitie dnes neexistuje. Myšlienka povoleného textového korpusu je najvzdialenejšou a právne najťažšou položkou na mape ciest; aj keby sa stala skutočnosťou, žiadny obsah by sa na ňu nepoužil bez výslovného súhlasu podniku.

Vráťte sa späť na AI portál pre ostatné AI nástroje.

Často kladené otázky

Čo je OpenRAG?

OpenRAG je systém RAG (Retrieval-Augmented Generation) a jednotná AI brána, ktorá beží na vlastnom serveri xloji.com. Keď príde otázka, najprv nájde relevantný obsah a potom vygeneruje odpoveď na základe tohto obsahu. Zároveň slúži ako centralizovaná brána, ktorá umožňuje nástrojom umelej inteligencie mimo xloji.com prístup k informáciám patriacim xloji.com z jedného bodu.

Čo znamená RAG a ako to OpenRAG implementuje?

RAG znamená 'Retrieval-Augmented Generation', teda generovanie obohatené o vyhľadávanie; umelá inteligencia vyhľadáva informácie z relevantných zdrojov pred vygenerovaním odpovede a potom vytvorí odpoveď na základe týchto informácií. OpenRAG tieto dva kroky, vyhľadávanie a generovanie, kombinuje a spúšťa na vlastnom serveri. Vďaka tomu sa odpovede, ktoré OpenRAG poskytuje, nezakladajú na náhodných dátach, ale na skutočnom obsahu patriacom xloji.com.

Čo znamená 'jedna brána AI'?

Jedna brána AI znamená, že rôzne požiadavky a integrácie umelej inteligencie prechádzajú cez jeden centralizovaný vstupný bod namiesto samostatných systémov. OpenRAG preberá túto úlohu: funkcia 'Pýtajte sa' od xloji.com a nástroje umelej inteligencie pripojené zvonku využívajú rovnakú infraštruktúru OpenRAG. Táto centralizovaná štruktúra umožňuje spravovať AI prevádzku z jedného bodu.

Aký je rozdiel v tom, že OpenRAG beží na vlastnom serveri?

OpenRAG beží na vlastnom serveri xloji.com bez závislosti od služby tretej strany v cloude. To znamená, že vyhľadávané a spracovávané údaje zostávajú pod kontrolou xloji.com. Ako štruktúra bežiaca na vlastnom serveri OpenRAG vykonáva vyhľadávanie a generovanie odpovedí v rámci vlastnej infraštruktúry bez prenosu dát do externých systémov.

Kto používa OpenRAG?

OpenRAG používa tri rôzne skupiny: koncoví používatelia, ktorí navštívia xloji.com a napíšu do poľa „Položiť otázku“, systémy, ktoré dotazujú vlastnú RAG infraštruktúru xloji.com a externé nástroje umelej inteligencie, ktoré pristupujú k informáciám xloji.com cez OpenRAG. Pre koncového používateľa OpenRAG vráti odpoveď založenú na obsahu xloji.com na jeho otázku. Pre externé nástroje je OpenRAG bezkontextovými bránami na získavanie informácií z xloji.com.

Ako funguje pole „Položiť otázku“ na xloji.com s OpenRAG?

Otázka napísaná do poľa „Položiť otázku“ na xloji.com je spracovaná OpenRAG. OpenRAG najprv vyhľadá obsah súvisiaci s otázkou v rámci vlastných dát xloji.com, a potom vytvorí odpoveď na základe tohto obsahu. Vďaka tomu je odpoveď poskytnutá používateľovi podložená skutočným obsahom xloji.com.

Ako externé nástroje umelej inteligencie získavajú informácie cez OpenRAG?

OpenRAG slúži ako jediná brána pre prístup k informáciám xloji.com pre nástroje umelej inteligencie mimo xloji.com. Tieto nástroje sa môžu pripojiť cez OpenRAG a získať odpovede, ktoré sú bezkontextové a samé o sebe zrozumiteľné z obsahu xloji.com. Preto sú informácie poskytované cez OpenRAG navrhnuté tak, aby boli zmysluplné samé o sebe bez potreby ďalšieho kontextu.

Aké sú obmedzenia OpenRAG?

Odpovede OpenRAG sú obmedzené poskytnutým obsahom; OpenRAG nedokáže poskytnúť definitívnu odpoveď na informácie, ktoré v systéme nie sú obsiahnuté alebo neboli pridané. OpenRAG je navrhnutý tak, aby sa držal obsahu, ktorý má k dispozícii, namiesto vymýšľania neexistujúcich informácií. Preto by sa nemalo zabúdať na to, že odpoveď získaná od OpenRAG je obmedzená obsahom, ktorý má xloji.com v danom momente k dispozícii.

Je OpenRAG chatbot?

OpenRAG nie je klasický nezávislý chatbot; je to RAG a brána infraštruktúra, ktorá poháňa funkciu 'Pýtajte sa' na xloji.com a prístup k informáciám pomocou externých nástrojov. Hlavnou úlohou OpenRAG je nájsť obsah, ktorý zodpovedá otázke, a vygenerovať odpoveď na základe tohto obsahu. V tomto stave funguje OpenRAG skôr ako infraštruktúrna vrstva za odpoveďami, než ako rozhranie priamo komunikujúce s používateľom.

Aký je účel OpenRAG pre xloji.com?

Účelom OpenRAG je umožniť prístup k informáciám vlastníkom xloji.com, a to ako koncovým používateľom, tak aj externým nástrojom umelej inteligencie, prostredníctvom spoľahlivej a infraštruktúry, ktorú sami kontrolujú. Jeho spustenie na vlastnom serveri zabezpečuje, že tento prístup prebieha bez závislosti od tretích systémov. Vďaka štruktúre jednoduchej brány OpenRAG kombinuje rôzne prístupové body do jedného centrálneho systému.

Podrobné informácie o OpenRAG

OpenRAG je systém RAG (Retrieval-Augmented Generation), ktorý beží na vlastnom serveri xloji.com a zároveň je AI bránou, ktorá prechováva požiadavky súvisiace s umelou inteligenciou z jedného bodu. Výraz „Open“ v jeho názve naznačuje, že systém ponúka otvorenú a prístupnú štruktúru, zatiaľ čo výraz „RAG“ označuje spôsob jeho fungovania, ktorý spočíva v najprv vyhľadaní relevantných údajov a následnom generovaní odpovede na základe týchto údajov. Otázka napísaná do poľa „Položte otázku“ na stránke xloji.com sa najprv vyhľadá v relevantnom obsahu pomocou OpenRAG a potom sa na základe tohto obsahu vygeneruje odpoveď. Tá istá infraštruktúra umožňuje aj nástrojom umelej inteligencie mimo xloji.com pristupovať k informáciám xloji.com cez OpenRAG a používať tieto informácie vo svojich odpovediach. Táto štruktúra umožňuje xloji.com poskytovať služby prostredníctvom jednej centrálnej infraštruktúry namiesto inštalácie samostatných riešení umelej inteligencie pre rôzne produkty.

Základná logika prístupu RAG spočíva v tom, že systém umelej inteligencie sa nespolieha iba na všeobecné znalosti, ktoré získal počas predchádzajúceho tréningu, ale najprv získa aktuálne a presné informácie zo zdroja a potom na základe týchto informácií odpovie. OpenRAG vykonáva tieto dva kroky, kroky vyhľadávania (retrieval) a generovania (generation), spoločne na svojom serveri. Tento prístup má za cieľ znížiť tendenciu modelov umelej inteligencie niekedy generovať neexistujúce informácie, pretože odpoveď je odvodená od skutočne nájdeného obsahu, a nie od pamäte modelu. Vďaka tomu odpovede, ktoré OpenRAG poskytuje, nie sú náhodné alebo zastarané, ale vychádzajú z vlastného obsahu xloji.com. Zdroj odpovede vygenerovanej OpenRAG tak môže byť vysledovaný ako vlastné údaje xloji.com. Skutočnosť, že server patrí xloji.com, znamená, že hľadané a spracovávané údaje sú pod kontrolou xloji.com bez závislosti od cloudovej služby tretej strany.

Strana „jednodverová AI brána“ OpenRAG znamená, že rôzne požiadavky a integrácie umelej inteligencie sú smerované z jedného centrálneho vstupného bodu namiesto samostatných systémov. Vďaka tomu funkcia „Položte otázku“ xloji.com a externé nástroje pripojené cez OpenRAG používajú rovnakú infraštruktúru a rovnakú základnú logiku. Ako centrálna brána zabezpečuje OpenRAG prechod všetkej dopravy súvisiacej s umelou inteligenciou cez jeden bod, čo zvyšuje konzistentnosť odpovedí a kontrolu nad údajmi ako systému bežiacim na vlastnom serveri. Tento prístup s jedným bodom tiež umožňuje údržbu a aktualizácie na jednom mieste namiesto rozptýlených systémov. OpenRAG je v tomto smere nielen nástroj na odpovedanie na otázky, ale aj infraštrukturná vrstva, ktorá spája všetky prístupové body xloji.com k umelej inteligencii.

OpenRAG používajú priamo alebo nepriamo tri rôzne skupiny používateľov: koncoví používatelia, ktorí navštevujú xloji.com a zadávajú otázky do poľa „Položte otázku“, systémy, ktoré dotazujú RAG infraštruktúru xloji.com, a externé nástroje umelej inteligencie, ktoré pristupujú k informáciám xloji.com cez OpenRAG. Všetky tieto tri skupiny používateľov dostávajú odpovede z rovnakej infraštruktúry OpenRAG, z rovnakého zdroja obsahu; preto bez ohľadu na to, kde sa pýtate na xloji.com, dosiahnete na konzistentný zdroj informácií. Odpovede, ktoré OpenRAG poskytuje, sú obmedzené poskytnutým obsahom; to znamená, že od OpenRAG by ste nemali očakávať presnú odpoveď na informácie, ktoré v systéme nie sú obsiahnuté alebo neboli pridané na jeho server. Toto obmedzenie je zároveň základom spoľahlivosti OpenRAG: namiesto vymýšľania neexistujúcich informácií sa snaží generovať odpovede obmedzené a založené na obsahu, ktorý má k dispozícii.

OpenRAG — Odomknite svoj obsah pre AI cez jedny povolené dvere | xloji.com