🧠 OpenRAG
OpenRAG je platforma RAG, která vyčistí a strukturová váš firemní obsah, indexuje jej na našem vlastním serveru a zpřístupní jej pro dotazování v přirozeném jazyce externím systémům AI prostřednictvím jediných autorizovaných dveří.
Vektory nejsou publikovány; PŘÍSTUP je otevřen.
Toto je představení produktu, nikoli seznam slibů. Níže jsou části, které fungují dnes, a části, které jsou stále v plánu, označeny samostatně. Pro položky v plánu nejsou slibovány žádné termíny; jakmile jsou dokončeny, přesunou se do sekce „funguje dnes“.
Základní princip
Celý design OpenRAG spočívá na jedné větě: vektory nejsou publikovány, přístup je otevřen. To, co je dáno ven, není kopie obsahu, ale právo se na něj ptát.
Vektor je motor, nikoli produkt
Vektor je specifický pro model, který jej vytvořil; jiná AI jej nemůže tak, jak je, použít. Také mnohonásobně nafukuje text. Proto se vektory nikdy nevydávají.
Otevřen je přístup k dotazům
Přijde dotaz; zpět se vrátí odpověď a zdrojové pasáže, na kterých je založena. Celý obsah není nikdy kopírován, distribuován nebo stahován.
Oprávnění patří firmě
Firma se rozhoduje, který obsah bude externě dotazovatelný; účast je volitelná. Vrstva oprávnění a souhlasu je v plánu.
Jak to funguje — cílová architektura
Čištění, strukturování, indexování a propojování vyhledávání v tomto toku fungují dnes. Samohostované vkládání s přerovnáváním a jediné dveře do světa jsou stále v plánu; každý krok níže uvádí, který z nich je který.
Zdroje jsou shromažďovány
Stránky xloji, nahrané dokumenty a procházené webové stránky jsou zdroji obsahu. (WordPress plugin a veřejné ingestovací API jsou v plánu.)
Je čištěn a strukturován
Nepřehledný obsah je vyčištěn, rozdělen do smysluplných částí a převeden do formátu použitelného pro RAG. Tento krok funguje dnes.
Je indexován a vyhledáván
Části jsou převedeny na vektory a zapsány do pgvector; jsou nalezeny pomocí HNSW indexu a hybridního vyhledávání (klíčové slovo + vektor). Tento krok funguje dnes; přidání propojení přerovnávání je v plánu.
Je k němu přistupováno přes jedny dveře
Externí systémy AI se ptají v přirozeném jazyce přes jedny autorizované dveře; odpovědi a zdrojové pasáže se vrací, nikoli samotné vektory. Tyto dveře ještě neexistují; jsou v plánu.
Části, které fungují dnesŽivě
Následující běží na platformě dnes a jsou již používány nástroji AI na xloji.com.
pgvector + HNSW index
Části obsahu jsou uloženy jako vektory v databázi a vyhledávány pomocí HNSW indexu přes kosinovou podobnost.
Hybridní vyhledávání
Klíčové slovo a vektorové vyhledávání běží společně; oba seznamy výsledků jsou sloučeny do jediného pořadí. To najde jak přesné shody termínů, tak sémanticky blízké pasáže.
Izolace pro více tenantů
Každá firma, web a autor má svůj vlastní RAG. Dotaz běží pouze proti indexu svého vlastního tenanta; data se nikdy nemíchají mezi tenanty.
Čištění dokumentů a strukturování RAG
Nahrané dokumenty jsou vyčištěny, rozděleny a strukturovány pro RAG. Nástroj pro strukturování dat na platformě je uživatelsky přívětivou tváří tohoto pipeline.
Webové procházení
Stránky webu jsou procházeny, jejich obsah je extrahován a prochází stejným procesem čištění a indexování.
Veřejný RAG feed v vlastních nástrojích AI
Vlastní nástroj AI, který vytvoříte, může být napájen z veřejného zdroje RAG; nástroj zakládá své odpovědi na této znalostní bázi.
Úložiště souborů a médií
Soubory a média jsou uloženy v objektovém úložišti – nikoli v úložišti vektorů. Záznam RAG odkazuje zpět na původní soubor.
Vkládání a přerovnávání na našich vlastních serverech
Vkládání a přerovnávání nyní běží na našich vlastních serverech v samostatné službě. Text je převeden na vektory, aniž by opustil server, a kandidátské výsledky procházejí lokálním přerovnávačem pro zlepšení přesnosti.
Přepisování dotazů
Nejasná nebo neúplná otázka je upravena před spuštěním vyhledávání. Uživatelé se nemusí formulovat "správnou" otázku; systém připraví dotaz pro vyhledávání.
Text z obrázků, audia a videa
Extrakce textu z obrázků a přepis audia a videa běží s lokálními nástroji na serveru a výsledný text prochází stejným procesem čištění a indexace. Data neopouštějí server.
Co je v plánuPlánováno
Následující ještě neexistují. Jsou to plánované a navržené položky; tato stránka je nepředstavuje tak, jako by již byly postaveny.
Jedny dveře: MCP / API gateway
Jedna brána, kterou mohou externí systémy AI dotazovat v přirozeném jazyce. AI, která se jednou připojí, dosáhne každé účastnící se firmy prostřednictvím stejných dveří.
Vrstva oprávnění a souhlasu
Firmy se připojují vlastní volbou; autentizace, správa klíčů, omezení rychlosti a ochrana proti zneužití jsou obsaženy v této vrstvě.
Vrstva viditelnosti AI
Zpřístupnění obsahu strojům pomocí llms.txt, /.well-known/ a značkování schema.org, plus registrace v registrech MCP. Neexistuje žádné magické automatické objevování; viditelnost je budována tímto způsobem.
WordPress plugin
Plugin, který umožní webu WordPress odeslat svůj obsah do OpenRAG a získat koncový bod, který mohou dotazovat systémy AI.
Neposkytujeme termíny pro tyto položky. Jakmile je položka dokončena, přesune se do seznamu „části, které fungují dnes“ a tato stránka bude odpovídajícím způsobem aktualizována.
🔒 Data neopouštějí server
Cílem OpenRAG je spustit každý krok pipeline RAG na našem vlastním serveru s lokálními, bezplatnými nástroji: vkládání, přerovnávání, extrakce textu z obrázků a přepis zvuku. Žádná média vstupující do RAG nejsou odesílána externí službě – to je nediskutovatelná zásada návrhu.
Upřímný stav: některé z těchto kroků jsou dnes prováděny externími službami. Přesunout je dovnitř je první položka v plánu.
Jak je plánován růst
Vyhledávání vektorů je dražší s rostoucím obsahem. Návrh OpenRAG omezuje tyto náklady od začátku třemi způsoby.
Neexistuje jeden obrovský index
Každá firma má svůj vlastní malý index a dotaz běží pouze proti tomuto indexu. I když celkový obsah roste, oblast, kterou jeden dotaz prohledává, zůstává malá; náklady na vyhledávání se škálují s velikostí této firmy, nikoli s celkovou velikostí platformy.
Velikost a přesnost vektoru jsou nastavitelné
Použitím kratších rozměrů vektoru a kompaktnějších číselných formátů zabírá stejný obsah výrazně méně místa. Tato volba je zabudována do návrhu od začátku, takže není potřeba žádná nákladná migrace později.
Cold tier
Index firmy, která nebyla dlouho dotazována, je přesunut do levného trvalého úložiště a načten zpět, když pro ni přijde dotaz. Tímto způsobem zůstává v rychlé paměti pouze aktuální obsah. Tato vrstva je v plánu.
Často kladené otázky
Co přesně je OpenRAG?
Je to platforma RAG, která vyčistí a strukturová váš firemní obsah, indexuje jej na našem vlastním serveru a zpřístupní jej pro dotazování v přirozeném jazyce externím systémům AI prostřednictvím jediných autorizovaných dveří. Není to chatovací nástroj; je to znalostní vrstva, která běží pod takovými nástroji.
Předáte mé vektory nebo můj obsah někomu jinému?
Ne. Základní princip je: vektory nejsou publikovány, přístup je otevřen. Ven jde nejen kopie obsahu, ale právo se na něj ptát; vrací se pouze podpůrné pasáže. Navíc se firma rozhoduje, který obsah bude externě dotazovatelný.
Co lze skutečně použít dnes?
Vektorová databáze a index, hybridní vyhledávání, multi-tenant izolace, čištění dokumentů a strukturování RAG, webové procházení, veřejný RAG feed v vlastních nástrojích AI a úložiště souborů/médií fungují dnes. Vlastní hostované vkládání, přerovnávání, přepisování dotazů, externí dveře, vrstva oprávnění, vrstva viditelnosti a plugin pro WordPress zatím neexistují.
Opouštějí moje data server?
Cílem je, aby každý krok RAG pipeline běžel s lokálními nástroji na serveru, bez odesílání jakýchkoli médií do RAG externí službě. Upřímný stav: některé z těchto kroků jsou dnes stále zpracovávány externími službami a přesunutí do vlastních sil je první položkou na roadmapě.
Kdy budou funkce na roadmapě hotové?
Nedáváme žádné termíny. To je přesně účel této stránky: ukázat odděleně, co funguje dnes a co je plánováno. Jakmile je položka dokončena, přesune se do seznamu "částí, které fungují dnes".
Jsou mé obsahy používány nebo prodávány pro trénink AI?
Ne. Takové použití dnes neexistuje. Myšlenka povoleného textového korpusu je nejvzdálenější, právně nejnáročnější položkou na roadmapě; i kdyby se stala realitou, žádný obsah by pro ni nebyl použit bez výslovného souhlasu firmy.
Vraťte se zpět do AI portálu pro další nástroje AI.
Často kladené otázky
Co je OpenRAG?
OpenRAG je systém RAG (Retrieval-Augmented Generation) a jednotná AI brána, která běží na vlastním serveru xloji.com. Když přijde otázka, nejprve najde relevantní obsah a poté vygeneruje odpověď na základě tohoto obsahu. Zároveň slouží jako centrální brána, která umožňuje nástrojům umělé inteligence mimo xloji.com přístup k informacím vlastněným xloji.com z jediného místa.
Co znamená RAG a jak to OpenRAG implementuje?
RAG znamená 'Retrieval-Augmented Generation', tedy generování obohacené o vyhledávání; umělá inteligence vyhledá informace z relevantních zdrojů před vygenerováním odpovědi a poté vytvoří odpověď na základě těchto informací. OpenRAG provádí tyto dva kroky, kroky vyhledávání a generování, spojením na svém vlastním serveru. Díky tomu se odpovědi OpenRAG nezakládají na náhodě, ale na skutečném obsahu vlastněném xloji.com.
Co znamená 'jedna brána AI'?
'Jedna brána AI' znamená, že různé požadavky a integrace umělé inteligence jsou zpracovávány přes jeden centrální vstupní bod namísto samostatných systémů. OpenRAG tuto roli přebírá: jak vlastní funkce 'Zeptej se' xloji.com, tak nástroje umělé inteligence připojené zvenčí využívají stejnou infrastrukturu OpenRAG. Tato centralizovaná struktura umožňuje správu veškerého provozu souvisejícího s umělou inteligencí z jediného místa.
Jaký rozdíl má běh OpenRAG na vlastním serveru?
OpenRAG běží na vlastním serveru xloji.com bez závislosti na službě třetí strany v cloudu. To znamená, že vyhledávaná a zpracovávaná data zůstávají pod kontrolou xloji.com. Jako struktura běžící na vlastním serveru OpenRAG provádí vyhledávání a generování odpovědí v rámci vlastní infrastruktury bez přenosu dat do externích systémů.
Kdo OpenRAG používá?
OpenRAG používají tři různé skupiny: koncoví uživatelé, kteří navštíví xloji.com a napíší dotaz do pole „Zeptej se“, systémy, které dotazují vlastní RAG infrastrukturu xloji.com, a externí nástroje umělé inteligence, které přistupují k informacím xloji.com prostřednictvím OpenRAG. Pro koncového uživatele OpenRAG vrátí odpověď založenou na obsahu xloji.com. Pro externí nástroje je OpenRAG bezkontextové rozhraní pro získávání informací z xloji.com.
Jak funguje pole „Zeptej se“ na xloji.com s OpenRAG?
Dotaz zadaný do pole „Zeptej se“ na xloji.com je zpracován OpenRAG. OpenRAG nejprve vyhledá relevantní obsah v datech xloji.com, a poté na základě tohoto obsahu vytvoří odpověď. Tímto způsobem je odpověď poskytnutá uživateli podpořena skutečným obsahem xloji.com.
Jak externí nástroje umělé inteligence získávají informace prostřednictvím OpenRAG?
OpenRAG slouží jako jediná brána pro přístup k informacím xloji.com pro nástroje umělé inteligence mimo xloji.com. Tyto nástroje se mohou připojit přes OpenRAG a získat srozumitelné odpovědi z obsahu xloji.com, které jsou bez kontextu. Informace poskytované prostřednictvím OpenRAG jsou proto navrženy tak, aby byly smysluplné samostatně, bez potřeby dalšího kontextu.
Jaké jsou limity OpenRAG?
Odpovědi poskytované OpenRAG jsou omezeny obsahem, který mu byl poskytnut; OpenRAG nemůže poskytnout definitivní odpověď na informace, které v systému nejsou obsaženy nebo nebyly přidány. OpenRAG je navržen tak, aby se omezil na dostupný obsah, místo aby si vymýšlel neexistující informace. Proto je třeba mít na paměti, že odpověď získaná od OpenRAG je omezena obsahem, který má xloji.com v daném okamžiku k dispozici.
Je OpenRAG chatbot?
OpenRAG není klasický samostatný chatbot; je to RAG a gateway infrastruktura, která pohání funkci 'Zeptej se' na xloji.com a přístup k informacím externích nástrojů. Hlavním úkolem OpenRAG je najít obsah odpovídající otázce a vygenerovat odpověď na základě tohoto obsahu. V této podobě OpenRAG funguje spíše jako infrastrukturní vrstva za odpověďmi než jako rozhraní přímo komunikující s uživatelem.
Jaký je účel OpenRAG pro xloji.com?
Účelem OpenRAG je umožnit jak koncovým uživatelům, tak externím nástrojům umělé inteligence spolehlivý a kontrolovaný přístup k informacím patřícím xloji.com prostřednictvím vlastní infrastruktury. Jeho provoz na vlastním serveru zajišťuje, že tento přístup probíhá bez závislosti na systémech třetích stran. Díky struktuře jedné brány OpenRAG sjednocuje různé přístupové body do jednoho centrálního systému.
Podrobné informace o OpenRAG
OpenRAG je systém RAG (Retrieval-Augmented Generation) běžící na vlastním serveru společnosti xloji.com a zároveň AI brána, která směruje požadavky související s umělou inteligencí z jednoho bodu. Slovo „Open“ v názvu naznačuje, že systém nabízí otevřenou a přístupnou strukturu, zatímco „RAG“ označuje způsob fungování, kdy systém nejprve najde relevantní data a poté na základě těchto dat generuje odpověď. Otázka zadaná do pole „Zeptej se“ na xloji.com je nejprve vyhledána v relevantním obsahu pomocí OpenRAG a poté je na základě tohoto obsahu generována odpověď. Stejná infrastruktura umožňuje i nástrojům umělé inteligence mimo xloji.com přístup k informacím společnosti xloji.com prostřednictvím OpenRAG a využívat tyto informace ve svých vlastních odpovědích. Tato struktura umožňuje společnosti xloji.com poskytovat služby prostřednictvím jedné centralizované infrastruktury namísto budování samostatných řešení umělé inteligence pro různé produkty.
Základní logika přístupu RAG spočívá v tom, že systém umělé inteligence se nespoléhá pouze na obecné znalosti, na kterých byl předem trénován, ale nejprve načte aktuální a přesný obsah ze zdroje související s otázkou a poté odpoví na základě tohoto obsahu. OpenRAG kombinuje tyto dva kroky, tedy vyhledávání (retrieval) a generování (generation), a spouští je na svém vlastním serveru. Tento přístup má snížit tendenci modelů umělé inteligence někdy generovat neexistující informace, protože odpověď je odvozena z obsahu, který byl skutečně nalezen, a nikoli z vlastní paměti modelu. Díky tomu se odpovědi poskytované OpenRAG nezakládají na náhodných nebo zastaralých informacích, ale na vlastním obsahu společnosti xloji.com. Zdroj odpovědi generované OpenRAG tak zůstává sledovatelný jako vlastní data společnosti xloji.com. Vlastnictví serveru společností xloji.com znamená, že vyhledávaná a zpracovávaná data jsou držena pod kontrolou společnosti xloji.com bez závislosti na cloudové službě třetí strany.
Strana OpenRAG jako „jednobodová AI brána“ znamená směrování různých požadavků a integrací umělé inteligence z jednoho centralizovaného vstupního bodu namísto samostatných systémů. Díky tomu jak funkce „Zeptej se“ společnosti xloji.com, tak externí nástroje připojené přes OpenRAG používají stejnou infrastrukturu a stejnou základní logiku. Jako centralizovaná brána zajišťuje OpenRAG, aby veškerý provoz související s umělou inteligencí procházel jedním bodem, což zvyšuje jak konzistenci odpovědí, tak kontrolu nad daty, protože systém běží na vlastním serveru. Tento přístup s jedním bodem také umožňuje provádět údržbu a aktualizace na jednom místě namísto rozptýlených systémů. OpenRAG je v tomto ohledu nejen nástroj pro otázky a odpovědi, ale také infrastrukturní vrstva, která sjednocuje všechny přístupové body společnosti xloji.com související s umělou inteligencí.
OpenRAG používají přímo nebo nepřímo tři různé skupiny uživatelů: koncoví uživatelé, kteří navštíví xloji.com a zadají otázku do pole „Zeptej se“, systémy, které dotazují vlastní infrastrukturu RAG společnosti xloji.com, a externí nástroje umělé inteligence, které přistupují k informacím společnosti xloji.com prostřednictvím OpenRAG. Všechny tři skupiny uživatelů získávají odpovědi ze stejné infrastruktury OpenRAG a ze stejného fondu obsahu; proto, bez ohledu na to, odkud se o xloji.com ptáte, získáte přístup ke konzistentnímu zdroji informací. Odpovědi poskytované OpenRAG jsou omezeny obsahem, který mu byl poskytnut; to znamená, že od OpenRAG nelze očekávat přesnou odpověď na informace, které v systému nejsou obsaženy nebo nebyly přidány na jeho server. Toto omezení je také základem spolehlivosti OpenRAG: namísto vymýšlení neexistujících informací se snaží generovat odpovědi omezené a založené na obsahu, který má k dispozici.

