🧠 OpenRAG

OpenRAG е RAG платформа, която почиства и структурира съдържанието на бизнеса, индексира го на нашия собствен сървър и го прави достъпен за заявки на естествен език от външни AI системи чрез една разрешена врата.

Векторите не се публикуват; ДОСТЪПЪТ е отворен.

Това е представяне на продукт, а не списък с обещания. По-долу, частите, които работят днес, и тези, които все още са на пътната карта, са маркирани отделно. За елементите от пътната карта не се обещават срокове; когато бъдат завършени, те се преместват в секцията „работи днес“.

Основният принцип

Целият дизайн на OpenRAG се основава на едно изречение: векторите не се публикуват, достъпът е отворен. Това, което се предоставя навън, не е копие на съдържанието, а правото да му се задават въпроси.

⚙️

Векторът е двигател, а не продукт

Векторът е специфичен за модела, който го е създал; друг AI не може да го използва такъв, какъвто е. Освен това той увеличава текста многократно. Затова векторите никога не се предоставят.

🔑

Отворен е достъпът до заявки

Заявка идва; отговор и изходните пасажи, на които се основава, се връщат обратно. Цялото съдържание никога не се копира, разпространява или изтегля.

🤝

Разрешението принадлежи на бизнеса

Бизнесът решава кое съдържание става достъпно за външни заявки; участието е доброволно. Слойът за разрешение и съгласие е на пътната карта.

Как работи — целева архитектура

Връзките за почистване, структуриране, индексиране и търсене на този поток работят днес. Самостоятелното хостване на вграждане с преподреждане и единичната врата към външния свят са все още на пътната карта; всяка стъпка по-долу посочва коя е коя.

1

Събират се източници

Сайтовете на xloji, качените документи и обходените уеб страници са източниците на съдържание. (Плъгин за WordPress и публичен API за приемане са на пътната карта.)

2

Почиства се и се структурира

Неподреденото съдържание се почиства, разделя се на смислени части и се привежда във форма, която RAG може да използва. Тази стъпка работи днес.

3

Индексира се и се търси

Частите се превръщат във вектори и се записват в pgvector; те се намират чрез HNSW индекс и хибридно търсене (ключова дума + вектор). Тази стъпка работи днес; добавянето на връзката за преподреждане е на пътната карта.

4

Достъпът до него е през една врата

Външните AI системи питат на естествен език през една разрешена врата; отговорите и изходните пасажи се връщат, а не самите вектори. Тази врата все още не съществува; тя е на пътната карта.

Частите, които работят днесНа живо

Следните са работещи на платформата днес и вече се използват от AI инструментите на xloji.com.

🧮

pgvector + HNSW индекс

Частите от съдържанието се съхраняват като вектори в базата данни и се търсят с HNSW индекс върху косинусова прилика.

🔎

Хибридно търсене

Търсенето по ключови думи и търсенето по вектори работят заедно; двата списъка с резултати се обединяват в едно класиране. Това намира както точни съвпадения на термини, така и семантично близки пасажи.

🧱

Многопотребителска изолация

Всеки бизнес, сайт и автор има свой собствен RAG. Заявката работи само срещу индекса на собствения си клиент; данните никога не се смесват между клиентите.

🧹

Почистване на документи и структуриране на RAG

Качените документи се почистват, разделят на части и структурират за RAG. Инструментът за структуриране на данни на платформата е потребителският интерфейс на този процес.

🕸️

Уеб обхождане

Страниците на сайта се обхождат, извлича се съдържанието им и се прекарва през същия процес на почистване и индексиране.

🧩

Публичен RAG канал в персонализирани AI инструменти

Персонализиран AI инструмент, който създавате, може да бъде захранван от публичен RAG източник; инструментът основава своите отговори на тази база знания.

🗄️

Съхранение на файлове и медии

Файловете и медиите се съхраняват в обектно хранилище — не във векторното хранилище. RAG записът сочи обратно към оригиналния файл.

🏠

Вграждане и преподреждане на наши собствени сървъри

Вграждането и преподреждането вече се изпълняват на наши собствени сървъри в отделна услуга. Текстът се превръща във вектори, без да напуска сървъра, а кандидатските резултати преминават през локален преподреждащ модул за подобряване на точността.

✏️

Пренаписване на заявки

Неясен или непълен въпрос се прецизира преди да започне търсенето. Потребителите не е необходимо да формулират "правилния" въпрос; системата прави заявката готова за търсене.

🎞️

Текст от изображения, аудио и видео

Извличане на текст от изображения и транскрибиране на аудио и видео се изпълняват с локални инструменти на сървъра, а полученият текст влиза в същата схема за почистване и индексиране. Данните не напускат сървъра.

Какво е на пътната картаПланирано

Следните все още не съществуват. Това са планирани и проектирани елементи; тази страница не ги представя като вече изградени.

🚪

Единната врата: MCP / API шлюз

Единен шлюз, към който външните AI системи могат да задават въпроси на естествен език. AI, който се свърже веднъж, достига до всеки участващ бизнес през една и съща врата.

🛡️

Слой за разрешение и съгласие

Бизнесите се присъединяват по собствен избор; удостоверяване, управление на ключове, ограничаване на скоростта и защита от злоупотреби са всички в този слой.

📡

Слой за видимост на AI

Направя съдържанието машинно откриваемо чрез llms.txt, /.well-known/ и маркиране на schema.org, плюс регистрация в регистрите на MCP. Няма магическо автоматично откриване; видимостта е изградена по този начин.

🔌

Плъгин за WordPress

Плъгин, който позволява на WordPress сайт да изпрати съдържанието си към OpenRAG и да получи крайна точка, към която AI системите могат да задават въпроси.

Ние не даваме срокове за тези елементи. Когато елементът е завършен, той се премества в списъка „частите, които работят днес“, и тази страница се актуализира съответно.

🔒 Данните не напускат сървъра

Целта на OpenRAG е да изпълни всяка стъпка от RAG процеса на нашия собствен сървър с локални, безплатни инструменти: вграждане, преподреждане, извличане на текст от изображения и транскрипция на аудио. Никакви медии, влизащи в RAG, не се изпращат към външна услуга — това е не подлежащо на договаряне дизайнерско правило.

Честният статус: някои от тези стъпки все още се извършват от външни услуги днес. Преместването им вътрешно е първият елемент в пътната карта.

Как се планира растежът

Търсенето на вектори става по-скъпо с нарастването на съдържанието. Дизайнът на OpenRAG ограничава тази цена от самото начало по три начина.

Няма един огромен индекс

Всеки бизнес има свой собствен малък индекс и заявката работи само срещу този индекс. Дори когато общото съдържание расте, областта, която една заявка сканира, остава малка; цената на търсенето се увеличава с размера на този бизнес, а не с общия размер на платформата.

Размерът и точността на вектора са регулируеми

Използването на по-къси векторни размери и по-компактни числови формати, същото съдържание заема значително по-малко място. Тези избори са вградени в дизайна от самото начало, така че не е необходима скъпа миграция по-късно.

Студен слой

Индексът на бизнес, който не е бил запитван от дълго време, се премества в евтино постоянно хранилище и се извлича, когато пристигне заявка за него. По този начин само активното съдържание остава в бързата памет. Този слой е на пътната карта.

Често задавани въпроси

Какво точно е OpenRAG?

Това е RAG платформа, която почиства и структурира съдържанието на бизнеса, индексира го на нашия собствен сървър и го прави достъпен за заявки на естествен език от външни AI системи чрез една разрешена врата. Това не е чат инструмент; това е слоят на знания, който работи под такива инструменти.

Предоставяте ли моите вектори или моето съдържание на някого другиго?

Не. Основният принцип е: векторите не се публикуват, достъпът е отворен. Това, което излиза навън, не е копие на съдържанието, а правото да му се задават въпроси; връщат се само поддържащите пасажи. Освен това, бизнесът решава кое съдържание става достъпно за външни заявки.

Какво може да се използва днес?

Векторната база данни и индексът, хибридният търсене, многопотребителската изолация, почистването на документи и RAG структурирането, уеб краулингът, публичният RAG фийд в персонализираните AI инструменти и съхранението на файлове/медия работят днес. Самостоятелно хостваното вграждане (embedding), прекласирането (reranking), пренаписването на заявки, външната врата, слойът за разрешения, слойът за видимост и плъгинът за WordPress все още не съществуват.

Напуска ли моята информация сървъра?

Целта е всяка стъпка от RAG конвейера да се изпълнява с локални инструменти на сървъра, като никакви медийни файлове, влизащи в RAG, никога не се изпращат до външна услуга. Честният статус: някои от тези стъпки все още се обработват от външни услуги днес и преместването им вътрешно е първата точка в пътната карта.

Кога ще бъдат готови функциите от пътната карта?

Ние не обещаваме дати. Точно в това е целта на тази страница: да покаже отделно какво работи днес и какво е планирано. Когато даден елемент бъде завършен, той се премества в списъка с "части, които работят днес".

Използва ли се или продава моето съдържание за обучение на AI?

Не. В момента не се извършва такава употреба. Идеята за корпус от текстове с разрешения е най-отдалеченият и правно най-тежък елемент в пътната карта; дори и да се случи, никакво съдържание няма да бъде използвано за това без изричното съгласие на бизнеса.

Върнете се към AI портала за останалите AI инструменти.

Често задавани въпроси

Какво е OpenRAG?

OpenRAG е RAG (Retrieval-Augmented Generation) система, работеща на собствен сървър на xloji.com и е AI портал „всичко в едно“. Когато получи въпрос, първо намира съответното съдържание, след което генерира отговор въз основа на това съдържание. Също така служи като централен портал, който позволява на AI инструменти извън xloji.com да имат достъп до информацията, притежавана от xloji.com, от една точка.

Какво означава RAG и как OpenRAG го прилага?

RAG означава „Retrieval-Augmented Generation“ или генериране, обогатено с извличане; това означава, че AI търси информация от съответни източници, преди да генерира отговор, след което създава отговор въз основа на тази информация. OpenRAG работи, като комбинира тези две стъпки, стъпките за търсене и генериране, на свой собствен сървър. По този начин отговорите, дадени от OpenRAG, не са случайни, а се основават на реално съдържание, притежавано от xloji.com.

Какво означава „AI портал „всичко в едно““?

AI портал „всичко в едно“ означава, че различните AI заявки и интеграции се прекарват през една централна входна точка, вместо през отделни системи. OpenRAG поема тази роля: както функцията „Задайте въпрос“ на xloji.com, така и AI инструментите, свързани отвън, получават услуги чрез една и съща инфраструктура на OpenRAG. Тази централизирана структура позволява управление на трафика, свързан с AI, от една точка.

Каква е разликата от факта, че OpenRAG работи на собствен сървър?

OpenRAG работи на собствен сървър на xloji.com, без да зависи от услуги за облак на трети страни. Това означава, че търсените и обработваните данни остават под контрола на xloji.com. Като структура, работеща на собствен сървър, OpenRAG извършва търсене и генериране на отговори в рамките на собствената си инфраструктура, без да прехвърля данни към външни системи.

Кои използват OpenRAG?

OpenRAG се използва от три различни групи: крайни потребители, които посещават xloji.com и пишат въпрос в полето „Задайте въпрос“, системи, които задават въпроси към собствената RAG инфраструктура на xloji.com, и външни инструменти с изкуствен интелект, които имат достъп до информация, свързана с xloji.com чрез OpenRAG. За крайния потребител OpenRAG връща отговор, базиран на съдържанието на xloji.com. За външните инструменти OpenRAG е безконтекстуална врата за извличане на информация от xloji.com.

Как работи полето „Задайте въпрос“ на xloji.com с OpenRAG?

Въпрос, написан в полето „Задайте въпрос“ на xloji.com, се обработва от OpenRAG. OpenRAG първо търси съдържание, свързано с въпроса, в собствените данни на xloji.com, след което генерира отговор въз основа на намереното съдържание. По този начин отговорът, предоставен на потребителя, е подкрепен от реално съдържание, принадлежащо на xloji.com.

Как външните инструменти с изкуствен интелект получават информация чрез OpenRAG?

OpenRAG служи като единна точка за достъп за изкуствени интелекти извън xloji.com, за да имат достъп до информация, свързана с xloji.com. Тези инструменти могат да се свързват чрез OpenRAG и да получават самостоятелно разбираеми отговори от съдържанието на xloji.com. Поради тази причина информацията, предоставена чрез OpenRAG, е проектирана да бъде смислена сама по себе си, без да е необходим отделен контекст.

Какви са ограниченията на OpenRAG?

Отговорите, предоставени от OpenRAG, са ограничени от предоставеното му съдържание; OpenRAG не може да генерира категоричен отговор за информация, която не съществува в системата или не е добавена. OpenRAG е проектиран да остане в рамките на наличното съдържание, вместо да измисля несъществуваща информация. Поради тази причина трябва да се помни, че отговорът, получен от OpenRAG, е ограничен от съдържанието, с което xloji.com разполага в момента.

OpenRAG чатбот ли е?

OpenRAG не е класически самостоятелен чатбот; това е RAG и инфраструктура за шлюз, която стои зад функцията „Задайте въпрос“ на xloji.com и достъпа до информация чрез външни инструменти. Основната работа на OpenRAG е да намери съдържание, съответстващо на въпрос, и да генерира отговор въз основа на това съдържание. В този вид OpenRAG работи повече като инфраструктурен слой зад отговорите, отколкото като интерфейс, който директно разговаря с потребителя.

Каква е целта на OpenRAG за xloji.com?

Целта на OpenRAG е да позволи на крайните потребители и външните AI инструменти да имат достъп до информация, притежавана от xloji.com, чрез надеждна и контролирана от тях инфраструктура. Работата му на собствен сървър гарантира, че този достъп се случва без зависимост от системи на трети страни. Благодарение на структурата си като единна точка за достъп, OpenRAG обединява различни точки на достъп в една централизирана система.

Подробна информация за OpenRAG

OpenRAG е RAG (Retrieval-Augmented Generation) система, работеща на собствения сървър на xloji.com, и също така е AI шлюз, който пренасочва заявки, свързани с изкуствен интелект, от една точка. Изразът „Open“ в името му показва, че системата предлага отворена и достъпна структура, а изразът „RAG“ показва начина му на работа, който се състои в намиране на съответните данни преди генериране на отговор и след това генериране на отговор въз основа на тези данни. Въпрос, написан в полето „Задайте въпрос“ на xloji.com, първо се търси в съответното съдържание от OpenRAG, след което се генерира отговор въз основа на намереното съдържание. Същата инфраструктура позволява на AI инструменти извън xloji.com да имат достъп до информация, принадлежаща на xloji.com чрез OpenRAG и да използват тази информация в собствените си отговори. Тази структура позволява на xloji.com да обслужва чрез една централизирана инфраструктура, вместо да създава отделни AI решения за различните си продукти.

Основната логика на подхода RAG е, че AI системата не трябва да разчита само на общите знания, за които е била обучена предварително, а трябва първо да извлече актуално и точно съдържание от източник, свързано с въпроса, и след това да отговори въз основа на това съдържание. OpenRAG работи, като комбинира тези две стъпки, а именно намиране (retrieval) и генериране (generation), на собствения си сървър. Този подход има за цел да намали тенденцията на AI моделите понякога да генерират несъществуваща информация; защото отговорът е получен от действително намерено съдържание, а не от собствената памет на модела. По този начин отговорите, дадени от OpenRAG, се основават на собственото съдържание на xloji.com, а не на произволна или остаряла информация. Източникът на отговор, генериран от OpenRAG, може да бъде проследен като собствени данни на xloji.com. Фактът, че сървърът принадлежи на xloji.com, означава, че данните, които се търсят и обработват, се държат под контрола на xloji.com, без да се разчита на облачна услуга на трета страна.

Страната на OpenRAG „AI шлюз с една врата“ означава, че различните AI заявки и интеграции се пренасочват от една централизирана входна точка, вместо от отделни системи. По този начин, както функцията „Задайте въпрос“ на xloji.com, така и външните инструменти, свързани чрез OpenRAG, използват една и съща инфраструктура и една и съща основна логика. Като централизирана шлюзова структура, OpenRAG позволява на трафика, свързан с изкуствен интелект, да преминава през една точка; това увеличава както последователността на отговорите, така и контрола върху данните като система, работеща на собствения сървър. Този подход с една точка също така позволява поддръжката и актуализациите да се извършват на едно място, вместо в разпръснати системи. В този смисъл OpenRAG не е само инструмент за въпроси и отговори, но и инфраструктурен слой, който обединява всички точки за достъп, свързани с изкуствен интелект на xloji.com.

OpenRAG се използва пряко или косвено от три различни групи потребители: крайни потребители, които посещават xloji.com и пишат в полето „Задайте въпрос“, системи, които запращат RAG инфраструктурата на xloji.com, и външни AI инструменти, които имат достъп до информация, принадлежаща на xloji.com чрез OpenRAG. Всички тези три групи потребители получават отговори, подхранвани от една и съща инфраструктура на OpenRAG и един и същ набор от съдържание; следователно, независимо откъде се задава въпрос за xloji.com, се достига до последователен източник на информация. Отговорите, дадени от OpenRAG, са ограничени до предоставеното му съдържание; тоест, не трябва да се очаква категоричен отговор от OpenRAG за информация, която не съществува в системата или не е добавена към нейния сървър. Това ограничение също така е в основата на надеждността на OpenRAG: вместо да измисля несъществуваща информация, тя има за цел да генерира отговори, ограничени до съдържанието в ръцете си и базирани на това съдържание.

OpenRAG — Отворете съдържанието си към изкуствен интелект чрез една разрешена врата | xloji.com