Všechny články

Co je RAG a proč vaše AI potřebuje přístup k firemním datům

Petr Skoda2 min čteníRead in English
  • RAG
  • umělá inteligence

Když firma nasadí jazykový model a zeptá se ho na něco z vlastní interní dokumentace, model si často něco vymyslí. Není to chyba modelu, jen důsledek toho, jak funguje. Model zná jen to, co viděl při trénování, a firemní směrnice, technickou dokumentaci nebo poslední verzi ceníku v tom typicky nemá. Řešením tohoto problému je přístup zvaný RAG, tedy retrieval augmented generation.

Co RAG vlastně dělá

RAG spojuje dvě věci, které samy o sobě fungují dobře, ale teprve dohromady dávají použitelný nástroj. První částí je vyhledávání, tedy schopnost najít v interních dokumentech firmy ty pasáže, které souvisí s konkrétním dotazem. Druhou částí je samotný jazykový model, který z nalezených pasáží sestaví srozumitelnou odpověď.

Místo toho, aby model odpovídal jen z toho, co se naučil při trénování, dostane před vygenerováním odpovědi k dispozici konkrétní úryvky z firemních dokumentů, a odpověď staví na nich. Výsledkem je odpověď, která se dá dohledat ve zdrojovém dokumentu, ne odpověď, kterou si model odvodil ze statistických vzorů bez jakékoliv opory.

Jak to funguje v praxi

Firemní dokumenty, směrnice nebo technická dokumentace se nejprve rozdělí na menší části a převedou na takzvané embeddingy, tedy číselnou reprezentaci významu textu. Tyto embeddingy se uloží do vektorové databáze, což je databáze optimalizovaná na hledání podle významu, ne podle přesné shody slov.

Když pak zaměstnanec položí dotaz, systém nejprve najde ve vektorové databázi ty části dokumentace, které jsou dotazu významově nejblíž, a teprve potom je spolu s dotazem pošle jazykovému modelu. Model dostane přesný kontext, ze kterého má vycházet, a jeho úkolem už není si fakta vymýšlet, ale správně je poskládat do odpovědi.

Proč to firmy potřebují místo obyčejného chatbota

Obecný jazykový model bez přístupu k firemním datům umí odpovídat na obecné otázky, ale nezná aktuální ceník, interní postupy ani historii konkrétního zákazníka. RAG tento nedostatek řeší tak, že model propojí přímo s aktuálním obsahem firemní znalostní báze, aniž by bylo nutné model přetrénovávat pokaždé, když se něco v dokumentaci změní.

Další výhodou je kontrola nad daty. Vektorová databáze zůstává v infrastruktuře firmy nebo jejího dodavatele, takže citlivá interní dokumentace nemusí být součástí trénovacích dat žádného modelu a firma si zachovává přehled o tom, co přesně systém při odpovídání používá.

Kde v tom pomáhá Eniware

Budování RAG systémů nad interní dokumentací je jednou z hlavních věcí, které Eniware pro firmy staví. Cílem je AI, která odpovídá na základě reálného obsahu firmy, ne na základě obecných znalostí z internetu, a která se dá nasadit nad existující dokumentaci, wiki nebo firemní znalostní bázi bez nutnosti cokoliv přepisovat od nuly.

Pokud vaše firma zvažuje nasazení AI nad vlastní dokumentací, dává smysl začít menší pilotní oblastí, třeba jedním konkrétním typem dotazů, a na ní si celý přístup ověřit.

Pokud vás zajímá, jak takový systém vypadá v praxi, ukazujeme to na konkrétním příkladu v case study o aplikaci MAistr. Pokud byste chtěli jít ještě dál a provozovat i samotný jazykový model ve vlastní infrastruktuře, tomu se věnujeme v článku o vlastním AI modelu na vašem zařízení.

Nové články e-mailem

Aktuality ze světa IT přímo pro firmy. Jasně, stručně a srozumitelně.

Adresu používám jen pro rozesílku článků. Nikomu ji nepředávám. Odhlásit se dá jedním kliknutím.

Další články

Rozhraní aplikace Maistr pro správu znalostícase study
2 min čtení

Jak jsme postavili MAistr: AI asistenta, který uchovává znalosti zaměstnanců

V rodinné firmě, ze které vzešel nápad na MAistr, i v řadě dalších firem se opakuje stejný problém. Klíčové znalosti mají v hlavě zkušení zaměstnanci a mistři, a když zrovna nejsou po ruce nebo firmu opustí, jejich know-how odchází s nimi. Mladší zaměstnanci se pak musí ptát kolegů, čekat, až budou mít čas, nebo si postup domýšlet sami. MAistr vznikl přesně z této zkušenosti. Co MAistr dělá MAistr je aplikace, která ukládá znalosti zaměstnanců ve formě videa, zvuku a textu a mění je v asisten

Interiér datového centra s regály serverů a provozním vybavením.umělá inteligence
2 min čtení

Vlastní AI model na vašem zařízení

Když firma dnes řekne, že používá umělou inteligenci, obvykle to znamená, že posílá data do cizí cloudové služby a čeká na odpověď. Méně známá, ale čím dál dostupnější varianta je opačná: provozovat AI model přímo na vlastním serveru nebo zařízení, bez závislosti na cizí infrastruktuře. Co znamená hostovat AI model sám Řada dnešních AI modelů se dá stáhnout ve formě takzvaných otevřených vah a spustit na vlastním hardwaru, ať už je to firemní server, lokální počítač, nebo výkonnější zařízení

Blízký záběr na futuristického humanoidního robota s digitálním displejem obličeje, který představuje moderní technologieumělá inteligence
3 min čtení

Jak vlastně funguje umělá inteligence

O umělé inteligenci se dnes mluví, jako by uměla myslet. Ve skutečnosti jde o statistický model, který se na obrovském množství dat naučil, jaká odpověď nejpravděpodobněji následuje po daném vstupu. Žádné porozumění v lidském smyslu za tím není, ale výsledek bývá překvapivě užitečný. AI jako předpovídání, ne přemýšlení Jádro dnešní umělé inteligence je predikce. Model se během trénování podívá na obrovské množství textu, obrázků nebo jiných dat a učí se, jaké vzory se v nich opakují. Když pak