media-blend
text-black

Farebné vlákna pripnuté na doske usporiadanej v geometrických vzoroch

Čo je to vektorová databáza?

Vektorové databázy uchovávajú a vyhľadávajú vysoko dimenzionálne vkladania dát pre umelú inteligenciu relevantnú pre podnikanie.

default

#

default

#

primary

default

#

secondary

Vektorová databáza je typ databázy vytvorenej na ukladanie a vyhľadávanie špeciálnych druhov údajov nazývaných vektorové vloženia. Tieto vloženia sú čísla, ktoré predstavujú význam alebo charakteristiky vecí, ako je text, obrázky, video alebo zvuk.

Zatiaľ čo tradičné databázy fungujú najlepšie s úhľadne usporiadanými údajmi v riadkoch a stĺpcoch, vektorové databázy sú navrhnuté na prácu s neštruktúrovanými, viacrozmernými údajmi. Ich hlavnou úlohou je rýchlo nájsť veci, ktoré sú navzájom podobné – známe ako hľadanie podobnosti – aj keď nie sú presné zhody, porovnaním toho, ako blízko sú ich začlenenia v matematickom priestore.

Vďaka tomu sú vektorové databázy obzvlášť užitočné pre moderné aplikácie umelej inteligencie (AI). Využívajú sémantické vyhľadávanie, ktoré vracia výsledky na základe významu a nie presných slov, a podporujú generatívne nástroje umelej inteligencie tým, že pomáhajú získavať najrelevantnejšie informácie pri vytváraní odpovedí, obrázkov alebo iného obsahu.

Vektorové databázy sa používajú aj v odporúčacích nástrojoch, pri vyhľadávaní obrázkov a videí a v jazykovom porozumení. Stručne povedané, umožňujú systémom umelej inteligencie vyhľadávať a porovnávať informácie spôsobom, ktorý je oveľa bližšie k tomu, ako ľudia myslia a rozumejú.

Aké sú kľúčové pojmy vektorovej databázy?

Pochopenie fungovania vektorových databáz začína pohľadom na ich tri základné koncepty: vektorové vloženia, vyhľadávanie podobnosti a techniky indexovania. Každý prvok zohráva kľúčovú úlohu pri umožnení rýchleho a inteligentného získavania údajov na základe významu a nie jednoduchého priraďovania.

1. Vektorové zabudovania

V centre každej vektorovej databázy sú vektorové vloženia, číselné reprezentácie údajov vytvorené modelmi strojového učenia. Tieto modely odoberajú neštruktúrované vstupy ako text, obrázky alebo zvuk a prepočítavajú ich do dlhých zoznamov čísel (vektorov), ktoré zachytávajú podstatu alebo význam pôvodného obsahu. Napríklad slová „cat“ a „mačiatko“ sú dve rôzne slová, ktoré môžu byť mapované k vektorom, ktoré sú v priestore blízke, čo odráža ich sémantickú podobnosť.

Tieto vloženia umožňujú porovnávať obsah ľudsky podobným spôsobom – skôr na základe podobnosti než štruktúry na povrchovej úrovni.

2. Vyhľadávanie podobnosti

Keď sa údaje prevedú do vektorových integrácií, ďalším krokom je vyhľadávanie podobnosti – proces hľadania, ktoré vektory sú najviac podobné. To sa vykonáva pomocou metrík vzdialenosti, ktoré sú matematickými vzorcami, ktoré merajú ako "ďaleko od" dva vektory sú vo viacdimenzionálnom priestore.

Bežné metódy zahŕňajú kosínusovú podobnosť, ktorá meria uhol medzi vektormi, a euklidovskú vzdialenosť, ktorá vypočítava priamočinnú vzdialenosť medzi nimi. Tieto metriky pomáhajú databáze rýchlo identifikovať, ktoré uložené položky sú najviac podobné novému dotazu, aj keď v údajoch neexistuje presná zhoda.

3. Techniky indexovania

Aby bolo vyhľadávanie podobnosti rýchle a škálovateľné, vektorové databázy používajú špecializované metódy indexovania. Tieto algoritmy organizujú vektorové údaje spôsobom, ktorý urýchľuje vyhľadávanie pri vyvážení presnosti a výkonu. Medzi populárne metódy patria:

Tieto tri piliere spolu vytvárajú vektorové databázy schopné zvládnuť obrovské objemy komplexných, neštruktúrovaných dát a nájsť to, čo je najdôležitejšie v milisekundách.

Ako funguje vektorová databáza?

Vektorové databázy fungujú prostredníctvom trojkrokového procesu, ktorý im umožňuje získavať informácie na základe významu, nielen zhodných slov. Vďaka tomu sú obzvlášť výkonné pre úlohy riadené umelou inteligenciou, ako sú sémantické systémy vyhľadávania a odporúčaní.

1. Kódovanie údajov do vektorov

Najskôr sa nespracované údaje spracúvajú modelmi strojového učenia. Tieto modely konvertujú údaje do vektorových integrácií, ktoré zachytávajú kľúčové vlastnosti alebo význam pôvodného obsahu. Napríklad veta ako „milujem turistiku v horách“ by sa mohla premeniť na vektor, ktorý odráža jej emocionálny tón a predmet.

2. Ukladanie a indexovanie vektorov

Po vložení dát sú vektory uložené vo vektorovej databáze a organizované pomocou vyššie uvedených techník ako HNSW, LSH a PQ. Tieto metódy pomáhajú databáze rýchlo nájsť podobné vektory bez porovnania každej položky po jednej.

3. Vyhľadávanie otázok s podobnosťou

Keď používateľ odošle dotaz, napríklad vetu, obrázok alebo výzvu, skonvertuje sa aj na vektor. Databáza potom vykoná podobné vyhľadávanie, pričom porovnáva vektor dotazov s uloženými vektormi, aby našla výsledky, ktoré sú sémanticky podobné, aj keď nezdieľajú presné kľúčové slová.

Či už hľadáte súvisiace články, podobné obrázky alebo príslušné odporúčania, vektorové databázy umožňujú inteligentnejšie a intuitívnejšie vyhľadávanie zameraním sa skôr na význam než na zodpovedajúce kľúčové slová.

Tradičné verzus vektorové databázy

Tradičné databázy sú dlhodobo chrbtovou kosťou ukladania a získavania dát. Tieto typy databáz spracovávajú dobre definované štruktúrované informácie v riadkoch, stĺpcoch a tabuľkách pomocou metód dotazu presnej zhody kľúčových slov. Vďaka tomu sú ideálne na správu vecí, ako sú záznamy zákazníkov alebo inventáre.

Naproti tomu vektorové databázy vynikajú vyhľadávaním vzorov a vzťahov v komplexných, neštruktúrovaných údajoch na zachytenie významu hlbšie ako informácie na povrchovej úrovni. Sú optimalizované pre aplikácie riadené umelou inteligenciou, ako je sémantické vyhľadávanie, rozpoznávanie obrazu alebo videa, generatívna umelá inteligencia – každý prípad použitia, v ktorom je pochopenie kontextu nevyhnutné.

Aké sú výhody vektorovej databázy?

Vektorové databázy ponúkajú mnoho výhod pre organizácie pracujúce s AI a veľké objemy neštruktúrovaných dát. Tu sú niektoré z najdôležitejších výhod:

Tieto funkcie robia z vektorových databáz základný komponent pri nasadzovaní inteligentných, škálovateľných a responzívnych systémov umelej inteligencie.

Prekonávanie problémov so spoločnými vektorovými databázami

Zatiaľ čo vektorové databázy poskytujú výkonné schopnosti, môžu prísť aj s jedinečnými výzvami. Tu sú niektoré z najčastejších problémov – a ako ich riešiť:

Výpočtové a skladovacie náklady na vysokorýchlostné vektorové úložisko

Ukladanie a spracovanie veľkých objemov vysoko dimenzionálnych vektorov môže vyžadovať významný výpočtový výkon a pamäť, ktoré zvyšujú náklady na infraštruktúru - najmä pre aplikácie v reálnom čase. To je možné vyriešiť pomocou spravovaných služieb, ktoré ponúkajú optimalizovanú infraštruktúru, ako aj komprimačných techník na zníženie využitia pamäte.

Ladenie parametrov indexovania pre optimálne stiahnutie a výkon

Metódy indexovania ako HNSW a LSH vyžadujú starostlivé ladenie parametrov na vyváženie rýchlosti a presnosti vyhľadávania. Zle naladené indexy môžu viesť k pomalým dotazom alebo chýbajúcim relevantným výsledkom. Preto je kľúčové začať s predvolenými parametrami ladenia, potom iteratívne otestovať a upraviť na základe vašej množiny údajov a prípadu použitia.

Interoperabilita a vyvíjajúce sa normy

ekosystém vektorovej databázy stále dozrieva a neexistuje jediný univerzálne prijatý štandard pre vektorové formáty alebo API. To môže viesť k výzvam integrácie s kanálmi umelej inteligencie alebo výstupmi modelov z rôznych rámcov. Na boj proti tomu by organizácie mali uprednostniť výber databázových platforiem so silnou podporou ekosystému a otvoriť rozhrania API, ktoré sa natívne integrujú s rámcami strojového učenia.

Riadenie komplexných potrieb filtrovania

Real-world aplikácie často potrebujú kombinovať vektorovú podobnosť so štruktúrovanými filtrami, ako je ID používateľa, umiestnenie alebo kategória obsahu. Nie všetky vektorové databázy to natívne podporujú. Jedným z riešení je použitie databáz, ktoré podporujú filtrovanie metadát a hybridné stratégie filtrovania, čo vám umožňuje vrstvu logiky založenej na pravidlách na vrchole vektorového vyhľadávania. To zaisťuje relevantnejšie a kontextovejšie výsledky.

Prípady použitia vektorovej databázy a aplikácie AI

Vektorové databázy podnecujú rastúci počet prípadov použitia riadených umelou inteligenciou vo všetkých odvetviach. Umožnením strojom pochopiť a porovnať údaje na základe významu a kontextu tieto systémy transformujú spôsob vyhľadávania, odporúčania, generovania a interpretácie obsahu. Niektoré z účinnejších prípadov použitia zahŕňajú:

Vyhľadať

Odporúčanie

Generatívna umelá inteligencia

Počítačové videnie

LLM

Tieto prípady použitia zdôrazňujú flexibilitu a dôležitosť vektorových databáz vo vyhľadávaní, personalizácii, generovaní a vnímaní, čo z nich robí základ pre aplikácie umelej inteligencie novej generácie.

Budúcnosť vektorových databáz

Vektorové databázy sa rýchlo vyvíjajú, aby spĺňali rastúce požiadavky systémov riadených umelou inteligenciou. Keď sa ich schopnosti rozširujú, tu sú štyri kľúčové trendy formujúce ich budúcnosť:

  1. Prijímanie v podnikovej umelej inteligencii a multimodálne vyhľadávanie
    Podniky čoraz viac využívajú vektorové databázy na posilnenie inteligentného vyhľadávania v rôznych dátových typoch. To umožňuje prirodzenejšie interakcie uvedomujúce si kontext v zákazníckej podpore, elektronickom obchode a interných znalostných systémoch.
  2. Použitie v RAG systémoch pre uzemnený obsah generovaný umelou inteligenciou
    Vektorové databázy sú centrálnou súčasťou RAG, čo je technika, ktorá zlepšuje presnosť a relevantnosť odpovedí generovaných umelou inteligenciou ich začlenením do reálnych dát. Je to obzvlášť cenné v právnom, zdravotníckom a finančnom odvetví, kde je rozhodujúca presnosť faktov.
  3. Pohyb smerom k hybridným systémom kombinujúcim štruktúrované a sémantické vyhľadávanie
    Budúcnosť spočíva v hybridných vyhľadávačoch, ktoré kombinujú tradičné dotazy založené na kľúčových slovách so sémantickým vektorovým vyhľadávaním. To umožňuje používateľom filtrovať podľa štruktúrovaných metadát a zároveň získavať výsledky na základe významu a kontextu.
  4. Štandardizácia vektorových jazykov dotazov a rozhraní API
    S rastúcim osvojovaním sa odvetvie posúva smerom k štandardizovaným vektorovým jazykom dotazov a interoperabilným rozhraniam API, čo uľahčuje integráciu vektorových databáz do existujúcich dátových zásobníkov a workflow AI. Pomôže to znížiť odkázanosť na dodávateľa a urýchliť inováciu.
Logo spoločnosti SAP

Produkt spoločnosti SAP

SAP HANA Cloud

Prekročte hranice transakčných aplikácií a umožnite vývojárom vytvárať kontextové aplikácie riadené umelou inteligenciou.

Ďalšie informácie