[Intum Pomoc](https://intum.pl/pomoc.md) / [Bazy wektorowe i rozmowy](https://intum.pl/pomoc/noe/bazy-wektorowe-i-rozmowy.md)

# [Baza wektorowa](https://intum.pl/pomoc/noe/noe-baza-wektorowa.md)

Baza wektorowa (RAG) przechowuje treści w postaci, która pozwala szukać po znaczeniu: pytanie
„jak zwrócić towar" znajdzie artykuł o reklamacjach, choć nie ma w nim słowa „zwrócić".
Na tym buduje się odpowiadanie na pytania: Intum wyszukuje w bazie fragmenty pasujące
do pytania, dokleja je jako kontekst i prosi model AI o odpowiedź wyłącznie na ich podstawie.

> [!PATH]
> [Noe → Bazy wektorowe](app:/noe/vector_dbs) → **Nowy**
> [Noe → Bazy wektorowe](app:/noe/vector_dbs) → *przycisk AI*

## Zanim zaczniesz {#zanim-zaczniesz}

Baza potrzebuje konektora AI - modelu, który zamienia tekst na wektory (embeddingi) i modelu,
który pisze odpowiedzi. Może to być ten sam konektor. Dodajesz go w [Ustawieniach Noe](noe/noe-ustawienia);
jeśli jest ustawiony jako domyślny, w formatce bazy zostawiasz wybór **domyślny**.

## Formatka {#formatka}

- **Nazwa**, **Kod**, **Opis** - kod służy do wskazania bazy z widgetu i API.
- **Konektor AI (embeddingi)** - model do zamiany treści na wektory. Zmiana modelu po
  zaindeksowaniu wymaga przeindeksowania źródeł, bo wektory z różnych modeli nie pasują
  do siebie.
- **Konektor AI (chat)** - model piszący odpowiedzi. Puste = ten sam, co do embeddingów.
- **Prompt systemowy** - kim ma być asystent i jak odpowiadać, np. „Jesteś asystentem sklepu X.
  Odpowiadaj krótko, po polsku, tylko na podstawie kontekstu."
- **Fraza „nie wiem"** - tekst, po którym Intum rozpoznaje, że model nie znalazł odpowiedzi
  w kontekście. Taka odpowiedź liczy się jako brak odpowiedzi - widget może wtedy np. przekazać
  pytanie do człowieka.
- **Próg distance** - jak bardzo fragment musi pasować do pytania, żeby trafić do kontekstu.
  Niższy próg = tylko bardzo podobne fragmenty, mniej szumu, ale częściej brak odpowiedzi.
- **Limit kontekstu** - ile fragmentów najwyżej dokleić do pytania.
- **Timeout AI** - ile sekund czekać na model.
- **Dziel długie teksty na fragmenty** - długi artykuł jest indeksowany kawałkami około 500
  tokenów; wyszukiwanie trafia wtedy precyzyjnie w akapit, a nie w cały dokument. **Max tokenów
  na chunk** pozwala zmienić rozmiar kawałka; puste = automatycznie.

Większość ustawień można zostawić domyślną i wrócić do nich, gdy odpowiedzi są za ogólne
(za wysoki próg, za duży limit) albo za często brak odpowiedzi (za niski próg, brak źródeł).

## Co dalej

Pusta baza nic nie wie. Podłącz [źródła](noe/noe-zrodla) i poczekaj na indeksowanie, potem
sprawdź działanie w [Pytaniach i testowaniu](noe/noe-pytania-i-testowanie).

## Przez agenta

Przycisk AI na liście baz wektorowych daje prompt, którym agent AI zakłada bazę, dobiera
ustawienia i podpina źródła według Twojego opisu: „baza z artykułów bazy wiedzy Sklep
i zgłoszeń z desku Reklamacje, odpowiedzi po polsku, gdy nie wie - odesłać do formularza".

## Gdy coś nie działa {#gdy-cos-nie-dziala}

- **Baza ciągle odpowiada „nie wiem"** -
  [Baza wektorowa nie zna odpowiedzi](noe/noe-problem-baza-nie-zna-odpowiedzi).