Vektordatenbanken erklärt: Das Gedächtnis von RAG-Anwendungen

1 Min. LesezeitStand 07.10.2026Mit KI erstellt · redaktionell geprüft

Eine Vektordatenbank speichert Texte als Zahlenreihen, sogenannte Embeddings, und findet zu einer Frage die Abschnitte mit ähnlicher Bedeutung. Sie ist das Herzstück vieler RAG-Anwendungen, die Sprachmodelle mit eigenem Wissen verbinden.

Wie sie funktioniert

  1. Dokumente werden in Abschnitte geteilt.
  2. Ein Embedding-Modell wandelt jeden Abschnitt in einen Vektor um.
  3. Die Datenbank speichert Vektor und Text.
  4. Bei einer Frage wird auch die Frage umgewandelt; die Datenbank liefert die Abschnitte mit den ähnlichsten Vektoren.

So findet die Suche „Kündigungsfrist“ auch einen Abschnitt, in dem „Vertrag beenden“ steht. Wie Embeddings funktionieren, erklärt Embeddings einfach erklärt.

Welche es gibt

  • Erweiterungen bestehender Datenbanken wie pgvector für PostgreSQL: oft die einfachste Wahl, wenn Sie schon eine Datenbank betreiben.
  • Spezialisierte Datenbanken wie Qdrant, Weaviate, Milvus oder Chroma, teils als Open Source, teils als Clouddienst.
  • Suchdienste mit Vektorsuche, etwa Elasticsearch oder OpenSearch.

Tipp: Kombination mit Stichworten

Reine Bedeutungssuche übersieht manchmal exakte Begriffe wie Artikelnummern. Viele Anwendungen kombinieren deshalb Vektorsuche mit klassischer Stichwortsuche (hybride Suche).

Kosten

Für tausende Dokumente reichen kleine Server oder kostenlose Stufen. Die Embeddings selbst kosten meist nur wenige Cent je Million Tokens. Den Gesamtüberblick gibt der RAG-Kostenrechner.

Erstellt mit Unterstützung von KI, geprüft und redaktionell verantwortet von Leon Blatz. Allgemeine Information, keine Rechts-, Steuer- oder Finanzberatung.

RAG-KostenrechnerWas kostet eine KI mit eigenen Dokumenten? Embeddings, Abfragen und Vektordatenbank berechnen.
Öffnen

Auch hilfreich: Systemprompt-Kostenrechner · KI-Preiskalkulation

Weiterlesen

Weitere Artikel

  1. RAG einfach erklärt: KI mit eigenen Dokumenten nutzenRAG einfach erklärt: wie Retrieval-Augmented Generation funktioniert, wofür man Embeddings und Vektordatenbanken braucht und was ein RAG-System kostet.
  2. Structured Outputs: Zuverlässig JSON von KI-ModellenStructured Outputs erklärt: Wie Sie mit JSON-Schema garantiert gültiges JSON von OpenAI, Claude und Gemini bekommen, statt kaputte Antworten nachträglich zu reparieren.
  3. Prompt Injection: Wie Angriffe auf KI-Systeme funktionierenPrompt Injection erklärt: wie versteckte Anweisungen in E-Mails, Dokumenten und Websites KI-Assistenten und Agenten manipulieren und welche Schutzmaßnahmen wirken.