# lightrag-simple-fast-rag-hkuds-2024-10-08

## Veille

LightRAG - Simple and Fast RAG - Knowledge Graphs - Dual-Level Retrieval - EMNLP2025 - GitHub

## Titre Article

HKUDS/LightRAG: [EMNLP2025] "LightRAG: Simple and Fast Retrieval-Augmented Generation"

## Date

2024-10-08

## URL

https://github.com/HKUDS/LightRAG

## Keywords

knowledge-graph, gpt, rag, gpt-4, large-language-models, llm, genai, retrieval-augmented-generation, graphrag, dual-level retrieval, vector storage, Neo4j, PostgreSQL, Faiss, document processing, multimodal RAG, EMNLP2025

## Authors

Zirui Guo, Lianghao Xia, Yanhua Yu, Tu Ao, Chao Huang (HKUDS - Hong Kong University Data Science)

## Ton

**Profil**: Akademisch-technisch, institutionelle Forschungsstimme, deskriptiv-technisches Register, Expertenniveau.

**Beschreibung**: Die HKUDS-Forscher verwenden den Ton eines akademischen GitHub-Repositoriums, das technische Dokumentation mit einer Positionierung als Forschungsarbeit verbindet (angenommen bei EMNLP 2025). Die spezialisierte ML/KI-Sprache (Dual-Level Retrieval, Wissensgraphen, Vektorspeicher) richtet sich an Forschende und Praktiker. Die typische Struktur eines Open-Source-Projekts (README, Beispiele, Benchmarks) erleichtert die Übernahme. Der technische, objektive Ton verzichtet auf Marketing-Übertreibung zugunsten des Nachweises von Fähigkeiten. Typisch für akademische Code-Veröffentlichungen (Stil HuggingFace, Papers with Code), die Forschungsbeiträge mit praktischer Umsetzung verbinden und sich an die ML-Community richten.

## Pense-betes

- **22k** GitHub-**Stars**, **3.3k Forks**, MIT-Lizenz
- Präsentation auf der **EMNLP 2025** (bedeutende NLP-Konferenz)
- **Dual-Level-Retrieval**: Kombination aus Wissensgraphen + Vektordatenbanken
- **Multimodale** Unterstützung über RAG-Anything (Text, Bilder, Tabellen, Gleichungen)
- **25+ Konfigurationsparameter** für feingranulare Anpassung
- LLM-Empfehlungen: **mindestens 32B Parameter**, Kontext **32 KB+** (64 KB ideal)
- **6 Abfragemodi**: local, global, hybrid, naive, mix, bypass
- Unterstützung **mehrerer Speicherlösungen**: PostgreSQL, Neo4j, Redis, MongoDB, Milvus, Qdrant, Faiss
- **RAG-Anything**-Integration für die Dokumentenverarbeitung (PDF, PPT, CSV)
- **Erweiterte Verwaltung**: Löschen anhand der Dokument-ID, anhand des Entitätsnamens
- **Streaming-Antworten** und Gesprächsverlauf
- Unterstützung von **Zitaten** zur Quellenzuordnung
- **Docker Compose** für schnelle Bereitstellung verfügbar
- Aktive Community: Discord, WeChat, umfassende Dokumentation

## RésuméDe400mots

LightRAG ist ein Retrieval-Augmented-Generation-System (RAG), das von HKUDS (Hong Kong University Data Science) entwickelt wurde und auf der EMNLP 2025, einer bedeutenden Konferenz für Computerlinguistik, vorgestellt wird. Mit **22k** GitHub-**Stars** und unter MIT-Lizenz zielt das Projekt darauf ab, Wissensextraktion und intelligente Abfragen durch einen innovativen Ansatz zu vereinfachen und zu beschleunigen, der Wissensgraphen und Vektordatenbanken kombiniert.

**Dual-Level-Retrieval-Architektur**

Die zentrale Innovation von LightRAG liegt in seinem „Dual-Level-Retrieval“-System, das zwei komplementäre Ansätze vereint: Wissensgraphen zur Erfassung struktureller Beziehungen zwischen Entitäten und Vektordatenbanken für die semantische Suche. Diese Hybridisierung bietet **sechs verschiedene Abfragemodi** (local, global, hybrid, naive, mix, bypass), die die Retrieval-Strategie an Kontext und spezifische Anforderungen anpassen.

**Multimodale Unterstützung und mehrere Formate**

Die kürzliche Integration mit RAG-Anything erweitert die Fähigkeiten zur Dokumentenverarbeitung erheblich. Das System verarbeitet nun nahtlos Text, Bilder, Tabellen und Gleichungen aus verschiedenen Formaten (PDF, DOC, PPT, CSV). Dieser multimodale Ansatz macht LightRAG zu einer vollständigen Lösung für die Wissensextraktion aus heterogenen Unternehmensdokumenten.

**Speicherflexibilität und Skalierbarkeit**

LightRAG unterstützt eine modulare vierstufige Speicherarchitektur: KV-Speicher für LLM-Caching und Textabschnitte (JSON, PostgreSQL, Redis, MongoDB), Vektorspeicher für Embeddings (NanoVectorDB, Milvus, Chroma, Faiss, Qdrant, PostgreSQL, MongoDB), Graphspeicher für den Entitäten-Beziehungs-Graphen (NetworkX, Neo4J, PostgreSQL, AGE) sowie Dokumentenstatus-Speicher zur Verarbeitungsverfolgung. Diese Flexibilität ermöglicht die Wahl des optimalen Backends je nach Leistungs- und Infrastrukturanforderungen. Für den performanten Produktionseinsatz wird Neo4J als Graphdatenbank empfohlen.

**LLM-Anforderungen und Empfehlungen**

Die empfohlenen Spezifikationen spiegeln die Komplexität des Systems wider: ein LLM mit **mindestens 32 Milliarden Parametern** und einer Kontextlänge von **32 KB** (64 KB bevorzugt), um die Entitäten-Beziehungs-Extraktion zu optimieren. Verbreitete mehrsprachige Embedding-Modelle wie BAAI/bge-m3 und text-embedding-3-large werden vorgeschlagen. Das System unterstützt OpenAI (GPT-4o, GPT-4o-mini), Ollama für lokale Modelle sowie Hugging Face.

**Erweiterte Konfiguration und Anpassung**

LightRAG stellt **mehr als 25 Initialisierungsparameter** bereit, die eine granulare Steuerung ermöglichen: Chunk-Größe (Standard 1200 Token), Schleifen zur Entitätsextraktion (Standard 1), Batch-Größe für Embeddings (Standard 32), LLM-Cache-Parameter sowie Token-Budgets für Entitäten, Beziehungen und Gesamtkontext. Diese Konfigurierbarkeit ermöglicht eine Feinabstimmung des Verhältnisses zwischen Leistung und Kosten.

**Erweiterte Funktionen und Verwaltung**

Das System bietet ausgereifte Fähigkeiten: Löschen von Dokumenten anhand der ID, Löschen von Entitäten anhand des Namens (unter Beibehaltung der Konsistenz von Graph und Vektorspeicher), Unterstützung von Zitaten zur Quellenzuordnung, Streaming-Antworten, Verfolgung des Gesprächsverlaufs sowie Einfügen benutzerdefinierter Wissensgraphen. Die asynchrone Architektur (asyncio) gewährleistet Leistung und Skalierbarkeit.

**Bereitstellung und Community**

Flexible Installation über PyPI (`pip install "lightrag-hku[api]"`), aus dem Quellcode oder via Docker Compose mit vorkonfigurierten Umgebungsdateien. Die aktive Community pflegt Discord, WeChat, umfassende Dokumentation, Beispiele und Tutorial-Videos. Jüngste Aktualisierungen (PostgreSQL-Unterstützung, Zitate, Löschfunktionen, Neo4J) zeugen von aktiver Entwicklung.

## GrapheDeConnaissance

- HKUDS —a_créé→ LightRAG (TECHNOLOGIE, 0.99)
- LightRAG —observé_dans→ EMNLP2025 (EVENEMENT, 0.98)
- LightRAG —utilise→ dual-level retrieval (CONCEPT, 0.99)
- dual-level retrieval —utilise→ knowledge graphs (TECHNOLOGIE, 0.97)
- dual-level retrieval —utilise→ bases de données vectorielles (TECHNOLOGIE, 0.97)
- LightRAG —utilise→ RAG-Anything (TECHNOLOGIE, 0.95)
- RAG-Anything —permet→ traitement multimodal (CONCEPT, 0.93)
- LightRAG —utilise→ Neo4j (TECHNOLOGIE, 0.96)
- LightRAG —utilise→ PostgreSQL (TECHNOLOGIE, 0.96)
- LightRAG —recommande→ modèles 32B paramètres minimum (CONCEPT, 0.92)
- LightRAG —permet→ 6 modes de requête (CONCEPT, 0.95)
- HKUDS —utilise→ GitHub (TECHNOLOGIE, 0.97)
- LightRAG —mesure→ 22k étoiles GitHub (MESURE, 0.98)

---
Canonical: https://www.thekb.eu/de/fiches/lightrag-simple-fast-rag-hkuds-2024-10-08/
