Zum Inhalt springen
ai101.tools
navigierenöffnenescschließen
Claude+372Whisper+228LangChain+168Codex+223NotebookLM+276DALL-E 3+192DeepL+249n8n+208Topaz Video AI+153LlamaIndex+161
RAG Implementation logo
Skill

RAG Implementation

Baut Retrieval-Pipelines für Antworten aus echten Dokumenten

0
SpeichernWebsite besuchen ↗

Installation

/plugin marketplace add wshobson/agents; /plugin install llm-application-dev
Wird ausgelöst bei

When an LLM needs to answer from a document set, or an existing RAG pipeline returns weak matches.

Autor
wshobson
Lizenz
MIT

Für jede Stufe einer Retrieval-Augmented-Pipeline wird bewusst entschieden: wie Dokumente aufgeteilt werden, welches Embedding-Modell zu Sprache und Budget passt und welcher Vektorspeicher eingesetzt wird – Pinecone, Weaviate, Qdrant, Chroma oder pgvector im praxisnahen Vergleich. Retrieval umfasst mehr als die Suche nach nächsten Nachbarn: Dichte Suche und Stichwortsuche werden kombiniert und die Ergebnisse vor der Übergabe an das Modell neu gerankt. Ein LangGraph-Beispiel trennt Retrieval und Generierung in eigene Knoten, damit beide unabhängig gemessen werden können.

Kommentare(0)

Zum Kommentieren anmelden

Noch keine Kommentare — schreibe den ersten.

Ähnliche Skills

Diesen Kommentar melden

Warum meldest du das?