Skills Agentes

Rag Implementation

Construye sistemas RAG (Retrieval-Augmented Generation) para aplicaciones LLM con bases de datos vectoriales y búsqueda semántica, integrando conocimiento externo.

Estrellas
39.8k

en todo el repo

Actividad
51

0–100, la ruta de este skill

Actualizado
hace 2 meses

último commit aquí

Commits
1

últimos 90 días

Contexto
1.1k tok

60 tok en reposo

Paquete
2 archivos

15 KB

Instalar

Funciona con cualquier agente que lea SKILL.md

npx -y skills add wshobson/agents --skill rag-implementation --agent claude-code

Se instala solo en este repositorio.

Qué hace

  • Guía la construcción de sistemas RAG con bases de datos vectoriales y búsqueda semántica
  • Compara opciones de bases vectoriales (Pinecone, Weaviate, Milvus, Chroma, Qdrant, pgvector)
  • Recomienda modelos de embeddings según caso de uso
  • Explica estrategias de recuperación (dense, sparse, hybrid, multi-query, HyDE) y reranking
  • Ofrece un ejemplo funcional de pipeline RAG con LangGraph

Úsalo cuando

  • Construir sistemas de preguntas y respuestas sobre documentos propios
  • Crear chatbots con información actual y factual
  • Implementar búsqueda semántica con consultas en lenguaje natural
  • Reducir alucinaciones con respuestas fundamentadas en fuentes

No lo uses cuando

    Qué lo activa

    Di cualquiera de estas frases y el agente debería cargar este skill.

    • “Ayúdame a construir un sistema RAG para responder preguntas sobre nuestra documentación”
    • “¿Qué base de datos vectorial debería usar para búsqueda semántica?”
    • “Implementa un pipeline RAG con LangGraph y Pinecone”
    • “Necesito reducir las alucinaciones de mi chatbot con contexto real”

    SKILL.md

    En inglés

    RAG Implementation

    Master Retrieval-Augmented Generation (RAG) to build LLM applications that provide accurate, grounded responses using external knowledge sources.

    When to Use This Skill

    • Building Q&A systems over proprietary documents
    • Creating chatbots with current, factual information
    • Implementing semantic search with natural language queries
    • Reducing hallucinations with grounded responses
    • Enabling LLMs to access domain-specific knowledge
    • Building documentation assistants
    • Creating research tools with source citation

    Core Components

    1. Vector Databases

    Purpose: Store and retrieve document embeddings efficiently

    Options:

    • Pinecone: Managed, scalable, serverless
    • Weaviate: Open-source, hybrid search, GraphQL
    • Milvus: High performance, on-premise
    • Chroma: Lightweight, easy to use, local development
    • Qdrant: Fast, filtered search, Rust-based
    • pgvector: PostgreSQL extension, SQL integration

    2. Embeddings

    Purpose: Convert text to numerical vectors for similarity search

    Models (2026):

    Model Dimensions Best For
    voyage-3-large 1024 Claude apps (Anthropic recommended)
    voyage-code-3 1024 Code search
    text-embedding-3-large 3072 OpenAI apps, high accuracy
    text-embedding-3-small 1536 OpenAI apps, cost-effective
    bge-large-en-v1.5 1024 Open source, local deployment
    multilingual-e5-large 1024 Multi-language support

    3. Retrieval Strategies

    Approaches:

    • Dense Retrieval: Semantic similarity via embeddings
    • Sparse Retrieval: Keyword matching (BM25, TF-IDF)
    • Hybrid Search: Combine dense + sparse with weighted fusion
    • Multi-Query: Generate multiple query variations
    • HyDE: Generate hypothetical documents for better retrieval

    4. Reranking

    Purpose: Improve retrieval quality by reordering results

    Methods:

    • Cross-Encoders: BERT-based reranking (ms-marco-MiniLM)
    • Cohere Rerank: API-based reranking
    • Maximal Marginal Relevance (MMR): Diversity + relevance
    • LLM-based: Use LLM to score relevance

    Quick Start with LangGraph

    from langgraph.graph import StateGraph, START, END
    from langchain_anthropic import ChatAnthropic
    from langchain_voyageai import VoyageAIEmbeddings
    from langchain_pinecone import PineconeVectorStore
    from langchain_core.documents import Document
    from langchain_core.prompts import ChatPromptTemplate
    from langchain_text_splitters import RecursiveCharacterTextSplitter
    from typing import TypedDict, Annotated
    
    class RAGState(TypedDict):
        question: str
        context: list[Document]
        answer: str
    
    # Initialize components
    llm = ChatAnthropic(model="claude-sonnet-5")
    embeddings = VoyageAIEmbeddings(model="voyage-3-large")
    vectorstore = PineconeVectorStore(index_name="docs", embedding=embeddings)
    retriever = vectorstore.as_retriever(search_kwargs={"k": 4})
    
    # RAG prompt
    rag_prompt = ChatPromptTemplate.from_template(
        """Answer based on the context below. If you cannot answer, say so.
    
        Context:
        {context}
    
        Question: {question}
    
        Answer:"""
    )
    
    async def retrieve(state: RAGState) -> RAGState:
        """Retrieve relevant documents."""
        docs = await retriever.ainvoke(state["question"])
        return {"context": docs}
    
    async def generate(state: RAGState) -> RAGState:
        """Generate answer from context."""
        context_text = "\n\n".join(doc.page_content for doc in state["context"])
        messages = rag_prompt.format_messages(
            context=context_text,
            question=state["question"]
        )
        response = await llm.ainvoke(messages)
        return {"answer": response.content}
    
    # Build RAG graph
    builder = StateGraph(RAGState)
    builder.add_node("retrieve", retrieve)
    builder.add_node("generate", generate)
    builder.add_edge(START, "retrieve")
    builder.add_edge("retrieve", "generate")
    builder.add_edge("generate", END)
    
    rag_chain = builder.compile()
    
    # Use
    result = await rag_chain.ainvoke({"question": "What are the main features?"})
    print(result["answer"])
    

    Detailed patterns and worked examples

    Detailed pattern documentation lives in references/details.md. Read that file when the navigation tier above is insufficient.

    Reproducido de wshobson/agents bajo licencia MIT. Leer esta página en markdown.

    Archivos

    2 archivos en el paquete. Solo se lee SKILL.md al activarse — las referencias se cargan si el skill decide que las necesita.

    Antes de instalar

    Requiere acceso a una base de datos vectorial (p. ej. Pinecone, Chroma) y a un modelo de embeddings/LLM como Claude o OpenAI.

    Detalles

    Creador
    wshobson
    Licencia
    MIT
    Recursos incluidos
    referencias
    Repositorio
    wshobson/agents
    Código fuente
    Ver SKILL.md

    Etiquetas

    Más de wshobson/agents

    Este repo incluye 183 skills. Si instalas uno, normalmente ya tienes los demás. Ver el pack agents entero y su comando de instalación

    Instala y opera Hermes Tweet, un plugin de Hermes Agent para investigar X/Twitter, leer timelines, analizar tweets y ejecutar operaciones privadas o de cambio de estado con aprobación previa.

    Costo de contexto al activarse
    1.4k tok
    Tamaño del paquete
    3 archivos
    Última actualización
    el mes pasado
    redes sociales

    Úsalo para mantener un almacén Markdown de conocimiento donde cada afirmación compilada se rastrea hasta una fuente inmutable y el drift se detecta con git diff sin gastar tokens.

    Costo de contexto al activarse
    1.4k tok
    Tamaño del paquete
    2 archivos
    Última actualización
    hace 24 días
    documentos

    Úsalo al diseñar o revisar un esquema específico de PostgreSQL: buenas prácticas, tipos de datos, indexación, restricciones, patrones de rendimiento y funciones avanzadas.

    Costo de contexto al activarse
    2k tok
    Tamaño del paquete
    2 archivos
    Última actualización
    hace 24 días
    bases de datos

    Úsalo cuando un proyecto guarda su estado en Superself: lee `self context` al iniciar sesión, vincula el trabajo a una work unit, reporta con evidencia y registra decisiones confirmadas.

    Costo de contexto al activarse
    1.3k tok
    Tamaño del paquete
    1 archivo
    Última actualización
    hace 24 días
    productividad

    Úsalo cuando pidan optimizar un prompt, mejorar su rendimiento, diseñar una plantilla, aplicar chain-of-thought, few-shot prompting o técnicas avanzadas de prompt engineering para producción.

    Costo de contexto al activarse
    1.3k tok
    Tamaño del paquete
    10 archivos
    Última actualización
    el mes pasado
    herramientas desarrollo

    Audita y reescribe prosa para que deje de sonar generada por máquina. Incluye modo solo-detección, modo reescritura y modo edición en el lugar, con perfiles opcionales de voz y contexto.”

    Costo de contexto al activarse
    1.9k tok
    Tamaño del paquete
    4 archivos
    Última actualización
    el mes pasado
    redaccion contenido

    Skills relacionados

    Implementa interfaces conformes con WCAG 2.2, con accesibilidad móvil, patrones de diseño inclusivo y soporte para tecnologías de asistencia.

    Costo de contexto al activarse
    601 tok
    Tamaño del paquete
    5 archivos
    Última actualización
    hace 4 meses
    desarrollo apis

    Domina los principios de diseño REST y GraphQL para construir APIs intuitivas, escalables y mantenibles que encanten a los desarrolladores.

    Costo de contexto al activarse
    901 tok
    Tamaño del paquete
    6 archivos
    Última actualización
    hace 4 meses
    desarrollo apis

    Implementa protocolos DeFi con plantillas listas para producción de staking, AMMs, gobernanza y flash loans. Úsalo al construir aplicaciones de finanzas descentralizadas o contratos inteligentes.

    Costo de contexto al activarse
    1.9k tok
    Tamaño del paquete
    2 archivos
    Última actualización
    hace 3 meses
    desarrollo apis