Skills Agentes

Depmap

Consulta el Cancer Dependency Map (DepMap) para obtener puntuaciones de dependencia génica (CRISPR Chronos), sensibilidad a fármacos y perfiles de efecto génico en líneas celulares de cáncer.

Estrellas
34.8k

en todo el repo

Actividad
57

0–100, la ruta de este skill

Actualizado
el mes pasado

último commit aquí

Commits
2

últimos 90 días

Contexto
2.8k tok

68 tok en reposo

Paquete
2 archivos

17 KB

Instalar

Funciona con cualquier agente que lea SKILL.md

npx -y skills add K-Dense-AI/scientific-agent-skills --skill depmap --agent claude-code

Se instala solo en este repositorio.

Este skill makes network requests.

Qué hace

  • Consulta la API de DepMap y descarga sus ficheros para obtener puntuaciones de dependencia CRISPR Chronos por línea celular
  • Identifica dependencias selectivas de un gen en un tipo de cáncer concreto frente al resto
  • Analiza biomarcadores comparando el efecto génico entre líneas mutadas y wild-type con Mann-Whitney
  • Busca genes co-esenciales por correlación de sus perfiles de dependencia
  • Cruza datos de sensibilidad a compuestos (PRISM) con características genómicas

Úsalo cuando

  • Validar si un gen es esencial en líneas celulares con una mutación concreta (p. ej. KRAS-mutante)
  • Buscar biomarcadores que predigan sensibilidad a la pérdida de un gen
  • Buscar interacciones de letalidad sintética
  • Evaluar si un gen es esencial pan-cáncer o selectivamente esencial para validar una diana

No lo uses cuando

    Qué lo activa

    Di cualquiera de estas frases y el agente debería cargar este skill.

    • ¿Es KRAS esencial en líneas celulares de cáncer de pulmón?
    • Busca genes con letalidad sintética con BRCA1
    • ¿Qué genes están correlacionados en co-esencialidad con este gen?
    • Valida esta diana oncológica con datos de DepMap

    SKILL.md

    En inglés

    DepMap — Cancer Dependency Map

    Overview

    The Cancer Dependency Map (DepMap) project, run by the Broad Institute, systematically characterizes genetic dependencies across hundreds of cancer cell lines using genome-wide CRISPR knockout screens (DepMap CRISPR), RNA interference (RNAi), and compound sensitivity assays (PRISM). DepMap data is essential for:

    • Identifying which genes are essential for specific cancer types
    • Finding cancer-selective dependencies (therapeutic targets)
    • Validating oncology drug targets
    • Discovering synthetic lethal interactions

    Key resources:

    When to Use This Skill

    Use DepMap when:

    • Target validation: Is a gene essential for survival in cancer cell lines with a specific mutation (e.g., KRAS-mutant)?
    • Biomarker discovery: What genomic features predict sensitivity to knockout of a gene?
    • Synthetic lethality: Find genes that are selectively essential when another gene is mutated/deleted
    • Drug sensitivity: What cell line features predict response to a compound?
    • Pan-cancer essentiality: Is a gene broadly essential across all cancer types (bad target) or selectively essential?
    • Correlation analysis: Which pairs of genes have correlated dependency profiles (co-essentiality)?

    Core Concepts

    Dependency Scores

    Score Range Meaning
    Chronos (CRISPR) ~ -3 to 0+ More negative = more essential. Common essential threshold: −1. Pan-essential genes ~−1 to −2
    RNAi DEMETER2 ~ -3 to 0+ Similar scale to Chronos
    Gene Effect normalized Normalized Chronos; −1 = median effect of common essential genes

    Key thresholds:

    • Chronos ≤ −0.5: likely dependent
    • Chronos ≤ −1: strongly dependent (common essential range)

    Cell Line Annotations

    Each cell line has:

    • DepMap_ID: unique identifier (e.g., ACH-000001)
    • cell_line_name: human-readable name
    • primary_disease: cancer type
    • lineage: broad tissue lineage
    • lineage_subtype: specific subtype

    Core Capabilities

    1. DepMap API

    import requests
    import pandas as pd
    
    BASE_URL = "https://depmap.org/portal/api"
    
    def depmap_get(endpoint, params=None):
        url = f"{BASE_URL}/{endpoint}"
        response = requests.get(url, params=params)
        response.raise_for_status()
        return response.json()
    

    2. Gene Dependency Scores

    def get_gene_dependency(gene_symbol, dataset="Chronos_Combined"):
        """Get CRISPR dependency scores for a gene across all cell lines."""
        url = f"{BASE_URL}/gene"
        params = {
            "gene_id": gene_symbol,
            "dataset": dataset
        }
        response = requests.get(url, params=params)
        return response.json()
    
    # Alternatively, use the /data endpoint:
    def get_dependencies_slice(gene_symbol, dataset_name="CRISPRGeneEffect"):
        """Get a gene's dependency slice from a dataset."""
        url = f"{BASE_URL}/data/gene_dependency"
        params = {"gene_name": gene_symbol, "dataset_name": dataset_name}
        response = requests.get(url, params=params)
        data = response.json()
        return data
    

    3. Download-Based Analysis (Recommended for Large Queries)

    For large-scale analysis, download DepMap data files and analyze locally:

    import pandas as pd
    import requests, os
    
    def download_depmap_data(url, output_path):
        """Download a DepMap data file."""
        response = requests.get(url, stream=True)
        with open(output_path, 'wb') as f:
            for chunk in response.iter_content(chunk_size=8192):
                f.write(chunk)
    
    # DepMap 24Q4 data files (update version as needed)
    FILES = {
        "crispr_gene_effect": "https://figshare.com/ndownloader/files/...",
        # OR download from: https://depmap.org/portal/download/all/
        # Files available:
        # CRISPRGeneEffect.csv - Chronos gene effect scores
        # OmicsExpressionProteinCodingGenesTPMLogp1.csv - mRNA expression
        # OmicsSomaticMutationsMatrixDamaging.csv - mutation binary matrix
        # OmicsCNGene.csv - copy number
        # sample_info.csv - cell line metadata
    }
    
    def load_depmap_gene_effect(filepath="CRISPRGeneEffect.csv"):
        """
        Load DepMap CRISPR gene effect matrix.
        Rows = cell lines (DepMap_ID), Columns = genes (Symbol (EntrezID))
        """
        df = pd.read_csv(filepath, index_col=0)
        # Rename columns to gene symbols only
        df.columns = [col.split(" ")[0] for col in df.columns]
        return df
    
    def load_cell_line_info(filepath="sample_info.csv"):
        """Load cell line metadata."""
        return pd.read_csv(filepath)
    

    4. Identifying Selective Dependencies

    import numpy as np
    import pandas as pd
    
    def find_selective_dependencies(gene_effect_df, cell_line_info, target_gene,
                                     cancer_type=None, threshold=-0.5):
        """Find cell lines selectively dependent on a gene."""
    
        # Get scores for target gene
        if target_gene not in gene_effect_df.columns:
            return None
    
        scores = gene_effect_df[target_gene].dropna()
        dependent = scores[scores <= threshold]
    
        # Add cell line info
        result = pd.DataFrame({
            "DepMap_ID": dependent.index,
            "gene_effect": dependent.values
        }).merge(cell_line_info[["DepMap_ID", "cell_line_name", "primary_disease", "lineage"]])
    
        if cancer_type:
            result = result[result["primary_disease"].str.contains(cancer_type, case=False, na=False)]
    
        return result.sort_values("gene_effect")
    
    # Example usage (after loading data)
    # df_effect = load_depmap_gene_effect("CRISPRGeneEffect.csv")
    # cell_info = load_cell_line_info("sample_info.csv")
    # deps = find_selective_dependencies(df_effect, cell_info, "KRAS", cancer_type="Lung")
    

    5. Biomarker Analysis (Gene Effect vs. Mutation)

    import pandas as pd
    from scipy import stats
    
    def biomarker_analysis(gene_effect_df, mutation_df, target_gene, biomarker_gene):
        """
        Test if mutation in biomarker_gene predicts dependency on target_gene.
    
        Args:
            gene_effect_df: CRISPR gene effect DataFrame
            mutation_df: Binary mutation DataFrame (1 = mutated)
            target_gene: Gene to assess dependency of
            biomarker_gene: Gene whose mutation may predict dependency
        """
        if target_gene not in gene_effect_df.columns or biomarker_gene not in mutation_df.columns:
            return None
    
        # Align cell lines
        common_lines = gene_effect_df.index.intersection(mutation_df.index)
        scores = gene_effect_df.loc[common_lines, target_gene].dropna()
        mutations = mutation_df.loc[scores.index, biomarker_gene]
    
        mutated = scores[mutations == 1]
        wt = scores[mutations == 0]
    
        stat, pval = stats.mannwhitneyu(mutated, wt, alternative='less')
    
        return {
            "target_gene": target_gene,
            "biomarker_gene": biomarker_gene,
            "n_mutated": len(mutated),
            "n_wt": len(wt),
            "mean_effect_mutated": mutated.mean(),
            "mean_effect_wt": wt.mean(),
            "pval": pval,
            "significant": pval < 0.05
        }
    

    6. Co-Essentiality Analysis

    import pandas as pd
    
    def co_essentiality(gene_effect_df, target_gene, top_n=20):
        """Find genes with most correlated dependency profiles (co-essential partners)."""
        if target_gene not in gene_effect_df.columns:
            return None
    
        target_scores = gene_effect_df[target_gene].dropna()
    
        correlations = {}
        for gene in gene_effect_df.columns:
            if gene == target_gene:
                continue
            other_scores = gene_effect_df[gene].dropna()
            common = target_scores.index.intersection(other_scores.index)
            if len(common) < 50:
                continue
            r = target_scores[common].corr(other_scores[common])
            if not pd.isna(r):
                correlations[gene] = r
    
        corr_series = pd.Series(correlations).sort_values(ascending=False)
        return corr_series.head(top_n)
    
    # Co-essential genes often share biological complexes or pathways
    

    Query Workflows

    Workflow 1: Target Validation for a Cancer Type

    1. Download CRISPRGeneEffect.csv and sample_info.csv
    2. Filter cell lines by cancer type
    3. Compute mean gene effect for target gene in cancer vs. all others
    4. Calculate selectivity: how specific is the dependency to your cancer type?
    5. Cross-reference with mutation, expression, or CNA data as biomarkers

    Workflow 2: Synthetic Lethality Screen

    1. Identify cell lines with mutation/deletion in gene of interest (e.g., BRCA1-mutant)
    2. Compute gene effect scores for all genes in mutant vs. WT lines
    3. Identify genes significantly more essential in mutant lines (synthetic lethal partners)
    4. Filter by selectivity and effect size

    Workflow 3: Compound Sensitivity Analysis

    1. Download PRISM compound sensitivity data (primary-screen-replicate-treatment-info.csv)
    2. Correlate compound AUC/log2(fold-change) with genomic features
    3. Identify predictive biomarkers for compound sensitivity

    DepMap Data Files Reference

    File Description
    CRISPRGeneEffect.csv CRISPR Chronos gene effect (primary dependency data)
    CRISPRGeneEffectUnscaled.csv Unscaled CRISPR scores
    RNAi_merged.csv DEMETER2 RNAi dependency
    sample_info.csv Cell line metadata (lineage, disease, etc.)
    OmicsExpressionProteinCodingGenesTPMLogp1.csv mRNA expression
    OmicsSomaticMutationsMatrixDamaging.csv Damaging somatic mutations (binary)
    OmicsCNGene.csv Copy number per gene
    PRISM_Repurposing_Primary_Screens_Data.csv Drug sensitivity (repurposing library)

    Download all files from: https://depmap.org/portal/download/all/

    Best Practices

    • Use Chronos scores (not DEMETER2) for current CRISPR analyses — better controlled for cutting efficiency
    • Distinguish pan-essential from cancer-selective: Target genes with low variance (essential in all lines) are poor drug targets
    • Validate with expression data: A gene not expressed in a cell line will score as non-essential regardless of actual function
    • Use DepMap ID for cell line identification — cell_line_name can be ambiguous
    • Account for copy number: Amplified genes may appear essential due to copy number effect (junk DNA hypothesis)
    • Multiple testing correction: When computing biomarker associations genome-wide, apply FDR correction

    Additional Resources

    Reproducido de K-Dense-AI/scientific-agent-skills bajo licencia CC-BY-4.0. Leer esta página en markdown.

    Archivos

    2 archivos en el paquete. Solo se lee SKILL.md al activarse — las referencias se cargan si el skill decide que las necesita.

    Antes de instalar

    Requiere acceso a la API de DepMap (depmap.org/portal/api) o descargar sus ficheros de datos, como CRISPRGeneEffect.csv y sample_info.csv.

    Detalles

    Creador
    K-Dense-AI
    Categoría
    Investigación
    Licencia
    CC-BY-4.0
    Recursos incluidos
    referencias
    Código fuente
    Ver SKILL.md

    Etiquetas

    Más de K-Dense-AI/scientific-agent-skills

    Este repo incluye 163 skills. Si instalas uno, normalmente ya tienes los demás.

    Gestión integral de citas académicas: busca en OpenAlex, PubMed y Google Scholar, extrae metadatos precisos, valida citas y genera entradas BibTeX correctamente formateadas.

    Costo de contexto al activarse
    3.7k tok
    Tamaño del paquete
    21 archivos
    Última actualización
    hace 28 días
    investigacion

    Realiza revisiones bibliográficas sistemáticas y completas usando varias bases académicas (PubMed, arXiv, bioRxiv, Semantic Scholar). Genera markdown y PDF con citas verificadas en varios estilos (APA, Nature, Vancouver).

    Costo de contexto al activarse
    3.2k tok
    Tamaño del paquete
    12 archivos
    Última actualización
    hace 15 días
    investigacion

    Crea decks de diapositivas y presentaciones para charlas de investigación: PowerPoint, presentaciones de conferencia, seminarios, defensas de tesis. Da estructura, plantillas, guía de tiempos y validación visual.

    Costo de contexto al activarse
    5.1k tok
    Tamaño del paquete
    24 archivos
    Última actualización
    hace 15 días
    documentos

    Crea infografías profesionales con Nano Banana Pro AI y refinamiento iterativo inteligente. Usa Gemini 3.6 Flash para revisar la calidad e integra investigación con Perplexity Sonar. Soporta 10 tipos, 8 estilos y paletas para daltonismo.

    Costo de contexto al activarse
    2.7k tok
    Tamaño del paquete
    8 archivos
    Última actualización
    hace 15 días
    diseno ui

    Crea pósteres de investigación profesionales en LaTeX con beamerposter, tikzposter o baposter, para conferencias y comunicación científica: layout, colores, columnas múltiples e integración de figuras.

    Costo de contexto al activarse
    3.9k tok
    Tamaño del paquete
    17 archivos
    Última actualización
    hace 15 días
    documentos

    Crea diagramas científicos de calidad de publicación con la IA Nano Banana 2 y refinamiento iterativo inteligente. Gemini 3.6 Flash revisa la calidad y solo regenera si está por debajo del umbral de tu tipo de documento.

    Costo de contexto al activarse
    4.1k tok
    Tamaño del paquete
    6 archivos
    Última actualización
    hace 15 días
    diseno ui

    Skills relacionados

    Astropy

    34.8k

    Librería Python central para astronomía y astrofísica: unidades/cantidades, coordenadas, E/S de FITS, tablas, sistemas de tiempo, WCS y cosmología, para implementar o depurar código con Astropy.

    Costo de contexto al activarse
    3.6k tok
    Tamaño del paquete
    8 archivos
    Última actualización
    el mes pasado
    investigacion

    Integración con el SDK de Python de Benchling y su API REST para entidades del registro, inventario, entradas del cuaderno electrónico (ELN), workflows, Benchling Apps y consultas al Data Warehouse.

    Costo de contexto al activarse
    1.9k tok
    Tamaño del paquete
    6 archivos
    Última actualización
    el mes pasado
    investigacion

    Busca papers científicos y obtiene datos experimentales estructurados extraídos de estudios a texto completo vía el servidor MCP de BGPT: más de 25 campos por paper (métodos, resultados, muestras, calidad, conclusiones).

    Costo de contexto al activarse
    713 tok
    Tamaño del paquete
    1 archivo
    Última actualización
    el mes pasado
    investigacion