Teach
214kEnseña al usuario una habilidad o un concepto nuevo, dentro de este workspace.
- Costo de contexto al activarse
- 2.4k tok
- Tamaño del paquete
- 6 archivos
- Última actualización
- el mes pasado
Explicaciones, tutorías y flujos de estudio estructurado.
8 skills en esta categoría
Enseña al usuario una habilidad o un concepto nuevo, dentro de este workspace.
Alinea un modelo ya afinado con datos de preferencia usando DPO, ORPO, KTO o SimPO; para cuando existen pares de preferencia o feedback, o hay que elegir método o depurar un run de DPO.
Aprende a construir con IA, desde cero.
Entrena comportamiento de razonamiento y tareas verificables con GRPO y RL a partir de recompensas verificables (RLVR): cuándo aplicar RL, la receta de referencia y el gate de inspección de rewards.
Decide si conviene hacer fine-tuning y enruta al método correcto (SFT, DPO/ORPO/KTO, GRPO/RLVR, continued pretraining) y al modelo base adecuado.
Configura el fine-tuning supervisado con LoRA y QLoRA usando los hiperparámetros de mejores prácticas actuales: rank/alpha, target modules y elección entre LoRA, QLoRA y full fine-tuning.
Haz fine-tuning supervisado de modelos visión-lenguaje (VLMs) con datos de imagen+texto. Úsalo al adaptar un VLM a un dominio visual, configurar LoRA con torre de visión congelada, o depurar un fine-tune que entrena sin aprender.
Aclara decisiones de carrera, emprendimiento, riqueza, felicidad y libertad usando reencuadre, auditoría de deseos, conocimiento específico y apalancamiento al estilo Naval Ravikant.
Domina el prompt engineering para modelos de IA: LLMs, generadores de imágenes y modelos de video, usando la CLI de inference.sh.