book-to-skill: convertir un libro técnico en una skill que tu IA consulta cuando le hace falta
Compras un libro técnico, lo lees una vez y a los tres meses no recuerdas ni que existía el capítulo 7. Este repo lo convierte en algo que tu agente consulta por ti.

- Estrellas
- 20,4K
- Lenguaje
- Python
- Licencia
- MIT
- Datos de
- 11 ago 2026
Las estrellas cambian a diario. La cifra es la del día indicado, no la de hoy.
book-to-skill convierte un libro técnico, una carpeta de documentación o un conjunto de fuentes en una skill que Claude Code, GitHub Copilot CLI o Amp cargan cuando les hace falta. Se instala con npx skills add virgiliojr94/book-to-skill, apuntas al archivo con /book-to-skill ./mi-libro.pdf, y a partir de ahí puedes preguntarle al agente por el contenido del libro y te responde desde el texto real, no de memoria.
Es de los repos más útiles que he visto este año, y no por el motivo que parece.

Como el anterior, esto no tiene interfaz que enseñar: es un conversor que se ejecuta desde tu agente y deja archivos de texto en una carpeta. Lo que se ve es el resultado, y eso sí lo desgloso más abajo.
El problema real
Compras un libro técnico bueno. Te lo lees. A los tres meses no recuerdas ni que existía el capítulo 7.
Publiqué 172 artículos en marzo y fue mi peor mes
Tenía esta web parada y la estoy rehaciendo con IA. Cambié la forma de hacerlo y en once días de agosto ha tenido más visitas desde Google que en todo julio. Te cuento por correo qué cambié.
- · Por qué la oportunidad es mayor ahora, y no menor
- · Lo único que la IA no te puede copiar: tu criterio
- · Cómo hacer que Google te vea en días, no en seis meses
Los apaños de siempre no sirven. Buscar dentro del PDF te devuelve una lista de páginas, no una respuesta. Preguntarle al agente por el libro acaba en alucinación o en un "no tengo ese contenido". Y tomar notas mientras lees termina en un documento de doscientas líneas que no vuelves a abrir.
La idea del repo es distinta: no resumir el libro, estructurarlo. Convertirlo en algo que tu agente pueda consultar por capítulos, con su glosario y sus patrones, sin que tengas que meter el libro entero en la conversación.
Qué genera exactamente
Al ejecutarlo sobre un archivo, crea una skill completa en la carpeta de tu agente:
| Archivo | Qué contiene | Tamaño aproximado |
|---|---|---|
SKILL.md | Modelos mentales principales e índice de capítulos | ~4.000 tokens |
chapters/ch01-*.md | Un archivo por capítulo, se carga solo si preguntas por él | ~1.000 tokens cada uno |
glossary.md | Términos clave ordenados alfabéticamente, con referencia al capítulo | ~1.500 tokens |
patterns.md | Técnicas, algoritmos y patrones de diseño | ~2.000 tokens |
cheatsheet.md | Tablas de decisión y reglas de consulta rápida | ~1.000 tokens |
La pieza inteligente es que los capítulos se cargan bajo demanda. No ocupan contexto hasta que preguntas por ese tema concreto. Por eso el conjunto se mantiene ligero aunque el libro sea de setecientas páginas.
Según las mediciones del propio proyecto, responder una pregunta así cuesta entre 24 y 51 veces menos tokens que volcar el libro entero en la conversación. Es su dato, medido con su metodología, pero la lógica se sostiene: el coste de estructurar se paga una vez, al convertir, en lugar de en cada pregunta.
Cómo se instala
npx skills add virgiliojr94/book-to-skill
O clonando directamente en la carpeta de skills de tu agente:
git clone https://github.com/virgiliojr94/book-to-skill.git ~/.claude/skills/book-to-skill
Para Copilot CLI la ruta es ~/.copilot/skills/ y para Amp o uso multiagente, ~/.agents/skills/.
Necesitas extractores según el formato. Esto es lo que más gente pasa por alto. Antes de nada:
python3 scripts/extract.py --check
Te dice qué tienes instalado y el comando exacto para lo que falte. Para PDF hay dos caminos según el libro:
- Libros de prosa:
pdftotext(del paquete poppler) opypdf. Instantáneos. - Libros técnicos con código, tablas y fórmulas:
docling(pip3 install docling). Va a más o menos segundo y medio por página, pero conserva las tablas en markdown y los bloques de código.
La skill te pregunta de qué tipo es el libro antes de empezar y elige la herramienta ella sola.
Formatos admitidos: PDF, EPUB, DOCX, HTML, RTF, MOBI y texto plano o markdown, que no necesitan nada extra.
Si el PDF está escaneado, no funciona, y el propio extractor te lo dice al momento en vez de trabajarse el libro entero para devolverte una skill vacía. Hay que pasarle OCR antes:
ocrmypdf entrada.pdf salida.pdf
Cómo se usa
/book-to-skill ./mi-libro.pdf
Acepta un archivo, una carpeta o un patrón. Cuando termina, la consulta es directa:
/mi-libro replicación
Y el agente abre el capítulo que toca y responde desde el contenido real.
En Codex el planteamiento es el mismo con las rutas de Codex, aunque el repo declara compatibilidad explícita con Claude Code, Copilot CLI y Amp. Al seguir el estándar abierto de Agent Skills, el mismo SKILL.md lo entienden todos.
Lo que de verdad le da valor: que no hace falta que sea un libro
El nombre despista. La entrada puede ser cualquier prosa estructurada, y ahí es donde le veo más recorrido:
Documentación interna. Decisiones de arquitectura, manuales de proceso, guías de incorporación. Metes la carpeta docs/ entera y preguntas mientras trabajas.
Manuales de marca. Guía de tono, principios de comunicación. Un manual de marca de sesenta páginas que nadie relee se convierte en algo que el equipo consulta de verdad.
Normativa y especificaciones. Contratos de API, estándares, documentación de cumplimiento. Para quien trabaja con normativa fiscal o laboral, convertir una guía técnica en una skill consultable es exactamente el caso de uso: dejas de buscar en un PDF y preguntas.
La regla que da el repo es buena: si vuelves a abrir un documento lo bastante a menudo como para desear habértelo memorizado, es candidato.
Lo del copyright, que sí importa
El repo es honesto con esto y conviene repetirlo. La herramienta no incluye contenido de ningún libro: es un conversor que apuntas a archivos que ya tienes.
- El procesamiento es local, tus archivos no se suben a ninguna parte por esta herramienta. Otra cosa es el modelo que uses: lo que le pases sigue las condiciones de ese proveedor.
- Usa tu propia copia. Un libro que compraste, documentación de tu empresa, textos con licencia abierta.
- La skill que sale es material derivado y sintetizado —nombres de conceptos, definiciones, conclusiones—, no una reproducción del texto.
- No la redistribuyas. Publicar o compartir la skill de un libro con derechos puede vulnerarlos. Para uso propio, sin problema; para repartirla por ahí, no.
La licencia MIT cubre el conversor, no lo que proceses con él.

¿Te preocupa el futuro con la IA?
Descubre cómo la inteligencia artificial ha liquidado las viejas reglas del juego y qué puedes hacer tú al respecto.
Leer más sobre el libroCuándo no te compensa
- Para un documento que consultas una vez, el coste de convertirlo no se recupera.
- Con libros escaneados sin OCR no funciona hasta que los pases por OCR tú.
- Para narrativa o textos poco estructurados rinde mal: extrae marcos y patrones, y si el libro no los tiene, no hay nada que extraer.
- No sustituye a leerte el libro. Sirve para recordar y consultar lo que ya entendiste, no para saltarte el aprendizaje.
Preguntas frecuentes
¿Sube mis libros a algún servidor?
No. La extracción y el análisis se ejecutan en tu máquina y la herramienta no sube tus archivos. Ten en cuenta, eso sí, que si el agente que dirige el proceso es un modelo en la nube, el texto que le pases se rige por las condiciones de ese proveedor.
¿Vale con cualquier formato?
PDF, EPUB, DOCX, HTML, RTF, MOBI, texto plano y markdown. Cada formato necesita su extractor, salvo texto y markdown que no requieren nada. Ejecuta python3 scripts/extract.py --check y te dice qué falta.
¿Puedo compartir la skill que genero de un libro?
No deberías si el libro tiene derechos de autor. Trátala como notas personales: para ti, sin publicarla. Documentación interna, textos propios o material con licencia abierta sí puedes compartirlos dentro de lo que permita su licencia.
¿Por qué no meter el PDF entero en la conversación y ya está?
Porque cada pregunta obligaría al agente a recorrer el documento otra vez: reabrir el índice, buscar, reprocesar. Este proyecto paga ese coste una sola vez al convertir, y sus mediciones hablan de entre 24 y 51 veces menos tokens por consulta.
¿Funciona con libros en español?
El conversor trabaja sobre el texto que extrae, así que el idioma del original no es el obstáculo. Lo que sí influye es la estructura: cuanto mejor definidos estén los capítulos y encabezados, mejor sale la skill.
Analizo los repos que entran en tendencia y cómo sacarles partido con Claude Code y Codex. Ver todos los repos analizados.