book-to-skill: convertir un libro técnico en una skill que tu IA consulta cuando le hace falta

Compras un libro técnico, lo lees una vez y a los tres meses no recuerdas ni que existía el capítulo 7. Este repo lo convierte en algo que tu agente consulta por ti.

Guillermo del Pino
Guillermo del Pino
virgiliojr94/book-to-skill
Estrellas
20,4K
Lenguaje
Python
Licencia
MIT
Datos de
11 ago 2026

Las estrellas cambian a diario. La cifra es la del día indicado, no la de hoy.

book-to-skill convierte un libro técnico, una carpeta de documentación o un conjunto de fuentes en una skill que Claude Code, GitHub Copilot CLI o Amp cargan cuando les hace falta. Se instala con npx skills add virgiliojr94/book-to-skill, apuntas al archivo con /book-to-skill ./mi-libro.pdf, y a partir de ahí puedes preguntarle al agente por el contenido del libro y te responde desde el texto real, no de memoria.

Es de los repos más útiles que he visto este año, y no por el motivo que parece.

Imagen de portada del proyecto book-to-skill. Del repositorio oficial.
Imagen de portada del proyecto book-to-skill. Del repositorio oficial.

Como el anterior, esto no tiene interfaz que enseñar: es un conversor que se ejecuta desde tu agente y deja archivos de texto en una carpeta. Lo que se ve es el resultado, y eso sí lo desgloso más abajo.

El problema real

Compras un libro técnico bueno. Te lo lees. A los tres meses no recuerdas ni que existía el capítulo 7.

Publiqué 172 artículos en marzo y fue mi peor mes

Tenía esta web parada y la estoy rehaciendo con IA. Cambié la forma de hacerlo y en once días de agosto ha tenido más visitas desde Google que en todo julio. Te cuento por correo qué cambié.

impresiones clics1-9 ago · 710 → 2.522
  • · Por qué la oportunidad es mayor ahora, y no menor
  • · Lo único que la IA no te puede copiar: tu criterio
  • · Cómo hacer que Google te vea en días, no en seis meses

Los apaños de siempre no sirven. Buscar dentro del PDF te devuelve una lista de páginas, no una respuesta. Preguntarle al agente por el libro acaba en alucinación o en un "no tengo ese contenido". Y tomar notas mientras lees termina en un documento de doscientas líneas que no vuelves a abrir.

La idea del repo es distinta: no resumir el libro, estructurarlo. Convertirlo en algo que tu agente pueda consultar por capítulos, con su glosario y sus patrones, sin que tengas que meter el libro entero en la conversación.

Qué genera exactamente

Al ejecutarlo sobre un archivo, crea una skill completa en la carpeta de tu agente:

ArchivoQué contieneTamaño aproximado
SKILL.mdModelos mentales principales e índice de capítulos~4.000 tokens
chapters/ch01-*.mdUn archivo por capítulo, se carga solo si preguntas por él~1.000 tokens cada uno
glossary.mdTérminos clave ordenados alfabéticamente, con referencia al capítulo~1.500 tokens
patterns.mdTécnicas, algoritmos y patrones de diseño~2.000 tokens
cheatsheet.mdTablas de decisión y reglas de consulta rápida~1.000 tokens

La pieza inteligente es que los capítulos se cargan bajo demanda. No ocupan contexto hasta que preguntas por ese tema concreto. Por eso el conjunto se mantiene ligero aunque el libro sea de setecientas páginas.

Según las mediciones del propio proyecto, responder una pregunta así cuesta entre 24 y 51 veces menos tokens que volcar el libro entero en la conversación. Es su dato, medido con su metodología, pero la lógica se sostiene: el coste de estructurar se paga una vez, al convertir, en lugar de en cada pregunta.

Cómo se instala

npx skills add virgiliojr94/book-to-skill

O clonando directamente en la carpeta de skills de tu agente:

git clone https://github.com/virgiliojr94/book-to-skill.git ~/.claude/skills/book-to-skill

Para Copilot CLI la ruta es ~/.copilot/skills/ y para Amp o uso multiagente, ~/.agents/skills/.

Necesitas extractores según el formato. Esto es lo que más gente pasa por alto. Antes de nada:

python3 scripts/extract.py --check

Te dice qué tienes instalado y el comando exacto para lo que falte. Para PDF hay dos caminos según el libro:

  • Libros de prosa: pdftotext (del paquete poppler) o pypdf. Instantáneos.
  • Libros técnicos con código, tablas y fórmulas: docling (pip3 install docling). Va a más o menos segundo y medio por página, pero conserva las tablas en markdown y los bloques de código.

La skill te pregunta de qué tipo es el libro antes de empezar y elige la herramienta ella sola.

Formatos admitidos: PDF, EPUB, DOCX, HTML, RTF, MOBI y texto plano o markdown, que no necesitan nada extra.

Si el PDF está escaneado, no funciona, y el propio extractor te lo dice al momento en vez de trabajarse el libro entero para devolverte una skill vacía. Hay que pasarle OCR antes:

ocrmypdf entrada.pdf salida.pdf

Cómo se usa

/book-to-skill ./mi-libro.pdf

Acepta un archivo, una carpeta o un patrón. Cuando termina, la consulta es directa:

/mi-libro replicación

Y el agente abre el capítulo que toca y responde desde el contenido real.

En Codex el planteamiento es el mismo con las rutas de Codex, aunque el repo declara compatibilidad explícita con Claude Code, Copilot CLI y Amp. Al seguir el estándar abierto de Agent Skills, el mismo SKILL.md lo entienden todos.

Lo que de verdad le da valor: que no hace falta que sea un libro

El nombre despista. La entrada puede ser cualquier prosa estructurada, y ahí es donde le veo más recorrido:

Documentación interna. Decisiones de arquitectura, manuales de proceso, guías de incorporación. Metes la carpeta docs/ entera y preguntas mientras trabajas.

Manuales de marca. Guía de tono, principios de comunicación. Un manual de marca de sesenta páginas que nadie relee se convierte en algo que el equipo consulta de verdad.

Normativa y especificaciones. Contratos de API, estándares, documentación de cumplimiento. Para quien trabaja con normativa fiscal o laboral, convertir una guía técnica en una skill consultable es exactamente el caso de uso: dejas de buscar en un PDF y preguntas.

La regla que da el repo es buena: si vuelves a abrir un documento lo bastante a menudo como para desear habértelo memorizado, es candidato.

El repo es honesto con esto y conviene repetirlo. La herramienta no incluye contenido de ningún libro: es un conversor que apuntas a archivos que ya tienes.

  • El procesamiento es local, tus archivos no se suben a ninguna parte por esta herramienta. Otra cosa es el modelo que uses: lo que le pases sigue las condiciones de ese proveedor.
  • Usa tu propia copia. Un libro que compraste, documentación de tu empresa, textos con licencia abierta.
  • La skill que sale es material derivado y sintetizado —nombres de conceptos, definiciones, conclusiones—, no una reproducción del texto.
  • No la redistribuyas. Publicar o compartir la skill de un libro con derechos puede vulnerarlos. Para uso propio, sin problema; para repartirla por ahí, no.

La licencia MIT cubre el conversor, no lo que proceses con él.

La Era del Qué
Nuevo Lanzamiento

¿Te preocupa el futuro con la IA?

Descubre cómo la inteligencia artificial ha liquidado las viejas reglas del juego y qué puedes hacer tú al respecto.

Leer más sobre el libro

Cuándo no te compensa

  • Para un documento que consultas una vez, el coste de convertirlo no se recupera.
  • Con libros escaneados sin OCR no funciona hasta que los pases por OCR tú.
  • Para narrativa o textos poco estructurados rinde mal: extrae marcos y patrones, y si el libro no los tiene, no hay nada que extraer.
  • No sustituye a leerte el libro. Sirve para recordar y consultar lo que ya entendiste, no para saltarte el aprendizaje.

Preguntas frecuentes

¿Sube mis libros a algún servidor?

No. La extracción y el análisis se ejecutan en tu máquina y la herramienta no sube tus archivos. Ten en cuenta, eso sí, que si el agente que dirige el proceso es un modelo en la nube, el texto que le pases se rige por las condiciones de ese proveedor.

¿Vale con cualquier formato?

PDF, EPUB, DOCX, HTML, RTF, MOBI, texto plano y markdown. Cada formato necesita su extractor, salvo texto y markdown que no requieren nada. Ejecuta python3 scripts/extract.py --check y te dice qué falta.

¿Puedo compartir la skill que genero de un libro?

No deberías si el libro tiene derechos de autor. Trátala como notas personales: para ti, sin publicarla. Documentación interna, textos propios o material con licencia abierta sí puedes compartirlos dentro de lo que permita su licencia.

¿Por qué no meter el PDF entero en la conversación y ya está?

Porque cada pregunta obligaría al agente a recorrer el documento otra vez: reabrir el índice, buscar, reprocesar. Este proyecto paga ese coste una sola vez al convertir, y sus mediciones hablan de entre 24 y 51 veces menos tokens por consulta.

¿Funciona con libros en español?

El conversor trabaja sobre el texto que extrae, así que el idioma del original no es el obstáculo. Lo que sí influye es la estructura: cuanto mejor definidos estén los capítulos y encabezados, mejor sale la skill.

Analizo los repos que entran en tendencia y cómo sacarles partido con Claude Code y Codex. Ver todos los repos analizados.