
Editar a mano un episodio de 45 minutos se te va a tres o cuatro horas. Con el flujo de IA que uso, baja a 20-40 minutos. Esa es exactamente la diferencia entre publicar cada semana y abandonar el podcast en el cuarto episodio, que es lo que le pasa a casi todo el mundo.
Crear un podcast con IA son cuatro fases: planificar el episodio, grabar, editar y publicar. La que frena a todo el mundo es la edición, y no es una tarea sino seis distintas: limpiar el ruido, quitar muletillas, cortar, nivelar el volumen, transcribir y sacar clips. Ninguna herramienta hace las seis bien, así que el flujo real combina dos o tres: Adobe Podcast Enhance para el ruido (gratis), Cleanvoice para las muletillas (desde 11 $/mes) y Auphonic para nivelar (2 horas gratis al mes).
Esta guía cubre las dos cosas: montar el podcast desde cero y editarlo con IA sin perder la tarde, con las herramientas de cada fase y los precios que hay hoy en las webs oficiales.
Publiqué 172 artículos en marzo y fue mi peor mes
Tenía esta web parada y la estoy rehaciendo con IA. Cambié la forma de hacerlo y en once días de agosto ha tenido más visitas desde Google que en todo julio. Te cuento por correo qué cambié.
- · Por qué la oportunidad es mayor ahora, y no menor
- · Lo único que la IA no te puede copiar: tu criterio
- · Cómo hacer que Google te vea en días, no en seis meses

Planificación de episodios con ChatGPT
Antes de grabar nada, necesitas saber qué vas a decir y por qué eso le importa a tu audiencia.
Definir el concepto del podcast:
"Quiero crear un podcast sobre [tema]. Mi audiencia objetivo son [descripción]. Llevo [X años] de experiencia en [área]. Ayúdame a definir: 1) El nicho concreto del podcast (más específico que el tema general). 2) El formato (entrevistas, monólogos, panel, narrativa). 3) La duración ideal por episodio. 4) La frecuencia de publicación recomendada. 5) El nombre del podcast y el tagline. 6) Los 3 temas diferenciadores respecto a otros podcasts similares."
Generar ideas de episodios:
"Genera 20 ideas de episodios para un podcast sobre [tema] dirigido a [audiencia]. Para cada episodio incluye: título atractivo, subtítulo que explica el valor para el oyente, los 3 puntos principales que se tratarían, y si sería mejor formato monólogo o entrevista (y a quién entrevistar)."
Estructura de un episodio (guion de conversación):
Para episodios de entrevista, ChatGPT puede prepararte las preguntas:
"Voy a entrevistar a [nombre del invitado], que es [descripción de quién es y por qué es relevante]. El tema del episodio es [tema]. Mi audiencia quiere saber [qué interesa a tu audiencia]. Prepárame: 5 preguntas de apertura para romper el hielo y establecer credibilidad del invitado, 10 preguntas de fondo sobre el tema principal (ordenadas de general a específico), 3 preguntas de seguimiento para profundizar en los puntos más interesantes, y 2 preguntas de cierre para extraer los takeaways más valiosos."
Para episodios en solitario (monólogos), ChatGPT puede escribirte el esquema completo:
"Escribe el esquema detallado para un episodio de podcast en solitario de [X minutos] sobre [tema]. Incluye: apertura con hook (primeros 60 segundos), presentación del episodio (qué aprenderá el oyente), desarrollo con [número] puntos principales (cada uno con subtemas y ejemplos), un momento de reflexión o historia personal relacionada, y cierre con los takeaways y la próxima llamada a la acción."
Si el guion se te resiste, la misma lógica que uso para escribir guiones de YouTube con ChatGPT funciona casi igual en audio: cambia el hook visual por un hook hablado y el resto de la estructura aguanta.
Generar show notes que posicionan en Google
Las show notes son el texto descriptivo del episodio que aparece en tu web y en las plataformas de podcast. Son también texto que Google indexa, así que tienen valor SEO.
Las show notes mediocres son un resumen aburrido de "en este episodio hablamos de X". Las buenas show notes son una mini-guía de texto que da valor al lector aunque no haya escuchado el episodio, y que convierte al lector en oyente.
Prompt para generar show notes:
"Aquí está el resumen/transcripción del episodio [número] de mi podcast [nombre]. El tema es [tema]. Genera unas show notes completas que incluyan: párrafo de introducción que enganche (150 palabras), lo que aprenderás en este episodio (lista de 5 puntos), los highlights más importantes del episodio con el minuto aproximado donde ocurren, recursos mencionados en el episodio (puedes dejar placeholders para que yo los rellene), y dos párrafos de cierre con invitación a suscribirse. Optimiza el texto para la keyword '[keyword principal]'. Que suene útil e interesante, no como publicidad del episodio."
Si grabas en español, el SEO de tus show notes puede ser un canal de tráfico importante. Cada episodio bien optimizado puede traer visitas orgánicas durante meses o años.
Edición de podcast con IA: la guía completa
Esta es la parte que más frena a los nuevos podcasters y donde la IA ha ahorrado más trabajo real. Con edición tradicional en Audacity, Reaper o Premiere, un episodio de 45 minutos se te puede ir a tres o cuatro horas. Con el flujo que te cuento aquí, baja a 20-40 minutos.
La clave es entender que "editar un podcast con IA" no es una sola tarea, sino seis tareas distintas, y que casi ninguna herramienta las hace todas bien. Vamos una por una.
1. Limpiar el ruido de fondo y la reverberación
Es el primer paso siempre, antes de cortar nada. Si has grabado en una habitación con eco, con el ordenador zumbando o con la calle de fondo, esto lo arregla.
Adobe Podcast (Enhance Speech) es la mejor opción gratuita y no hay debate. Subes el archivo, lo procesa en la nube y te lo devuelve sonando como si lo hubieras grabado en un estudio. El plan gratuito acepta archivos de hasta 30 minutos y 500 MB, con un límite de una hora de procesado al día. El plan Premium cuesta 9,99 $ al mes (o 99,99 $ al año) y sube el límite a 2 horas y 1 GB por archivo, cuatro horas diarias de procesado, subida por lotes, soporte de vídeo y control de intensidad del efecto.
Ese control de intensidad importa más de lo que parece: al máximo, Enhance Speech puede dejar la voz con un punto artificial, metálico. Si notas ese efecto, la solución es bajar la intensidad, no cambiar de herramienta.
Auphonic es la alternativa clásica y sigue siendo excelente para el nivelado (lo veremos en el punto 4). Tiene un plan gratuito de 2 horas de procesado al mes.
Krisp funciona en tiempo real, durante la grabación, no después. Es útil si grabas entrevistas por videollamada y quieres que el invitado llegue ya limpio.
2. Eliminar muletillas, silencios y sonidos de boca
Aquí es donde la IA marca la diferencia frente a la edición manual. Quitar a mano cada "eh", cada "o sea" y cada silencio de tres segundos es lo que convierte la edición en una tortura.
Cleanvoice está hecha exactamente para esto y es la que mejor lo hace en español. Detecta y elimina muletillas, tartamudeos, respiraciones fuertes, chasquidos de boca y silencios largos. Funciona por horas de audio procesado: el plan más pequeño son 10 horas por 11 $ al mes, 30 horas por 30 $ y 100 horas por 90 $. Tienes 30 minutos de prueba gratis sin tarjeta.
Para un podcast semanal de 45 minutos, el plan de 10 horas te sobra: son unos 13 episodios al mes.
Descript hace lo mismo desde su editor, con la ventaja de que ves exactamente qué va a borrar antes de borrarlo. Su función "Remove Filler Words" y la de acortar silencios están integradas en el flujo de edición por texto.
Aviso práctico: no pases el detector de muletillas al 100% de agresividad. Una conversación sin ninguna respiración ni pausa suena antinatural, casi robótica. Yo dejo siempre las pausas de más de un segundo que están al final de una frase, porque son las que dan ritmo.
3. Editar el audio editando el texto
Este es el cambio conceptual grande. En vez de mover formas de onda, editas una transcripción: borras un párrafo del texto y desaparece del audio.
Descript es la referencia. Transcribe automáticamente, y a partir de ahí trabajas sobre el texto. Sus planes actuales son: Free (0 $, 60 minutos de media al mes, exportación a 720p), Hobbyist (24 $/mes o 16 $/mes pagando el año), Creator (35 $/mes o 24 $/mes anual, 1.800 minutos de media y 800 créditos de IA, exportación 4K) y Business (65 $/mes o 50 $/mes anual). Para un podcaster individual, el plan Creator es el punto dulce.
Podcastle y Riverside ofrecen edición por texto parecida, con la ventaja añadida de que graban en local a cada participante por separado (pistas independientes), lo cual salva entrevistas donde a alguien se le cae la conexión.
4. Nivelar las voces y masterizar
Si tú suenas fuerte y tu invitado bajito, el oyente se pasa el episodio subiendo y bajando el volumen. Y hay un estándar concreto: las plataformas de podcast trabajan en torno a -16 LUFS para estéreo y -19 LUFS para mono. No es una opinión estética, es lo que hace que tu podcast suene al mismo volumen que los demás en la cola de reproducción de Spotify.
Auphonic es la herramienta que mejor resuelve esto y lleva años haciéndolo. Le subes las pistas, le dices el objetivo de loudness y te devuelve el episodio nivelado, con las voces equilibradas entre sí y sin picos. Su plan gratuito de 2 horas mensuales cubre un podcast quincenal.
Descript y Adobe Podcast también nivelan, pero de forma más automática y con menos control sobre el objetivo final.
5. Transcribir para tener el texto
La transcripción no es solo para el SEO (eso lo veo más abajo): es la materia prima de todo lo demás. Sin transcripción no hay edición por texto, no hay clips automáticos y no hay capítulos.
Whisper de OpenAI sigue siendo el mejor equilibrio entre precisión en español y coste. Lo explico a fondo en la guía de transcripción de audio con IA, y si quieres comparar opciones tienes el análisis de la mejor IA para transcribir audio.
Si usas Descript, Riverside o Podcastle, la transcripción ya viene incluida como subproducto de la edición.
6. Sacar clips para redes
De cada episodio salen entre tres y seis clips verticales que son el 90% de tu captación de oyentes nuevos.
Opus Clip y Riverside Magic Clips analizan la transcripción, detectan los momentos con más gancho y montan el vertical con subtítulos quemados y reencuadre automático de cara. Headliner sigue siendo la más específica para audiogramas de podcast (forma de onda + subtítulos), con un plan gratuito de 5 vídeos sin marca de agua al mes y 10 minutos de transcripción.
Comparativa: qué herramienta para qué tarea
| Herramienta | Para qué es la mejor | Plan gratuito | Precio de pago |
|---|---|---|---|
| Adobe Podcast Enhance | Limpiar ruido y eco | Sí: 30 min/archivo, 1 h al día | 9,99 $/mes o 99,99 $/año |
| Cleanvoice | Muletillas, silencios y ruidos de boca | 30 min de prueba | Desde 11 $/mes (10 h de audio) |
| Descript | Editar cortando texto | Sí: 60 min de media al mes | 16-24 $/mes (Hobbyist/Creator anual) |
| Auphonic | Nivelar voces y loudness (-16 LUFS) | Sí: 2 h al mes | Por paquetes de horas |
| Whisper (OpenAI) | Transcripción precisa en español | Sí, si lo ejecutas en local | Céntimos por hora vía API |
| Headliner | Audiogramas para redes | Sí: 5 vídeos/mes sin marca | Planes de pago según volumen |
| Opus Clip | Clips verticales automáticos | Limitado por minutos | Suscripción mensual |
| ElevenLabs | Clonar tu voz para corregir tomas | Sí, sin licencia comercial | Desde 5 $/mes (Starter) |
Precios de las webs oficiales en el momento de escribir esto y sin IVA. Verifícalos antes de contratar, porque en este sector cambian cada pocos meses.
Mi flujo de edición recomendado
- Graba sin obsesionarte con la perfección. Si te equivocas, para, respira y repite la frase entera: luego se corta en dos segundos.
- Pasa el audio bruto por Adobe Podcast Enhance (limpieza de ruido y reverb).
- Súbelo a Cleanvoice para quitar muletillas, chasquidos y silencios largos.
- Edición estructural en Descript: cortar secciones que no aportan, reordenar, meter intro y outro.
- Nivelado final en Auphonic a -16 LUFS.
- Exporta, y de la misma transcripción saca show notes, artículo y clips.
Para un episodio de 45 minutos son 20-40 minutos de trabajo real, y la mayor parte es la fase 4, que es la única que requiere criterio humano.
Inteligencia Artificial aplicada a negocio
Sin humo. Solo experimentos reales, prompts que funcionan y estrategias de escalabilidad.
Transcripción para SEO: el activo que más se subestima
La transcripción de cada episodio es oro para el SEO. Cada vez que publicas un episodio de 45 minutos, generas aproximadamente 6.000-8.000 palabras de contenido potencialmente indexable.
Si subes esas palabras a tu web como texto (en la página del episodio o en un artículo aparte), estás creando un artículo de long-form content que puede posicionar para decenas de keywords.
Cómo convertir la transcripción en contenido SEO:
"Aquí está la transcripción del episodio de mi podcast sobre [tema]: [pega transcripción]. Convierte esta transcripción en un artículo de blog bien estructurado, de entre 1.500 y 2.000 palabras. Mantén el contenido y los argumentos del audio pero mejora la estructura para lectura web: añade encabezados, organiza los puntos en listas donde tenga sentido, elimina las partes conversacionales que no funcionan por escrito, y añade una introducción y un cierre propios del formato artículo. Optimiza para la keyword '[keyword]'."
Un aviso: no publiques la transcripción en bruto y te quedes tan ancho. Una transcripción literal es texto conversacional lleno de repeticiones y sin estructura, y Google la trata como lo que es: contenido de baja calidad. El paso de reescritura no es opcional. Si quieres el detalle de cómo estructurarlo, lo cuento en la guía sobre cómo escribir un artículo de blog optimizado para SEO.
El resultado es que cada episodio te da dos piezas de contenido: el audio y el artículo. Doble distribución, doble indexación.
Crear audiogramas y clips con IA
Los audiogramas son clips de vídeo cortos (60-90 segundos) con la forma de onda del audio y la transcripción del fragmento, diseñados para compartir en redes sociales. Son la forma más efectiva de promocionar el podcast en Instagram, TikTok, LinkedIn y X.
Headliner.app es la más completa para podcasters. Importas tu episodio, seleccionas el fragmento más atractivo, y genera el audiograma automáticamente con la waveform, el texto de la transcripción y tu imagen de portada. El plan gratuito da 5 vídeos sin marca de agua al mes, suficiente para un clip semanal.
Opus Clip es hoy la opción por defecto si grabas también en vídeo: la IA elige los fragmentos, puntúa cada uno por potencial viral, recorta a vertical siguiendo la cara y quema los subtítulos.
Canva con vídeo. Para audiogramas más personalizados visualmente, puedes exportar el audio del fragmento y montarlo en Canva con diseño propio. Si te interesa el montaje más allá del audiograma, en la guía de cómo crear vídeos con IA están las herramientas que uso.
Prompt para que ChatGPT identifique los mejores momentos:
"Aquí está la transcripción de mi episodio: [pega la transcripción]. Identifica los 5 fragmentos más atractivos para convertir en clips de redes sociales. Para cada fragmento indica: el extracto textual exacto, por qué es atractivo (insights, controversia, datos sorprendentes, humor, historia potente), y para qué red social es más adecuado (LinkedIn, Instagram, TikTok, X)."
Clonar tu voz para corregir errores sin regrabar
Esta es la función que más sorprende a quien empieza. Si has dicho "en 2024" cuando querías decir "en 2026", no hace falta que vuelvas a montar el micrófono: puedes generar esas dos palabras con tu propia voz clonada y sustituirlas en la línea de tiempo.
ElevenLabs es la mejor en español con diferencia. Su plan gratuito da unos 10.000 créditos al mes (en torno a 10 minutos de audio) pero sin licencia de uso comercial, así que para un podcast necesitas el plan Starter de 5 $ al mes, que ya incluye licencia comercial y clonación instantánea de voz a partir de un minuto de muestra. El plan Creator, 22 $ al mes, añade la clonación profesional, que entrena con más material y se nota bastante en las frases largas.
Descript tiene su propia función de voz clonada integrada en el editor, lo que evita el paso de exportar e importar.
Mi criterio: úsalo para arreglar palabras sueltas, cifras mal dichas y nombres propios. Para párrafos enteros se nota, y sobre todo, si acabas grabando episodios completos con voz sintética estás renunciando justo a lo que hace que un podcast funcione. Tienes el detalle técnico en la guía sobre cómo clonar tu voz con IA.
Música generada con IA: Suno y otras opciones
La música de intro y outro de tu podcast necesita ser original o con licencia libre de royalties. La IA resuelve esto, pero con una letra pequeña que conviene leer.
Suno es la herramienta más avanzada para generar música con IA. Describe el estilo que quieres y genera canciones completas con letra o instrumentales. Para un podcast querrás algo instrumental con el mood correcto.
Ejemplo de prompt para Suno: "Instrumental podcast intro music, professional and energetic, corporate but not boring, 30 seconds, modern electronic with piano, crescendo at the end."
Ojo con esto: el plan gratuito de Suno (créditos diarios) no incluye derechos de uso comercial. Si vas a monetizar el podcast, aunque sea con un patrocinio pequeño, necesitas el plan Pro (10 $/mes, u 8 $/mes pagando el año) o Premier (30 $/mes, 24 $ anual). Es un error caro y muy común: gente que monta su intro con el plan gratuito y descubre el problema cuando entra el primer patrocinador.
Uppbeat no es IA, pero tiene miles de tracks libres de royalties clasificados por género y mood. Si no quieres generar tu propia música, es la opción más rápida y la licencia está clara desde el minuto uno.
En la comparativa de las mejores IA para hacer música entro en el detalle de cada plataforma y de sus condiciones de licencia.
Consideración legal importante: usar fragmentos de canciones conocidas —aunque los generes "en estilo de"— puede ser problemático legalmente. Y si el podcast es una actividad económica, recuerda que en España los ingresos por patrocinio llevan su IVA y su modelo 303 como cualquier otro servicio.
Portada del podcast con IA
La portada es lo primero que ve la gente cuando encuentra tu podcast en Spotify o Apple Podcasts. Tiene que ser clara y profesional.
Las plataformas de podcast requieren una imagen cuadrada (mínimo 1400x1400 píxeles, máximo 3000x3000) en formato JPG o PNG.
Para la imagen de fondo: genera el elemento visual principal con cualquiera de las mejores IA para crear imágenes. Un buen prompt podría ser: "Minimalist podcast cover art for a business podcast about [tema], professional design, [colores principales], clean composition, would look good as a small thumbnail, no text, high quality."
Para el texto y diseño final: Canva es lo más rápido. Importas la imagen generada por IA como fondo y añades el nombre del podcast, tu nombre y cualquier elemento de diseño adicional.
La portada debe leerse bien en thumbnail pequeño (como en el móvil en una lista de podcasts). Prueba tu diseño en una imagen de 200x200 píxeles para verificar que el texto sigue siendo legible.
Distribución: dónde publicar el podcast
No necesitas publicar manualmente en cada plataforma. Un hosting de podcast distribuye automáticamente a todas mediante tu feed RSS.
Buzzsprout. El más amigable para principiantes. Plan gratuito con 2 horas de audio al mes, con la letra pequeña de que los episodios se borran a los 90 días —sirve para validar, no para construir un archivo. Los planes de pago van desde 19 $/mes (4 horas de subida) hasta 79 $/mes (35 horas).
Spotify for Creators. Completamente gratuito y sin límite de horas. Es lo que antes se llamaba Anchor: pasó a llamarse Spotify for Podcasters en 2023 y desde noviembre de 2024 es Spotify for Creators. Si tu objetivo principal es Spotify, es la opción más directa.
Transistor.fm. Más profesional, para podcasters que tienen múltiples shows o equipo. Analíticas más completas.
Castos. Opción europea con servidores en Europa. Interesante si la privacidad de datos de tus oyentes es importante para ti.
Dato que ha cambiado y conviene tener claro: Google Podcasts ya no existe. Google lo cerró en 2024 y migró los suscriptores a YouTube Music, así que hoy los destinos que importan son Spotify, Apple Podcasts, YouTube (Music y el propio YouTube), Amazon Music e iVoox, que en España sigue teniendo una comunidad muy fiel.
Monetización del podcast
Un podcast puede monetizarse de varias formas, y la más adecuada depende de tu audiencia y de tu modelo de negocio.
Patrocinios. La forma más común. Las marcas pagan para aparecer en tu podcast (mención al principio, en la mitad o al final del episodio). Para conseguir patrocinadores necesitas entre 1.000 y 5.000 descargas por episodio en España, dependiendo del nicho. Plataformas como Podcorn o AdvertiseCast conectan podcasters con marcas.
Contenido premium o membresía. Episodios extra, sin publicidad o con acceso anticipado para los suscriptores de pago. Plataformas como Patreon, Buy Me a Coffee o Supercast permiten monetizar directamente la audiencia.
Venta de productos propios. Si tienes cursos, consultoría, un libro o cualquier producto, el podcast es un canal de ventas muy efectivo. La audiencia que escucha un podcast tiene un nivel de confianza en el creador muy alto. Un solo episodio bien orientado puede generar ventas directas.
Formación o consultoría a partir del podcast. Muchos podcasters usan el show como portfolio de expertise. Cada episodio demuestra conocimiento y genera leads para su actividad de consultoría o formación.
Sea cual sea la vía, hay una parte administrativa que no desaparece: en España esos ingresos se facturan con IVA, van a tu modelo 303 trimestral y, si un mismo patrocinador te paga más de 3.005,06 euros en el año, entran en el modelo 347.
IA para crear contenido de pago:
"Tengo un podcast sobre [tema] con [X] oyentes por episodio. Genera 5 ideas de productos o servicios de pago que podría crear como extensión del podcast, ordenadas por facilidad de implementación y potencial de ingresos."

El stack de herramientas que yo recomendaría para empezar
Para alguien que empieza desde cero con presupuesto ajustado:
Grabación: micrófono USB (Rode NT-USB Mini o Blue Yeti, ambos por debajo de 150 euros). Grabación directa en Descript, en Riverside o en Audacity (gratuito).
Edición: Adobe Podcast Enhance (gratuito) para limpieza + Descript (plan gratuito para empezar). Cuando el volumen crezca, Cleanvoice.
Nivelado: Auphonic (2 horas gratis al mes).
Música: Suno para generar la intro —plan de pago si vas a monetizar— o Uppbeat para tracks libres de royalties.
Portada: una IA de imagen + Canva.
Hosting: Spotify for Creators (gratis e ilimitado) o Buzzsprout.
Show notes y transcripción: ChatGPT sobre la transcripción de Whisper.
Clips: Headliner (plan gratuito) u Opus Clip.
Coste total para empezar: el micrófono (inversión única de 100-150 euros) y los planes gratuitos de todo lo demás. Cuando el podcast crezca y empiece a generar ingresos, escalas los planes.
Preguntas frecuentes
¿Cuánto cuesta montar un podcast con IA?
Puedes empezar con 0 euros al mes en software si te apañas con los planes gratuitos de Adobe Podcast Enhance, Auphonic, Headliner y Spotify for Creators. El único gasto real inicial es el micrófono: entre 100 y 150 euros por un Rode NT-USB Mini o un Blue Yeti. Un stack profesional completo (Descript Creator, Cleanvoice y ElevenLabs Starter) ronda los 40-50 dólares al mes.
¿Se puede hacer un podcast entero sin grabar mi voz?
Técnicamente sí: con ElevenLabs o herramientas similares generas el episodio completo a partir de un guion, y NotebookLM incluso convierte documentos en conversaciones de audio. Pero mi opinión es que es mala idea como estrategia principal: el podcast funciona precisamente porque genera confianza a través de una voz humana con dudas, pausas y matices. La voz sintética sirve para corregir errores puntuales, para versiones en otros idiomas o para contenido informativo, no para construir audiencia.
¿Qué herramienta edita mejor un podcast con IA?
Depende de la tarea. Para limpiar ruido, Adobe Podcast Enhance (gratis). Para quitar muletillas y silencios, Cleanvoice (desde 11 $/mes por 10 horas de audio). Para editar cortando texto en vez de forma de onda, Descript (16-24 $/mes en plan anual). Para nivelar el volumen a -16 LUFS, Auphonic. Ninguna las hace las cuatro cosas de forma sobresaliente, por eso el flujo real combina dos o tres.
¿La IA puede clonar mi voz para corregir errores del episodio?
Sí, y es de lo más útil que hay. ElevenLabs clona tu voz con un minuto de muestra y te deja generar las palabras exactas que quieres sustituir; Descript tiene la función integrada en su editor. Para uso comercial necesitas al menos el plan Starter de ElevenLabs (5 $/mes), porque el gratuito no incluye licencia comercial. Funciona muy bien en palabras sueltas y cifras, y se empieza a notar en párrafos largos.
¿Cómo paso el podcast a texto para SEO?
Transcribe con Whisper de OpenAI, que es lo más preciso en español por lo que cuesta, o aprovecha la transcripción que ya generan Descript, Riverside y Podcastle. El paso importante es el siguiente: no publiques la transcripción literal, porque es texto conversacional que Google interpreta como contenido de baja calidad. Pásala por ChatGPT para reescribirla como artículo estructurado de 1.500-2.000 palabras con encabezados.
¿Spotify o Apple penalizan el contenido generado con IA?
Spotify no prohíbe el contenido hecho con IA, pero desde mayo de 2026 sí elimina los podcasts que suplantan la voz o la imagen de otra persona sin permiso, y ha extendido las insignias "Verified by Spotify" a los podcasts para que el oyente distinga a los creadores reales. Apple Podcasts tampoco prohíbe la IA, pero rechaza contenido duplicado o de baja calidad. Resumen: usar IA para producir no penaliza; clonar voces ajenas o publicar audio generado en masa sí.
¿Cuánto tiempo se tarda en editar un episodio con IA?
Con el flujo de Adobe Podcast Enhance + Cleanvoice + Descript + Auphonic, un episodio de 45 minutos se edita en 20-40 minutos. La mayor parte de ese tiempo es la edición estructural (decidir qué se queda y qué se corta), que es la única fase que requiere criterio humano. Las fases de limpieza, muletillas y nivelado son automáticas y se ejecutan mientras haces otra cosa.
¿Hay alguna IA gratis para editar podcast en español?
Sí. Adobe Podcast Enhance limpia ruido y reverberación gratis (hasta 30 minutos por archivo y una hora al día), Auphonic nivela 2 horas al mes gratis, Whisper transcribe gratis si lo ejecutas en local y Headliner monta 5 clips al mes sin marca de agua. Combinándolas produces un episodio semanal decente sin pagar nada. Lo que no encontrarás gratis es la eliminación masiva de muletillas: Cleanvoice solo da 30 minutos de prueba.
¿Qué necesito para publicar el podcast en Spotify y Apple?
Un archivo de audio (MP3 a 128 kbps mono o 192 kbps estéreo va bien), una portada cuadrada de entre 1400x1400 y 3000x3000 píxeles, una descripción del programa y un hosting que genere el feed RSS. Con Spotify for Creators (gratis) o Buzzsprout subes el episodio y ellos distribuyen a todas las plataformas. La aprobación en Apple Podcasts suele tardar entre unas horas y unos días la primera vez.
¿Merece la pena grabar el podcast también en vídeo?
Si tu objetivo es crecer, sí. YouTube es hoy una de las principales plataformas de descubrimiento de podcasts, y grabar en vídeo te da material para los clips verticales, que es de donde viene la mayoría de oyentes nuevos. No necesitas producción: una webcam decente o el móvil bien colocado, luz natural de frente y grabación en Riverside, que guarda las pistas de cada participante por separado.
¿En qué consiste la edición de podcast con IA?
En encadenar seis tareas que antes se hacían a mano: limpiar el ruido de fondo y la reverberación, eliminar muletillas y silencios largos, cortar y reordenar el contenido, nivelar el volumen a -16 LUFS, transcribir el audio y sacar los clips para redes. Cada una tiene su herramienta y ninguna las hace todas bien, así que la edición con IA es en realidad un flujo de dos o tres programas encadenados, no un botón mágico.
¿Se puede crear un podcast con IA siendo principiante y sin equipo?
Sí, y es el escenario para el que mejor funciona. Necesitas un micrófono de 100-150 euros, y el resto lo cubren los planes gratuitos: Adobe Podcast Enhance limpia el audio, Auphonic nivela dos horas al mes, Whisper transcribe en local y Spotify for Creators distribuye. Lo que la IA no sustituye es tener algo que decir y un guion decente, que es donde de verdad se decide si el podcast funciona.
El podcast es el formato que más fidelidad genera en la audiencia. Si alguien te escucha regularmente durante 30-45 minutos cada semana, desarrolla una relación contigo que ninguna otra red social puede igualar. La IA no te da esa conexión humana —tú la das— pero sí te quita las barreras técnicas que impedían que empezaras.






