
Cada mes hay miles de personas en España escribiendo en Google alguna variante de lo mismo: "chatgpt sin censura", "ia sin restricciones morales", "cuál es la ia con menos límites". Y cada mes se encuentran con lo mismo: foros de 2023, vídeos con miniaturas en rojo y listas de prompts copiadas mil veces que, si los pruebas, no hacen absolutamente nada.
No es que estés haciéndolo mal. Es que el problema cambió de sitio. En 2023 el filtro vivía dentro del modelo, y convencerlo con un juego de rol bastaba. En agosto de 2026 el filtro es un sistema aparte que ni siquiera participa en la conversación: lee lo que escribes antes de que llegue al modelo, lee lo que el modelo responde antes de que llegue a ti, y desde mayo también mira lo que pasó en tus conversaciones anteriores. Puedes convencer al modelo y que la respuesta se corte igual, porque quien la corta no es el modelo.
La respuesta corta: ChatGPT sin censura no existe y no va a existir. No hay versión oculta, ni modo desarrollador, ni prompt mágico. Lo que sí existe —y casi nadie cuenta— es un margen de configuración legítimo y amplio: puedes quitarle el tono moralizante, los avisos legales repetitivos y las advertencias que no pediste; puedes usar la API con tu propio prompt de sistema en lugar de la app; y puedes pedir un registro adulto y directo. Eso cubre la mayoría de los casos en que se busca "sin censura", porque lo que molesta casi nunca es el límite duro: es el sermón.
Por qué los jailbreaks murieron: la arquitectura cambió
El error de fondo de casi todo lo que se lee sobre esto es tratar a ChatGPT como si fuera un modelo. No lo es. Es un producto con varias piezas, y el modelo es solo una.
El filtro revisa la entrada Y la salida
Tu mensaje no va directo al modelo. Pasa antes por clasificadores: modelos pequeños y rápidos, entrenados solo para etiquetar contenido, que puntúan tu texto en varias categorías de riesgo. Si la puntuación pasa cierto umbral, la petición se bloquea o se degrada antes de que el modelo principal la haya leído siquiera.
Y aquí está la clave que inutiliza los jailbreaks clásicos: el mismo proceso se repite al revés. La respuesta vuelve a pasar por clasificadores antes de mostrarse en tu pantalla. Por eso ves ese comportamiento tan característico de una respuesta que empieza a escribirse, avanza dos frases y desaparece sustituida por un error. Eso no es el modelo arrepintiéndose: es un sistema externo que ha leído la salida y la ha tumbado.
La consecuencia es demoledora para cualquier técnica de persuasión. Aunque el modelo "acepte" el juego de rol, la conversación se corta igual, porque el filtro de salida no ha jugado a nada. No sabe que hay un personaje. Solo ve texto.
El enrutador de seguridad y la memoria entre conversaciones
En mayo de 2026 OpenAI añadió otra capa: un modelo dedicado exclusivamente a razonar sobre seguridad, que analiza la conversación y genera notas de contexto. Con eso, ChatGPT detecta que una petición inocente por sí sola significa otra cosa a la luz de los diez mensajes anteriores.
Lo relevante es que ese seguimiento no se limita al chat abierto: cruza señales entre sesiones. La táctica de toda la vida —ir calentando el terreno, o abrir un chat nuevo para "resetear"— funciona mucho peor cuando existe un resumen de seguridad que sobrevive a la conversación. OpenAI publicó mejoras del 52 % en respuestas seguras ante daño a terceros y del 39 % en casos de autolesión sobre GPT-5.5 Instant; son datos de la propia empresa, pero la dirección del cambio se verifica usando el producto.
Conviene conocer también la crítica: análisis independientes señalan que ese enrutador se dispara con más frecuencia de lo que sugieren las explicaciones públicas, y no solo ante angustia aguda, sino ante casi cualquier mensaje con carga emocional o con un personaje de por medio. Si has notado que ChatGPT se vuelve plano en mitad de una conversación creativa, probablemente lo hayas visto en acción.
Por qué "DAN" y "modo desarrollador" ya no funcionan
Los prompts tipo DAN eran un truco de reencuadre: convencer al modelo de que interpretaba a otra entidad sin reglas. Funcionaban porque en 2023 la seguridad era casi toda alineamiento del modelo, y el alineamiento se negociaba con la ficción. Tres cosas los mataron: los clasificadores externos, que no negocian porque no conversan; la viralidad, porque cuando decenas de miles de personas pegan el mismo texto ese texto se convierte en un patrón reconocible al instante; y la rotación de modelos, que rompe cada mes lo que funcionaba.
El "modo desarrollador" merece mención aparte porque es directamente un mito. No existe ningún modo desarrollador en ChatGPT. Existe la API, que es otra cosa, pero no hay interruptor oculto en la app. Si alguien te vende acceso a uno, te vende humo o algo peor.

Qué arriesgas realmente en tu cuenta
Esto se suele despachar con un "podrían banearte". El riesgo real es intermedio: ni inofensivo ni expulsión por preguntar algo raro una vez.
Las políticas de uso vigentes de OpenAI, reescritas el 29 de octubre de 2025 para unificar todos sus productos, incluyen entre las conductas prohibidas dos que aplican de lleno: intentar eludir las salvaguardas del sistema y realizar pruebas de seguridad no solicitadas sobre él. El intento de saltarse los filtros es en sí mismo una infracción, con independencia de para qué querías el resultado.
El escalado funciona por fases. Primero un aviso a la cuenta: no es una suspensión, es una advertencia formal para que corrijas el uso. Si el patrón continúa, llegan restricciones. Y la reincidencia puede acabar en desactivación permanente. Los términos, además, se reservan el derecho de pausar el acceso sin preaviso. Existe procedimiento de apelación, pero conviene no confiar en él: los relatos de apelaciones resueltas sin explicación abundan en los foros de la propia OpenAI.
Mi lectura, después de ver cómo gestionan esto las plataformas grandes: la probabilidad de que te cierren la cuenta por curiosear una tarde es baja; la de que lo hagan si eso se convierte en tu uso habitual, real. Y si tienes la cuenta ligada al trabajo —proyectos, GPTs, historial de meses—, el coste de perderla no es el precio de la suscripción. Además, nada de esto ocurre en privado: las conversaciones de la app se conservan y se pueden revisar por abuso.
Lo que sí puedes conseguir de forma legítima
Aquí es donde la búsqueda "sin censura" casi siempre se equivoca de objetivo. La mayoría no quiere contenido prohibido: quiere que ChatGPT deje de darle lecciones, deje de repetir que consulte a un profesional y deje de suavizarlo todo. Eso sí se cambia, y está documentado.
Las instrucciones personalizadas quitan el sermón
El documento que define el comportamiento de los modelos de OpenAI —el Model Spec, cuya versión pública vigente es la del 18 de diciembre de 2025— organiza las reglas en una jerarquía de mando: raíz, sistema, desarrollador, usuario y directrices. Las de raíz son inmutables. Pero las directrices son valores por defecto pensados explícitamente para que el usuario los sobrescriba: tono, longitud, formalidad, cortesía al rechazar, tendencia a moralizar y avisos de cautela entran ahí.
Traducido: cuando ChatGPT te suelta un párrafo pidiéndote que acudas a un especialista, casi nunca está aplicando un límite de seguridad. Está aplicando un valor por defecto que puedes desactivar en Configuración → Personalización, donde tienes instrucciones personalizadas en texto libre, ocho perfiles de personalidad y tres deslizadores de tono.
Lo que funciona en ese campo es concreto: pedir que no añada advertencias no solicitadas, que no repita recomendaciones de consultar a un profesional cuando ya has dicho que lo sabes, que vaya al grano, que asuma un nivel de conocimiento alto y que no suavice conclusiones incómodas. Son ajustes de estilo, están permitidos y cambian mucho la experiencia. Si nunca has trabajado a fondo la redacción, en qué es un prompt y cómo escribirlo bien tienes la base: las instrucciones personalizadas son eso, aplicado a todas tus conversaciones a la vez. Lo que no funciona es colar por ahí instrucciones de contenido: una instrucción de usuario no derrota a una regla de sistema, y el intento queda registrado.
La API es otro producto, y eso importa
En la app hay un prompt de sistema que tú no escribes ni ves: lo pone OpenAI y define buena parte de la personalidad y las cautelas. En la API ese hueco lo ocupas tú, con el mensaje de desarrollador, que en la jerarquía del Model Spec está por encima del usuario.
Conviene ser exacto, porque circula mucha exageración: la API no está menos censurada en el nivel duro. Aplican las mismas políticas, hay moderación y las prohibiciones absolutas siguen ahí. Lo que desaparece es la capa de producto: el tono de asistente generalista prudente diseñado para mil millones de usuarios semanales, menores incluidos. Para un uso profesional concreto —un asistente clínico interno, un motor de redacción con voz propia— esa diferencia es enorme.
Añade dos ventajas. Control fino: parámetros de generación y elección de modelo dentro de la familia GPT-5.6 (Sol para lo difícil, Terra intermedio, Luna para volumen y latencia baja). Y tratamiento de datos: los envíos por API no se usan para entrenar modelos, la retención por defecto es de 30 días para detección de abuso, y hay retención cero para clientes empresariales que la solicitan y cumplen requisitos.
Declarar el contexto
Queda un tercer margen, poco glamuroso y muy efectivo: un modelo que no sabe quién eres ni para qué es el texto aplica el ajuste más conservador posible, porque es lo razonable. Decir que eres profesional del sector, que el destinatario es adulto, que la pieza es una novela y no un manual, o que necesitas el vocabulario técnico correcto y no el eufemismo, cambia la respuesta sin tocar ningún filtro. No es un truco: es información que el sistema no tiene y que debe tener en cuenta.

¿Te preocupa el futuro con la IA?
Descubre cómo la inteligencia artificial ha liquidado las viejas reglas del juego y qué puedes hacer tú al respecto.
Leer más sobre el libroDónde está la frontera de verdad
La pregunta útil no es "¿ChatGPT censura?", sino "¿esto es un hábito del modelo o hay un muro detrás?". Distinguirlo ahorra horas.
Desde GPT-5, OpenAI cambió el entrenamiento de seguridad del rechazo duro a lo que llama safe completions: en lugar de clasificar tu intención como buena o mala y negarse en bloque, el sistema intenta maximizar la utilidad de la respuesta dentro de los límites de la política. La negativa que recibes hoy es más informativa que hace dos años: si te ofrece una alternativa, hay margen; si es una frase seca que cierra, no lo hay.
| Situación | Qué es realmente | Qué hacer |
|---|---|---|
| Advertencias y "consulta a un profesional" | Directriz por defecto | Instrucciones personalizadas |
| Tono blando, suaviza conclusiones | Estilo por defecto | Personalidad y deslizadores de tono |
| Se niega y ofrece otro enfoque | Política con margen | Reformular con contexto y finalidad reales |
| Se niega en seco y repite | Límite firme de política | Cambiar de herramienta o de enfoque |
| La respuesta se escribe y desaparece | Clasificador de salida | No hay ajuste posible por tu parte |
| Se vuelve plano en un tema delicado | Enrutador de seguridad | Cambiar de tema o de plataforma |
| Rechazo instantáneo en categoría crítica | Regla de raíz, inmutable | Nada. Y no insistas |
El caso más malinterpretado es el del consejo profesional. En octubre de 2025 corrió que ChatGPT había dejado de dar consejo médico y legal. Es falso: lo que hizo OpenAI fue reescribir la redacción de una norma que ya existía. Lo prohibido es el asesoramiento personalizado que requiere licencia, como el legal o el médico, sin participación adecuada de un profesional colegiado. ChatGPT sigue explicando conceptos médicos, analizando informes y redactando borradores de contratos. La barrera está en sustituir a un profesional, no en informar.
En el otro extremo hay reglas raíz —contenido sexual con menores, síntesis de armas de destrucción masiva, unas pocas más— que no se mueven con nada: ni con la API, ni con un mensaje de desarrollador, ni con acuerdos empresariales. Ahí no hay frontera que explorar; hay un muro, y está bien que lo haya.
Qué usar según lo que de verdad querías hacer
Cinco escenarios, cinco recomendaciones distintas, porque "sin censura" significa cinco cosas según quién lo busque.
Ficción adulta o rol sin cortes. Es el caso mayoritario y el que peor encaja en ChatGPT. Conviene saber cómo acabó la historia del famoso "modo adulto": Sam Altman lo anunció en octubre de 2025 para diciembre, se retrasó a principios de 2026, volvió a retrasarse en marzo y quedó aparcado sin fecha. Lo único que sí se desplegó fue la otra mitad del plan, el sistema de estimación de edad, activo desde enero de 2026. Llegó el control y no llegó la apertura. Para esto la vía razonable son modelos ejecutados en tu propio equipo o plataformas pensadas para ello; tengo el catálogo completo, con lo que funciona y lo que es un timo, en las mejores IA sin censura de 2026.
Investigación de temas incómodos. Terrorismo, extremismo, drogas, criminología, historia militar, salud mental. Aquí el problema casi nunca es la política: es que el sistema no sabe que eres investigador y aplica el ajuste conservador. Lo que funciona es declarar contexto y finalidad, usar la API con un mensaje de desarrollador que lo fije de entrada, y apoyarse en herramientas de búsqueda con fuentes citadas en vez de pedir al modelo que lo genere de memoria. Si aun así choca, Mistral y los modelos chinos son bastante menos remilgados con las zonas grises occidentales, cada uno con su propia lista de temas vetados.
Consultas médicas directas. El escenario que más veo en mi trabajo. Dirijo el marketing de una red de más de setenta clínicas dentales y la queja es siempre la misma: preguntas algo concreto y recibes tres párrafos de cautelas. Para uso personal, las instrucciones personalizadas eliminan casi todo ese ruido. Para uso profesional, la API con un mensaje de desarrollador que establezca el contexto clínico y el interlocutor sanitario cambia el producto por completo. OpenAI ha lanzado además ChatGPT Health, disponible desde el 23 de julio de 2026 para usuarios estadounidenses mayores de edad, con conexión a historiales médicos y conversaciones que no se usan para entrenar los modelos base; en España todavía no está.
Pentesting y seguridad ofensiva. Aquí existe una puerta oficial que casi nadie conoce. OpenAI mantiene el programa Trusted Access for Cyber para profesionales y empresas verificadas, con acceso a modelos que aplican menos rechazos de clasificador en trabajo legítimo de doble uso: identificación y triaje de vulnerabilidades, análisis de malware, ingeniería inversa de binarios, ingeniería de detección y validación de parches. Incluye una variante específica, GPT-5.5-Cyber, para flujos más sensibles con aprobación adicional, y exige seguridad de cuenta avanzada desde el 1 de junio de 2026. Los límites siguen firmes en robo de credenciales, persistencia, despliegue de malware y explotación de sistemas de terceros, y no puedes autorizar pruebas sobre sistemas que no sean tuyos. Si tu trabajo es este, el camino es solicitar el acceso, no pelearte con el chat.
Datos confidenciales. Esto no es censura y se confunde constantemente. Que no quieras que tus datos salgan de tu organización no tiene nada que ver con los filtros de contenido. Las opciones son planes de empresa con compromisos de tratamiento, API con retención de 30 días o retención cero si cumples requisitos, o modelos en infraestructura propia. Y un aviso desde la experiencia de haber trabajado dentro del software que usan miles de asesorías: meter datos personales de clientes o pacientes en una cuenta personal de un chatbot es un problema de protección de datos con nombre y apellidos, por muy bien que responda el modelo.
Comparativa de restricciones: agosto de 2026
Esta tabla no mide "cuánto censura cada uno", que es una pregunta mal planteada. Mide dónde aprieta cada plataforma, dónde afloja y qué puedes ajustar tú de verdad.
| Plataforma | Dónde aprieta más | Dónde afloja | Ajuste real disponible |
|---|---|---|---|
| ChatGPT | Contenido adulto, autolesión, consejo profesional personalizado | Zonas grises técnicas y creativas con contexto declarado | Instrucciones personalizadas; mensaje de desarrollador vía API; acceso verificado para ciberseguridad |
| Claude | Conservador y consistente; rechaza de más en peticiones legítimas | Análisis largo y matizado de temas delicados | Prompt de sistema propio vía API |
| Gemini | La app de consumo es de las más estrictas | Poco margen en la app | En la API y Vertex AI sí: umbrales de filtro configurables por categoría |
| Grok | Menores, deepfakes de personas reales, pornografía explícita | El más permisivo en lenguaje y contenido adulto estilizado | Modo picante en su app de imagen, con verificación de edad y suscripción de pago |
| Mistral | Ilegalidad clara | Rechazos bajos en zonas grises; respuestas directas y sin adorno | Shieldstral 1.0, clasificador abierto al que describes tu política en lenguaje natural |
| DeepSeek | Temas políticos sensibles para China: se han medido tasas de rechazo o desvío en torno al 85 % | Bastante permisivo en lo que incomoda en Occidente | Pesos abiertos servibles desde Europa, aunque el sesgo persiste |
| Qwen | Las mismas líneas rojas políticas | Chat gratuito completo y poco moralizante | Versiones abiertas con licencia permisiva, ejecutables por tu cuenta |
Dos conclusiones. La primera: no hay una IA menos censurada, hay censuras distintas. DeepSeek y Qwen responderán cosas que ChatGPT no, y se cerrarán en banda con cosas que ChatGPT contesta sin pestañear; si vas a usarlas conviene entender de dónde vienen, y para eso escribí el análisis de DeepSeek y la IA china. La segunda, la más rentable: la palanca más potente de la tabla no es cambiar de marca, es pasar de la app a la API, porque ahí es donde se escribe el prompt de sistema. Si decides entre las tres grandes por criterios más amplios, tengo la comparativa en ChatGPT contra Claude contra Gemini.

"IA sin restricciones legales" no es una categoría que exista
Aparece mucho en las búsquedas y merece respuesta directa: ninguna IA te exime de la ley. Si un contenido es ilegal en España, lo es igual generado por una máquina. Y la normativa europea va en dirección contraria a la de "menos restricciones": desde el 2 de agosto de 2026 están en aplicación las obligaciones de transparencia del artículo 50 del Reglamento Europeo de IA, que exigen, entre otras cosas, informar de que un contenido ha sido generado o manipulado artificialmente. Aunque encuentres el modelo más permisivo del mundo, lo que publiques con él sigue teniendo reglas. Lo desgloso en la guía del AI Act europeo.
No es un sermón, es cálculo de riesgo: la búsqueda de "sin restricciones legales" suele terminar en herramientas oscuras, de origen desconocido, que se pagan en cripto y registran todo lo que escribes. El resultado habitual no es libertad, es entregar tus datos más comprometedores a alguien que no responde ante nadie.
Lo que hago yo
Uso ChatGPT a diario con instrucciones personalizadas agresivas en tono: sin preámbulos, sin advertencias no solicitadas, sin repetirme que consulte a un profesional cuando ya he dicho que decido yo, y con permiso explícito para llevarme la contraria. Con eso desaparece casi todo lo que la gente llama censura y que en realidad era pesadez de producto. Lo que necesita otro registro va por API con su propio mensaje de desarrollador. Y lo que ninguna de las dos cosas resuelve, no lo hago con ChatGPT.
Última idea. Si tu motivo para buscar "ChatGPT sin censura" era que el plan gratuito te parecía limitado, ese diagnóstico ya no encaja: desde el 6 de agosto de 2026 el plan gratuito tiene chat de texto ilimitado con GPT-5.6 Luna y botón de razonamiento, y las diferencias con el de pago están en imágenes, archivos y modelos, no en los filtros. Los filtros son idénticos pagues o no. Tienes el desglose en qué es gratis y qué es de pago en ChatGPT.
Preguntas frecuentes
¿Existe alguna forma de quitar la censura de ChatGPT en 2026?
No. Los filtros son clasificadores externos que revisan tu mensaje antes de que llegue al modelo y la respuesta antes de que llegue a ti, así que no dependen de convencer al modelo. Lo único ajustable de forma legítima es el tono, los avisos y el formato, con instrucciones personalizadas o con un prompt de sistema propio en la API.
¿Los prompts DAN o el modo desarrollador siguen funcionando?
No. Los prompts tipo DAN dejaron de funcionar en el modelo por defecto porque se volvieron patrones reconocibles y porque el filtrado se movió fuera del modelo. Y el "modo desarrollador" nunca ha existido en ChatGPT: es un mito de 2023. Lo más parecido es la API, un producto distinto con las mismas políticas de fondo.
¿Me pueden banear por intentar saltarme los filtros de ChatGPT?
Sí. Las políticas de uso vigentes desde octubre de 2025 prohíben expresamente eludir las salvaguardas. El escalado habitual es aviso, luego restricciones y, en caso de reincidencia, desactivación permanente. Hay procedimiento de apelación, pero es lento y sin garantías.
¿La API de OpenAI tiene menos censura que la app?
Tiene menos capa de producto, no menos política. En la API escribes tú el mensaje de desarrollador, que pesa más que el del usuario en la jerarquía de OpenAI, y eso quita el tono conservador de la app. Las prohibiciones absolutas y la moderación se aplican igual.
¿Qué IA tiene menos restricciones en agosto de 2026?
Depende del tema. Grok es la más permisiva en contenido adulto y lenguaje, con verificación de edad y suscripción de pago. Mistral tiene rechazos bajos en zonas grises. DeepSeek y Qwen son laxos con lo que incomoda en Occidente pero bloquean con dureza los temas políticos sensibles para China. No hay ganador absoluto.
¿Sigue ChatGPT dando información médica y legal?
Sí. La idea de que dejó de hacerlo en octubre de 2025 es un malentendido: se reescribió la redacción de una norma que ya existía. Lo prohibido es el asesoramiento personalizado que requiere licencia sin participación de un profesional colegiado, no explicar conceptos, analizar informes o redactar borradores.
¿Qué pasó con el modo adulto de ChatGPT?
Se anunció en octubre de 2025 para diciembre, se retrasó a comienzos de 2026 y quedó aparcado sin fecha durante la primavera. A agosto de 2026 no se ha lanzado. Sí está activo desde enero de 2026 el sistema de estimación de edad que restringe la experiencia de los menores.
¿Y si necesito una IA sin filtros para trabajo de ciberseguridad?
Existe una vía oficial: el programa Trusted Access for Cyber de OpenAI, para profesionales y empresas verificadas, que reduce los rechazos de clasificador en tareas legítimas de doble uso como el análisis de malware o el triaje de vulnerabilidades. Requiere verificación de identidad y seguridad de cuenta reforzada, y sigue prohibiendo actuar sobre sistemas que no sean tuyos.
¿Los modelos que ejecuto en mi ordenador no tienen ningún filtro?
Tienen menos capas, no ninguna. Desaparecen los clasificadores externos y el prompt de sistema de la plataforma, pero el alineamiento aprendido durante el entrenamiento sigue dentro del modelo, y en los modelos chinos se ha comprobado que el sesgo político persiste incluso ejecutándolos en local.
Inteligencia Artificial aplicada a negocio
Sin humo. Solo experimentos reales, prompts que funcionan y estrategias de escalabilidad.






