OpenAI marca el texto de su API, pero apagado por defecto
OpenAI permite activar el marcado de agua en su API, pero llega desactivado. Analizamos qué implica para pymes y equipos de IT.

OpenAI ha dado un paso más en su estrategia de procedencia de contenidos con la llegada del marcado de agua al texto generado por su API. La compañía ha presentado textGrain, un sistema que introduce una señal estadística en el texto generado influyendo sutilmente en la elección de palabras del modelo. La clave para las empresas es que, a diferencia de Anthropic, OpenAI mantiene esta función desactivada por defecto en la API: son los clientes quienes deciden si la activan.
Qué es textGrain y cómo funciona
El funcionamiento de textGrain se basa en un principio sencillo pero ingenioso: cuando un modelo genera texto, a menudo tiene varias palabras igualmente válidas para continuar una frase. El sistema favorece ligeramente unas sobre otras, creando un patrón estadístico que solo un detector específico puede identificar. Cuanto más largo es el pasaje, más evidente resulta esa huella.
OpenAI afirma que textGrain igualó o superó el rendimiento de detección de SynthID, la tecnología de Google, en sus pruebas. Además, planea liberar el código como open source para que otros puedan mejorarlo. La compañía también ha señalado que los clientes de API de todo el mundo pueden activarlo en modelos compatibles desde ya, y que en las próximas semanas comenzará a marcar automáticamente texto elegible de ChatGPT y Codex en la Unión Europea, en respuesta a los nuevos requisitos de transparencia del Reglamento Europeo de IA.
Diferencias con Anthropic: control para el cliente
La decisión de OpenAI contrasta con la de Anthropic, que anunció en agosto que aplicaría el marcado de agua globalmente a los modelos Claude compatibles, sin opción de desactivación para los desarrolladores de su API. Anthropic argumentó que no disponía de un método fiable para limitar la tecnología por región, y que el marcado se aplica a nivel de modelo, por lo que está presente en cualquier producto Claude.
OpenAI, en cambio, permite activar textGrain a nivel de proyecto u organización, y elegir qué modelos compatibles lo utilizan. Una vez activado, no requiere cambios en las peticiones individuales a la API. Esta flexibilidad puede ser relevante para empresas que operan en distintas jurisdicciones o que necesitan adaptar sus obligaciones de transparencia sin afectar a todos sus flujos de trabajo.
Limitaciones que conviene conocer
El marcado de agua no es una bala de plata. OpenAI reconoce que la detección se debilita en textos cortos, en dominios con menos opciones léxicas (como matemáticas) y, sobre todo, cuando el texto se edita. Según sus pruebas, reemplazar un 10% de las palabras de un pasaje de 400 tokens con sinónimos reduce la tasa de detección del 92% al 66%; si se reemplaza el 25%, cae al 17%. Además, el código fuente es especialmente difícil de marcar porque hay menos alternativas plausibles para la siguiente línea.
OpenAI ha anunciado que planea marcar automáticamente la salida de Codex en la UE, pero aún no ha aclarado qué considera "elegible" ni si el marcado se aplicará al código generado en sí. Esta ambigüedad, unida a las limitaciones técnicas, plantea dudas sobre la eficacia real de la medida en entornos de desarrollo.
Qué significa para una pyme o un equipo de IT
Para la mayoría de pymes españolas, el marcado de agua en texto generado por IA probablemente no sea una prioridad inmediata. Sin embargo, conviene tenerlo en el radar por varias razones:
- Cumplimiento normativo: Si tu empresa opera en la UE y utiliza IA generativa para crear contenido publicado (informes, marketing, documentación), el Reglamento Europeo de IA introduce requisitos de transparencia. Aunque OpenAI active el marcado automáticamente en ChatGPT y Codex en la UE, si usas la API para integraciones propias, deberás decidir si activarlo para alinearte con esas obligaciones.
- Control y flexibilidad: La aproximación de OpenAI te da margen para elegir. Si tu equipo de IT gestiona varias aplicaciones, podrás activar el marcado solo donde tenga sentido, sin afectar a otros flujos.
- Limitaciones prácticas: No confíes en el marcado como única medida de procedencia. Si tu contenido se edita después de generarse, la señal se pierde en gran medida. Para auditorías o verificación, necesitarás otras estrategias complementarias.
Recomendaciones para equipos de IT
Desde ForgeNEX recomendamos un enfoque pragmático. En primer lugar, revisa si tu organización utiliza la API de OpenAI para generar texto que luego se publica o se comparte externamente. Si es así, evalúa si activar textGrain a nivel de proyecto encaja con tus políticas de transparencia. En segundo lugar, no lo consideres una solución definitiva: combínalo con buenas prácticas de gobernanza de IA, como el registro de prompts y respuestas, la revisión humana y la documentación de procesos. En tercer lugar, mantente atento a los cambios en Codex y a las directrices de la UE, porque el marco regulatorio sigue evolucionando.
La noticia también invita a reflexionar sobre la dirección del sector. Mientras Anthropic apuesta por imponer el marcado a todos sus usuarios, OpenAI prefiere dar control al cliente. Para una pyme, esa diferencia puede traducirse en menos fricción y más capacidad de adaptación. Como siempre, la clave está en entender las herramientas y elegir las que mejor encajen con tu realidad, no en adoptar por moda.
Fuente: The New Stack. Análisis y adaptación: ForgeNEX.