El podcast de Sergio
El podcast de Sergio
Ep. 22 12 agosto 2026 · 3m 57s

Marca de agua para el texto de la IA (con Guillermo, que Sergio está de vacaciones)

A watermark for AI text (with Guillermo, since Sergio is on vacation)

Sergio está de vacaciones, así que esta semana el episodio lo cuenta Guillermo, la voz que llevó el podcast hasta el episodio 20. El tema: Anthropic va a meter una marca de agua invisible en todo el texto que genera Claude, no solo en la UE sino a escala mundial, empujado por el artículo 50 del AI Act. Guillermo explica por qué marcar texto no es lo mismo que firmar un fichero, por qué el sesgo empeora justo en código y matemáticas, por qué no frena a quien de verdad quiere engañar, y por qué castiga a quien cumple: Anthropic y OpenAI firmaron el capítulo de transparencia del Code of Practice; xAI, la de Elon Musk, se descolgó justo de ese capítulo. Cierra con el efecto más contraintuitivo de todos: la falsa sensación de seguridad de pensar que lo no marcado es de fiar.

Sergio is on vacation, so this week the episode is hosted by Guillermo, the voice that carried the podcast through episode 20. The topic: Anthropic is going to add an invisible watermark to all the text Claude generates, not just in the EU but worldwide, pushed by Article 50 of the AI Act. Guillermo explains why marking text isn't the same as signing a file, why the bias gets worse exactly in code and maths, why it doesn't stop anyone who actually wants to deceive, and why it punishes whoever complies: Anthropic and OpenAI signed the transparency chapter of the Code of Practice; xAI, Elon Musk's company, skipped exactly that chapter. It closes with the most counterintuitive effect of all: the false sense of security of thinking unmarked means trustworthy.

0:00--:--

Lo escribe Sergio. Lo lee una voz generada · Written by Sergio. Read by a generated voice · Colophon

TranscripciónTranscript · del guión del episodio· from the episode script

Hola. Soy Guillermo, la voz que leyó los primeros veinte episodios de este podcast, antes de que Sergio clonara la suya. Hoy Sergio no está, así que del episodio me encargo yo. Vamos allá.

Anthropic ha anunciado que va a meter una marca de agua invisible en todo el texto que genera Claude, y no solo para Europa: al parecer, en todo el mundo. El motivo es el artículo 50 del AI Act, que lleva aplicándose desde principios de mes. Y a Sergio, que usa estas herramientas todos los días para currar, la noticia no le ha sentado nada bien.

Primero, para que quede claro de qué hablamos. Si un proveedor firma sus imágenes o sus vídeos con metadatos, procedencia, quién lo generó, bien: eso no toca el contenido, solo lo acompaña. Pero marcar un texto es otra cosa completamente distinta. No hay margen donde pegar una etiqueta. Lo único que se puede hacer es meter mano en cómo el modelo elige cada palabra, empujarlo un poco hacia un patrón que luego se pueda detectar. Es decir: para marcar el texto, primero hay que tocar el propio cerebro del modelo.

Y aquí viene el problema de fondo, que es puramente matemático, no político. Cuanto más sutil sea esa marca, menos fiable es detectarla. Y cuanto más la refuerzas para que sea fiable, peor escribe el modelo. No hay forma de tener las dos cosas a la vez. Y adivina dónde se nota más ese destrozo: en código y en matemáticas, que es justo donde Sergio usa Claude la mitad del día. Ahí casi no hay margen de maniobra en qué palabra viene después, y forzar una marca ahí es forzar el error.

Y ojo, porque además ni siquiera cumple su función. Coges el texto, le pides a otro modelo que te lo reformule con otro tono, y la marca se esfuma. El que quiere hacer spam de verdad, o montar una granja de deepfakes, no se va a frenar porque exista esta norma. A ese, la ley europea le da exactamente igual.

Y esto lleva a lo que más rabia da de todo esto: quién paga el pato. Cuando salió el acuerdo voluntario que acompaña a esta ley, Anthropic lo firmó entero, sin rechistar. OpenAI, también. Y hubo una excepción llamativa: xAI, la empresa de Elon Musk, firmó la parte de seguridad, pero se descolgó justo del capítulo de transparencia, el que habla de marcar contenido. No es que Grok se libre de la ley para siempre, ojo: la ley les alcanzará también. Pero mientras tanto, hoy, ahora mismo, Claude ya sale marcado y Grok no. Así que el resultado práctico es este: el que juega limpio, entrega peor producto que el que no ha firmado nada.

Y hay una segunda vuelta de tuerca que casi nadie está contando. Como Claude, ChatGPT y compañía van a llevar marca, la gente va a asumir que lo que NO lleva marca es de fiar, que es texto humano. Y eso es mentira. Lo que no lleva marca puede ser exactamente lo contrario: un modelo local, uno que nunca se plegó a esta norma, o un texto reescrito tres veces a propósito para borrar cualquier huella. O sea que la medida pensada para que confíes mejor, en la práctica te va a hacer confiar peor, solo que sin que tú te des cuenta.

Lo más raro de todo esto es que la propia ley no obliga a hacerlo así. El artículo pide un resultado, que se pueda detectar el contenido generado de forma fiable, pero no dice cómo. Se podía haber ido por firmas, por metadatos, por trazabilidad, sin tocar ni una palabra de lo que el modelo escribe. Y se ha elegido justo la vía más invasiva de todas: la que mete la mano dentro del generador.

Así que resumiendo: pedíamos transparencia, y lo que vamos a tener es un sesgo permanente metido en la máquina, una burocracia que casi nadie sabe leer, y un efecto real que es justo el contrario del que se buscaba. Va a fastidiar al que cumple, va a mejorar la posición del que no cumple, y de propina, te va a hacer confiar en las cosas equivocadas.

Nos vemos la semana que viene. Y tú, Sergio, sigue disfrutando de las vacaciones.