¡Hola! Te escribe Lalo.
Imagina que copias un párrafo generado por Claude, lo pegas en el Bloc de notas de Windows, lo editas un poco y lo mandas como tuyo. Según Anthropic, la marca de agua sigue ahí. Tú no la ves. Yo tampoco. Pero una máquina sí.
Eso es lo que anunció la empresa esta semana: a partir del 2 de agosto, todos los modelos Claude nuevos van a incrustar señales invisibles en el texto que producen, en imágenes .svg, .png y .jpg, y en archivos generados desde cualquier superficie de Claude, ya sea la API, Claude Code, Claude Cowork o Claude Tag.
El movimiento responde al Código de Práctica de Transparencia de Contenido Generado por IA de la Unión Europea, pero Anthropic decidió aplicarlo globalmente, no solo dentro del bloque europeo. Vale la pena entender qué cambia, qué no cambia y por qué los límites de esta tecnología importan tanto como la tecnología misma.
🔏 Cómo funciona la marca de agua de Claude
🖼️ Qué pasa con las imágenes
⚠️ El problema que Anthropic admite
🌐 Un patrón de industria que ya llegó
Precios del día
CRIPTO:
🔴 Bitcoin = $62,987.00 | -0.2% (24h)
🔴 Ethereum = $1,875.95 | -0.0% (24h)
🔴 Solana = $75.14 | -0.8% (24h)
ACCIONES:
🟢 AAPL = $306.01 | +0.3% (24h)
🔴 MSFT = $495.54 | -0.3% (24h)
🔴 NVDA = $224.66 | -0.3% (24h)
🔏 Cómo funciona la marca de agua de Claude
El concepto de marca de agua tiene siglos: nació en Italia en el siglo XIII como método de autenticación en papel. Lo que Anthropic hace con texto es completamente distinto.
El sistema incrusta señales dentro de las letras y palabras: espaciado diferente entre caracteres, secuencias de palabras específicas, patrones invisibles al ojo humano. No hay sello visible, no hay aviso emergente. El marcado ocurre a nivel de modelo, lo que significa que no depende de la aplicación que uses ni de dónde termines pegando el texto.
Anthropic lo dice directo: el marcado se aplica "at the model level", así que la señal viaja con el texto sin importar de qué producto o superficie de Claude haya salido. Copiarlo, pegarlo, pasarlo por un editor de texto básico, no elimina la marca. La edición humana tampoco garantiza que desaparezca.
Lo que Anthropic no ha publicado todavía es cómo detectar esas marcas. La empresa dijo que compartirá los detalles en el futuro, sin dar fecha.
🖼️ Qué pasa con las imágenes
Con archivos de imagen el mecanismo es diferente: provenance metadata firmada criptográficamente. Cada imagen generada por Claude cargará información sobre su origen, quién la creó y si fue modificada.
La parte interesante está en la protección contra manipulación. Si alguien intenta alterar esos metadatos para ocultar que la imagen es de IA, la firma criptográfica se rompe. Esa ruptura es, en sí misma, una señal de que algo fue alterado. No elimina el fraude, pero lo hace visible.
Eso aplica a archivos .svg, .png y .jpg generados por Claude. El anuncio no menciona otros formatos.
⚠️ El problema que Anthropic admite
Aquí está el punto que más importa leer con cuidado, porque Anthropic lo incluye en su propio anuncio.
La presencia de una marca de agua no significa que el contenido sea de Claude. Y la ausencia de marca de agua tampoco significa que Claude no estuvo involucrado.
Ejemplo concreto que da la empresa: alguien toma un ensayo escrito por un humano, lo mete a Claude para que lo reformule, y el resultado tiene marca de agua, aunque los hechos y las ideas originales son del humano. El texto parece de IA cuando no del todo lo es.
El caso inverso también existe: si alguien usa Claude como corrector o traductor y luego reescribe el texto a mano, podría quedar sin marca o con una parcial, aunque Claude participó en el proceso. Y si mezclas fragmentos de Claude con texto propio, una porción pequeña puede dejar marca en todo el documento, lo que distorsiona cualquier juicio sobre la autoría.
Esto no invalida el sistema. Pero sí limita qué tan concluyente puede ser una marca de agua como prueba de origen.
🌐 Un patrón de industria que ya llegó
Anthropic no está solo en esto. Substack se asoció con Pangram para indicar qué tanto de una publicación fue generado por IA. Suno anunció cambios para que los oyentes sepan si una canción es de IA. LinkedIn permite reportar contenido sospechoso de ser "AI slop". Spotify lanzó AI Persona para que creadores y escuchas identifiquen música hecha con inteligencia artificial.
La dirección es clara: las plataformas están asumiendo que el contenido de IA va a saturar sus espacios y están construyendo capas de identificación antes de que los reguladores los obliguen a hacerlo de forma más costosa.
El Código de Práctica de Transparencia de la UE es el marco que mueve a Anthropic ahora, pero la decisión de aplicarlo globalmente dice algo concreto: la empresa prefiere un estándar único a gestionar reglas por región.
La pregunta que queda abierta es qué tan confiables serán esas marcas cuando los modelos adversariales empiecen a entrenarse específicamente para borrarlas o falsificarlas. Anthropic no ha respondido eso todavía.
Eso es todo por hoy. Compártela con alguien que le sirva. ¡Buen fin de semana!