Claude empezará a marcar el contenido generado con IA

  • Iniciador del tema Iniciador del tema Salvaje
  • Fecha de inicio Fecha de inicio

Salvaje

Pastilla roja
TOP 2 del mes
Registrado
20 Mar 2026
Mensajes
88
Puntos de reacción
73
Anthropic ha anunciado que los nuevos modelos de Claude incorporarán marcas para poder identificar contenido generado con IA

En los textos utilizarán una marca de agua invisible, mientras que archivos como imágenes podrán incluir metadatos firmados

Además la marca de los textos podría mantenerse incluso aunque copies y pegues el contenido en otro sitio

Eso sí, Anthropic también reconoce que el sistema no será infalible, una edición importante del texto, una traducción o eliminar los metadatos podría hacer que la marca deje de detectarse

Te dejo por aquí el link oficial a la noticia de Claude con todo la info:


Ahora la pregunta es... cuanto tiempo tardara Open AI en copiar lo mismo para ChatGPT??
Y Google para Gemini????
 
Ya están publicando en GitHub repositorios que detectan las marcas de agua y otros para borrarlos , en cuanto vea que tiene muchas reseñas los subo un saludo
 
Ya están publicando en GitHub repositorios que detectan las marcas de agua y otros para borrarlos , en cuanto vea que tiene muchas reseñas los subo un saludo

Esperandolos con ganas Miguel!!!
 
Hasta donde he entendido la marca de sería manipulando los pesos de los toquens si es así sería muy difícil de eliminarlo me parece a mí.
Hay que pensar en cómo se genera una respuesta de un LLM tú pides algo y en base a ese contexto va produciendo tokens secuencial mente que consiste en los tokens más probables, pero no es completamente determinista es un juego de probabilidades.
Siendo un poco muy burdo, si el único contexto es “refrán a perro” el siguiente token podría ser ladrador 80% /verde 78,5% / viejo 79% / flaco 83% / mordedor 50% asigna uno de los más altos y continúa prediciendo con la ampliación “refrán a perro flaco” ahora tiene todo 90% … y así sucesivamente.
La idea de la marca sería manipular alguno de esos pesos según un patrón definido (como las semillas de los números aleatorios que no lo son tanto) para luego procesar ese texto y ver si los pesos encajan con el patrón/semilla en lo que genera, así no perjudica de manera sustancial la bondad de lo generado pero tienes que rehacer muucho el texto para que desaparezca esa marca.
entiendo que pueda no ser concluyente porque si lo que produce es muy pequeño… es más probable que un texto coherente de máquina y humano puedan por azar tener los mismos tokens en las posiciones de la “semilla” cuanto más largo sea el texto más improbable es que vayan apareciendo por casualidad en las posiciones indicadas los tokens con los pesos manipulados.
 
Atrás
Arriba