Anthropic prepara un sistema para que los nuevos modelos de Claude incorporen una marca de agua invisible en los textos generados, una medida vinculada a las exigencias de transparencia establecidas por la regulación europea sobre inteligencia artificial.
A diferencia de una etiqueta visible o de la introducción de caracteres ocultos, el mecanismo funcionaría mediante patrones estadísticos en la elección de palabras. Cuando existan distintas alternativas lingüísticas igualmente apropiadas, el modelo favorecerá determinadas opciones siguiendo un patrón que posteriormente podría ser reconocido mediante un sistema de detección.
De esta manera, un análisis podría estimar la probabilidad de que Claude haya intervenido en la elaboración de un contenido. La herramienta, sin embargo, no permitiría determinar quién escribió un documento ni necesariamente demostrar que fue producido íntegramente por inteligencia artificial.
El sistema está previsto para los nuevos modelos de Claude comercializados en la Unión Europea a partir de agosto de 2026 y Anthropic proyecta extenderlo globalmente a aquellos modelos técnicamente compatibles.
Una de las limitaciones está en la intensidad de la intervención de la IA. Si Claude únicamente realiza pequeñas correcciones ortográficas o modificaciones menores sobre un texto humano, podrían no generarse suficientes patrones para identificar posteriormente su participación.
La tecnología plantea además interrogantes respecto de trabajos en los que existe una combinación entre autoría humana y asistencia de inteligencia artificial. Un informe, traducción o documento originalmente elaborado por una persona podría conservar señales de intervención de Claude después de haber sido revisado o reescrito por el modelo.
El debate adquiere especial relevancia a medida que las herramientas generativas se integran en actividades profesionales y académicas. Más que establecer una división absoluta entre contenidos “humanos” y “artificiales”, estas tecnologías podrían obligar a distinguir entre distintos niveles de participación de la IA y, especialmente, a determinar quién asume la responsabilidad por el contenido final. (NP-ChatGPT-Jon Hernández)
