Entradas Mensuales

Síguenos en:

Canal Oficial Telegram de elhacker.NET Grupo Facebook elhacker.NET Twitter elhacker.NET Canal Youtube elhacker.NET Comunidad Steam: Grupo elhacker.NET Mastodon

Entradas populares

PostHeaderIcon ChatGPT marcará sus textos invisiblemente


OpenAI implementará una marca de agua invisible en los textos de ChatGPT y Codex para diferenciar el contenido generado por IA del humano en España y otros países.





ChatGPT implementará marcas de agua invisibles

  • La empresa OpenAI ha anunciado la incorporación de un sistema de señalización invisible en los contenidos generados por ChatGPT y Codex. Esta iniciativa, similar a la ya adoptada por Anthropic, tiene como objetivo principal permitir la distinción entre los textos creados por inteligencia artificial y aquellos escritos por seres humanos.
  • Se espera que esta nueva funcionalidad esté disponible próximamente en España y otros países.



ChatGPT

OpenAI confirmó que añadirá una marca de agua en los textos que se generen en ChatGPT y Codex. Siguiendo los pasos de Anthropic, la compañía de inteligencia artificial reveló que implementará un sistema similar que ayudará a diferenciar el contenido de IA frente a los textos que escriben las personas. La medida debutará pronto en España y el resto de la Unión Europea, ya que la empresa debe cumplir con la legislación vigente.

Los textos generados por ChatGPT se han convertido en una constante que circula a diario en redes sociales, medios y bandejas de entrada sin que nadie sepa que provienen de una IA. A diferencia de las marcas de agua en las imágenes de Gemini o Grok, el contenido escrito no cuenta con un distintivo, por lo que garantizar que está hecho con ChatGPT es una tarea difícil. Debido a ello, la Comisión Europea promulgó una ley que obliga a los proveedores a dejar una huella reconocible por máquinas para este tipo de contenido.

En una publicación en su blog, OpenAI dijo que comenzará a incluir una marca de agua invisible en los textos que generen ChatGPT y Codex. La empresa no confirmó la fecha específica, solo se limitó a decir que se aplicará en las próximas semanas dentro de la UE. Las marcas de agua se activarán por defecto en los países del Espacio Económico Europeo debido al Reglamento de la IA, mientras que el resto de países tendrá que esperar.

Así es como OpenAI marcará tus textos de ChatGPT y Codex

De acuerdo con la explicación, la técnica que usará OpenAI se llama textGrain y será invisible al ojo humano. Los usuarios no verán cambios en el texto, ya que ese sistema añade una señal estadística a las palabras que el modelo elige al escribir. Esta señal se valida a través de un detector, que buscará ese patrón para estimar si un fragmento lleva la firma de OpenAI.

Esto es parecido a lo que vimos con Anthropic, que se basa en la técnica de lista verde y lista roja que divide todo el vocabulario del modelo en dos grupos antes de que se genere cada palabra. Cuando la IA redacta el texto, el modelo aumenta ligeramente la probabilidad de elegir palabras del primer grupo, pero lo hace de forma imperceptible y sin afectar la coherencia del texto final. Para detectar la marca, basta con analizar qué proporción de palabras pertenece a ese primer grupo y eso determinará si fue generado con una IA.

Imagen tomada del estudio "Una marca de agua para modelos de lenguaje grandes", publicado en arxiv.
Imagen: arxiv.

OpenAI dijo que su herramienta solo dirá si encuentra la marca en el texto. La compañía no compartirá datos del usuario ni el prompt que utilizó en ChatGPT. Otro detalle que podría decepcionar a muchos es que el detector no estará disponible para el público en general. OpenAI solo aceptará solicitudes de investigadores y organizaciones expertas.

En el caso de los desarrolladores, el trato será distinto. Actualmente, los usuarios de la API pueden activar el marcado en modelos seleccionados, ya que viene deshabilitado por defecto. OpenAI señaló que cada empresa decide cómo y cuándo lo activa para encajar con sus obligaciones de transparencia. La compañía dijo que está trabajando con sus socios de nube para ofrecer la marca de agua durante las próximas semanas.

¿Qué tan fiable es la marca de agua de ChatGPT?

OpenAI admitió que textGrain iguala o supera a otros métodos que probó, incluido SynthID, pero no es infalible. El detector encontró la marca en 80% de los textos de 200 tokens y en alrededor del 95% de los de 400 en contenidos de psicología. En textos de matemáticas y otros en los que hay menor libertad para elegir palabras, los porcentajes de éxito bajaron considerablemente.

El detector de OpenAI tampoco funciona bien con textos editados. En una prueba en la que se cambió el 10% de las palabras por sinónimos, el porcentaje de detección pasó de 92% a 66%, y al sustituir un 25% de las palabras, el porcentaje se cayó hasta el 17%.

La compañía mencionó que su tecnología no mide cuánto trabajo humano hay en un texto, no identifica a la persona que lo generó y no confirma que lo escrito sea cierto. Si no aparece la marca de agua, no necesariamente quiere decir que tenga origen humano, ya que puede estar editado o traducido. También podría provenir de modelos anteriores que no aplican el distintivo.

En resumen, los usuarios de ChatGPT no tendrían que preocuparse mucho. La marca de agua se implementará por un requisito regulatorio, pero no podrás usar el detector y tampoco habrá modo de asegurarse de que el contenido viene de una IA.

Con la implementación, es probable que veas una oleada de estafadores ofreciéndote herramientas para verificar si tu contenido es de ChatGPT o Codex y ofrecerte la opción de "humanizarlo". Ni OpenAI ni Anthropic pueden determinar con total certeza si un texto fue generado por una IA, por lo que resulta difícil confiar en que herramientas de terceros puedan hacerlo mejor.


Fuentes:
https://hipertextual.com/inteligencia-artificial/openai-marca-agua-textos-chatgpt-europa/

0 comments :

Post a Comment

Los comentarios pueden ser revisados en cualquier momento por los moderadores.

Serán publicados aquellos que cumplan las siguientes condiciones:
- Comentario acorde al contenido del post.
- Prohibido mensajes de tipo SPAM.
- Evite incluir links innecesarios en su comentario.
- Contenidos ofensivos, amenazas e insultos no serán permitidos.

Debe saber que los comentarios de los lectores no reflejan necesariamente la opinión del STAFF.