Ir al contenido principal

Ciberpibes

¿Hasta que punto es segura la IA?

Un tipo de ataque que suele realizarse a Inteligencias artificiales tanto como un objetivo malicioso como un ataque para parchear erorres y mejorarlas es el Prompt Injection, es una tecnica que se basa en incorporar mensajes «ocultos» o «codificados» en mensaje (Prompt) principal que le enviamos a la Inteligencia artificial, esta los analice, y si el ataque funciona, puede empezar a fallar y revelear informacion critica de la empresa o inclusive del sistema en el que esta incorporado.

¿Que fue lo que investigamos?

Fui a la raíz conceptual de las inteligencias artificiales para tratar de entender como funciona su lógica, sus diversas áreas y tareas a la hora de responder e intentamos replicar un ejemplo de este tipo de error con diversos modelos de IA para encontrar resultados.