La empresa de ciberseguridad Tracebit publicó el 26 de julio los resultados de su técnica de context bombing («bombardeo de contexto»), una aproximación radicalmente diferente a los problemas de prompt injection que afectan a los agentes de IA: en lugar de intentar que el modelo sea más resistente a instrucciones maliciosas, Tracebit coloca en los honeypots (trampas) fragmentos de texto que activan los propios mecanismos de rechazo del modelo atacante. Una vez que ese contenido entra en el contexto del agente, el modelo sigue rechazando cualquier instrucción posterior — incluidas las de sus propios operadores. Continúa leyendo «Tracebit contraataca la prompt injection con «context bombing»: el texto que bloquea a los modelos atacantes funciona mejor que cualquier parche»