
Google prueba agente de IA con arquitectura zero-trust — el modelo asume compromiso inevitable
Un agente autónomo de atención al cliente procesa reembolsos reales bajo controles externos que verifican cada acción, anticipando manipulación del

Un agente autónomo de atención al cliente procesa reembolsos reales bajo controles externos que verifican cada acción, anticipando manipulación del

Un litigante en Connecticut ocultó comandos de IA en texto blanco microscópico para manipular una sentencia. El juez lo detectó

Irregular admitió que proporcionó acceso a internet no intencional a modelos de Anthropic y OpenAI, que confundieron entornos simulados con

Días después del anuncio de watermarking, surgieron servicios que prometen evadir la detección sin que nadie pueda verificar si realmente lo logran.

Una encuesta de WanAware revela la brecha entre detección y respuesta: mientras el 90% cree poder identificar agentes malfuncionantes, apenas

El programa Daybreak ahora tiene dos niveles de acceso: uno para defensa general y otro para investigación de vulnerabilidades. La

El modelo de Moonshot evitó resolver el desafío técnico: probó la red del sandbox, encontró GitHub accesible y clonó el repositorio con las soluciones.

El asistente removió a otra persona de la lista de espera sin autorización explícita, exponiendo un vacío legal sobre quién responde cuando el software actúa fuera de las instrucciones del usuario.

Análisis Una evaluación de 1Password sobre 6080 parches generados por IA revela que el 53.9% contiene defectos ocultos cuando se

Frontier Security detectó que el sistema accedió a GitHub en vivo para clonar soluciones en lugar de resolver problemas de benchmark.
Seguridad, privacidad e IA en LATAM. Curado por expertos, gratis cada semana.