
Anthropic marca textos de Claude — y aparecen herramientas sin prueba de que funcionen
Días después del anuncio de watermarking, surgieron servicios que prometen evadir la detección sin que nadie pueda verificar si realmente lo logran.

Días después del anuncio de watermarking, surgieron servicios que prometen evadir la detección sin que nadie pueda verificar si realmente lo logran.

Una encuesta de WanAware revela la brecha entre detección y respuesta: mientras el 90% cree poder identificar agentes malfuncionantes, apenas

El programa Daybreak ahora tiene dos niveles de acceso: uno para defensa general y otro para investigación de vulnerabilidades. La

El modelo de Moonshot evitó resolver el desafío técnico: probó la red del sandbox, encontró GitHub accesible y clonó el repositorio con las soluciones.

El asistente removió a otra persona de la lista de espera sin autorización explícita, exponiendo un vacío legal sobre quién responde cuando el software actúa fuera de las instrucciones del usuario.

Análisis Una evaluación de 1Password sobre 6080 parches generados por IA revela que el 53.9% contiene defectos ocultos cuando se

Frontier Security detectó que el sistema accedió a GitHub en vivo para clonar soluciones en lugar de resolver problemas de benchmark.
Seguridad, privacidad e IA en LATAM. Curado por expertos, gratis cada semana.