DeepSeek, el último proveedor de chatbots de IA de China, ha sido rápidamente objeto de escrutinio por parte de expertos en ciberseguridad que recientemente encontraron una vulnerabilidad de infraestructura relacionada con la base de datos de IA de la empresa.
Los investigadores de la empresa de seguridad en la nube Wiz descubrieron una base de datos expuesta que filtra datos confidenciales, incluidos historiales de chat, claves API y detalles operativos del backend.
El equipo de investigación de Wiz reveló el problema a DeepSeek y la empresa china rápidamente aseguró la exposición.
Wiz compartió sus hallazgos, en un informe del 29 de enero.
La base de datos expuesta de DeepSeek era una configuración de ClickHouse. ClickHouse es un sistema de gestión de bases de datos orientado a columnas diseñado para el procesamiento analítico en línea (OLAP) al manejar grandes volúmenes de datos.
Mientras DeepSeek lanzaba su LLM de razonamiento R1, Wiz analizó la postura de seguridad externa de la startup china y buscó vulnerabilidades potenciales.
El equipo de investigación identificó rápidamente una base de datos ClickHouse de acceso público, completamente abierta y no autenticada, alojada en oauth2callback.deepseek.com:9000 y dev.deepseek.com:9000.
Normalmente, una base de datos ClickHouse solo debería ser accesible internamente por la empresa que la utiliza.
Mediante la interfaz HTTP de ClickHouse, Wiz accedió a la ruta /play, que permitió la ejecución directa de consultas SQL arbitrarias a través de un navegador web. Una simple consulta SHOW TABLES; devolvió una lista completa de conjuntos de datos accesibles.
La base de datos contenía una cantidad sustancial de historial de chat, datos de backend e información confidencial, como flujos de registros, claves API y detalles operativos.
Además, la exposición permitió un control total sobre la base de datos y una posible escalada de privilegios dentro del entorno de DeepSeek, todo ello sin ningún mecanismo de autenticación o defensa para protegerlo del acceso externo.
Wiz se abstuvo de ejecutar consultas intrusivas y limitó las acciones a la enumeración únicamente.
Los investigadores concluyeron su informe enfatizando que, si bien la seguridad de la IA a menudo se centra en amenazas futuras, no debe pasar por alto los peligros actuales.
Estos a menudo se derivan de riesgos básicos, como la exposición externa accidental de bases de datos.
Los hallazgos de Wiz llegan en un momento en el que DeepSeek y sus LLM están generando cada vez más preocupaciones sobre la privacidad de los datos en los países occidentales, y la Casa Blanca y la Autoridad de Protección de Datos italiana ya están investigando a la startup china.
El 29 de enero, otra empresa tecnológica china, Alibaba, lanzó un nuevo LLM, Qwen 2.5-Max, que, según afirma, supera a los modelos de IA de DeepSeek.