DeepMind lanza la primera evaluación doble ciego de modelos AI usando tecnología Confidential Space
Google DeepMind ha presentado un sistema pionero que garantiza la privacidad y confidencialidad en la evaluación de modelos de IA, en colaboración con instituciones internacionales. La prueba piloto involucra al modelo Gemini Flash Lite y tecnología de Google Cloud.
John Jumper, de Google DeepMind, habla durante una videollamada o entrevistaNational Academies - Earth and Life Studies · Wikimedia Commons · CC-BY
DeepMind prueba un sistema pionero de evaluación doble ciego para IA
DeepMind anunció que ha lanzado la primera evaluación doble ciego de un modelo de IA, concretamente para su modelo Gemini Flash Lite. La evaluación se realizó en un entorno de privacidad mediante la tecnología Confidential Space de Google Cloud, garantizando que ni el evaluador puede acceder a los pesos del modelo ni Google ve los datos del evaluador.
Colaboración internacional y estándares elevados en la evaluación de IA
Para llevar a cabo esta prueba piloto, DeepMind colaboró con instituciones como Singapore AI Safety Institute, OpenMined, AVERI y MLCommons. La iniciativa busca mejorar la integridad de las evaluaciones de IA, promoviendo un método que protege tanto los datos como los modelos, en línea con avances en seguridad y confidencialidad a nivel global.