Google ha presentado un nuevo modelo de IA llamado Gemini que, según afirma, supera a ChatGPT en varias pruebas y demuestra un razonamiento avanzado en múltiples formatos. Gemini es un modelo multimodal que puede comprender simultáneamente texto, audio, imágenes, vídeo y código informático. Se integrará en los productos de Google, incluido el motor de búsqueda. El modelo está disponible en tres versiones: Pro, Nano y Ultra. La versión Ultra, la más potente, se someterá a pruebas externas y no se hará pública hasta principios de 2024. Google está en conversaciones con el gobierno británico para probar Gemini a través del Instituto de Seguridad de la Inteligencia Artificial. Aunque Gemini muestra capacidades prometedoras, las alucinaciones o respuestas falsas siguen siendo un problema de investigación sin resolver. Google publicó vídeos en los que se mostraban las capacidades de Gemini’, como la comprensión de deberes de física escritos a mano y la identificación de dibujos. Las preocupaciones en torno a la IA van desde la desinformación hasta el desarrollo de sistemas superinteligentes. Gemini representa un paso hacia la inteligencia general artificial (AGI), pero aún quedan áreas en las que es necesario investigar e innovar. Ultra, la versión más avanzada, superó a expertos humanos en una prueba multitarea e impulsará una herramienta de escritura de código llamada AlphaCode2. Los datos utilizados para entrenar a Gemini proceden de diversos lugares, incluida la web abierta, lo que ha suscitado la preocupación de las industrias editorial y creativa.
