Definición:
Gemini es una familia de modelos de inteligencia artificial desarrollada por Google DeepMind. También es el nombre del asistente de Google que utiliza esos modelos y otras herramientas para responder preguntas, elaborar contenido y ayudar con distintas tareas.
Su carácter multimodal permite trabajar con información en formatos como texto, imágenes, audio o vídeo. Las capacidades disponibles dependen del modelo y del servicio utilizado: la familia de modelos y la aplicación Gemini están relacionadas, pero no son lo mismo.
Índice de contenidos
Origen de Gemini y relación con Bard
Google presentó la familia de modelos Gemini en diciembre de 2023 como parte de su desarrollo de sistemas de inteligencia artificial multimodal.
Bard era el asistente conversacional que Google había abierto al público ese mismo año. En febrero de 2024 pasó a llamarse Gemini, de modo que el asistente y la familia de modelos comenzaron a compartir una misma denominación.
Por tanto, no se trató simplemente de cambiar el nombre de un modelo llamado Bard. La evolución de los modelos y la del asistente son procesos relacionados, pero distintos.
Cómo funciona Gemini
Gemini genera respuestas a partir de su entrenamiento, las instrucciones recibidas y el contexto disponible. Este puede incluir la conversación, documentos aportados por el usuario o información obtenida mediante herramientas conectadas.
Las instrucciones, llamadas prompts, permiten indicar el objetivo y el formato esperado. Por ejemplo, una persona puede pedir que se resuma un documento, se expliquen sus términos técnicos o se comparen dos apartados.
La multimodalidad amplía esa interacción: permite combinar una pregunta escrita con una imagen o un archivo compatible. Interpretar un formato no implica necesariamente poder generarlo. Algunas funciones del asistente utilizan modelos o herramientas especializados para producir contenido.
Para qué sirve Gemini
Gemini puede apoyar tareas de comprensión, creación y organización de información. Entre sus aplicaciones se encuentran las siguientes:
- Redacción y edición: preparar borradores, resumir textos, traducir o adaptar el tono de un mensaje.
- Análisis de documentos: localizar información, comparar contenidos y extraer datos.
- Interpretación de imágenes: explicar capturas, diagramas u otros materiales visuales.
- Programación: explicar código, proponer modificaciones y ayudar a investigar errores.
- Aprendizaje: aclarar conceptos, desarrollar ejemplos y preparar ejercicios.
- Apoyo dentro de otras aplicaciones: utilizar funciones integradas en servicios como Gmail o Documentos de Google, según la cuenta y la configuración.
Estas tareas pueden realizarse mediante el asistente o incorporarse a una aplicación propia que utilice los modelos.
Formas de utilizar Gemini
El asistente Gemini permite interactuar mediante conversaciones desde sus interfaces disponibles. Algunas de sus funciones también están incorporadas en otros productos de Google.
Los desarrolladores pueden acceder a los modelos mediante una API e integrarlos en webs, aplicaciones o procesos propios. En ese caso, la aplicación determina qué información se envía, qué herramientas intervienen y cómo se presenta el resultado.
Las integraciones con documentos y otros servicios requieren los permisos correspondientes. Utilizar Gemini no concede automáticamente acceso a toda la información de una cuenta de Google.
Límites que conviene conocer
Gemini puede generar respuestas incorrectas, interpretar mal un archivo o citar información que no respalda su explicación. Disponer de herramientas de búsqueda no significa que todas las respuestas estén actualizadas o verificadas.
La personalización tampoco equivale necesariamente a reentrenar el modelo: utilizar instrucciones, contexto o información guardada son mecanismos diferentes.
Antes de aportar datos confidenciales, conviene revisar las condiciones del servicio utilizado. El asistente, las funciones empresariales y las integraciones para desarrolladores pueden tener políticas distintas de tratamiento de datos.
Diferencia entre Gemini y Google AI Studio
Gemini identifica la familia de modelos y el asistente de Google. Google AI Studio es un entorno para experimentar con modelos, preparar instrucciones y desarrollar aplicaciones que utilizan sus capacidades.
Una persona puede utilizar el asistente Gemini para resolver una tarea directamente. En AI Studio puede probar cómo debería responder un modelo dentro de una aplicación que está preparando.
Son herramientas relacionadas, pero cumplen funciones diferentes: utilizar Gemini no exige trabajar en AI Studio.
