La IA generativa ha avanzado mucho en los últimos meses y todo el mundo quiere una parte del pastel. Google tuvo un comienzo difícil en la escena de la IA generativa, pero la recién anunciada familia de modelos Gemini 2.0 está cambiando eso.
Google ha anunciado2.0, su modelo de IA más avanzado hasta el momento, aunque el lanzamiento está escalonado por ahora. Aprovechando el éxito de Gemini 1.0 y 1.5, este nuevo modelo cuenta con capacidades multimodales mejoradas, incluida la salida de imagen y audio nativa. Esto permite la creación de agentes de IA más sofisticados que pueden comprender e interactuar con el mundo de una manera más humana.
Gemini 2.0 Flash, el primer modelo de la familia, está disponible para desarrolladores y algunos usuarios de Gemini Advanced, con planes para una implementación más amplia en un futuro próximo. Según Google, supera a su predecesor, Gemini 1.5 Pro, en puntos de referencia clave y ofrece el doble de velocidad. Si tienes Gemini Advanced, es posible que ya tengas acceso al nuevo modelo Gemini 2.0 Flash. Sin embargo, una vez que lo enciendas, verás una gran advertencia en negrita que indica que se encuentra en una etapa "experimental" y que es posible que no funcione como se esperaba.
Es posible que falle en algunas cosas en este momento; lo probé por un tiempo y, en realidad, tiende a dar respuestas demasiado complicadas a consultas que de otro modo serían simples, pero por lo demás está bien y funciona a buenas velocidades. No confiaría en él para ninguna tarea realmente importante en este momento. Después de todo, es experimental, lo que significa que requiere más capacitación y uso antes de que sea apropiado para ser utilizado por la mayoría de las personas.
No estamos seguros de cuándo saldrá realmente de esta etapa "experimental" y reemplazará a la familia de modelos Gemini 1.5, pero tendremos que esperar y ver. También deberíamos tener un modelo Gemini 2.0 Pro más grande en el futuro y, al igual que el modelo Gemini 2.0 Flash, probablemente se lanzará como un modelo experimental al principio.
Sin embargo, una mejora que puede utilizar ahora mismo es una nueva versión de "Investigación profunda" de Gemini 1.5 Pro. Esto es similar a los nuevos cambios de pensamiento de ChatGPT, donde en realidad verificará la precisión de sus respuestas una y otra vez en lugar de simplemente escupir lo primero que salga del modelo. Sin embargo, en lugar de simplemente verificar un resultado, Deep Research irá un paso más allá y elaborará un plan paso a paso de lo que hará y cómo le ayudará a investigar.
Puede encontrar información en la web, analizar toda esa información, hacer cálculos y verificar la precisión de todo eso para finalmente culminar en un informe informado de formato largo, utilizando información de varias fuentes (citando cada fuente utilizada), respondiendo adecuadamente a su consulta. Incluso puedes revisar el plan de investigación antes de que Géminis dedique varios minutos a investigar y escribir.
La investigación profunda es bastante interesante, pero dado que prioriza la investigación y la precisión en lugar de brindar una respuesta rápida, puede llevar mucho tiempo. Las tres indicaciones que utilicé me llevaron al menos 5 minutos cada una para darme una respuesta adecuada, que puedes leer directamente en Gemini o exportar a Google Docs (en caso de que vayas a utilizarlo para algo como un ensayo). Todavía puede cometer errores incluso si verifica las respuestas mil veces, por lo que no podemos enfatizar esto lo suficiente: si va a usar esto,por favorVuelva a verificar lo que le proporciona y no se limite a tomar el resultado según su valor nominal.
Tanto la versión experimental de Gemini 2.0 Flash como la versión Deep Research de Gemini 1.5 Pro ya están disponibles para los usuarios de Gemini Advanced.
