Revisión de Gemini 3.7 Flash: Mejoras y Comparativas
Resumen
Gemini 3.7 Flash logró desarrollar un juego jugable en un navegador a partir de un solo comando en 2 minutos y 13 segundos, una tarea que Gemini 3.6 Flash no pudo completar hace tres semanas.
No logró resolver nuestro rompecabezas lógico sobre puentes, repitiendo la misma respuesta incorrecta que Claude Fable 5, y no llegó a calcular correctamente el problema matemático que planteó.
El modelo tiene un costo de 0.75 dólares por cada millón de tokens de entrada hasta el 31 de diciembre, lo que representa la mitad de la tarifa de 3.6 Flash, antes de duplicarse a $1.50 el 1 de enero.
Lanzamiento y Disponibilidad
Google lanzó Gemini 3.7 Flash el 13 de agosto, y desde el primer día estuvo disponible en más de 160 países. Este modelo admite hasta un millón de tokens de entrada, devuelve 64,000, interpreta imágenes, videos, audios y PDFs, además de poder utilizar herramientas y controlar una computadora.
Flash no ha sido históricamente el modelo preferido para problemas complejos. Se utiliza más bien para organizar texto, compactar sesiones de agentes y resumir documentos que no requieren un modelo insignia.
Mejoras y Desempeño
En comparación con su antecesor, Gemini 3.7 Flash es una mejora significativa. Sin embargo, en términos generales, sigue siendo un modelo competente que no supera a los programas que se pueden descargar de forma gratuita.
Según las pruebas de Google, 3.7 Flash supera a Claude Sonnet 5 y GPT-5.6 Terra en 11 de 18 categorías evaluadas. Las cifras principales son 1,588 en el tablero de desarrollo web de Code Arena y 30.4% en AutomationBench, basadas en la metodología de Google.
Prueba de Codificación: ¿Funciona desde el Primer Intento?
Para evaluar la generación de código sin ejemplos, entregamos un único comando para crear un juego en el navegador y tomamos como válido el resultado, incluidos los errores. Gemini 3.7 Flash completó esta tarea en 2 minutos y 13 segundos, generando un juego jugable en la primera ejecución, con una sintaxis limpia y lógica coherente.
En comparación, Gemini 3.6 Flash, lanzado el 21 de julio, no pudo producir un archivo funcional. HTML mal formado y elementos que fallaron al renderizarse demostraron la debilidad de la versión anterior.
Escritura Creativa: ¿Puede Crear una Narrativa Coherente?
En esta sección, evaluamos la calidad literaria y la capacidad del modelo para seguir reglas estructurales. Se solicitó a Gemini que enviara a un personaje llamado Jose Lanz del año 2150 al 1000, creando un bucle causal cerrado.
A pesar de generar una historia aceptable, su estilo denunciaba que era una creación de IA, con un uso excesivo de adjetivos. Comparado con Qwopus3.5-27B-v3, un modelo gratuito, Qwopus logró seguir correctamente la regla establecida.
Pensamiento Asociativo: ¿Puede una Metáfora Argumentar Eficazmente?
Evaluamos la habilidad de asociación del modelo pidiendo un argumento sobre la explotación laboral utilizando la metáfora de una ramita que se convierte en una lechuga. Gemini erró en la transición nominando su metáfora directamente, lo que arruinó el impacto.
En contraste, GPT-5.6 Sol logró integrar su argumento y desarrollar una mejor narrativa a partir de la metáfora.
Lógica: ¿Reconoce el Problema?
Analizamos si el modelo entiende el rompecabezas. Al dar el tiempo de cruce de cuatro personas sin mencionar una limitación, Gemini respondió incorrectamente con 17 minutos en vez de los 10 minutos correctos.
Matemáticas: ¿Completa el Trabajo?
En esta prueba, solicitamos un polinomio específico y aunque ambos modelos identificaron un polinomio correcto, Gemini se detuvo en la expresión en vez de evaluar el número solicitado. Qwen finalizó correctamente el cálculo, realizando el trabajo que se le había encomendado.
Conclusión
Gemini 3.7 Flash es una opción viable para aquellos que ya están en el ecosistema de Google. Representa una mejora considerable en código, es lo suficientemente rápido para trabajos de agente y su costo es bajo en comparación con otros modelos.
Sus fortalezas son la ejecución y la estructura. Sin embargo, su creatividad y razonamiento son limitados, con respuestas predecibles y afirmaciones incorrectas sin advertencias sobre sus supuestos erróneos.
En términos de costo, con un precio de 0.75 dólares por millón de tokens de entrada y $3.75 de salida, es un competidor serio frente a otros modelos más caros en el mercado.
Descargo de responsabilidad: Los puntos de vista y opiniones expresadas en este artículo pertenecen a su autor y no necesariamente reflejan aquellas de CriptoPasion. La opinión del autor es a título informativo y en ninguna circunstancia constituye una recomendación de inversión ni asesoría financiera.



















