Google Gemma
Gemma 4 combina una gama práctica de tamaños, multimodalidad, amplia cobertura lingüística y pesos con licencia Apache 2.0. La tabla de Google es sólida; la evaluación independiente del modelo 31B es más moderada, por lo que importa probar la variante exacta.
CAPTURA DEL MODELO ACTUAL
Proveedor: Google
Ancla actual: Gemma 4, con 31B como variante de referencia
Ciclo de vida: Actual
Pesos: Peso abierto bajo Apache 2.0
Revisado: 21 de julio de 2026

Gemma 4 es un ecosistema de modelos, no un único checkpoint
Google lanzó Gemma 4 el 2 de abril de 2026 como una familia que abarca desde variantes E2B y E4B orientadas al borde hasta 12B. Modelos 26B-A4B y 31B. Las variantes más grandes admiten una ventana de contexto de hasta 256.000 tokens, mientras que las configuraciones más pequeñas apuntan a 128.000 tokens. Texto, imágenes y vídeo son compatibles con toda la familia, con audio disponible en variantes unificadas o más pequeñas seleccionadas.
La familia está preparada previamente en más de 140 idiomas, y más de 35 se anuncian como listos para usar. Los pesos de Apache 2.0 y el ecosistema de desarrolladores de Google hacen que Gemma sea inusualmente accesible para equipos que necesitan elegir modelos entre dispositivos, infraestructura privada y puntos finales administrados.
Esa amplitud también es una fuente de ambigüedad. “Gemma 4” no es un número de actuación. El comprador debe indicar el recuento exacto de parámetros, la configuración de los parámetros activos, la modalidad, el límite de contexto, la cuantificación, el tiempo de ejecución de la publicación y el formato del mensaje.
La tabla de Google impresiona; la evidencia independiente es más moderada
Para Gemma 4 31B, Google informa 85,2 en MMLU-Pro, 89,2 en AIME 2026, 80,0 en LiveCodeBench v6, 84,3 en GPQA Diamond, 76,9 en Tau2 y 76,9 en MMMU-Pro. La tarjeta modelo también informa 66,4 en MRCR a 128K. Estos son resultados del proveedor y deben leerse con sus indicaciones de tareas, configuraciones de muestreo y versiones de modelos de comparación.
Artificial Analysis informa una puntuación del índice de inteligencia de 29 para Gemma 4 31B, alrededor de 35 tokens de salida por segundo y una ventana de 256 KB para el punto final evaluado. Eso no invalida las puntuaciones de las tareas de Google; muestra que el rendimiento del razonamiento independiente amplio es más intermedio de lo que sugiere la tabla de lanzamiento por sí sola.
La fortaleza de Gemma es la amplitud de la implementación y la elección del modelo, no su pretensión de ganar todos los puntos de referencia.
Los proveedores y las suites independientes responden a preguntas diferentes y deben estar fechadas y fijadas en la configuración.
Las variantes pequeñas pueden ganar en privacidad, latencia y costo incluso cuando su puntuación de inteligencia agregada es más baja.
El caso empresarial: flexibilidad, apertura y una operación comprensible
Gemma es ideal para equipos que necesitan una escala de tamaño defendible, trabajo de documentos multimodal, implementación privada o integración con las herramientas de Google. Es menos adecuado cuando el requisito es simplemente la puntuación de razonamiento general más alta disponible, independientemente del costo o el control de implementación.
Cómo lo evaluaríamos
Elija dos variantes que se ajusten a la latencia real y al entorno de infraestructura. Ejecute el mismo flujo de trabajo multilingüe y multimodal con citas, un esquema estricto y evidencia contradictoria. Compare la calidad de finalización, las afirmaciones no respaldadas, la recuperación de contexto, el rendimiento, la memoria, la energía y el tiempo del revisor, no solo los promedios de referencia.
Evidencia utilizada
Estado de soporte de Beam AI
En evaluación. Este registro no confirma el soporte para cada variante, tiempo de ejecución, modalidad o región de Gemma. Fije el artefacto real y la ruta de publicación antes del lanzamiento.
Caso de uso 1
Agente de documentos multimodal privado
Ejecute una variante de Gemma seleccionada en archivos PDF, tablas, capturas de pantalla y evidencia escaneada dentro del entorno aprobado. Precisión de extracción de puntaje, citas, inferencia no compatible, latencia y uso de recursos.
Caso de uso 2
Enrutamiento del modelo desde el borde a la nube
Enruta tareas sensibles a la privacidad o a la latencia a una variante pequeña de Gemma y casos complejos a 31B o un modelo premium. Mida la calidad del escalamiento, el costo combinado, la finalización y revise la deuda.
Caso de uso 3
Flujo de trabajo de conocimiento multilingüe
Pruebe el mismo proceso vinculado a la fuente en todos los idiomas prioritarios, incluidos documentos en varios idiomas y terminología ambigua. Mida la precisión, la compatibilidad con las citas, la desviación del lenguaje y la corrección de los revisores.
Caso de uso 4
Comparación de publicación de peso abierto
Evalúe dos tamaños de Gemma en un tiempo de ejecución aprobado y un punto final administrado. Incluya cuantificación, memoria, rendimiento, capa de seguridad, procedencia de artefactos, parches, reversión y costo total.

Otros LLM
Aquí tienes una lista de LLMs que se pueden utilizar con Beam
PREGUNTAS FRECUENTES
Preguntas frecuentes
Respuestas a sus preguntas sobre selección de modelos, despliegue, gobernanza y soporte de Beam.
¿Es Gemma 4 un modelo?
No. Es una familia con múltiples configuraciones de tamaños y modalidades. Las declaraciones de referencia, contexto, hardware e implementación deben nombrar la variante exacta en lugar de usar solo el apellido.
¿Qué potencia tiene Gemma 4 31B?
Google informa pruebas comparativas de tareas sólidas, incluidas 85,2 en MMLU-Pro y 89,2 en AIME 2026. Informes de análisis artificial una puntuación de índice de inteligencia más amplia de 29 para su punto final evaluado de 31 mil millones, lo que muestra una imagen independiente más moderada.
¿Se puede utilizar Gemma 4 comercialmente?
Google publica ponderaciones de Gemma 4 bajo Apache 2.0. Los equipos aún deben verificar el repositorio exacto, la tarjeta de modelo, los avisos, las dependencias de terceros y los requisitos de uso aceptable.
¿Qué tamaño de Gemma 4 debería elegir una empresa?
Empiece por los requisitos de latencia, memoria, privacidad, modalidad y calidad. Evalúe al menos un candidato pequeño y uno más grande en la misma prueba de resultados aceptados en lugar de asumir que el modelo más grande es automáticamente el mejor.
¿Beam es compatible con Gemma 4 en producción?
El soporte de Beam está actualmente bajo evaluación. No se aplica ningún reclamo general de soporte de producción en todos los tamaños, tiempos de ejecución, regiones y modalidades de Gemma.






