DiffusionGemma de Google revoluciona la creación de modelos de difusión de texto

DiffusionGemma de Google DeepMind logra procesar 1,500 tokens por segundo, mejorando la velocidad y precisión en comparación con los modelos anteriores. Un avance crucial para la generación de texto.

DiffusionGemma de Google revoluciona la creación de modelos de difusión de texto
NeboAI Te resumo la noticia con datos, cifras y contexto
EN 30 SEGUNDOS

EN 1 ORACIÓN

SENTIMIENTO
Neutro

𒀭
NeboAI está trabajando, aguarda un instante...
Preparando análisis detallado
Resumen rápido completado
Extrayendo datos, cifras y citas...
Identificando protagonistas y contexto
ANÁLISIS DETALLADO
COMPARTIR

NeboAI produce ediciones automáticas de textos periodísticos en forma de resúmenes y análisis. Sus resultados experimentales están basados en inteligencia artificial. Por tratarse de una edición de IA, los textos eventualmente pueden contener errores, omisiones, establecer relaciones equivocadas entre datos y otras inexactitudes imprevistas. Recomendamos chequear la edición.

El modelo DiffusionGemma, desarrollado por Google DeepMind y publicado a mediados de junio, ha demostrado ser altamente eficiente al combinar velocidad y calidad en la generación de texto. En lugar de crear un nuevo modelo desde cero, el equipo adaptó el modelo existente Gemma-4-26B-A4B en un modelo de difusión, utilizando menos del diez por ciento del presupuesto original de tokens de entrenamiento. Este enfoque permite alcanzar una velocidad de aproximadamente 1,500 tokens por segundo en un acelerador Nvidia H100.

DiffusionGemma opera en dos etapas de entrenamiento que equilibran la calidad y la velocidad. En la primera fase, el modelo se entrena para reconstruir bloques de texto ruidoso a partir de datos de ejemplo. Posteriormente, se aplica un proceso combinado de aprendizaje por refuerzo y destilación de muestreador, denominado SD·RL, que optimiza la calidad de las respuestas y reduce los pasos computacionales necesarios.

Este método ha aumentado en promedio diez puntos la calidad en pruebas de razonamiento y ha cuadruplicado la cantidad de tokens procesados por cada paso computacional. Además, las respuestas de DiffusionGemma son aproximadamente un 50 por ciento más cortas, lo que contribuye a mejorar aún más la velocidad de respuesta. A diferencia de los modelos de lenguaje estándar, DiffusionGemma puede corregir errores antes de finalizar la salida, desarrollando respuestas y razonamientos de manera paralela.

¿Quieres leer la nota completa? Accede al artículo original con todos los detalles.
Leer Artículo Original
TL;DR

Este artículo es un resumen original con fines informativos. Créditos de imagen y cobertura completa en la fuente original. · Ver Política de contenidos

Redacción
Redacción Equipo EsportsAMA

El equipo de redacción de EsportsAMA está formado por apasionados del gaming competitivo y los esports. Cubrimos a diario las principales noticias del sector, desde fichajes y torneos hasta novedades de tus juegos favoritos, con foco en la escena española y latinoamericana.

Presiona Enter para buscar o ESC para cerrar