El innovador modelo Shieldstral de Mistral redefine la seguridad en espacios reducidos

El nuevo modelo Shieldstral de Mistral, con 3 mil millones de parámetros, supera a modelos tres veces más grandes en métricas de seguridad, redefiniendo cómo clasificamos contenido.

El innovador modelo Shieldstral de Mistral redefine la seguridad en espacios reducidos
NeboAI Te resumo la noticia con datos, cifras y contexto
EN 30 SEGUNDOS

EN 1 ORACIÓN

SENTIMIENTO
Neutro

𒀭
NeboAI está trabajando, aguarda un instante...
Preparando análisis detallado
Resumen rápido completado
Extrayendo datos, cifras y citas...
Identificando protagonistas y contexto
ANÁLISIS DETALLADO
COMPARTIR

NeboAI produce ediciones automáticas de textos periodísticos en forma de resúmenes y análisis. Sus resultados experimentales están basados en inteligencia artificial. Por tratarse de una edición de IA, los textos eventualmente pueden contener errores, omisiones, establecer relaciones equivocadas entre datos y otras inexactitudes imprevistas. Recomendamos chequear la edición.

El modelo Shieldstral de la empresa francesa Mistral ha demostrado un rendimiento notable al igualar los resultados de modelos mucho más grandes en pruebas de seguridad de texto. Este modelo, que cuenta con 3 mil millones de parámetros, ha establecido un nuevo récord en la clasificación conjunta de texto e imagen, según un nuevo estudio. Los investigadores han propuesto un enfoque innovador que reemplaza las categorías de seguridad fijas por preguntas simples que los operadores pueden definir en tiempo real.

Los autores del estudio, incluido el cofundador de Mistral, Guillaume Lample, argumentan que los modelos tradicionales suelen agrupar riesgos de manera inadecuada. Esto se debe a que los conjuntos de datos de seguridad pública no se ajustan a una única taxonomía, lo que limita su efectividad en diferentes contextos. El modelo Shieldstral permite a los operadores formular criterios de revisión en lenguaje sencillo y obtener respuestas de "sí" o "no", generando un puntaje de seguridad entre cero y uno.

Para entrenar Shieldstral, se utilizaron aproximadamente 54.1 millones de ejemplos que abarcan contenido seguro, dañino y intentos de manipulación. Los investigadores aplicaron estándares estrictos a la manipulación dirigida y más flexibles a los datos de seguridad generales. Cada ejemplo de entrenamiento incluye instrucciones específicas, una pregunta de "sí" o "no", y el contenido a revisar, lo que permite al modelo aprender distinciones más finas en la evaluación de contenido.

¿Quieres leer la nota completa? Accede al artículo original con todos los detalles.
Leer Artículo Original
TL;DR

Este artículo es un resumen original con fines informativos. Créditos de imagen y cobertura completa en la fuente original. · Ver Política de contenidos

Redacción
Redacción Equipo EsportsAMA

El equipo de redacción de EsportsAMA está formado por apasionados del gaming competitivo y los esports. Cubrimos a diario las principales noticias del sector, desde fichajes y torneos hasta novedades de tus juegos favoritos, con foco en la escena española y latinoamericana.

Presiona Enter para buscar o ESC para cerrar