Reflection presentó Beam, un modelo de pesos abiertos orientado a programación, razonamiento y tareas agénticas, con 501.000 millones de parámetros totales y 23.000 millones activos por token.
El anuncio llega con el sistema todavía en evaluaciones finales y pruebas de seguridad, aunque la empresa ya ofrece acceso anticipado a un grupo limitado de usuarios.
Un modelo de gran escala con menos cómputo activo
Beam pertenece a la familia de modelos de Mezcla de Expertos, una arquitectura que reparte el procesamiento entre expertos especializados. Reflection sostiene que esa estructura le permite reducir el cómputo de inferencia frente a modelos comparables.
La compañía afirma que Beam puede acercarse a resultados de modelos abiertos más grandes y que su ventaja principal no es una superioridad general, sino una mayor eficiencia durante el uso.
En los resultados divulgados, Beam obtuvo 80,9 en SWE-Bench Verified y 80,1 en Terminal-Bench 2.1, además de 77,2 en SWE-Bench Pro v2-Hard.
En razonamiento, marcó 97,8 en AIME 2026, 90,5 en GPQA Diamond y 36,2 en Humanity’s Last Exam sin herramientas.
Más de 100 millones de rollouts y 10.500 GPU
Reflection atribuye parte del rendimiento de Beam a una combinación de preentrenamiento y aprendizaje por refuerzo a gran escala. Según la empresa, ejecutó más de 100 millones de rollouts durante cuatro semanas con 10.500 GPU NVIDIA GB300.
El entrenamiento y la calificación usaron aproximadamente 1.300 millones de sandboxes, y la plataforma mantuvo un promedio de 110.000 rollouts concurrentes durante el proceso.
La compañía también señala que Beam recibió preentrenamiento con 23,8 billones de tokens de la web, fuentes públicas y conjuntos de datos propietarios con licencia. Reflection dice que eliminó alrededor del 95% de los tokens crudos de Internet mediante análisis, deduplicación y filtrado de calidad.
El preentrenamiento completo tomó menos de cuatro semanas en un clúster de 6.144 GPU NVIDIA GB300 NVL72.
Acceso anticipado y publicación bajo Apache 2.0
Reflection prevé publicar los pesos, el informe técnico, la ficha del modelo y recursos para desarrolladores a finales del mes de su anuncio, bajo licencia Apache 2.0, una vez terminen las evaluaciones de seguridad.
Antes de esa publicación, la empresa mantiene Beam en red teaming y validaciones finales. También planea abrir las evaluaciones de seguridad que desarrolló internamente.
La compañía publicó una demostración en X sobre Beam:
Reflection describe Beam como el primer modelo de una serie y asegura que ya trabaja en el siguiente.



