Reflection AI presenta Beam, un modelo abierto de 501.000 millones de parámetros para código y agentes. Sus cifras son propias y aún no hay pesos.
Qué ha pasado
Según el blog de la compañía, Beam es un modelo de mezcla de expertos con 501.000 millones de parámetros en total, de los cuales solo 23.000 millones están activos a la vez. Se preentrenó con 23,8 billones de tokens y admite una ventana de contexto de un millón de tokens, tal como recoge The Next Web.

En tareas de código y de agentes, Reflection afirma que Beam es competitivo con GLM 5.2 de Z.ai y se acerca a Qwen 3.8-Max de Alibaba, aunque Kimi K3 de Moonshot AI sigue por delante. En su tabla, Beam obtiene 80,1 en Terminal Bench v2.1 frente a 88,3 de Kimi K3, y 80,9 en SWE-bench Verified frente a 77,6 de Inkling. Su ventaja, dice, sería la eficiencia: igualaría a GLM-5.2 en razonamiento avanzado con tres o cuatro veces menos cómputo de inferencia, una cifra que la propia empresa describe como aproximada.
El preentrenamiento duró menos de cuatro semanas con 6.144 GPU Nvidia GB300, y el aprendizaje por refuerzo otras cuatro con 10.500 GPU, con más de 100 millones de intentos de tareas. Más detalles en TechCrunch.
La única forma de poseer inteligencia es, por definición, que sea abierta.
Misha Laskin, CEO de Reflection AI, en declaraciones a Semafor y en el podcast Sources
Por qué importa
Estados Unidos tenía pocos modelos abiertos de este tamaño frente a la oferta china. Beam se suma a iniciativas como los Nemotron de Nvidia y, si cumple lo prometido, daría a cualquiera la posibilidad de descargarlo, ejecutarlo en su hardware y ajustarlo con licencia Apache 2.0, junto con informe técnico, ficha del modelo y herramientas. Lo cubre también Semafor.
Reflection añade que entrenó un segundo modelo para seguridad y alineamiento y lo fusionó con el primero, y que publicará sus pruebas de seguridad internas. Dos organismos públicos, uno estadounidense y el AI Safety Institute británico, lo evalúan junto a la empresa.
Qué no sabemos aún
- Los pesos todavía no están publicados: solo hay una versión temprana para un grupo reducido mediante lista de espera.
- Beam sigue en red-teaming y evaluaciones finales, y los resultados de seguridad llegarán con el informe técnico.
- Todas las puntuaciones proceden de Reflection y The Next Web no las ha verificado de forma independiente.
- El ahorro de cómputo es una comparación aproximada, no un coste medido.
Nuestra recomendación es sencilla: esperar a los pesos, al informe técnico y a pruebas externas antes de planificar nada sobre Beam.
Fuente original: thenextweb.com
Elaborado con apoyo de IA y revisado por la redacción



Comentarios
Publicar un comentario