Saltar al contenido
ES EN

Beam, el primer modelo de pesos abiertos de Reflection AI, llega con dudas

Reflection AI presenta Beam, un modelo abierto de 501.000 millones de parámetros para código y agentes. Sus cifras son propias y aún no hay pesos.

En 30 segundos Reflection AI, startup respaldada por Nvidia y fundada por antiguos investigadores de Google DeepMind, ha presentado Beam, su primer modelo de pesos abiertos para código, razonamiento y tareas de agente. Los pesos se publicarán este mes bajo licencia Apache 2.0, pero todas las puntuaciones son de la propia empresa y no están verificadas de forma independiente.

Qué ha pasado

Según el blog de la compañía, Beam es un modelo de mezcla de expertos con 501.000 millones de parámetros en total, de los cuales solo 23.000 millones están activos a la vez. Se preentrenó con 23,8 billones de tokens y admite una ventana de contexto de un millón de tokens, tal como recoge The Next Web.

Beam, el primer modelo de pesos abiertos de Reflection AI, llega con dudas
Imagen: Unsplash — the nvidia logo is displayed on a table

En tareas de código y de agentes, Reflection afirma que Beam es competitivo con GLM 5.2 de Z.ai y se acerca a Qwen 3.8-Max de Alibaba, aunque Kimi K3 de Moonshot AI sigue por delante. En su tabla, Beam obtiene 80,1 en Terminal Bench v2.1 frente a 88,3 de Kimi K3, y 80,9 en SWE-bench Verified frente a 77,6 de Inkling. Su ventaja, dice, sería la eficiencia: igualaría a GLM-5.2 en razonamiento avanzado con tres o cuatro veces menos cómputo de inferencia, una cifra que la propia empresa describe como aproximada.

El preentrenamiento duró menos de cuatro semanas con 6.144 GPU Nvidia GB300, y el aprendizaje por refuerzo otras cuatro con 10.500 GPU, con más de 100 millones de intentos de tareas. Más detalles en TechCrunch.

La única forma de poseer inteligencia es, por definición, que sea abierta.

Misha Laskin, CEO de Reflection AI, en declaraciones a Semafor y en el podcast Sources

Por qué importa

Estados Unidos tenía pocos modelos abiertos de este tamaño frente a la oferta china. Beam se suma a iniciativas como los Nemotron de Nvidia y, si cumple lo prometido, daría a cualquiera la posibilidad de descargarlo, ejecutarlo en su hardware y ajustarlo con licencia Apache 2.0, junto con informe técnico, ficha del modelo y herramientas. Lo cubre también Semafor.

Reflection añade que entrenó un segundo modelo para seguridad y alineamiento y lo fusionó con el primero, y que publicará sus pruebas de seguridad internas. Dos organismos públicos, uno estadounidense y el AI Safety Institute británico, lo evalúan junto a la empresa.

Qué no sabemos aún

  • Los pesos todavía no están publicados: solo hay una versión temprana para un grupo reducido mediante lista de espera.
  • Beam sigue en red-teaming y evaluaciones finales, y los resultados de seguridad llegarán con el informe técnico.
  • Todas las puntuaciones proceden de Reflection y The Next Web no las ha verificado de forma independiente.
  • El ahorro de cómputo es una comparación aproximada, no un coste medido.

Nuestra recomendación es sencilla: esperar a los pesos, al informe técnico y a pruebas externas antes de planificar nada sobre Beam.

Fuente original: thenextweb.com

Elaborado con apoyo de IA y revisado por la redacción

Dune

· Editora de verificación · Dubái

«Una eficiencia declarada como aproximada y puntuaciones propias son una invitación a verificar, no una conclusión.»

Comentarios

Publicar un comentario