Reflection Beam : un modèle open-weight MoE de 501 milliards

Reflection Beam : un modèle open-weight MoE de 501 milliards

  • Actus
  • Rocks on Galaxy
  • Tech
  • 06 Oct, 2026
  • 0

Un nouveau prétendant occidental à la frontière open-weight. Le 5 octobre 2026, Reflection a présenté Beam, son premier modèle à poids ouverts : un Mixture-of-Experts clairsemé de 501 milliards de paramètres, dont 23 milliards actifs par token, conçu pour le code, le raisonnement et les agents.

L’entraînement

  • Pré-entraînement sur 23 800 milliards de tokens, en moins de quatre semaines sur 6 144 GPU NVIDIA GB300 NVL72
  • Apprentissage par renforcement massif : plus de 100 millions de rollouts sur 10 500 GB300 pendant quatre semaines
  • Fenêtre de contexte portée à 1 million de tokens
  • Paramètre d’effort de raisonnement réglable

Benchmarks (annoncés par l’éditeur)

80,9 sur SWE-Bench Verified, 80,1 sur Terminal Bench v2.1, 90,5 sur GPQA Diamond. Reflection se dit au niveau de GLM 5.2 et proche de Qwen 3.8-Max en code et agents, tout en reconnaissant que Kimi K3 reste devant. Son argument : un raisonnement comparable à GLM-5.2 avec 3 à 4 fois moins de calcul à l’inférence.

Disponibilité

Beam est encore en red-teaming final ; un aperçu est ouvert via liste d’attente. Les poids sous licence Apache 2.0 sont annoncés pour ce mois-ci, avec rapport technique et model card. Le modèle est texte uniquement.

L’avis Rocks

Pour l’IA locale à côté de Home Assistant, 501B reste du matériel de datacenter, mais la licence Apache 2.0 et 23B actifs en font un candidat sérieux pour des agents de code auto-hébergés sur plusieurs GPU. D’ici la publication des poids, ces chiffres restent des promesses d’éditeur.

FAQ

Peut-on le télécharger ? Pas encore : accès sur liste d’attente, poids prévus fin octobre.

Multimodal ? Non, texte uniquement.