
Reflection Beam : un modèle open-weight MoE de 501 milliards
- Actus
- Rocks on Galaxy
- Tech
- 06 Oct, 2026
- 0
Un nouveau prétendant occidental à la frontière open-weight. Le 5 octobre 2026, Reflection a présenté Beam, son premier modèle à poids ouverts : un Mixture-of-Experts clairsemé de 501 milliards de paramètres, dont 23 milliards actifs par token, conçu pour le code, le raisonnement et les agents.
L’entraînement
- Pré-entraînement sur 23 800 milliards de tokens, en moins de quatre semaines sur 6 144 GPU NVIDIA GB300 NVL72
- Apprentissage par renforcement massif : plus de 100 millions de rollouts sur 10 500 GB300 pendant quatre semaines
- Fenêtre de contexte portée à 1 million de tokens
- Paramètre d’effort de raisonnement réglable
Benchmarks (annoncés par l’éditeur)
80,9 sur SWE-Bench Verified, 80,1 sur Terminal Bench v2.1, 90,5 sur GPQA Diamond. Reflection se dit au niveau de GLM 5.2 et proche de Qwen 3.8-Max en code et agents, tout en reconnaissant que Kimi K3 reste devant. Son argument : un raisonnement comparable à GLM-5.2 avec 3 à 4 fois moins de calcul à l’inférence.
Disponibilité
Beam est encore en red-teaming final ; un aperçu est ouvert via liste d’attente. Les poids sous licence Apache 2.0 sont annoncés pour ce mois-ci, avec rapport technique et model card. Le modèle est texte uniquement.
L’avis Rocks
Pour l’IA locale à côté de Home Assistant, 501B reste du matériel de datacenter, mais la licence Apache 2.0 et 23B actifs en font un candidat sérieux pour des agents de code auto-hébergés sur plusieurs GPU. D’ici la publication des poids, ces chiffres restent des promesses d’éditeur.
FAQ
Peut-on le télécharger ? Pas encore : accès sur liste d’attente, poids prévus fin octobre.
Multimodal ? Non, texte uniquement.