Reflection AI a présenté Beam le 5 octobre 2026 : son premier modèle à poids ouverts, conçu pour le code, le raisonnement et les agents d’intelligence artificielle. L’entreprise le positionne comme une alternative aux grands modèles ouverts chinois et occidentaux. Mais ses promesses de performances et d’efficacité restent à confirmer tant que les poids et les détails d’évaluation ne sont pas accessibles à des vérifications indépendantes.
3
7
13
Une architecture pensée pour activer moins de paramètres
Beam est un modèle « mixture of experts » (MoE), ou à mélange d’experts : il compte 501 milliards de paramètres au total, mais environ 23 milliards sont activés pour traiter chaque jeton. Reflection indique l’avoir préentraîné sur 23 800 milliards de jetons, puis soumis à un entraînement par renforcement intensif. Selon l’entreprise, cette étape a généré plus de 100 millions de séquences d’entraînement, appelées « rollouts ».
14
La fenêtre de contexte annoncée peut atteindre un million de jetons. Il faut toutefois distinguer cette caractéristique du modèle de la capacité accessible via un service donné : des informations sur l’interface bêta font état d’une limite de 256 000 jetons. Les éléments disponibles ne permettent pas de conclure que cette limite s’applique à toutes les versions ou à tous les déploiements de Beam.
3
7
17
18
Des résultats prometteurs, mais encore déclaratifs
Reflection annonce un score de 80,9 % à SWE-bench Verified, un test axé sur la résolution de problèmes de programmation. Sur Terminal-Bench v2.1, qui évalue notamment des tâches en ligne de commande, une comparaison publiée attribue à Beam un score de 80,1, contre 81,0 pour GLM-5.2, 88,3 pour Kimi K3 et 90,6 pour DeepSeek V4.1 Flash. Beam pourrait donc être compétitif sur certaines tâches, mais ces chiffres ne montrent pas qu’il surpasse les principaux modèles ouverts chinois ou occidentaux dans leur ensemble.
12
20
L’entreprise affirme aussi que Beam atteint, sur certains benchmarks, un niveau de raisonnement comparable à celui de GLM-5.2. Elle estime que sa génération nécessite environ trois à quatre fois moins de calcul que celle de GLM-5.2, et plus de quatre fois moins que celle des principaux modèles ouverts occidentaux retenus dans ses comparaisons. Ce sont des estimations de l’entreprise, pas des mesures indépendantes démontrant que chaque utilisateur bénéficiera des mêmes économies de coût ou de latence.
13
16
Tant que les poids ne sont pas disponibles, il est impossible pour des évaluateurs externes de reproduire les tests. Les résultats peuvent aussi varier selon les protocoles, le matériel et les conditions d’utilisation. Les chiffres publiés ne suffisent donc pas à établir les performances de Beam sur d’autres tâches ni dans tous les environnements de déploiement.
7
13
Publication prévue et accès anticipé
Reflection prévoit de publier les poids de Beam sous licence Apache 2.0 plus tard en octobre 2026, sans avoir annoncé de date précise dans les informations disponibles. Cette licence permet notamment aux développeurs d’utiliser et d’adapter le modèle selon ses conditions. Des documents complémentaires, dont un rapport technique et une fiche de modèle, sont également évoqués, mais leur contenu n’est pas encore publié.
2
3
21
Dans l’intervalle, les personnes intéressées peuvent demander un accès anticipé via une liste d’attente. La publication de poids ouverts permettrait aux développeurs de faire tourner et d’adapter le modèle, mais cela ne garantit pas qu’il soit immédiatement prêt à être déployé dans une organisation donnée. Beam vise les développeurs, les entreprises et le secteur public ; les informations disponibles ne démontrent ni déploiement précis au sein d’une administration ni personnalisation à partir des données privées d’une institution.
1
5
31
Une annonce adossée à de lourds investissements en calcul
Beam s’inscrit dans une stratégie qui dépasse la seule publication d’un modèle. Des informations de presse font état d’un accord de 6,3 milliards de dollars avec SpaceX portant sur des systèmes Nvidia GB300, ainsi que d’un accord distinct avec le fournisseur de calcul Nebius. Ces contrats donnent une idée de l’ampleur des infrastructures mobilisées par Reflection, mais ils ne valident pas à eux seuls les performances de Beam ni les économies de calcul annoncées.
4
8
Pour l’instant, le plus utile est de distinguer les caractéristiques annoncées des comparaisons encore à vérifier. L’architecture, l’échelle d’entraînement et les usages visés sont présentés ; les performances relatives et l’efficacité en conditions réelles restent à tester lorsque les poids et les documents d’évaluation complets seront disponibles.
7
13
14