Reflection lance Beam, modèle open-weight face aux IA chinoises
Original : Reflection debuts Beam, an open-weight AI model to rival Chinese models at lower compute cost
Pourquoi c'est important
Un modèle open-weight occidental performant face à DeepSeek change la donne en souveraineté IA.
Reflection AI dévoile Beam, modèle mixture-of-experts de 501 milliards de paramètres, conçu pour rivaliser avec les modèles chinois à 3 à 4 fois moins de calcul d'inférence, selon la startup de Brooklyn fondée en 2024.
Reflection AI sort officiellement Beam, son premier modèle frontier en open-weight. La startup de Brooklyn, fondée en 2024 par deux anciens chercheurs de Google DeepMind, affirme que Beam égale les performances des meilleurs modèles ouverts chinois sur les benchmarks de raisonnement avancé, mais à coût réduit.
Techniquement, Beam est un modèle mixture-of-experts de 501 milliards de paramètres au total, dont 23 milliards actifs. Il a été pré-entraîné sur 23,8 billions de tokens et dispose d'une fenêtre de contexte d'un million de tokens. À titre de comparaison, le GLM-5.2 de Z.ai totalise environ 744 milliards de paramètres avec 40 milliards actifs. Beam est uniquement textuel, contrairement à Inkling de Thinking Machines Lab — son rival américain le plus direct — qui est multimodal.
Selon ses propres benchmarks, non encore vérifiés de manière indépendante, Beam utilise « 3 à 4 fois moins de calcul d'inférence » que ses concurrents chinois tout en atteignant des scores comparables. La startup cible les entreprises, le secteur public et les nations souveraines avec un concept d'« AI factories » : permettre aux institutions de construire leurs propres systèmes IA locaux en entraînant les modèles Reflection sur leurs données propriétaires.
Reflection a levé environ 4,7 milliards de dollars auprès de Nvidia, Sequoia Capital et Lightspeed Venture Partners, pour une valorisation pré-money de 25 milliards. Cet été, elle a signé des contrats d'une valeur cumulée de plus de 7 milliards de dollars avec SpaceX et Nebius pour sécuriser l'accès aux puces Nvidia GB300 jusqu'en 2029.