Misha Laskin
PDG. Ancien chercheur chez Google DeepMind, où il a travaillé sur l’apprentissage par renforcement et la modélisation des récompenses pour Gemini.
L’entreprise
Une startup new-yorkaise fondée en 2024 qui, en moins de deux ans, est passée des agents de programmation autonomes à l’entraînement de l’un des plus grands modèles à poids ouverts développés hors de Chine.
PDG. Ancien chercheur chez Google DeepMind, où il a travaillé sur l’apprentissage par renforcement et la modélisation des récompenses pour Gemini.
Cofondateur. L’un des premiers ingénieurs de DeepMind et l’un des créateurs d’AlphaGo, AlphaZero et MuZero ; il a ensuite travaillé sur l’apprentissage par renforcement à partir des retours humains pour Gemini.
“La seule façon de posséder l’intelligence, par définition, c’est qu’elle soit ouverte — parce que si elle est ouverte, vous pouvez l’exécuter sur vos propres machines, la posséder, la contrôler et la personnaliser.”
Reflection a passé sa première année en mode furtif, puis est sortie de l’ombre en mars 2025 avec 130 millions de dollars et un plan visant d’abord à créer des systèmes de programmation autonomes superintelligents, puis à s’étendre à d’autres tâches informatiques. Son premier produit, Asimov, était un agent de recherche sur le code qui aide les équipes à comprendre les grandes bases de code.
En octobre 2025, l’entreprise a levé 2 milliards de dollars sur la base d’une valorisation de 8 milliards de dollars, lors d’un tour mené par Nvidia. Elle s’est alors repositionnée autour de modèles ouverts de pointe destinés aux entreprises, aux gouvernements et aux institutions publiques qui souhaitent garder le contrôle total de leur pile d’IA.
Annoncé le October 5, 2026, Beam est le premier modèle de cette nouvelle stratégie et le premier d’une série prévue. En parallèle, Reflection a lancé Mirror CLI, un agent de programmation en ligne de commande qui utilise Beam par défaut.
| Date | Tour de financement | Montant | Valorisation | Investisseurs notables |
|---|---|---|---|---|
| mars 2025 | Seed et série A | $130M | ≈ $545M | Sequoia Capital, CRV, Lightspeed Venture Partners, NVentures, Databricks, Reid Hoffman |
| octobre 2025 | Série B | $2B | $8B | Nvidia (chef de file), Citi, Sequoia, Lightspeed, Eric Schmidt, 1789 Capital, GIC, DST Global, B Capital |
| 2026 | Dernière levée de fonds | ≈ $2.5B | $25Bpré-money | Les participants mentionnés incluent JPMorgan et Disruptive |
Montants et valorisations rapportés par Reuters, The Wall Street Journal et Business Insider. Reflection ne publie pas tous les détails de ses financements.
Le préentraînement de Beam a été effectué sur 6 144 GPU NVIDIA GB300 NVL72 et son apprentissage par renforcement sur environ 10 500 GPU GB300. En juin 2026, Reflection a signé un accord pluriannuel portant sur des systèmes GB300 dans le centre de données Colossus 2 de SpaceX, d'une valeur pouvant atteindre 6,3 milliards de dollars s'il se poursuit jusqu'en 2029.
En mars 2026, The Wall Street Journal a rapporté que certains investisseurs employaient cette expression. La comparaison porte sur la stratégie plutôt que sur la nationalité : comme DeepSeek, Reflection mise sur des modèles efficaces dont les poids sont publiés ouvertement. La différence, c'est qu'il s'agit d'une entreprise américaine, ce qui compte pour les gouvernements et les entreprises qui ne veulent pas s'appuyer sur des modèles chinois. Les propres benchmarks de Reflection nuancent la comparaison : ils montrent que des modèles chinois à poids ouverts comme Kimi K3 et Qwen 3.8 Max gardent une longueur d'avance en matière de capacités brutes.