Misha Laskin
CEO. Voormalig onderzoekswetenschapper bij Google DeepMind, waar hij werkte aan reinforcement learning en beloningsmodellering voor Gemini.
Het bedrijf
Een startup uit New York, opgericht in 2024, die in minder dan twee jaar overstapte van autonome codeeragents naar het trainen van een van de grootste open-gewichtenmodellen die buiten China zijn gebouwd.
CEO. Voormalig onderzoekswetenschapper bij Google DeepMind, waar hij werkte aan reinforcement learning en beloningsmodellering voor Gemini.
Medeoprichter. Een van de eerste ingenieurs bij DeepMind en medeontwikkelaar van AlphaGo, AlphaZero en MuZero; werkte later aan reinforcement learning op basis van menselijke feedback voor Gemini.
“De enige manier om intelligentie te bezitten, is per definitie door haar open te maken — want als ze open is, kun je haar op je eigen apparatuur draaien, bezitten, beheren en aanpassen.”
Reflection werkte het eerste jaar in stealth en kwam in maart 2025 naar buiten met $130 miljoen en een plan om eerst superintelligente autonome codesystemen te bouwen en zich daarna uit te breiden naar ander computerwerk. Het eerste product, Asimov, was een codeonderzoeksagent die teams helpt grote codebases te begrijpen.
In oktober 2025 haalde het bedrijf $2 miljard op bij een waardering van $8 miljard in een financieringsronde onder leiding van Nvidia. Het verlegde zijn focus naar open frontiermodellen voor bedrijven, overheden en publieke instellingen die volledige controle over hun AI-stack willen.
Beam, aangekondigd op 5 oktober 2026, is het eerste model van die nieuwe strategie en het eerste in een geplande reeks. Tegelijkertijd bracht Reflection Mirror CLI uit, een terminalcodeeragent die standaard Beam gebruikt.
| Datum | Ronde | Bedrag | Waardering | Bekende investeerders |
|---|---|---|---|---|
| maart 2025 | Seed- en Series A-ronde | $130M | ≈ $545M | Sequoia Capital, CRV, Lightspeed Venture Partners, NVentures, Databricks, Reid Hoffman |
| oktober 2025 | Series B | $2B | $8B | Nvidia (lead), Citi, Sequoia, Lightspeed, Eric Schmidt, 1789 Capital, GIC, DST Global, B Capital |
| 2026 | Laatste financieringsronde | ≈ $2.5B | $25Bpre-money | Volgens berichten namen onder meer JPMorgan en Disruptive deel |
Bedragen en waarderingen zoals gemeld door Reuters, The Wall Street Journal en Business Insider. Reflection publiceert geen volledige financieringsdetails.
De voortraining van Beam draaide op 6,144 NVIDIA GB300 NVL72-GPU's en de reinforcement learning op ongeveer 10,500 GB300-GPU's. In juni 2026 sloot Reflection een meerjarige overeenkomst voor GB300-systemen in het datacenter Colossus 2 van SpaceX, ter waarde van maximaal $6.3 miljard als de overeenkomst tot en met 2029 loopt.
In maart 2026 berichtte The Wall Street Journal dat sommige investeerders deze term gebruikten. De vergelijking gaat over de strategie, niet over nationaliteit: net als DeepSeek zet Reflection in op efficiënte modellen waarvan de gewichten openbaar worden vrijgegeven. Het verschil is dat Reflection een Amerikaans bedrijf is, iets wat van belang is voor overheden en bedrijven die niet op Chinese modellen willen bouwen. De eigen benchmarks van Reflection zijn bescheiden over de vergelijking: ze laten zien dat Chinese open modellen zoals Kimi K3 en Qwen 3.8 Max nog steeds voorlopen op het gebied van pure modelcapaciteit.