Misha Laskin
CEO. Dating research scientist sa Google DeepMind, kung saan nagtrabaho siya sa reinforcement learning at reward modeling para sa Gemini.
Ang kumpanya
Isang startup sa New York na itinatag noong 2024. Wala pang dalawang taon, nagbago ito mula sa paggawa ng mga autonomous coding agent tungo sa pagsasanay ng isa sa pinakamalalaking open-weight model na binuo sa labas ng China.
CEO. Dating research scientist sa Google DeepMind, kung saan nagtrabaho siya sa reinforcement learning at reward modeling para sa Gemini.
Co-founder. Isa sa mga pinakaunang engineer ng DeepMind at kasamang lumikha ng AlphaGo, AlphaZero at MuZero; kalaunan ay nagtrabaho sa reinforcement learning mula sa feedback ng tao para sa Gemini.
“Ang tanging paraan para magkaroon ng sariling intelihensiya ay, ayon sa depinisyon, gawin itong bukas — dahil kung bukas ito, mapapatakbo mo ito sa sarili mong mga sistema, maaangkin mo ito, makokontrol at mako-customize.”
Nagpalipas ang Reflection ng unang taon nito sa stealth mode at lumabas noong Marso 2025 na may $130 milyon at planong unahing bumuo ng mga autonomous coding system na superintelligent, saka palawakin ang mga ito para sa iba pang gawain sa computer. Ang una nitong produkto, ang Asimov, ay isang agent para sa pananaliksik ng code na tumutulong sa mga team na maunawaan ang malalaking codebase.
Noong Oktubre 2025, nakalikom ito ng $2 bilyon sa valuasyong $8 bilyon sa isang funding round na pinangunahan ng Nvidia, at muling itinampok ang mga bukas na frontier model para sa mga kompanya, pamahalaan, at pampublikong institusyong gustong magkaroon ng ganap na kontrol sa kanilang AI stack.
Ang Beam, na inanunsyo noong October 5, 2026, ang unang model ng bagong estratehiyang ito at una sa isang planadong serye. Kasabay nito, inilabas ng Reflection ang Mirror CLI, isang terminal coding agent na Beam ang ginagamit bilang default.
| Petsa | Round | Halaga | Valuation | Mga kilalang mamumuhunan |
|---|---|---|---|---|
| Marso 2025 | Seed at Series A | $130M | ≈ $545M | Sequoia Capital, CRV, Lightspeed Venture Partners, NVentures, Databricks, Reid Hoffman |
| Oktubre 2025 | Series B | $2B | $8B | Nvidia (nanguna), Citi, Sequoia, Lightspeed, Eric Schmidt, 1789 Capital, GIC, DST Global, B Capital |
| 2026 | Pinakahuling round | ≈ $2.5B | $25Bpre-money | Iniulat na kabilang sa mga lumahok ang JPMorgan at Disruptive |
Mga halaga at valuation ayon sa mga ulat ng Reuters, The Wall Street Journal at Business Insider. Hindi inilalathala ng Reflection ang buong detalye ng pagpopondo.
Isinagawa ang pretraining ng Beam gamit ang 6,144 NVIDIA GB300 NVL72 GPU, at ang reinforcement learning nito gamit ang humigit-kumulang 10,500 GB300 GPU. Noong Hunyo 2026, lumagda ang Reflection sa isang kasunduang tatagal nang maraming taon para sa mga GB300 system sa data center na Colossus 2 ng SpaceX, na nagkakahalaga ng hanggang $6.3 bilyon kung magpapatuloy ito hanggang 2029.
Noong March 2026, iniulat ng The Wall Street Journal na ginagamit ng ilang mamumuhunan ang pariralang ito. Diskarte, hindi nasyonalidad, ang tinutukoy ng paghahambing: tulad ng DeepSeek, tumataya ang Reflection sa mga episyenteng modelong inilalabas nang bukas ang mga weight. Ang kaibahan, kumpanyang Amerikano ito—mahalaga ito sa mga pamahalaan at negosyong ayaw gumamit ng mga modelong Tsino bilang pundasyon. Hindi pinalalaki ng sariling benchmark ng Reflection ang paghahambing: ipinapakita ng mga ito na lamang pa rin sa purong kakayahan ang mga open model na Tsino gaya ng Kimi K3 at Qwen 3.8 Max.