Misha Laskin
CEO. Mantan ilmuwan riset di Google DeepMind, tempat ia mengerjakan pembelajaran penguatan dan pemodelan reward untuk Gemini.
Perusahaan
Startup di New York yang didirikan pada 2024 ini beralih dari agen coding otonom ke pelatihan salah satu model berbobot terbuka terbesar yang dibuat di luar China dalam waktu kurang dari dua tahun.
CEO. Mantan ilmuwan riset di Google DeepMind, tempat ia mengerjakan pembelajaran penguatan dan pemodelan reward untuk Gemini.
Salah satu pendiri. Salah satu insinyur paling awal di DeepMind dan salah satu pencipta AlphaGo, AlphaZero, dan MuZero; kemudian mengerjakan pembelajaran penguatan dari umpan balik manusia untuk Gemini.
“Satu-satunya cara untuk memiliki kecerdasan, berdasarkan definisi, adalah dengan membuatnya terbuka—karena jika terbuka, Anda bisa menjalankannya di perangkat Anda, memilikinya, mengendalikannya, dan menyesuaikannya.”
Reflection menghabiskan tahun pertamanya dalam mode stealth dan muncul pada Maret 2025 dengan pendanaan $130 juta serta rencana untuk terlebih dahulu membangun sistem coding otonom yang supercerdas, lalu memperluasnya ke pekerjaan komputer lainnya. Produk pertamanya, Asimov, adalah agen riset kode yang membantu tim memahami basis kode berukuran besar.
Pada Oktober 2025, perusahaan ini mengumpulkan $2 miliar dengan valuasi $8 miliar dalam putaran yang dipimpin Nvidia, lalu mengalihkan fokus ke model frontier terbuka untuk perusahaan, pemerintah, dan lembaga publik yang menginginkan kendali penuh atas tumpukan AI mereka.
Beam, yang diumumkan pada 5 Oktober 2026, adalah model pertama dari strategi baru tersebut dan model pertama dalam rangkaian yang direncanakan. Bersamaan dengan peluncurannya, Reflection merilis Mirror CLI, agen coding terminal yang menggunakan Beam secara default.
| Tanggal | Putaran | Jumlah | Valuasi | Investor terkemuka |
|---|---|---|---|---|
| Maret 2025 | Pendanaan awal dan Seri A | $130M | ≈ $545M | Sequoia Capital, CRV, Lightspeed Venture Partners, NVentures, Databricks, Reid Hoffman |
| Oktober 2025 | Seri B | $2B | $8B | Nvidia (pemimpin), Citi, Sequoia, Lightspeed, Eric Schmidt, 1789 Capital, GIC, DST Global, B Capital |
| 2026 | Putaran terbaru | ≈ $2.5B | $25Bpra-uang | Peserta yang dilaporkan mencakup JPMorgan dan Disruptive |
Jumlah dan valuasi sebagaimana dilaporkan Reuters, The Wall Street Journal, dan Business Insider. Reflection tidak memublikasikan detail pendanaan lengkap.
Prapelatihan Beam berjalan menggunakan 6,144 GPU NVIDIA GB300 NVL72, sementara pembelajaran penguatannya menggunakan sekitar 10,500 GPU GB300. Pada Juni 2026, Reflection menandatangani perjanjian multiyear untuk sistem GB300 di pusat data Colossus 2 milik SpaceX, senilai hingga $6.3 miliar jika berlangsung hingga 2029.
Pada Maret 2026, The Wall Street Journal melaporkan bahwa beberapa investor menggunakan frasa tersebut. Perbandingan ini berkaitan dengan strategi, bukan kebangsaan: seperti DeepSeek, Reflection bertaruh pada model efisien dengan bobot yang dirilis secara terbuka. Bedanya, Reflection adalah perusahaan Amerika, yang penting bagi pemerintah dan perusahaan yang tidak ingin membangun produk di atas model Tiongkok. Tolok ukur Reflection sendiri menggambarkan perbandingan ini secara moderat: hasilnya menunjukkan bahwa model terbuka Tiongkok seperti Kimi K3 dan Qwen 3.8 Max masih unggul dalam kemampuan mentah.