Misha Laskin
CEO。曾任 Google DeepMind 研究科学家,期间从事 Gemini 的强化学习和奖励建模研究。
公司
这家纽约初创公司成立于 2024 年,不到两年便从自主编程智能体转向训练中国以外规模最大的开放权重模型之一。
CEO。曾任 Google DeepMind 研究科学家,期间从事 Gemini 的强化学习和奖励建模研究。
联合创始人。DeepMind 最早的一批工程师之一,也是 AlphaGo、AlphaZero 和 MuZero 的共同创作者;后来从事 Gemini 的人类反馈强化学习研究。
“拥有智能的唯一方式,按定义来说,就是让它开放——因为只要它是开放的,你就能在自己的设备上运行它,真正拥有它、控制它并按需定制。”
Reflection 首年处于隐身状态,并于 2025 年 3 月公开亮相,获得1.3亿美元资金,并计划先构建超智能自主编程系统,再拓展到其他计算机任务。其首款产品 Asimov 是一款代码研究智能体,可帮助团队理解大型代码库。
2025 年 10 月,Reflection 在由 Nvidia 领投的一轮融资中筹集了20亿美元,估值达80亿美元,并将业务重心转向面向企业、政府和公共机构的开放前沿模型,让这些客户能够全面掌控自己的 AI 技术栈。
Beam 于 October 5, 2026 发布,是这一新战略的首款模型,也是计划推出的系列模型中的第一款。Reflection 同时发布了 Mirror CLI,这是一款默认使用 Beam 的终端编程智能体。
| 日期 | 轮次 | 金额 | 估值 | 知名投资方 |
|---|---|---|---|---|
| 2025年3月 | 种子轮和 A 轮 | $130M | ≈ $545M | Sequoia Capital、CRV、Lightspeed Venture Partners、NVentures、Databricks、Reid Hoffman |
| 2025年10月 | B 轮 | $2B | $8B | Nvidia(领投)、Citi、Sequoia、Lightspeed、Eric Schmidt、1789 Capital、GIC、DST Global、B Capital |
| 2026 | 最新一轮 | ≈ $2.5B | $25B投前 | 据报道,参与方包括 JPMorgan 和 Disruptive |
金额和估值数据据 Reuters、The Wall Street Journal 和 Business Insider 报道。Reflection 未公布完整的融资详情。
Beam 的预训练使用了 6,144 块 NVIDIA GB300 NVL72 GPU,强化学习则使用了约 10,500 块 GB300 GPU。2026 年 6 月,Reflection 签署了一项多年期协议,将在 SpaceX 的 Colossus 2 数据中心部署 GB300 系统;若协议持续至 2029 年,价值最高可达63亿美元。
2026 年 3 月,The Wall Street Journal 报道称,一些投资者在使用这一说法。这一比较关乎战略,而非国籍:和 DeepSeek 一样,Reflection 也押注于高效模型,并公开发布模型权重。不同之处在于,Reflection 是一家美国公司,这对不想基于中国模型构建产品的政府和企业来说很重要。Reflection 自己发布的基准测试对这一比较持较为谨慎的态度:结果显示,Kimi K3 和 Qwen 3.8 Max 等中国开源模型在原始能力方面仍然领先。