Misha Laskin
CEO อดีตนักวิจัยของ Google DeepMind ซึ่งทำงานด้านการเรียนรู้แบบเสริมกำลังและการสร้างแบบจำลองรางวัลสำหรับ Gemini
บริษัท
สตาร์ตอัปในนิวยอร์กที่ก่อตั้งในปี 2024 ซึ่งเปลี่ยนจากการพัฒนาเอเจนต์เขียนโค้ดอัตโนมัติมาฝึกหนึ่งในโมเดลแบบเปิดน้ำหนักที่ใหญ่ที่สุดซึ่งสร้างขึ้นนอกประเทศจีนภายในเวลาไม่ถึงสองปี
CEO อดีตนักวิจัยของ Google DeepMind ซึ่งทำงานด้านการเรียนรู้แบบเสริมกำลังและการสร้างแบบจำลองรางวัลสำหรับ Gemini
ผู้ร่วมก่อตั้ง หนึ่งในวิศวกรรุ่นแรก ๆ ของ DeepMind และผู้ร่วมสร้าง AlphaGo, AlphaZero และ MuZero ต่อมาได้ทำงานด้านการเรียนรู้แบบเสริมกำลังจากความคิดเห็นของมนุษย์สำหรับ Gemini
“วิธีเดียวที่จะเป็นเจ้าของปัญญาได้ ตามนิยามแล้ว คือการทำให้มันเปิด เพราะถ้ามันเปิด คุณก็เรียกใช้งานบนอุปกรณ์ของคุณได้ เป็นเจ้าของได้ ควบคุมได้ และปรับแต่งได้”
Reflection ใช้ปีแรกไปกับการพัฒนาอย่างเงียบ ๆ ก่อนเปิดตัวในเดือนมีนาคม 2025 พร้อมเงินทุน $130 ล้านและแผนสร้างระบบเขียนโค้ดอัตโนมัติที่ฉลาดเหนือมนุษย์เป็นอย่างแรก แล้วจึงขยายไปสู่งานด้านคอมพิวเตอร์ประเภทอื่น ผลิตภัณฑ์แรก Asimov เป็นเอเจนต์สำหรับค้นคว้าโค้ดที่ช่วยให้ทีมทำความเข้าใจฐานโค้ดขนาดใหญ่
ในเดือนตุลาคม 2025 บริษัทระดมทุนได้ $2 พันล้าน ที่มูลค่าประเมิน $8 พันล้าน ในรอบที่ Nvidia เป็นผู้นำ และปรับทิศทางธุรกิจไปสู่โมเดลแนวหน้าแบบเปิดสำหรับบริษัท รัฐบาล และสถาบันสาธารณะที่ต้องการควบคุมระบบ AI ของตนได้อย่างเต็มที่
Beam ซึ่งประกาศเมื่อ October 5, 2026 เป็นโมเดลแรกภายใต้กลยุทธ์ใหม่นี้ และเป็นโมเดลแรกในชุดที่วางแผนไว้ นอกจากนั้น Reflection ยังเปิดตัว Mirror CLI ซึ่งเป็นเอเจนต์เขียนโค้ดบนเทอร์มินัลที่ใช้ Beam เป็นค่าเริ่มต้น
| วันที่ | รอบการระดมทุน | จำนวนเงิน | มูลค่าประเมิน | นักลงทุนรายสำคัญ |
|---|---|---|---|---|
| มีนาคม 2568 | รอบ Seed และ Series A | $130M | ≈ $545M | Sequoia Capital, CRV, Lightspeed Venture Partners, NVentures, Databricks, Reid Hoffman |
| ตุลาคม 2568 | รอบ Series B | $2B | $8B | Nvidia (ผู้ลงทุนหลัก), Citi, Sequoia, Lightspeed, Eric Schmidt, 1789 Capital, GIC, DST Global, B Capital |
| 2026 | รอบล่าสุด | ≈ $2.5B | $25Bก่อนการระดมทุน | มีรายงานว่า JPMorgan และ Disruptive เข้าร่วมด้วย |
จำนวนเงินและมูลค่าประเมินตามที่ Reuters, The Wall Street Journal และ Business Insider รายงาน Reflection ไม่เปิดเผยรายละเอียดการระดมทุนทั้งหมด
การฝึกล่วงหน้าของ Beam ใช้ NVIDIA GB300 NVL72 จำนวน 6,144 GPU ส่วนการเรียนรู้แบบเสริมกำลังใช้ GB300 ประมาณ 10,500 GPU ในเดือนมิถุนายน 2026 Reflection ลงนามข้อตกลงหลายปีสำหรับระบบ GB300 ที่ศูนย์ข้อมูล Colossus 2 ของ SpaceX ซึ่งมีมูลค่าสูงสุด $6.3 พันล้าน หากใช้งานต่อเนื่องไปจนถึงปี 2029
ในเดือนมีนาคม 2026 The Wall Street Journal รายงานว่านักลงทุนบางรายใช้คำนี้ การเปรียบเทียบนี้พูดถึงกลยุทธ์ ไม่ใช่สัญชาติ กล่าวคือ Reflection เดิมพันกับโมเดลประสิทธิภาพสูงที่เปิดเผยน้ำหนักอย่างเปิดกว้าง เช่นเดียวกับ DeepSeek ความแตกต่างคือ Reflection เป็นบริษัทอเมริกัน ซึ่งมีความสำคัญต่อรัฐบาลและองค์กรที่ไม่ต้องการพัฒนาต่อยอดจากโมเดลจีน ผลการทดสอบของ Reflection เองก็แสดงให้เห็นว่าการเปรียบเทียบนี้มีข้อจำกัด โดยโมเดลเปิดของจีนอย่าง Kimi K3 และ Qwen 3.8 Max ยังนำหน้าในด้านความสามารถดิบ