Đối đầu
Beam vs DeepSeek V4.1 Flash
Beam thắng 2 trên tổng số 9 benchmark chung
Kết luận
DeepSeek V4.1 Flash dẫn trước ở 7 trong 9 benchmark chung, với khoảng cách lớn ở DeepSWE và AutomationBench, cùng mức dẫn trước 10 điểm trên Terminal-Bench. Beam thắng ở CritPt và có chỉ số AA Omniscience tốt hơn, vốn trừ điểm cho các câu trả lời sai nhưng được khẳng định chắc chắn. Xét về hiệu quả, Beam không có lợi thế trong trường hợp này: DeepSeek V4.1 Flash chỉ kích hoạt 16 tỷ tham số cho mỗi token được tạo ra, ít hơn 23 tỷ của Beam, và trọng số của mẫu này đã được công khai theo giấy phép MIT.
So sánh từng benchmark
| Benchmark | Beam | DeepSeek V4.1 Flash | Chênh lệch | |
|---|---|---|---|---|
| DeepSWE v1.1 | 44,4 | 74,2 | -29,8 | |
| Terminal-Bench v2.1 | 80,1 | 90,6 | -10,5 | |
| Humanity's Last Exam (no tools) | 36,2 | 39,1 | -2,9 | |
| SciCode | 49,7 | 52,0 | -2,3 | |
| CritPt (AA) | 16,3 | 14,3 | +2,0 | |
| GPQA Diamond | 90,5 | 90,9 | -0,4 | |
| AutomationBench (public) | 37,0 | 54,8 | -17,8 | |
| AA-LCR (long context) | 79,3 | 84,0 | -4,7 | |
| AA Omniscience index (public split) | 13,0 | 6,6 | +6,4 |
Tất cả điểm số đều lấy từ thông báo của Reflection (bản cập nhật October 8, 2026). Điểm số của DeepSeek V4.1 Flash là số liệu Reflection trích dẫn từ Artificial Analysis và DataCurve.
Hai mô hình
| Beam | DeepSeek V4.1 Flash | |
|---|---|---|
| Nhà phát triển | Reflection AI | DeepSeek |
| Có trụ sở tại | Hoa Kỳ | Trung Quốc |
| Tham số (tổng / đang hoạt động) | 501B / 23B | 552B / 16B |
| Trọng số | Apache 2.0, được hứa hẹn ra mắt vào cuối October 2026 | MIT |
| Phát hành | 5 tháng 10, 2026 | 10 tháng 9, 2026 |
| Cách truy cập | API beta theo danh sách chờ; trọng số sẽ ra mắt sau | Hugging Face, DeepSeek API, OpenRouter |
Các so sánh khác
Z.ai (Zhipu AI)
Beam vs GLM 5.2
Moonshot AI
Beam vs Kimi K3
Alibaba (Qwen)
Beam vs Qwen 3.8 Max
Z.ai (Zhipu AI)
Beam vs GLM 5.3
NVIDIA
Beam vs Nemotron 3 Ultra
Thinking Machines Lab