Chuyển đến nội dung
reflectionbeam

Đối đầu

Beam vs Kimi K3

1:13

Beam thắng 1 trên tổng số 14 benchmark chung

Kết luận

Chính Reflection nêu Kimi K3 là mô hình vẫn dẫn trước về năng lực thuần. Kimi K3 thắng 13 trong 14 benchmark chung, thường dẫn hơn 10 điểm ở các tác vụ lập trình tác tử và tìm kiếm. Chiến thắng duy nhất của Beam là τ³ banking. Đổi lại, Kimi K3 có quy mô lớn: 2.8 nghìn tỷ tham số, trong đó 104 tỷ tham số hoạt động trên mỗi token, gấp khoảng 4.5 lần con số 23 tỷ của Beam; trọng số của mẫu này chiếm khoảng 1.4 TB ngay cả ở dạng 4-bit.

So sánh từng benchmark

BenchmarkBeamKimi K3Chênh lệch
DeepSWE v1.144,468,0-23,6
SWE-Bench Pro v2-Hard77,288,2-11,0
Terminal-Bench v2.180,188,3-8,2
SWE Atlas Codebase QnA34,668,0-33,4
Humanity's Last Exam (no tools)36,246,9-10,7
SciCode49,758,7-9,0
CritPt (AA)16,323,4-7,1
GPQA Diamond90,593,5-3,0
AutomationBench (public)37,046,7-9,7
MCP Atlas78,782,3-3,6
τ³ banking38,037,1+0,9
BrowseComp (context mgmt)77,491,2-13,8
DeepSearchQA (context mgmt)80,195,0-14,9
AA-LCR (long context)79,388,7-9,4

Tất cả điểm số đều lấy từ thông báo của Reflection (bản cập nhật October 8, 2026). Điểm số của Kimi K3 là số liệu Reflection trích dẫn từ Artificial Analysis và DataCurve.

Hai mô hình

BeamKimi K3
Nhà phát triểnReflection AIMoonshot AI
Có trụ sở tạiHoa KỳTrung Quốc
Tham số (tổng / đang hoạt động)501B / 23B2.8T / 104B
Trọng sốApache 2.0, được hứa hẹn ra mắt vào cuối October 2026Kimi K3 License (custom)
Phát hành5 tháng 10, 202616 tháng 7, 2026
Cách truy cậpAPI beta theo danh sách chờ; trọng số sẽ ra mắt sauHugging Face, Moonshot API, OpenRouter

Các so sánh khác