Cara menggunakan
Cara menggunakan Beam hari ini
Beam sedang menjalani beta bertahap. Berikut semua cara untuk mengaksesnya sekarang, kode yang berfungsi untuk API kompatibel OpenAI, serta perubahan saat bobot terbuka dirilis.
Pilihan Anda saat ini
API beta Reflection
Daftar di platform Reflection dan bergabunglah dengan daftar tunggu. Setelah akses diaktifkan, Anda dapat membuat kunci API dan memanggil Beam melalui endpoint yang kompatibel dengan OpenAI.
Bergabung dengan daftar tungguMirror CLI
Agen coding terminal buatan Reflection, tersedia untuk macOS (Apple Silicon) dan Linux. Agen ini menggunakan Beam secara default dan memerlukan kunci API yang sama.
Panduan memulai MirrorMengobrol di browser
BeamAI.chat adalah situs obrolan independen yang akan beralih ke Beam segera setelah tersedia untuk umum. Sementara itu, situs ini menjalankan model terbuka yang sebanding dan menyatakannya dengan jelas.
Buka BeamAI.chatUnduh bobot model
Belum bisa. Reflection menjanjikan bobot model dengan lisensi Apache 2.0 pada akhir Oktober 2026. Kami memantau perilisannya setiap hari.
Pelacak rilisDari nol hingga permintaan pertama
- 01
Bergabung dengan daftar tunggu
Buat akun di platform.reflection.ai. Pengguna baru harus menunggu hingga akses mereka diaktifkan.
- 02
Buat kunci API
Di platform, buka API Keys dan buat kunci. Simpan kunci tersebut dalam variabel lingkungan REFLECTION_API_KEY.
- 03
Arahkan klien Anda ke Reflection
Gunakan URL dasar https://api.reflection.ai/openai/v1 dengan SDK OpenAI apa pun, serta ID model Beam-501B-A23B.
- 04
Kirim permintaan Chat Completions
Panggil Chat Completions seperti biasa. Secara opsional, atur reasoning_effort untuk menukar kecepatan dengan kedalaman.
Contoh kode
Endpoint ini mengikuti format OpenAI Chat Completions, sehingga SDK resmi OpenAI dapat digunakan setelah URL dasar dan kunci diubah.
Permintaan pertama
curl https://api.reflection.ai/openai/v1/chat/completions \
-H "Authorization: Bearer $REFLECTION_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "Beam-501B-A23B",
"messages": [{"role": "user", "content": "Explain Mixture-of-Experts in two sentences."}],
"reasoning_effort": "medium"
}'Streaming
stream = client.chat.completions.create(
model="Beam-501B-A23B",
messages=[{"role": "user", "content": "Write a haiku about sparse experts."}],
stream=True,
)
for chunk in stream:
delta = chunk.choices[0].delta
# reasoning arrives first in delta.reasoning_content, then the answer in delta.content
if delta.content:
print(delta.content, end="", flush=True)Variabel lingkungan
export REFLECTION_API_KEY="<your API key>"
# Tools that read the standard OpenAI variables and use Chat Completions
export OPENAI_BASE_URL="https://api.reflection.ai/openai/v1"
export OPENAI_API_KEY="$REFLECTION_API_KEY"
# Check which models your key can use
curl https://api.reflection.ai/openai/v1/models -H "Authorization: Bearer $REFLECTION_API_KEY"Tingkat penalaran
Beam selalu melakukan penalaran; tidak ada cara untuk menonaktifkannya. Parameter reasoning_effort mengontrol seberapa banyak. Nilai default-nya adalah medium.
| Nilai | Perilaku |
|---|---|
| low | Penalaran paling sedikit, latensi terendah. Untuk tugas sederhana. |
| medium | Keseimbangan antara kualitas dan latensi. Digunakan jika Anda tidak menyertakan parameter. |
| high | Penalaran lebih banyak untuk masalah yang lebih sulit. |
| xhigh | Penalaran lebih banyak daripada high. |
| max | Penalaran paling banyak, untuk masalah tersulit. |
Token penalaran dihitung dalam max_completion_tokens dan batas laju. Jika batasnya terlalu rendah, model dapat kehabisan token saat masih melakukan penalaran dan mengembalikan jawaban kosong dengan finish_reason "length". Teks penalaran dikembalikan secara terpisah dalam reasoning_content.
Yang berfungsi dan yang tidak
Didukung
- POST /chat/completions, GET /models, GET /models/{model}
- Streaming, termasuk penggunaan pada potongan terakhir
- Pemanggilan alat dengan tool_choice dan parallel_tool_calls
- Output terstruktur: json_object dan json_schema
- temperature, top_p, frequency_penalty, presence_penalty, max_completion_tokens, seed
- Peran system, developer, user, assistant, dan tool
Tidak didukung
- API untuk respons, embedding, gambar, audio, file, batch, dan asisten
- Input gambar, audio, atau file: Beam hanya menerima teks
- n selain 1, logprobs, logit_bias
- Parameter seperti user, metadata, audio, atau prediction (akan menghasilkan error)
- Urutan stop diterima, tetapi tidak berpengaruh
Batas laju
Batas berlaku per organisasi untuk jumlah permintaan dan token per menit serta per hari UTC, ditambah batas permintaan bersamaan. Jika salah satu batas terlampaui, akan muncul HTTP 429 dengan header Retry-After. Batas harian direset pada 00:00 UTC. Reflection belum memublikasikan cara meminta batas yang lebih tinggi, dan belum ada daftar harga publik untuk versi beta.
Agen coding
Mirror CLI terhubung ke Beam hanya dengan kunci API. Pi, OpenCode, dan Hermes dapat digunakan melalui setelan penyedia yang kompatibel dengan OpenAI: URL dasar https://api.reflection.ai/openai/v1, model Beam-501B-A23B, kunci dari REFLECTION_API_KEY. Mirror tidak mendukung Windows native.
curl -fsSL https://raw.githubusercontent.com/reflection-oss/mirror-beta/main/install.sh | bash
cd your-project
mirror # uses Reflection and Beam-501B-A23B by defaultMenjalankan Beam sendiri
Saat bobotnya dirilis, Beam dapat dijalankan menggunakan engine sumber terbuka; Reflection menyatakan bahwa mereka sedang mengerjakan integrasi dan mencari mitra peluncuran. Siapkan memori yang besar: semua 501 miliar parameter harus berada di memori GPU, meskipun hanya 23 miliar yang aktif untuk setiap token. Jumlahnya kira-kira 1 TB pada BF16, 500 GB pada FP8, dan 250 GB pada 4-bit, belum termasuk cache KV.