Lewati ke konten
reflectionbeam

Cara menggunakan

Cara menggunakan Beam hari ini

Beam sedang menjalani beta bertahap. Berikut semua cara untuk mengaksesnya sekarang, kode yang berfungsi untuk API kompatibel OpenAI, serta perubahan saat bobot terbuka dirilis.

Pilihan Anda saat ini

Dari nol hingga permintaan pertama

  1. 01

    Bergabung dengan daftar tunggu

    Buat akun di platform.reflection.ai. Pengguna baru harus menunggu hingga akses mereka diaktifkan.

  2. 02

    Buat kunci API

    Di platform, buka API Keys dan buat kunci. Simpan kunci tersebut dalam variabel lingkungan REFLECTION_API_KEY.

  3. 03

    Arahkan klien Anda ke Reflection

    Gunakan URL dasar https://api.reflection.ai/openai/v1 dengan SDK OpenAI apa pun, serta ID model Beam-501B-A23B.

  4. 04

    Kirim permintaan Chat Completions

    Panggil Chat Completions seperti biasa. Secara opsional, atur reasoning_effort untuk menukar kecepatan dengan kedalaman.

Contoh kode

Endpoint ini mengikuti format OpenAI Chat Completions, sehingga SDK resmi OpenAI dapat digunakan setelah URL dasar dan kunci diubah.

Permintaan pertama

curl https://api.reflection.ai/openai/v1/chat/completions \
  -H "Authorization: Bearer $REFLECTION_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "Beam-501B-A23B",
    "messages": [{"role": "user", "content": "Explain Mixture-of-Experts in two sentences."}],
    "reasoning_effort": "medium"
  }'

Streaming

stream = client.chat.completions.create(
    model="Beam-501B-A23B",
    messages=[{"role": "user", "content": "Write a haiku about sparse experts."}],
    stream=True,
)

for chunk in stream:
    delta = chunk.choices[0].delta
    # reasoning arrives first in delta.reasoning_content, then the answer in delta.content
    if delta.content:
        print(delta.content, end="", flush=True)

Variabel lingkungan

export REFLECTION_API_KEY="<your API key>"

# Tools that read the standard OpenAI variables and use Chat Completions
export OPENAI_BASE_URL="https://api.reflection.ai/openai/v1"
export OPENAI_API_KEY="$REFLECTION_API_KEY"

# Check which models your key can use
curl https://api.reflection.ai/openai/v1/models -H "Authorization: Bearer $REFLECTION_API_KEY"

Tingkat penalaran

Beam selalu melakukan penalaran; tidak ada cara untuk menonaktifkannya. Parameter reasoning_effort mengontrol seberapa banyak. Nilai default-nya adalah medium.

NilaiPerilaku
lowPenalaran paling sedikit, latensi terendah. Untuk tugas sederhana.
mediumKeseimbangan antara kualitas dan latensi. Digunakan jika Anda tidak menyertakan parameter.
highPenalaran lebih banyak untuk masalah yang lebih sulit.
xhighPenalaran lebih banyak daripada high.
maxPenalaran paling banyak, untuk masalah tersulit.

Token penalaran dihitung dalam max_completion_tokens dan batas laju. Jika batasnya terlalu rendah, model dapat kehabisan token saat masih melakukan penalaran dan mengembalikan jawaban kosong dengan finish_reason "length". Teks penalaran dikembalikan secara terpisah dalam reasoning_content.

Yang berfungsi dan yang tidak

Didukung

  • POST /chat/completions, GET /models, GET /models/{model}
  • Streaming, termasuk penggunaan pada potongan terakhir
  • Pemanggilan alat dengan tool_choice dan parallel_tool_calls
  • Output terstruktur: json_object dan json_schema
  • temperature, top_p, frequency_penalty, presence_penalty, max_completion_tokens, seed
  • Peran system, developer, user, assistant, dan tool

Tidak didukung

  • API untuk respons, embedding, gambar, audio, file, batch, dan asisten
  • Input gambar, audio, atau file: Beam hanya menerima teks
  • n selain 1, logprobs, logit_bias
  • Parameter seperti user, metadata, audio, atau prediction (akan menghasilkan error)
  • Urutan stop diterima, tetapi tidak berpengaruh

Batas laju

Batas berlaku per organisasi untuk jumlah permintaan dan token per menit serta per hari UTC, ditambah batas permintaan bersamaan. Jika salah satu batas terlampaui, akan muncul HTTP 429 dengan header Retry-After. Batas harian direset pada 00:00 UTC. Reflection belum memublikasikan cara meminta batas yang lebih tinggi, dan belum ada daftar harga publik untuk versi beta.

Agen coding

Mirror CLI terhubung ke Beam hanya dengan kunci API. Pi, OpenCode, dan Hermes dapat digunakan melalui setelan penyedia yang kompatibel dengan OpenAI: URL dasar https://api.reflection.ai/openai/v1, model Beam-501B-A23B, kunci dari REFLECTION_API_KEY. Mirror tidak mendukung Windows native.

curl -fsSL https://raw.githubusercontent.com/reflection-oss/mirror-beta/main/install.sh | bash

cd your-project
mirror        # uses Reflection and Beam-501B-A23B by default

Menjalankan Beam sendiri

Saat bobotnya dirilis, Beam dapat dijalankan menggunakan engine sumber terbuka; Reflection menyatakan bahwa mereka sedang mengerjakan integrasi dan mencari mitra peluncuran. Siapkan memori yang besar: semua 501 miliar parameter harus berada di memori GPU, meskipun hanya 23 miliar yang aktif untuk setiap token. Jumlahnya kira-kira 1 TB pada BF16, 500 GB pada FP8, dan 250 GB pada 4-bit, belum termasuk cache KV.