İçeriğe geç
reflectionbeam

Nasıl kullanılır

Beam bugün nasıl kullanılır

Beam aşamalı olarak beta erişimine açılıyor. Şu anda erişmenin tüm yolları, OpenAI uyumlu API için çalışan kod örnekleri ve açık ağırlıklar geldiğinde nelerin değişeceği burada.

Şu anki seçenekleriniz

Sıfırdan ilk isteğe

  1. 01

    Bekleme listesine katılın

    platform.reflection.ai adresinde hesap oluşturun. Yeni kayıtların erişimlerinin açılmasını beklemesi gerekir.

  2. 02

    API anahtarı oluşturun

    Platformda API Keys bölümünü açıp bir anahtar oluşturun. Anahtarı REFLECTION_API_KEY ortam değişkeninde saklayın.

  3. 03

    İstemcinizi Reflection'a yönlendirin

    Herhangi bir OpenAI SDK'sıyla https://api.reflection.ai/openai/v1 temel URL'sini ve Beam-501B-A23B model kimliğini kullanın.

  4. 04

    Chat Completions isteği gönderin

    Chat Completions çağrısını her zamanki gibi yapın. İsteğe bağlı olarak hız ile derinlik arasında denge kurmak için reasoning_effort değerini ayarlayın.

Kod örnekleri

Uç nokta OpenAI Chat Completions biçimini izler; bu nedenle taban URL'sini ve anahtarı değiştirdikten sonra resmi OpenAI SDK'ları çalışır.

İlk istek

curl https://api.reflection.ai/openai/v1/chat/completions \
  -H "Authorization: Bearer $REFLECTION_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "Beam-501B-A23B",
    "messages": [{"role": "user", "content": "Explain Mixture-of-Experts in two sentences."}],
    "reasoning_effort": "medium"
  }'

Akış

stream = client.chat.completions.create(
    model="Beam-501B-A23B",
    messages=[{"role": "user", "content": "Write a haiku about sparse experts."}],
    stream=True,
)

for chunk in stream:
    delta = chunk.choices[0].delta
    # reasoning arrives first in delta.reasoning_content, then the answer in delta.content
    if delta.content:
        print(delta.content, end="", flush=True)

Ortam değişkenleri

export REFLECTION_API_KEY="<your API key>"

# Tools that read the standard OpenAI variables and use Chat Completions
export OPENAI_BASE_URL="https://api.reflection.ai/openai/v1"
export OPENAI_API_KEY="$REFLECTION_API_KEY"

# Check which models your key can use
curl https://api.reflection.ai/openai/v1/models -H "Authorization: Bearer $REFLECTION_API_KEY"

Akıl yürütme düzeyi

Beam her zaman akıl yürütür; bunu kapatmanın bir yolu yoktur. reasoning_effort parametresi akıl yürütme miktarını kontrol eder. Varsayılan değer medium'dur.

DeğerDavranış
lowEn az akıl yürütme, en düşük gecikme. Basit görevler için.
mediumKalite ile gecikme arasında denge. Parametreyi belirtmediğinizde kullanılır.
highDaha zor problemler için daha fazla akıl yürütme.
xhighhigh değerinden daha fazla akıl yürütme.
maxEn zor problemler için en fazla akıl yürütme.

Akıl yürütme token'ları max_completion_tokens ve hız sınırlarına dahildir. Sınır çok düşükse model akıl yürütmeye devam ederken token'ları tükenebilir ve finish_reason "length" ile boş bir yanıt döndürebilir. Akıl yürütme metni ayrıca reasoning_content içinde döner.

Neler işe yarıyor, neler yaramıyor

Destekleniyor

  • POST /chat/completions, GET /models, GET /models/{model}
  • Son parçadaki kullanım bilgileri de dahil olmak üzere akış
  • tool_choice ve parallel_tool_calls ile araç çağırma
  • Yapılandırılmış çıktılar: json_object ve json_schema
  • temperature, top_p, frequency_penalty, presence_penalty, max_completion_tokens, seed
  • system, developer, user, assistant ve tool rolleri

Desteklenmiyor

  • Yanıtlar, Gömme, Görseller, Ses, Dosyalar, Toplu İşlem ve Asistanlar API'leri
  • Görsel, ses veya dosya girdileri: Beam yalnızca metin tabanlıdır
  • 1 dışında n, logprobs, logit_bias
  • user, metadata, audio veya prediction gibi parametreler (hata döndürürler)
  • stop dizileri kabul edilir ancak etkileri olmaz

Hız sınırları

Sınırlar kuruluş başına uygulanır; dakika başına istek ve token sayısını, UTC günü başına sınırları ve eşzamanlı isteklere yönelik bir üst sınırı kapsar. Bu sınırlardan birinin aşılması, Retry-After başlığıyla birlikte HTTP 429 döndürür. Günlük sınırlar 00:00 UTC'de sıfırlanır. Reflection henüz daha yüksek sınırların nasıl talep edileceğini açıklamadı ve beta için herkese açık bir fiyat listesi yok.

Kodlama ajanları

Mirror CLI, Beam'e yalnızca bir API anahtarıyla bağlanır. Pi, OpenCode ve Hermes, OpenAI uyumlu sağlayıcı ayarları üzerinden çalışır: temel URL https://api.reflection.ai/openai/v1, model Beam-501B-A23B, anahtar REFLECTION_API_KEY'den alınır. Mirror yerel Windows'u desteklemez.

curl -fsSL https://raw.githubusercontent.com/reflection-oss/mirror-beta/main/install.sh | bash

cd your-project
mirror        # uses Reflection and Beam-501B-A23B by default

Beam'i kendi ortamınızda çalıştırma

Ağırlıklar yayımlandığında Beam, açık kaynaklı motorlarla sunulabilecek; Reflection, entegrasyonlar ve lansman ortakları üzerinde çalıştığını söylüyor. Bellek ihtiyacını yüksek tutun: token başına yalnızca 23 milyar parametre etkin olsa da 501 milyar parametrenin tamamı GPU belleğinde bulunmalı. KV önbelleği hesaba katılmadan bu, BF16'da yaklaşık 1 TB, FP8'de 500 GB ve 4 bitte 250 GB demek.