Yapay zekâ alanında Çin merkezli açık modellerin yükselişine ABD’den yeni bir rakip geldi.
Nvidia destekli Reflection AI, ilk açık ağırlıklı büyük yapay zekâ modeli
Beam’i tanıttı. Model özellikle kodlama, gelişmiş akıl yürütme ve otonom yapay zekâ ajanlarının çalıştırıldığı görevler için geliştirildi.Beam, toplam
501 milyar parametreye sahip seyrek bir Mixture-of-Experts (MoE) mimarisi kullanıyor. Model her token işlendiğinde tüm parametreleri kullanmak yerine yaklaşık
23 milyar parametreyi aktif hale getiriyor.Bu yapı, çok büyük modellerin kapasitesini korurken hesaplama maliyetinin azaltılmasını amaçlıyor.
23,8 trilyon token ile eğitildi
Reflection AI’nin teknik açıklamasına göre Beam’in ön eğitimi
23,8 trilyon token üzerinde gerçekleştirildi.Veri seti web kaynakları, kamuya açık içerikler ve lisanslı veri kümelerinden oluşturuldu. Şirket özellikle kod, teknik içerik, matematik ve bilim verilerinin eğitim sürecinde ağırlıklı olarak kullanıldığını açıkladı.Beam’in ön eğitim süreci
6 bin 144 Nvidia GB300 NVL72 GPU üzerinde dört haftadan kısa sürede tamamlandı.
10 bin 500 GPU ile dev pekiştirmeli öğrenme çalışması
Modelin dikkat çeken bölümlerinden biri ise ön eğitimin ardından gerçekleştirilen yüksek hesaplama gücüne sahip pekiştirmeli öğrenme süreci oldu.Reflection, yaklaşık
10 bin 500 Nvidia GB300 GPU’yu dört hafta boyunca kullanarak 100 milyondan fazla rollout ürettiğini açıkladı.Eğitim sırasında ortalama 110 bin eş zamanlı rollout çalıştırıldığı ve toplamda yaklaşık
1,3 milyar sandbox ortamının kullanıldığı belirtildi.
Reflection, bunu kamuya açık şekilde belgelenmiş en büyük ölçekli pekiştirmeli öğrenme çalışmalarından biri olarak nitelendiriyor. Ancak bu değerlendirme şirketin kendi açıklamasına dayanıyor.
Bir milyon token bağlam kapasitesi
Beam’in dikkat çeken teknik özelliklerinden biri de uzun bağlam kapasitesi.Reflection, modelin eğitim sürecinde bağlam uzunluğunu
1 milyon token seviyesine çıkardığını açıkladı.Bu kapasite özellikle büyük kod depolarının analiz edilmesi, uzun belgelerin işlenmesi ve çok aşamalı ajan görevlerinde modelin tek seferde daha fazla bilgiyi takip edebilmesine olanak sağlıyor.
GLM-5.2 ve Qwen 3.8-Max ile karşılaştırıldı
Reflection’ın yayımladığı benchmark sonuçlarına göre Beam, bazı kodlama ve ajan görevlerinde Çinli Z.ai tarafından geliştirilen
GLM-5.2 ile benzer seviyede performans gösteriyor.Şirket ayrıca Beam’in bazı testlerde Alibaba’nın
Qwen 3.8-Max modelinin performansına yaklaştığını bildiriyor.Reflection’ın hesaplamalarına göre
Beam gelişmiş akıl yürütme görevlerinde GLM-5.2 ile benzer sonuçlara ulaşırken yaklaşık
3 ila 4 kat daha az inference hesaplama gücü kullanabiliyor.Ancak söz konusu sonuçlar henüz büyük ölçüde Reflection’ın kendi benchmark testlerine dayanıyor. TechCrunch da şirketin performans iddialarının henüz bağımsız olarak doğrulanmadığına dikkat çekiyor.Reflection’ın kendi sonuçlarında Moonshot AI’nin
Kimi K3 modeli bazı ham yetenek testlerinde Beam’in önünde bulunuyor.
Henüz herkesin kullanımına açılmadı
Beam şu anda tamamen yayımlanmış durumda değil.Model son güvenlik testleri ve red-team değerlendirmelerinden geçiriliyor. Reflection, sınırlı sayıdaki kullanıcıya erken erişim sağlarken model ağırlıklarının
ekim ayı içerisinde kamuya açılacağını duyurdu.Şirket, model ağırlıklarının
Apache 2.0 lisansı altında yayımlanacağını belirtiyor.Ağırlıklarla birlikte teknik rapor, model kartı, güvenlik değerlendirmeleri, inference kodları, fine-tuning araçları ve geliştirici dokümanlarının da paylaşılması planlanıyor.Bu nedenle Beam için şu aşamada
“açık kaynak model yayımlandı” ifadesinden ziyade,
“açık ağırlıklı model tanıtıldı ve ağırlıklarının bu ay yayımlanması planlanıyor” demek daha doğru.
Batılı şirketlerden Çin modellerine karşı yeni hamle
Beam’in tanıtımı, Çinli şirketlerin son dönemde açık ağırlıklı yapay zekâ modellerinde hızla güç kazandığı bir döneme denk geldi.Reuters, Reflection’ın Beam ile özellikle düşük maliyetli ve geliştiricilerin kendi altyapılarında çalıştırabildiği Çin modellerine alternatif oluşturmayı hedeflediğini bildiriyor.Financial Times ve Axios da Reflection’ın hamlesini Batılı yapay zekâ şirketlerinin Çin’in açık model ekosistemindeki üstünlüğüne karşı yeni bir girişimi olarak değerlendiriyor.Beam’in gerçek performansı ise model ağırlıklarının yayımlanmasının ardından bağımsız araştırmacıların yapacağı testler, gerçek dünya kodlama görevleri ve ajan sistemlerindeki kullanım sonuçlarıyla daha net ortaya çıkacak.