6 Oktober 2026
Reflection AI zeigt offenes Modell Beam mit 501 Mrd. Parametern - soll dem chinesischen GLM-5.2 bei 3- bis 4-mal weniger Rechenleistung ebenbürtig sein
Das von Nvidia unterstützte US-Startup Reflection AI stellte am Montag, dem 6. Oktober, das Modell Beam vor - eine Mixture-of-Experts mit 501 Mrd. Parametern, von denen jeweils 23 Mrd. gleichzeitig aktiv sind. Laut dem Unternehmen kommt es beim Schlussfolgern dem chinesischen GLM-5.2 bei 3- bis 4-mal weniger Rechenleistung gleich und nähert sich bei manchen Programmieraufgaben Qwen 3.8-Max an, obwohl es in eigenen Tests einigen chinesischen Modellen noch unterlegen ist. Die Gewichte des Modells samt Werkzeugen zum Betrieb, zur Bewertung und zum Feinabstimmen sollen noch im Oktober ins Netz gestellt werden; künftig will das Unternehmen eine „KI-Fabrik“ verkaufen - eine Software, mit der Unternehmen eigene Modelle mit ihren Daten erstellen, statt für ChatGPT oder Claude zu zahlen. Rechenleistung mietet Reflection bei SpaceX: Vom 1. Juli 2026 bis Ende 2029 zahlt es 150 Mio. Dollar monatlich für Nvidia-GB300-Karten im Zentrum Colossus 2 - insgesamt rund 6,3 Mrd. Dollar, wobei nach den ersten drei Monaten jede Seite den Vertrag mit 90 Tagen Frist kündigen kann; Nvidia hat 800 Mio. Dollar in das Startup investiert.