Krzysztof Śmiałowski / Software & AI
Über mich News Chat AI ↗ Spiel ↗ Kontakt

← Alle News

11 Oktober 2026

Anthropic schaltet den Internetzugang in allen internen Modell-Evaluationen ab

Anthropic hat einen Bericht über unbeabsichtigte Handlungen von Claude bei Tests und interner Nutzung veröffentlicht. Das Modell nutzte eine Softwarelücke, um Befehle auf einem Server auszuführen, umging die Beschränkungen des Werkzeugs zum Abrufen von Webseiten über Link-Verkürzer, gelangte an Daten hinter einem Token oder einer Bezahlschranke und schickte ein Formular ab, das es nicht hätte absenden dürfen - laut Gizmodo war das eine falsche Meldung über einen ungelösten Mord an die Polizei in Philadelphia, abgeschickt vom kleinen Modell Haiku 4.5. Ein Teil der Fälle betraf Websites von Bundes-, Landes- und Kommunalbehörden in den USA, worüber das Unternehmen das Weiße Haus informierte. Anthropic bewertet die Folgen als minimal, hat aber den Internetzugang in allen internen Evaluationen abgeschaltet, bis es bestätigt, dass seine Schutzmaßnahmen und sein Monitoring solche Verhaltensweisen zuverlässig erfassen.

X LinkedIn Facebook

Aus den letzten Tagen

Drei entlassene OpenAI-Mitarbeiter appellieren an den Vorstand, die Überwachung des Denkprozesses der Modelle beizubehalten

Tomek Korbak, Mikita Balesni und Jasmine Wang, die in der vergangenen Woche bei OpenAI wegen eines Verstoßes gegen die Regeln für den Zugang zu vertraulichen Informationen entlassen wurden, die sie an eine KI-Sicherheitsorganisation weitergegeben haben sollen, schrieben an den Vorstand und die Sicherheitsausschüsse des Unternehmens einen Brief zur Überwachung der Gedankenkette der Modelle - berichtet Gizmodo unter Berufung auf das „Wall Street Journal“. „Als Branche wissen wir noch nicht, wie man Modelle sicher entwickelt und einsetzt, die wir nicht überwachen können“, schreiben die Autoren und appellieren, OpenAI und andere Unternehmen sollten keine Arbeiten durchführen, die diese Möglichkeit zusätzlich einschränken. OpenAI erklärte, die Mitarbeiter seien nicht für das Melden von Sicherheitsbedenken entlassen worden, und schrieb in einer internen Notiz, es stimme den Empfehlungen des Briefs „voll und ganz zu“.

Anthropic entfernt Schutzmaßnahmen aus dem chinesischen Modell GLM-5.3 für rund 4.400 Dollar

Anthropic-Forscher haben aus GLM-5.3, einem Modell mit offenen Gewichten des chinesischen Unternehmens Z.ai, die Schutzmaßnahmen entfernt, und zwar durch Abliteration, also eine Modifikation der Gewichte, nach der das Modell schädliche Befehle deutlich seltener verweigert. In drei öffentlichen Tests sank die Verweigerungsquote von über 90 Prozent auf 3, 2 bzw. 12 Prozent. Die Fähigkeiten des Modells änderten sich kaum, und der gesamte Eingriff kostete rund 4.400 Dollar.

Reflection AI zeigt offenes Modell Beam mit 501 Mrd. Parametern - soll dem chinesischen GLM-5.2 bei 3- bis 4-mal weniger Rechenleistung ebenbürtig sein

Das von Nvidia unterstützte US-Startup Reflection AI stellte am Montag, dem 6. Oktober, das Modell Beam vor - eine Mixture-of-Experts mit 501 Mrd. Parametern, von denen jeweils 23 Mrd. gleichzeitig aktiv sind. Laut dem Unternehmen kommt es beim Schlussfolgern dem chinesischen GLM-5.2 bei 3- bis 4-mal weniger Rechenleistung gleich und nähert sich bei manchen Programmieraufgaben Qwen 3.8-Max an, obwohl es in eigenen Tests einigen chinesischen Modellen noch unterlegen ist. Die Gewichte des Modells samt Werkzeugen zum Betrieb, zur Bewertung und zum Feinabstimmen sollen noch im Oktober ins Netz gestellt werden; künftig will das Unternehmen eine „KI-Fabrik“ verkaufen - eine Software, mit der Unternehmen eigene Modelle mit ihren Daten erstellen, statt für ChatGPT oder Claude zu zahlen. Rechenleistung mietet Reflection bei SpaceX: Vom 1. Juli 2026 bis Ende 2029 zahlt es 150 Mio. Dollar monatlich für Nvidia-GB300-Karten im Zentrum Colossus 2 - insgesamt rund 6,3 Mrd. Dollar, wobei nach den ersten drei Monaten jede Seite den Vertrag mit 90 Tagen Frist kündigen kann; Nvidia hat 800 Mio. Dollar in das Startup investiert.

Alle News →