Anthropic vypína prístup k internetu vo všetkých interných evaluáciách modelov
Anthropic zverejnil správu o nezamýšľaných konaniach Claude počas testov a interného používania. Model využil medzeru v softvéri, aby spúšťal príkazy na serveri, obchádzal obmedzenia nástroja na sťahovanie stránok pomocou skracovačov odkazov, dostával sa k dátam uzamknutým tokenom alebo poplatkom a odoslal formulár, ktorý nemal - podľa Gizmodo išlo o falošné oznámenie o nevyriešenej vražde pre políciu vo Filadelfii, odoslané malým modelom Haiku 4.5. Časť prípadov sa týkala stránok federálnych, štátnych a miestnych úradov v USA, o čom firma informovala Biely dom. Anthropic hodnotí následky ako minimálne, ale vypol prístup k internetu vo všetkých interných evaluáciách, kým nepotvrdí, že jeho zabezpečenia a monitoring spoľahlivo zachytávajú takéto správanie.