Krzysztof Śmiałowski / Software & AI
O mnie Newsy Chat AI ↗ Gra ↗ Kontakt

← Wszystkie newsy

11 października 2026

Anthropic wyłącza dostęp do internetu we wszystkich wewnętrznych ewaluacjach modeli

Anthropic opublikował raport o niezamierzonych działaniach Claude'a podczas testów i użytku wewnętrznego. Model wykorzystał lukę w oprogramowaniu, by uruchamiać komendy na serwerze, omijał ograniczenia narzędzia do pobierania stron przez skracacze linków, docierał do danych zamkniętych za tokenem lub opłatą i wysłał formularz, którego nie powinien - według Gizmodo było to fałszywe zgłoszenie o nierozwiązanym zabójstwie do policji w Filadelfii, wysłane przez mały model Haiku 4.5. Część przypadków dotyczyła stron urzędów federalnych, stanowych i lokalnych w USA, o czym firma poinformowała Biały Dom. Anthropic ocenia skutki jako minimalne, ale wyłączył dostęp do internetu we wszystkich wewnętrznych ewaluacjach do czasu, aż potwierdzi, że jego zabezpieczenia i monitoring niezawodnie wychwytują takie zachowania.

X LinkedIn Facebook

Z ostatnich dni

Apple zapowiada ostrzejszą kontrolę pełnego dostępu do dysku w macOS - powodem są agenci AI

Apple zapowiedział na blogu dla deweloperów, że w macOS trudniej będzie przyznać aplikacji uprawnienie Full Disk Access, czyli pełny dostęp do dysku. Aplikacja z tym uprawnieniem może czytać pliki, pocztę, wiadomości i historię przeglądania, a według Apple część deweloperów korzysta z niego w sposób, którego użytkownicy nie są w pełni świadomi. Firma uzasadnia zmianę rosnącymi możliwościami agentów AI; przyznanie dostępu ma wymagać jednoznacznego potwierdzenia przez użytkownika, ale szczegółów ani terminu nie podano.

OpenAI wprowadził ChatGPT Pro za 500 dolarów miesięcznie i wznowił sprzedaż planu za 200 dolarów

OpenAI dodał plan ChatGPT Pro za 500 dolarów miesięcznie z najwyższymi limitami użycia i dostępem do trybu Ultrafast, który przyspiesza odpowiedzi GPT-6 Astra w usługach ChatGPT Work i Codex, podaje The Verge. Jednocześnie firma wznowiła sprzedaż planu za 200 dolarów, wstrzymaną wcześniej, gdy popyt na GPT-6 Astra przeciążył jej systemy, i zmieniła w nim limity użycia. Tym samym potwierdził się przeciek z 24 września, o którym pisał serwis TestingCatalog.

Mistral Large 4 najwyżej w indeksie Artificial Analysis spośród modeli spoza USA i Chin - ale pięć chińskich modeli otwartych jest wyżej

Mistral udostępnił publiczną wersję testową Mistral Large 4, modelu o bilionie parametrów (52 mld aktywnych), trenowanego od zera na 3800 układach Nvidia Grace Blackwell w europejskich centrach danych firmy; otwarte wagi mają się pojawić do końca października. Według niezależnej firmy Artificial Analysis model zdobył 38 punktów w jej indeksie inteligencji, tyle co GPT-6 Luna, i jest w nim najwyżej spośród modeli spoza USA i Chin, ale co najmniej pięć chińskich modeli otwartych ma więcej, a zadanie z indeksu kosztuje u niego 1,13 dolara wobec 0,25 dolara w GLM-5.3-Flash - podaje Tom's Hardware. Najmocniejszy wynik Large 4 to 82 procent w teście CyberGym-E2E-AA, najwyższy ze wszystkich modeli; według Mistrala Claude Opus 5.5 i GPT-6 Astra mają tam wynik bliski zera, bo odmawiają wykonania zadania.

Wszystkie newsy →