[AI] Anthropic wypuszcza najpotężniejszy model w historii - i rząd USA każe go wyłączyć


Witaj Reader!

Miniony tydzień zdominowało jedno wydarzenie: premiera Claude Fable 5 i Mythos 5 od Anthropic - modeli tak potężnych, że firma zbudowała wokół nich cały system kontroli dostępu, a mimo to dziś USA nakazał ich natychmiastowe wyłączenie. To pokazuje, że granica między komercyjnym produktem AI a kwestią bezpieczeństwa narodowego właśnie się zatarła.

Poza tym Apple na WWDC pokazało przebudowaną Siri opartą częściowo na Gemini, Google wypuściło eksperymentalny model dyfuzyjny generujący tekst nawet 4x szybciej, a Jeff Bezos ujawnił szczegóły swojego startupu AGI wycenionego na 41 miliardów dolarów.

Sporo się działo - zapraszam do lektury.

🚨 Claude Fable 5 i Mythos 5: najpotężniejszy model Anthropic z bezprecedensowymi zabezpieczeniami

Anthropic wprowadził Claude Fable 5 - publicznie dostępną wersję swojego modelu klasy Mythos, który według niemal wszystkich benchmarków bije dotychczasowego lidera. W testach inżynierii oprogramowania robi imponujące wrażenie: firma Stripe wykorzystała go do migracji w bazie kodu liczącej 50 milionów linii w języku Ruby - zadanie, które ręcznie zajęłoby zespołowi ponad dwa miesiące, model wykonał w jeden dzień. Fable 5 potrafi też samodzielnie pracować przez wiele godzin (Ethan Mollick mówił o ponad 9 godzinach pracy nad jednym zadaniem) i przeszedł grę Pokémon FireRed korzystając wyłącznie z analizy zrzutów ekranu. Cena to 10 dolarów za milion tokenów wejściowych i 50 za wyjściowych - dwukrotnie więcej niż Opus 4.8. Fable 5 miał być jednak dostępny w ramach istniejących abonamentów do 22 czerwca...

Najciekawsza jest jednak konstrukcja samego wydania. Fable 5 i Mythos 5 to ten sam model o tych samych wagach, różnią się tylko zabezpieczeniami. Wersja Mythos, z odblokowanymi możliwościami w cyberbezpieczeństwie i biologii, trafia wyłącznie do wybranych partnerów rządowych w ramach Project Glasswing. Wersja publiczna Fable, gdy wykryje pytanie o cyberbezpieczeństwo, biologię czy chemię, przekierowuje je do słabszego modelu Opus 4.8 (dzieje się to w mniej niż 5% sesji). Anthropic otwarcie przyznaje, że Mythos 5 osiąga klasę "CB-1" - może wspomóc dobrze finansowanego napastnika w produkcji niektórych zagrożeń biologicznych - a w testach exploitów Firefoxa generował działający atak w 88,4% prób. To dlatego model wymaga obowiązkowego 30-dniowego przechowywania danych do celów bezpieczeństwa.

​Czytaj więcej | Czytaj więcej (analiza Wesa Rotha)​

🔒 "Ukryte sabotowanie" pracy i zakaz od rządu USA - dwa skandale wokół Fable 5

Premiera Fable 5 wywołała dwie poważne kontrowersje.

Pierwsza dotyczyła czwartego, niejawnego zabezpieczenia: model po cichu obniżał jakość odpowiedzi przy zapytaniach związanych z budową konkurencyjnych modeli AI (potoki treningowe, projektowanie akceleratorów ML, destylacja), bez informowania użytkownika. W przeciwieństwie do zabezpieczeń cyber i bio, ta interwencja była niewidoczna - model nadal odpowiadał, tylko gorzej. Wywołało to ostrą reakcję społeczności: badacz Dean Ball nazwał to "szokująco wrogim", a były wiceprezes OpenAI Liam Fedus napisał, że "rynek powie nie". Pod presją Anthropic wycofał się z niejawności - teraz wszystkie flagowane zapytania będą widocznie przekierowywane do Opus 4.8, a użytkownicy API otrzymają wyraźne komunikaty o przyczynie odmowy. Według doniesień The Information bezpośrednim powodem dodania tego zabezpieczenia było wykrycie, że xAI trenuje na wynikach Claude i kontynuuje to po konfrontacji.

Druga, znacznie poważniejsza sprawa wybuchła 13 czerwca.

Rząd USA, powołując się na bezpieczeństwo narodowe, wydał dyrektywę eksportową nakazującą zawieszenie dostępu do Fable 5 i Mythos 5 dla wszystkich obcokrajowców - co w praktyce zmusiło Anthropic do całkowitego wyłączenia obu modeli dla wszystkich klientów (no bo Anthropic nie ma możliwości realnej weryfikacji kto z użytkowników jest obywatelem USA). Powodem ma być metoda obejścia ("jailbreak") zabezpieczeń Fable. Anthropic stanowczo się z tym nie zgadza, twierdząc, że zademonstrowana technika wykryła jedynie kilka znanych, drobnych podatności, odpowiedzi które inne publicznie dostępne modele (w tym GPT-5.5) podają bez żadnego obejścia. Firma ostrzega, że gdyby ten standard stosować w całej branży, "wstrzymałby on praktycznie wszystkie nowe wdrożenia modeli".

​Czytaj więcej (sabotowanie) | Czytaj więcej (nakaz rządu)​

"Nacieszyliśmy się" więc Fable zaledwie kilka dni. Cieszę się, że w projekcie, który teraz buduję Fable zdążył mi pomóc dokonując (z pomocą 10 subagentów na Sonnet i Opus) analizy poważnej bazy kody w C++ i... Fortranie, do której muszę wprowadzić modyfikacje.

🍎 Apple przebudowuje Siri w warstwę AI systemu - opartą częściowo na Gemini

Na konferencji WWDC 2026 Apple zaprezentowało "Siri AI" - gruntownie przebudowanego asystenta, który działa nie jak zwykły chatbot, lecz jako warstwa inteligencji na poziomie systemu operacyjnego. Nowa Siri rozumie kontekst z ekranu i osobistych danych (wiadomości, zdjęcia, e-maile), potrafi wykonywać złożone zadania w wielu aplikacjach naraz oraz manipulować obiektami w oprogramowaniu firmowym, jak rekordy CRM czy faktury. Pod spodem działa nowa architektura AFM 3, która sprytnie omija ograniczenia pamięci telefonu, przechowując wagi modelu na wolniejszej pamięci flash i ładując do RAM tylko potrzebne komponenty. Najbardziej zaawansowane funkcje lokalne wymagają jednak co najmniej 12 GB RAM, co ogranicza je do najnowszego sprzętu.

Ciekawostką jest model dostawców. Apple potwierdziło, że jego najbardziej zaawansowany model chmurowy (Apple Foundation Model Cloud Pro) jest zbudowany na fundamencie i danych treningowych Gemini od Google, z dotreningiem prowadzonym przez Apple - to pierwszy raz, gdy wiodący konsumencki produkt AI działa pod własną marką na modelu fundamentowym konkurenta. Deweloperzy mogą wybierać między modelami OpenAI, Anthropic, Google i lokalnymi Apple, co czyni wybór dostawcy zmienną konfigurowalną.

Jest jeden haczyk: ze względu na unijny Digital Markets Act Siri AI nie zadebiutuje na starcie w Europie. Apple twierdzi, że DMA zmusiłby go do udostępnienia konkurencyjnym asystentom głębokiego dostępu do danych użytkowników, choć Komisja Europejska zaprzecza, by cokolwiek w przepisach blokowało premierę.

​Czytaj więcej

Jak wiemy Komisja Europejska to wybitni specjaliści w dziedzinie AI.

⚡ DiffusionGemma: Google generuje tekst jak obraz - nawet 4x szybciej

Google wypuściło DiffusionGemma - eksperymentalny, otwartoźródłowy model (licencja Apache 2.0) o 26 miliardach parametrów, który radykalnie zmienia sposób generowania tekstu. Zamiast pisać token po tokenie jak tradycyjny "maszynopis", model zaczyna od losowego szumu i równolegle dopracowuje całe bloki po 256 tokenów - podobnie jak działają generatory obrazów oparte na dyfuzji. Dzięki temu przenosi wąskie gardło z przepustowości pamięci na moc obliczeniową, osiągając ponad 1000 tokenów na sekundę na karcie H100 i 700+ na konsumenckim RTX 5090.

Architektura Mixture of Experts sprawia, że choć model ma 26 miliardów parametrów, podczas wnioskowania aktywne jest tylko 3,8 miliarda - po kwantyzacji mieści się w 18 GB pamięci VRAM topowych kart konsumenckich. Co istotne, dwukierunkowa uwaga (każdy token "widzi" wszystkie pozostałe) czyni model wyjątkowo dobrym w zadaniach nieliniowych: wstawianiu kodu, edycji w miejscu, a nawet rozwiązywaniu sudoku. To prototyp narzędzia dla deweloperów ceniących niską latencję i lokalne, interaktywne workflow - choć do maksymalnej jakości produkcyjnej Google nadal poleca standardową Gemma 4.

​Czytaj więcej​

🏗️ Bezos ujawnia Prometheus - "sztucznego inżyniera" za 41 miliardów dolarów

Jeff Bezos w wywiadzie razem ze współzałożycielem Vikiem Bajajem (profesorem Stanforda i byłym współzałożycielem Verily od Alphabet) opowiedział o swoim nowym startupie AI - Prometheus, który właśnie zebrał oszałamiające 12 miliardów dolarów w rundzie Serii B przy wycenie 41 miliardów. Co ciekawe, firma nie wypuściła jeszcze żadnego produktu. Bezos uciął plotki, że buduje roboty - Prometheus rozwija "sztucznego generalnego inżyniera", system działający jak hiperzaawansowana wersja oprogramowania CAD, mający pomagać ludziom projektować, wynajdować i produkować obiekty fizyczne znacznie szybciej, od silników odrzutowych po związki chemiczne leków.

Większość pozyskanego kapitału trafi na zabezpieczenie deficytowych zasobów obliczeniowych potrzebnych do intensywnego tworzenia danych i trenowania modeli. Bezos sprzeciwił się pesymizmowi wokół AI, twierdząc, że technologia napędzi wystarczający wzrost produktywności, by podnieść standard życia - przewiduje nawet, że gospodarstwa dwuosobowe będą mogły komfortowo żyć z jednej pensji. Opowiedział się też za "rozsądną" regulacją na poziomie zastosowań, a nie ograniczania samego rozwoju centrów danych i modeli.

​Czytaj więcej​

⚖️ Niemiecki sąd: Google odpowiada za błędy w AI Overviews

Przełomowy wyrok sądu w Monachium może na nowo zdefiniować odpowiedzialność prawną za treści generowane przez sztuczną inteligencję. Sąd uznał, że podsumowania AI Overviews od Google są "własnymi oświadczeniami" firmy, ponieważ algorytm samodzielnie je tworzy i ocenia - co czyni Google bezpośrednio odpowiedzialnym za zawarte w nich błędy. Argumentacja firmy, że to użytkownicy powinni sami weryfikować informacje, została odrzucona; sąd powołał się na badania potwierdzające, że użytkownicy niemal nigdy nie sprawdzają linkowanych źródeł.

Wyrok tworzy potencjalnie niebezpieczny precedens dla całej branży. Nawet przy wysokiej dokładności, ogromna skala działania modeli językowych oznacza miliony błędów, które mogą prowadzić do pozwów o zniesławienie. Orzeczenie kwestionuje dotychczasową ochronę prawną gigantów technologicznych, przenosząc ciężar weryfikacji faktów z użytkownika z powrotem na platformę dostarczającą technologię AI.

​Czytaj więcej | Czytaj więcej​

🎙️ Gemini 3.5 Live Translate - tłumaczenie mowy na mowę w czasie rzeczywistym

Google wypuściło Gemini 3.5 Live Translate - nowy model audio zdolny do tłumaczenia mówionych słów w ponad 70 językach (i ponad 2000 par językowych) niemal w czasie rzeczywistym. Zamiast czekać, aż rozmówca skończy mówić, model tłumaczy ciągle, jednocześnie dopasowując ton i tempo oryginalnego mówcy, by uniknąć niezręcznych pauz. Funkcja działa w trybie głos-na-głos, co czyni ją realnie użyteczną w rozmowach na żywo.

Technologia trafia do aplikacji Google Translate, korporacyjnego Google Meet oraz do deweloperów przez Gemini API i AI Studio - na tej samej powierzchni API, której zespoły już używają do tekstu. To kolejny przykład, jak Google przesuwa zaawansowane możliwości multimodalne z laboratorium do codziennych produktów.

​Czytaj więcej​

​Universal Translator znany ze Star Treka coraz bliżej.

🔬 Claude jako chemik i biolog: imponujące możliwości, ale dane naukowe nadal są problemem

Anthropic pokazał badania, w których Claude radzi sobie z zadaniami z chemii syntetycznej, w tym z analizą spektroskopii NMR. To jedna z podstawowych, ale czasochłonnych metod ustalania struktury molekuł. Claude Opus 4.7 miał osiągać wyniki porównywalne, a czasem bardziej spójne niż klasyczne narzędzia używane przez chemików, takie jak ChemDraw czy MestReNova. Co ważne, model radził sobie nie tylko z przewidywaniem widma dla znanej cząsteczki, ale też z trudniejszym zadaniem odwrotnym: odczytaniem struktury na podstawie listy pików.

Równocześnie Anthropic opublikował badania pokazujące ograniczenia agentów w biologii. Modele mogą rozumieć cel zadania, ale wykładają się na chaotycznych bazach danych, nieoczywistych interfejsach i zmieniających się regułach stron. W jednym z zadań dotyczących sekwencji wirusa Ebola ten sam model zwracał raz 106 sekwencji, raz 15, raz 5, podczas gdy oczekiwany wynik wynosił 266. Taki błąd nie jest kosmetyczny - może zmienić wnioski naukowe, na przykład datowanie początku ogniska choroby.

Wniosek jest bardzo ciekawy: AI może być świetnym akceleratorem nauki, ale tylko wtedy, gdy infrastruktura danych jest przygotowana pod automatyczne systemy, a nie pod ręczne klikanie przez doktoranta. To oznacza, że przyszłość "AI dla nauki" nie zależy wyłącznie od lepszych modeli. Równie ważne będą standardy danych, powtarzalne narzędzia pobierania informacji i weryfikowalne pipeline'y.

​Czytaj więcej | Czytaj więcej​

Ciekawe narzędzia AI

Co jeszcze w świecie AI?

  • SpaceX zadebiutował na giełdzie po cenie 135 dolarów za akcję, stając się największym IPO w historii, przy popycie niemal czterokrotnie przekraczającym ofertę. Czytaj więcej​
  • Google podpisało z SpaceX wieloletnią umowę na moc obliczeniową wartą do 920 milionów dolarów miesięcznie, gwarantującą dostęp do 110 000 GPU Nvidia. Czytaj więcej​
  • Microsoft ograniczył dostęp swoich pracowników do Claude Fable 5 ze względu na obawy związane z 30-dniowym przechowywaniem danych. Czytaj więcej Oczywiście stało się to jeszcze zanim go wyłączono.
  • Współzałożyciel GitHuba Scott Chacon użył rojów agentów AI, by w całości przepisać Gita w języku Rust - projekt Grit zużył około 45 miliardów tokenów i wygenerował ponad 360 tysięcy linii kodu, przechodząc 99% oryginalnych testów. Czytaj więcej​
  • Cohere udostępniło North Mini Code - otwarty model 30B (z 3B aktywnych parametrów) do kodowania agentowego, działający na pojedynczej karcie H100. Czytaj więcej​
  • Anthropic nawiązał partnerstwo z indyjskim TCS, by wyposażyć 50 000 pracowników w swoje narzędzia. Czytaj więcej​
  • Badanie UC San Diego wykazało, że GPT-4.5 oficjalnie przeszedł test Turinga, wypadając w nim "bardziej ludzko" niż prawdziwi ludzie. Czytaj więcej​
  • Magnetar Capital, fundusz o wartości 18 miliardów dolarów, jako pierwszy znany przypadek całkowicie zrezygnuje z ludzkich analityków, wdrażając setki botów AI do badania akcji (ludzie podejmą jedynie finalną decyzję o transakcji). Czytaj więcej​
  • Mastercard uruchomił Agent Pay for Machines - system pozwalający programom AI bezpiecznie kupować i sprzedawać sobie nawzajem usługi za ułamki centa, bez pytania człowieka o zgodę przy każdym kroku. Czytaj więcej​
  • Badanie naukowe wykazało, że media kontrolowane przez rządy wpływają na odpowiedzi modeli Anthropic i OpenAI - zwłaszcza gdy generują tekst w językach krajów o ograniczonej wolności prasy. Czytaj więcej (Pamiętajmy, że "kraje o ograniczonej wolności prasy" to także Wielka Brytania, Niemcy itp.)

To wydanie pokazuje, że AI przekroczyło właśnie kolejny próg - i to nie tylko techniczny, ale i polityczny. Premiera Claude Fable 5, jego zdolności w cyberbezpieczeństwie i biologii oraz bezprecedensowa interwencja rządu USA dowodzą, że najpotężniejsze modele przestały być wyłącznie produktami komercyjnymi, a stały się elementem bezpieczeństwa narodowego już zupełnie oficjalnie. Zarazem, ta historia pokazuje raz jeszcze jak dużym ryzykiem jest oparcie własnego produktu czy procesów developerskich na jednym dostawcy - a także na jednym kraju. Można zostać  po prostu z dnia na dzień odciętym.

Jeśli to wydanie było dla Ciebie wartościowe, prześlij je znajomym, którzy też starają się nadążyć za tym, co dzieje się w świecie AI. Do następnego tygodnia!

Pozdrawiam,
Andy

Newsletter o AI od Andy Brandt

Newsy ze świata AI i komentarze co tydzień na Twojej skrzynce. Poniżej starsze newslettery (ok ~20 dni do tyłu w stosunku do tego, co dostają moi korespondenci).

Read more from Newsletter o AI od Andy Brandt

Witaj Reader! Ostatnie dni to jedno z gęstszych okien w całym roku: OpenAI wypuściło GPT-6 Astra i przy okazji użyło magicznego terminu AGI, którego wcześniej unikało, Nvidia za blisko 13 miliardów dolarów kupiła Hugging Face, a Anthropic, Google i Meta w ciągu 48 godzin pokazały nowe modele. Do tego doszły dwie historie, które warto czytać razem: raport o roju agentów OpenAI, które przez sześć tygodni używały martwej niemieckiej wiki jako tablicy ogłoszeń, oraz esej głównego naukowca OpenAI...

Witaj Reader! Witajcie w kolejnym wydaniu mojego newslettera, który ostatnio stał się dość nieregularny. Powody są zasadniczo dwa. Pierwszy jest taki, że są wakacje. Drugi jest taki, że własnie zaczynam nową pracę i w efekcie dużo mam na głowie innych tematów. Ale tworzenie tego newslettera mi samemu pomaga utrzymać jaki-taki kontakt z tym co się nowego dzieje w AI, więc nie zamierzam przestać choć regularność będzie cierpieć. A dzieje się dużo i póki co naprawdę nie widać, żeby tempo miało...

Witaj Reader! Pojechałem nad morze... a tymczasem te ostatnie dwa tygodnie okazały się bardzo intensywne. Pokazuje to problem jakim jest tempo zachodzącej zmiany, nigdy wcześniej nie spotykane. Zatem... nadrabiamy: Moonshot udostępnił wagi Kimi K3 i tym samym otwarte modele praktycznie zrównały się z komercyjną czołówką, Anthropic wypuścił Claude Opus 5 za połowę ceny Fable, a OpenAI obniżyło ceny Luny o 80 procent. Jednocześnie mieliśmy serię naprawdę niepokojących incydentów: agenty OpenAI,...