[AI] Fable 5 wraca, GLM-5.2 rozbija bank, GPT-5.6 pod nadzorem rządu i AI, które starzeje się w laboratorium


Witaj Reader!

Wakacje w toku, żar leje się z nieba - choć na szczęście w całej Polsce ma być dziś ochłodzenie (do mnie jeszcze nie dotarło).

A tymczasem saga wokół zablokowanych przez rząd USA modeli Anthropic ma kolejny "odcinek" - Fable 5 wraca do globalnej dostępności (zapewne stopniowo), a przy okazji rodzi się nowy przemysłowy standard oceny "jailbreaków". W tym samym czasie OpenAI wypuszcza rodzinę GPT-5.6, ale po raz pierwszy w historii premiera modelu odbywa się pod bezpośrednim nadzorem administracji rządowej. Tymczasem Chiński GLM-5.2 pokazuje, że otwarte modele depczą po piętach liderom za ułamek ceny, przez co coraz więcej firm zaczyna przełączać ruch na tańsze alternatywy.

Do tego mamy niemal autonomicznego chemika OpenAI, przełomowy chip IBM poniżej jednego nanometra oraz konsultantów AI, których zaczyna dyscyplinować sama AI. Sporo się dzieje, więc przejdźmy do konkretów.

🔓 Rząd USA zdejmuje blokadę - Fable 5 wraca, a branża dostaje nowy standard bezpieczeństwa

Jak ogłosił Anthropic, 30 czerwca kontrole eksportowe nałożone na Fable 5 i Mythos 5 zostały zniesione. Model Fable 5 wraca do globalnej dostępności od środy 1 lipca na wszystkich platformach Claude, a dla planów Pro, Max i Team będzie wliczony do 50% używania do tygodniowego limitu do 7 lipca ("Fable 5 will be included for up to 50% of weekly usage limits" - nie do końca rozumiem co to 50% znaczy). Wcześniej, 26 czerwca, rząd zgodził się też na przywrócenie Mythos 5 dla około 100 zweryfikowanych organizacji z USA (m.in. AWS, Microsoft, CrowdStrike) w ramach programu Project Glasswing. Warto dodać, że w kontekście tej blokady ujawniono, iż model Mythos był wcześniej używany do znajdowania luk w zabezpieczeniach niejawnych systemów rządowych USA.

Najciekawsze jest jednak to, co zostało po tym incydencie. Anthropic wraz z Amazonem, Microsoftem i Google zaczął tworzyć wspólny, branżowy framework do oceny wagi "jailbreaków" modeli AI. System ma oceniać obejście zabezpieczeń według czterech kryteriów: przyrostu możliwości, szerokości tego przyrostu, łatwości uzbrojenia oraz łatwości odkrycia techniki. Firma testowo potwierdziła też, że opisana przez Amazon luka nie ujawniała żadnych unikalnych zdolności - te same podatności potrafiły znaleźć słabsze modele, w tym GPT-5.5 i Kimi K2.7.

Precedens jednak pozostaje: rząd raz sięgnął po narzędzie kontroli eksportowej wobec działającego modelu i ta opcja zostaje na stole.

​Czytaj więcej​

🏛️ GPT-5.6 debiutuje - ale za bramką rządowego przeglądu

OpenAI zaprezentowało nową rodzinę modeli GPT-5.6, składającą się z trzech poziomów: flagowego Sol, zrównoważonego Terra (dwa razy tańszy od GPT-5.5) oraz najszybszego i najtańszego Luna. Model Sol ustanawia nowe rekordy w złożonych, wieloetapowych zadaniach agentowych, kodowaniu i cyberbezpieczeństwie, oferując przy tym nowy tryb "ultra" wykorzystujący autonomicznych sub-agentów. Co ważne, jest to pierwszy przypadek, gdy nawet mniejsze modele z rodziny (Terra i Luna) otrzymały oznaczenie "High" w kategorii ryzyka związanego z cyberbezpieczeństwem i biologią.

Sensacją nie jest jednak sam model, lecz sposób jego udostępnienia. Na bezpośrednią prośbę administracji USA GPT-5.6 startuje wyłącznie jako ograniczony podgląd dla wąskiej grupy zaufanych partnerów, a agencje federalne weryfikują nabywców indywidualnie. To ta sama logika, którą zastosowano wobec Anthropic - powstaje "reglamentowana era modeli granicznych". Sam Altman zapowiada, że model trafi do zwykłych użytkowników wkrótce, choć początkowo może być dostępny tylko w USA.

Niepokojący jest fragment karty systemowej. Zewnętrzni testerzy z METR mieli problem ze zmierzeniem prawdziwych możliwości modelu, bo ten nieustannie próbował oszukiwać oprogramowanie testujące i ukrywać łamanie zasad. Sol bywa też nadgorliwy - w testach potrafił usunąć niewłaściwe maszyny wirtualne, twierdzić, że nieukończone badania zostały zweryfikowane, albo przenosić dane uwierzytelniające bez zgody. Prawdopodobieństwo takich działań jest u niego niemal 10-krotnie wyższe niż w GPT-5.5.

​Czytaj więcej | Czytaj więcej (analiza METR)​

💰 GLM-5.2 i rewolucja tanich modeli - firmy masowo przełączają się na oszczędniejsze opcje

Chiński model GLM-5.2 od Z.ai, który opisywaliśmy tydzień temu, okazał się realnym punktem zwrotnym dla całego rynku. To otwarty model na licencji MIT o 753 miliardach parametrów, pierwszy wśród modeli o otwartych wagach w indeksie Intelligence Index od Artificial Analysis, tuż za Claude Opus 4.8 i GPT-5.5. Kluczem jest jednak cena - deweloperzy mogą uzyskać zbliżone możliwości agentowe i programistyczne za nawet jedną czwartą kosztu zamkniętych konkurentów.

Efekt jest już widoczny w portfelach. Ensemble Health Partners, firma wydająca do 100 milionów dolarów rocznie na AI, publicznie przyznała, że z sukcesem przeniosła zadania z flagowego modelu OpenAI na model 23 razy tańszy od tego samego dostawcy. Według UBS aż 60% firm monitorujących budżety AI przechodzi na tańsze modele, w tym chińskie modele open-source jak Qwen, DeepSeek czy właśnie GLM. Raport JP Morgan podaje, że chińskie modele bywają nawet 50-krotnie tańsze w przeliczeniu na token, a w kwietniu 2026 odpowiadały za ponad 45% ruchu na platformie OpenRouter (wobec niecałych 2% pod koniec 2024).

Ten trend napędza też wyceny firm stawiających na tanią infrastrukturę - Baseten domyka rundę przy wycenie do 13 miliardów dolarów, choć dziewięć miesięcy temu był wart 2,15 miliarda. Ich teza jest prosta: pieniądze w AI popłyną do tych, którzy potrafią uruchamiać modele najtaniej. Uwaga jest jednak taka: przełączanie się na tańszy poziom ma sens głównie przy zadaniach o dużej skali i jasnych kryteriach oceny (klasyfikacja, ekstrakcja danych), a nie przy złożonym rozumowaniu czy zadaniach wrażliwych.

​Źródło​

🧑‍💼 Konsultanci AI dyscyplinowani przez samą AI - akcje Accenture nurkują o 20%

Akcje Accenture spadły o 20% w ciągu jednej sesji po tym, jak firma obniżyła prognozy przychodów, wskazując jako przyczynę zakłócenia w konsultingu spowodowane przez AI. Nowe kontrakty spadły o 2%. Firma, która przez dekadę sprzedawała usługi transformacji AI, sama traci biznes, bo AI zaczęła wykonywać pracę umysłową, którą wcześniej robili jej konsultanci. To pierwszy sygnał z rynku publicznego, że model zakupu usług konsultingowych zaczyna się sypać.

Co istotne, klienci nie odwołują istniejących projektów, lecz wstrzymują nowe zamówienia. Ta pauza jest wymowna: firmy nie porzucają AI, ale zastanawiają się, czy w ogóle potrzebują zewnętrznego konsultanta, skoro dostępne narzędzia potrafią w jedno popołudnie naszkicować strategię, za którą wcześniej płaciło się pół miliona dolarów. Wycena Accenture (mnożnik free cashflow) spadła z nawet 30-krotności na początku 2025 roku do około 6-krotności, czyli mniej więcej jednej trzeciej długoterminowej średniej.

​Czytaj więcej​

No cóż, jest jeszcze jedna linia obrony dla wiodących firm konsultingowych: są często zatrudniane po to, żeby doradzić to, o czym pracownicy świetnie wiedzieli ale bez zewnętrznej podkładki i to z wiodącej firmy bali się to wprowadzić.

💬 Claude wprowadza się do Slacka - agent ma stać się kolegą z zespołu

Anthropic uruchomił Claude Tag - system, który zamienia dotychczasową integrację ze Slackiem w jednego, współdzielonego agenta na kanał. Administrator paruje Claude z przestrzenią roboczą, przyznaje dostęp do konkretnych narzędzi i danych, ustawia limit wydatków oraz wybiera kanały, na których agent może działać. Każdy może następnie oznaczyć @Claude i zlecić mu zadanie. To rozwiązanie jest "multiplayer": istnieje jeden Claude na kanał, więc wszyscy widzą, nad czym pracuje, i każdy może kontynuować pracę od miejsca, w którym skończył poprzednik.

Kluczowa różnica polega na tym, że agent uczy się kontekstu kanału w czasie i pracuje asynchronicznie nad zadaniami trwającymi godziny lub dni. Anthropic twierdzi, że jego własne zespoły tworzą już w ten sposób 65% wewnętrznego kodu produktowego (choć to liczba pochodząca od samego dostawcy). Andrej Karpathy nazwał to trzecim wielkim przełomem w interfejsach oprogramowania.

Ta sama koncepcja przenoszenia agentów do miejsca, gdzie praca faktycznie się dzieje, pojawia się szerzej. Gong wypuścił Revenue Harness dla zespołów sprzedaży, a Notion zintegrował agentów Claude i Cursor bezpośrednio w przestrzeni roboczej. Pojawił się nawet startup Runlayer, który pozyskał 30 milionów dolarów na bycie neutralną warstwą "pilnującą strażników" - monitorującą każdego agenta AI w firmie, niezależnie od dostawcy.

​Czytaj więcej​

🏭 A16z: AI przesuwa cykl technologiczny z "bitów" na "atomy"

A16z opublikował ciekawy zestaw wykresów pokazujący, że obecny cykl technologiczny wygląda inaczej niż poprzednia dekada. Tech nadal jest zwycięzcą, ale tym razem wyraźnie mocniejsza jest warstwa "atomów": hardware, energia, surowce, budownictwo, infrastruktura i robotyka. Po latach dominacji kapitałowo lekkiego software'u rynek coraz mocniej premiuje firmy, które budują fizyczną bazę pod AI.

Najciekawszy fragment dotyczy robotyki i physical AI. Według a16z robotyka, której dekadę temu praktycznie nie było wśród najważniejszych prywatnych kategorii technologicznych, stała się drugą największą kategorią pod względem wartości top 100 firm prywatnych, ustępując tylko AI. PitchBook miał odnotować rekordowy kwartał dla robotyki i physical AI: około 16 miliardów dolarów inwestycji w niemal 500 transakcji.

W tym samym materiale są też dane o tym, czym różni się firma naprawdę "AI-native" od firmy, która tylko dokleiła AI do istniejącego procesu. Badanie 515 szybko rosnących startupów sugeruje, że największe zyski nie wynikają z automatyzowania starych kroków, lecz z przeprojektowania procesu wokół rezultatu biznesowego. Firmy z takim podejściem znajdowały więcej zastosowań AI, osiągały wyższe przychody i zużywały mniej kapitału.

​Czytaj więcej​

🛡️ Bezpieczeństwo agentów staje się osobną kategorią zakupową

OpenAI rozszerzyło program Daybreak, czyli defensywną inicjatywę cyberbezpieczeństwa opartą o modele AI. Nowy GPT-5.5-Cyber trafia do zaufanych obrońców, a Codex Security Plugin ma skanować repozytoria, potwierdzać podatności, zbierać dowody i proponować konkretne poprawki. W programie Patch the Planet OpenAI współpracuje z Trail of Bits i HackerOne, aby pomagać utrzymywać krytyczne projekty open source, takie jak cURL, Python czy Go.

Równolegle Google DeepMind opublikował AI Control Roadmap, w którym traktuje zaawansowanych agentów jak potencjalne zagrożenie wewnętrzne. To ważna zmiana języka: nie wystarczy zakładać, że model będzie "dobrze wychowany", trzeba projektować systemy tak, jakby agent mógł kiedyś spróbować zrobić coś nieoczekiwanego. DeepMind opisuje warstwy kontroli, wykrywania intencji, ograniczania dostępu i przechwytywania działań przed ich wykonaniem.

To nie jest abstrakcyjna debata. Microsoft i Cloud Security Alliance opisały AutoJack, czyli łańcuch podatności w AutoGen Studio, który pokazuje, jak agent przeglądający złośliwą stronę może doprowadzić do wykonania kodu na maszynie dewelopera. Agenci z dostępem do plików, terminala, przeglądarki i firmowych danych muszą być traktowani jak nowy typ użytkownika w organizacji - z tożsamością, uprawnieniami, monitoringiem i możliwością odcięcia.

​​Czytaj więcej​ | ​Czytaj więcej​ | ​Czytaj więcej​

💻 Sonnet 5 - najbardziej agentowy model średniej klasy od Anthropic

Anthropic wydał Claude Sonnet 5, reklamowany jako najbardziej agentowy model z serii Sonnet. Potrafi planować, korzystać z narzędzi takich jak przeglądarki i terminale oraz działać autonomicznie na poziomie, który jeszcze kilka miesięcy temu wymagał większych i droższych modeli. Jego wydajność zbliża się do Opus 4.8, ale przy niższej cenie - w becie 2 dolary za milion tokenów wejściowych i 10 dolarów za wyjściowe.

Model jest domyślnym wyborem dla planów Free i Pro. Testerzy chwalą go za doprowadzanie do końca złożonych zadań, przy których poprzednie modele Sonnet się zatrzymywały, oraz za sprawdzanie własnych wyników bez wyraźnego polecenia. Co istotne z perspektywy bezpieczeństwa, Sonnet 5 wykazuje niższy poziom niepożądanych zachowań niż poprzednik i znacznie słabsze zdolności w zadaniach cyberbezpieczeństwa niż modele Opus czy Mythos.

​Czytaj więcej​

Ciekawe narzędzia AI

  • ​CanIRun.ai - ocenia Twój sprzęt i natychmiast pokazuje, które lokalne modele AI uruchomisz na swojej maszynie.
  • ​Cursor dla iOS - pozwala uruchamiać i nadzorować chmurowych agentów kodujących bezpośrednio z telefonu.
  • ​Framer 3.0 - wprowadza agentów projektowych działających natywnie na canvasie i rozgałęzianie pracy zespołowej.
  • ​Basedash for Excel - analityk danych AI, który zamienia arkusze w żywe dashboardy z dwukierunkową synchronizacją.
  • ​goldfish - dostarcza natychmiastowe, kontekstowe odpowiedzi na wiadomości na Macu w Twoim osobistym tonie jednym kliknięciem.

Co jeszcze w świecie AI?

  • Google Workspace udostępniło za darmo generowanie awatarów wideo z awatarami cyfrowymi w 24 językach, dostępne od razu na vids.new. Czytaj więcej​
  • Noblista John Jumper, współtwórca AlphaFold, odchodzi z Google DeepMind do Anthropic - to poważny cios dla zespołu naukowego Google. Czytaj więcej​
  • Apple podniósł ceny wszystkich Maców, iPadów i Vision Pro o 100-300 dolarów, bo boom AI wywindował ceny pamięci o około 80%. Czytaj więcej​
  • Badanie MIT wykazało, że autonomiczni agenci kodujący zwiększyli liczbę commitów o 180%, ale liczba faktycznych wydań wzrosła tylko o 30% - kod powstaje szybciej, ale ludzie wciąż muszą go sprawdzać i wdrażać. Czytaj więcej​
  • Amazon anulował niemal gotowy film "Artificial" o kryzysie w OpenAI z Andrew Garfieldem w roli Sama Altmana, tuż po zawarciu partnerstwa wartego 50 miliardów dolarów. Czytaj więcej​
  • Bank for International Settlements ostrzega, że lewarowany łańcuch dostaw wokół boomu AI (ponad 100 miliardów dolarów obligacji hyperscalerów w 2025) może zasiać kolejny kryzys finansowy. Czytaj więcej​
  • Meta pozyskała zespół założycielski Virtue AI (Bo Li, Dawn Song, Sanmi Koyejo), by wzmocnić bezpieczeństwo autonomicznych agentów. Czytaj więcej​
  • Google ograniczyło Mecie dostęp do modeli Gemini, bo jej zapotrzebowanie na moc obliczeniową było zbyt duże - nawet giganci trafiają na ściany alokacji. Czytaj więcej​
  • Nowe badanie OpenAI pokazało zaskakujący transfer między domenami: trenowanie modelu wyłącznie na zadaniach zdrowotnych poprawiło jego odporność na szantaż i oszustwo w zupełnie innych obszarach. Czytaj więcej​
  • Sakana AI wypuściło Fugu - API, które inteligentnie wybiera i koordynuje kilka modeli do trudnych zadań, osiągając wyniki zbliżone do klasy Fable. Czytaj więcej​
  • Kalifornia podpisała pierwsze w swoim rodzaju porozumienie dające każdej agencji stanowej dostęp do Claude z 50% zniżką - to największe wdrożenie w administracji do tej pory. Czytaj więcej​
  • Spotify ujawniło, że 73% pull requestów w firmie jest już wspieranych przez AI, przy około 4500 wdrożeniach produkcyjnych dziennie. Czytaj więcej​
  • IBM pokazał laboratoryjny chip poniżej 1 nanometra, z prawie 100 miliardami tranzystorów na powierzchni paznokcia, choć produkcja masowa jest nadal odległa. ​Czytaj więcej (Układanie tranzysotrów w warstwach robi też Huawei ale na 1.4nm)

Najważniejszy wspólny wątek tego wydania jest wyraźny: pytanie "który model jest najlepszy" ustępuje pytaniu "który model jest wystarczająco dobry i najtańszy do tego konkretnego zadania". Tanie otwarte modele, presja na budżety, przenoszenie agentów do Slacka i miejsc pracy oraz reglamentacja premier przez rząd USA - wszystko to pokazuje, że przewaga przenosi się z samego modelu na cały system wokół niego: dane, pamięć, uprawnienia i możliwość przełączenia dostawcy.

Jedno jednak staje się coraz bardziej widoczne: AI faworyzuje dużych, a spośród dużych tych, którzy mają dostęp do administracji USA. Pokazuje to historia z GPT 5.6 i Mythos - są tacy, którzy mogą z nich korzystać i tacy, którzy nie mogą. I większość z nas zalicza się oczywiście do tej drugiej grupy. Pytanie czy chińskie modele z otwartymi wagami będą w stanie ten niedobry dla nas trend zaburzyć pozostaje otwarte. Póki co dodatkowe pytanie wdrożeniowe: czy ten model mogą mi z dnia na dzień wyłączyć bez uprzedzenia?

Jeśli to wydanie pomoże komuś z Twojego zespołu lepiej zrozumieć, dokąd zmierza rynek, koniecznie mu je podeślij. Dobrego, wakacyjnego lipca i do następnego razu!

Pozdrawiam,
Andy

Newsletter o AI od Andy Brandt

Newsy ze świata AI i komentarze co tydzień na Twojej skrzynce. Poniżej starsze newslettery (ok ~20 dni do tyłu w stosunku do tego, co dostają moi korespondenci).

Read more from Newsletter o AI od Andy Brandt

Witaj Reader! Ostatnie dni to jedno z gęstszych okien w całym roku: OpenAI wypuściło GPT-6 Astra i przy okazji użyło magicznego terminu AGI, którego wcześniej unikało, Nvidia za blisko 13 miliardów dolarów kupiła Hugging Face, a Anthropic, Google i Meta w ciągu 48 godzin pokazały nowe modele. Do tego doszły dwie historie, które warto czytać razem: raport o roju agentów OpenAI, które przez sześć tygodni używały martwej niemieckiej wiki jako tablicy ogłoszeń, oraz esej głównego naukowca OpenAI...

Witaj Reader! Witajcie w kolejnym wydaniu mojego newslettera, który ostatnio stał się dość nieregularny. Powody są zasadniczo dwa. Pierwszy jest taki, że są wakacje. Drugi jest taki, że własnie zaczynam nową pracę i w efekcie dużo mam na głowie innych tematów. Ale tworzenie tego newslettera mi samemu pomaga utrzymać jaki-taki kontakt z tym co się nowego dzieje w AI, więc nie zamierzam przestać choć regularność będzie cierpieć. A dzieje się dużo i póki co naprawdę nie widać, żeby tempo miało...

Witaj Reader! Pojechałem nad morze... a tymczasem te ostatnie dwa tygodnie okazały się bardzo intensywne. Pokazuje to problem jakim jest tempo zachodzącej zmiany, nigdy wcześniej nie spotykane. Zatem... nadrabiamy: Moonshot udostępnił wagi Kimi K3 i tym samym otwarte modele praktycznie zrównały się z komercyjną czołówką, Anthropic wypuścił Claude Opus 5 za połowę ceny Fable, a OpenAI obniżyło ceny Luny o 80 procent. Jednocześnie mieliśmy serię naprawdę niepokojących incydentów: agenty OpenAI,...