|
Witaj Reader! Po tygodniach dramatów wokół blokad rządowych wreszcie mamy prawdziwą falę premier - i to jaką. OpenAI wypuściło rodzinę GPT-5.6 wraz z agentowym ChatGPT Work, SpaceXAI odpaliło zaskakująco tanie Grok 4.5, a Anthropic pokazało wgląd w "wewnętrzny notatnik myśli" Claude'a. Na rynku toczy się prawdziwa wojna cenowa - modele klasy Fable dostają konkurencję za ułamek kosztu, co pokazuje że a firmy uczą się budować systemy niezależne od pojedynczego dostawcy. Do tego Apple pozywa OpenAI o kradzież tajemnic sprzętowych, a rząd China idzie w ślady rządu USA i zamierza ograniczyć dostępność najnowszych modeli poza Chinami. Zanim jednak przejdziemy do newsów chcę się podzielić z Tobą pewną refleksją, do której zainspirowało mnie zrozumienie, że dobrym tłumaczeniem słowa "harness" na polski jest "uprząż". To świetnie pasuje - uprząż na koniu służy do tego, żeby zwierzę - które ma własny rozum i wolę - zaprząc do pożytecznej pracy (czy to niesienia jeźdźca czy też ciągnięcia wozu) jednocześnie zapewniając woźnicy czy jeźdźcowi możliwość kontrolowania zwierzęcia. Podzieliłem się to refleksją z pewnym doświadczonym CIO, który jak się okazało miał okazję jeździć konno dzięki czemu dowiedziałem się, że lejców i innych "elementów sterowania koniem" należy używać ostrożnie i z wyczuciem, bo jako się rzekło zwierzę ma swój rozum i nie działa to tak jak przy sterowaniu maszyną. Ta rozmowa pomogła mi głębiej zrozumieć czemu twórcy narzędzi takich jak "Claude Code" nazwali je "AI Harness" - to jest uprząż, dzięki której zaprzęgami AI do pożytecznej pracy. Ale sposób tej pracy jest bardzo różny od tego jak pracowało się nad kodem kiedyś. I trzeba ten sposób opanować co wcale nie jest proste zwłaszcza dla kogoś, kto nigdy nie jeździł konno. :) 🥊 GPT-5.6 i Grok 4.5 depczą po piętach Fable 5 - za jedną trzecią cenyOpenAI wypuściło rodzinę GPT-5.6 składającą się z trzech wariantów: flagowego Sol, tańszego Terra oraz najszybszej i najtańszej Luny. Najważniejsza jest tu matematyka: Sol uzyskał 59 punktów w Artificial Analysis Intelligence Index wobec 60 dla Claude Fable 5, ale kosztuje około 1,04 dolara za zadanie zamiast 2,75. Sol zdobył też pierwsze miejsce w nowym Coding Agent Index i wprowadził "tryb ultra", który koordynuje cztery równoległe sub-agenty. Ceny API to 5 dolarów za milion tokenów wejściowych i 30 za wyjściowe dla Sola, a Luna schodzi aż do 1/6 dolara. Dwa dni wcześniej SpaceXAI (po przejęciu Cursora za 60 miliardów dolarów) pokazało Grok 4.5, model "klasy Opus" trenowany razem z Cursorem. Jego przewagą jest oszczędność - zużywa około 60% mniej tokenów wyjściowych niż Opus 4.8 przy podobnej pracy, a ceny to 2 dolary za milion tokenów wejściowych i 6 za wyjściowe. Według VentureBeat pojedyncze zadanie programistyczne kosztuje 1,51 dolara wobec 17,32 dla Fable 5 Max. Jest jednak drobny haczyk: Cursor przyznał, że starszy snapshot jego własnej bazy kodu przypadkiem trafił do danych treningowych Groka, co zawyżało wyniki na CursorBench. Nikt nie zadał nokautującego ciosu, ale wniosek jest jasny - inteligencja gwałtownie tanieje, a to świetna wiadomość dla użytkowników i znacznie gorsza dla tych, którzy ją sprzedają. Czytaj więcej | Czytaj więcej (Grok 4.5) | Czytaj więcej (analiza cenowa) 🤖 ChatGPT Work - koniec czatu, początek "skończonej pracy"Wraz z premierą GPT-5.6 OpenAI zaprezentowało ChatGPT Work, które zamienia okno czatu w nadzorowanego agenta wykonującego całe projekty. Zamiast odpowiadać na pytania, system przyjmuje cel (np. "przygotuj aktualizację dla zarządu" albo "raport z premiery"), zbiera kontekst z wybranych aplikacji, plików i źródeł web, proponuje plan, zadaje pytania doprecyzowujące i czeka na akceptację przed wrażliwymi krokami. Efektem nie jest tekst, lecz gotowy artefakt: arkusz, prezentacja, dokument, dashboard czy strona internetowa. Najważniejsza jest jednak decyzja o interfejsie. Anthropic udostępniło Fable API-first, a OpenAI wbudowało agenta bezpośrednio w ChatGPT, który ma około miliarda użytkowników tygodniowo. To zakład, że dystrybucja bije surową wydajność modelu. Wersja desktopowa daje najgłębszy dostęp - potrafi działać na lokalnych plikach, kartach przeglądarki i aplikacjach, dostaje własny kursor i porządkuje np. Apple Notes w tle. Dostępnych jest ponad 1400 wtyczek do integracji z narzędziami biznesowymi. Dla operatorów to zmiana pytania z "który model jest lepszy w benchmarku" na "który system mój zespół faktycznie otworzy, gdy będzie miał realne zadanie do wykonania". 🧠 Anthropic zagląda do "ukrytego umysłu" Claude'aBadacze Anthropic opublikowali fascynującą pracę, w której odkryli wewnętrzną "przestrzeń roboczą" wewnątrz Claude'a. Za pomocą metody nazwanej "J-lens" (soczewka jakobianowa) nauczyli się odczytywać część prywatnych, wewnętrznych sygnałów modelu, zanim ten cokolwiek napisze. Okazuje się, że Claude czasem używa niewielkiego wewnętrznego "notatnika", by przetrzymywać idee w trakcie rozwiązywania trudniejszych problemów - może wypowiadać jedno, a wewnętrznie nieść zupełnie inny koncept lub pośrednie kroki rozumowania. Co ciekawe, ta wewnętrzna przestrzeń zachowuje się funkcjonalnie podobnie do jednej z głównych teorii ludzkiej świadomości - global workspace theory. Gdy badacze usuwali lub zmieniali koncepty w tej przestrzeni, zachowanie Claude'a zmieniało się w celowany sposób: banan stawał się słoniem, Francja Chinami. Przy prostych zadaniach (klasyfikacja tekstu, kontynuacja po hiszpańsku) model radził sobie bez tego mechanizmu, ale zadania wymagające wieloetapowego rozumowania, analogii czy tłumaczenia wyraźnie się psuły. Najciekawszy jest aspekt bezpieczeństwa. Jeśli model wewnętrznie zauważa słowa takie jak "fałsz", "oszustwo", "ewaluacja" czy "w tajemnicy", jednocześnie dając neutralną odpowiedź, J-space może ujawnić ten ukryty stan zanim dotrze do powierzchni. Anthropic zaznacza jednak trzeźwo: to dowód na funkcjonalny mechanizm dostępu, a nie na to, że Claude cokolwiek "czuje" lub ma życie wewnętrzne. 🇨🇳 Chiny rozważają odcięcie zagranicy od swoich najlepszych modeliTo niepokojąca wiadomość dla wszystkich, którzy liczyli na tanie, otwarte modele z Chin. Pekin prowadzi rozmowy z Alibabą, ByteDance i Z.ai o utrzymaniu najsilniejszych chińskich modeli wewnątrz kraju - w tym modeli jeszcze niewydanych. Rozmowom przewodzi Ministerstwo Handlu wraz z państwową agencją planowania, co sygnalizuje kontrolę eksportową, a nie zwykłą regulację platform. Ograniczenia mają objąć zarówno modele zamknięte, jak i te z otwartymi wagami, więc problem dotyczy nie tylko dostępu przez API, ale i możliwości pobierania potężnych modeli. Chińscy urzędnicy dyskutowali też o traktowaniu wycieku lub kradzieży własnościowej technologii AI jako przestępstwa przeciw bezpieczeństwu narodowemu. Firmy zagraniczne mogą stracić dostęp do niskokosztowych chińskich modeli akurat w chwili, gdy stają się one wystarczająco silne do poważnej pracy produkcyjnej. To symetryczne odbicie tego, co robi Waszyngton, ograniczając dostęp do zaawansowanych amerykańskich modeli. Prawdopodobna ścieżka to kontrola warstwowa: podstawowe otwarte narzędzia dostają zgłoszenia, silniejsze systemy podlegają przeglądom, a modele graniczne pozostają w kraju. Byłby to poważny cios dla otwartego dostępu do AI - postęp modeli przestałby rozprzestrzeniać się głównie przez jakość produktu i cenę. ⚖️ Apple pozywa OpenAI o kradzież tajemnic sprzętowychApple złożyło szeroko zakrojony pozew przeciwko OpenAI i jej sprzętowej spółce io Products, oskarżając firmę o systematyczne wykorzystywanie tajemnic handlowych do budowy urządzeń konsumenckich z AI. Pozew wskazuje byłych menedżerów Apple - Tanga Tana (obecnie Chief Hardware Officer w OpenAI, 24 lata w Apple) i inżyniera Changa Liu. Według skargi Liu miał zatrzymać służbowego laptopa po odejściu i pobrać poufne dokumenty techniczne dotyczące nieujawnionych technologii. Apple twierdzi, że Tan instruował rekrutów, by przynosili na rozmowy w OpenAI nieujawnione prototypy i własnościowe dane o dostawcach, pomagając zbudować zespół sprzętowy liczący dziś ponad 400 byłych pracowników Apple. Firma podnosi też, że jej poufne informacje wykorzystano przy pracach nad sprzętem OpenAI, w tym zastrzeżoną technikę obróbki metalu. Apple domaga się m.in. zakazu używania swoich tajemnic i zwrotu materiałów. Spór wybucha, gdy OpenAI rozwija ambicje sprzętowe po przejęciu startupu io Jony'ego Ive'a za 6,5 miliarda dolarów. OpenAI odrzuca zarzuty, twierdząc, że nie ma interesu w tajemnicach innych firm. Cała sprawa doprowadziła też do publicznej sprzeczki na platformie X między Elonem Muskiem a Samem Altmanem. 🎙️ ChatGPT dostaje nowy głos - GPT-Live słucha i mówi jednocześnieOpenAI całkowicie przebudowało tryb głosowy ChatGPT, wprowadzając modele GPT-Live oraz Live-1-mini. Nowa architektura pełnego dupleksu pozwala modelowi słuchać i mówić w tym samym czasie, dzięki czemu można mu naturalnie przerywać, robić pauzy, wtrącać krótkie potwierdzenia, a nawet tłumaczyć na żywo - bez ucinania wypowiedzi użytkownika w połowie zdania. Kluczowym trikiem jest rozdzielenie potoku przetwarzania: silnik głosowy utrzymuje płynność rozmowy, podczas gdy trudniejsze pytania trafiają w tle do GPT-5.5, który zajmuje się głębokim rozumowaniem i wyszukiwaniem w sieci. Efektem jest znacznie płynniejsza konwersacja i wyraźny skok inteligencji względem starego trybu głosowego. Funkcja jest wdrażana globalnie zarówno dla użytkowników darmowych, jak i płacących, a dostęp deweloperski ma pojawić się później. 🎨 Meta wchodzi do gry z modelami Muse - i szybko wycofuje jedną funkcjęMeta Superintelligence Labs pod wodzą Alexandra Wanga zaprezentowało własne modele multimodalne: Muse Image i Muse Video. To pierwszy generator obrazów Mety po modelu językowym Muse Spark, który wcześniej korzystała z Midjourney i Black Forest Labs. Muse działa bardziej jak autonomiczny agent niż zwykły generator - potrafi przeszukiwać sieć w poszukiwaniu faktów i referencji wizualnych, pisać kod, by wygenerować skanowalne kody QR, a także samodzielnie oceniać i poprawiać swoje szkice. Muse Video zadebiutowało na trzecim miejscu w rankingu LMSYS Text-to-Video Arena, wyprzedzając Sora 2 Pro i Google Veo-3.1. Firma szybko musiała jednak zmierzyć się z kryzysem. Zaledwie kilka dni po premierze Meta wycofała funkcję pozwalającą oznaczać publiczne konta na Instagramie i wciągać prawdziwe osoby do scen generowanych przez AI - po fali sprzeciwu wobec tworzenia obrazów użytkowników bez ich zgody. To wymowna lekcja, że nawet przy potężnej technologii kwestie prywatności i zgody potrafią wywrócić produkt w kilka dni. Czytaj więcej | Czytaj więcej (wycofanie funkcji) 🤖 1X pokazuje robotyczną dłoń o ludzkiej precyzjiFirma 1X Technologies zaprezentowała najbardziej zaawansowaną dłoń robotyczną dla swojego humanoida NEO, mającą 25 stopni swobody (22 osie palców i dłoni plus 3 osie nadgarstka). Zarówno Elon Musk, jak i Demis Hassabis wielokrotnie podkreślali, że robotyka jest zablokowana właśnie przez dłonie - roboty nie staną się naprawdę użyteczne, dopóki chwytaki radykalnie się nie poprawią. Konstrukcja opiera się na napędzie ścięgnowym z niskim przełożeniem, dzięki czemu siły z zewnątrz wracają przez każdy staw - to daje robotowi realne "czucie" kontaktu. Silniki siedzą w przedramieniu i ciągną ścięgna przez nadgarstek jak biologiczne mięśnie, co utrzymuje palce lekkimi. Dłoń łączy propriocepcję w zamkniętej pętli (dane o pozycji i sile bez użycia kamer) ze skórą dotykową rejestrującą nacisk i ślizganie się obiektów, jest wodoszczelna (IP68) i wykonana z materiałów bezpiecznych dla kontaktu z żywnością. Najciekawsza jest jednak pętla danych: każdy chwyt zwraca informacje o sile, pozycji, kontakcie i poślizgu, zamieniając NEO w rodzaj instrumentu pomiarowego, który uczy kolejne pokolenia robotów. 1X planuje produkcję 10 000 dłoni w tym roku. 🚗 Roboty humanoidalne Figure budują samochody na linii produkcyjnej BMWCEO Figure, Brett Adcock, ogłosił, że humanoidalne roboty F.03 pracują komercyjnie na linii montażowej BMW w Spartanburgu, pomagając budować model X3. To nie jest demo ani pilotaż, lecz realna produkcja z bieżącymi zadaniami logistycznymi przez sześć miesięcy - pierwsze cztery samochody z tej linii Adcock kupił dla siebie. To pierwsze komercyjne wdrożenie robotów humanoidalnych u dużego producenta samochodów. Znaczenie tej wiadomości wykracza poza produkcję. Fizyczne wdrożenia AI na dużą skalę generują dane z interakcji, które wracają do treningu - każdy robot zbierający dane o manipulacji obiektami na linii BMW przyspiesza trenowanie kolejnej generacji robotów. To ta sama pętla sprzężenia zwrotnego, która tak szybko poprawiała modele językowe, tyle że wejściem są dane fizyczne, a tempo ich zbierania ogranicza liczba faktycznie działających robotów. Ciekawe narzędzia AI
Co jeszcze w świecie AI?
Najważniejszy wspólny wątek tego wydania jest wyraźny: wojna cenowa rozkręca się na dobre, a przewaga przesuwa się od "który model jest najlepszy" ku "który system wokół modelu daje najwięcej za najmniej". GPT-5.6, Grok 4.5 i tanie modele otwarte pokazują, że granica możliwości staje się coraz tańsza, podczas gdy rządy USA i Chin coraz mocniej decydują, kto ma dostęp do najlepszych narzędzi. Dla nas oznacza to jedno: warto budować elastycznie, tak by dało się przełączyć dostawcę z dnia na dzień. No i korzystajmy, bo jeśli subskrybcja Claude za $200 kupuje tokeny za $8000 (wg cennika API, bo koszt jest jeszcze wyższy) to cały czas ktoś dokłada różnicę. W końcu przestanie. Jeśli to wydanie pomoże komuś z Twojego zespołu lepiej zrozumieć, dokąd zmierza rynek, koniecznie mu je podeślij - i do zobaczenia w kolejnym wydaniu (chciałem napisać za tydzień, ale ten czas wakacyjny nie sprzyja regularności - więc: mam nadzieję, że za tydzień :) )! Pozdrawiam, |
Newsy ze świata AI i komentarze co tydzień na Twojej skrzynce. Poniżej starsze newslettery (ok ~20 dni do tyłu w stosunku do tego, co dostają moi korespondenci).
Witaj Reader! Ostatnie dni to jedno z gęstszych okien w całym roku: OpenAI wypuściło GPT-6 Astra i przy okazji użyło magicznego terminu AGI, którego wcześniej unikało, Nvidia za blisko 13 miliardów dolarów kupiła Hugging Face, a Anthropic, Google i Meta w ciągu 48 godzin pokazały nowe modele. Do tego doszły dwie historie, które warto czytać razem: raport o roju agentów OpenAI, które przez sześć tygodni używały martwej niemieckiej wiki jako tablicy ogłoszeń, oraz esej głównego naukowca OpenAI...
Witaj Reader! Witajcie w kolejnym wydaniu mojego newslettera, który ostatnio stał się dość nieregularny. Powody są zasadniczo dwa. Pierwszy jest taki, że są wakacje. Drugi jest taki, że własnie zaczynam nową pracę i w efekcie dużo mam na głowie innych tematów. Ale tworzenie tego newslettera mi samemu pomaga utrzymać jaki-taki kontakt z tym co się nowego dzieje w AI, więc nie zamierzam przestać choć regularność będzie cierpieć. A dzieje się dużo i póki co naprawdę nie widać, żeby tempo miało...
Witaj Reader! Pojechałem nad morze... a tymczasem te ostatnie dwa tygodnie okazały się bardzo intensywne. Pokazuje to problem jakim jest tempo zachodzącej zmiany, nigdy wcześniej nie spotykane. Zatem... nadrabiamy: Moonshot udostępnił wagi Kimi K3 i tym samym otwarte modele praktycznie zrównały się z komercyjną czołówką, Anthropic wypuścił Claude Opus 5 za połowę ceny Fable, a OpenAI obniżyło ceny Luny o 80 procent. Jednocześnie mieliśmy serię naprawdę niepokojących incydentów: agenty OpenAI,...