Opus 4.8 przestaje kłamać, a Google rusza po rynek osobistych asystentów AI

    Najważniejsze zmiany w AI w czerwcu 2026 dla Twojej pracy

    Kamil JakubczykFilip PabisekKrzysztof WróblewskiAleksandra Rogalska, MBA

    Zespół nauczymycie.ai

    Nie przegap kolejnego wydania. Raz w miesiącu, 2000+ czytelników.

    Zapisz się

    Cześć!

    Maj mimo zbliżających się wakacji utrzymał tempo. Brytyjski rząd ostrzega, że możliwości AI podwajają się już co 4 miesiące.

    Anthropic wypuścił Opusa 4.8, pierwszy model, który realnie przestaje kłamać. Google rzuciło wyzwanie OpenClaw i Hermesowi własnym asystentem. A w tle ponad połowa firm w USA płaci już za sztuczną inteligencję. Zaczynamy.

    5 rzeczy, które musisz wiedzieć

    1.AI przyśpieszyło. Znowu

    AI przyśpieszyło - METR mierzy horyzont czasowy modeli

    Brytyjska agencja badająca AI wyliczyła, że Claude Mythos skrócił czas podwajania możliwości modeli z 7-8 do zaledwie 4 miesięcy. Benchmark METR, który mierzy, jak długie zadania AI wykonuje samodzielnie, potwierdza - Mythos Preview przebił dotychczasowy trend i przy 80% skuteczności wykonuje zadania zajmujące ludzkiemu ekspertowi ponad 3 godziny. Jeśli to tempo się utrzyma, w 3 lata czeka nas 9 podwojeń możliwości AI.

    Zobacz więcej

    2.Firefox naprawił w miesiąc więcej błędów niż przez 15 miesięcy

    Mozilla Firefox naprawił w kwietniu więcej bugów niż przez 15 miesięcy

    W kwietniu Mozilla z pomocą Claude Mythosa naprawiła 423 błędy. To więcej niż przez poprzednie 15 miesięcy razem wziętych. Sam Mythos znalazł 271 ukrytych podatności, których przez lata nie wychwyciły żadne procesy, w przeglądarce używanej co miesiąc przez 155 milionów osób. Dla mnie najważniejsze jest to, że AI nie zastąpiła specjalistów, tylko umożliwiła im pracę nad zadaniami, do których wcześniej brakowało im czasu i kompetencji.

    Zobacz więcej

    3.Opus 4.8 - pierwszy model, który (ponoć) nie kłamie

    Opus 4.8 - najlepszy model do codziennej pracy

    Anthropic wypuścił Opusa 4.8 i w mojej ocenie to najlepszy model do codziennej pracy. Nawet nie przez jego bezpośrednią inteligencję, tylko przez postęp tam, gdzie AI ma dziś największy problem: niezawodność i uczciwość. W teście na ukrywanie wad kodu poprzedni Opus milczał w 19,7% przypadków, Sonnet 4.6 aż w 65,2%, a Opus 4.8 zszedł do 3,7%. W teście na lenistwo pierwszy raz model nie pomylił się ani razu. Do tego świetnie radzi sobie z długim kontekstem i dominuje większość benchmarków biznesowych.

    Zobacz więcej

    4.Gemini Spark - odpowiedź Google na OpenClaw i Hermes

    Gemini Spark - osobisty agent AI od Google

    Google zapowiedziało Gemini Spark, osobistego agenta AI działającego 24/7 w chmurze. Jego przewaga jest oczywista: kontekst i ekosystem. Spark ma dostęp do Twojego Gmaila, Drive, Kalendarza i całego Workspace. Bez manualnej konfiguracji: stawiania serwera, podpinania go pod aplikacje, budowania i pobierania skilli. Po prostu otwierasz aplikację i piszesz: przygotuj podsumowanie dnia, znajdź zaległe zadania w dokumentach, daj znać, gdy konkurent wypuści nowy produkt. Pierwsza wersja ma działać z Gemini 3.5 Flash, więc nie liczę na cuda - prawdziwy test przyjdzie wraz z premierą Gemini 3.5 Pro w przyszłym miesiącu.

    Zobacz więcej

    5.Ponad 50% firm w USA płaci już za AI

    Ponad 50% firm w USA płaci już za AI - dane z Ramp AI Index

    Ramp AI Index pokazuje, że ponad połowa amerykańskich firm aktywnie płaci za narzędzia AI. To nie deklaracje z ankiet, tylko dane wyciągane prosto z faktur. Dla tych, którzy przez 3 lata powtarzali, że AI to bańka, to bardzo niewygodna liczba - kiedy 50% firm z największej gospodarki świata płaci za technologię w 3 lata od premiery, mówimy o sytuacji absolutnie bezprecedensowej. W wielu firmach to wciąż chaos: kilka subskrypcji i pierwsze automatyzacje. Ale dokładnie tak wyglądała adopcja komputerów i internetu.

    Zobacz więcej

    Tip miesiąca

    Nie daj się naciągnąć dostawcom AI

    Niewiele osób wie, że dostawcy AI potrafią po cichu obniżać jakość swoich modeli. MarginLab od 22 maja widzi spadek skuteczności Claude Code z Opusem 4.7 - z bazowych 65% do 50%, i jest to spadek statystycznie istotny. Ty płacisz tyle samo, oni wydają mniej na serwowanie modelu, a różnica zostaje w ich kieszeni. OpenAI łapano na tym samym.

    Dlatego zbuduj własny benchmark - nie abstrakcyjne testy, tylko zestaw zadań z Twoich codziennych procesów. Pozwoli Ci wybrać model z najlepszym stosunkiem jakości do kosztu oraz wychwycić moment, w którym dostawca po cichu obniża jakość modelu. Taka wiedza potrafi być warta dziesiątki, a czasem setki tysięcy złotych.

    Zobacz więcej

    Takie sposoby pracy ćwiczymy z zespołami na szkoleniach AI dla firm. Jeśli chcesz, żeby cały zespół pracował tak z AI, zacznij od bezpłatnej konsultacji.

    Polecane narzędzia i modele AI: czerwiec 2026

    8 narzędzi z tego wydania dostajesz mailem

    Listę polecanych narzędzi i modeli wysyłamy tylko subskrybentom. Zapisz się, a kolejną dostaniesz razem z następnym wydaniem.

    Zapisz się do newslettera

    Polecane poradniki

    Tak pracujemy z zespołami

    Nie przegap kolejnego wydania

    Raz w miesiącu otrzymasz 5 najważniejszych wiadomości ze świata sztucznej inteligencji + praktyczne tipy usprawniające Twoją pracę.

    Zapisując się, akceptujesz naszą politykę prywatności.