Dakarda AI Newsletter · 10 lipca 2026

Wydanie piątkowe

Trzy fronty AI – 24 dni do granicy

OpenAI publikuje GPT-5.6 w trzech wariantach, SpaceXAI (xAI + SpaceX) uderza z Grok 4.5 po przejęciu Cursora za 60 mld, a Meta łamie wieloletnią zasadę i po raz pierwszy wprowadza płatny model. Do tego UE odlicza dni do obowiązkowego znakowania treści AI, a Uber testuje nowatorski model wdrażania agentów w enterprise. To był intensywny tydzień.

Wstęp · Alex

W tym tygodniu rynek AI eksplodował na trzech frontach jednocześnie. OpenAI pokazało, że potrafi jeszcze zaskoczyć — Sol bije konkurencję na testach agentowych przy ułamku kosztów. SpaceXAI z Grok 4.5 udowadnia, że fuzja z Cursorem to nie był tylko gest Muska, tylko realna strategia wejścia w enterprise. A Meta? Meta po latach rozdawania modeli za darmo wreszcie mówi: „za wszystko trzeba płacić”. W dzisiejszym wydaniu prześledziłam pięć wydarzeń, które zmienią układ sił na najbliższe miesiące. Od benchmarków i cen, przez regulacje UE, aż po praktyczne studium wdrożenia agentów w korporacji. Do tego sekcja tech, narzędzie tygodnia i porada dnia, która przyda się każdemu, kto pracuje z agentami AI.

Co warto wiedzieć

01

OpenAI wypuszcza GPT-5.6: Sol bije konkurencję, ChatGPT Work wchodzi do biur

Rodzina modeli GPT-5.6 w trzech wariantach — Sol (flagowy, najpotężniejszy), Terra (zbalansowany) i Luna (najszybszy, najtańszy). Sol wyprzedza Claude Fable 5 o 13,1 pkt w teście Agents' Last Exam, robiąc to z 61% mniejszym nakładem czasu i przy połowie kosztów. Równocześnie OpenAI zaprezentowało ChatGPT Work — agenta zintegrowanego z Codexem, który realizuje zadania w arkuszach, kalendarzach i mailach, z opcją nadzoru dla firm.

02

SpaceXAI uderza z Grok 4.5 — model po przejęciu Cursor za 60 mld $

SpaceXAI (dawniej xAI) wypuściło Grok 4.5 — model trenowany wspólnie z przejętym Cursorem, zaprojektowany głównie do kodowania i zadań agentowych. Ceny są agresywne: wejście od 2,5 $/M tokenów wobec 10-15 $ u konkurencji. Model pozycjonowany jako 'Opus-class, faster, cheaper' — bezpośrednie zagrożenie dla Claude Code i OpenAI Codex.

03

Meta Muse Spark 1.1 — pierwszy płatny model w historii Meta AI

Meta udostępniła Muse Spark 1.1 z 1M tokenów kontekstu, przewyższający benchmarkami starsze wersje OpenAI i Anthropica. Po raz pierwszy Meta oferuje płatny dostęp przez Meta Model API (1,25 $/M wejściowych, 4,25 $/M wyjściowych). To koniec ery darmowego AI od Meta i zapowiedź nowego etapu monetyzacji.

04

UE: 24 dni do obowiązkowego znakowania treści AI — publikacja Action Plan

Komisja Europejska opublikowała Action Plan on Cybersecurity and AI oraz formalną opinię o Code of Practice on Transparency of AI-Generated Content. To uruchamia 24-dniowe odliczanie do obowiązkowego znakowania treści AI (art. 50 AI Act, wejście w życie 2 sierpnia 2026). Równocześnie UE buduje system pre-release evaluation dla zaawansowanych modeli, co wpłynie na strategie release'owe wszystkich graczy na rynku europejskim.

05

Uber testuje 'Agentic Pods' — embedded AI w HR, finansach i dziale prawnym

CTO Ubera wdrożył 30 najlepszych inżynierów AI bezpośrednio do działów HR, finansów i prawnych na 2 tygodnie. Zamiast centralnego AI teamu, inżynierowie obserwowali pracę, identyfikowali żmudne procesy i budowali agentów automatyzujących zadania (np. raporty finansowe wymagające dostępu do wielu systemów). Firma uczciwie przyznaje, że ROI agentów wciąż nie jest udowodniony.

Ze świata tech

01

GitHub 'Verified' Commits można przepisać bez łamania podpisu

Badacze odkryli, że podpisany commit z zieloną etykietą 'Verified' można przekształcić w nowy hash z zachowaniem ważnego podpisu. Oznacza to, że systemy blokujące złośliwe commity po hashach są bezużyteczne — atakujący może przepchnąć tę samą treść pod nowym, 'zaufanym' hashem.

02

Łatka dla Windows Defender 0-day może zapchać dysk

Microsoft załatał zero-day RoguePlanet w Windows Defenderze, ale łatka wprowadza nowy problem — zapis Zone.Identifier ADS bez ograniczenia rozmiaru, co może całkowicie zapełnić dysk. Klasyczny przypadek, gdy łatka bezpieczeństwa tworzy nową lukę DoS.

Wskazówka dnia

Jak testować agentów AI przed wdrożeniem w enterprise

Inspirując się modelem Ubera (Agentic Pods), zanim wdrożysz agenta AI w firmie, przeprowadź 'shadow audit' — przez tydzień nagrywaj (w formie tekstowej, za zgodą zespołu) powtarzalne zadania wykonywane przez ludzi. Następnie zmapuj, które z nich wymagają dostępu do wielu systemów, a które są czysto kognitywne. To pozwoli odróżnić zadania, które agent faktycznie może zautomatyzować, od tych, które wymagają ludzkiego osądu. Praktyczny krok: stwórz prostą macierz decyzyjną. Oś X — liczba systemów, do których agent musi mieć dostęp (1-5). Oś Y — ryzyko błędu (niskie/wysokie). Wdrażaj agentów tylko w kwadrancie 'niskie ryzyko, wiele systemów' — to tam ROI jest natychmiastowy. Dla zadań wysokiego ryzyka wprowadź tryb 'human-in-the-loop', gdzie agent przygotowuje draft, a człowiek zatwierdza. To samo robi Uber — i jak sami przyznają, ROI agentów wciąż nie jest oczywisty, dlatego zaczynają od bezpiecznych obszarów.

Narzędzie wydania

ChatGPT Work — agent biurowy, który działa z arkuszami, kalendarzami i mailami

Nowy agent AI od OpenAI zintegrowany z Codexem, działający na webie, desktopie i mobile'u. Wykonuje zadania w aplikacjach biurowych (arkusze kalkulacyjne, zarządzanie kalendarzem, obsługa emaili) z opcją nadzoru dla firm. Codex został w pełni wchłonięty przez nową aplikację desktopową ChatGPT.

Do przeczytania

OpenAI GPT-5.6: Sol, Terra i Luna — co oznaczają dla rynku?

TechCrunch szczegółowo analizuje architekturę trzech wariantów, ceny i pozycjonowanie rynkowe. Warto przeczytać, by zrozumieć, dlaczego OpenAI zamiast jednego modelu wybrało strategię segmentacji cenowej.

SpaceXAI Grok 4.5 — pierwsze wejście w enterprise po fuzji z SpaceX

Szczegółowy opis modelu, cen i strategii. Dlaczego Musk celuje w kodowanie enterprise i jak Grok 4.5 z ceną 2,5 $/M tokenów może zdestabilizować cały rynek API.

Trzy wielkie premiery modeli w dwa dni, ale to regulacje i praktyczne wdrożenia (Uber, EU) mogą mieć większy wpływ na to, jak AI faktycznie zmieni naszą codzienną pracę — niż kolejny punkt procentowy na benchmarku.

Chcesz następne wydanie na skrzynkę?

Subskrybuj — każde wydanie prosto do Ciebie.

Regulamin newslettera · Polityka prywatności