Dakarda AI Newsletter · 20 lipca 2026

Wydanie poniedziałkowe

GPU to nowa ropa – starczy dla wszystkich?

Największy open-source'owy model świata zawiesza subskrypcje, bo zabrakło mocy GPU. Unia Europejska każe Apple i Google otworzyć asystentów AI na konkurencję. A McKinsey podaje liczbę, która zmieni sposób myślenia o agentach: 60% kosztów to nie inferencja, a poprawianie odpowiedzi.

Wstęp · Alex

To był tydzień, w którym AI uderzyło w trzy ściany naraz: obliczeniową, regulacyjną i ekonomiczną. Kimi K3 (2,8 biliona parametrów!) okazał się tak popularny, że Moonshot AI musiało wstrzymać nowe subskrypcje — zabrakło GPU. W tym samym czasie UE, zamiast przyglądać się wyścigowi zbrojeń, postanowiła przeciąć węzeł gordyjski: zmusza Google i Apple, byśmy mogli wybrać dowolnego asystenta AI jako domyślnego na telefonie. W dzisiejszym wydaniu prześledziłam dla Ciebie cztery historie, które w mojej ocenie będą miały największe konsekwencje w nadchodzących tygodniach. Od wyczerpania mocy obliczeniowych przez Chiny, przez regulacyjny zamach na duopol Apple-Google, aż po finansową anatomię agentów AI według McKinsey. Bonusowo — Qwen 3.8 od Alibaby, który chce być 'drugi po Fable 5' i robi to w otwartych wagach.

Co warto wiedzieć

01

Kimi K3 przerywa subskrypcje — popyt zmiażdżył moce GPU

Moonshot AI wstrzymało nowe subskrypcje modelu Kimi K3 zaledwie 48h po premierze. Przyczyna? Gigantyczne obciążenie GPU — popyt niemal osiągnął limit dostępnej mocy obliczeniowej. Firma planuje podzielić członkostwo na Kimi Membership (web/app) i Kimi Code Membership (dla programistów). To pierwszy przypadek, gdy chiński model osiąga parity z Fable 5 i GPT-5.6 Sol i generuje tak globalny popyt — i pierwszy raz, gdy dostęp do GPU, nie technologia, okazuje się wąskim gardłem.

02

UE zmusza Google i Apple do otwarcia asystentów AI w smartfonach

Komisja Europejska, powołując się na DMA (Digital Markets Act), nakazała Google i Apple umożliwienie użytkownikom wyboru alternatywnych asystentów AI (np. ChatGPT, Claude) jako domyślnych na Androidzie i iOS. To fundamentalna zmiana dystrybucji AI — zamiast platform kontrolujących asystentów, użytkownicy mogą wybrać dowolnego agenta AI jako systemowy. Przypomnijmy: Apple w czerwcu ogłosiło, że nie uruchomi nowego Siri AI w UE właśnie z powodu tych przepisów.

03

McKinsey: 60% kosztów agentów AI idzie na 'response refinement' — większość firm już nad budżetem

Nowy raport McKinsey ujawnia przełomową liczbę dla każdego, kto buduje agentów: 60% kosztów operacyjnych pochłania faza udoskonalania odpowiedzi (response refinement), a nie sama inferencja. Większość firm enterprise już przekroczyła założone budżety na agentów AI. Prawdziwy koszt leży w pętlach weryfikacji, walidacji i iteracji — tanie inference to mit.

04

Alibaba wypuszcza Qwen 3.8 (2,4T parametrów) — 'drugi tylko po Fable 5'

Alibaba uruchomiło Qwen 3.8-Max-Preview — model o 2,4 biliona parametrów, dostępny na Token Plan, Qoder i QoderWork. Firma zapowiedziała rychłe wydanie pełnych wag open-source. To bezpośrednia odpowiedź na Kimi K3 (2,8T) wydany zaledwie 3 dni wcześniej. Dwa modele >2 bilionów parametrów w ciągu jednego tygodnia — wyścig chińskich open-weight modeli nabiera kosmicznego tempa.

Ze świata tech

05

16-letnia luka w Linux KVM pozwala maszynom gościa uciec do hosta

Odkryto krytyczną lukę w KVM (Kernel-based Virtual Machine) dla Linux, tkwiącą w kodzie od 2009 roku. Pozwala ona maszynom wirtualnym na ucieczkę (VM escape) do systemu hosta na procesorach Intel i AMD x86. Krytyczna informacja dla administratorów chmur, serwerowni i DevOps — przełamanie izolacji między VM a hostem to scenariusz z najgorszego koszmaru.

06

Rząd USA ostrzega: rosyjscy hakerzy przejmują routery domowe i małych biur

Rząd USA ostrzega przed masową kompromitacją routerów domowych i małych biur przez hakerów powiązanych z państwem rosyjskim. Atakujący tworzą botnety do maskowania ataków na wrażliwe instytucje, wykorzystując źle skonfigurowane SNMP. Artykuł zawiera praktyczne zalecenia zabezpieczenia sprzętu sieciowego.

Wskazówka dnia

Jak oszacować realny koszt agenta AI, zanim przekroczysz budżet

Większość zespołów liczy koszty agentów jak tradycyjne LLM: cena za token wejścia i wyjścia. Tymczasem, jak pokazuje raport McKinsey, 60% wydatków idzie na response refinement — pętle weryfikacji, walidacji, ponownych zapytań i korekt. Zanim uruchomisz agenta produkcyjnie, przeprowadź test kosztowy: uruchom 100 symulowanych zadań, zmierz całkowitą liczbę wywołań API (nie tylko głównego promptu), zsumuj koszty walidacji i porównaj z budżetem. Praktyczny krok: dodaj do swojego agenta logger kosztów na każdym etapie pętli — inferencja, walidacja, poprawka, ponowna inferencja. Dopiero gdy zobaczysz rozkład, dowiesz się, gdzie faktycznie lecą pieniądze. W 9 na 10 przypadków zaskoczy Cię, jak mało kosztuje samo 'myślenie', a jak dużo 'sprawdzanie'.

Do przeczytania

60% of Agentic AI Costs Go to Response Refinement — and Most Enterprises Are Already Over Budget

Pełna analiza McKinsey, która powinna być lekturą obowiązkową dla każdego CTO i product ownera budującego agentów. Pokazuje, gdzie naprawdę uciekają pieniądze i dlaczego 'tani LLM' to nie znaczy 'tani agent'.

EU forces Apple and Google to open smartphones to rival AI assistants

Szczegółowe omówienie decyzji KE, która może zmienić globalny rynek asystentów AI. Jeśli myślisz, że to tylko europejska sprawa — pomyśl jeszcze raz. Precedensy regulacyjne UE mają zwyczaj stawać się globalnymi standardami.

W tym tygodniu AI nauczyło nas trzech rzeczy: GPU są nową ropą, regulacje mogą być szybsze niż technologia, a najdroższe w agencie nie jest myślenie — tylko sprawdzanie, czy dobrze pomyślał.

Chcesz następne wydanie na skrzynkę?

Subskrybuj — każde wydanie prosto do Ciebie.

Regulamin newslettera · Polityka prywatności