Szukaj

Claude Opus 5, Midjourney kupuje Co-Star, Jensen Huang broni modeli otwartych

ai-powered-markdown-translator

Artykuł przetłumaczony z fr na pl z gpt-5.4-mini.

Zobacz projekt na GitHubie ↗

24 lipca 2026 roku zdominował jeden kluczowy wydarzenie: Anthropic uruchamia Claude Opus 5, przyjęty tego samego dnia przez Cursor, Devin, v0 i GitHub Copilot — cykl między wydaniem modelu a jego wdrożeniem w narzędziach kodujących jest już niemal natychmiastowy. Tego samego dnia Midjourney ogłasza swoje pierwsze w historii przejęcie (Co-Star), Jensen Huang (NVIDIA) publikuje swój pierwszy osobisty wpis na X, broniąc modeli otwartych, a xAI dodaje do Grok Build orkiestrację setek agentów działających równolegle. Wokół tych czterech tematów obracają się piętnaście istotnych nowości — od ekosystemu narzędzi kodujących po rozszerzenie Enterprise Genspark — oraz dziewięć mniejszych ogłoszeń.


Claude Opus 5: nowy model Anthropic, przyjęty tego samego dnia przez Cursor, Devin, v0 i GitHub Copilot

24 lipca — Anthropic uruchamia Claude Opus 5, nowy model z rodziny Claude 5 obok Sonnet 5 i Fable 5. Oficjalne pozycjonowanie: model „przemyślany i proaktywny”, który zbliża się do granicznej inteligencji Claude Fable 5 — najbardziej zaawansowanego modelu Anthropic — za połowę ceny. Jest dostępny już dziś we wszystkich płatnych planach oraz przez API (identyfikator claude-opus-5), w tej samej cenie co Opus 4.8: $5 za milion tokenów wejściowych, $25 za milion wyjściowych. Tryb Fast, około 2,5× szybszy, jest wyceniony na dwukrotność stawki bazowej. Opus 5 staje się domyślnym modelem na Claude Max oraz najbardziej zaawansowaną opcją oferowaną na Claude Pro.

BenchmarkWynik Opus 5
Frontier-Bench v0.1Przewyższa wszystkie modele, ponad dwukrotnie wynik Opus 4.8, przy niższym koszcie na zadanie
CursorBench (maksymalny wysiłek)O 0,5 punktu od najlepszego wyniku Fable 5, za połowę ceny
ARC-AGI 3 (nowe problemy)Wynik około trzy razy wyższy niż najlepszy konkurent
OSWorld 2.0 (używanie komputera)Przewyższa najlepszy wynik Fable 5 przy koszcie około jednej trzeciej

Anthropic raportuje także postępy w naukach o życiu: +10,2 punktu w chemii organicznej (wnioskowanie o strukturach molekularnych) oraz +7,7 punktu w przewidywaniu skutków zmian sekwencji białkowych, względem Opus 4.8. Ważny niuans: te wyniki „stanu najwyższej sztuki” dotyczą kodu i pracy wiedzy — w ofensywnym cyberbezpieczeństwie Opus 5 pozostaje celowo za Mythos 5 (modelem z ograniczonym dostępem): jego klasyfikatory bezpieczeństwa blokują skanowanie podatności metodą binarną, testy penetracyjne i generowanie exploitów, jednocześnie dopuszczając wykrywanie podatności w kodzie źródłowym. Anthropic szacuje, że te klasyfikatory będą uruchamiać się około 85% rzadziej niż w przypadku Fable 5.

Po stronie alignementu Anthropic wskazuje, że Opus 5 jest, według wewnętrznego automatycznego audytu zachowania, najbardziej zgodnym modelem do tej pory (wynik 2,3 w globalnym zachowaniu niezgodnym, najniższy wśród jego nowszych modeli). W Claude Code można go używać natychmiast przez /model claude-opus-5 lub /claude-api migrate, aby przełączać istniejące obciążenia, a domyślnie startuje w trybie wysokiego wysiłku.

🔗 Oficjalne ogłoszenie — Anthropic

It’s a thoughtful and proactive model that comes close to the frontier intelligence of Fable 5 at half the price.

🇵🇱 To model przemyślany i proaktywny, który zbliża się do granicznej inteligencji Fable 5, za połowę ceny.@claudeai na X

Adopcja w dniu premiery w narzędziach do kodu. W mniej niż pół godziny trzy narzędzia do kodu ogłaszają integrację w odstępie kilku minut, a tego samego dnia dołącza GitHub Copilot:

Narzędzie integrująceGodzina ogłoszenia (24 lipca)Różnicujący szczegół
Cursor19:03Dorównuje Fable 5 w CursorBench (66,7 vs 66,5 przy domyślnym wysiłku), połowa ceny, zgodność z Zero Data Retention
Devin (Cognition)19:07„Zbliża się” do poziomu Fable 5 w FrontierCode 1.1, za połowę ceny
v0 (Vercel)19:29Dostępny natychmiast przez v0.app/?opus5
GitHub CopilotTego samego dniaVS Code, Visual Studio, Copilot CLI, cloud agent, JetBrains, Xcode… dla Pro+/Max/Business/Enterprise

Cursor jest najdokładniejszy, z konkretnymi liczbami i dodatkową przewagą: zgodnością z Zero Data Retention, której Fable 5 nie oferuje. Po stronie GitHub Copilot podkreśla dobre wyniki w agentowych workflowach kodowania — autonomiczne modyfikacje, weryfikacja braku regresji, koordynacja wielu narzędzi — ale ostrzega, że model zawiera zabezpieczenia, które mogą blokować niektóre żądania związane z cyberbezpieczeństwem, z rekomendacją przeformułowania zapytania albo wyboru innego modelu w razie blokady. Wdrażanie Copilot jest stopniowe; administratorzy Enterprise i Business muszą włączyć politykę Claude Opus 5, aby przyznać dostęp swoim zespołom.

🔗 Cursor ogłasza integrację

🔗 Devin ogłasza integrację — @cognition

🔗 v0 ogłasza integrację

🔗 GitHub Copilot — oficjalny changelog


Midjourney przejmuje Co-Star, pierwsze przejęcie w jego historii

23 lipca — Midjourney ogłasza swoje pierwsze w historii przejęcie: Co-Star, spersonalizowaną aplikację astrologiczną znaną z bezpośredniego tonu i wiralowych powiadomień. Jej założycielka, Banu Guler, dołącza do Midjourney na nowo utworzone stanowisko Chief Design Officer, odpowiedzialnej za zbudowanie przekrojowej organizacji Produkt/Design/Frontend dla wszystkich projektów firmy. Co-Star nadal działa autonomicznie, całkowicie pod jej kontrolą i kierownictwem.

Oficjalny wpis, utrzymany w bardzo osobistym tonie, osadza to przejęcie w szerszej trajektorii: wspomina Midjourney Medical jako początek „niezwykłego laboratorium badawczego” i zapowiada pół tuzina równie ambitnych projektów w ciągu najbliższych sześciu miesięcy. Midjourney, dotąd skoncentrowany na generowaniu obrazów i wideo, sygnalizuje w ten sposób wyraźną strategiczną dywersyfikację poza swój historyczny rdzeń działalności. Relacja na X, opublikowana następnego dnia, zebrała ponad 426 000 wyświetleń, 1 300 polubień i 226 repostów w kilka godzin.

🔗 Relacja X — 426 000 wyświetleń w kilka godzin

“As an adult I find myself in the unusual position of having everything I wanted and two questions come to mind next: How can I use this opportunity to make baby David proud?”

🇵🇱 Jako dorosły znajduję się w niezwykłej sytuacji, mając wszystko, czego chciałem, i wtedy przychodzą mi do głowy dwa pytania: jak wykorzystać tę okazję, by mały David był dumny?Midjourney, oficjalny changelog


NVIDIA: Jensen Huang publikuje swój pierwszy post na X, otwarty list w obronie modeli otwartych

24 lipca — Jensen Huang, założyciel i CEO NVIDIA, publikuje swój pierwszy osobisty wpis na X: otwarty list podpisany przez NVIDIA, zatytułowany „Open Weights and American AI Leadership”, o znaczeniu modeli otwartych (open models). Twierdzi w nim, że AI „przekształci każdą branżę, zasili każdą firmę i będzie budowana przez każdy kraj”, a modele otwarte wzmacniają bezpieczeństwo i cyberbezpieczeństwo, przyspieszają innowacje i umożliwiają suwerenność — stanowisko, które wyraźnie ustawia NVIDIA, poprzez własną linię Nemotron publikowaną w otwartych wagach, po stronie ekosystemu open-weight, naprzeciw zamkniętych laboratoriów takich jak OpenAI, Anthropic czy Google.

Post wywołał niezwykłe zaangażowanie jak na pierwszy osobisty wpis: ponad 23,6 miliona wyświetleń, 98 000 polubień i 23 700 repostów w kilka godzin. Kilku graczy w obszarze open-weight AI, w tym MiniMax, publicznie podziękowało Jensenowi Huangowi za to stanowisko niemal natychmiast potem.

“Open models strengthen safety and cybersecurity, accelerate innovation and diffusion, and enable sovereignty. The world needs both frontier closed models and frontier open models.”

🇵🇱 Modele otwarte wzmacniają bezpieczeństwo i cyberbezpieczeństwo, przyspieszają innowacje i ich upowszechnianie oraz umożliwiają suwerenność. Świat potrzebuje zarówno zamkniętych modeli granicznych, jak i otwartych modeli granicznych.@JensenHuang na X


Workflows w Grok Build: xAI orkiestruje setki agentów równolegle

23 lipca — xAI uruchamia workflows w Grok Build, swoim agentowym środowisku kodowania w wierszu poleceń (odpowiednik Claude Code lub Codex). Użytkownik opisuje złożone zadanie w języku naturalnym; Grok automatycznie planuje skrypt orkiestracji — fazy pracy, agentów przypisanych do każdej z nich, sposób przekazywania ich wyników — a następnie wykonuje go w tle, podczas gdy sesja pozostaje dostępna do innych zadań.

Parametr technicznyZmierzona wartość
Agenci domyślnie128
Maksymalna liczba agentów (duże zadania)1024
Pokazana demonstracjaPrzegląd pull requesta GitHub w 4 fazach (Context → Review → Verify → Synthesize)
Śledzenie na żywoKomenda /workflows

Specjalistyczni recenzenci w demonstracji mają swoje wnioski sprawdzane w sposób adwersarialny przez niezależnych „sceptyków” przed trafieniem do raportu końcowego. Postęp jest zapisywany ciągle — pauza i wznowienie nigdy nie wymagają ponownego wykonywania już wykonanej pracy. Workflows można zapisywać i używać ponownie: te umieszczone w .grok/workflows/ są współdzielone z zespołem, te w ~/.grok/workflows/ podążają za użytkownikiem wszędzie, a każdy zapisany workflow staje się własną parametryzowaną slash command (na przykład /pr-review 5137). Funkcja /deep-research, która rozbija pytanie badawcze między kilku równoległych badaczy i sprawdza każde twierdzenie względem jego źródeł, jest wbudowana natywnie.

Przykłady użycia wskazywane przez xAI: przejrzeć każdą funkcję w dużym pull requeście, posortować 100 ostatnich ticketów Linear, aby wyciągnąć listę działań, albo przeprowadzić audyt każdego handlera tras w bazie kodu pod kątem brakujących kontroli uwierzytelniania.

🔗 Oficjalne ogłoszenie — xAI


Ekosystem kodu: mniej promptu, więcej agentów

Claude Code: Anthropic usuwa 80% system promptu dla modeli Claude 5

24 lipca — Thariq (@trq212) z zespołu Anthropic publikuje artykuł opisujący ewolucję context engineering w Claude Code: Anthropic usunął ponad 80% system promptu Claude Code dla modeli Claude 5, takich jak Opus 5 i Fable 5, bez mierzalnej utraty w ocenach kodu. Starsze system promptu narzucały sztywne reguły — na przykład nigdy nie pisać wielolinijkowych komentarzy — które stały się zbędne, ponieważ nowsze modele mają lepszy osąd przy rozstrzyganiu sprzecznych instrukcji w zależności od kontekstu. Artykuł formalizuje sześć zmian doktryny, w tym: dawać sztywne reguły → pozwolić Claude ocenić; wszystko umieszczać z wyprzedzeniem w promptcie → stopniowe ujawnianie. Anthropic udostępnia te praktyki przez nową komendę /doctor, która pomaga audytować i skalować skills oraz pliki CLAUDE.md projektu.

🔗 Pełny wątek — @trq212

v0 zamienia cały plik Figma w aplikację

24 lipca — v0 (Vercel) rozszerza swoją integrację z Figmą, dotąd raczej skoncentrowaną na imporcie pojedynczych komponentów: na podstawie samego linku agent automatycznie przegląda wszystkie strony i frames pliku, wybiera istotne elementy — tokeny designu, kolory, układ, tekst, ikony — a następnie składa zidentyfikowane ekrany w jedną spójną aplikację, bez ręcznego wybierania frame po frame. Oficjalna dokumentacja szczegółowo opisuje wszystkie wyodrębnione dane na dedykowanej stronie v0 Docs.

🔗 Ogłoszenie — @v0

Copilot cloud agent for Linear przechodzi do ogólnej dostępności

23 lipca — GitHub przenosi przypisywanie issue z Linear do Copilot cloud agent do ogólnej dostępności: po przypisaniu agent analizuje issue, otwiera szkic pull requesta w efemerycznym środowisku zasilanym przez GitHub Actions, raportuje postęp w osi czasu Linear, a następnie prosi o review. Nowość względem wersji zapoznawczej: wybór modelu i własnego agenta bezpośrednio z Linear, definiowanie docelowych branchy oraz sterowanie sesją zwykłym komentarzem. Dostępne w planach Copilot Pro, Pro+, Business i Enterprise.

🔗 Oficjalny changelog

GitHub MCP Server wyprzedza kolejną specyfikację MCP

23 lipca — protokół MCP (Model Context Protocol) staje się bezustanowy (stateless) od 28 lipca 2026 r., a GitHub MCP Server już obsługuje tę nową specyfikację przed jej oficjalną publikacją. W praktyce oznacza to: usunięcie sesji Redis, szybsze połączenia bez etapu initialize oraz implementację elicitation zaktualizowaną do osobnych żądań HTTP. Ponieważ SDK poziomu 1 zachowują zgodność wsteczną, po stronie istniejących klientów nie jest wymagana żadna akcja.

🔗 Oficjalny changelog

Sakana AI publikuje Fugu-Ultra v1.1 i interfejs zgodny z Claude Code

24 lipca — Sakana AI publikuje aktualizację swojego silnika orkiestracji wielomodelowej Fugu-Ultra (v1.1), z zyskami sięgającymi 7,9 punktu względem v1.0, szczególnie wyraźnymi w ProgramBench i Terminal Bench 2.1. Sakana deklaruje lepsze wyniki niż Fable 5 w złożonym kodowaniu i rozumowaniu, nawet bez uwzględniania tego ostatniego w puli orkiestracji modeli. Równolegle Sakana udostępnia endpointy zgodne z Claude Code, aby korzystać z wieloagentowej inteligencji Fugu bezpośrednio z tego klienta zamiast polegać na jednym modelu.

🔗 Oficjalne ogłoszenie — Sakana AI


Google / Gemini: rozszerzenie Spark, poprawka bezpieczeństwa dla Gemini CLI

Gemini Spark rozszerzony na subskrybentów Google AI Pro w Stanach Zjednoczonych

23 lipcaGemini Spark, osobisty agent AI Google działający w tle 24/7, aby wykonywać zadania pod kierunkiem użytkownika, wkracza w etap szerszego udostępniania: po subskrybentach Google AI Ultra zaczyna być wdrażany także dla znacznie szerszej grupy subskrybentów planu Google AI Pro, początkowo w Stanach Zjednoczonych. Google zapowiada rozszerzenie na kolejne kraje „wkrótce”. To nie jest nowa funkcja w ścisłym sensie, lecz zmiana grupy odbiorców, która przybliża autonomicznego agenta klasy premium do płacącej szerokiej publiczności.

🔗 Ogłoszenie — @GeminiApp

Gemini CLI v0.53.0-preview.0 usuwa lukę RCE

22 lipca — Nowe wydanie preview Gemini CLI (jeszcze niewymienione w oficjalnym stabilnym changelogu), z dwiema poprawkami o znaczeniu bezpieczeństwa: wzmocnieniem izolacji zadań i zaufania do przestrzeni roboczej w serwerze Agent-to-Agent, aby zapobiec dowolnemu wykonywaniu kodu (RCE), oraz ograniczeniem pętli wstrzykiwania promptów i nieskończonych pętli ReAct. Do tego dochodzi orchestrator triage oparty na LLM oraz utwardzenie profili Seatbelt w macOS do modelu deny-by-default.

🔗 Wydanie GitHub v0.53.0-preview.0


OpenAI: ChatGPT Work łączy się z chronionymi stronami, diagnoza poprawiona dzięki ChatGPT

ChatGPT Work może teraz łączyć się ze stronami wymagającymi uwierzytelnienia

24 lipca — Agent ChatGPT Work może teraz korzystać ze stron wymagających logowania: użytkownik przejmuje na chwilę kontrolę nad przeglądarką w chmurze, aby się uwierzytelnić, a następnie pozwala agentowi automatycznie kontynuować zadanie. Kluczowa rzecz: logowanie utrzymuje się między sesjami, więc do kolejnych zadań na tej samej stronie wystarcza jedno uwierzytelnienie — klasyczne ograniczenie agentów przeglądających sieć zostaje w ten sposób zniesione. Ta zmiana poszerza zakres zadań możliwych do zautomatyzowania o wewnętrzne narzędzia firmowe i SaaS chronione danymi logowania.

🔗 Ogłoszenie — @OpenAIDevs

Jak ChatGPT pomógł poprawić diagnozę nowotworu

24 lipca — OpenAI Newsroom opisuje, jak mąż Kiley, u której w wieku 18 lat zdiagnozowano glioblastomę z prognozą kilku miesięcy życia, a która po pięciu latach nadal żyje bez jasnego wyjaśnienia, użył ChatGPT do rozszyfrowania niedawnego opisu radiologicznego. Ta analiza przywołała wyniki początkowej biopsji, gdzie ChatGPT pomógł wydobyć przeoczony wcześniej szczegół: mutację IDH1. W porozumieniu z neuroonkologiem Kiley ten detal pozwolił przeklasyfikować diagnozę na glejak gwiaździakowy IDH-zmutowany — nadal poważny, ale z dużo lepszym rokowaniem.

🔗 Świadectwo — @OpenAINewsroom


NVIDIA i wideo generatywne: szybsza infrastruktura, bardziej współpracujące agenty

NVIDIA skraca uruchamianie DeepSeek-V4 Pro z 8 minut do mniej niż 2 minut

24 lipca — NVIDIA opisuje optymalizację infrastruktury inferencyjnej: czas uruchomienia wdrożenia DeepSeek-V4 Pro spada z 8 minut do mniej niż 2 minut dzięki kierowaniu wag modelu do pamięci GPU najkrótszą drogą przez RDMA GPU-to-GPU. Mechanizm opiera się na NVIDIA ModelExpress, usłudze dystrybucji i zarządzania cache’em wag zintegrowanej z NVIDIA Dynamo, platformą do rozproszonej inferencji. NVIDIA podkreśla, że to samo podejście przyspiesza także post-trening ze wzmocnieniem.

🔗 Ogłoszenie — @NVIDIAAI

Runway dodaje do swojego agenta Workflows w języku naturalnym

24 lipca — Runway dodaje funkcję Workflows do Runway Agent: możliwe staje się tworzenie, uruchamianie lub modyfikowanie przepływów pracy opartych na węzłach (node-based workflows) bezpośrednio w języku naturalnym, zamiast ręcznej obsługi edytora wizualnego. Rozwiązanie to, odrębne od Media Router uruchomionego dzień wcześniej — który automatycznie dobiera modele generatywne według kosztu, jakości i opóźnienia — bierze na cel samą orkiestrację etapów produkcji.

🔗 Ogłoszenie — @runwayml

HeyGen — tryb companion: reżyserować wideo zamiast je zamawiać

22 lipca — HeyGen wprowadza companion mode dla swojego Video Agent: zamiast zamawiać film jednym promptem, użytkownik prowadzi go iteracyjnie — agent proponuje pięć kreatywnych kierunków, przedstawia storyboard do zatwierdzenia, a następnie szkicuje klatki kluczowe do sprawdzenia przed końcową generacją. Użytkownik zachowuje kontrolę na każdym etapie i uruchamia pełną produkcję dopiero po akceptacji. Ta funkcja odpowiada na częstą krytykę generatorów wideo „jednym strzałem” — nieprzewidywalny rezultat, kosztowne czasowo i kredytowo iteracje — zbliżając doświadczenie do współpracy z ludzkim reżyserem.

🔗 Ogłoszenie — @HeyGen


Genspark: partnerstwo z Microsoftem i inwestycja 100 milionów dolarów w Japonii

SecondBrain integruje się z Outlook, Teams i Microsoft Agent 365

24 lipca — Podczas premiery Genspark 6.0 w Seulu Genspark przedstawia strategiczne partnerstwo z Microsoftem: SecondBrain, warstwa trwałej pamięci jego agentów, integruje się teraz bezpośrednio z Outlook, Office, Teams, a także z Microsoft Agent 365 — z którym Genspark, jak podaje, był globalnym partnerem premierowym. Całość działa na Azure, przedstawianym jako gwarancja odporności oczekiwanej w środowisku korporacyjnym. Post dziękuje z imienia i nazwiska Satyi Nadelli (CEO Microsoftu), Judsonowi Althoffowi i Rodrigo Kede. Ten element nie był ujęty w początkowym wpisie z 20 lipca.

🔗 Ogłoszenie — @genspark_ai

Genspark inwestuje 100 milionów dolarów w ciągu 3 lat w Japonii

24 lipca — Po wydarzeniu zorganizowanym w Tokio 21 lipca dla klientów korporacyjnych, partnerów przemysłowych i japońskich influencerów — drugim takim wydarzeniu Genspark w tym kraju — firma ogłasza inwestycję w wysokości $100 milionów w ciągu najbliższych trzech lat w Japonii, zaledwie sześć miesięcy po uruchomieniu lokalnej działalności. Trzy priorytety: lokalizacja danych dla kwalifikujących się klientów (instytucji finansowych, agencji rządowych, dużych przedsiębiorstw), kompleksowe partnerstwa z resellerami i integratorami oraz wzmocnienie zespołów terenowych, w języku i strefie czasowej klientów.

🔗 Ogłoszenie — @genspark_ai


Grok trafia do Google Workspace

24 lipca — xAI uruchamia darmowy dodatek, który integruje Grok bezpośrednio z Sheets, Slides i Docs, instalowany z Google Workspace Marketplace. W Sheets Grok odpowiada na pytania, cytując użyte komórki, i tworzy formuły; w Slides zamienia plan w prezentację, zachowując istniejący motyw; w Docs pisze i poprawia tekst dokładnie tam, gdzie się go tworzy, z dostępem do ostatnich e-maili i plików Drive, jeśli konektory są aktywne. Ta integracja uzupełnia pakiet już dostępny po stronie Microsoft 365 (Word, Excel, PowerPoint, Outlook), uruchomiony między czerwcem a lipcem.

🔗 Oficjalne ogłoszenie — xAI


Krótkie informacje

  • Replit podsumowuje swoje nowości miesiąca — agent głosowy, tworzenie z Claude lub Slacka, trwała pamięć stosu; przynajmniej jedna z wymienionych możliwości wydaje się pokrywać z integracją opublikowaną już 17 czerwca. 🔗 Źródło
  • Kimi K3 niemal na równi z Claude Fable 5 w DeepSWE — pass@1 z różnicą 1,4 punktu, ale lepszy w pass@2/pass@4, przy 2,8× niższym koszcie na rozwiązane zadanie (Together AI). 🔗 Źródło
  • Wspólna deklaracja o otwartości modeli jako drodze do bezpieczeństwa AI — koalicja kilkunastu organizacji, w tym Hugging Face, Meta, Mistral AI, NVIDIA i Microsoft, opublikowana ponownie przez oficjalne konto @huggingface. 🔗 Źródło
  • HeyGen uruchamia API Audio to Video — głos i obraz do wideo w jednym wywołaniu, z przetwarzaniem wsadowym (np. 100 narracji na tym samym obrazie). 🔗 Źródło
  • ElevenLabs publikuje wpis o głosie AI i ochronie wyborów — pozycjonowanie instytucjonalne w obliczu nadchodzących ważnych terminów wyborczych. 🔗 Źródło
  • HeyGen — HyperFrames, dzień 18 z 30 — nowy odcinek codziennej serii, poświęcony zastosowaniu w Video Agent. 🔗 Źródło
  • Zvec 0.6.0, silnik wyszukiwania wektorowego Tongyi Lab (Alibaba) — wyszukiwanie Group-By, ponad 50 punktów recall zyskanych przy kwantyzacji INT4, rozszerzone wsparcie dla 34 języków. 🔗 Źródło
  • xAI mnoży wtyczki firm trzecich w Grok Build — Tavily i Exa do wyszukiwania w sieci, Grok STT dostępny w OpenRouter za $0,10 za godzinę audio. 🔗 Źródło
  • ChatGPT Pet staje się udostępnialny między użytkownikami — link do udostępnienia z ustawień Personalizacji w sieci, aby inny użytkownik mógł przejąć zwierzaka. 🔗 Źródło

Co to oznacza

Premiera Opus 5 pokazuje zmianę strukturalną w sposobie, w jaki modele graniczne trafiają do użytkowników: Cursor, Devin i v0 integrują go w mniej niż pół godziny, GitHub Copilot tego samego dnia. Cykl wydanie → adopcja, który jeszcze niedawno liczono w tygodniach, jest dziś niemal zerowy dla najlepiej połączonych z ekosystemem Anthropic narzędzi do kodu — dynamika, która równie mocno skraca okno różnicowania między laboratoriami i przenosi konkurencję na szybkość integracji, a nie tylko na surową wydajność modeli.

Tego samego dnia równie mocno wybrzmiewa kontrnarracja. Jensen Huang publikuje swój pierwszy osobisty wpis na X, broniąc modeli otwartych jako drogi do bezpieczeństwa i suwerenności; koalicja kilkunastu organizacji, w tym Hugging Face i Meta, przedstawia podobną deklarację; a Sakana AI twierdzi, że przewyższa Fable 5, orchestrując kilka modeli bez uwzględniania go w swoim puli. Dwie wizje bezpieczeństwa AI — jedna oparta na kontroli właścicielskiej, druga na przejrzystości wag — ścierają się publicznie tego samego dnia, bez wyraźnej przewagi którejkolwiek z nich.

Cyberbezpieczeństwo nadal działa jako marker celowej ostrożności, a nie surowej wydajności. Anthropic umieszcza Opus 5 celowo za Mythos 5 w zadaniach ofensywnych, z dedykowanymi klasyfikatorami blokującymi skanowanie podatności, testy penetracyjne i generowanie exploitów. W tym samym czasie Google usuwa w Gemini CLI lukę umożliwiającą zdalne dowolne wykonywanie kodu po stronie serwera agent-to-agent — przypomnienie, że same narzędzia agentowe, nie tylko modele, które zawierają, pozostają powierzchnią ataku wymagającą ciągłego zabezpieczania.


Źródła