ai-powered-markdown-translatorPrzetłumaczony artykuł z fr na pl przy użyciu gpt-5.4-mini.
23 lipca 2026 przynosi siedem ważnych ogłoszeń: OpenAI udostępnia Health in ChatGPT w Stanach Zjednoczonych i wprowadza ChatGPT Voice do aplikacji desktopowej, Black Forest Labs łączy obraz, wideo, dźwięk i predykcję działań w FLUX 3, GitHub po raz pierwszy określa, co jego agenci mogą samodzielnie modyfikować w Issues, HeyGen przekształca swój framework HyperFrames w pełnoprawnego agenta do tworzenia wideo, a Cognition rozszerza swoją obecność, przejmując Poke, a następnie podpisując protokół ustaleń z amerykańskim Departamentem Energii. Wokół tych siedmiu tematów krąży osiemnaście innych godnych uwagi nowości — od trybu głosowego Claude po narzędzia kodowania (Cursor, Replit, Zed, v0, Amp), a także cyberobronę w Gemini i Hugging Face.
Health in ChatGPT trafia do Stanów Zjednoczonych
23 lipca — OpenAI udostępnia Health in ChatGPT amerykańskim zalogowanym użytkownikom w wieku od 18 lat, w internecie i na iOS, w planach Free, Go, Plus i Pro. Funkcja pozwala bezpiecznie połączyć Apple Health oraz obsługiwane dokumentacje medyczne (amerykańskie systemy szpitalne, One Medical, Function Health), aby ChatGPT miał kontekst zdrowotny użytkownika — porównać wynik badania z wcześniejszymi testami, podsumować, co zmieniło się od ostatniej wizyty, albo zestawić sen i aktywność z codzienną rutyną.
OpenAI podaje jedną liczbę: ponad 300 milionów osób co tydzień zadaje ChatGPT pytania związane ze zdrowiem. Firma informuje, że pracuje z setkami lekarzy, aby mierzyć i poprawiać dokładność, bezpieczeństwo oraz rozpoznawanie sytuacji wymagających profesjonalnej opieki. Jeśli chodzi o modele, GPT-5.5 Instant (plan darmowy) zapewnia wspólną bazę dla wszystkich użytkowników, natomiast GPT-5.6 Sol (plany płatne) idzie dalej w złożonych pytaniach; w HealthBench Professional, ocenie opracowanej z lekarzami, wszystkie modele GPT-5.6 przewyższają GPT-5.5.
W kwestii prywatności OpenAI podkreśla: połączone dokumentacje medyczne i dane Apple Health, a także rozmowy, które ich używają, nigdy nie są wykorzystywane do trenowania modeli ani do targetowania reklam, niezależnie od innych ustawień treningu. Domyślnie ChatGPT prosi o zgodę przed każdym użyciem tych danych; odłączenie konta usuwa zsynchronizowane dane w ciągu 30 dni. Warto zaznaczyć: Health nie jest dostępne w Codex. Wcześniejsza wersja z początku tego roku ograniczała te wymiany do osobnej przestrzeni — ale ponad 70% rozmów związanych ze zdrowiem odbywało się gdzie indziej, stąd natywna integracja we wszystkich rozmowach.
🔗 Oficjalne ogłoszenie — OpenAI
FLUX 3: Black Forest Labs łączy obraz, wideo, dźwięk i predykcję działań
23 lipca — Black Forest Labs (BFL), twórcy modeli FLUX do obrazów, ogłaszają FLUX 3, przedstawiany jako pojedynczy multimodalny model trenowany w ujednoliconej architekturze, a nie jako zestaw oddzielnych modeli składanych po fakcie. Firma podkreśla renderowanie „bardziej wierne rzeczywistości we wszystkich stylach” w porównaniu z poprzednimi generacjami.
| Obsługiwana modalność | Status na 23 lipca |
|---|---|
| Obraz | Dostępny |
| Wideo (FLUX 3 Video) | Wczesny dostęp, dostępny już dziś |
| Dźwięk | Zintegrowany z ujednoliconą architekturą |
| Predykcja działań | Prace robotyczne z mimic i Audi |
Na tę premierę składają się dwa wyróżniające się elementy. Po pierwsze, FLUX 3 Video rozszerza historyczny zakres BFL — dotąd skupiony na obrazach statycznych — na wideo, obszar do tej pory zdominowany przez Runway, Luma, Kling lub Wan. Po drugie, BFL wskazuje, że ujednolicona architektura modelu może zostać rozszerzona do przewidywania działań fizycznych, przy pracach prowadzonych we współpracy z mimic (specjalista od teleoperacji i uczenia robotycznego) oraz Audi — to wymiar, który zbliża BFL do obszaru fizycznej AI, w który NVIDIA intensywnie inwestuje za pomocą Cosmos i Isaac.
Post z ogłoszeniem zebrał ponad 393 000 wyświetleń w kilka godzin, a w wątku pokazano pierwsze próbki FLUX 3 Image. To najważniejsze uruchomienie modelu w tym oknie czasowym w segmencie mediów generatywnych, zarówno ze względu na ambicję — jeden model dla czterech modalności — jak i na otwarcie w stronę robotyki.
ChatGPT Voice steruje Chat, Work i Codex głosem
23 lipca (21:43) — OpenAI ogłasza pojawienie się ChatGPT Voice w aplikacji desktopowej (macOS i Windows), dla planów Plus, Pro, Business, Edu i Enterprise, z globalnym wdrożeniem od dziś. Napędzana przez GPT-Live funkcja pozwala sterować komputerem i kierować wieloma agentami — ChatGPT Work lub Codex — wyłącznie głosem: model mówi, słucha i koordynuje pracę w aplikacji jednocześnie.
ChatGPT Voice is now in the desktop app. Control your computer and direct multiple agents running in ChatGPT Work or Codex, using just your voice. It’s powered by GPT-Live, so it can speak, listen, and coordinate work in the app at the same time. Rolling out globally today on macOS and Windows to Plus, Pro, Business, Edu, and Enterprise plans.
🇵🇱 ChatGPT Voice jest teraz dostępny w aplikacji desktopowej. Steruj swoim komputerem i kieruj wieloma agentami działającymi w ChatGPT Work lub Codex, tylko za pomocą głosu. Jest to napędzane przez GPT-Live, więc może on mówić, słuchać i jednocześnie koordynować pracę w aplikacji. Globalne wdrożenie od dziś na macOS i Windows dla planów Plus, Pro, Business, Edu i Enterprise. — @OpenAI na X
Oficjalny changelog Codex (wersja 26.715) dodaje szczegół nieobecny w tweecie: na macOS opcja „Screen context” pozwala udostępnić ChatGPT zrzut okna na pierwszym planie podczas rozmowy głosowej, aby asystent widział to, na co użytkownik patrzy podczas pracy na głos. Tweet uzupełniający precyzuje, że ChatGPT Voice można też używać w Codex z aplikacji iOS, poprzez sparowany dostęp zdalny — wsparcie Androida zapowiedziano jako „wkrótce”, bez podania daty.
🔗 Changelog Codex — wersja 26.715
Tryb głosowy Claude również zyskuje nowe możliwości
23 lipca — Anthropic aktualizuje tryb głosowy Claude, dostępny we wszystkich planach. Teraz opiera się on na wydajniejszych modelach — Opus i Sonnet — zamiast na lżejszym, dedykowanym modelu, co ma zapewnić głębsze rozmowy głosowe.
Voice mode now runs on Claude’s more capable models and reaches the tools you’ve connected mid-conversation. Talk through the hard problems out loud, in many more languages.
🇵🇱 Tryb głosowy działa teraz z najbardziej wydajnymi modelami Claude i może sięgać do narzędzi, które masz podłączone w trakcie rozmowy. Rozwiązuj złożone problemy na głos, w znacznie większej liczbie języków. — @claudeai na X
Claude może teraz także uzyskiwać w trakcie rozmowy dostęp do narzędzi już podłączonych do konta (poczta, kalendarz), bez przerywania rozmowy. Tryb głosowy zyskuje hiszpański, francuski, hindi i japoński, w publicznej becie już dziś na urządzeniach mobilnych, komputerach i w sieci.
Codex: projekty obejmujące wiele folderów
23 lipca (22:31) — W tej samej publikacji co ChatGPT Voice (changelog Codex 26.715), Codex wprowadza lokalne projekty wielofolderowe w aplikacji desktopowej ChatGPT. Lokalny projekt może teraz łączyć kod, dokumentację i pliki referencyjne rozmieszczone w kilku folderach; Codex może czytać i zapisywać w całym tym zakresie, podczas gdy jeden folder główny pozostaje rootem Git.
Z poziomu menu projektu opcja „Edit project” pozwala dodać foldery i wyznaczyć folder główny. Nowe czaty, operacje Git, automatyczne wykrywanie AGENTS.md, skills oraz plik config.toml korzystają ze folderu głównego; foldery podrzędne pozostają dostępne do odczytu i zapisu przy wyszukiwaniu plików.
GitHub porządkuje pracę agentów modyfikujących Issues
23 lipca — GitHub uruchomił w publicznej wersji zapoznawczej zestaw kontroli przeznaczonych do porządkowania automatyzacji agentów w GitHub Issues. Punkt wyjścia: agenci (GitHub Agentic Workflows, Copilot cloud agent) coraz częściej automatycznie dodają etykiety, typy, przypisują i zamykają issues, a zespoły nie zawsze wiedzą dlaczego ani nie mają łatwej możliwości przejęcia nad tym kontroli.
| Dodana możliwość | Co robi |
|---|---|
| Zatwierdzenia | Automatyzacja sugeruje zamiast stosować; zmiany czekają na walidację, pojedynczo lub zbiorczo |
| Wynik zaufania | Każda akcja otrzymuje wysokie / średnie / niskie zaufanie; tylko wysokie stosuje się automatycznie |
| Uzasadnienie | Każda akcja zapisuje swój powód, zastosowana lub oczekująca — możliwy do przejrzenia ślad audytowy |
Wyszukiwanie has:suggestions odnajduje issues ze zmianami oczekującymi na przegląd; administratorzy ustawiają próg zaufania, który decyduje o tym, co stosuje się automatycznie. Te kontrole działają z GitHub Agentic Workflows (po dodaniu issue-intents: true do frontmatter workflow) oraz z Copilot cloud agent (bez wymaganej aktualizacji). Na start objęte są następujące akcje: etykiety, pola niestandardowe, typ, zamknięcie i przypisanie, przez API REST i GraphQL.
GitHub sam wskazuje na ważne zastrzeżenie: zatwierdzenia są przedstawiane jako „wygoda przepływu pracy, nie kontrola bezpieczeństwa” — nie tworzą one blokady po stronie serwera, a agent z odpowiednimi uprawnieniami nadal może bezpośrednio zastosować zmianę zamiast ją tylko zasugerować. Wskazywane scenariusze użycia: automatyczny triage, wzbogacanie metadanych, wykrywanie spamu z uzasadnieniem.
GitHub Mobile naprawia błędy CI z Copilot
23 lipca — GitHub rozszerza funkcję Fix with Copilot, wcześniej dostępną w komentarzach pull requestów, na aplikację mobilną (iOS i Android). Teraz, gdy check GitHub Actions nie przejdzie na pull requeście, przycisk Fix with Copilot pojawia się bezpośrednio na nieudanym checku w GitHub Mobile.
Jednym ruchem Copilot coding agent analizuje błąd, otwiera nowy pull request nad istniejącym z proponowaną poprawką, a następnie powiadamia użytkownika o potrzebie przeglądu. Celem jest umożliwienie reagowania na błędy CI w ruchu, bez powrotu do stanowiska pracy, tak aby pull requesty posuwały się naprzód nawet poza klawiaturą.
Runway automatyzuje wybór modelu generatywnego
23 lipca — Runway uruchamia Media Router, opisany jako pierwszy router generowania mediów „zoptymalizowany według preferencji”. Zamiast ręcznie wybierać model dla każdego zapytania, użytkownik raz określa, co znaczy „najlepszy” — koszt, jakość lub latencja — a router automatycznie wybiera odpowiedni model wideo, obrazu lub audio.
Funkcja jest już dostępna w Runway Dev, uruchomionej równolegle platformie dla deweloperów. To raczej element infrastruktury niż nowy model: jest skierowana do zespołów produktowych, które orkiestrują wiele zewnętrznych modeli generatywnych i chcą zautomatyzować kompromis koszt/jakość/latencja — podejście podobne do routerów LLM (OpenRouter i podobne), ale zastosowane do mediów generatywnych.
HeyGen zamienia HyperFrames w agenta do tworzenia wideo
23 lipca — HeyGen przenosi HyperFrames — dotąd szerzej znany opinii publicznej dzięki codziennej serii kreatywnej — z roli prostego silnika renderującego HTML do statusu produktu centralnego: Video Agent, bezpośrednio zintegrowanego z HeyGen. Zasada jest prosta: użytkownik opisuje, czego chce, a agent buduje całe wideo od początku do końca — avatar, grafiki, napisy i muzykę, a wszystko to przedstawione jako „nieskończenie konfigurowalne”.
Premierze towarzyszy akcja wzrostu wirusowego (miesiąc darmowego HeyGen za interakcję z postem), która wygenerowała ponad 1,1 miliona wyświetleń, 810 odpowiedzi i 788 repostów w kilka godzin — zdecydowanie najczęściej oglądany post całego okna skanowania w segmencie mediów generatywnych.
Wartość dla deweloperów: równolegle do produktu dla szerokiego rynku, HeyGen otwiera HyperFrames jako open source na GitHubie (repozytorium heygen-com/hyperframes, opisane jako „Napisz HTML. Wygeneruj wideo. Stworzone dla agentów.”), co pozwala agentom zewnętrznym generować wideo z HTML nawet poza aplikacją HeyGen. Ten sam wątek zapowiada też nowe API do tłumaczenia wideo na dużą skalę (zob. Krótkie wiadomości). To więc jednocześnie ruch produktowy i platformowy dla deweloperów w jednym dniu dla HeyGen.
Cognition przejmuje Poke, agenta mieszkającego w Twoich wiadomościach
23 lipca — Cognition (Devin) ogłasza przejęcie The Interaction Company of California, wydawcy Poke, osobistego agenta konwersacyjnego, który działa bezpośrednio w wiadomościach użytkownika. Jak wynika z wpisu podpisanego przez Scotta Wu, CEO i współzałożyciela Cognition, on sam i Walden (współzałożyciel Cognition) byli wczesnymi aniołami biznesu Interaction, a oba zespoły już wcześniej dzieliły to samo technologiczne założenie: chmurowych agentów „zawsze aktywnych”.
Poke is a personal agent that lives in your texts. It messages you first, follows up with you, and feels less like software and more like a friend. People have exchanged more than 100 million messages with it in just the last three months, and it’s the only AI agent approved to text natively on Apple Messages.
🇵🇱 Poke to osobisty agent, który mieszka w Twoich wiadomościach. Pisze pierwszy, podtrzymuje rozmowę i bardziej przypomina przyjaciela niż oprogramowanie. W ciągu samych ostatnich trzech miesięcy wymieniono z nim ponad 100 milionów wiadomości, a to jedyny agent AI uprawniony do natywnego wysyłania wiadomości w Apple Messages. — Scott Wu na blogu Cognition
Dla użytkowników nic nie zmienia się od razu — Poke nadal działa tak jak wcześniej — ale Cognition ogłasza, że chce wykorzystać swoje modele i infrastrukturę, aby uczynić go „szybszym i bardziej niezawodnym”. To połączenie ustawia Cognition poza jej historycznym rdzeniem działalności (autonomicznym inżynierem oprogramowania Devin) i kieruje ją ku osobistym agentom dla szerokiego grona odbiorców, co stanowi nowy strategiczny kierunek dla firmy.
Cognition dołącza do Genesis Mission Departamentu Energii
22 lipca — Cognition podpisał protokół ustaleń (MOU) z amerykańskim Departamentem Energii (DOE), aby dołączyć do Genesis Mission, ogólnokrajowej inicjatywy uruchomionej dekretem prezydenckim w listopadzie 2025 roku i przedstawianej jako „amerykański Projekt Manhattan dla AI”. Mobilizuje ona 17 amerykańskich laboratoriów narodowych, przemysł i środowisko akademickie, by połączyć najpotężniejsze superkomputery kraju z największymi federalnymi zbiorami danych naukowych, z deklarowanym celem podwojenia produktywności amerykańskich badań naukowych w ciągu dekady. Cognition dołącza tym samym do Google DeepMind, OpenAI i Arcee AI, których przystąpienie do tej samej misji zostało już opisane dzień wcześniej, 22 lipca.
| Oś zaangażowania | Wkład Devina (Cognition) |
|---|---|
| Bezpieczeństwo oprogramowania i danych | Znajdowanie i naprawianie luk w naukowych codebase’ach |
| Modernizacja kodu legacy | Dokumentacja, testy i tłumaczenie starego kodu (Fortran, C++, COBOL) |
| Rozszerzenie możliwości badawczych | Delegowanie pipeline’ów danych, infrastruktury i wdrożeń |
| Modernizacja chmurowa | Migracja aplikacji legacy do platform cloud-native |
W poście doprecyzowano, że platforma Cognition jest w trakcie kwalifikacji FedRAMP Class D (High), że Devin Desktop i Devin CLI są już certyfikowane na tym poziomie oraz zgodne z ITAR/IL4-IL6, a także że Devin jest już używany przez US Army, US Navy i Jet Propulsion Laboratory NASA. W ramach swojego przystąpienia Cognition oferuje skany bezpieczeństwa kodu i raporty naprawcze w naturze dla laboratoriów narodowych, a także dodatkowe zasoby obliczeniowe dla zespołów wybranych w ramach naborów projektów Genesis Mission.
🔗 Ogłoszenie na blogu Cognition
Narzędzia kodowe przyspieszają
Pięć istotnych aktualizacji dotyczy w tym tygodniu narzędzi do rozwoju wspomaganego przez AI, od cen i funkcji po automatyzację zdarzeń.
Cursor podwaja limity użycia
21 lipca — Cursor podwaja limity użycia wliczone we wszystkie plany indywidualne i Teams (z wyłączeniem Enterprise, nieujętego). Zmiana obejmuje modele Grok (xAI) i Composer (własny model Cursor), a także każdy przyszły model Cursor, bez zapowiedzianej zmiany cen poza samym „podwojeniem”. Post wygenerował duże zaangażowanie — około 1000 repostów i 10 000 polubień w kilka godzin — co wskazuje na bardzo pozytywny odbiór w społeczności. Ogłoszenie to jest niezależne od Cursor Router, opublikowanego dzień wcześniej.
Replit obniża ceny hostingu o ponad połowę
23 lipca — Replit ogłasza znaczącą obniżkę cen — o ponad 50% — hostingu aplikacji publikowanych na dużą skalę, obowiązującą od 1 sierpnia 2026 roku. Każda opublikowana aplikacja działa na Replit Cloud, ze skalowaniem automatycznym zależnym od użycia, wbudowanym uwierzytelnianiem i bezpieczną bazą danych, a także zintegrowanymi analitykami i SEO. Nowe ceny będą stosowane automatycznie do wszystkich użytkowników przy ich następnym miesięcznym cyklu rozliczeniowym, bez wymaganej akcji z ich strony.
Zed 1.12: Git Panel i wielokrotny wybór
22 lipca — Zed publikuje stabilną wersję 1.12: panel Git oferuje teraz osobne sekcje „Staged” i „Unstaged”, a kliknięcie wpisu w jednej z tych grup otwiera odpowiedni multibuffer. Zarówno File Finder, jak i Text Finder obsługują też wielokrotny wybór (cmd-klik na macOS, ctrl-klik na Linux/Windows lub tab), aby otwierać wiele plików naraz. Filtrowanie CSV wspomniane początkowo w wątku zostało ostatecznie usunięte w korekcie Zed, który wyjaśnił, że ta funkcja nie była jeszcze w rzeczywistości publicznie dostępna.
v0: komendy slash, Shopify dla wszystkich, niezawodność Snowflake
21 lipca — v0 (Vercel) dodaje komendy slash: wpisanie / w kompozytorze otwiera menu do dołączenia kompetencji (skill) przez skills.sh bez odrywania się od klawiatury. Integracja Shopify, która generuje witrynę e-commerce czytającą produkty, ceny i stany magazynowe na żywo, jest teraz otwarta dla wszystkich użytkowników. Przegląd niezawodności dla Snowflake wykrywa zmiany kodu od ostatniego wdrożenia i kieruje generowanie do podłączonego konta zamiast do danych fikcyjnych.
Amp: orby reagują na zdarzenia zewnętrzne
23 lipca — „Orby” Ampa (chmurowe piaskownice dla zdalnych agentów) mogą teraz budzić się na zdarzenia zewnętrzne za pośrednictwem nowego API webhooków (amp.createWebhook): niepowodzenie CI na GitHub, nowe issue w Linear, alert z monitoringu, wiadomość Discord. Amp weryfikuje podpis dostawcy i deduplikuje dostarczenia; zdarzenie zewnętrzne pozostaje danymi niewiarygodnymi, nigdy nieinterpretowanymi jako bezpośrednia instrukcja dla agenta. Przytoczone przykłady użycia: analizowanie każdego niepowodzenia CI na głównej gałęzi i publikowanie wyników na Slacku albo monitorowanie nowych wersji zależności, by automatycznie otwierać pull request z aktualizacją.
Cyberobrona: Gemini i Hugging Face uzbrajają obrońców
Dwa osobne ogłoszenia z tego okna czasowego prowadzą do tego samego wniosku: trzeba lepiej wyposażyć obronę w obliczu luk w oprogramowaniu.
Gemini 3.5 Flash Cyber wykrywa 72% luk
23 lipca — Po zbiorczym ogłoszeniu z 21 lipca (Gemini 3.6 Flash, 3.5 Flash-Lite, 3.5 Flash Cyber), Google DeepMind publikuje dedykowany wątek z liczbowym benchmarkiem Gemini 3.5 Flash Cyber, lekkiego modelu specjalizującego się w wykrywaniu i naprawianiu luk.
| Testowany model | Wskaźnik wykrywania |
|---|---|
| Gemini 3.5 Flash Cyber | 72 % |
| Gemini 3.5 Flash (standard) | 55 % |
| Claude Opus 4.6 (Anthropic) | 54 % |
Test — nazwany „Chrome Production Commit Scanning Pipeline” — został przeprowadzony na rzeczywistych codebase’ach Chrome i Android, gdzie model wykrył złożone luki pominięte przez modele standardowe. Dostępność pozostaje pilotażem o ograniczonym dostępie, zarezerwowanym dla rządów i zaufanych partnerów, przedstawianym przez Google jako podejście do „odpowiedzialnego wdrożenia”.
The Stack v3, open-source’owe paliwo cyberobrony
23 lipca — Leandro von Werra, Head of Research w Hugging Face, ogłasza The Stack v3, nową generację zbioru danych z kodem organizacji HuggingFaceCode (źródła modeli StarCoder): 5 000 miliardów tokenów gotowych do treningu, 120 TB surowych danych, ponad 700 języków programowania, na licencji ODC-BY. Przekaz komunikacyjny jest wyraźnie defensywny — von Werra uzasadnia publikację pilną potrzebą „dobrych otwartych modeli kodu dla cyberobrony”, nawiązując do wydania Fugu-Cyber przez Sakana AI dzień wcześniej.
Together AI i NVIDIA wyposażają inferencję i fine-tuning
Together AI uruchamia nową generację swojej platformy inferencji
23 lipca — Together AI ogłasza Together Dedicated Model Inference, przebudowę swojej platformy inferencji dla modeli open-weight. Wśród nowości: wielokrotne wdrożenia za stabilnym endpointem, bezpieczne rollouty (canary, blue-green, rolling z automatycznym rollbackiem), testy A/B i „shadow traffic” na rzeczywistym ruchu, starty około 4 razy szybsze dzięki nowej warstwie cache (modele MoE z czołówki, takie jak Kimi K2.7, MiniMax M3 czy GLM 5.2, wdrażane w 7–14 minut) oraz zamknięta beta custom fine-tuningu (RL full-weight, LoRA, SFT) z bezpośrednim wdrażaniem checkpointów do produkcji. Zapowiedziano webinarium prezentacyjne na 6 sierpnia.
NVIDIA: fine-tuning RL za mniej niż 5 dolarów
23 lipca — NVIDIA pokazuje demonstrację fine-tuningu metodą uczenia ze wzmocnieniem hostowaną na Nemotron 3 Nano, zrealizowaną wspólnie z Prime Intellect Lab: dokładność wzrosła z 22% do 91% w zadaniu matematycznym, przy koszcie poniżej $5. Pełny przepływ — baseline, trening do zbieżności nagrody, ponowny test walidacyjny — kończy się pobieranym adapterem LoRA, możliwym do przeniesienia na Nemotron 3 Super i Ultra po zmianie jednej linii konfiguracji.
Gemini Notebook porządkuje notebooki za pomocą Collections
20 lipca — Gemini Notebook (dawniej NotebookLM) uruchamia Collections, nową kartę do organizowania notebooków na wzór albumów zdjęć lub playlist, zamiast klasycznej hierarchii folderów: bez sztywnej struktury, a ten sam notebook może należeć do dowolnej liczby kolekcji albo do żadnej.
To funkcja dostarczona jako gotowy element — nowa karta widoczna w produkcie — a nie tylko teaser. Choć tweet był datowany na dzień przed ścisłym oknem tego skanu, odpowiadał na powracające od dawna życzenie użytkowników, które dotąd pozostawało bez odpowiedzi.
🔗 Przypięty tweet @Gemini_Notebook
xAI i Qwen rozszerzają swoje oferty
Grok 4.5 dostępny na wszystkich powierzchniach konsumenckich
22 lipca — xAI ogłasza, że Grok 4.5 zasila teraz Groka we wszystkich jego konsumenckich powierzchniach: grok.com, X oraz aplikacjach iOS i Android. Model pozostaje też dostępny z Worda, Excela, PowerPointa i Outlooka poprzez dodatki Microsoft 365 od xAI. Nie jest to nowy model: jego flagowa premiera została już opisana 8 lipca, a pełna dostępność w Europie 16 lipca — to ogłoszenie jest ostatnim ogniwem wdrożenia, faktycznym przełączeniem na mobile i witrynie dla użytkowników.
Grok trafia do Microsoft Outlook
21 lipca — xAI rozszerza integrację Groka z Microsoft 365 o Grok dla Outlook: agenta, który podsumowuje długie wątki, redaguje odpowiedzi w stylu użytkownika, archiwizuje zakończone rozmowy i oznacza to, co czeka na odpowiedź — nic nie jest wysyłane bez wyraźnego potwierdzenia. Dostępny od dziś dla płatnych subskrybentów X i SuperGrok przez Microsoft Marketplace, moduł ten dołącza do tych już oferowanych dla Worda, Excela i PowerPointa.
Qwen Cloud uruchamia Token Plan Individual
21 lipca — Qwen Cloud uruchamia Token Plan Individual, abonament od $6 miesięcznie, zapewniający dostęp do wspólnej puli kredytów dla rodziny Qwen, a także GLM i DeepSeek, z wcześniejszym dostępem do Qwen3.8-Max-Preview (modelu już opisanego 19 lipca). Grafika promocyjna opisuje trzy progi cenowe (Lite / Standard / Pro), zniżki poza godzinami szczytu i pulę zdolną zasilać do 8 agentów jednocześnie.
Anthropic inwestuje 200 milionów dolarów w przyszłość ekonomiczną AI
22 lipca — Anthropic ujawnia agendę badawczą swojego Economic Futures Research Fund, wyposażonego w 200 milionów dolarów na finansowanie ambitnych badań zewnętrznych dotyczących interwencji przygotowujących społeczeństwo na ekonomiczne skutki AI. Pięć priorytetowych obszarów: wpływ na pracowników, wsparcie przejść zawodowych, modernizacja instrumentów wsparcia dochodu, mechanizmy dzielenia się wzrostem związanym z AI (przeddystrybucyjne konta kapitałowe) oraz nowe dane o inwestycjach publicznych.
Anthropic planuje finansować głównie projekty od 5 do 30 milionów dolarów, otwarte dla uniwersytetów, niezależnych instytutów badawczych i organizacji non-profit — nie dla pojedynczych badaczy. Fundusz rozwija program „Economic Futures” uruchomiony rok wcześniej, koncentrując się na mniejszej liczbie ambitnych grantów zamiast wielu małych.
Krótkie informacje
- Anthropic podwaja wsparcie dla Public First Action (dodatkowe 20 milionów dolarów) — łączne wsparcie wzrasta do 40 milionów dolarów dla tej bezpartyjnej organizacji edukującej opinię publiczną w kwestiach AI; darowizny finansują wyłącznie misję edukacyjną i polityki publicznej, bez wsparcia wyborczego. 🔗 Źródło
- Claude Code: przewodnik po pętlach weryfikacyjnych zbudowanych ze skills — jak przekształcić ręczne weryfikacje w skills Claude Code, aby Claude sam zamykał własną pętlę weryfikacyjną. 🔗 Źródło
- Studium przypadku Outtake: agent do cyberśledztw zbudowany na Claude — jak Outtake prowadzi wielogodzinne sesje, by mapować sieci ataków. 🔗 Źródło
- Cognition — DeepWiki przekracza 500 000 zindeksowanych repozytoriów — generowane przez AI narzędzie do dokumentacji kodu, darmowe; meetup z LangChain zapowiedziany na 28 lipca w San Francisco. 🔗 Źródło
- Replit promuje integrację Firecrawl — kontekst webowy jednym kliknięciem dla aplikacji, z 10 000 kredytów oferowanych pierwszym użytkownikom. 🔗 Źródło
- Hugging Face natywnie integruje Nunchaku (SVDQuant) w Diffusers — kwantyzowane checkpointy 4-bit (wagi i aktywacje) ładują się teraz przez
from_pretrained(), bez oddzielnej biblioteki inferencyjnej. 🔗 Źródło - Together AI będzie hostować Kimi K3 (Moonshot AI) od dnia premiery 27 lipca — inferencja dostępna „day zero”, benchmarki ujawnione po faktycznym starcie. 🔗 Źródło
- Gemini CLI v0.52.0 — usługi triage i egress, obejście korekty LLM dla JSON/IPYNB w
write_file/replace, aktualizacjagoogle-auth-librarydo wersji 10.9.0. 🔗 Źródło - GitHub — pola wielokrotnego wyboru dla Projects i Issues — pole niestandardowe może teraz zawierać kilka wartości jednocześnie (zespoły, moduły, kategorie). 🔗 Źródło
- HeyGen — API tłumaczenia wideo na dużą skalę — duplikowanie całego kanału wideo w 10 zlokalizowanych wersjach w mniej niż 24 godziny, z przetwarzaniem wsadowym. 🔗 Źródło
- Codex Sites Analytics przechodzi do testów publicznych — podstawowe metryki wydajności dla stron publikowanych z Codexem. 🔗 Źródło
- OpenAI uruchamia program „ChatGPT dla małych firm” — webinary ChatGPT Work, AI academies w Stanach Zjednoczonych, partnerstwa z Dropbox, Shopify, Intuit, Slack, Atlassian i Wix. 🔗 Źródło
- David Vélez (Nubank) i Robin Vince (BNY) dołączają do rad nadzorczych OpenAI — OpenAI Foundation i OpenAI Group PBC witają obu liderów. 🔗 Źródło
- Cohere ogłasza partnerstwo z HUMAIN dla arabskiego AI — kontynuacja sukcesu Cohere Transcribe Arabic, na razie bez wskazanego produktu ani daty. 🔗 Źródło
Co to oznacza
Głos staje się pełnoprawnym interfejsem sterowania, i to tego samego dnia, u dwóch różnych graczy. ChatGPT Voice trafia na desktop, by bez klawiatury sterować Chat, Work i Codex, zasilany przez GPT-Live; Claude z kolei uruchamia swój tryb głosowy na swoich najmocniejszych modelach i daje mu dostęp do podłączonych narzędzi w trakcie rozmowy. Oba ogłoszenia są niezależne, ale zbieżność daty prawdopodobnie nie jest przypadkiem: wskazuje na tę samą stawkę — rozmowa głosowa staje się pełnoprawnym kanałem pracy, zdolnym wyzwalać rzeczywiste działania za pośrednictwem agentów lub podłączonych narzędzi, a nie tylko prostym gadżetem asystenta, który ogranicza się do odpowiadania na pytania.
Ograniczanie agentów staje się osobnym tematem, odrębnym od samego ich uruchamiania. GitHub wprowadza zatwierdzenia, wynik zaufania i uzasadnienie dla zmian, które jego agenci samodzielnie stosują w Issues — jednocześnie sam podkreślając, że „to nie jest kontrola bezpieczeństwa”, a jedynie wygoda przepływu pracy. Runway z kolei dodaje automatyczną warstwę arbitrażu (koszt, jakość, opóźnienie) między konkurencyjnymi modelami generatywnymi. Wspólny mianownik: wraz z tym, jak agenci zyskują autonomię, wydawcy dodają warstwy zarządzania i sterowania zamiast po prostu dokładać kolejne możliwości — ruch, który widać też w wieloprojektowych katalogach Codex, zaprojektowanych tak, by agenci mogli pracować w szerszym zakresie bez utraty pojęcia korzenia prawdy, głównego katalogu Git.
Cyberobrona wyłania się jako wyraźna oś rywalizacji między dużymi graczami AI. Gemini 3.5 Flash Cyber deklaruje 72% wykrywania podatności na rzeczywistych codebase’ach Chrome i Androida, wobec 55% dla własnego modelu standardowego i 54% dla Claude Opus 4.6 wymienionego z nazwy przez Google — to dość rzadka, bezpośrednia porównawcza deklaracja, by warto ją odnotować. Tego samego dnia Hugging Face publikuje The Stack v3, zbiór danych kodu o rozmiarze 5 000 miliardów tokenów, wyraźnie uzasadniając publikację potrzebą „dobrych, otwartych modeli kodu do cyberobrony”. Te dwa niezależne ogłoszenia rysują wspólny niepokój wokół wykorzystywania podatności oprogramowania na dużą skalę i symetryczną odpowiedź: z jednej strony zamknięte, wyspecjalizowane modele, z drugiej — otwarte dane, by trenować kolejne.
Cognition poszerza swój teren gry w obie strony w ciągu jednego tygodnia. Przejęcie Poke, osobistego agenta działającego w wiadomościach użytkownika i który wymienił ponad 100 milionów wiadomości w trzy miesiące, przesuwa środek ciężkości firmy poza Devin, jej autonomicznego inżyniera oprogramowania, w stronę agentów konsumenckich. W tym samym czasie jej list intencyjny z amerykańskim Departamentem Energii w ramach Genesis Mission stawia ją obok Google DeepMind, OpenAI i Arcee AI — już zaangażowanych w tę samą inicjatywę od 22 lipca — w wyścigu, który teraz toczy się w czwórkę o zakorzenienie się w publicznych badaniach naukowych w USA. Dwa ruchy, ta sama logika: umacniać pozycję jednocześnie na rynku konsumenckim i na infrastrukturze instytucjonalnej, zamiast pozostawać zamkniętym w jednym segmencie.
Źródła
- Zdrowie w ChatGPT
- FLUX 3 — Black Forest Labs
- ChatGPT Voice na desktop
- Dziennik zmian Codex 26.715
- Tryb głosowy Claude
- Blog Anthropic — tryb głosowy
- Codex — projekty wieloprojektowe
- GitHub — kontrole agentów w Issues
- GitHub Mobile — Napraw za pomocą Copilot
- Runway Media Router
- HeyGen Video Agent
- Cognition przejmuje Poke
- Cognition — ogłoszenie na X
- Cognition — Genesis Mission DOE
- Cursor — podwojone limity
- Replit — ceny hostingu
- Zed 1.12
- v0 — dziennik zmian
- Amp — zdarzeniowe orby
- Gemini 3.5 Flash Cyber
- The Stack v3 — Hugging Face
- Together AI — platforma inferencyjna
- NVIDIA — fine-tuning Nemotron
- Gemini Notebook — Kolekcje
- Grok 4.5 — wszędzie
- Grok dla Outlook
- Qwen Token Plan Individual
- Anthropic — Economic Futures Research Fund
- Anthropic — darowizna Public First Action
- Claude Code — pętle weryfikacyjne
- Studium przypadku Outtake
- Cognition — DeepWiki
- Replit — Firecrawl
- Hugging Face — Nunchaku Diffusers
- Together AI — Kimi K3
- Gemini CLI — dziennik zmian
- GitHub — pola wielokrotnego wyboru
- HeyGen — Video Translation API
- Analizy Codex Sites
- OpenAI — program dla małych firm
- OpenAI — nowi administratorzy
- Cohere — partnerstwo HUMAIN