ai-powered-markdown-translatorPrzetłumaczony artykuł z fr na pl za pomocą gpt-5.4-mini.
22 lipca 2026 dominuje firmowe AI dla narzędzi i agentów: Cursor uruchamia Cursor Router, router modeli, który obniża koszty o 60% bez zauważalnej utraty jakości, OpenAI w jednym dniu przedstawia swoją platformę agentów Presence oraz centrum danych Project Camellia o mocy 3,2 gigawata w Georgii, Alibaba prezentuje Qwen-Image-3.0, a Synthesia uruchamia Roleplay Sessions do szkolenia zawodowego. Wokół tych pięciu kluczowych ogłoszeń krąży około trzydziestu innych godnych uwagi nowości — od Genesis Mission Departamentu Energii USA (Google, OpenAI, Arcee AI) po nowości Anthropic, GitHub Copilot, NVIDIA i Cohere.
Cursor uruchamia Cursor Router, inteligentne routowanie modeli o 60% taniej
22 lipca — Cursor uruchomił Cursor Router, router modeli zintegrowany z trybem Auto, który analizuje każde zapytanie i automatycznie wybiera model najlepiej dopasowany do zadania, zamiast systematycznie wysyłać wszystkie zapytania do modelu granicznego (frontier). Funkcja jest dostępna od dziś we wszystkich interfejsach (desktop, web, iOS, CLI, SDK) w planach Teams i Enterprise.
| Tryb optymalizacji | Cel | Rozliczanie |
|---|---|---|
| Intelligence | Systematyczna jakość graniczna | Stawka rzeczywiście użytego modelu |
| Balance | Jakość zbliżona do granicznej, codzienne użycie | Stawka rzeczywiście użytego modelu |
| Cost | Zadowalająca jakość, zoptymalizowana pod kątem tokenów | Stawka rzeczywiście użytego modelu |
Po stronie administracji zespoły Teams i Enterprise mają do dyspozycji szczegółowe sterowanie: włączanie lub wyłączanie Routera per zespół, ograniczanie dostępnych trybów, ustawianie trybu domyślnego, zezwalanie lub blokowanie określonych modeli bazowych oraz wybór, czy wyświetlać nazwę rzeczywiście trasowanego modelu (domyślnie ukrytą). Opcje miękkiego lub ścisłego egzekwowania pozwalają ujednolicić korzystanie z trybu Auto w całej organizacji.
In early access, customers observed no drop-off in quality with a lower cost per commit vs. routing all requests to Opus 4.8.
🇵🇱 We wczesnym dostępie klienci nie zaobserwowali żadnego spadku jakości, przy koszcie na commit niższym niż przy routowaniu wszystkich zapytań do Opus 4.8. — @cursor_ai na X
🔗 Dziennik zmian Cursor Router
OpenAI Presence, platforma agentów głosowych i tekstowych dla przedsiębiorstw
22 lipca — OpenAI uruchamia Presence, platformę agentów AI przeznaczoną dla firm do wdrażania w produkcji niezawodnych agentów głosowych i tekstowych, wykraczających poza prostą demonstrację techniczną. Presence łączy rozumowanie modeli z politykami, zabezpieczeniami i regułami eskalacji do człowieka.
Każde wdrożenie zaczyna się od konkretnego zadania (fakturowanie, szkody ubezpieczeniowe, wewnętrzne zgłoszenia IT): agent otrzymuje tylko niezbędną wiedzę i dostęp do systemów, a firma-klient definiuje, co może robić, kiedy wymagana jest walidacja człowieka i kiedy osoba ma przejąć kontrolę. Po wdrożeniu rzeczywiste sesje i przypadki eskalacji ujawniają braki systemu; Codex proponuje wtedy aktualizacje, które zespoły testują i zatwierdzają, co pozwala agentowi dostosować się do zmieniających się zachowań użytkowników.
Od dziś Presence obsługuje doświadczenia czasu rzeczywistego w głosie i tekście dla obsługi klienta, sprzedaży wychodzącej lub wewnętrznych procesów o wysokiej stawce. Produkt jest dostępny dla kwalifikujących się klientów biznesowych w ramach programu ograniczonej dostępności ogólnej, z bezpośrednim wsparciem zespołów OpenAI, a następnie — w ramach dalszego monitoringu — przez wybranych integratorów systemów.
Project Camellia, centrum danych OpenAI o mocy 3,2 gigawata w Georgii
22 lipca — OpenAI ujawnia Project Camellia, długoterminowy projekt infrastruktury AI w hrabstwie Effingham w Georgii. Firma zawarła umowę z Georgia Power na 3,2 gigawata mocy, dostarczanej etapami między 2028 a 2032 rokiem.
Jeśli chodzi o energię elektryczną, OpenAI zobowiązuje się pokryć całość kosztów infrastruktury i usług, bez przenoszenia ich na rachunki mieszkańców, a lokalizacja została zaprojektowana tak, aby proaktywnie ograniczać zużycie w razie dużego zapotrzebowania, zanim odczują to odbiorcy indywidualni. W kwestii wody zamknięty obieg ponownie wykorzystuje wodę zamiast nieprzerwanie ją pobierać i odprowadzać, dzięki czemu ciągłe zużycie pozostaje porównywalne z odpowiednim biurowcem.
Na poziomie gospodarczym OpenAI ogłasza 80 milionów dolarów korzyści dla społeczności w całym cyklu życia projektu (szkoły, bezpieczeństwo publiczne, zdrowie, mieszkalnictwo, weterani, małe firmy), oprócz setek milionów dolarów oczekiwanych lokalnych i stanowych wpływów podatkowych — firma zakłada, że stanie się największym podatnikiem hrabstwa. Dodatkowo przewidziano do 71 milionów dolarów kredytów Codex dla kwalifikujących się studentów colleges, community colleges i szkół technicznych w Georgii, z których każdy otrzyma 100 dolarów kredytów na swoje konto ChatGPT.
Qwen-Image-3.0, trzecia generacja modelu Alibaba do generowania obrazów
22 lipca — Alibaba uruchomiła Qwen-Image-3.0, trzecią generację swojego modelu do generowania obrazów, podsumowaną przez zespół jednym hasłem: „Real” („实”), po precyzji wersji 1.0 i różnorodności/kompletności 2.0.
| Wymiar | Co to konkretnie zmienia |
|---|---|
| Bogata treść | Prompty do 4,5k tokenów; złożony układ w jednym przebiegu (gazety, storyboardy, tematy egzaminacyjne, siatki infografik 3×3, zagnieżdżone interfejsy) |
| Autentyczne detale | Czytelny tekst do 10px, pełne strony LaTeX, niemal fotorealistyczne tekstury (pory, kosmyki włosów, skóra) |
| Głęboka wiedza | Natywne renderowanie w 12 językach, ponad 100 stylów artystycznych, realistyczne interfejsy (web, gry, streamy), pobieranie z sieci na żywo |
Pokazany przez Alibaba przykład ilustruje tę „ekspansję horyzontalną”: przy zaledwie 3,7k tokenów model generuje infografikę 3×3 obejmującą dziewięć bardzo różnych dziedzin (bezpieczeństwo w tunelu, geometria przestrzenna, analiza stylistyczna klasycznego tekstu chińskiego, ruch pocisku, parazytologia, diagnostyka medyczna, twierdzenia Sylowa, kontrola bankowa, struktura DNA), z precyzyjnym tekstem i grafiką w każdym polu. Alibaba pozycjonuje model nie jako zwykłe narzędzie „ładne do oglądania”, lecz jako narzędzie produktywności dla projektowania, tworzenia treści, edukacji i e-commerce. Jest już dostępny przez Qwen Chat.
Synthesia uruchamia Roleplay Sessions do szkolenia zawodowego
22 lipca — Synthesia uruchamia Roleplay Sessions, pierwszy element swojej przyszłej platformy „Sessions” przeznaczonej do szkolenia zawodowego z wykorzystaniem AI. Idea: na żywo prowadzona rozmowa treningowa z awatarem, który odpowiada i podpowiada w czasie rzeczywistym, coachuje użytkownika za pomocą systemu punktacji, a następnie mierzy postęp umiejętności w skali zespołu. Cel to sprzedaż, zarządzanie, obsługa klienta i każda sytuacja, w której pracownik musi przećwiczyć trudną rozmowę.
| Wskaźnik | Wartość |
|---|---|
| Podstawowe kompetencje zakłócone do 2027 r. (źródło Synthesia) | 44% pracowników |
| Pracodawcy deklarujący brak możliwości zniwelowania luki | 63% |
| Średni wzrost kompetencji (duża globalna agencja rekrutacyjna) | około 30% |
| Handlowcy wracający na dobrowolny trening (firma z Fortune 10) | około 70% |
Roleplay Sessions ma połączyć w jednej platformie cztery zwykle rozproszone etapy — informowanie, trening, coaching i pomiar — opierając się na bazie wideo Synthesia, już wykorzystywanej przez 90% firm z Fortune 100. Pierwsze wdrożenia obejmują dużą europejską grupę i spółkę z Fortune 10.
Genesis Mission DOE: Google, OpenAI i Arcee AI zwiększają swoje zobowiązania
22 lipca — Trzej różni gracze ogłosili tego samego dnia nowe zobowiązania wokół Genesis Mission, inicjatywy amerykańskiego Departamentu Energii (DOE) mającej podwoić tempo odkryć naukowych w ciągu dekady.
| Organizacja | Zobowiązanie | Szczegół |
|---|---|---|
| Google DeepMind | 40 milionów dolarów | Tokeny AI i kredyty Google Cloud, aby umożliwić większej liczbie badaczy z laboratoriów narodowych dostęp do Gemini i innych modeli |
| OpenAI | 17 milionów dolarów | Dostęp Codex dla około 2 000 badaczy, wsparcie API dla dwóch kampanii naukowych, do 10 milionów dolarów darmowego użycia API za 2,5 miliona wydatków, dostęp do GPT-Rosalind dla biologii |
| Arcee AI | Partnerstwo (kwota nieujawniona) | Budowa Genesis-Science-1 (GS1), amerykańskiego modelu o otwartych wagach, połączonego z zarządzanym środowiskiem badawczym dla workflow obliczeń naukowych |
Google rozszerza już istniejącą współpracę wokół biologii obliczeniowej (AlphaFold, Isomorphic Labs). OpenAI opiera się na pracach prowadzonych już z systemem laboratoriów narodowych, w tym sesji „AI Jam”, która zgromadziła ponad 1 000 naukowców z dziewięciu laboratoriów. Arcee AI z kolei uruchamia program współtworzenia przeznaczony dla badaczy, laboratoriów, uniwersytetów, firm i organizacji non-profit; projekt jest na wczesnym etapie, bez daty premiery ani opublikowanego benchmarku dla GS1 na tym etapie.
🔗 Google DeepMind na X — 🔗 OpenAI na ten temat — 🔗 Arcee AI na X
Anthropic mnoży ogłoszenia dotyczące Claude
Claude Security w wersji beta dla Claude Code
22 lipca — Anthropic uruchamia w wersji beta wtyczkę Claude Security dla Claude Code: skanowanie bieżących zmian w poszukiwaniu podatności przed commitem lub pełna analiza repozytorium, wszystko z terminala, z wykorzystaniem inferencji Claude już używanej (bez osobnej usługi zewnętrznej do uruchomienia). To wydanie stawia Claude Code na tym samym polu co Codex Security od OpenAI albo wzmocnione secret scanning w GitHub Copilot. Nie podano ani cen, ani planów objętych poza statusem beta.
Claude może odpytywać Anthropic Economic Index przez connector
22 lipca — Nowy natywny connector daje dostęp do Anthropic Economic Index, publicznego zbioru danych mierzącego użycie AI w gospodarce. Po włączeniu w menu connectorów Claude może odpowiadać na pytania takie jak „jakie zawody używają najwięcej AI”, opierając się bezpośrednio na danych Indexu zamiast na swojej ogólnej wiedzy.
Claude Managed Agents: effort, seeding, 500 skills i webhooks
22 lipca — Anthropic wdraża pakiet funkcji dla Claude Managed Agents: konfigurowalne poziomy effort dla każdego agenta (szybsze i tańsze odpowiedzi przy niższym effort), „seedowane” sesje z maksymalnie 50 zdarzeniami już przy tworzeniu, łącznie do 500 skills we wszystkich agentach danej sesji, webhooks dla środowisk i magazynów pamięci oraz streaming zdarzeń subagentów.
Claude Code na desktopie integruje się z symulatorem iOS
21 lipca — Claude Code na desktopie obsługuje symulator iOS: aplikacja może być skompilowana i uruchomiona przez Claude, który ją obserwuje, wchodzi z nią w interakcję i iteruje aż do zakończenia zadania, w panelu obok rozmowy. Dostępne od dziś w publicznej becie, tylko na macOS i wymaga Xcode.
🔗 Claude Security — 🔗 Economic Index — 🔗 Managed Agents — 🔗 Symulator iOS
Narzędzia kodowe: Amp, Warp i Replit
Amp uruchamia Multiplayer, współpracę w czasie rzeczywistym nad orbami
22 lipca — Trzy tygodnie po uruchomieniu agentów w orbach Amp dodaje Multiplayer: ten sam orb może być teraz współdzielony i jednocześnie edytowany przez wielu członków przestrzeni roboczej, z możliwością wysyłania wiadomości do agenta, przeglądania portalu, obserwowania zmian plików na żywo i korzystania ze wspólnego terminala, aktywowanego z menu Share w wątku.
Warp dodaje obsługę linków hypertext OSC 8
22 lipca — Warp wprowadza obsługę OSC 8, standardu terminalowego pozwalającego CLI i agentom kodującym emitować klikalne linki zamiast zwykłego tekstu. Opracowana przez zewnętrznego kontrybutora na podstawie pięcioletniego otwartego zgłoszenia funkcja jest wdrażana w wersji Dev za flagą funkcji (feature flag), do czasu dodatkowych testów silnika renderującego siatkę terminala.
Replit odświeża swoją aplikację mobilną
22 lipca — Replit publikuje przebudowę swojej aplikacji mobilnej (iOS, stopniowe wdrażanie na Androidzie): przeprojektowany ekran główny, wprowadzanie głosowe, aby mówić bezpośrednio do Agenta, nawigacja gestami między czatem, zadaniami i podglądem oraz Live Activities iOS śledzące postęp agenta na żywo, także poza aplikacją.
🔗 Amp Multiplayer — 🔗 Warp OSC 8 — 🔗 Replit mobile
Microsoft Asia publikuje Mage-Flow, kompaktowy model do generowania obrazów
22 lipca — Microsoft Asia publikuje na Hugging Face Mage-Flow, model do generowania i edycji obrazów liczący zaledwie 4 miliardy parametrów, który deklaruje jakość porównywalną z dużo większymi modelami. Pod względem wydajności model generuje obraz w 4 krokach w mniej niż sekundę przy 1024×1024 i może skalować do 4K. Demonstracja jest dostępna przez Hugging Face Spaces.
Gemini: Galaxy Unpacked 2026 i Gemini 3.5 Pro
Trzy nowości Gemini po stronie Samsunga
22 lipca — Na marginesie Galaxy Unpacked 2026 Google opisuje trzy nowości Gemini dla ekosystemu Galaxy: szerszą automatyzację zadań obejmującą ponad 40 popularnych aplikacji (zakupy, rezerwacje, zakup biletów, zdolną przetwarzać złożone obrazy jako instrukcje i wykonywać się w tle); Gemini Notebook (dawny NotebookLM) preinstalowany na serii Galaxy Z Fold8, z sześciomiesięcznym okresem próbnym Google AI Pro w zestawie; oraz Gemini na Galaxy Watch 9 (aktywacja prostym uniesieniem nadgarstka, bez słowa wybudzającego), a także inteligentne okulary rozwijane wspólnie z Samsungiem (oprawki Gentle Monster i Warby Parker) planowane na jesień 2026.
Gemini 3.5 Pro wchodzi do testów partnerskich
21 lipca — Josh Woodward, wiceprezes odpowiedzialny za Gemini, potwierdza, że kolejny flagowy model, Gemini 3.5 Pro, oficjalnie wszedł w fazę testów z partnerami. Nie podano daty ogólnej dostępności, ale potwierdzenie to sytuuję Gemini 3.5 Pro jako kolejne oczekiwane duże wydanie po stronie modeli Gemini.
🔗 Galaxy Unpacked 2026 — 🔗 Gemini 3.5 Pro
Manus uruchamia Plan Mode
22 lipca — Manus wprowadza Plan Mode, strukturalny etap przeglądu przed wykonaniem: zamiast od razu przechodzić do budowania, agent generuje plan wykonalności w formacie Markdown, z celami, krokami i ograniczeniami, który użytkownik może edytować lub wysłać do ponownej weryfikacji przed zatwierdzeniem. Aktywacja odbywa się przez / w sieci lub + na urządzeniu mobilnym; tryb można też uruchomić w trakcie zadania, aby zaplanować kolejne fazy. Dostępne od razu dla wszystkich użytkowników, w sieci i na urządzeniach mobilnych, w trybie opt-in.
GitHub Copilot: canvasy i rozliczenia
GitHub Copilot uruchamia canvasy
21 lipca — GitHub wprowadza canvasy, interaktywne przestrzenie robocze w aplikacji GitHub Copilot, w których deweloperzy i agenci współpracują w czasie rzeczywistym: wizualizacja złożonych informacji, bezpośrednie interakcje (kliknięcia, edycje), dopracowywanie w iteracjach promptów. Tworzenie za pomocą polecenia /create-canvas. Przykładowe zastosowania: sortowanie issue przez przesuwanie kart, interaktywne diagramy architektury, tablice kontrolne worktrees, coaching jakości promptów, wyszukiwanie wiedzy na wielu platformach. Jeden z użytkowników udokumentował przypadek, w którym aplikacja automatycznie uruchomiła canvas przeglądarkowy, aby klikać aż do ekranu płatności i zweryfikować funkcję, zastępując ręcznie napisany test Playwright.
Co Copilot daje ponad surowy dostęp do API
22 lipca — GitHub wyjaśnia swoją politykę rozliczeń, opartą teraz na kredytach AI naliczanych według opublikowanych stawek API modeli. Uzupełnianie kodu i Next Edit Suggestions pozostają wliczone w płatne plany; chat i zadania agentowe zużywają kredyty AI. Argument GitHuba: poza dostępem do modelu Copilot oferuje zintegrowany przepływ pracy (issue, repozytoria, pull requesty, polityki organizacyjne), mniejsze zużycie tokenów przy równoważnej skuteczności rozwiązywania zadań według jego ocen, kontrole polityk dla administratorów oraz sprawdzoną w produkcji infrastrukturę agenta poprzez SDK Copilot.
🔗 Canvasy — 🔗 Copilot vs surowy dostęp do API
ElevenLabs: ElevenMusic i ukraińska usługa publiczna
ElevenLabs wprowadza Vocals i Styles w ElevenMusic
22 lipca — ElevenLabs dodaje dwie funkcje do ElevenMusic, dostępne także w Finetunes w ElevenCreative: Vocals, które pozwalają generować oryginalne utwory własnym głosem lub głosem z biblioteki głosów (przesyłanie utworów w celu dopracowania Music v2 pod kątem barwy głosu lub tryb jednorazowy na podstawie jednego nagrania); oraz Styles, zapewniające spójność stylistyczną na całych utworach, kompatybilne z Vocals. ElevenLabs podkreśla, że wszystkie przesyłane pliki są sprawdzane pod kątem zgodności z prawami autorskimi.
ElevenLabs wyposaża Obrii (Ukraina) w asystenta głosowego dla publicznej służby zatrudnienia
22 lipca — Obrii, nowy cyfrowy ekosystem rynku pracy w Ukrainie, uruchamia swoją pierwszą usługę AI: asystenta głosowego opracowanego z ElevenLabs dla publicznej służby zatrudnienia, dostępnego 24 godziny na dobę, także podczas alertów nalotowych.
“Together with @ElevenLabs, we launched AI voice assistant for the State Employment Service — bringing public services closer to people, 24/7, even during air raid alerts.”
🇵🇱 Dzięki ElevenLabs uruchomiliśmy asystenta głosowego AI dla publicznej służby zatrudnienia — przybliżając usługi publiczne obywatelom, 24 godziny na dobę i 7 dni w tygodniu, także podczas alertów nalotowych. — @C_o_S na X
NVIDIA: symulacja medyczna, fabryka w Teksasie i modele Cosmos
Otwarty framework symulacji fizyki medycznej
22 lipca — NVIDIA publikuje jako open source, w NVIDIA Isaac for Healthcare, przyspieszany przez GPU framework symulacji fizyki medycznej, przedstawiany jako pierwszy tego rodzaju: interakcje między urządzeniem medycznym (cewnik, prowadnik) a anatomią pacjenta, łączące klasyczną symulację fizyczną i generatywną AI (Cosmos-H Dreams). Dzięki uruchomieniu 8 192 środowisk równolegle NVIDIA twierdzi, że skróciła czas treningu polityk robotycznych (policies) z ponad pięciu godzin do mniej niż dwóch minut. CMR Surgical, Johnson & Johnson MedTech, XCath i Medtronic Structural Heart już z tego korzystają; dostępne od razu na GitHub.
NVIDIA i Wistron otwierają fabrykę superchipów w Fort Worth
21 lipca — Wistron otwiera swoją pierwszą amerykańską fabrykę, zakład o powierzchni 30 000 m² w Fort Worth (Teksas), który już produkuje superchipy Grace Blackwell Ultra i w przyszłości będzie wytwarzał Vera Rubin. Inwestycja 700 milionów dolarów, ponad 500 utworzonych miejsc pracy (cel: 1 000 do końca roku), w ramach zobowiązania NVIDIA na poziomie 500 miliardów dolarów na produkcję platform AI w USA.
Cosmos 3 Super, nawet 25 razy szybszy
22 lipca — NVIDIA publikuje Cosmos 3 Super, wariant swojej rodziny Cosmos 3 z 4 krokami, generujący obrazy i filmy nawet 25 razy szybciej niż modele oryginalne, przy zachowaniu wysokiej pozycji w Artificial Analysis: pierwsze miejsce w image-to-video (bez audio), drugie miejsce w text-to-image. Dostępne od razu na Hugging Face.
Podsumowanie Nemotron Model Reasoning Challenge na Kaggle
22 lipca — NVIDIA publikuje podsumowanie swojego Nemotron Model Reasoning Challenge na Kaggle: ponad 5 000 uczestników w ponad 4 000 zespołów, wokół technik poprawy rozumowania otwartych modeli. Zespoły NullSira, vli i YS-L kończą na trzech pierwszych miejscach.
🔗 Symulacja medyczna — 🔗 Fabryka Wistron — 🔗 Cosmos 3 Super — 🔗 Podsumowanie Kaggle
Kimi K3: drugi na AA-Briefcase, ale kosztowny i wolny
21 lipca — Artificial Analysis publikuje wyniki Kimi K3 (Moonshot AI) na AA-Briefcase, swoim benchmarku pracy z wiedzą agentową (arkusze kalkulacyjne, prezentacje, makiety interfejsu). Model uzyskuje drugi najlepszy zarejestrowany wynik, skok o ponad 700 punktów względem poprzedniej generacji.
| Oceniany model | Elo AA-Briefcase | Średni koszt na zadanie | Średni czas na zadanie |
|---|---|---|---|
| Claude Fable 5 (max) | 1574 | — | — |
| Kimi K3 | 1543 | 10,57 dolarów | 56,4 minuty |
| GPT-5.6 Sol (max) | 1501 | — | — |
| Claude Sonnet 5 (max) | 1388 | — | — |
| Claude Opus 4.8 (max) | 1347 | — | — |
| Kimi K2.6 (referencja) | 816 | ~1 dolar | — |
Kimi K3 osiąga 51% skuteczności w siatkach oceny, tuż za Claude Fable 5 (56%), z porównywalną jakością analityczną, ale słabszą jakością prezentacji. Minus: średni koszt 10,57 dolarów za zadanie, około dziesięć razy więcej niż Kimi K2.6, co wynika z ceny modelu, dużego zużycia tokenów wyjściowych i średnio 83 tur na zadanie (w porównaniu z 67 dla Claude Fable 5 i 50 dla GPT-5.6 Sol).
OpenAI: zastosowania w prasie i limity API
Jak redakcje korzystają z narzędzi OpenAI
22 lipca — OpenAI publikuje przegląd zastosowań swoich narzędzi przez organizacje medialne. Associated Press używa ich do reportażu, weryfikacji (śledzenie uploadu, geolokalizacja, chronolokalizacja obrazów i filmów), przekształcania tysięcy akt Sądu Najwyższego w uporządkowane informacje oraz konwersji artykułów na skrypty do emisji, pozostawiając dziennikarzom kontrolę nad osądem redakcyjnym. POLITICO analizuje duże wolumeny dokumentów publicznych, by szybciej tworzyć oryginalne materiały; Axios także jest wymienione. OpenAI odnawia wsparcie dla American Journalism Project i kontynuuje współpracę z Lenfest Institute oraz WAN-IFRA.
Ścisłe limity wydatków rozszerzone na wszystkie konta API
22 lipca — OpenAI rozszerza w tym tygodniu na wszystkie konta API Platform dostęp do ścisłych limitów wydatków (hard spend limits), pozwalając każdemu deweloperowi ograniczyć zużycie do wybranej kwoty, z monitorowaniem użycia w czasie rzeczywistym z poziomu panelu.
🔗 Zastosowania w prasie — 🔗 Limity API
Cohere: diakrytyzacja arabskiego i lekki model kodu
Speech Tashkeel 2B i społecznościowy ekosystem Transcribe Arabic
22 lipca — Cohere promuje Speech Tashkeel 2B, model partnerski opracowany przez NAMAA, który konwertuje surowy arabski tekst na w pełni zdiakrytyzowany zapis (znaki gramatyczne przypadków, harakāt, tanwīn, sukūn, shadda), w wersji skwantyzowanej do 4 bitów. Ogłoszeniu towarzyszą wkłady społeczności wokół Transcribe Arabic, modelu rozpoznawania mowy w języku arabskim od Cohere: aplikacja listen-habibi, natywne wsparcie Ruby oraz kwantyzacje GGUF/ONNX opublikowane na Hugging Face. Cohere ogłasza ponadto partnerstwo z HUMAIN, aby rozszerzyć tę pracę na inne języki o niedoborze zasobów.
North Mini Code, lekki i ekonomiczny model kodu
21 lipca — Cohere przedstawia North Mini Code, open source’owy model kodu zaprojektowany do zadań powtarzalnych i mało złożonych — debugowania, tworzenia testów jednostkowych — pozycjonowany jako ekonomiczna alternatywa dla większych modeli w celu ograniczenia kosztów inferencji.
🔗 Speech Tashkeel 2B — 🔗 North Mini Code
Krótkie wiadomości
- Warp publikuje wpis o napięciach ekonomicznych startupów AI w fazie hiperwzrostu — analiza nadchodzącego zaostrzenia przychodów dla szybko rosnących startupów. 🔗 Źródło
- Hugging Face organizuje swoje pierwsze wydarzenie w Japonii, w Tokio — prezentacja najnowszych narzędzi i planów firmy na rynek japoński, w Otemachi. 🔗 Źródło
- Ai2 publikuje nową wersję PaperFinder — narzędzie do wyszukiwania dokumentów naukowych chwalone przez użytkującego je regularnie badacza, bez podanych szczegółów technicznych. 🔗 Źródło
- Sakana AI publikuje ogólną prezentację Fugu, „One Model to Command Them All” — wpis na blogu rozszerzający zakres modelu orkiestracji poza już opisaną odmianę Fugu-Cyber. 🔗 Źródło
- Gemini Live — przewodnik po kamerze do pomocy wizualnej w czasie rzeczywistym — skieruj kamerę na obiekt lub dokument, aby uzyskać pomoc kontekstową bez potrzeby opisywania sytuacji na piśmie. 🔗 Źródło
- AlphaFold — nowe zastosowanie w inżynierii białek w okolicach 5. rocznicy bazy — Pushmeet Kohli (Google DeepMind) chwali użycie do wypełniania strukturalnych luk w biologii. 🔗 Źródło
- Nowy pulpit wpływu metryk Copilot (Enterprise) — kohorty adopcji (Code-first, Agent-first, Multi-agent, Pasywni) ze wskaźnikami szybkości i merge’ów na użytkownika. 🔗 Źródło
- Copilot Business/Enterprise — widoczność kredytów AI według cyklu rozliczeniowego — wyświetlanie możliwe teraz nawet bez przypisanego indywidualnego budżetu. 🔗 Źródło
- GHES — nadchodzące zaostrzenie uploadu bundle’i wsparcia (18 sierpnia 2026) — odrzucanie uploadów z niezałatanych instancji; wymagane zaktualizowanie do 3.21.3, 3.20.5, 3.19.9, 3.18.12 lub 3.17.18. 🔗 Źródło
- NVIDIA uruchamia moduły Jetson Thor T2000 i T3000 — nowe moduły do robotyki i AI na brzegu sieci, bez dostępnej na tym etapie szczegółowej karty technicznej. 🔗 Źródło
- Cisco uruchamia Antares, małe modele do wykrywania podatności w kodzie — Antares-350M i Antares-1B, dostępne na Hugging Face, uruchamialne lokalnie, aby uniknąć wysyłania wrażliwego kodu do chmury. 🔗 Źródło
- HeyGen HyperFrames — dzień 17/30: przepływ Storyboard — plan w trzech przebiegach (karty, szkice, finalny render) z przeglądem poprzez komentarze klatka po klatce. 🔗 Źródło
- Kling AI publikuje poradnik MCP do tworzenia kinowych kreacji z agentami — pełny kreatywny przepływ w agencie: postać, emocja, masowa generacja wideo. 🔗 Źródło
- Rodzina buduje domek na drzewie z ChatGPT jako konsultantem — projekt konstrukcyjny, wybór materiałów i tłumaczenie pomysłów dzieci na wykonalne plany. 🔗 Źródło
- Codex Live Build — sesja budowania na żywo — transmisja z twórcami klawiatur Codex Micro. 🔗 Źródło
- Graczka odtwarza włoskie Dolomity w grze wideo z pomocą Codex — otwarty świat „Valdiluce” z wspinaczką, szybownictwem i działającą kolejką linową. 🔗 Źródło
- Promocja ChatGPT Work — 100 dolarów kredytów w prezencie — dla pierwszych 10 000 uczestników publikujących na X, co cenią w ChatGPT Work. 🔗 Źródło
Co to oznacza
Routing modeli staje się nowym polem rywalizacji narzędzi do kodowania: Cursor Router obiecuje 60% oszczędności bez zauważalnej utraty jakości, automatycznie wybierając właściwy model dla każdego zapytania, podczas gdy Artificial Analysis pokazuje odwrotnie, że Kimi K3, drugi najlepszy wynik w jego benchmarku pracy z wiedzą agentową, kosztuje około dziesięć razy więcej niż poprzednia generacja i zajmuje prawie godzinę na zadanie. Przekaz po obu stronach jest ten sam: sama surowa moc modelu nie wystarcza już, by uzasadnić jego użycie; kompromis koszt/jakość/opóźnienie staje się prawdziwym parametrem decyzyjnym dla zespołów wdrażających te narzędzia na dużą skalę.
Agenci korporacyjni wyraźnie przechodzą z logiki demonstracji do logiki produkcji. OpenAI Presence explicite porządkuje polityki, zabezpieczenia i eskalację do człowieka wokół rozumowania modeli; Synthesia Roleplay Sessions wylicza konkretne korzyści w podnoszeniu kompetencji w warunkach rzeczywistych; GitHub Copilot Canvases dokumentuje przypadek, w którym agent zweryfikował własną pracę aż do ekranu płatności, zastępując testy pisane ręcznie; a Claude Managed Agents dodaje poziomy wysiłku i webhooks zaprojektowane z myślą o złożonych, agentowych workflowach produkcyjnych. Te ogłoszenia zbiegają się wokół jednego wymagania: uczynić agentów niezawodnymi i sterowalnymi w dłuższym horyzoncie, a nie tylko zdolnymi na pokazowej demonstracji.
Na gruncie instytucjonalnym Genesis Mission DOE pokazuje wyścig, który jest już otwarty dla trzech graczy — Google, OpenAI i Arcee AI — o zakorzenienie się w amerykańskich publicznych badaniach naukowych, każdy według własnej logiki: tokeny i kredyty chmurowe dla Google, dostęp do Codex i API dla OpenAI, otwarty, zarządzany model dla Arcee AI. Ta dynamika instytucjonalna splata się z wyścigiem o infrastrukturę fizyczną, z Project Camellia (3,2 gigawata w Georgii) i fabryką superchipów Wistron w Fort Worth (700 milionów dolarów, kilkaset miejsc pracy), które pokazują, że moc obliczeniowa i zakorzenienie terytorialne stają się pełnoprawnymi argumentami komunikacyjnymi, liczonymi i publicznie szczegółowo opisywanymi.
Wreszcie generowanie multimodalne nadal różnicuje się zarówno od dołu, jak i od góry: Qwen-Image-3.0 podnosi realizm i profesjonalną użyteczność modelu granicznego, podczas gdy Mage-Flow (Microsoft Asia, 4 miliardy parametrów) i Cosmos 3 Super (NVIDIA, nawet 25 razy szybciej) stawiają na kompaktowość i szybkość, aby uczynić te możliwości dostępnymi przy niższym koszcie obliczeniowym. Przypadek użycia ElevenLabs/Obrii w Ukrainie przypomina ponadto, że te technologie głosowe znajdują także zastosowania w usługach publicznych o dużym wpływie społecznym, wykraczające poza same komercyjne use case’y.
Źródła
- Cursor Router — dziennik zmian
- OpenAI Presence
- Project Camellia
- Qwen-Image-3.0
- Synthesia Roleplay Sessions
- Google DeepMind — Genesis Mission
- OpenAI — Genesis Mission
- Arcee AI — Genesis-Science-1
- Claude Security
- Anthropic Economic Index — connector
- Claude Managed Agents
- Claude Code — symulator iOS
- Amp Multiplayer
- Warp — linki OSC 8
- Replit — aplikacja mobilna
- Microsoft Asia — Mage-Flow
- Galaxy Unpacked 2026 — Gemini
- Gemini 3.5 Pro — test partnerów
- Manus Plan Mode
- GitHub Copilot — Canvases
- GitHub Copilot vs surowy dostęp do API
- ElevenLabs — Vocals et Styles
- ElevenLabs — Obrii Ukraine
- NVIDIA — medyczna symulacja fizyczna
- NVIDIA/Wistron — fabryka Fort Worth
- NVIDIA — Cosmos 3 Super
- NVIDIA — podsumowanie Nemotron Reasoning Challenge
- Kimi K3 — AA-Briefcase
- OpenAI — zastosowania prasowe
- OpenAI — limity wydatków API
- Cohere — Speech Tashkeel 2B
- Cohere — North Mini Code