Szukaj

Qwen3.8-Max w Alibaba, open source GenOffice, API v0: zapowiedzi z 3 sierpnia

Artykuł wygenerowany przez sztuczną inteligencję
Qwen3.8-Max w Alibaba, open source GenOffice, API v0: zapowiedzi z 3 sierpnia

ai-powered-markdown-translator

Artykuł przetłumaczony z fr na pl za pomocą gpt-5.4-mini.

Zobacz projekt na GitHubie ↗

3 sierpnia 2026 skupia trzy główne ogłoszenia: Alibaba przedstawia Qwen3.8-Max, swój nowy flagowy model z 2,4 T parametrów, Genspark udostępnia jako open source swój pakiet biurowy GenOffice, a Vercel otwiera programistyczne API dla v0. Wokół tych trzech premier Cursor, GitHub, Sakana AI, MiniMax, Runway, ElevenLabs i Google mnożą aktualizacje produktowe.


Qwen3.8-Max, nowy flagowy model Alibaba do kodu i coworkingu

Alibaba przedstawiła Qwen3.8-Max, opisywany jako najbardziej zaawansowany model, jaki firma wyprodukowała do tej pory, z pozycjonowaniem skupionym na kodzie i współpracy z AI (cowork). Model ma 2,4 T parametrów i jest dostępny natychmiast przez API oraz Qwen Studio.

Zespół podkreśla cztery obszary postępu: długotrwały autonomiczny rozwój (dziesięć dni lub więcej samoewolucji, od pustego katalogu do produkcji, z pełnym śladem projektu opublikowanym na GitHub), gotowe do produkcji rezultaty w wielu zawodach, autonomiczne planowanie na długich horyzontach — do 500 rund optymalizacji projektu chipów i 365 dni strategii e-commerce przywołanych jako przykłady — oraz natywną multimodalną inteligencję, w której wizja nieustannie zasila planowanie, wykonanie i samokorektę.

Alibaba zapowiada udostępnienie wag Qwen3.8-Max w tygodniu po ogłoszeniu, a także open weights lżejszej wersji Qwen3.8-27B. Model jest też dostępny od razu po ogłoszeniu w Venice, anonimowej platformie czatowej, a integrację w narzędziu o nazwie „Command Code” wspomniano tego samego dnia bez dodatkowych szczegółów.

WskaźnikWartość
Parametry2,4 T
Cena wejścia2,0 $ / milion tokenów
Cena wyjścia6,0 $ / milion tokenów
Cache implicite0,25 $ / milion tokenów
Udostępnienie wagNastępny tydzień (Qwen3.8-Max + Qwen3.8-27B)

🔗 Ogłoszenie na X


Genspark otwiera kod GenOffice, swojego pakietu biurowego AI

Genspark ogłosił przejście GenOffice na open source, przedstawiając go jako pierwszy kompletny i otwarty pakiet biurowy AI dla PC i Mac. Narzędzie jest darmowe dla wszystkich i bez reklam.

Pakiet obejmuje klasyczne zastosowania pakietu biurowego — edycję tekstu (Docs), arkusze kalkulacyjne (Sheets), prezentacje (Slides) i PDF — wraz ze standardowymi narzędziami edycyjnymi. Genspark integruje w nim swojego Super Agenta, zdolnego do wyszukiwania, analizowania danych, a następnie pisania dokumentu lub tworzenia prezentacji, zużywając kredyty Genspark.

Warto zauważyć metodę tworzenia: wersję Alpha zbudował jeden inżynier w tydzień, kosztem 10 000 dolarów w tokenach.

“One engineer, one week, $10,000 in tokens. That’s what it took to build the GenOffice Alpha.”

🇵🇱 Jeden inżynier, jeden tydzień, 10 000 dolarów w tokenach. Tyle trzeba było, aby zbudować wersję Alpha GenOffice.@genspark_ai na X

Projekt pozostaje świadomie na etapie Alpha: Genspark zachęca społeczność do testowania narzędzia, zgłaszania błędów i proponowania funkcji za pośrednictwem dedykowanego grupowego czatu w GenTeam, bez pisania kodu. Najbardziej pomocni współtwórcy otrzymują w podziękowaniu ponad 1 000 kredytów Genspark. Ogłoszenie miało miejsce podczas singapurskiej edycji AGI Playground, gdzie Genspark broni tezy, że wraz ze spadkiem kosztów modeli wartość przesuwa się ku najlepszemu doświadczeniu zbudowanemu na ich bazie.


Vercel uruchamia programistyczne API dla v0

Vercel otwiera nowe API v0, dostępne od dziś, które zapewnia programistyczny dostęp do możliwości tworzenia aplikacji dotąd zarezerwowanych dla interfejsu czatu. W praktyce deweloper może teraz sterować v0 z własnego kodu zamiast korzystać ze strony internetowej.

Udostępniono cztery operacje: rozpoczęcie rozmowy na podstawie promptu tekstowego, istniejącego repozytorium kodu lub archiwum ZIP; wygenerowanie podglądu serwera deweloperskiego, aby zobaczyć wynik na żywo; wysyłanie wiadomości uzupełniających w celu iterowania nad generacją; oraz bezpośrednie wdrożenie wyniku na Vercel.

To API przekształca v0 w element, który można włączyć do zewnętrznych łańcuchów narzędzi — agentów, skryptów automatyzacji, integracji wewnętrznych — zamiast w prosty autonomiczny produkt dla szerokiego odbiorcy. To spójny krok ze strategią Vercel, by uczynić z v0 warstwę generowania interfejsów, z której mogą korzystać inne agenty, w tym agenty firm trzecich sterujące v0 bez używania historycznego czatu.

Dla zespołów, które już budują agentów deweloperskich, otwiera to możliwość łączenia generacji kodu, podglądu i wdrożenia w całkowicie zautomatyzowanym pipeline, bez udziału człowieka na każdym etapie.

🔗 Ogłoszenie na X


Cursor: bardziej wydajne agenty chmurowe i nowe wtyczki Google Workspace

Cursor opublikował tego samego dnia dwie oddzielne aktualizacje, jedną dotyczącą wydajności agentów chmurowych, a drugą integracji z Google Workspace.

Agenty chmurowe: o 20 do 30 % mniej tokenów

Cursor ogłasza znaczące wzrosty efektywności swoich agentów chmurowych: od 20 do 30 % mniej tokenów zużywanych na wszystkich zadaniach i nawet do 80 % większą efektywność w zadaniach wykorzystujących kontrolę komputera (computer use). Zyski te wynikają z lepszego zarządzania serwerami MCP, skills i computer use przez agentów. Deklarowanym celem jest umożliwienie użytkownikom delegowania bardziej ambitnych zadań, pozostając w budżecie tokenów.

🔗 Ogłoszenie na X

Wtyczki Google Workspace zintegrowane z edytorem

Cursor może teraz bezpośrednio czytać, pisać i działać w Google Workspace za pośrednictwem wtyczek dostępnych z poziomu strony „Customize” lub Cursor Marketplace, bez opuszczania edytora.

Usługa WorkspaceFunkcjonalności
Google DriveSzukanie, otwieranie i pobieranie plików, organizowanie folderów
GmailSzukanie i czytanie poczty, redagowanie i wysyłanie wiadomości
Google CalendarSprawdzanie kalendarzy, tworzenie wydarzeń, znajdowanie wolnych terminów
Google DocsOtwieranie, czytanie, redagowanie i modyfikowanie dokumentów
Google SheetsOdczytywanie zakresów, aktualizowanie komórek, tworzenie arkuszy
Google ChatDostęp do przestrzeni i wiadomości, wysyłanie wiadomości

Celem jest umożliwienie deweloperowi pobierania kontekstu z poczty lub kalendarza bezpośrednio z Cursor, bez wracania do przeglądarki.

🔗 Changelog Cursor


GitHub Agentic Workflows automatyzuje dokumentację cross-repo w Aspire

GitHub pokazuje konkretny przypadek użycia GitHub Agentic Workflows: zespół Aspire wykorzystuje je do automatycznego przekształcania scalonych funkcji w pull requesty dokumentacyjne rozproszone po wielu repozytoriach. System stosuje ograniczone uprawnienia (scoped permissions) i wymaga ludzkiego przeglądu przez eksperta dziedzinowego (SME review) przed scaleniem.

Śledzona metrykaWartość
Scalonych PR-ów dokumentacyjnych82 / 82
Mediana czasu scalania44,8 godziny

To doświadczenie ilustruje jeden z priorytetowych kierunków GitHub w obszarze workflow agentowych: trzymanie człowieka w pętli przy jednoczesnej automatyzacji powtarzalnych zadań związanych z utrzymaniem dokumentacji.

🔗 Ogłoszenie na X


GitHub publikuje swój Ship Log za lipiec 2026

GitHub publikuje swój miesięczny przegląd premier z lipca 2026, skupiony na temacie wyboru dla deweloperów.

Aplikacja desktopowa GitHub Copilot jest teraz dostępna we wszystkich planach, w tym Copilot Free i GitHub Education; deweloperzy bez subskrypcji mogą też używać własnego klucza dostawcy modelu (bring your own key). Selektor modeli Copilot zyskuje nowości: Kimi K2.7 Code staje się pierwszym wybieralnym w pickerze modelem z otwartymi wagami, rodzina OpenAI GPT-5.6 dołącza do Copilot z obniżkami cen o 80 % dla GPT-5.6 Luna i 20 % dla GPT-5.6 Terra, a Opus 5 od Anthropic przechodzi do ogólnej dostępności. GitHub Projects zyskuje ponadto ulepszone filtry i system tagów oparty na polach z wielokrotnym wyborem.

🔗 Podsumowanie na X


Sakana Namazu, API LLM dostosowane do rynku japońskiego

Sakana AI udostępniła online API Sakana Namazu, wersję swojego modelu Namazu w formie usługi, dotąd zarezerwowaną dla aplikacji Sakana Chat. Model opiera się na Kimi K2.6, modelu z otwartymi wagami od Moonshot AI, dostosowanym przez Sakana AI do języka japońskiego i zastosowań biznesowych.

API jest zgodne z formatem OpenAI: wystarczy zmienić bazowy URL i klucz API w istniejącym kodzie. Zawiera wbudowane narzędzia do wyszukiwania w sieci i wykonywania kodu, z możliwościami agentowymi pozwalającymi łączyć wiele kroków autonomicznie.

Sakana AI podkreśla trzy przypadki użycia: autonomiczne generowanie raportów z badań rynku, automatyzację obsługi klienta oraz kreatywną aplikację sterującą około 1 000 animowanych ryb na podstawie prostej komendy. W benchmarku FairPoliticsQA, poświęconym japońskiemu kontekstowi kulturowemu, wynik wzrósł z 34,10 % do 56,30 %.

🔗 Oficjalne ogłoszenie


MiniMax H3: wagi są już opublikowane

MiniMax ogłosił swój otwarty multimodalny model H3 31 lipca — już opisywany na tych łamach. 3 sierpnia wagi są faktycznie publikowane jako open weights, z deklarowanym wsparciem „Day-0” w całym łańcuchu inferencyjnym open source.

Narzędzie inferencyjneWsparcie Day-0
ComfyUINatywna integracja, jeden model i pięć workflow od premiery
vLLM-OmniWideo endpoint zgodny z API OpenAI
SGLang / LMSYSLokalne, konfigurowalne wsparcie, uruchamianie na sprzęcie NVIDIA i AMD
falGotowa do użycia infrastruktura produkcyjna

MiniMax przedstawia to wydanie jako przekroczenie etapu między ogłoszeniem a rzeczywistą dostępnością: wagi są otwarte, a wdrożenie produkcyjne również. Partner zewnętrzny Magnific zaprezentował ponadto demonstrację natywnej synchronizacji ruchu warg przez postać w jednej generacji.

🔗 Ogłoszenie na X


Runway uruchamia plan Max z 7 dniami nieograniczonego dostępu do Seedance 2.5

Runway ogłasza nowy próg subskrypcji, plan Max, z ofertą startową: zapisani użytkownicy otrzymują 7 dni nieograniczonego dostępu do modelu Seedance 2.5 od momentu jego dostępności na platformie.

Seedance 2.5, już wspominany w naszych poprzednich wydaniach, nie jest jeszcze dostępny w Runway („coming soon”): nowością dnia jest właśnie nowy plan i jego oferta wcześniejszego dostępu, a nie sam model.

🔗 Ogłoszenie na X


ElevenAgents: głosowa AI ElevenLabs na skalę enterprise

ElevenLabs przedstawia skalę i możliwości swojej platformy agentów głosowych i czatowych ElevenAgents.

“More than 10 million conversations run on ElevenAgents every week.”

🇵🇱 Ponad dziesięć milionów rozmów jest obsługiwanych co tydzień w ElevenAgents.@ElevenLabs na X

Każda rozmowa odpowiada rzeczywistej interakcji obsługiwanej przez głos lub agenta czatowego o naturalnym tonie: prośba o zwrot pieniędzy, umówienie spotkania, pytanie o świadczenia, zmiana lotu. Platforma oferuje symulację scenariuszy przed wdrożeniem, wielokanałowe uruchomienie oraz monitoring za pomocą narzędzia Spotlight, które śledzi rozmowy produkcyjne i proponuje proaktywne rekomendacje usprawnień. Po stronie enterprise ElevenLabs podkreśla konfigurowalne zabezpieczenia i opcje regionalnej rezydencji danych, dla klientów od startupów po rządy i firmy z listy Fortune 500.


Google i PSG: Gemini staje się oficjalnym asystentem AI klubu

Paris Saint-Germain i Google ogłosili podpisanie partnerstwa Premium obowiązującego do 2029 roku. W tym ramach Google Gemini staje się oficjalnym asystentem AI klubu, a Google Pixel oficjalnym smartfonem PSG.

Jest to umowa sponsoringowo-dystrybucyjna, bez szczegółów technicznych dotyczących ewentualnych funkcji lub integracji produktowych związanych z tym partnerstwem na ten dzień. Operacja wpisuje się w strategię Google polegającą na zwiększaniu masowej widoczności Gemini poza kręgiem użytkowników technicznie zaawansowanych, poprzez powiązanie go z jednym z najczęściej śledzonych klubów piłkarskich na świecie.

🔗 Ogłoszenie na X


Krótkie wiadomości

  • Vercel i v0 akceptują logowanie przez konto ChatGPT — na stronach logowania dodano przycisk „Continue with ChatGPT”, obok wtyczki Vercel, która jest teraz dostępna w ChatGPT. 🔗 Źródło
  • Replit ogłasza Designathon — tygodniowy konkurs projektowy, otwarty dla wszystkich twórców, z transmisją na żywo inauguracji 4 sierpnia o 9:00 (czasu pacyficznego) i nagrodami do zdobycia. 🔗 Źródło
  • Together AI porównuje koszt na zadanie Kimi K3 Max i Fable 5 xhigh — w benchmarku DeepSWE Kimi K3 Max zbliża się do wyników Fable 5 xhigh za około jedną trzecią kosztu na uruchomienie, czyli 2,8 razy więcej zadań rozwiązanych za wydanego dolara. 🔗 Źródło
  • Migracja z GitLab do GitHub Enterprise Cloud w ogólnej dostępności — rozszerzenie CLI gh gl2gh umożliwia teraz samoobsługową migrację repozytoriów z gitlab.com lub GitLab Self-Managed do GitHub Enterprise Cloud. 🔗 Źródło
  • Luma Ray 3.2 dostępny na zewnętrznej platformie Fuser — model wideo został zintegrowany z tym narzędziem do kadrowania, z obietnicą zachowania akcji sceny przy zmianie proporcji obrazu. 🔗 Źródło
  • NVIDIA NeMo Gym integruje Legal Agent Bench — ten benchmark agentów prawnych, opracowany wraz z Harvey, dołącza do otwartej biblioteki NeMo Gym, aby rozwijać modele open weights w złożonych zastosowaniach prawnych. 🔗 Źródło
  • Demonstracja NVIDIA agenta parkourowego wyuczonego w 30 sekund — symulacja miała nabyć eksperckie zachowanie na podstawie bardzo krótkiego referencyjnego fragmentu wideo, bez dodatkowych szczegółów technicznych. 🔗 Źródło
  • Poradnik Kimi Slides do tworzenia prezentacji — Moonshot AI publikuje pierwszy odcinek serii edukacyjnej o Kimi Slides, generowaniu prezentacji napędzanym przez Kimi K3, z wykresami i SmartArts. 🔗 Źródło

Co to oznacza

Wyścig o otwarte wagi trwa jednocześnie na kilku frontach. Qwen3.8-Max, mimo swoich 2,4 T parametrów, będzie otwarty już w przyszłym tygodniu; MiniMax H3 przechodzi od zapowiedzi do rzeczywistej dostępności z obsługą Day-0 na czterech różnych warstwach inferencji; a analiza kosztów i wydajności Together AI dotycząca Kimi K3 Max pokazuje, dlaczego te otwarte modele zyskują na znaczeniu: przy zbliżonej jakości kosztują ułamek ceny równoważnych modeli zamkniętych. Równowaga sił między modelami otwartymi i zamkniętymi coraz bardziej rozgrywa się na polu ekonomicznym, a nie wyłącznie na wyniku benchmarku.

Drugim kierunkiem jest platformizacja narzędzi deweloperskich w postaci programowalnych modułów. API v0 od Vercel, wzrost efektywności cloudowych agentów Cursor i integracja z Google Workspace, a także przypadek użycia udokumentowany przez GitHub w Aspire, wszystkie pokazują ten sam trend: dostawcy nie sprzedają już tylko interfejsu czatu, lecz sterowalny przez inne agenty łańcuch automatyzacji, z zabezpieczeniami — ograniczonymi uprawnieniami, recenzją człowieka — aby nadawał się do użycia w produkcji.

Z perspektywy konsumenckiej dwie zapowiedzi grają na zupełnie innym rejestrze: udostępnienie kodu GenOffice przez Genspark ma na celu demokratyzację kompletnego pakietu biurowego AI poprzez postawienie na darmowość i efekt społecznościowy, podczas gdy partnerstwo między Google a PSG wynika bardziej z logiki widoczności marki niż z innowacji technicznej — Gemini zyskuje ekspozycję wśród szerokiej publiczności, bez zapowiedzi jakiejkolwiek nowej funkcji.

Wreszcie, liczby podane przez ElevenLabs — ponad dziesięć milionów tygodniowych rozmów na ElevenAgents — oraz oferta startowa Runway wokół Seedance 2.5 potwierdzają, że generatywna AI do produkcji, głosowej i wideo, zadomawia się teraz na poziomie enterprise, z dedykowanymi narzędziami nadzoru zamiast samych demonstracji technologicznych.


Źródła