ai-powered-markdown-translatorPrzetłumaczony artykuł z fr na pl za pomocą gpt-5.4-mini.
19 sierpnia 2026 roku Anthropic publikuje badanie, w którym Claude autonomicznie projektuje białka wiążące określone cele biologiczne, zweryfikowane eksperymentalnie przez Adaptyv Bio i Twist Bioscience. Google uruchamia studencką ofertę na początek roku akademickiego z rokiem Google AI gratis i nowym student hub w aplikacji Gemini, a Replit otwiera Free Mode, nieograniczony dostęp do tworzenia oprogramowania napędzany przez GPT-5.6 Luna od OpenAI. Wokół tych najważniejszych ogłoszeń Cursor wzmacnia swoich agentów w chmurze, ElevenLabs upowszechnia swój model głosowy w czasie rzeczywistym, a siedemnaście innych nowości obejmuje rozwój oprogramowania, otwarte badania i platformy medialne.
Claude przyspiesza projektowanie białek, zweryfikowane przez Adaptyv Bio i Twist Bioscience
19 sierpnia — Anthropic publikuje wyniki eksperymentu badawczego testującego zdolność Claude do autonomicznego projektowania „minibinderów” — małych białek zdolnych do silnego wiązania się z celem biologicznym, co stanowi kluczowy etap rozwoju leków, zwykle wymagający od eksperta od kilku tygodni do kilku miesięcy pracy na jeden cel.
Za pośrednictwem Claude Science, z dostępem do wyspecjalizowanych modeli projektowych (Opus 4.8 i Mythos Preview), Claude z powodzeniem zaprojektował bindery przeciwko 14 z 15 testowanych celów białkowych, wychodząc od prostego promptu napisanego przez ludzkiego eksperta. Współczynnik sukcesu wyniósł od 22,6 % do 26,7 % w zależności od modelu w trybie wielocechowym, a w trybie jednokierunkowym sięgał 35,1 % — wobec typowego wyniku 10 do 15 % w obecnych kampaniach projektowych. Na celu RBX1 Claude osiągnął 40 % skuteczności wobec 3,7 % dla ludzkich uczestników referencyjnego konkursu.
Niezależnie od tego Claude Opus 5 przetworzył surowe pliki spektrometrii NMR i LC-MS bez oprogramowania własnościowego: 23 minuty na tabelę 18 precyzyjnych pików NMR z dokładnością ±0,08 jednostki oraz 19 minut na chromatogram LC-MS z obliczeniem czystości na poziomie 96,4 % wobec 96,33 % w laboratorium.
Anthropic przypomina, że binder o wysokim powinowactwie to dopiero pierwszy krok do leku i że te możliwości pozostają podwójnego zastosowania: projektowanie białek nie jest dostępne w otwartym dostępie w Claude Fable 5. Pełny raport techniczny został opublikowany jako open source na Hugging Face.
With a protein design prompt written by a human expert, Claude autonomously designed protein binders against 14 out of 15 targets. We then worked with Adaptyv Bio and Twist Bioscience, who independently built and tested the proteins Claude designed.
🇵🇱 Na podstawie promptu projektowego napisanego przez ludzkiego eksperta Claude autonomicznie zaprojektował bindery białkowe przeciwko 14 celom z 15. Następnie współpracowaliśmy z Adaptyv Bio i Twist Bioscience, które niezależnie zbudowały i przetestowały białka zaprojektowane przez Claude. — @AnthropicAI na X
🔗 Pełne badanie na anthropic.com
Gemini na początek roku akademickiego: student hub, study notebooks i rok Google AI gratis
19 sierpnia — Google uruchamia na początek roku akademickiego 2026 globalną ofertę studencką połączoną z nowym student hub w aplikacji Gemini.
| Region | Oferta | Zawartość planu |
|---|---|---|
| Stany Zjednoczone | 1 rok Google AI Pro gratis (wartość 19,99 $/mies.) | 4× limity użycia, Gemini Spark, integracja Gmail/Docs, 5 TB miejsca |
| 140+ krajów | 1 rok Google AI Plus gratis | Gemini Omni, podwojone limity, 400 GB miejsca |
Oferta jest przeznaczona dla kwalifikujących się studentów, wymaga ważnej karty płatniczej (automatyczne odnowienie po okresie darmowym), a okno zgłoszeń trwa do 31 grudnia 2026 r.
Student hub wprowadza kilka nowych funkcji: study notebooks, adaptacyjne środowisko nauki z testami diagnostycznymi, lekcjami tworzonymi na podstawie materiałów kursowych studenta i pulpitem postępu; interaktywne wizualizacje — symulacje 3D i dynamiczne wykresy generowane w czacie po poprzedzeniu promptu frazą „Show me…”; oraz Deep Research w Gemini Live, które pozwala uruchomić wieloetapowy raport badawczy głosem, zablokować telefon podczas działania wyszukiwania w tle, a następnie rozmawiać o wynikach ustnie.
Talk through research with Gemini Live. You can now kick off multi-step research reports with your voice: 1) Ask Gemini Live to Deep Research a complex topic 2) Lock your phone or switch tasks while it works in the background 3) Get notified when it’s done, then seamlessly talk through the findings hands-free.
🇵🇱 Rozmawiaj o swoich badaniach z Gemini Live. Teraz możesz uruchamiać wieloetapowe raporty badawcze głosem: 1) Poproś Gemini Live o wykonanie Deep Research na złożony temat 2) Zablokuj telefon albo przełącz się na inne zadanie, podczas gdy wszystko działa w tle 3) Otrzymaj powiadomienie po zakończeniu, a następnie rozmawiaj ustnie o wynikach w trybie bez użycia rąk. — @GeminiApp na X
Replit uruchamia Free Mode, napędzany przez GPT-5.6 Luna od OpenAI
18-19 sierpnia — Replit uruchamia Free Mode, darmowy i nieograniczony dostęp do codziennych zadań związanych z tworzeniem oprogramowania, napędzany przez GPT-5.6 Luna od OpenAI. Ogłoszenie zostało przedstawione ekskluzywnie w Fortune jako efekt wzmocnionego partnerstwa między obiema firmami, z zapowiedzią kolejnych wspólnych produktów.
| Tryb | Użycie |
|---|---|
| Free Mode | Nieograniczone codzienne zadania, brak zużycia kredytów (GPT-5.6 Luna) |
| Power Mode | Modele zoptymalizowane pod kątem kosztu/szybkości do regularnego użytku |
| Max Mode | Modele wysokiej wydajności do złożonych buildów |
Według Replit Free Mode pozwala „tworzyć nawet 30 razy więcej” w ramach tej samej subskrypcji, z do 30 godzinami czatu wliczonymi miesięcznie i resetem limitów co 5 godzin. Gdy zadanie wymaga większego rozumowania, Replit może przełączyć na GPT-5.6 Sol, a następnie wrócić do Free Mode z zachowaniem kontekstu projektu. Free Mode jest wliczony w plany Core (20 $/mies.) i Pro, a umożliwiły go — według Amjada Masada (CEO Replit) — niedawne obniżki cen OpenAI dla serii GPT-5.6.
Dla Replit to bezpośrednia odpowiedź na znany punkt tarcia w „vibe coding”: nieprzewidywalny koszt kredytów użycia, który hamuje eksperymentowanie. Dla OpenAI to kolejna wizytówka GPT-5.6 Luna, pozycjonowanego jako ekonomiczny model do zastosowań na dużą skalę, a nie model graniczny.
If we can get to a world where anyone with access to the internet can build a product, build a startup, and just kind of get started and get going, I think we’re going to see another renaissance-level entrepreneurial boom like we’ve never seen before.
🇵🇱 Jeśli uda nam się osiągnąć świat, w którym każdy mający dostęp do internetu może zbudować produkt, założyć startup i po prostu zacząć działać, myślę, że będziemy świadkami renesansowego rozkwitu przedsiębiorczości, jakiego jeszcze nigdy nie widzieliśmy. — Sam Altman, CEO OpenAI, cytowany przez OpenAI
Cursor wzmacnia swoich agentów w chmurze dzięki /goal, odizolowanym subagentom i Custom Modes
19 sierpnia — Cursor publikuje zestaw funkcji, które popychają jego agentów w chmurze w stronę większej autonomii, z wyraźnym celem działania „jak system”, a nie jak narzędzia wymagające ponownego uruchamiania przy każdej iteracji.
/goal: daje agentowi trwały cel, nad którym ma pracować aż do pełnego zakończenia (/goal fix all flaky tests and make CI green), bez zatrzymywania się na pierwszej próbie.- Automatyczne subskrypcje: agenci w chmurze monitorują teraz pull requesty, wątki Slack i zaplanowane zadania, a także automatycznie subskrybują PR-y, które tworzą, aby doprowadzić je do końca (naprawy CI, uwzględnianie uwag botów).
- Subagenci na izolowanych maszynach: każdy subagent może działać na własnej maszynie wirtualnej z odizolowaną kopią projektu, co jest przydatne do testowania zmian w nowym środowisku lub równoległego naprawiania błędów bez konfliktów.
- Custom Modes: dowolny skill można przypiąć jako zawsze aktywny tryb w czacie, dostępny przez ⌥⏎ (Mac) lub Alt+Enter (Windows).
- Ulepszone steering: wiadomość wysłana, gdy agent pracuje, nie przerywa już bieżącego działania — trafia do kolejki i jest uwzględniana przy następnym wywołaniu narzędzia.
Ta aktualizacja kontynuuje strategię Cursor (Origin, agenci w chmurze) zmierzającą do przekształcenia edytora w platformę orkiestracji autonomicznych agentów, a nie tylko w prostego asystenta interaktywnego.
ElevenLabs uruchamia Eleven v3 Conversational w dostępności ogólnej
19 sierpnia — ElevenLabs ogłasza dostępność ogólną Eleven v3 Conversational, swojego najbardziej ekspresyjnego modelu do głosu w czasie rzeczywistym, teraz dostępnego w ElevenAgents i ElevenAPI.
| Cecha | Szczegóły |
|---|---|
| Biblioteka głosów | ponad 11 000 głosów |
| Obsługiwane języki | ponad 70 języków |
| Cena początkowa | 0,05 $ za 1 000 znaków (malejąca) |
Model został zoptymalizowany specjalnie do użycia w czasie rzeczywistym, z konsekwentną jakością w generacjach streamingowych. Wprowadza audio tags zapewniające precyzyjną kontrolę nad emocjami i tonem: głosy można kierować tak, by się śmiały, szeptały, przyjmowały sarkastyczny ton lub wyrażały ciekawość. Szczególnie podkreślana jest wydajność w języku niemieckim, hiszpańskim, francuskim, portugalskim i hindi.
To wydanie wzmacnia pozycję ElevenLabs w obszarze konwersacyjnego głosu w czasie rzeczywistym, gdzie opóźnienie i ekspresyjność są kluczowymi wyróżnikami na tle modeli konkurencyjnych. Zespół ElevenLabs Devs opublikował pełny walkthrough, aby pomóc deweloperom w integracji modelu.
Claude może teraz wysyłać maile Gmail i zarządzać Google Drive
18 sierpnia — Claude może teraz działać bezpośrednio w Gmail i Google Drive: pisać i wysyłać odpowiedź w wątku dyskusji albo zarządzać plikami w Drive, bez konieczności ręcznego kopiowania i wklejania treści przez użytkownika. Funkcja działa przez menu connectorów, gdzie wystarczy połączyć konto Gmail lub Google Drive, aby ją aktywować.
Anthropic podkreśla kontrolę użytkownika: to użytkownik decyduje, kiedy wymagana jest ręczna akceptacja przed wysłaniem przez Claude maila lub modyfikacją pliku. Funkcja jest już dostępna na wszystkich płatnych planach, co stanowi istotne rozszerzenie zakresu agentowego Claude.ai poza sam czat, w kontynuacji wcześniej oferowanych connectorów (Slack, GitHub).
Narzędzia do kodu: zdalny MCP w Amp, Zed 1.16 i Devin w GE Aerospace
Trzy edytory i agenci kodu publikują 19 sierpnia istotne aktualizacje.
Amp łączy zdalne serwery MCP z orbami, TUI i Puck
19 sierpnia — Amp (Sourcegraph) dodaje obsługę zdalnych serwerów MCP we wszystkich swoich interfejsach: orbach (maszyny w chmurze dla agentów), lokalnym TUI i asystencie głosowym Puck. Konfiguracja odbywa się z poziomu ampcode.com/settings/mcp-servers, z uwierzytelnianiem OAuth lub Bearer token, w konfiguracji osobistej lub na poziomie workspace. MCP Apps, Resources i Prompts nie są jednak jeszcze wspierane — na razie obsługiwane są tylko klasyczne narzędzia MCP. Ta funkcja domyka strategię „orbów” Amp rozpoczętą w połowie sierpnia.
Amp pozwala zaprosić zespół do współpracy w orbie
19 sierpnia — Amp dodaje możliwość zapraszania współpracowników do orba poprzez oznaczenie ich za pomocą @. Po otagowaniu dana osoba może przejrzeć wątek, przejąć kontrolę („drive”) i wymieniać wiadomości bezpośrednio w rozmowie z agentem. Ogłoszenie pokazuje kilka konkretnych zastosowań: poproszenie o asset projektowy, zlecenie code review diffa albo podjęcie decyzji o wdrożeniu. To logiczna ewolucja modelu „orbów” Amp: te chmurowe maszyny dedykowane agentowi stają się wspólną przestrzenią roboczą, a nie izolowanym narzędziem na komputerze jednego dewelopera.
Zed v1.16: zwijany Git Panel, nazwane stashe i Gemini 3.6 Flash
19 sierpnia — Zed publikuje wersję 1.16 swojego edytora. Git Panel zyskuje zwijane sekcje zmian, komenda git: stash all pozwala nadać nazwę stashowi, a ustawienie gutter.git_gutter_width dopasowuje szerokość wskaźników diffu. W Markdown Preview i Agent Panel diagramy Mermaid obsługują teraz zoom i poziome przewijanie. Po stronie modeli Gemini 3.6 Flash dołącza do modeli Google AI dostępnych w Zed, obok nowych modeli OpenCode Zen i OpenCode Go. To klasyczna aktualizacja utrzymaniowa, podczas gdy Zed nadal rozwija swoją główną funkcję, wciąż w prywatnej becie: Delta.
Cognition przedstawia GE Aerospace jako klienta Devin
17 sierpnia — Cognition (Devin) publikuje testimonial klienta, w którym wyróżnia GE Aerospace, używające Devin do przyspieszenia tworzenia oprogramowania wbudowanego związanego z silnikami lotniczymi. Według Cognition jeden zespół miał niemal podwoić swoją wydajność inżynieryjną dzięki narzędziu; omawiane oprogramowanie optymalizuje trasy lotu, zmniejsza zużycie paliwa i monitoruje anomalie silnika. Żaden szczegółowy artykuł nie towarzyszy temu ogłoszeniu (brak bloga lub pełnego case study): to jednorazowa komunikacja na X, którą należy tak właśnie traktować — jako marketingowy wskaźnik, publicznie nierozpisany na tym etapie.
Liquid AI publikuje checkpointy LFM2.5 Q4_0 dzięki distillation quantization-aware (QAD)
19 sierpnia — Liquid AI publikuje na Hugging Face skwantyzowane checkpointy GGUF w Q4_0 dla czterech rozmiarów LFM2.5 (230M, 350M, 1,2B-Instruct i 2,6B), uzyskane dzięki distillation quantization-aware (QAD): model nauczycielski o wysokiej precyzji jest destylowany bezpośrednio do skwantyzowanego modelu ucznia, zamiast stosować kwantyzację dopiero po fakcie.
Ogłoszony rezultat: checkpointy odzyskują 97 % średniej dokładności utraconej przez klasyczną kwantyzację, na benchmarkach obejmujących GPQA Diamond, MMLU-Pro i IFEval. Testowane na MacBook Pro, NucBox EVO-X2, Samsung Galaxy S26 Ultra i Raspberry Pi 5, warianty 230M/350M dorównują jakości Q5_K_M przy przepustowości wyższej o 4 do 33 %. Wszystkie cztery warianty są już dostępne i można je wdrożyć przez llama.cpp.
Gemini: Chrome na Androidzie w Stanach Zjednoczonych, Waymo integruje asystenta
Google rozszerza Gemini na dwa nowe punkty kontaktu poza główną aplikacją.
Gemini w Chrome jest już dostępne na Androidzie w Stanach Zjednoczonych
18 sierpnia — Gemini in Chrome, asystent AI zintegrowany z przeglądarką, trafia do użytkowników Androida w Stanach Zjednoczonych. Podstawowe funkcje (podsumowanie długich stron, łączenie z aplikacjami Google, generowanie obrazów w przeglądarce) są dostępne dla wszystkich użytkowników Androida w USA. Subskrybenci Google AI Pro i Ultra otrzymują dodatkowo funkcję auto browse, zdolną wykonywać powtarzalne zadania, takie jak rezerwacja miejsca parkingowego czy aktualizacja zamówienia online.
Waymo integruje Gemini w swoich pojazdach Ojai
19 sierpnia — Waymo integruje Gemini jako pokładowego asystenta AI w swoich autonomicznych pojazdach Ojai. Pasażerowie mogą korzystać ze sterowania głosowego, aby wchodzić w interakcję z kabiną (na przykład regulować klimatyzację), odkrywać pobliskie miejsca lub uzyskiwać informacje kontekstowe o swojej podróży. Integracja działa niezależnie od systemu jazdy Waymo Driver: Gemini pozostaje nieaktywny, dopóki pasażer nie uruchomi go dobrowolnie za pomocą dedykowanej ikony, co zachowuje rozdział między asystentem konwersacyjnym a stosem jazdy autonomicznej. W komunikacie nie podano ani daty wdrożenia, ani miast objętych rozwiązaniem.
GitHub: trendy jakości kodu i zarządzanie sesjami Copilot
Dwie aktualizacje dotyczą zarządzania i śledzenia pracy zespołów.
Organizacyjny dashboard Code Quality dodaje kartę Trends
19 sierpnia — Organizacyjny dashboard Code Quality w GitHubie zyskuje kartę Trends. Dotychczas ograniczony do statycznego zrzutu findings ze wszystkich repozytoriów organizacji, teraz dodaje wykres trendu dla 7, 14 lub 30 dni, grupowany według health score lub severity. Dwie tabele uzupełniają wykres, klasyfikując repozytoria według zmiany liczby otwartych findings. Funkcja jest ogólnie dostępna w GitHub Enterprise Cloud i GitHub Team z włączonym Code Quality, ale nie w GitHub Enterprise Server.
Aplikacja GitHub Copilot opisuje panel My work do zarządzania sesjami
19 sierpnia — GitHub publikuje przewodnik opisujący panel My work w aplikacji GitHub Copilot, centralnym hubie do śledzenia pull requests i issues powiązanych z sesjami Copilot. Oferuje on cztery domyślne widoki (All, Active, Review requests, Done) oraz widoki niestandardowe poprzez składnię filtrów GitHub lub kreator interfejsu. Dostępne są dwa tryby wyświetlania — lista w stylu kart lub tabela z konfigurowalnymi kolumnami — a nową sesję Copilot można uruchomić bezpośrednio z wybranego issue lub PR, także zbiorczo.
Generowanie mediów: SkillEvaluator, destylacja wideo i nieograniczony dostęp na Runway
Trzy nowości dotyczą odpowiednio ewaluacji agentów, badań nad generowaniem wideo i dostępu do modeli.
NVIDIA publikuje SkillEvaluator, narzędzie open source do mierzenia wpływu skills agentów
19 sierpnia — NVIDIA publikuje SkillEvaluator, narzędzie open source, które mierzy rzeczywisty wpływ skills agentów AI. Zespół ocenił ponad 300 zweryfikowanych przez NVIDIA skills na 30+ produktach, porównując wyniki tego samego agenta, przy tym samym zadaniu, z zainstalowanym i niezainstalowanym skill. Wyniki zmierzono w pięciu wymiarach: poprawność +41 punktów (46→87), discoverability +40, efektywność +39, wydajność +35, bezpieczeństwo +1 — średnio +31 punktów we wszystkich wymiarach łącznie. NVIDIA podkreśla, że domena skill ma znacznie większe znaczenie niż wybór harnessu agenta (wahania od +2 do +46 punktów w zależności od produktu, wobec około 5 punktów w zależności od harnessu).
Context-Matched Distillation (CMD): szybkie i sterowalne autoregresywne generowanie wideo
14 sierpnia — Badacz (Hmrishav Bandyopadhyay), cytowany przez NVIDIA AI, przedstawia Context-Matched Distillation (CMD), framework szybkiego i sterowalnego autoregresywnego generowania wideo. Metoda dopasowuje ocenę modelu nauczyciela do kontekstu generacji modelu ucznia dzięki Prefix Scoring: teacher causal ocenia każdy cel bez dostępu do przyszłych klatek, w przeciwieństwie do klasycznych podejść dwukierunkowych. CMD umożliwia generowanie klatka po klatce lub blokami, z interaktywną kontrolą trajektorii kamery w każdej klatce oraz wydajną inferencją w niewielu krokach, odpowiednią do zastosowań czasu rzeczywistego.
MiniMax H3 przechodzi na nieograniczone generowanie na Runway (oferta ograniczona)
19 sierpnia — Runway ogłasza, że model wideo MiniMax H3 przechodzi na nieograniczone generowanie dla użytkowników planu Max, na ograniczony czas: bez limitu i bez zliczania generacji z tym modelem. MiniMax_AI przekazał z kolei to samo ogłoszenie po swojej stronie, potwierdzając wspólną ofertę między dwiema platformami. Nie jest uruchamiany żaden nowy model: chodzi o tymczasową zmianę warunków korzystania z już dostępnego modelu, mającą na celu zwiększenie adopcji MiniMax H3 na Runway.
GLM-5.3: API online i podsumowanie benchmarków
18 sierpnia — API GLM-5.3 (Z.ai) jest już online, dostępne przez oficjalne API i bramki partnerów, w tej samej cenie co GLM-5.2. Artificial Analysis publikuje szczegółowe podsumowanie liczbowe:
| Metryka | GLM-5.2 | GLM-5.3 |
|---|---|---|
| AA Intelligence Index | 53 | 60 |
| GDPval-AA v2 (Elo, agentowe) | 1524 | 1770 |
| Koszt na zadanie | 0,44 $ | 0,68 $ |
Model zachowuje tę samą architekturę (753 miliardy parametrów, 40 miliardów aktywnych w MoE), okno kontekstu 1 miliona tokenów, licencję MIT oraz stawkę 1,40 $/milion tokenów wejściowych i 4,40 $/milion wyjściowych. Przy koszcie 0,68 $ za zadanie, GLM-5.3 pozostaje o 19 % tańszy niż Kimi K3 i o 45 % tańszy niż GPT-5.6 Sol. W Terminal-Bench 3.0 model skacze z 4,6 % do 32,4 %. Otwartych wag można się spodziewać „w ciągu tygodnia” według Z.ai.
OpenAI: wzmocniona prywatność API i rozszerzenie reklamowe w Europie
Dwa ogłoszenia OpenAI z 19 sierpnia dotyczą odpowiednio prywatności danych firmowych i rozszerzenia programu reklamowego.
OpenAI wznawia Zero Data Retention i zapowiada Private Safety Processing
19 sierpnia — OpenAI potwierdza swoje zobowiązanie do Zero Data Retention (ZDR) dla kwalifikujących się klientów API: prompty i odpowiedzi modeli nie są przechowywane po przetworzeniu, a treść nie jest dostępna dla personelu OpenAI. Firma prezentuje także Private Safety Processing, zaprojektowane do wykrywania wzorców nadużyć w wielu powiązanych interakcjach (złośliwe intencje, powtarzalne testowanie zabezpieczeń) bez dawania personelowi OpenAI dostępu do treści źródłowej — niezależnie od tego, czy treść ta pozostaje na infrastrukturze klienta, czy jest przechowywana zaszyfrowana z kluczami kontrolowanymi przez klienta. Zautomatyzowane systemy identyfikują potencjalne nadużycia i zwracają ograniczone sygnały bezpieczeństwa.
ChatGPT Ads rozszerza się na 31 europejskich rynków
19 sierpnia — OpenAI ogłasza rozszerzenie ChatGPT Ads na 31 krajów europejskich w następnym tygodniu (m.in. Niemcy, Francję, Hiszpanię, Włochy, Szwecję, Norwegię, Danię, Holandię, Austrię) — największą jak dotąd ekspansję programu reklamowego, uruchomionego pilotażowo w USA w lutym. Reklamy będą pokazywane wyłącznie użytkownikom planów Free i Go — subskrypcje Plus, Pro i Enterprise pozostają bez reklam. OpenAI rozszerzyło targetowanie poza CPM/CPC o optymalizację konwersji, z geotargetowaniem, niestandardowymi odbiorcami i pomiarem przez OpenAI Pixel.
DeepSeek V4 Pro dostępny w Perplexity Computer, hostowany w USA
18 sierpnia — Perplexity dodaje DeepSeek V4 Pro do Perplexity Computer, z hostingiem zlokalizowanym w USA — to ważne dla klientów dbających o lokalizację danych, zamiast hostingu u DeepSeek w Chinach. Zespół podaje, że ocenił model na swoim wewnętrznym benchmarku WANDR, gdzie uzyskuje wynik 0,359 przy koszcie 0,75 $ za zadanie, czyli 62 % taniej niż kolejny model na granicy koszt-wydajność. Ogłoszenie wpisuje się w szersze wdrożenie DeepSeek V4 Pro obserwowane u innych dostawców (Together AI, Novita), z własną, liczbową informacją właściwą ekosystemowi Perplexity.
Krótkie informacje
- Claude Desktop uruchamia się około dwa razy szybciej — poprawka throttlingu w tle usuwa spowolnienie przy starcie wykryte miesiąc temu. 🔗 Tweet
- GPT-5.6 Sol -70 % w Devin Desktop i Devin CLI do 3 października — promocja Cognition na model uznawany za mocny w benchmarku FrontierCode 1.1. 🔗 Tweet
- Replit przygotowuje nowe narzędzia ładu korporacyjnego — pełne dzienniki audytu, ustawienia przestrzeni roboczej dla przedsiębiorstw i API administracyjne na dużą skalę, bez podanej daty dostępności. 🔗 Tweet
- DeepSeek V4 Flash podsumowuje 1000 prac badawczych za 4 USD — zewnętrzny deweloper streścił i zwizualizował najlepsze prace roku za łączny koszt 4 $. 🔗 Tweet
- Higgsfield AI staje się klientem Together AI do inferencji wideo — platforma stojąca za Cinema Studio, świeżo po rundzie 400 M$, uruchamia swoje modele wideo na Dedicated Container Inference. 🔗 Tweet
- Cztery interaktywne doświadczenia BTS w aplikacji Gemini — quiz muzyczny, śledzenie trasy i nauka koreańskiego, dostępne przez kod 7777. 🔗 Ogłoszenie Google
- Zarządzane ustawienia firmowe dla GitHub Copilot w JetBrains — governance wtyczek, lista dozwolonych serwerów MCP, konfiguracja OpenTelemetry i kontrola trybów uprawnień. 🔗 Dziennik zmian
- Cofanie i dezautoryzacja credentiali według typu tokenu — GitHub pozwala wskazać PAT, klucze SSH, tokeny OAuth lub GitHub App podczas incydentu bezpieczeństwa. 🔗 Dziennik zmian
- HeyGen uruchamia upscale 4K dla filmów z ogłoszeń nieruchomości — zamiana rozmazanego wideo w 4K bez nowego nagrania. 🔗 Tweet
- HeyGen automatycznie tłumaczy filmy z wiadomości o nieruchomościach — ponad 175 języków, by dotrzeć do kupujących nieanglojęzycznych. 🔗 Tweet
- Synthesia promuje tworzenie osobistych lookalikes — cyfrowy avatar wygenerowany na podstawie własnej twarzy, dostępny dla każdego użytkownika w kilka minut. 🔗 Tweet
- Suno usprawnia zarządzanie playlistami w web i mobile — shuffle, zmiana kolejności utworów i filtrowanie playlist, mobile wkrótce. 🔗 Tweet
- Kimi K3 dostępny przez Ollama Cloud, zintegrowany z Claude Code i OpenCode — można wdrażać bezpośrednio za pomocą
ollama launch claude --model kimi-k3:cloud. 🔗 Tweet - Problem techniczny z Advanced Account Security powoduje utratę dostępu do Daybreak Blue u części użytkowników — dotknięte konta muszą przejść ponowną weryfikację przed terminem 1 września. 🔗 Tweet
- Jak NVIDIA podnosi kompetencje swoich zespołów za pomocą ChatGPT Work — zespoły GTM i solution architecture oszczędzają do 16 godzin tygodniowo na zautomatyzowanych workflowach. 🔗 Studium przypadku OpenAI
Co to oznacza
Duże modele zaczynają dawać wyniki mierzone w laboratorium, a nie wyłącznie w benchmarkach. Eksperyment Anthropic dotyczący projektowania białek zmienia charakter: Claude nie generuje już tylko prawdopodobnego tekstu, jego protein binders zostały zbudowane i przetestowane niezależnie przez Adaptyv Bio i Twist Bioscience, z wskaźnikiem sukcesu wyższym niż standardy branżowe. W innym rejestrze SkillEvaluator od NVIDIA stosuje tę samą logikę kontrolowanego testu do skills agentów kodujących — to samo zadanie, ten sam model, jedyną zmienną jest zainstalowany skill — i obiektywizuje zyski sięgające +41 punktów. Te dwa ogłoszenia łączy wspólna zasada: mierzyć rzeczywisty wkład możliwości AI zamiast zakładać jego wartość.
Infrastruktura agentowa w development software gęstnieje wokół długotrwałej autonomii. Cursor wprowadza trwały cel (/goal) i subagenty na odizolowanych maszynach, Amp otwiera swoje orbs na zdalne serwery MCP i współpracę zespołową, a Zed kontynuuje pracę w tle, podczas gdy jego główna funkcja Delta pozostaje w prywatnej becie. Devin z kolei umacnia się w lotnictwie dzięki GE Aerospace. Te aktualizacje zbliżają się do wspólnego celu: sprawić, by agenci działały jak ciągły system, a nie narzędzie uruchamiane od nowa przy każdej iteracji. Replit posuwa tę logikę aż do kwestii dostępu: Free Mode, napędzany przez GPT-5.6 Luna, sprawia, że tworzenie oprogramowania jest darmowe dla codziennych zadań, a decyzję tę umożliwia ciągły spadek kosztu inferencji modeli frontierowych.
Ład danych i dostępów staje się pełnoprawnym argumentem sprzedażowym. OpenAI zapowiada Private Safety Processing, aby wykrywać nadużycia bez ujawniania treści klienta, uzupełniając zobowiązanie Zero Data Retention. GitHub z kolei pozwala teraz cofać credentiale według typu tokenu podczas incydentu, dodaje zarządzane ustawienia firmowe dla Copilot w JetBrains i wzbogaca organizacyjny dashboard Code Quality o widok Trends obejmujący kilka tygodni. W trzech przypadkach stawką jest coś więcej niż pojedyncza funkcja: chodzi o danie zespołom bezpieczeństwa i zgodności narzędzi precyzyjnej kontroli, co coraz częściej jest warunkiem adopcji AI w przedsiębiorstwach.
Relacja koszt-wydajność nadal kształtuje konkurencję między modelami. GLM-5.3 od Z.ai dogania Kimi K3 w Intelligence Index Artificial Analysis, pozostając jednocześnie tańszym na zadanie niż GPT-5.6 Sol, w oczekiwaniu na publikację otwartych wag. DeepSeek V4 Pro trafia do Perplexity z amerykańskim hostingiem i wynikiem koszt-wydajność o 62 % lepszym niż kolejny model na granicy. Liquid AI z kolei optymalizuje niski segment: jego checkpointy LFM2.5 skwantyzowane przez distillation quantization-aware odzyskują 97 % precyzji utraconej przy klasycznej kwantyzacji, aby działać na Raspberry Pi 5. A Kimi K3 trafia do chmury Ollama, bezpośrednio używalnej z Claude Code — znak, że przenośność między narzędziami liczy się dziś równie mocno jak sam model.
Źródła
- Anthropic — Claude przyspiesza projektowanie białek
- Tweet @AnthropicAI
- Tweet @claudeai — Gmail i Google Drive
- Tweet @ClaudeDevs — start x2
- Cursor — changelog z 19 sierpnia
- Replit — Tryb darmowy
- OpenAI — Replit
- Amp — MCP w orbach
- Amp — współpraca w orbie
- Tweet @zeddotdev — Zed v1.16
- Tweet @cognition — GE Aerospace
- Tweet @devindesktop — promocja GPT-5.6 Sol
- Tweet @Replit — ład korporacyjny
- Hugging Face — LFM2.5 QAD
- Tweet @nutlope — DeepSeek V4 Flash
- Tweet @togethercompute — Higgsfield AI
- Google — oferta studencka Gemini
- Tweet @GeminiApp — Deep Research w Gemini Live
- Tweet @googlechrome — Gemini w Chrome na Androidzie
- Google — Gemini w Waymo
- Google — interaktywne doświadczenia BTS
- GitHub Changelog — trendy jakości kodu
- GitHub Blog — panel Moja praca
- GitHub Changelog — zarządzane ustawienia JetBrains
- GitHub Changelog — unieważnianie poświadczeń
- Tweet @ElevenLabs — Eleven v3 Conversational
- Tweet @NVIDIAAI — SkillEvaluator
- Tweet @hmrishavbandy — distylacja dopasowana do kontekstu
- Tweet @runwayml — nieograniczony MiniMax H3
- Tweet @HeyGen — upscale 4K
- Tweet @HeyGen — tłumaczenie filmów nieruchomościowych
- Tweet @synthesiaIO — sobowtóry
- Tweet @suno — playlisty
- Tweet @ArtificialAnlys — podsumowanie GLM-5.3
- Tweet @ollama — Kimi K3 na Ollama Cloud
- OpenAI — Zero Data Retention i Private Safety Processing
- OpenAI — reklamy ChatGPT w Europie
- Tweet @OpenAIDevs — Daybreak Blue
- OpenAI — studium przypadku NVIDIA ChatGPT Work
- Tweet @perplexity_ai — DeepSeek V4 Pro