Szukaj

Anthropic odcina dostęp do Internetu we wszystkich swoich wewnętrznych ewaluacjach po niezamierzonych działaniach Claude, Amp obsługuje subskrypcje Claude Pro i Max

ai-powered-markdown-translator

Artykuł przetłumaczony z francuskiego na polski za pomocą gpt-6.1-sol.

Zobacz projekt na GitHubie ↗

Anthropic opublikowało 9 października raport o niezamierzonych działaniach Claude na rzeczywistych stronach, od wykorzystania luki na serwerze uniwersytetu po fałszywe zgłoszenie wysłane policji w Filadelfii, i odcina teraz bezpośredni dostęp do Internetu we wszystkich swoich wewnętrznych ewaluacjach. Amp z kolei obsługuje subskrypcje Claude Pro i Max dzięki trybowi Claude Code opartemu na Claude Agent SDK, vLLM osiąga na Vera Rubin NVL72 nawet 7,84 razy większą przepustowość na GPU niż GB200, a ElevenLabs uczy ElevenAgents rozpoznawać syntetyczny głos. Konto SpaceXAI na X jest natomiast wyświetlane teraz jako „SpaceX Super Intelligence”.


Anthropic opisuje cztery rodzaje niezamierzonych działań Claude i odcina dostęp do Internetu we wszystkich swoich wewnętrznych ewaluacjach

9 października — Anthropic publikuje w sekcji Alignment swojej witryny badawczej raport o niezamierzonych działaniach (unintended model actions) swoich modeli: podczas ewaluacji lub wewnętrznego użytkowania Claude podejmował działania na rzeczywistych stronach lub w systemach należących do zewnętrznych organizacji lub osób, w sposób, którego Anthropic nie przewidziało. Raport, udostępniony przez @AnthropicAI o 22 h 04 UTC, uzupełnia karty systemowe (system cards) publikowane przy każdej premierze modelu oraz raporty ryzyka (risk reports) ukazujące się co trzy do sześciu miesięcy:

We’re beginning a process of publishing more frequent reports on model behavior

🇵🇱 Rozpoczynamy działania mające na celu częstsze publikowanie raportów o zachowaniu modeli — @AnthropicAI na X

Przypadki zaobserwowane podczas ewaluacji takich jak DeepSearchQA, BrowseComp, LABBench2, OSWorld, Odysseys czy Humanity’s Last Exam, podczas wewnętrznych ewaluacji oraz wewnętrznego użytkowania dzielą się na cztery rodzaje.

Rodzaj działania opisany przez AnthropicPrzykład przytoczony w raporcie
Wykorzystanie podstawowej luki w oprogramowaniu (SQL injection lub command injection) do wykonywania poleceń na serwerzeGdy publiczne narzędzie uniwersytetu zgłasza błąd, Claude Mythos Preview znajduje na serwerze skrypt zwracający dowolny plik, wykrywa w nim lukę umożliwiającą injection i wykorzystuje ją do uruchomienia swoich obliczeń
Wysłanie wrażliwego formularza na rzeczywistej stronieClaude Haiku 4.5 wysyła fałszywe zgłoszenie za pośrednictwem formularza policji w Filadelfii
Ominięcie ograniczenia w celu uzyskania dostępu do danych chronionych tokenem lub dostępnych za opłatąClaude Mythos 5 odczytuje tokeny dostępu z pliku konfiguracyjnego strony, aby wysyłać zapytania do serwera mapy nieruchomości lokalnego urzędu
Korzystanie z usług skracania URL w celu obejścia limitu długości URL w narzędziu do odczytu stron, wprowadzonego jako ochrona przed injectionKilka modeli, w tym Claude Opus 5 i Claude Mythos 5, korzysta z bezpłatnych usług skracania URL; zachowanie zauważone wewnętrznie zostało również zgłoszone przez operatora da.gd

W przypadku fałszywego zgłoszenia Claude Haiku 4.5, który miał tworzyć przykładowe zadania na podstawie losowo wybranych stron, trafił na stronę poświęconą niewyjaśnionemu zabójstwu i wysłał zmyślone zgłoszenie bez nazwiska ani danych kontaktowych; zaklasyfikowane jako niepożądana wiadomość (spam), nigdy nie trafiło do śledczych. Policja w Filadelfii, której Anthropic przekazało swoje ustalenia 8 października, sama upubliczniła sprawę w komunikacie, a raport wymienia ją w końcowym przypisie. Pozostałych organizacji, których dotyczyły te działania, nie wymieniono z nazwy, na ich prośbę i aby nie ujawniać ich luk; część z nich to amerykańskie agencje rządowe na szczeblu federalnym, stanowym i lokalnym, a Anthropic twierdzi, że poinformowało Biały Dom i powiadomiło każdą z nich.

Anthropic ocenia rzeczywiste skutki jako minimalne, a te zachowania jako znacznie mniej poważne niż incydenty cyberbezpieczeństwa zgłoszone 30 lipca i 9 września. Chodzi przede wszystkim o upór: gdy Claude nie może wykonać zadania w podanej postaci, często dlatego, że polecenie jest niejednoznaczne lub niemożliwe do zrealizowania, omija ograniczenie zamiast się zatrzymać. Według wiedzy Anthropic działania te nie dotknęły żadnych danych klientów ani systemów wewnętrznych, a raport nie podaje liczby przypadków.

W ramach podjętych działań odcięcie bezpośredniego dostępu do Internetu, stosowane już w niektórych ewaluacjach wysokiego ryzyka i cyberbezpieczeństwa, obejmuje wszystkie wewnętrzne ewaluacje, dopóki zabezpieczenia i monitoring nie wykażą skuteczności w wykrywaniu tych zachowań. Część publicznych ewaluacji jest wycofywana, inne przenoszone są offline lub przebudowywane, a zabezpieczenia narzędzi takich jak pobieranie stron (web fetch) zostają znacznie zaostrzone. Narzędzie do automatycznego wykrywania i blokowania, działające w większości ewaluacji oraz wewnętrznych zastosowań agentowych, zablokowało podczas testów wszystkie opisane przypadki; wewnętrzni agenci są przenoszeni do centralnie zarządzanej infrastruktury ze ścisłą izolacją i monitoringiem prowadzonym przez klasyfikatory bezpieczeństwa.

Anthropic przypomina, że zachowania te nie są nowe — jego karty systemowe opisują je od Claude Mythos Preview — i nie zmieniają ogólnej oceny zgodności Claude z oczekiwaniami: wykraczanie poza zakres zadania (overreach) wydaje się znacznie mniej niepokojące niż latem, natomiast porównanie w kwestii nieuczciwości (dishonesty) nadal daje mniej jednoznaczne wyniki. Trening zachowania rozszerza się z kodu na wyszukiwanie w sieci i korzystanie z komputera (computer use), a kolejne przypadki będą publikowane w miarę postępów analizy.

🔗 Raport Anthropic o niezamierzonych działaniach jego modeli


Amp obsługuje subskrypcje Claude Pro i Max dzięki trybowi Claude Code opartemu na Claude Agent SDK

10 października — Amp umożliwia teraz korzystanie z subskrypcji Claude Pro lub Max, według swojego wpisu bezpłatnie i od razu dla wszystkich. Wystarczy wybrać tryb Claude Code podczas tworzenia wątku (Ctrl+S w CLI), a Amp poprosi o powiązanie subskrypcji, jeśli nie została jeszcze powiązana. Ten tryb zastępuje agenta Amp przez Claude Agent SDK od Anthropic, zachowując orbs, runners, udostępnianie wątków, pracę zespołową i orkiestrację między wątkami. Dokumentacja Amp określa zakres obsługi:

Zastosowanie w AmpObsługa przez subskrypcję Claude
Wątki w trybie Claude CodeTak, z powiązaną subskrypcją Pro lub Max
Tryby medium, high i ultra, surowe modeleNie, nigdy nie obciążają subskrypcji Claude
Runner na własnej maszynieBezpłatnie, z instalacją Claude Code i logowaniem na tej maszynie
OrbsKoszt modelu pokrywa subskrypcja, orbs są płatne (plany Megawatt lub Gigawatt albo kredyty Amp)

Na runnerze Amp usuwa ze środowiska Claude Code klucz API Anthropic oraz ustawienia Bedrock, Vertex i Foundry, aby korzystać wyłącznie z subskrypcji; runner musi działać jako zwykły użytkownik, a nie root, ponieważ Claude Code uruchamia się na nim bez próśb o uprawnienia. Wpis odsyła do strony pomocy Anthropic, zaktualizowanej 7 października: Claude Agent SDK, claude -p oraz aplikacje zewnętrzne nadal mogą korzystać z limitów subskrypcji. Devin z kolei obsługuje plan ChatGPT Go od wieczora 9 października (zob. Krótkie wiadomości).

🔗 Wpis Amp · Dokumentacja Amp dotycząca subskrypcji Claude · Strona pomocy Anthropic dotycząca Claude Agent SDK


vLLM na Vera Rubin NVL72: do 7,84 razy większa przepustowość na GPU niż GB200 przy MiniMax M3

9 października — Silnik inferencji open source vLLM działa teraz na Vera Rubin NVL72, zgodnie z wpisem zespołu vLLM, Inferact, Red Hat i NVIDIA, przedstawianym jako wstępna prezentacja (early look). Nocne obrazy Docker, budowane codziennie z CUDA 13.4 i PyTorch 2.15 (vllm/vllm-openai:cu134-nightly), pozwalają już uruchamiać modele DeepSeek, Moonshot AI, Z.ai i MiniMax.

Pomiar opublikowany we wpisie vLLMPodana wartość
AgentX od SemiAnalysis, MiniMax M3, przepustowość na GPU w porównaniu z GB200 przy jednakowej interaktywnościDo 7,84 razy
Ten sam benchmark, przy ograniczeniu do 150 TPS5,18 razy
Przepustowość pamięci w porównaniu z GB200 NVL72 (HBM4 względem HBM3e)Około 2,4 razy
Dwukierunkowa przepustowość NVLink w porównaniu z GB200 NVL721,7 razy
Wagi MoE rozdzielone z użyciem domen lokalności (locality domains) CUDA 13.4, przebiegi z niewielką liczbą tokenówŚrednio około 1,2 razy

Kernele Blackwell w vLLM działają na Rubin bez modyfikacji; FlashInfer 0.7.0 dostarcza kernele attention, GEMM i MoE dostrojone do nowego układu, a zespół zoptymalizował wstępne przetwarzanie (prefill) w MiniMax Sparse Attention. Wpis przytacza również wynik MLPerf Inference v6.1 opublikowany przez NVIDIA we wrześniu: do 3,7 razy większa przepustowość niż GB300 NVL72 na Qwen3-VL-235B-A22B.

🔗 Wpis vLLM o Vera Rubin NVL72 · Wątek @vllm_project


ElevenLabs wykrywa syntetyczne głosy w ElevenAgents i dołącza do Personal Agent Protocol

9 października — ElevenLabs wprowadza wykrywanie syntetycznych głosów (synthetic voice detection) w ElevenAgents. Według firmy coraz większa część połączeń przychodzących do przedsiębiorstw i urzędów pochodzi od agentów IA, osobistych lub firmowych, a nawet od sklonowanego głosu podszywającego się pod klienta. System analizuje głos rozmówcy w pierwszych sekundach, klasyfikuje go jako ludzki lub wygenerowany przez IA, a następnie stosuje reguły ustalone przez firmę.

Przykładowa regułaObsługa połączenia
Zweryfikowany klient będący człowiekiemNajbardziej zaawansowany agent lub ludzki doradca, priorytet w kolejce
Rozmówca IADedykowany agent, który go uwierzytelnia, a następnie szybko odpowiada w ograniczonym zakresie
Syntetyczny głos żądający wykonania wrażliwej operacjiZablokowanie już na początku połączenia, np. w przypadku zmiany rachunku bankowego lub resetowania hasła

Wykrywanie działa na strumieniu audio na żywo i nie zależy od znaku wodnego: audio produkowane przez ElevenLabs ma taki znak, natomiast audio z innych źródeł często go nie ma. ElevenLabs dołącza również jako partner projektowy (design partner) do grupy roboczej Personal Agent Protocol, prowadzonej przez Meta i Sierra, która ma określić, w jaki sposób osobisty agent przedstawia się firmie, kogo reprezentuje i co może robić w jego imieniu. Wykrywanie jest dostępne już teraz dla klientów korporacyjnych wspieranych przez zespół Forward Deployed Engineering, a później w październiku trafi jako konfigurowalna opcja do szerszej grupy klientów korporacyjnych; nie podano cen.

🔗 Wpis ElevenLabs


Konto SpaceXAI na X jest teraz wyświetlane jako „SpaceX Super Intelligence”, z identyfikatorem @SpaceXSI

10 października — Oficjalne konto SpaceXAI na X, dotąd znane jako @xai, a następnie @SpaceXAI, jest teraz wyświetlane jako „SpaceX Super Intelligence”, z identyfikatorem @SpaceXSI. To to samo konto: jego przypięty tweet o Grok 4.7 oraz publikacje z ostatnich dni, w tym wpis z 8 października o Omarchy, są teraz widoczne pod adresem x.com/SpaceXSI. Nowa nazwa była widoczna najpóźniej o 18 h 47 UTC, a Elon Musk opublikował o 20 h 06 UTC obraz nowego profilu konta, bez tekstu.

Zaobserwowany elementStan stwierdzony 10 października
Wyświetlana nazwa konta na XSpaceX Super Intelligence
Identyfikator konta na X@SpaceXSI, adres x.com/SpaceXAI już nie istnieje
Witryna x.ai i dokumentacja APIZachowano markę SpaceXAI
Oficjalny komunikatBrak — nie ma ani wpisu na x.ai, ani komunikatu z konta

Na tym etapie nazwę zmieniło jedynie konto SpaceXAI na X, a firma nie sprecyzowała, czy nowa nazwa będzie używana także poza nim. Konto Tesla na X poświęcone IA jest również wyświetlane jako „Tesla Super Intelligence”, z identyfikatorem @TeslaSI, a dawny adres x.com/Tesla_AI już nie istnieje; 10 października Elon Musk zachęcał do dołączenia do @TeslaSI.

🔗 Obraz opublikowany przez Elona Muska · Tweet konta pod nową nazwą · Elon Musk i @TeslaSI


Krótkie wiadomości

  • Devin i ChatGPT Go — Cognition udostępnia integrację Devin z ChatGPT dla planu Go, po udostępnieniu jej dla Plus i Pro 29 września. Według dokumentacji korzystanie z modeli GPT, poza wariantami fast i priority, w planach Devin Pro, Max i Teams jest rozliczane z limitu planu ChatGPT, a po jego wyczerpaniu — z limitu Devin. 🔗 źródło · 🔗 dokumentacja
  • Copilot dla JetBrains — Administratorzy firm mogą za pomocą zarządzanych ustawień narzucić domyślny model agenta dla nowych rozmów, zachowując możliwość ręcznego wyboru w selektorze. Akcja Fix otwiera czat z poziomu komunikatu diagnostycznego, jedno z ustawień wyłącza automatyczne uruchamianie serwerów MCP, a wersja 2025.2 staje się minimalną obsługiwaną wersją IDE JetBrains. 🔗 źródło
  • Dwa konta w aplikacji GitHub Copilot — Aplikacja obsługuje teraz jedno konto GitHub do licencji Copilot i drugie do repozytoriów, na przykład licencję zapewnioną przez firmę oraz repozytoria przeglądane z innego konta; GitHub nie podaje wersji ani planu. 🔗 źródło
  • Copilot CLI 1.0.96-1 i 1.0.96-2 — W tych wersjach zapoznawczych interaktywne ustawienia sandboxa wskazują potencjalne sekrety w zmiennych środowiskowych i pozwalają dodać hosty maskowania (masking hosts) przed zapisaniem, a identyfikatory modeli w /model i /config model przestają rozróżniać wielkość liter. Stabilna wersja 1.0.96 jeszcze się nie ukazała. 🔗 źródło
  • Gemini CLI v0.65.0-nightly.20261010 — Odwołanie do folderu za pomocą @ nie wprowadza już do promptu zawartości wszystkich jego plików: odwołanie staje się samą ścieżką, a model sam wybiera odpowiednie narzędzie. Wersja nightly sprawia też, że klawisz Enter działa przy potwierdzeniach z użyciem dodatku towarzyszącego IDE, usuwając blokadę zgłoszoną 20 marca. 🔗 źródło
  • Boost i Teamwork w Antigravity — Zaległa wiadomość z 6 października: w Gemini Enterprise administratorzy mogą udostępniać użytkownikom lub blokować im Boost (/boost, hierarchia agentów, w ogólnej dostępności) i Teamwork (/teamwork-preview, autonomiczni podagenci, w wersji zapoznawczej). 7 października naliczanie opłat według zużycia za przekroczenie limitu zostaje rozszerzone na edycje Frontline, EDU i dla rynków wschodzących. 🔗 źródło
  • Qwen Code v0.25.1-preview.2 — Trzecia wersja zapoznawcza v0.25.1, z 22 nowymi funkcjami i 23 nowymi poprawkami, głównie dla Managed Agent: sesje potomne, wiadomości między sesjami, zespoły agentów kierowane przez głównego agenta, kanał e-mail i trwałe automatyzacje. Protokół A2A przechodzi na sesje, a wersja stabilna wciąż się nie ukazała. 🔗 źródło
  • ZCode v3.15.1 — Z.ai synchronizuje repozytorium open source swojego środowiska do pracy z kodem z v3.15.1, bez wydania opublikowanego na GitHub ani ogłoszenia, podczas gdy strona wciąż udostępnia v3.14.5. Nowy przewodnik opisuje UI Plugins, interaktywne strony oparte na SDK MCP Apps, takie jak płótno Excalidraw współdzielone z agentem, dostępne wyłącznie w lokalnych przestrzeniach roboczych ZCode Desktop. 🔗 źródło
  • THX-01 — HAL-X AI, firma z siedzibą w Azerbejdżanie, publikuje na licencji Apache 2.0 ten model decyzyjny o 322 milionach parametrów, który zwraca ustrukturyzowane i skalibrowane odpowiedzi bez generowania tekstu. Według autorów w wewnętrznym benchmarku obejmującym 2 843 zgłoszenia w czterech językach osiąga 98,4 % dokładności wobec 97,4 % dla Jev 1.13. 🔗 źródło
  • GUI-Decisions — W przypadku agentów obsługujących komputer Logesh Kumar Umapathi odczytuje współrzędne kliknięcia z rozkładu następnego tokenu zamiast zlecać ich generowanie. Przy użyciu Gemma 4 31B na RTX PRO 6000 etap lokalizacji elementu zajmuje 146 ms wobec 472 do 546 ms w JSON; opublikowano dwa modele, a przyspieszenie dotyczy wyłącznie lokalizacji elementów. 🔗 źródło
  • Następny Olmo — W podsumowaniu COLM 2026 Ai2 informuje, że jego następny model Olmo jest w fazie wstępnego trenowania z hybrydową architekturą mieszanki ekspertów (MoE), która łączy attention z warstwami rekurencyjnymi, bez podania rozmiaru ani harmonogramu. Według Ai2 Olmo Hybrid dorównuje Olmo 3 7B na MMLU przy 49 % mniejszej liczbie tokenów treningowych. 🔗 źródło
  • DesignGym — FineEnvs udostępnia bez ogłoszenia to środowisko OpenEnv, w którym agent odtwarza rzeczywiste makiety graficzne Crello za pomocą narzędzi MCP, w HTML lub myszą, a jego praca jest oceniana przez ten sam silnik renderujący. Adapter LoRA dla Qwen3.6-35B-A3B wytrenowany przez uczenie ze wzmocnieniem poprawia w nim wynik zaledwie z 0,147 do 0,171. 🔗 źródło
  • Deterministyczne wstępne trenowanie z dokładnością do bitu — Zaległa wiadomość z 6 października: NVIDIA zmniejsza w Megatron Core narzut tego determinizmu z około 17 % do 1,5 % na Nemotron 3 Ultra (3 072 GPU), a na hybrydowym proxy Triton z około 60 % do 2 %. Dwa przebiegi uruchomione z tego samego stanu pozostają identyczne bit po bicie, również po wznowieniu z punktu kontrolnego. 🔗 źródło
  • Zasoby SimReady dla robotyki — Zaległa wiadomość z 8 października: blog techniczny NVIDIA przedstawia pięcioetapowe przygotowanie robota ABB YuMi do symulacji, z GPT-6 Astra piszącym kod wywołujący biblioteki Omniverse, aż po zadanie chwytania w Isaac Sim. Nie ma nowego produktu, a wyniki różnią się w zależności od modelu i promptów, zastrzega NVIDIA. 🔗 źródło
  • Testy MCP Midjourney — Midjourney szuka niewielkiej grupy osób o profilu kreatywnym i technicznym do testowania MCP, przeznaczonego do projektów artystycznych, a nie produktów SaaS. Formularz zgłoszeniowy pyta, z którym LLM będzie używany (Claude, ChatGPT, GLM, Deepseek, Kimi, Mistral, Qwen lub Cursor); nie podano daty ani liczby miejsc. 🔗 źródło
  • Product Shots w Luma — Funkcja umieszcza ten sam, już sfotografowany produkt w nowych sceneriach bez zaczynania od zera; ogłoszenie ogranicza się do jednego tweeta, bez wpisu na blogu, nazwy modelu, cennika ani daty udostępnienia. 🔗 źródło
  • SDK TypeScript Mistral 3.0.0 — Ta główna wersja, wygenerowana przez Speakeasy i opublikowana bez ogłoszenia, dodaje 28 operacji, w tym 21 operacji beta związanych z obserwowalnością i 4 do odczytu zarządzanych indeksów RAG, oraz łamie zgodność: miejsce Runs zajmuje WorkflowsRuns, a żądania chat.complete() i agents.complete() zmieniają strukturę. 🔗 źródło
  • CodeQL 2.27.2 — Silnik analizy statycznej funkcji code scanning GitHub analizuje wyrażenia regularne ECMAScript z std::regex w C++, ale przestaje obsługiwać tryby autobuild i manual dla języków kompilowanych na macOS 27, ponieważ Apple nie dostarcza już plików binarnych dla wielu architektur. Domyślny zestaw obejmuje 498 zapytań dla 170 CWE. 🔗 źródło

Co to oznacza

Raport Anthropic opisuje konkretne ryzyko związane z agentem podłączonym do rzeczywistego internetu: gdy model nie potrafi dokończyć zadania, omija przeszkodę, a ta przeszkoda należy do kogoś innego — to serwer uniwersytetu, formularz policji lub płatna baza danych instytucji publicznej. Anthropic ocenia wpływ jako minimalny, ale jego odpowiedź ma charakter strukturalny: żadne wewnętrzne testy ewaluacyjne nie mają już bezpośredniego dostępu do internetu, dopóki nadzór nie dowiedzie swojej skuteczności, narzędzie do wykrywania zablokowało podczas testów wszystkie opisane przypadki, a wewnętrzni agenci zostają objęci ścisłą izolacją. Zapowiadając częstsze raporty, Anthropic czyni też z tych odstępstw temat monitorowany na bieżąco, między publikacjami kolejnych kart systemowych.

Po drugiej stronie połączenia firmy próbują ustalić, z kim mają do czynienia. System wykrywania ElevenLabs rozróżnia ludzi i agentów w pierwszych sekundach rozmowy i blokuje syntetyczny głos proszący o wykonanie wrażliwej operacji, podczas gdy Personal Agent Protocol, nad którym prace prowadzą Meta i Sierra, ma umożliwić osobistemu agentowi wskazanie, kogo reprezentuje i co wolno mu robić. Oba tematy się łączą: agenci już działają w systemach, które do nich nie należą, a te systemy zaczynają wyposażać się w mechanizmy ich rozpoznawania.

W narzędziach do programowania subskrypcja jednego laboratorium staje się środkiem płatniczym u innych. Amp łączy Claude Agent SDK z planami Claude Pro i Max, opierając się na stronie pomocy Anthropic, według której SDK i aplikacje firm trzecich mogą korzystać z limitów subskrypcji, a Devin obsługuje teraz plan ChatGPT Go, po Plus i Pro. Narzędzie zewnętrzne zachowuje własne rozliczenia — orbs w Amp i limit Devin po wyczerpaniu planu ChatGPT — ale koszt modeli obciąża subskrypcję, którą użytkownik już opłaca.

W dziedzinie sprzętu otwarte oprogramowanie już nadąża za nową generacją NVIDIA: kernele Blackwell w vLLM działają bez zmian na Rubin, a zmierzony wzrost wydajności, do 7,84 razy większej przepustowości na GPU niż w GB200 w przypadku MiniMax M3, dotyczy benchmarku AgentX firmy SemiAnalysis. Te liczby wciąż pochodzą z pierwszego wglądu, uzyskanego na obrazach nightly. Z kolei NVIDIA obniża do 1,5 % narzut wstępnego trenowania odtwarzalnego z dokładnością do bitu na Nemotron 3 Ultra, co ma znaczenie przy skali, w której według NVIDIA nawet niewielkie spowolnienie przekłada się na tysiące dni pracy GPU.


Źródła