Căutare

Grok ajunge în Copilot pentru Word, Excel și PowerPoint, OpenAI reduce la zero licența ChatGPT pentru administrațiile americane, DeepSeek menține V4 Pro

Articol generat de inteligență artificială
Grok ajunge în Copilot pentru Word, Excel și PowerPoint, OpenAI reduce la zero licența ChatGPT pentru administrațiile americane, DeepSeek menține V4 Pro

ai-powered-markdown-translator

Articol tradus din fr în ro cu gpt-5.6-sol.

Vezi proiectul pe GitHub ↗

Niciun model emblematic nou în această sâmbătă, dar schimbări concrete pentru cei care folosesc deja aceste instrumente. Microsoft implementează modelele Grok de la SpaceXAI în Copilot pentru Word, Excel și PowerPoint la o zi după sosirea Grok Bot în Teams, OpenAI reduce la zero prețul licenței ChatGPT pentru toate administrațiile americane, solicitând totodată o lege federală, iar documentația DeepSeek anulează redirecționarea V4 Pro programată pentru 14 septembrie. În ceea ce privește instrumentele de dezvoltare, Amp devine gratuit pentru cei care își asigură resursele de calcul și modelele, în timp ce Gemini CLI și Vibe CLI își înăspresc controalele de securitate.


Grok se instalează în suita Microsoft, de la Copilot pentru Word, Excel și PowerPoint la Teams

12 septembrie — Microsoft anunță implementarea modelelor Grok de la SpaceXAI în Copilot pentru Word, Excel și PowerPoint. Lansarea este direcționată: începe doar pentru clienții programului Microsoft Frontier, iar Microsoft o prezintă drept o extindere a opțiunilor de modele oferite în Copilot. Contul @grok a redistribuit anunțul mai puțin de o oră mai târziu.

Launching even more models in Copilot. Grok models from SpaceXAI are rolling out in Copilot in Word, Excel, and PowerPoint—starting with a focused release to customers in the Microsoft Frontier program.

🇷🇴 Și mai multe modele sosesc în Copilot. Modelele Grok de la SpaceXAI sunt în curs de implementare în Copilot pentru Word, Excel și PowerPoint, începând cu o lansare direcționată către clienții programului Microsoft Frontier.@Microsoft365 pe X

Nuanța contează: SpaceXAI oferea deja propriile extensii (add-ins) Grok pentru Word, Excel, PowerPoint și Outlook încă din iunie și iulie, iar Grok 4.6 este disponibil pe Microsoft Foundry de la sfârșitul lunii august. De data aceasta, modelele Grok sunt cele care intră în Copilot de la Microsoft. Anunțul nu precizează nici versiunea Grok vizată, nici tariful și nici calendarul dincolo de programul Frontier.

🔗 Redistribuirea anunțului de către Grok pe X

Grok Bot caută și acționează în Microsoft Teams

11 septembrie — În ajunul anunțului Microsoft, contul @bot a indicat că Grok Bot, oferta de agenți persistenți a SpaceXAI, poate acum să caute și să acționeze în Microsoft Teams în numele utilizatorului. Un mesaj publicat pe 10 septembrie, spre sfârșitul după-amiezii, ora Pacificului, viza deja echipele comerciale: Grok Bot se conectează la Salesforce, HubSpot, Gong, Clay și Granola pentru a urmări conturile clienților, a asigura acțiunile ulterioare și a efectua cercetări aprofundate. Acești conectori extind funcțiile prezentate la începutul lunii septembrie, de la Grok Bot for Enterprise până la completarea formularelor și redactarea mesajelor. Niciunul dintre cele două mesaje nu precizează planul necesar, tariful sau limita de utilizare.

🔗 Anunțul Grok Bot pentru Microsoft Teams pe X


OpenAI în raport cu statul american, între achiziții publice și apelul la legislație

9 și 10 septembrie — Două texte OpenAI publicate la mijlocul săptămânii, pe care edițiile noastre precedente nu le-au preluat, prezintă compania în raport cu autoritatea publică americană în două ipostaze: vinde administrației și îi cere legiuitorului să o reglementeze.

OneGov 2.0, o licență ChatGPT de zero dolari pentru toate administrațiile

10 septembrie — OpenAI for Government semnează cu agenția federală pentru servicii generale (General Services Administration, GSA) un nou acord multianual, în continuarea ofertei federale de anul trecut. Licența, facturată în mod normal cu 15 dolari per utilizator pe lună, ajunge la zero, fără angajament minim, iar utilizarea este facturată la jumătate de preț. Oferta depășește acum nivelul federal: statele, autoritățile locale și guvernele tribale sunt eligibile pentru prima dată. Peste un milion de funcționari publici aveau deja acces la ChatGPT datorită acordurilor existente; eligibilitatea se extinde la aproximativ 23 de milioane de persoane, iar GPT-6 Astra se numără printre instrumentele oferite.

Element al acorduluiConținut anunțat
Licență per utilizator0 dolari în loc de 15 dolari pe lună, fără angajament minim
Utilizarea modelelorReducere de 50 %
Administrații eligibileGuvernul federal, statele, autoritățile locale și guvernele tribale
Componenta de apărare cyberDaybreak Blue la 50 % din tariful comercial, Daybreak Red la cerere, la tariful standard
Durata acordului27 de luni, de la 1 octombrie 2026 până la 31 decembrie 2028

Componenta de apărare cyber extinde Daybreak for Frontline Defenders, finanțat cu un miliard de dolari și anunțat în săptămâna precedentă. OpenAI reamintește că ChatGPT Enterprise nu folosește datele organizațiilor, nici intrările, nici ieșirile, pentru a-și antrena modelele. Un webinar de prezentare este programat pentru 14 septembrie.

🔗 Extinderea accesului la AI și a apărării cyber pentru guvernele federale, statale, locale și tribale

Un articol de opinie pentru o lege federală și patru proiecte de lege californiene

9 septembrie — Într-un articol de opinie care consideră că fereastra politică este deschisă, Chris Lehane, directorul pentru afaceri globale al OpenAI (Chief Global Affairs Officer), cere Congresului să adopte, înainte de încheierea sesiunii sale, o reglementare națională obligatorie, bazată pe capacitățile modelelor. Aceste obligații ar trebui să vizeze puținele laboratoare care dezvoltă cele mai capabile sisteme, nu startupurile sau dezvoltatorii mici, iar politica de siguranță nu trebuie să devină o politică împotriva modelelor cu ponderi deschise. Între timp, OpenAI susține oficial patru proiecte de lege adoptate de legislativul Californiei și transmise guvernatorului Newsom. SB 1119 se numără printre ele: OpenAI își anunțase deja sprijinul pentru acest text la sfârșitul lunii august.

Proiect de lege californianObiectul textului
SB 813Cadru pentru evaluări independente de siguranță
AB 1405Standarde aplicabile auditorilor AI
SB 1119Protecția minorilor care folosesc chatboți însoțitori
AB 1864Măsuri de protecție împotriva amenințărilor biologice facilitate de AI

Some of these bills we did not endorse in the past, and are now supporting after reconsidering in light of the recent jump in capabilities we have seen.

🇷🇴 Nu am susținut în trecut unele dintre aceste proiecte de lege, iar acum le susținem după ce le-am reexaminat în lumina recentului salt al capacităților pe care l-am observat. — Chris Lehane, director pentru afaceri globale, OpenAI

Articolul solicită, de asemenea, standarde industriale pentru monitorizarea nealinierii (misalignment): o notificare scrisă rapidă adresată organizațiilor vizate atunci când un model, în timpul dezvoltării sau evaluării sale, eludează fără autorizație controalele lor de securitate. Pentru Astra, OpenAI afirmă că monitorizează traiectoriile complete, inclusiv lanțurile de gândire, și impune o evaluare a alinierii înainte de orice implementare internă extinsă. Potrivit textului, auto-îmbunătățirea recursivă (recursive self-improvement) complet autonomă nu are loc în prezent și nu ar trebui urmărită atât timp cât nu poate fi realizată în siguranță.

🔗 Fereastra politicilor privind AI este deschisă. Trebuie să acționăm.


DeepSeek își menține în cele din urmă API-ul V4 Pro după 14 septembrie

Constatat pe 12 septembrie — Documentația API-ului DeepSeek afirmă acum contrariul anunțului din 10 septembrie. În acea zi, odată cu lansarea V4.1-Flash, DeepSeek programase încetarea V4 Pro: începând cu 14 septembrie, ora 04:00 UTC, toate solicitările către deepseek-v4-pro urmau să fie redirecționate către V4.1-Flash și facturate la tariful Flash, până la lansarea V4.1-Pro. O notă de pe pagina Models & Pricing indică acum că DeepSeek va continua să furnizeze API-ul V4 Pro după 14 septembrie, pentru a răspunde cererii utilizatorilor, cu facturarea neschimbată, și că firma va anunța orice nouă modificare.

Același paragraf apare în înregistrarea din 10 septembrie a jurnalului de modificări (Change Log), atât în engleză, cât și în chineză. DeepSeek nu datează această răzgândire și nu a distribuit-o pe X, în timp ce articolul cu anunțul din 10 septembrie afișează încă vechiul calendar: două versiuni contradictorii rămân online.

Element de facturare per milion de tokenideepseek-flash, ore de trafic redusdeepseek-flash, ore de vârfdeepseek-v4-pro, ore de trafic redusdeepseek-v4-pro, ore de vârf
Intrare din cache (cache hit)0,003 dolari0,006 dolari0,022 dolari0,044 dolari
Intrare fără cache (cache miss)0,15 dolari0,30 dolari0,66 dolari1,32 dolari
Tokeni de ieșire0,60 dolari1,20 dolari1,98 dolari3,96 dolari
Solicitări simultane2 5002 500500500
Înțelegerea imaginilordadanunu

Prin urmare, pentru utilizatorii API-ului, redirecționarea automată nu va avea loc: cele două modele coexistă, fiecare cu un context de un milion de tokeni și o ieșire maximă de 384K. În funcție de elementul facturat, V4 Pro costă de 3,3 până la 7,3 ori mai mult decât Flash. Orele de vârf sunt între 01:00 și 04:00 și între 06:00 și 10:00 UTC, de luni până vineri, iar în restul timpului tariful este redus la jumătate.

🔗 Models & Pricing, API-ul DeepSeek 🔗 Jurnalul de modificări al API-ului DeepSeek


Amp devine gratuit pentru cei care își asigură resursele de calcul și abonamentele la modele

12 septembrie — Amp a publicat un articol intitulat Free Agent, datat 13 septembrie pe site-ul său, care schimbă logica de facturare a agentului său de programare. Utilizarea devine gratuită atunci când utilizatorul își asigură propriile resurse de calcul și propriile abonamente sau chei pentru modele. Conectarea unui abonament ChatGPT nu mai necesită un plan lunar, iar folosirea cheilor API personale (Bring Your Own Key, BYOK) nu mai presupune nici taxe per token, nici plafon, pentru toți clienții din afara segmentului Enterprise. Amp facturează acum orbs, mașinile sale la distanță pe care agenții lucrează autonom și în paralel, iar executanții (runners) instalați pe propriile mașini permit evitarea gratuită a acestora. Inferența poate fi achiziționată în continuare prin Amp, fără adaos comercial.

Plan AmpPreț afișatCe include planul
Hobby (nou)GratuitToate funcțiile, orbs plătite în funcție de utilizare sau executanți personali gratuiți, BYOK fără taxe ori plafon
Individual (Megawatt sau Gigawatt)20 de dolari pe lună pentru Megawatt45 000 de minute de timp orb, depozite publice și private nelimitate
Teams (nou)Fără cost suplimentarMembri cu planuri diferite, fire și portaluri partajate, credite comune, SSO SAML/OIDC
EnterprisePreț la cerereCredite comune fără locuri plătite, SCIM, plafoane de cheltuieli, jurnale de audit

Pentru echipe, costul de intrare dispare: oricine poate fi invitat gratuit într-un spațiu de lucru, iar utilizatorii intensivi trec la un plan plătit pentru reduceri la utilizare, în medie 60 % pentru Megawatt și 65 % pentru Gigawatt, potrivit Amp. Autentificarea unică SAML/OIDC devine gratuită pentru întregul spațiu de îndată ce un membru plătește, iar politica de păstrare zero sau minimă a datelor, garantată până acum prin contract doar clienților Enterprise, este extinsă la toți. În cele din urmă, Megawatt și Gigawatt obțin acces anticipat la încă opt furnizori, printre care OpenRouter, Amazon Bedrock și Ollama Cloud.

🔗 Articolul Free Agent de la Amp


ChatGPT pentru desktop 26.908, conversație rapidă din Pets și Appshots pe Windows

11 septembrie — OpenAI publică versiunea 26.908 a aplicației desktop ChatGPT, axată pe Pets. Acești însoțitori animați opționali, care plutesc deasupra celorlalte ferestre în macOS și Windows, erau folosiți până acum pentru a urmări conversațiile în curs. Ei devin și un punct de pornire: din comenzile aflate sub animal, se tastează o conversație rapidă (Quick Chat) și se trimite cu Enter, fără a deschide fereastra principală. O scurtătură globală afișează aceste comenzi, Option+Space în macOS și Windows+Alt+P în Windows, iar modul Mini păstrează aceleași scurtături și aceleași notificări, fără animal pe ecran.

Animalul semnalează patru stări: conversație în curs, în așteptarea unei decizii, finalizată sau blocată de o eroare și aduce în prim-plan firele care așteaptă un răspuns. Conversațiile lansate din aceste comenzi sunt create în afara oricărui proiect, iar pets personalizați rămân stocați pe dispozitiv, fără sincronizare cu ChatGPT pe web.

Appshots, prezentate la sfârșitul lunii august în macOS, ajung și în Windows: apăsarea simultană a ambelor taste Alt trimite către ChatGPT fereastra aflată în prim-plan, sub forma unei capturi de ecran însoțite de textul disponibil, către conversația aleasă. Scurtătura poate fi personalizată, iar în Windows appshot-ul se deschide în aplicația principală.

🔗 Anunțul ChatGPT pe X 🔗 Jurnalul de modificări al aplicației ChatGPT


Gemini CLI, un nightly care izolează sandbox-ul și monitorizează fișierele de build

12 septembrie — După două versiuni nightly fără modificări de cod pe 10 și 11 septembrie, v0.61.0-nightly.20260912 pentru Gemini CLI aduce două schimbări, ambele dedicate securității, continuând direcția versiunilor nightly din 2, 4 și 5 septembrie. Canalele stable (v0.59.0) și preview (v0.60.0-preview.0) rămân neschimbate.

Prima (PR #29250) vizează injectarea indirectă de prompturi (indirect prompt injection) prin fișierele de build: un conținut extern compromis determină agentul să modifice un Makefile sau un package.json, apoi să pornească build-ul. CLI-ul urmărește acum fișierele de configurare a build-ului create sau modificate în timpul sesiunii, iar orice comandă de build sau de test lansată ulterior (npm run, make, cargo, blaze) solicită o confirmare explicită. Aceeași regulă se aplică atunci când o comandă reutilizează argumente preluate din conținuturi externe care nu sunt de încredere: Google Docs, Buganizer, pagini preluate prin web fetch sau răspunsuri de la servere MCP.

A doua (PR #29214, 45 de commit-uri) separă sandbox-ul de configurația și credențialele utilizatorului. Gemini CLI refuză să îl pornească din directorul personal, din rădăcina sistemului sau din ~/.gemini și să monteze aceste căi într-un container, care nu mai primește decât o copie igienizată a setărilor, fără hooks și fără chei API. Pe macOS, profilurile Seatbelt interzic scrierea în ~/.gemini și în fișierele sensibile (oauth_creds.json, trustedFolders.json, .env), precum și citirea depozitelor de credențiale și a definițiilor de hooks.

🔗 Notele versiunii nightly v0.61.0-nightly.20260912


Vibe CLI 2.25.4 impune aprobarea pentru sintaxele shell riscante

12 septembrie — Mistral publică Vibe CLI 2.25.4, a patra versiune în patru zile. Această versiune corectivă vizează în primul rând securitatea: verificările permisiunilor shell impun acum aprobarea utilizatorului pentru sintaxele și opțiunile de comandă riscante care permiteau ocolirea controalelor spațiului de lucru și a listei de interdicții (denylist). Nota de lansare asociază această înăsprire cu patru identificatori, de la CVE-2026-87984 la CVE-2026-87987, și cu variante reziduale ale CVE-2026-87988. La 12 septembrie, depozitul nu conținea niciun aviz de securitate, iar gravitatea acestor vulnerabilități nu este precizată.

Aprobarea inteligentă (smart approve), pe care versiunea 2.25.1 o împiedica deja să aprobe automat comenzile git susceptibile să afișeze secrete, își schimbă din nou comportamentul. Când o acțiune riscantă este solicitată din nou, nu se mai limitează la blocarea acesteia: cere confirmarea și afișează motivul. Apelurile pe care le aprobă automat sunt afișate ca o simplă notă, nu ca un avertisment, iar modul apare în selectorul din Vibe Desktop atunci când implementarea sa progresivă îl activează.

Restul modificărilor sporesc fiabilitatea utilizării zilnice: un conector nevalid nu le mai împiedică pe celelalte să se încarce, menționarea fișierelor prin @ funcționează pentru toate rădăcinile adăugate prin --add-dir, iar clienții ACP precum Zed și JetBrains afișează întotdeauna modul activ.

🔗 Notele versiunii 2.25.4 pe GitHub


Wringer, un model de raționament cu 4 miliarde de parametri și 2,655 biți per pondere

12 septembrie — weiciao wu publică pe blogul comunității Hugging Face Wringer, o metodă de cuantizare testată pe InternScience/Agents-A1-4B, un model de raționament cu 4 miliarde de parametri bazat pe arhitectura hibridă Qwen3.5. Este o contribuție individuală, nu o publicație a unui laborator. Corpul modelului coboară la 2,655 biți per pondere și păstrează în medie 93,7 % din scorurile inițiale pe IFEval, HumanEval și GSM8K, în timp ce curba cuantizărilor GGUF ale aceluiași model scade, prin interpolare, la 52,7 % la același debit.

Rețeta are trei etape. O cuantizare în formă închisă, prin GPTQ pe matricea completă de covarianță, oferă deja o retenție de 81,4 %. Umplerea (fill) îngheață apoi codurile și adaugă fiecărui strat liniar un adaptor de rang 128, antrenat prin autodistilare pe aproximativ 100 de milioane de tokeni, adică 7 h 30 pe un singur GPU. Stoarcerea (wring) elimină în cele din urmă adaptorul, recalculând codurile pentru a-i absorbi contribuția: același buget de biți, fără adaptor la inferență.

Configurație testatăBiți per pondere a corpuluiScor IFEvalScor HumanEvalScor GSM8KRetenție medie
bf16, referință1692,7994,5195,53100 %
GGUF, clasa IQ2_M2,76373,3863,4176,6575,47 %
Wringer fără antrenare2,65575,9770,7383,7081,44 %
Wringer, două cicluri (model publicat)2,65588,1785,3793,4894,65 %
GGUF, clasa IQ2_XXS2,55834,3820,1236,5432,16 %

Valoarea de 93,7 % corespunde evaluării inițiale a unui singur ciclu; modelul publicat pe Hub, cu două cicluri, ajunge la 94,65 %. Limitările sunt prezentate clar: cei 2,655 biți acoperă numai ponderile liniare ale corpului, iar întregul model ocupă 4,69 biți per pondere, cu embedding-ul păstrat în bf16. Inferența revine la bf16 în vLLM din cauza lipsei unor kernel-uri native cu puțini biți, astfel încât nu a fost încă demonstrat niciun câștig de memorie sau de viteză în timpul execuției, iar evaluarea se limitează la un singur model, trei benchmark-uri și o comparație cu GGUF. Proiectul a durat aproximativ cinci săptămâni pe un singur GPU, un agent executând lanțurile de experimente în timp ce o persoană selecta direcțiile de explorat.

🔗 Wringer pe blogul Hugging Face


Pe scurt

  • Cognition și Perplexity încredințează testele end-to-end modelului GPT-6 Astra — două studii de caz despre API. Devin testează jocul pentru iPhone Otter Run și returnează o înregistrare realizată într-un simulator, împreună cu un raport care diferențiază verificările reușite de zonele netestate; Perplexity îi cere lui Astra să construiască un mic program care imită răspunsurile altor servicii pentru a testa o aplicație end-to-end. 🔗 sursă
  • OpenAI Developers reunește treisprezece proiecte construite cu GPT-6 Astra — printre acestea, 2 234 de structuri anatomice de explorat în 3D, Manhattan recreat în Unreal Engine, un vechi desen cu un tren transformat într-un model Blender cu 3 295 de obiecte editabile și un motor de ray tracing (ray tracer) scris în C++, portat în Swift pe GPU-ul iPhone-ului. 🔗 sursă
  • autofinetune încredințează unui agent zeci de experimente de fine-tuning pentru Gemma — pe Google Developers Blog, Antigravity CLI și Gemini 3.7 Flash modifică scriptul de antrenare, lansează Tunix pe Cloud TPU și păstrează numai commit-urile câștigătoare. Rezultate: 20 de experimente în câteva ore pe FunctionGemma 270M, apoi 40 de experimente GRPO în două-trei zile pe Gemma 3 1B, pentru o recompensă cu aproximativ 10 % mai mare. 🔗 sursă
  • ToolGrad generează date despre utilizarea instrumentelor pornind de la răspuns — retrospectivă din 10 septembrie: Google Research construiește mai întâi un lanț valid de apeluri API, apoi redactează cererea, cu o rată de succes apropiată de 100 % pentru cele peste 16 000 de API-uri din ToolBench. Un Gemma 3 12B ajustat pe aceste date obține 83,1 pe BFCL, față de 83,2 pentru gemini-2.5-pro și 74,4 pentru GPT-5, modelele de vârf la momentul publicării articolului. 🔗 sursă
  • Documentația API-ului Gemini ajunge în Google AI Studio — retrospectivă din 10 septembrie: o primă versiune preliminară, reconstruită de la zero și accesibilă la ai.studio/docs, pe care Logan Kilpatrick o descrie ca fiind concepută atât pentru oameni, cât și pentru agenți. Mesajele nu precizează cum o utilizează agenții. 🔗 sursă
  • Trei proiecte Android XR susținute de Google la Festivalul de Film de la Veneția — echipa 100 ZEROS a sprijinit NEVATARS de Andy Serkis și Galápagos: The Last Eden, narat de Margot Robbie, în care Gemini animă conversațiile cu spectatorul, precum și trailerul pentru Sedona, thrillerul psihologic al Asylm Studios, convertit automat din 2D în 3D. Articolul nu oferă niciun model precis și nicio dată de disponibilitate. 🔗 sursă
  • Claude Code 2.1.270 corectează o regresie din versiunea 2.1.269 — comenzile git doar pentru citire lansate de instrumentul Bash nu mai solicită din nou autorizarea după o anumită durată a sesiunii. Aceasta este singura modificare a versiunii. 🔗 sursă
  • Rapoarte inteligente (smart reports) în versiune beta pe Claude Enterprise — retrospectivă din 10 septembrie: Claude analizează un eșantion al transcrierilor unei echipe pe o perioadă de cel mult 28 de zile și redactează un raport despre activitatea realizată, costul acesteia, dificultățile și sarcinile repetitive care pot fi transformate în skills partajate. Zece rapoarte gratuite pe lună pe durata versiunii beta, funcția fiind dezactivată implicit. 🔗 sursă
  • Metricile Copilot măsoară fereastra Agents din VS Code — disponibile pentru publicul larg, noile câmpuri numără utilizatorii activi zilnic, sesiunile și mesajele din această fereastră, pe perioade de 1 și 28 de zile, pentru fiecare întreprindere, organizație sau utilizator. Accesul este rezervat proprietarilor, administratorilor de facturare și rolurilor care dețin permisiunea View Copilot Metrics. 🔗 sursă
  • GitHub relansează vânzarea biletelor pentru Universe 2026 — un scurt videoclip evidențiază ecusonul programabil prezentat ca un mini-computer, rezervat participanților prezenți fizic: permis de participare la fața locului în valoare de 1 399 de dolari pentru 28 și 29 octombrie la San Francisco, participarea virtuală fiind gratuită. Este o promovare fără anunțuri despre produse, în continuarea relansărilor din 22 august și 7 septembrie. 🔗 sursă
  • Fugu Ultra v2 ajunge pe OpenRouter — orchestratorul premium al Sakana AI costă acolo 5 dolari per milion de tokeni la intrare și 30 de dolari la ieșire, cu un context de un milion de tokeni. Prompturile de peste 272 000 de tokeni sunt tarifate mai scump, iar tokenii consumați chiar de orchestrare sunt taxați la fel ca tokenii obișnuiți. 🔗 sursă
  • ChordStream, un token de 64 de biți per acord pentru modelele de muzică simbolică — specificație publicată pe blogul comunității Hugging Face: fiecare token conține tonalitatea, treapta, basul și poziția acordului, extrase din fișiere MIDI sau fluxuri REMI, împreună cu setul de date captioned-ChordStream. Extractorul rămâne euristic și nu este prezentat niciun model antrenat. 🔗 sursă
  • Qwen3.8-27B rulează pe Cerebras cu aproximativ 1 850 de tokeni pe secundă — context de 64k tokeni cu acces gratuit și de 128k cu acces plătit, la un preț de 0,99 dolari per milion de tokeni la intrare și 1,49 dolari la ieșire. Cerebras îi atribuie un scor de 34 în Artificial Analysis Intelligence Index. 🔗 sursă

Ce înseamnă toate acestea

Primul fir al zilei este distribuția. Modelele Grok intră în Copilot pentru Word, Excel și PowerPoint prin intermediul Microsoft, în timp ce SpaceXAI oferea deja propriile add-in-uri pentru aceste aplicații, iar Grok Bot se instalează cu o zi înainte în Teams, după conectarea la instrumente comerciale precum Salesforce sau HubSpot. OpenAI mizează pe același teren cu ChatGPT pentru desktop, unde o conversație pornește dintr-un companion flotant și unde Windows poate trimite acum o fereastră către ChatGPT prin două apăsări de taste. De altfel, Microsoft prezintă sosirea Grok drept o extindere a opțiunilor de modele din Copilot: modelul devine o opțiune în instrumentul deja deschis, nu doar o aplicație care trebuie căutată separat.

Al doilea fir este politic. În două zile, OpenAI a publicat un acord care reduce la zero costul licenței ChatGPT pentru aproximativ 23 de milioane de funcționari publici americani, de la nivel federal până la guvernele tribale, și un articol de opinie care solicită Congresului o lege obligatorie bazată pe capabilitățile modelelor. Cele două texte se completează: compania devine furnizor al administrației la nivelul întregii țări și propune ca obligațiile să revină celor câteva laboratoare care dezvoltă cele mai capabile sisteme, nu startup-urilor și nici modelelor cu ponderi deschise. Sprijinul său pentru patru proiecte de lege din California, dintre care unele nu erau susținute anterior, se înscrie în ceea ce articolul numește federalism inversat (reverse federalism), convergența legislațiilor statelor în așteptarea nivelului federal.

Al treilea fir privește prețul utilizării. Amp nu mai taxează tokenii furnizați de utilizator, revinde inferența fără marjă și își mută facturarea către mașinile la distanță pe care rulează agenții. DeepSeek, care intenționa să retragă V4 Pro în favoarea unui V4.1-Flash mai ieftin, îl menține la același tarif pentru a răspunde cererii, deși costă de 3,3 până la 7,3 ori mai mult: o parte dintre utilizatori țin mai mult la un anumit model decât la cel mai mic preț. La rândul său, Sakana taxează tokenii propriei orchestrări, iar Cerebras vinde Qwen3.8-27B pe baza vitezei sale. În cele din urmă, Wringer amintește că o compresie la 2,655 biți per pondere nu reduce încă factura atât timp cât inferența revine la bf16.

Ultimul fir privește securitatea agenților din linia de comandă și se învârte în jurul aceluiași mecanism: solicitarea aprobării. Gemini CLI o impune atunci când un fișier de build a fost modificat în timpul sesiunii sau când o comandă preia argumente provenite dintr-o pagină web ori de la un server MCP și separă sandbox-ul de credențialele utilizatorului. Vibe CLI 2.25.4 o face obligatorie pentru sintaxele shell care îi ocoleau controalele, invocând patru CVE-uri și variantele unui al cincilea, și schimbă aprobarea inteligentă de la blocare la confirmare. Claude Code 2.1.270 arată reversul medaliei: o regresie solicita din nou autorizarea pentru simple comenzi git doar pentru citire. Între vulnerabilitatea care lasă comenzile să treacă și întrebarea adresată prea des, reglarea acestor solicitări devine o parte vizibilă a muncii editorilor.


Surse