ai-powered-markdown-translatorArticol tradus din fr în ro cu gpt-5.4-mini.
Săptămâna aceasta, Meta publică Muse Glimmer, un model agentic multimodal cu 30 de miliarde de parametri și ponderi deschise, accesibil imediat printr-un endpoint NVIDIA accelerat de GPU, pe lângă Hugging Face. OpenAI își restructurează programul de securitate cibernetică Daybreak și lansează GPT-5.6-Cyber, un model care a ajutat deja la descoperirea unei vulnerabilități nemaiîntâlnite în motorul JavaScript din Chrome. Un alt element remarcabil: o versiune de cercetare nepublicată a lui Claude a făcut progrese asupra unui problem matematic legat de conjectura lui Riemann, cu o dovadă formală verificată. La meniu mai apar: tarifarea Anthropic, instrumente pentru dezvoltatori, IA vocală de întreprindere și finanțe IA-native.
Meta publică Muse Glimmer, model agentic 30B cu ponderi deschise, disponibil prin NVIDIA
Meta a publicat Muse Glimmer, un model dens multimodal cu 30 de miliarde de parametri (encoder vizual de 2B + decoder text de 28B), optimizat pentru a rula local, continuu, pe hardware de larg consum — Mac sau PC echipat cu un GPU performant. Ponderile sunt distribuite sub licența Apache 2.0. Modelul gestionează o fereastră de context de peste 120 000 de tokenuri și atinge, potrivit NVIDIA, până la 20 000 de tokenuri pe secundă pe un singur GPU; Alexandr Wang (Meta Superintelligence Labs) precizează că rulează pe 24 Go de VRAM fără pierdere a fiabilității agentice.
Din punct de vedere tehnic, Muse Glimmer combină atenția cu fereastră glisantă și atenția completă, o arhitectură Gated Grouped-Query Attention care reduce cache-ul de memorie de 16 ori și un model de schiță ușor, DFlash, care accelerează generarea de 2 până la 4x. Suportul este disponibil din prima zi în transformers, llama.cpp și vLLM, cu ponderi GGUF cuantificate și implementări prin Inference Endpoints de la Hugging Face.
| Caracteristică tehnică | Valoare măsurată |
|---|---|
| Parametri | 30B (encoder 2B + decoder 28B) |
| Licență | Apache 2.0 |
| Fereastră de context | 120 000+ tokenuri |
| VRAM minimă | 24 Go |
| Debit (1 GPU) | până la 20 000 tokenuri/s |
| MCP Atlas (agentic) | 75,5 (față de 54,2–62,5 pentru concurenți) |
NVIDIA a deschis imediat un punct de acces accelerat de GPU pentru a testa Muse Glimmer, optimizat pentru platformele sale edge, desktop și workstation — o disponibilitate concretă în completarea descărcării ponderilor.
Introducing Muse Glimmer, an open-weight 30B-parameter model optimized for local, always-on agent workflows. […] we’re releasing model weights under a permissive Apache 2.0 license.
🇷🇴 Prezentarea lui Muse Glimmer, un model cu ponderi deschise de 30 de miliarde de parametri, optimizat pentru fluxuri de lucru cu agenți locali și permanenți. […] publicăm ponderile modelului sub licența permisivă Apache 2.0. — @AIatMeta pe X
🔗 NVIDIA oferă un endpoint accelerat de GPU pentru Muse Glimmer
OpenAI extinde Daybreak și lansează GPT-5.6-Cyber, o CVE nemaiîntâlnită descoperită în Chrome
OpenAI își restructurează programul de securitate cibernetică Daybreak în două niveluri de acces și lansează GPT-5.6-Cyber, un model specializat construit pe GPT-5.6 Sol. Obiectivul declarat: să pună o inteligență de vârf în mâinile apărătorilor de încredere înainte ca capacitățile ofensive să se generalizeze în rândul atacatorilor.
| Nivel de acces | Model utilizat | Public vizat |
|---|---|---|
| Daybreak Blue | GPT-5.6 Sol (sisteme de protecție ridicate) | Punct de intrare recomandat pentru majoritatea apărătorilor |
| Daybreak Red | GPT-5.6-Cyber (nou) | Cercetători în securitate experimentați, lucrări autorizate avansate |
GPT-5.6-Cyber reduce refuzurile la anumite solicitări dual-use cu risc ridicat (de exemplu pentest pe sisteme de producție) și depășește GPT-5.6 Sol, precum și vechiul GPT-5.5 Cyber pe ExploitGym 2. În condiții reale, modelul a permis descoperirea a două vulnerabilități nemaiîntâlnite în V8, motorul JavaScript din Chrome, permițând coruperea memoriei și evadarea din sandbox-ul heap-ului; după divulgarea coordonată către Google, vulnerabilitatea a fost corectată și referențiată CVE-2026-15903. A identificat, de asemenea, cel puțin cinci vulnerabilități într-un sistem de operare mobil popular, trei breșe critice într-o bază de date populară și peste 400 de vulnerabilități de escaladare a privilegiilor într-un nucleu de sistem de operare popular — corecții în curs împreună cu partenerii Daybreak.
OpenAI impune chei de securitate hardware pentru toate conturile Daybreak individuale începând cu 1 septembrie 2026, iar un program Daybreak Cyber Partner asociază deja furnizori de servicii (Accenture, IBM, KPMG) și editori de securitate (Palo Alto Networks, CrowdStrike, Cisco) pentru a integra aceste modele în serviciile lor.
We’re expanding our cybersecurity initiative Daybreak and introducing GPT-5.6-Cyber, a new model for advanced, authorized cybersecurity work.
🇷🇴 Ne extindem inițiativa de securitate cibernetică Daybreak și lansăm GPT-5.6-Cyber, un model nou pentru lucrări avansate și autorizate de securitate cibernetică. — @OpenAI pe X
🔗 Extinderea Daybreak pe măsură ce fereastra de apărare cibernetică se îngustează
Claude avansează în conjectura lui Riemann, fără a o rezolva
Anthropic a cerut unei versiuni de cercetare nepublicate a lui Claude să se atace de ipoteza lui Riemann, unul dintre cele șapte probleme ale premiului mileniului al Clay Mathematics Institute (1 milion de dolari fiecare). Claude nu a rezolvat problema, dar a făcut progrese într-o întrebare conexă: a ridicat limita inferioară a fracției de zerouri ale funcției zeta a lui Riemann care verifică ipoteza, ducând-o de la 41,6 % la 67,2 %.
Lucrul s-a desfășurat în două sesiuni totalizând 31 de milioane de tokenuri de ieșire. Prima a generat 650 de idei inițiale, toate fără succes. Pentru a doua încercare, Claude a coordonat 60 de subagenți specializați (dezvoltare matematică, generare de idei, validare, redactare), a executat 2 400 de comenzi shell și a descărcat 54 de articole din arXiv pentru a-și verifica pistele. Rezultatul a fost apoi recitit de doi matematicieni Anthropic, apoi examinat de experții externi Brian Conrey și Dan Goldston. Claude a produs o dovadă verificată formal în Lean, care a trecut validarea standard.
Acest rezultat iese din registrul obișnuit al benchmark-urilor: o îmbunătățire măsurabilă asupra unei probleme deschise de decenii, cu verificare independentă și dovadă formală, ilustrează modul în care Anthropic își testează acum modelele de cercetare pe probleme de matematică fundamentală, mai degrabă decât pe sarcini clasice de inginerie software.
We asked an unreleased research version of Claude to take a stab at the Riemann hypothesis. It didn’t solve it, but it did make strides on a related problem: it increased the lower bound for the fraction of zeros of the Riemann zeta function that satisfy the hypothesis from 41.6% to 67.2%.
🇷🇴 I-am cerut unei versiuni de cercetare nepublicate a lui Claude să încerce ipoteza lui Riemann. Nu a rezolvat-o, dar a făcut progrese într-un problem conex: a ridicat limita inferioară a fracției de zerouri ale funcției zeta a lui Riemann care verifică ipoteza de la 41,6 % la 67,2 %. — @AnthropicAI pe X
🔗 Detaliu metodologic complet pe blogul de cercetare Anthropic
Anthropic : tarifare și securitate
Tariful de lansare al Sonnet 5 devine permanent
Anthropic confirmă că tariful de lansare al Claude Sonnet 5 — $2 per milion de tokenuri la intrare, $10 per milion de tokenuri la ieșire — devine permanent. Modelul fusese lansat în iunie cu acest tarif prezentat ca promoțional, valabil până la 31 august 2026. Anthropic înlătură astfel incertitudinea care apăsa asupra echipelor care și-au construit costurile previzionale în jurul acestui preț de lansare: nu se prevede nicio creștere pentru începutul de toamnă pe acest model, ceea ce îi consolidează poziția tarifară în fața concurenței pentru utilizările cu volum mare de tokenuri.
🔗 Anunț
Injecția de prompt „în mare parte rezolvată” potrivit Anthropic
Boris Cherny, responsabil de produs Claude Code la Anthropic, afirmă că injecția de prompt — metoda de atac cea mai frecventă împotriva utilizatorilor și agenților IA, în care un site sau document malițios strecoară o instrucțiune ascunsă executată de model — este acum în mare parte rezolvată în practică cu modelele Claude. El precizează că acest progres vine în principal din antrenarea modelelor, completată de mai mulți clasificatori de securitate suprapuși: combinația model + detector (probe) + mod automat ar readuce rata de succes a atacurilor la 0 %, un dispozitiv care devine modul implicit de permisiune al Claude Code pe 14 august. Este vorba despre o declarație publică pe X, nu despre o publicație de cercetare formală cu metodologie detaliată.
🔗 Tweet
Instrumente de dezvoltare: Amp trece la OpenAI, Copilot Chat se îmbunătățește
Amp își schimbă sistemul de moduri către OpenAI dacă este legat un abonament ChatGPT
Instrumentul de cod agentic Amp modifică logica de rutare a modurilor sale („the Dial”) atunci când un cont este legat de un abonament ChatGPT. Cu un abonament legat, modurile low, medium și high trec pe modele OpenAI (GPT-5.6 Terra pentru modul low și revizuirea de cod, GPT-5.6 Sol pentru agent și oracle în modul high) în loc de GLM-5.2 sau Claude Fable. Fără abonament legat, nimic nu se schimbă. Amp justifică abandonarea lui Claude Fable ca model oracle printr-o convergență a performanțelor modelelor frontieră: cofondatorul său @sqs consideră puțin probabil ca un test viitor să justifice diferența de preț de 80x dintre Fable și modelele OpenAI utilizate. Modul Ultra nu este afectat și continuă să ruleze pe Claude Fable.
Copilot Chat pe github.com: controale de conversație îmbunătățite
GitHub actualizează Copilot Chat pe github.com cu trei îmbunătățiri, în disponibilitate generală pentru toate planurile. Accesul la conversațiile recente este facilitat, fereastra de discuție poate fi acum redusă (minimize) în timp ce se generează un răspuns, apoi redeschisă pentru a relua schimbul, iar un indicator de consum de tokenuri apare direct în chat — cu detalierea pe sesiune și pe mesaj. Aceste ajustări rămân îmbunătățiri de ergonomie mai degrabă decât o funcționalitate majoră, dar răspund unei utilizări zilnice concrete pentru conturile supuse unor cote Copilot limitate.
🔗 Copilot pe web extinde controalele conversației
Ecosistem open source și inferență
NVIDIA publică Magpie TTS Multilingual, TTS deschis pentru agenți vocali în 12 limbi
NVIDIA publică Magpie TTS Multilingual, un model de sinteză vocală cu ponderi deschise de aproximativ 357 de milioane de parametri, sub licența NVIDIA Open Model License, care acoperă douăsprezece limbi (inclusiv franceza) cu voce masculină și feminină pentru fiecare. Latența până la primul sunet ajunge la 32 ms în flux unic pe GPU B200 (239 ms cu 64 de fluxuri concurente), 47 ms pe H100 și 79 ms pe A100, cu un factor de timp real de până la 320x. Rata de eroare a caracterelor scade și ea: de la 2,70 % la 1,54 % pentru franceză, de la 1,14 % la 0,60 % pentru spaniolă. Implementarea este posibilă prin ponderile deschise de pe Hugging Face sau prin NVIDIA NIM în producție.
🔗 Construirea de agenți vocali multilingvi cu latență redusă
O tehnică de distilare reduce de până la 15x memoria GPU necesară
Multiverse Computing publică o tehnică de distilare a cunoștințelor care combină cache-ul offline al logits-urilor profesorului și o funcție de pierdere KL fuzionată care evită materializarea matricei complete vocabular × lungime de secvență. Rezultat: memoria GPU scade de la 85,2 Go la 5,45 Go la 32K tokenuri de context (până la o reducere de 15,6x), iar distilarea unui model GPT-OSS 20B a trecut de la patru noduri GPU la unul singur, cu un timp de iterație redus cu aproximativ 5x. Aplicată la GPT-OSS 120B și Kimi-K3 (2,8T parametri), tehnica păstrează aproximativ 90 % din precizia profesorului pe BoolQ și HellaSwag. Codul este publicat ca open source pe GitHub.
🔗 Făcând distilarea cunoștințelor suficient de ieftină pentru a rula la scară
DeepSeek-V4-Flash disponibil pe cloud-ul Ollama prin Together AI
Together AI furnizează acum infrastructura de inferență din spatele DeepSeek-V4-Flash pe cloud-ul Ollama, prezentat ca găzduirea cu cele mai bune performanțe disponibile pentru acest model cu ponderi deschise. Oferta pune în prim-plan o politică de zero retenție a datelor, precum și găzduire în Statele Unite și în Uniunea Europeană — un argument de suveranitate pentru companiile care vor să folosească DeepSeek-V4-Flash fără a depinde de o infrastructură chineză. Este un nou canal de distribuție care se adaugă disponibilității deja existente a DeepSeek-V4-Flash direct pe Together AI.
🔗 Tweet
Sakana AI își antrenează orchestratorul Fugu pe o bază Gemma 4
Sakana AI publică o nouă versiune a modelului dirijor din produsul său de orchestrare multi-agent Fugu, antrenată de această dată pe baza modelului deschis Gemma 4, în completarea pool-ului de modele interschimbabile deja oferit. Arhitectura cu două straturi — un mic model dirijor care distribuie sarcinile și un pool de modele care execută procesarea reală — se sprijină pe cercetările Trinity și Conductor prezentate la ICLR 2026. Evaluările interne arată o performanță de orchestrare echivalentă cu versiunea anterioară, cu o reducere a costurilor. Sakana AI vizează și, pe termen lung, modele dirijor proprii pentru a răspunde cerințelor de suveranitate digitală în Japonia.
Together AI detaliază parteneriatul său cu Cursor pentru inferența în timp real
Together AI publică un articol co-semnat cu Cursor care detaliază parteneriatul lor de infrastructură de inferență: agenții integrați în editor generează cod în timp ce dezvoltatorii își editează activ fișierul, ceea ce impune constrângeri stricte de latență — răspunsul modelului trebuie să se insereze în bucla de feedback a editorului fără a rupe fluxul de lucru. Articolul ilustrează cum Together AI și-a construit infrastructura pentru a respecta aceste obiective la scară mare, un caz de utilizare concret al ofertelor sale de inferență dedicată pentru instrumente de dezvoltare asistate de IA.
🔗 Tweet
Media generativă: ElevenLabs la Deutsche Telekom, MiniMax detaliază H3
ElevenLabs își implementează tehnologia vocală IA la Deutsche Telekom
ElevenLabs anunță un parteneriat cu Deutsche Telekom, primul operator telecom din Europa, pentru a integra tehnologia sa vocală IA la trei niveluri: centrul de contact, aplicația pentru publicul larg și rețeaua însăși. Asistentul de apel IA rulează pe ElevenLabs și este integrat direct în rețea, ceea ce îl face disponibil pe orice dispozitiv mobil capabil să efectueze un apel, fără aplicație dedicată — cu asistență în direct în timpul apelurilor, traducere în timp real și transcriere/sumarizare a apelurilor. Parteneriatul a început ca un set de funcționalități de aplicație la începutul lui 2025 și s-a transformat într-o integrare în centrul serviciilor Deutsche Telekom, cu o extindere planificată.
🔗 Tweet
MiniMax detaliază foaia de parcurs open source pentru H3
După o sesiune AMA pe Reddit, MiniMax publică un rezumat al foii de parcurs open source pentru modelul său video H3. O tranziție către licența Apache-2.0 este „pe masă” odată ce chestiunile legate de drepturile de autor sunt clarificate, urmând să apară și un raport tehnic complet. MiniMax intenționează, de asemenea, să deschidă greutățile pentru H3-Regenerate-2K, un model de regenerare în spațiul latent care permite transformarea unui rezultat 768p în 2K, o implementare de sparse attention, o variantă cu latență redusă 4-NFE/8-NFE aflată în studiu și un model unificat de generare/editare de imagini derivat din linia H3. Workflow-ul Ref2VA permite deja concatenarea clipurilor pentru a produce videoclipuri de 60 de secunde.
🔗 Tweet
Agenți multimodali și finanțe IA-native
Qwen-MM-Plugins: transformarea agenților în multimodali-nativi
AlibabaQwen anunță Qwen-MM-Plugins, o familie de pluginuri destinată să facă orice mediu de execuție pentru agenți (_agent harness) multimodal-nativ: citire de imagini, videoclipuri și documente, editare video și lucru cu fișiere 3D/CAD. Ideea: în locul unui model multimodal izolat, un strat de pluginuri se adaugă peste mediul deja folosit de dezvoltator. Anunțul nu detaliază nici benchmark-uri, nici prețuri, nici o dată precisă de disponibilitate — rămâne la stadiul de teaser de produs, cu o demonstrație video alături. Acest lansare continuă strategia Qwen din 2026, care își extinde acum oferta spre tooling agentic multimodal, mai degrabă decât spre noi greutăți brute de model.
🔗 Tweet
Cinci lecții pentru construirea unei funcții finance IA-native
CFO-ul OpenAI, Sarah Friar, împărtășește cinci lecții pentru a construi o funcție finance IA-native, în jurul a două ambiții: un closing zero-day (vizualizare în timp real, reconciliată și trasabilă a finanțelor companiei) și o prognoză continuă. Printre lecții: să oferi acces tuturor, apoi să creezi un motiv pentru a-l folosi — ilustrat printr-un hackathon finance care a dat naștere la IR-GPT, un GPT personalizat pentru a răspunde la întrebările de due diligence ale investitorilor; să combini experimentarea de jos în sus cu strategia de sus în jos; să depășești foile de calcul statice în favoarea unor instrumente vii, susținute de contextul complet al activității; să construiești o responsabilitate clară în fiecare workflow; și să măsori randamentul investiției în IA.
🔗 Construirea unei funcții finance IA-native
Apar locuri Premium pentru ChatGPT Business
OpenAI lansează locuri Premium pentru ChatGPT Business, oferind celor mai activi colaboratori de 5 ori mai multă utilizare decât locurile Standard și fără limita de utilizare pe cinci ore.
| Tip de loc | Tarif lunar | Tarif anual (lunarizat) |
|---|---|---|
| Standard | $25/utilizator | $20/utilizator |
| Premium | $125/utilizator | $100/utilizator |
Companiile pot combina locuri Standard și Premium în același spațiu de lucru. Ofertă de lansare: proprietarii de spații de lucru care se înscriu înainte de 20 august 2026 primesc $100 în credite pentru fiecare loc Premium adăugat (până la $500 pentru cinci locuri), cu posibil acces anticipat înainte de disponibilitatea generală.
🔗 Locuri Premium pentru ChatGPT Business
Pe scurt
- Claude Code — câștiguri de performanță CPU și memorie: echipa indică îmbunătățiri importante ale utilizării CPU și ale memoriei la percentila 99 (P99 RSS) în ultimele luni, fără cifre precise comunicate. 🔗 Tweet
- CEO-ul Replit descrie „self-driving company” în Platformer: Amjad Masad detaliază viziunea sa despre o companie condusă de un bot intern și de agenți care folosesc aplicațiile în locul oamenilor. 🔗 Tweet
- Sakana AI își extinde RSI Lab către IA fizică: compania vrea să construiască modele ale lumii pentru IA fizică și recrutează cu normă întreagă și pentru stagii la Tokyo. 🔗 Tweet
- FC Bayern Munich se asociază cu Google Pixel și Gemini: parteneriat anunțat fără detalii privind natura exactă (sponsorizare, integrare de produs). 🔗 Tweet
- Gemini, sfaturi pentru vizitarea târgurilor agricole americane: articol lifestyle de pe blogul Google care enumeră cinci utilizări existente ale Gemini (itinerarii, Ask Maps, AI Mode, Gemini Live, editare foto), fără funcționalitate nouă. 🔗 Google Blog
- Facturare GitHub în India: clienții pot activa acum plata automată recurentă cu cardul salvat, printr-un mandat electronic conform cu Reserve Bank of India. 🔗 Changelog
- GitHub retrage abonamentele personalizate pe fir de discuție: vor rămâne disponibile doar stările Subscribed/Not subscribed, iar abonamentele personalizate existente vor trece automat la Subscribed. 🔗 Changelog
- NVIDIA optimizează vLLM pentru Qwen 3.5 pe GB200: optimizările ajung la 25 000 de tokeni pe secundă și pe GPU, în pregătirea lansării Qwen 3.8. 🔗 Tweet
- Codex Build Week — proiecte și câștigători în curând: OpenAI indică faptul că participanții și-au transformat ideile în proiecte reale cu Codex; anunțul câștigătorilor urmează. 🔗 Tweet
- Scrisoarea OpenAI către guvernatorul Texasului: compania detaliază angajamentul său pentru o dezvoltare responsabilă a infrastructurii IA în stat. 🔗 OpenAI
- Model ML accelerează munca de finance cu GPT-5.6 Sol: firma automatizează producția de deckuri PowerPoint și registre Excel trasabile, cu 36 % mai puțini tokeni decât Opus 5 pe un workflow Excel. 🔗 OpenAI
Ce înseamnă asta
Cursa pentru greutăți deschise se accelerează și se diversifică: Meta (Muse Glimmer), Alibaba (Qwen-MM-Plugins), MiniMax (foaia de parcurs H3) și Sakana AI (Fugu pe Gemma 4) publică toate, în aceeași săptămână, blocuri reutilizabile mai degrabă decât simple modele închise. Tendința depășește textul: NVIDIA deschide un TTS multilingv cu 357M de parametri, iar Sakana AI își justifică explicit alegerea prin suveranitatea digitală — un argument care reapare și la Together AI pentru găzduirea DeepSeek-V4-Flash în UE și în Statele Unite.
Siguranța IA trece din laborator în producția concretă. GPT-5.6-Cyber de la OpenAI nu se oprește la un scor de benchmark: a făcut să fie corectată o CVE reală în V8 și sute de vulnerabilități în alte locuri, toate acestea fiind însoțite de un regim de acces întărit (chei hardware obligatorii începând din septembrie). În oglindă, Anthropic afirmă că a neutralizat prompt injection-ul pe partea de apărare prin stivuirea model + clasificatori — două abordări complementare (atac instrumentat de o parte, apărare întărită de cealaltă) care arată că securitatea devine un ax de diferențiere de produs în sine, nu un subiect secundar.
Pe partea de infrastructură, economia inferenței continuă să se tensioneze: tehnica de distilare a Multiverse Computing reduce de 15 ori memoria GPU necesară, Together AI își consolidează parteneriatul cu Cursor pentru a respecta constrângeri stricte de latență în editarea de cod, iar Anthropic stabilizează pe termen lung prețul Sonnet 5. Privite împreună, aceste mișcări indică o presiune continuă asupra costurilor de inferență pe măsură ce utilizările agentice și interactive se generalizează.
În fine, IA se instalează în funcțiile suport ale companiilor la fel de mult ca în cercetarea fundamentală. OpenAI documentează cum propria sa funcție finance devine IA-native și lansează locuri ChatGPT Business cu capacitate extinsă, în timp ce Model ML raportează câștiguri concrete de tokeni pe workflow-uri Excel. La celălalt capăt al spectrului, rezultatul lui Claude asupra conjecturii Riemann — verificat formal și recitit de matematicieni externi — amintește că aceleași modele sunt implicate și în probleme de cercetare fundamentală, departe de cazurile de utilizare de produs.
Surse
- Meta lansează Muse Glimmer
- NVIDIA — endpoint GPU-accelerat Muse Glimmer
- OpenAI — Extinderea Daybreak pe măsură ce fereastra de apărare cibernetică se îngustează
- OpenAI — anunț Daybreak/GPT-5.6-Cyber pe X
- Anthropic — anunț Riemann pe X
- Anthropic — articol de cercetare Riemann
- Anthropic — tarif permanent pentru Sonnet 5
- Anthropic — prompt injection rezolvată în mare parte
- Amp — Am schimbat Dial
- GitHub — Copilot pe web extinde controalele de conversație
- NVIDIA — Magpie TTS Multilingual
- Multiverse Computing — distilarea cunoștințelor
- Together AI — DeepSeek-V4-Flash pe Ollama
- Sakana AI — Fugu × Gemma 4
- Together AI — parteneriat Cursor
- ElevenLabs — parteneriat Deutsche Telekom
- MiniMax — foaia de parcurs H3
- Alibaba_Qwen — Qwen-MM-Plugins
- OpenAI — Construirea unei funcții finance IA-native
- OpenAI — locuri Premium pentru ChatGPT Business
- Claude Code — câștiguri de performanță CPU/memorie
- Replit — self-driving company
- Sakana AI — RSI Lab IA fizică
- FC Bayern Munich × Google Pixel × Gemini
- Google Blog — Gemini și târgurile agricole
- GitHub — facturare în India
- GitHub — retragerea abonamentelor pe fir
- vLLM/NVIDIA — optimizări Qwen 3.5
- OpenAIDevs — Codex Build Week
- OpenAI — scrisoare către guvernatorul Texasului
- OpenAI — Model ML